行と、それが来たタイムコードを見つける
トランスクリプトを貼り付けるか、SRTまたはVTTファイルをドロップし、探している単語を入力すると、すべての検索結果にタイムスタンプが添付されて返されます。「ファイル内のどこか」ではなく、12:04、この行で、入力した用語が文脈でハイライト表示されます。
ブラウザで実行されます。トランスクリプトはデバイス上で解析および検索されるため、トランスクリプトが未公開のインタビューや社内通話である場合に重要です。
なぜCtrl+Fを使うだけではダメなのか
なぜなら、Ctrl+Fは単語を見つけても、そこで行き詰まってしまうからです。テキストの壁の真ん中で「pricing」をハイライト表示しても、それが録音のどこであったか全くわかりません。本当に必要だったのはタイムコードです。
字幕ファイルはさらに悪化させます。`.srt`ファイルを開くと、半分は足場です。シーケンス番号、矢印付きのタイミング行、そして2行のテキストが何度も繰り返されます。Ctrl+Fはその乱雑な中で一致を見つけ、どのキューにたどり着いたかを確認するために逆算しなければなりません。これは最初にキューを解析するため、テキストは読みやすく、各一致はすでに自身の開始時刻を知っています。
また、折り返された行を結合し直します。キャプションファイルは1つの文を3つのキューに分割することがあるため、「usage based pricing」のようなフレーズはファイル内で分割され、Ctrl+Fでは単純に見つけることができません。ここでは、検索前にキューテキストが結合されるため、そのフレーズはあなたが言う通りの方法で一致します。
YouTubeのトランスクリプトを検索する
YouTubeはトランスクリプトを表示しますが、それを検索する方法は提供しません。動画を開き、説明の下にある「トランスクリプトを表示」をクリックすると、タイムスタンプ付きのスクロールパネルにすべて表示されますが、検索ボックスはどこにもありません。40分の動画で1つの文章を探している場合、そのパネルはほとんど役に立ちません。
その回避策は3つのステップです。そのパネル内のトランスクリプトテキストを選択し、コピーして、ここに貼り付けます。YouTubeのトランスクリプトにはタイムコードが添付されているため、返されるすべての一致は依然として動画の正しい時点を指します。その後、単語を検索します。
YouTubeのほとんどを占める自動生成キャプションでも同様に機能します。これらは検索する価値があります。なぜなら、自動キャプションは、言葉遣いの記憶を信頼できないまさにその場所であり、その瞬間に戻るために必要なタイムスタンプを持っているからです。
電話ではCtrl+Fがない
これは誰も良い答えを持っていない問題のバージョンです。ラップトップでは少なくともCtrl+Fに頼ることができます。電話ではYouTubeアプリにページ内検索がまったくなく、トランスクリプトパネルは検索機能のないサムスクロールです。
そのため、モバイルでのフローは同じ3つのステップであり、時間を節約し、それどころかより多くの時間を節約できます。アプリでトランスクリプトを開き、それをコピーし、電話のブラウザでこのページを開き、貼り付けて検索します。ページは電話の幅で機能し、検索はデバイス上で実行されるため、1つの単語を見つけるためにモバイルデータ経由でトランスクリプトを送信することはありません。
意図的な完全一致
これはリテラル文字列マッチングです。入力した文字のみを見つけ、それ以外は何も見つけません。それは意図的な制限であり、欠けている機能ではありません。
完全一致検索は、単語を知っている場合に欲しいものです。例えば、製品名、誰かが言った数字、人の姓、引用しているフレーズなどです。再現性があり、そのカウントを信頼できるため、ジャーナリストや研究者はこれを利用します。
単語を知らない場合は、間違ったツールです。「チャーンについて話している部分を見つける」という仕事で、誰も「チャーン」という単語を言っていない場合、完全一致は何も返しませんが、その瞬間はそこにあります。それはセマンティック検索の仕事であり、動画自体をインデックス化し、スペルではなく意味によって瞬間を見つけるビデオファインダーに属します。2つの異なる質問に対する2つの異なるツールであり、どちらを持っているかを知る価値があります。
完全一致と大文字/小文字の区別がその価値を発揮する
どちらのトグルも、一度でも助けられるまでは面倒に感じるかもしれません。
「AI」を単語全体の一致なしで検索すると、「said」、「again」、「sustainable」、「maintain」など、その2文字が埋め込まれている他のすべての単語が見つかります。単語全体の一致をオンにすると、実際に話された場所のアクロニムだけが得られます。これは、トランスクリプト検索がおかしく見える最も一般的な理由です。
大文字/小文字の区別は逆の役割を果たします。トランスクリプトでは大文字/小文字が inconsistent に扱われることが多く、話し手が文を始めたからといってヒットを見逃したくないため、デフォルトではオフにしておきましょう。大文字/小文字がポイントである場合にオンにします。例えば、企業「Apple」を果物から区別したり、頭字語を一般的な単語から区別したりする場合です。
実際にこれを行うのは誰か
インタビュー録音から作業するジャーナリストが、引用のための正確な文とタイムコードを見つけ、ビデオ編集者がクリップを抜き出せるようにします。タイムコードは成果物の半分です。
質的インタビューをコーディングする研究者が、セッション全体で特定の用語が何回出現したかを数えます。これは一致が文字通りであるため、裏付けのある数字です。
サポートチームや製品チームが、デモやウェビナーの録画を検索して、機能がどこで説明されたかを見つけ、顧客に時間ではなく分単位でリンクできるようにします。
そして、うろ覚えの引用文を探す編集者。その場合、単語全体の一致と短いフレーズが、毎回スクロールするよりも優れています。
まだトランスクリプトがない場合
これはすでにお持ちのテキストを検索します。録音からまずトランスクリプトを作成するには、トランスクリプトジェネレーターが話者ラベル付きで生成します。お持ちのトランスクリプトがタイムスタンプやフィラーでごちゃごちゃしている場合、トランスクリプトクリーナーがブラウザでそれらを削除します。そして、完成したトランスクリプトを字幕ファイルにするには、テキストからSRTへのコンバーターがタイミングを処理します。