乱雑な文字起こしを読みやすいテキストに変換
YouTubeのキャプション、Zoomの.vttファイル、または自動生成されたポッドキャストのエクスポートから得られるような生の状態の文字起こしを貼り付けると、タイムスタンプ、キャプションのキュー番号、「あの」「ええと」、「SPEAKER 1:」といったラベル、そして繰り返される行といった余分なものが除去されます。その後、分断されたキャプションの断片を、実際に読める段落に結合します。
この機能は完全にブラウザ内で実行されます。文字起こしがアップロードされることはありません。これは、クリーニングする対象がプライベートな通話や未公開のインタビューである場合に重要です。
AIではなくルール、そしてそれが重要な理由
名前に「AI」を含むほとんどのツールは、文字起こしをクリーンにするために言語モデルを使用します。これは文法を修正しますが、モデルが誰かの発言を静かに言い換えてしまう可能性も意味します。文字起こしにとって、それは最も望まないことです。「改善された」引用はもはや引用ではありません。
これは、代わりに単純なパターンルールでクリーニングを行います。トグルで有効にしたものだけを正確に削除し、他は何も削除しません。文を書き換えたり、句読点を追加したり、ぎこちない言い回しを滑らかにしたりすることはないため、残されたものはノイズを除いた話し手の実際の言葉そのままです。
正直なトレードオフとして、ルールベースであるため、AIが行うような文法修正や句読点の追加は行いません。それが目的であれば、後で文字起こしフォーマッターに通してください。これはAIを使用して話者の構造と可読性を追加します。まずジャンクを取り除くためにクリーンアップし、洗練させたい場合は次にフォーマットします。私は、読みやすい段落で十分なことがほとんどなので、80%の時間はクリーナー単独で使用しています。
削除するもの
これらはそれぞれトグルになっているので、必要なものは残し、残りは削除できます。
- タイムスタンプとキュー。SRTのシーケンス番号、
00:00:04,500 --> 00:00:08,200のようなタイミング行、WEBVTTヘッダー、および[00:05]や単独の00:01:32のようなインラインスタンプ。「文字起こしからタイムスタンプを削除」という、人々が最も検索する作業です。 - フィラーワード。明確な口癖:um、uh、er、hmm、「you know」、「i mean」。削除した数をカウントするので、録音がどれほどの「損傷」を与えたかを確認できます。
- 話者ラベル。
SPEAKER 1:、John:、[Interviewer]のような行頭タグ、およびZoomやキャプションツールが挿入する>>マーカー。 - 繰り返される行。自動キャプションは、再描画される際に同じ行を2回印刷することがよくあります。連続する重複は1つにまとめられます。
- 壊れた行間。キャプションは数単語ごとに改行されるため、文が4行に分割されて表示されます。結合によりそれらを再結合し、結果を段落に分割します。
特筆すべき意図的な選択として、「like」、「actually」、「basically」、または「so」は削除しません。これらはリスト上ではフィラーのように見えますが、しばしば本当の意味を持つため、削除すると文の意味が変わってしまいます。意図したことを編集するクリーナーは、余分な「like」を残すクリーナーよりも悪いため、これらは残されます。
YouTube、Zoom、またはポッドキャストの文字起こしをクリーンアップ
最も乱雑になりがちな3つの情報源は、このツールが最も得意とする3つです。
YouTubeのキャプションダンプは、ほぼすべての行にタイムスタンプが付いており、段落がまったくありません。コピーした文字起こしを貼り付け、タイムスタンプをオンにして結合すると、5単語の断片の山ではなく、ブログですぐに使えるブロックが得られます。
ZoomやTeamsでは、キュー番号、タイミング、そしてすべてのターンに話者ラベルが付いた.vttファイルが得られます。ファイルをドロップすると、クリーンな対話または流れるようなテキストとして返されます。話者名を保持するかどうかはあなた次第です。
ポッドキャストやインタビューの文字起こしは、通常すでにクリーンですが、人々が実際にそのように話すため、口頭のフィラーでいっぱいです。「um」を削除して結合すると、内容に手を触れることなく読み上げ時間が短縮されます。
Wordで文字起こしからタイムスタンプを削除する方法
人々がこれを検索するのは、Microsoft Wordの「検索と置換」で、ワイルドカードパターンを使って00:00:00に一致させようとしているからです。それはかろうじて機能しますが、パターンは面倒で、ファイルごとにタイムスタンプの形式が変わるとすぐに機能しなくなります。
ここにテキストを貼り付けるのが近道です。一般的なタイムスタンプの形式、SRT、VTT、および単独のHH:MM:SSを自動的に認識するため、ワイルドカード式を書いたり、4つの形式のために4回実行したりする必要はありません。ここでクリーンアップし、結果をWordに貼り付け直してください。
クリーンアップ後
文字起こしがクリーンになったら、次のステップにはそれぞれのツールがあります。AIを使って適切な話者構造と読みやすさを追加するには、文字起こしフォーマッターを使用してください。まず、動画または音声ファイルから直接クリーンな文字起こしを取得するには、文字起こしジェネレーターが文字起こしを行います。そして、クリーンアップされた文字起こしを字幕に変換するには、テキストからSRTへのコンバーターが、今回は意図的にタイムスタンプを戻します。
よくある質問
この文字起こしクリーナーは無料ですか?
はい、無料です。ブラウザ内で完結します。サインアップもアップロードも不要で、クリーンアップする文字起こしの数に制限はありません。作業はサーバーではなく、あなたのデバイスで行われるためです。
文字起こしはアップロードまたは保存されますか?
いいえ。クリーンアップはページ内で実行されるプレーンなJavaScriptであるため、テキストがブラウザから出ることはありません。何も送信、保存、ログ記録されないため、プライベートな通話や未公開のインタビューにはローカルクリーナーを使用することをお勧めします。
タイムスタンプだけを削除し、他はすべて残すにはどうすればよいですか?
タイムスタンプのトグルをオンにし、他のトグルをオフにしてください。これにより、SRTおよびVTTのタイミング行、シーケンス番号、そして[00:05]のようなインラインスタンプが削除され、話者ラベル、フィラー、改行は元のまま残ります。
「like」や「actually」のようなフィラーワードも削除されますか?
いいえ、意図的に削除しません。「um」や「uh」のような明確な口頭フィラーのみを削除します。「like」、「actually」、「basically」のような言葉は、しばしば本当の意味を持つため、それらを削除すると文が変わってしまいます。クリーナーは誰かが言ったことを編集すべきではありません。
クリーンアップできるファイルタイプは何ですか?
任意のテキストを貼り付けるか、.srt、.vtt、または.txtファイルをドロップしてください。このツールはファイルをローカルで読み込み、貼り付けられたテキストと同じ方法でクリーンアップします。約5MBまでのファイルはスムーズに動作しますが、それ以上の場合はテキストを貼り付けてください。
ルールベースのクリーナーはAI文字起こしクリーナーよりも優れていますか?
それらは異なる役割を果たします。このようなルールベースのクリーナーは、あなたの言葉を変えることなくノイズを除去するため、引用や記録にはより安全です。AIクリーナーは文法や句読点も修正しますが、言われたことを言い換える可能性があります。まずここでクリーンアップし、洗練させたい場合にのみ後でAIによる処理を行ってください。