複数話者文字起こし

複数話者が話している録音をアップロードするか、ライブで録音すると、各話者にラベルとタイムスタンプが付いた文字起こしが作成されます。

MP4、M4V、MOV、AVI、WEBM、MKV、FLV、TS、MTS、M2TS、3GP、3GPP、3G2、WMV、ASF、VOB、OGV、RM、RMVB、MPG、MPEG、M2V、F4V、MXFに対応。最大45分まで無料でお試しいただけます。インストール不要。

MP4, MOV, WEBM, MKV, AVI, FLV, MTS, 3GP

または動画リンクを貼り付け

YouTube、TikTok、Instagram、Vimeo、Google Drive、Dropbox、直接リンク

録音は転送中および保存時に暗号化され、AIモデルのトレーニングには使用されません。 プライバシー · セキュリティ

話者識別 AIノートとチャット 複数のエクスポート形式

複数話者の録音を文字起こしし、各話者にラベルを付ける

複数人が話している録音をアップロードするか、リンクを貼り付けると、ScreenAppは各話者にラベルと各行にタイムスタンプが付いた文字起こしに変換します。ブラウザレコーダーまたはiOSおよびAndroidアプリで会話をライブ録音するか、通話用にZoom、Google Meet、Microsoft Teams 用の会議ボットを接続し、ファイルができたらアップロードします。

ラベル付きの文字起こしは、誰が何を言ったかを確認するために録音を何度も聞き直す手間を省きます。

得られるもの:

  • 100+言語で話者識別を含む文字起こし
  • 任意の録音とのAIチャットにより、文字起こし全体をスキャンする代わりに、特定の話し手が何を言ったかを尋ねることができます
  • AIノート:所有者と期限付きのアクションアイテム、および個別にリストされた決定事項
  • PDF、DOCX、TXT、SRT、VTTとしてエクスポート
  • 無料プラン:最大45分の録音の文字起こし2回、AIチャット付き

複数話者を文字起こしする方法

  1. アップロードまたはリンクを貼り付け: 音声または動画ファイル(MP4、M4V、MOV、AVI、WEBM、MKV、FLV、TS、MTS、M2TS、3GP、3GPP、3G2、WMV、ASF、VOB、OGV、RM、RMVB、MPG、MPEG、M2V、F4V、MXF)をドラッグするか、リンクを貼り付けます。開始するためにアカウント設定は不要です。
  2. 文字起こし: 音声がテキストに変換され、各話者が個別の話者ラベルに分割され、すべての文にタイムスタンプが付けられます。
  3. 確認とエクスポート: ブラウザで文字起こしを読み、必要に応じて話者ラベルの名前を変更し、PDF、DOCX、TXT、SRT、VTTとしてエクスポートします。

精度は音声と話されている言語に依存します。100+のサポートされている言語のうち25は単語レベルの話者ダイアライゼーションをサポートしています。残りの言語は話者ごとのラベルなしでテキストに文字起こしされます。参加者が近くにいてクロストークが少ない単一のマイクも、話者間の最も明確な分離を提供します。精度の測定方法をご覧ください。

複数話者文字起こしと他のアプリの比較

機能ScreenAppOtter.aiRevSonix
無料プラン文字起こし2回、各録音最大45分300分/月45分/月 (AI)30分トライアル
話者識別含まれるベーシック含まれる含まれる
話者名変更話者ラベルをクリックして名前を変更したり、チームメンバーに一致させたり、単一のセグメントを再割り当てしたりできます記載なし記載なし記載なし
AIノート含まれるPro、年払い$8.33/月、または月払い$16.99記載なし記載なし
エクスポート形式PDF、DOCX、TXT、SRT、VTT無料プランでmp3とtxt、Pro以上でpdf、docx、srtも利用でき、Business以上で一括エクスポートに対応記載なしDOCX、PDF、TXT、SRT、VTT
言語100+6記載なし54+
有料プラン年払い$19/月年払い$8.33/月年払い$25.49/月$25/月

Sources, checked 2026-10-01: screenapp.io/accuracy#languages, screenapp.io/help/how-many-minutes-can-i-record, ScreenApp pricing, otter.ai/pricing, rev.com/pricing, sonix.ai/pricing, Editing speaker labels

  • Otter.aiとの比較: Otterの無料プランは月300分に制限されており、無料プランでの話者識別はベーシックです。ScreenAppはすべてのプランで話者ラベルを含み、後からラベルの名前を変更できます。
  • Revとの比較: Revの無料プランは月45分のAI文字起こしを提供し、その後はAI文字起こしに$25.49/月(年払い)、または人間による文字起こしに$1.99/分かかります。複数話者の録音を繰り返し行うと、どちらの料金でもすぐに高額になります。
  • Sonixとの比較: Sonixは1回限りの30分間のトライアルを提供し、その後は月$25ドルのプランです。ScreenAppの無料プランは1回限りのトライアルではなく、更新されます。

複数話者文字起こしの利用者

ジャーナリストは、複数の情報源とのインタビューやパネルディスカッションを文字起こしし、事実確認のためにタイムスタンプ付きで各話者を直接引用します。

ポッドキャストプロデューサーは、ホストと複数のゲストとのエピソードを文字起こしし、話者ごとに会話を分割して番組ノートやクリップを作成します。

研究者は、グループインタビューやフォーカスグループを文字起こしし、話者ごとに文字起こしを読んで各参加者がどのように答えたかを確認します。

採用および人事チームは、複数の面接官と候補者とのパネルインタビューを文字起こしし、後でファイルを確認する人が誰が何を尋ねたかを確認できるようにします。

法務およびコンプライアンスチームは、証言、複数当事者間の通話、およびどの人物がどのセリフを言ったかを知ることが重要な録音された声明を文字起こしします。

ドキュメンタリーおよびビデオチームは、複数の被写体とのインタビュー映像を文字起こしし、話者ラベルを使用して各時点で誰がカメラに映っているかを記録します。

FAQ

文字起こしにおける「話者識別」とはどういう意味ですか?

文字起こしが各瞬間に誰が話しているかをマークすることを意味します。つまり、1つのテキストブロックではなく、各人物の個別のラベル付き行が得られます。

ScreenAppはどのように話者を識別しますか?

話者識別は音声を個別の声に分割し、100+言語で文字起こし内の各声にラベルを付けます。

話者識別はすべての言語で機能しますか?

いいえ。単語レベルの話者ダイアライゼーションは、100+のサポートされている言語のうち25で実行され、言語リストにダガーでマークされています。他の言語での録音は、話者ごとのラベルなしでテキストに文字起こしされます。

ScreenAppは人々が互いに話し合っている状況をどのように処理しますか?

重なり合う音声は、話者分離システムを混乱させる可能性があります。クロストークが少ない単一の中央マイクは、話者間の最も明確な分離を提供します。

ScreenAppは文字起こし前にバックグラウンドノイズを低減しますか?

いいえ。ScreenAppはノイズリダクションを適用しません。静かな録音環境と話者に近いマイクは、騒がしい部屋よりもクリーンな文字起こしを生成します。

複数話者文字起こしをエクスポートできますか?

はい、PDF、DOCX、TXT、SRT、VTTとしてエクスポートできます。話者ラベルとタイムスタンプはエクスポートされたファイルに保持されます。

特定の話し手が何を言ったかについて質問できますか?

はい、任意の録音とのAIチャットを使用すると、議論について質問し、誰が言ったかを含め、録音のその時点を指す回答を得ることができます。

複数話者の録音はプライベートに保たれますか?

録音は転送中に暗号化されますで、AES-256で保存され、SOC 2 Type 2インフラストラクチャ上にあり、AIモデルのトレーニングには使用されませんです。セキュリティ管理はトラストセンターで公開されています。

First-party usage data

2,167,954

speakers identified

across all transcribed recordings to date. Pulled at build time from the ScreenApp production database. Methodology: see the accuracy page.

First-party production data

What ScreenApp users actually record

Top content types across 73,857 labelled recordings in the last 90 days. Pulled at build time from videometainfo.meetingType in production. Methodology: accuracy page.

14,348

training

19.4% of labelled

14,287

podcast

19.3% of labelled

13,377

call

18.1% of labelled

13,126

meeting

17.8% of labelled

11,010

lecture

14.9% of labelled

3,398

webinar

4.6% of labelled

3,020

presentation

4.1% of labelled

1,291

interview

1.7% of labelled

コンテンツを転写する準備はできましたか?

複数話者が話している録音をアップロードするか、ライブで録音すると、各話者にラベルとタイムスタンプが付いた文字起こしが作成されます。