話者ダイアリゼーション オンライン

複数の話者がいる録音をアップロードすると、誰が話しているかを示すラベルと、検索およびエクスポート可能なタイムスタンプが付いた文字起こしが作成されます。

ファイルはクラウドで処理されます。アプリで結果を使用および保存するには、無料アカウントが必要です。ファイルをダウンロードするには、有料プランが必要です。

MP3, WAV, M4A, AAC, OGG, FLAC, AMR, WMA

または音声リンクを貼り付け

YouTube、TikTok、Instagram、Vimeo、Google Drive、Dropbox、直接リンク

録音は転送中および保存時に暗号化され、AIモデルのトレーニングには使用されません。 プライバシー · セキュリティ

文字起こしで話者にラベルを付け、タイムスタンプを取得

複数の話者がいる音声または動画をアップロードするか、そのリンクを貼り付けると、ScreenAppは各話者の発言にタイムスタンプを付けた文字起こしを返します。録音はデバイスからアップロードする必要はありません。Dropbox、Google Drive、またはポッドキャストホストからのリンクも機能します。

ラベル付きの文字起こしがあれば、録音全体を聞き直すことなく、特定の人物が何を言ったかを見つけることができます。

得られるもの:

システムは、顔や名前を照合するのではなく、声によって話者を割り当てるため、すべての録音は汎用的なラベル(話者1、話者2)で始まり、後で名前を変更できます。

音声で話者を識別する方法

  1. アップロードまたはリンクを貼り付け: ファイル(MP3、M4A、MP4A、M4B、AAC、WAV、OGG、OPUS、FLAC、AIFF、WMA、WEBMA、MKA、AC3、EAC3、WV、AMR、DSF、DFF、最大2 GB(無料オンラインツールの場合))をドラッグするか、Dropbox、Google Drive、またはポッドキャストホストからのリンクを貼り付けます。
  2. 文字起こしは話者ごとに分離されます: 各音声には独自のラベルが付けられ、すべての発言にタイムスタンプが付きます。
  3. 名前を変更してエクスポート: 話者ラベルをクリックして名前を変更したり、チームメンバーに一致させたり、単一のセグメントを再割り当てしたりできます。完成した文字起こしをPDF、DOCX、TXT、SRT、VTTとしてエクスポートします。

クリアな音声で明確な声は最もよく分離され、重なり合う音声は、話者分離システムを混乱させる可能性がありますであるため、可能な限り話者が互いに話し合わないようにしてください。精度がどのように測定されるかを参照してください。

話者ダイアリゼーションと他のアプリの比較

機能ScreenAppAssemblyAIOtter.aiNotta
無料プラン文字起こし2回、45分$50クレジット300分/月、30分/会話120分/月、3分/会話
話者ラベル含まれる+$0.02/時アドオンベーシックプランから含まれる含まれています
言語100+未記載658
エクスポート形式PDF、DOCX、TXT、SRT、VTT未記載無料プランでmp3とtxt、Pro以上でpdf、docx、srtも利用でき、Business以上で一括エクスポートに対応TXT、DOCX、PDF、またはXLSX
有料プラン$19/月(年間請求)$0.15/時間$8.33/月(年間請求)$8.17/月(年間請求)

Sources, checked 2026-09-24: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, assemblyai.com/pricing, otter.ai/pricing, notta.ai/en/pricing, notta.ai/en, notta.ai/en/lecture-summarizer

  • AssemblyAIとの比較: AssemblyAIは開発者APIであり、話者ダイアリゼーションを+$0.02/時のアドオンとして追加した場合、1時間の音声あたり$0.15で、新規アカウントには$50の無料クレジットが付与されます。ScreenAppは完成されたアプリであり、ファイルをアップロードするだけで、ラベル付きの文字起こしが返され、統合は不要です。
  • Otter.aiとの比較: Otterの無料プランは月間300分で、1会話あたり30分に制限されており、話者識別はベーシックプランから利用できます。ScreenAppの無料プランは、文字起こし2回まで、各録音最長45分の録音で、話者ラベルは最初から含まれています。
  • Nottaとの比較: Nottaの無料プランでは、月間120分(最長3分のクリップ)が提供され、話者識別が含まれています。Nottaは58言語を文字起こしし、ScreenAppは100+言語を文字起こしします。

話者ダイアリゼーションの利用者

ポッドキャスターは、生の音源をアップロードし、ホストとゲストに分割された文字起こしを取得して、番組のメモやエピソードの文字起こしページに貼り付けることができます。

会議やインタビューのメモは、音声だけで誰が何を言ったかがわかる場合に役立ちます。インタビュアーは、話者分割を使用して、聞き直すことなく自分の質問と回答を分離します。

研究者は、フォーカスグループや定性インタビューを実施する際に、一貫した話者ラベルを使用して、誰が何に貢献したかを追跡し、手動で発言にラベルを付ける手間を省きます。

法律および医療専門家は、供述録取書、クライアントとの通話、相談の際に、各発言にタイムスタンプが付いた話者ラベル付きの文字起こしを必要とします。

FAQ

話者ダイアリゼーションとは何ですか?

話者ダイアリゼーションとは、録音の中で誰がいつ話したかを特定するプロセスです。システムは音声を声ごとにグループ化し、各セグメントに話者ラベルを割り当てるため、文字起こしは話者1、話者2などのように、各発言にタイムスタンプが付いて表示されます。

話者ダイアリゼーションの精度はどのくらいですか?

精度は録音に依存します。クリアな音声で明確な声は最もよく分離され、重なり合う音声は、話者分離システムを混乱させる可能性がありますです。精度の測定方法を参照してください。

何人の話者を識別できますか?

ダイアリゼーションは、録音で検出されたすべての異なる声にラベルを割り当てます。2人の話者からグループ全体の会話まで対応します。話者の数が増えるほど、特に声が似ていたり、発言が重なったりすると、分離が難しくなります。

ポッドキャストにも使えますか?

はい、使えます。エピソードファイルをアップロードするか、ポッドキャストホストからのリンクを貼り付けると、各ホストとゲストに個別の話者ラベルが割り当てられ、文字起こしで名前を変更できます。

リアルタイムでダイアリゼーションできますか?

いいえ、これはアップロードツールです。録音が終了した後にファイルまたはリンクを処理するもので、リアルタイムではありません。ライブ会議の場合は、通話中に録音と文字起こしを行う会議レコーダーを使用してください。

どのような音声および動画形式に対応していますか?

音声: MP3、M4A、MP4A、M4B、AAC、WAV、OGG、OPUS、FLAC、AIFF、WMA、WEBMA、MKA、AC3、EAC3、WV、AMR、DSF、DFF。動画: MP4、M4V、MOV、AVI、WEBM、MKV、FLV、TS、MTS、M2TS、3GP、3GPP、3G2、WMV、ASF、VOB、OGV、RM、RMVB、MPG、MPEG、M2V、F4V、MXF。最大2 GB(無料オンラインツールの場合)のファイルが受け入れられます。アップロードする代わりにリンクを貼り付けることもできます。

特定の人物を名前で識別できますか?

自動的にはできません。システムは声のみに基づいて汎用的なラベル(話者1、話者2)を割り当てます。既知のIDと声を照合することはありません。その後、話者ラベルをクリックして名前を変更したり、チームメンバーに一致させたり、単一のセグメントを再割り当てしたりできます。

無料プランはありますか?

はい、あります。文字起こし2回まで、各録音最長45分の録音で、話者ラベル、タイムスタンプ、エクスポートが含まれます。年間請求で月額$19のProプランでは、録音制限が解除されます。

実際のユーザーからの実際の結果

works like a charm, notes have been super helpful alongside chat function. loveeeee
KS
Katharine Suy
Chrome Web Store, October 17, 2024
nice app for important summary
S
SAHIL
Google Play, January 30, 2026

生産性を向上させる準備はできていますか?

無料アカウントで話者ダイアリゼーションを始められます。利用制限があり、アプリのダウンロードには有料プランが必要です。

無料で開始 →

60秒で使い始める