あらゆる動画リンクから音声を抽出
MP4、MOV、MKV、WebMファイルをエクストラクターにドラッグ&ドロップし、出力形式(MP3、WAV、AAC、FLAC、M4A)を選択すれば、1分以内にオーディオトラックをダウンロードできます。MP3では64kbpsから320kbpsまでビットレートを選択でき、ソースが対応していればロスレスの16ビットおよび24ビットWAVも利用可能です。最大2GBまでのファイルは直接アップロードされ、より大きな元のファイルはチャンク転送で処理されます。
リンクを貼り付け、形式を選択し、ダウンロード。YouTube、ソーシャルメディア、その他1000以上のプラットフォームに対応しています。YouTubeに特化した変換については、YouTubeからWAVへの変換ツール比較をご覧ください。まず動画全体を取得するには、最適なYouTubeからMP4への変換ツールをお読みください。
得られるもの:
- 320kbps MP3またはロスレスWAV
- 15~60秒での処理
- ソフトウェアのインストール不要
- 動画全体をダウンロードせずに音声を抽出
- 1000以上のプラットフォームをサポート
- 無料利用、登録不要
ファイルは24時間後に自動削除されます。個人データは必要ありません。
動画リンクから音声をダウンロードする方法
- URLをエクストラクターに貼り付ける
- 形式を選択:MP3、WAV、AAC、またはFLAC
- 処理完了まで15~60秒待つ
- ファイルをダウンロード
このツールはソースからストリームデータを直接取得します。バッチモードでは複数のリンクを一度に処理できます。すべての転送はSSLを使用します。
無料、登録不要。
適切な形式とビットレートを選択する
オーディオファイルには様々な種類があり、最適な選択は、そのファイルを次にどう利用するかによって異なります。当てずっぽうではなく、以下の意思決定表を使ってユースケース別に選択してください。一般的なワークフローごとに、当社が推奨する形式、ビットレート、サンプルレート、チャンネルレイアウト、そして特定の制約がある場合の代替案をリストアップしました。
| ユースケース | 形式 | ビットレート | サンプルレート | チャンネル | 備考 |
|---|---|---|---|---|---|
| ポッドキャスト公開 (Apple Podcasts, Spotify) | MP3 | 192 kbps | 44.1 kHz | モノラルまたはステレオ | Appleの提出ガイドは128-320 kbpsを受け入れます。192が最適なポイントです。 |
| オーディオブック (ACX / Audible) | MP3 | 192 kbps CBR | 44.1 kHz | モノラル | ACXは正確にモノラルCBRを要求します。ステレオは拒否されます。 |
| Whisper文字起こし (OpenAI API) | WAV (PCM) | n/a (ロスレス) | 16 kHz | モノラル | Whisperは内部でリサンプリングするため、16 kHz モノラルは帯域幅を節約します。 |
| AssemblyAI/Deepgram文字起こし | MP3またはWAV | MP3の場合96-192 kbps | 16 kHz以上 | モノラル | 彼らのドキュメントはどちらも受け入れます。モノラルを推奨します。 |
| 音楽サンプリング / 制作 | FLAC | n/a (ロスレス) | 48 kHz | ステレオ | ビデオが48 kHzだった場合、ソースを保持します。CD時代のプロジェクト用にミックスする場合は44.1に切り替えてください。 |
| 音楽サンプリング / ハイレゾ | WAV (PCM) | n/a (ロスレス) | 96 kHz | ステレオ | ソースが48 kHz以上で録音された場合のみ有用 (ウェブビデオでは稀) |
| iOSボイスメモ互換性 | M4A (AAC-LC) | 64-128 kbps | 44.1 kHz | モノラル | ボイスメモのデフォルトです。iOSが期待するものと一致します。 |
| 音声クローン (ElevenLabsなど) | WAV (PCM) | n/a (ロスレス) | 22.05 kHz | モノラル | ElevenLabsはアップサンプリングします。22 kHzは品質を損なわずにアップロードサイズを削減します。 |
| YouTubeコンテンツ (オーディオとして再アップロード) | M4A内のAAC | 192 kbps | 48 kHz | ステレオ | YouTubeのオーディオリファレンスと一致します。 |
| 電話インタビューアーカイブ | MP3 | 64 kbps | 16 kHz | モノラル | 電話の帯域幅はせいぜい8 kHz広帯域であり、それ以上のスペックは無駄です。 |
| 音楽識別 (Shazamスタイル) | WAV (PCM) | n/a | 44.1 kHz | モノラル | 音楽IDサービスは10-15秒の未処理オーディオを必要とします。 |
| 音声学習 (TTSデータセット) | WAV (PCM) | n/a | 24 kHz | モノラル | Coqui TTSおよび同様のデフォルトです。 |
| DJセット / クラブ再生 | WAV (PCM) | n/a | 44.1 kHz | ステレオ | ほとんどのDJソフトウェア (Serato, Rekordbox) は、キューポイントの精度のためMP3よりもWAVを好みます。 |
これらのデフォルトの理由
MP3 192 kbps モノラル vs. 320 kbps ステレオ: 音声コンテンツ (ポッドキャスト、オーディオブック、インタビュー) の場合、ソースがモノラル録音であるため、192 kbpsのモノラルは320 kbpsのステレオと事実上区別できません。ステレオは同じ信号を二度エンコードするためバイトを無駄にします。
44.1 vs 48 kHz: 48 kHzはビデオ業界の標準、44.1 kHzは音楽/CDの標準です。ダウンストリームツールが両方を受け入れる場合、ソースに一致する方を選択してください。リサンプリングは何も追加しません。
MP3 vs AAC vs Opus: AACは同じビットレートでMP3よりも音質が良いですが、互換性は狭くなります (一部のポッドキャストホストはまだMP3を要求します)。Opusは低ビットレートでの音質において最高のコーデックですが、ウェブ/ストリーミング以外では互換性が最も低いです。
ScreenAppで設定できること
- 形式: MP3, WAV, AAC (M4A), FLAC, OGG (Vorbis), Opus
- ビットレート (MP3/AAC/OGG): 64, 96, 128, 160, 192, 224, 256, 320 kbps (またはVBRバリアント)
- サンプルレート: 8, 11.025, 16, 22.05, 24, 32, 44.1, 48, 88.2, 96 kHz
- チャンネル: モノラル (ダウンミックス), ステレオ, またはオリジナル
- トリミング: 抽出前に開始/終了秒数をオプションで指定 (2分必要なのに2時間抽出しないように)
出力スペックの確認
抽出後、ffprobe を出力ファイルに対して実行し、要求したスペックと一致するか確認してください。
ffprobe -v error -show_entries stream=codec_name,bit_rate,sample_rate,channels -of default=noprint_wrappers=1 your-audio.mp3
MP3 192 kbps 44.1 kHz mono の期待される出力:
codec_name=mp3
bit_rate=192000
sample_rate=44100
channels=1
何が必要か不明な場合は、192 kbpsステレオ44.1 kHzのMP3が、消費者向けユースケースの約95%において安全なデフォルトです。上記の意思決定表は、そのデフォルトが適合しない場合に使用します。
オーディオエクストラクター比較
| 機能 | ScreenAppオーディオエクストラクター | Audacity | FFmpeg | VLCメディアプレイヤー | CloudConvert | オーディオエクストラクター |
|---|---|---|---|---|---|---|
| アクセス | ウェブ、インストール不要 | デスクトップインストール (Win/Mac/Linux) | コマンドラインインストール | デスクトップインストール | ウェブ | ウェブ |
| インターフェース | UI、ドラッグ&ドロップ | タイムラインエディター付きUI | CLIのみ | UI (変換/保存ダイアログ) | UI | UI |
| 出力形式 | MP3, WAV, AAC, FLAC, M4A | WAV, MP3 (LAME付き), FLAC, OGG | ffmpegがサポートするすべての形式 | MP3, OGG, FLAC, WAV | MP3, WAV, AAC, FLAC, M4A, OGG | MP3, WAV, M4A, FLAC, OGG |
| ビットレート制御 | 64-320kbps MP3, 16/24ビット WAV | エクスポートダイアログで完全制御 | フラグで完全制御 | 制限されたプリセットビットレート | 64-320kbps | 64-320kbps |
| バッチ処理 | はい | マクロ (手動設定) | シェルループ経由で可能 | いいえ | はい (有料プラン) | 単一ファイル |
| URLからのソース | はい、リンクを貼り付け | いいえ、ローカルファイルのみ | 入力URLで可能 | はい、ネットワークストリーム入力 | はい | はい |
| 学習曲線 | 数分 | 数時間 (タイムラインUI) | 急勾配 (フラグ構文) | 中程度 | 数分 | 数分 |
| 無料枠の制限 | 3回抽出 | 無制限 (オープンソース) | 無制限 (オープンソース) | 無制限 (オープンソース) | 1日25回変換 | 広告付きで無制限 |
| 最適な用途 | URLから素早く取得、インストール不要 | 抽出中の編集 | スクリプト化されたパイプライン | ローカルファイル変換 | 形式の柔軟性 | 単一の簡単な作業 |
Audacityとの比較: 無料でオープンソースですが、エクスポートする前にファイルをタイムラインに読み込みます。同じセッション中にトリミングやノーマライズを行いたい場合に便利です。ScreenAppはエディタをスキップし、トラックを直接出力します。
FFmpegとの比較: ffmpeg -i input.mp4 -vn -acodec libmp3lame -b:a 320k output.mp3を知っていれば最も強力なオプションです。UIもリンク貼り付けもプログレスバーもありません。スクリプトやCIパイプライン内で役立ちます。
VLCとの比較: メディア > 変換/保存の下に隠れており、ビットレートの選択を制限するプリセットプロファイルがあります。ローカルファイルには機能しますが、URLワークフローには適していません。
CloudConvertとの比較: ウェブベースで幅広い形式をサポートし、1日25回まで無料で変換できます。有料プランは変換時間に応じて課金されます。ScreenAppの無料枠は3回の抽出に制限されますが、有料プランには分単位の課金メーターはありません。
Audio Extractorとの比較: 広告付きのウェブツールで、一度に単一ファイルのみ、バッチキューはありません。ScreenAppは広告を削除し、バッチサポートを追加します。
後でオーディオを文字起こしする必要がありますか? オーディオ文字起こしツールのガイドをご覧ください。
利用者
ポッドキャスターは、録画されたビデオインタビューからクリーンなオーディオを抽出し、再録音せずにその会話をエピソードとして再公開します。
ミュージシャンは、ライブパフォーマンスの映像から分離されたオーディオを抽出し、ドラムヒット、ボーカルフレーズ、または楽器のトーンをソースビットレートでサンプリングします。
ジャーナリストは、フィールドインタビューの録音からオーディオトラックを剥がし、文字起こしツールやエディターが完全なMP4ではなく、より小さいMP3で作業できるようにします。
語学教師は、ネイティブスピーカーのビデオから短い発音の断片を保存し、Ankiデッキや教室での再生に読み込みます。
文字起こし業者は、ビデオを16kHzモノラルWAVに前処理してから、Whisper、faster-whisper、またはオーディオ入力を好む他の音声テキスト変換モデルに供給します。
音声が小さすぎる、または同期がずれている場合
時折2つの問題が発生しますが、どちらも抽出ではなくソースに起因します。出力が静かな場合は、通常、元のビデオが静かだったことを意味し、エクストラクターはそこにあるレベルをそのまま抽出し、ブーストしません。そのため、より大きな音が必要な場合は、後でノーマライズ処理を実行してください。片方のチャンネルがサイレントな場合、ソースは片側にモノラル録音されていた可能性が高いため、エクスポート時にモノラルにダウンミックスすると両耳から音が聞こえるようになります。
音声が映像より先行したり遅れたりする同期ずれは、後でビデオと再度ペアリングする場合にのみ問題となります。スタンドアロンのMP3には同期するものがありません。フレーム精度の同期が必要な場合は、トリミングせずに抽出し、後でカットしてください。抽出中のトリミングでは、可変フレームレートのソースでわずかなオフセットが発生する可能性があります。
FAQ
ビデオリンクから音声をダウンロードするにはどうすればよいですか?
URLを貼り付け、MP3またはWAVを選択し、処理が完了したらダウンロードしてください。15〜60秒かかります。インストールは不要です。
ビデオリンクから音声を無料でダウンロードできますか?
はい。無料枠では、最初の抽出を320kbps MP3またはロスレスWAVで行えます。サインアップは不要です。
安全ですか?
転送にはSSLを使用しています。ファイルは24時間後に自動的に削除されます。個人データは保存されません。
どのプラットフォームで動作しますか?
YouTube、Vimeo、Facebook、Instagram、TikTok、Twitter、Dailymotion、その他1000以上のプラットフォームで動作します。公開されているURLであればどれでも機能します。
抽出にはどのくらい時間がかかりますか?
通常30秒未満です。長いビデオの場合は最大60秒かかることがあります。
どのような形式で抽出できますか?
MP3 (320kbps)、WAV (ロスレス)、AAC、FLACです。品質はソースに一致します。
完全なビデオをダウンロードせずに音声だけを取得できますか?
はい。このツールはソースから直接ストリーミングし、音声トラックのみを保存します。完全なビデオがデバイスに触れることはありません。
リンクをコピーして音声をダウンロードするにはどうすればよいですか?
ブラウザのアドレスバーまたは共有メニューからビデオリンクをコピーし、エクストラクターに貼り付け、音声をダウンロードします。YouTubeのURL、リールリンク、または直接のビデオアドレスをコピーした場合でも、同じように動作します。
リンクから曲をダウンロードできますか?
はい。リンクを貼り付けるとエクストラクターが音声トラックを抽出するため、ビデオリンクから曲、または任意の音声をMP3、WAV、またはAACとしてダウンロードできます。出力はソースの品質を超えることはできません。
リール音声にも対応していますか?
はい。YouTubeリール、Instagramリール、またはその他のショートフォームビデオリンクを貼り付けると、フルレングスのビデオと同じ方法で音声を抽出します。
ビデオリンクから音声を無料でダウンロードするにはどうすればよいですか?
ビデオリンクを貼り付けるとエクストラクターが音声トラックを抽出するため、MP3、WAV、またはAACとして無料でダウンロードを試すことができます。これはリンクによる音声ダウンロードです。ファイルをアップロードする必要はなく、必要なビデオのURLだけです。