公開前に録音をチェックする
オーディオファイルをドロップすると、波形をデコードして測定します。ピークがどれくらい大きくなるか、クリッピングが発生したか、平均レベル、そして音声の下にある背景ノイズの量などです。スコアが得られ、スコアよりもさらに役立つ実際の数値と、それぞれについてどうすべきかがわかります。すべてブラウザ内で完結するため、録音がデバイスから離れることはありません。
これは、ポッドキャスト、ナレーション、インタビューを録音した後、そしてソースで壊れていたものを編集するのに1時間費やす前に必要なチェックです。クリッピングと埋もれたノイズフロアは、編集では修正できない2つの問題なので、今それらを見つけることが最も重要な点です。
実際に測定するもの
各数値は、モデルによる推測ではなく、サンプルから直接得られます。
ピークレベルはdBFSで表されます。ゼロが上限です。ピークが0.0にあり、多数のサンプルがそこに固定されている場合、波形はクリッピングされ、上部が角張っており、その歪みは焼き付いています。チェッカーは、最大に達したサンプルの割合を数え、失敗としてフラグを立てます。なぜなら、オーディオを非クリッピングにするプラグインは存在しないからです。
平均レベル、RMS。これは、瞬間的な最大音量だけでなく、時間の経過とともに録音が実際にどれくらい大きいかを示します。音声オーディオは通常、平均して約-18 dBFS付近に落ち着くのが望ましいとされます。-35 dBFSまで下がると静かすぎ、後で音量を上げるとノイズも一緒に持ち上がってしまいます。このツールは、おおよそ何dB追加すべきかを教えてくれます。
ノイズフロアと信号対ノイズ比。ファイルの最も静かな部分を調べて、ノイズフロア、ヒスノイズ、部屋の音、ファンの音を推定し、それを音声と比較します。約40 dB以上の分離があればクリーンです。25 dB未満だと、ヘッドホンで聞いているリスナーは部屋の音を聞き取ってしまいます。これは推定値であり、その点については以下で正直に述べます。
DCオフセット。波形が中央線からずれているもので、通常はハードウェアの特性であり、静かにヘッドルームを食い潰します。見逃しやすく、ハイパスフィルターで簡単に修正できます。
スコアが伝えられないこと
数値は好みを判断できません。これは、録音が技術的にクリーンであるかどうかを測定するものであり、声が良い音であるか、マイクが声に合っているか、部屋に心地よい響きがあるかではありません。暖かく意図的にマイクに近づけた声と、耳障りな声が同じスコアになることもあります。なぜなら、メーターはレベルを読み取るのであって、感覚を読み取るわけではないからです。
そして、信号対ノイズ比は推定値です。これは、ファイルにノイズフロアをサンプリングするための静かな間隔があることを前提としており、これは音声には当てはまりますが、連続する音楽にはほとんど当てはまりません。音の途切れない壁のような音源では、ノイズの読み取りは信頼できなくなるため、SNRは会話で最も信頼し、音楽トラックでは最も信頼しないようにしてください。私はその点を偽って「この数値が絶対だ」と言うよりも、正直にそう言いたいのです。
指示する修正点
チェッカーは採点するだけでなく、どうすべきかを教えてくれます。クリッピングは、入力ゲインを下げて再録音することを意味し、救済策はありません。音量が小さすぎる場合は、提案された量だけゲインを上げるか、公開前にファイルをノーマライズします。ノイズフロアが高いのは通常マイクではなく部屋が原因なので、最も効果的なのはより静かな場所で録音することであり、ノイズリダクション処理は最後の手段です。DCオフセットは、どのエディターでもハイパスフィルターまたはDC除去フィルターでクリーンアップできます。
マイクテストとして使用する
短いクリップを録音し、ここを通過させるのが、最も速いマイク品質テストです。通常の距離で数文話し、ファイルをドロップして、ピークとノイズの数値を読み取ります。ピークが上限に達している場合、マイクに近づきすぎているか、ゲインが高すぎます。ノイズフロアが大きい場合、マイクが部屋の音を拾っているか、安価なマイクがその役割を果たしているかのどちらかです。聞き返して推測するよりも、これら2つの数値から多くを学ぶことができます。
これがオーディオアナライザーとどう違うのか
名前が似ているため、明確にしておく価値があります。オーディオアナライザーは、ファイルの内容(スピーチか音楽か、どの楽器、どの言語、どの音)を教えてくれるAIツールです。これは、録音がクリーンであるか(レベル、クリッピング、ノイズ)を教えてくれる技術的なメーターです。一方は「このオーディオは何ですか」と答え、もう一方は「このオーディオは公開するのに十分な品質ですか」と答えます。コンテンツを理解するにはアナライザーを使用し、録音の品質チェックにはこれを使用します。
録音がパスすると、次のステップは別の場所にあります。動画から音声を抽出は、まず動画からクリーンなトラックを抽出します。オンラインオーディオカッターは無音部分をトリミングします。そして、トランスクリプトジェネレーターは完成した音声をテキストに変換します。