無音がポッドキャストに悪影響を与える理由

リスナーは多くのことを大目に見てくれますが、長い隙間は会話のリズムを崩します。その場では自然に感じた間も、ヘッドホン越しでは技術的な不具合のように聞こえてしまいます。十分に取り除けばエピソードはプロが制作したように感じられ、残したままにすれば未編集の録音のように聞こえます。

無音を取り除けば内容を削らずに尺を短くでき、ほとんどのポッドキャストプラットフォームで最後まで聴かれる率が向上します。

手作業の方法(そしてそれが遅い理由)

従来はエピソードを DAW に読み込み、波形にズームインして、平坦な区間を探していました。45分のインタビューでは、何百もの細かな編集と1時間以上の作業がエピソードごとに必要になることもあります。

またミスも起こりやすく、話者に必要だった呼吸まで切ってしまったり、タイムラインがわずかにずれてしまったりしがちです。

無音を自動で取り除く

代わりに、エピソード全体を自動の無音検出にかけましょう。しきい値を通常の話し声の音量より少し下に、最小無音長を0.5秒ほどに、そしてカットが自然に響くように少量のパディングを設定します。

アプリは条件に合うすべての隙間を見つけ、一度のパスで取り除きます。手作業なら1時間かかっていた45分のエピソードが、1分足らずで引き締まります。

話し言葉に適した設定

ソロやインタビュー形式のポッドキャストでは、最小無音長を0.4〜0.7秒にすると、不要な隙間を取り除きつつ会話の自然な間は残せます。100ミリ秒ほどのパディングをとれば、語尾が切れてしまうのを防げます。

2人のホストが互いに被せて話す場合は、しきい値を控えめにして小さな声を切らないようにし、本当の無音だけを取り除きましょう。

引き締めるとエピソードの尺は実際どう変わるか

会話調の話し言葉には、思いのほか多くの無音が含まれています。考えている間、返答の前の一拍、誰かが考えをまとめる間の隙間など。40分のエピソードを通すと、それはしばしば純粋な無音だけで3〜6分にもなります。それを取り除いても誰かがせわしなく聞こえることはありません。何も話されていない部分が取り除かれるだけです。

視聴維持への効果は確かなものです。リスナーは間延びした箇所で離脱するため、引き締まったカットは注意を長く引きつけ、完聴率を高める傾向があります。これはほとんどのポッドキャストプラットフォームが評価する指標です。

インタビューや2人ホストの番組

複数の声が入った録音には独特のリズムがあります。話者から話者へのバトンの受け渡しこそ、無音がたまりやすい場所です。検出は誰が話しているかではなく音量と長さで働くため、両方の声を完全にそのまま残しながら、その受け渡しをきれいにトリミングします。

ゲストごとに別々のトラックで収録している場合は、すべてのトラックに同じ設定を適用しましょう。そうすればミックスで合わせ直すときにタイミングがぶれません。

編集のなかで無音除去をどこに位置づけるか

編集全体ではなく、最初のパスとして捉えましょう。まず無音を取り除き、それから創造的な作業——チャプターマーカー、音楽、たまのフィラーワードのトリミング——を、すでに引き締まったタイムライン上で行います。隙間のないファイルから始めれば、その後のどの工程もスクラブが少なくて済みます。

設定そのものについては、話し言葉に最適なしきい値、長さ、パディングの値を解説したガイドをご覧ください。

プライバシーを守る

未公開のエピソードはデリケートなものです。デバイス上での処理なら、音声がスマホの外に出ることは一切ありません。アップロードもクラウドアカウントも不要で、あなたの録音のコピーが誰かのサーバーに残ることもありません。

エピソードのどこに無音は潜んでいるか

明らかな隙間もありますが、ひそかに尺を水増ししているものは見落としやすいものです。イントロ音楽が終わる前の無音、ゲストが考えを話し終えた後の一拍、誰かが水を一口飲む間の間、そしてアウトロの前の長い余韻。自動検出なら、ひとつひとつ探し回る代わりに、これらすべてを一度のパスで捉えます。

こうした箇所を捉えることこそが、すべての場所を覚えていなくても、緩い録音を引き締まったエピソードに変えてくれます。

繰り返し使えるエピソード制作の流れを作る

一貫性こそが、番組をエピソードごとにプロらしく感じさせます。自分の声に合うしきい値、最小無音長、パディングを決めたら、その同じ値をすべてのエピソードに適用し、テンポがぶれないようにしましょう。

繰り返し使えるパスは、本当に判断が必要な部分——構成、ハイライト、ストーリーテリング——に編集時間を割けるようにし、機械的な隙間カットから解放してくれます。