明瞭さを失わずに話し言葉のボーカルをミックスする方法
話し言葉のボーカルをミックスするときは、まず明瞭さを守ること:コンプレッション前にフレーズのレベルを編集し、低周波のノイズやこもり感を除去し、1〜4kHzの子音のディテールを保持し、きつい音節だけをデエスし、空間は短く保ち、声の周りの音楽はダックします。話し言葉は歌のリードボーカルのように盛り上げるのではなく、明瞭で人間味があり、近くに感じられるべきです。
話し言葉、ラップのイントロ、ポッドキャスト風ボーカル、詩、ナレーションのためにクリーンなスタートチェーンが欲しい場合は、コントロールされたボーカルプリセットから始めて声に合わせて調整しましょう。
ボーカルプリセットを購入する話し言葉のミキシングは、単にメロディが少ないボーカルミキシングではありません。リスナーはリアルタイムで言語を解読しています。歌のボーカルで子音が一つ失われても、メロディと文脈がフレーズを支えます。話し言葉で子音が失われると、重要な単語が消えることがあります。それは感情的な影響、リズム、時には意味を変えます。
目標は無菌的でない明瞭さです。話し言葉のボーカルは暖かく、親密で、ざらつきがあり、シネマティックで、乾いた感じでもよいですが、言葉は最初の一度で伝わらなければなりません。つまり、ミックスの決定は色味を追う前に発音を守る必要があります。フックで刺激的に感じるコンプレッションは詩を平坦にするかもしれません。コーラスで広がりを感じるリバーブは次の文をぼかすかもしれません。歌手が抜けるのを助ける明るいエアシェルフは、話し言葉のSやTの音を鋭く感じさせることがあります。
チェーンは話し言葉のサポートシステムと考えましょう。まずレベルを編集し、次にトーンを整え、優しくコンプレッションをかけます。デエスは控えめに。言葉がすでに明瞭になってから空間を加えます。その後、ソロだけでなく音楽のベッドに対して声をチェックします。
ソースとパフォーマンスから始める
プラグインを選ぶ前に、生のテイクを聴いて本当の問題点をマークしましょう。話し言葉の問題は通常いくつかのカテゴリーに分かれます:ルームリフレクション、マイクからの距離の不均一、口のノイズ、息のピーク、破裂音、低中域のこもり感、きつい子音、音楽のマスキング。それぞれの問題には異なるツールが必要です。すべてをコンプレッションで処理すると、ボーカルが平坦で不明瞭になります。
ルームリフレクションは特にダメージが大きく、子音をぼやけさせます。声が大きいときは部屋の影響に気づかないかもしれませんが、単語の間やフレーズの終わりで聞こえます。反響の多い部屋は各音節の後に曇った尾を作り、その尾が次の単語と競合します。EQで多少のこもり感は減らせますが、悪い部屋の影響を完全に取り除くことはアーティファクトなしにはできません。
距離の変化も話し言葉ではより重要です。感情的なセリフで演者が前に出て、静かなセリフで後ろに下がると、声のトーンとレベルが同時に変わります。コンプレッションはレベルの揺れを減らせますが、遠いフレーズを近いフレーズと同じくらい存在感のある音にすることはできません。クリップゲインと手動のライドが最初に行うべきよりクリーンな方法です。
この初期診断を使う:
| 問題点 | どんな音か | 最初の修正 |
|---|---|---|
| 低周波の轟音 | 低周波振動、マイクスタンドの衝撃音、空調、交通音 | コンプレッション前のハイパスフィルターとクリップのクリーンアップ |
| 箱鳴り感 | 声が閉塞感があり、段ボールのようで、小さな部屋の響きが強い | 文脈を聴いた後、200〜500Hz周辺を広くカットする |
| 埋もれた言葉 | 重要な言葉がフレーズの中で消えてしまう | コンプレッサーの前に単語やフレーズのクリップゲインを調整する |
| きつい子音 | S、T、K、SHが痛々しく前に出る | 特定の音節に対する手動ディエッシングやダイナミックEQ |
| 口のクリック音 | 言葉の間の小さなクリック音や粘着音 | トーンシェイピング前の手動編集や修正 |
| 音楽によるマスキング | 声は聞こえるが理解しにくい | ボーカルを上げるだけでなく、ベッドをダックまたはカーブさせる |
コンプレッション前にフレーズのレベルを編集する
話し言葉で最も大きな間違いは、すべてのレベリングをコンプレッサーに任せることです。話し言葉には自然なフレーズの動きがあります。ある言葉は柔らかくあるべきで、ある言葉は前に出るべきです。その動きを潰すと、パフォーマンスではなく広告のように聞こえ始めます。コンプレッションは、最悪のレベルの揺れを手動で整えた後にテイクをコントロールするべきです。
フレーズごとに進めましょう。飲み込まれた言葉は1〜3dB持ち上げます。コンプレッサーが過剰に反応する前に、大きな破裂音、叫び声、笑いのピークを抑えます。文を妨げる息遣いは減らしますが、すべての息を削除しないでください。息が全くない話し言葉のパフォーマンスは不自然で編集された感じがします。息は人間のタイミングの一部です。
ボーカルの息遣いコントロールのワークフローはここで特に役立ちます。話し言葉はすべての息遣いを露わにします。歌唱ボーカルはサステイン、ハーモニー、リバーブの下に息を隠せますが、話し言葉は吸うたびに裸の空間があることが多いです。解決策は無音ではなく、レベルの規律です。
クリップゲイン処理の後、コンプレッサーの仕事は楽になります。声をつなげ、小さな跳ねを滑らかにし、リズムを壊さずにボーカルを際立たせることができます。編集処理を省くと、コンプレッサーは最も大きな音節に過剰反応し、その後の言葉を引き下げてしまいます。これが、メーター上はレベルがよりコントロールされていても、話し言葉が不明瞭になる理由です。
誇張ではなく、明瞭さのためにEQを使う
スポークンワードは多くの歌唱ボーカルチェーンとは異なるEQの考え方が必要です。声を密集したコーラスの上で輝かせるのではなく、言葉を解読しやすくすることが目的です。つまり、プレゼンスを上げる前に泥や部屋の響きを取り除くことです。ボーカルが250Hzで曇り、5kHzで耳障りな場合、エアを加えても問題は解決しません。トップは高級感が出ても言葉は不明瞭なままです。
| 範囲 | よくある調整 | なぜ重要か |
|---|---|---|
| 60-90 Hz | 声に合わせて調整するハイパスフィルター | 胸の厚みを薄くせずに低周波のこもりを除去 |
| 120-200 Hz | ブーミーな場合のみ小さなカットを | 近接マイクによる近接効果の蓄積をコントロール |
| 200-500 Hz | 箱鳴りの場合は広いカットを | 小さな部屋の響きと曇った話し声を減らす |
| 700Hz〜1.2kHz | 鼻声の場合は慎重に狭いカットを | 声を空洞化させずにホンクをコントロール |
| 1-4 kHz | 保護し、時には軽く持ち上げる | 言葉の定義と子音の存在感を運ぶ |
| 5-8 kHz | 静的な除去ではなくダイナミックコントロール | SとTのエッジを管理しつつ明瞭さを保つ |
| 10kHz以上 | 鈍い場合のみ小さなシェルフを | 開放感を加えますが、話し声が人工的に感じることがあります |
サブトラクティブEQのワークフローはスポークンワードに強く適用されます。トーンを加える前に理解を妨げる周波数をカットしましょう。適切な低中域を2dBカットすることは、明るいシェルフを加えるよりも明瞭さに効果的なことが多いです。1つの厳しい子音周波数に狭いダイナミックカットを入れる方が、ボーカル全体を暗くするより効果的な場合があります。
ボーカルを過剰にクリーンにしないでください。スポークンワードには厚みが必要です。150〜300Hzを削りすぎると、ソロではクリアに聞こえても音楽の上では弱く感じるかもしれません。1〜2kHzを削りすぎると、声は滑らかになりますが理解しにくくなります。5〜8kHzを削りすぎると、声は丁寧に聞こえますが舌足らずに感じることがあります。EQの調整はすべて文の理解テストを通過すべきです:調整後に言葉がより速く理解できますか?
優しく圧縮し、文の呼吸を保つ
ほとんどのスポークンワードには、速く攻撃的なコンプレッサーではなく、適度なコンプレッサーから始めましょう。比率は通常2:1か3:1程度で十分です。子音を通すアタックを使い、声やコンプレッサーによっては10〜30msあたりが多いです。フレーズ間でポンピングせずに回復するリリースを使い、開始点としては80〜180msあたりがよく使われます。通常のフレーズで数dBのゲインリダクションを目指し、常に強く絞りすぎないようにしましょう。
適切な設定は配信内容によって異なります。落ち着いたナレーションには、よりゆっくりで滑らかなコントロールが使えます。鋭いダイナミクスのスラムポエトリーのパフォーマンスには、メインコンプレッサーの後に速めのセーフティステージが必要かもしれません。ラップスタイルのスポークンイントロには、ビートに馴染むためにより密度が必要な場合があります。重要なのは、言葉の形を消さずにパフォーマンスをコントロールすることです。
コンプレッション後にボーカルが鈍くなったら、すぐに高音域を足さないでください。まずコンプレッサーのアタックが速すぎないか確認しましょう。子音のトランジェントを潰すと、声の切れ味と明瞭さが失われます。言葉の間でボーカルがポンピングするなら、リリースが遅すぎるかスレッショルドが低すぎる可能性があります。ダイナミクスを潰さないコンプレッションの論理を使いましょう:コンプレッサーは問題を減らすものであり、パフォーマンスの音そのものになってはいけません。
声に密度が必要でメイントラックは自然なままにしたい場合、パラレルコンプレッションが役立ちます。圧縮した複製を静かにクリーンなボーカルの下にブレンドしましょう。パラレルチャンネルは暗めでコントロールされた状態に保ち、息や口のノイズを強調せずにボディを加えます。パラレルチャンネルが声を近く感じさせるが音量は上げないなら、正しく機能しています。
言葉を失わずにディエッシングする
話し言葉のディエッシングには節度が必要です。シビランスは耳障りですが、「S」や「SH」音は理解のために重要です。過度に取り除くと単語の識別性が失われます。聴き手はなぜ声が不明瞭に感じるのか分からず、理解しようと余計に努力することになります。
問題が全体的かフレーズ特有かを把握してからディエッサーを使いましょう。ある単語だけが耳障りなら、その単語だけをオートメーションやクリップゲインで調整し、全体の「S」を下げるのは避けてください。マイクのせいで全体が明るすぎる場合は、耳障りな領域にダイナミックEQを使い、全文を聴いてみてください。ディエッサーで話者が舌足らずに聞こえるなら、すぐに控えましょう。
iZotopeのディエッシングガイダンスは、強いシビランスを減らしつつも「s」音を完全に取り除かず、EQ、コンプレッション、ディエッシングを連携したプロセスとして扱うことを強調しています。これは話し言葉に対して正しい考え方です。コンプレッサーはシビランスを強調することがあります。明るいEQはディエッシングを必要にします。明るいEQの前にディエッサーを置くと滑らかな経路が作れます。チェーンの順序よりも相互作用が重要です。
良い出発点は、特定の耳障りな部分を狙ったスプリットバンドのディエッサーです。多くの声では5〜8kHz付近ですが、話者によってはもっと低いか高い場合もあります。減衰は軽く保ちましょう。強い減衰が必要なら、ソース、EQ、またはコンプレッションが問題を悪化させている可能性があります。
空間は短く意図的に保つ
長いリバーブは話し言葉には危険です。なぜならリバーブの尾が次の言葉のすぐ後ろに重なるからです。だからといって話し言葉が完全にドライでなければならないわけではありません。空間はコントロールされている必要があります。短いルームリバーブ、短いプレートリバーブ、スラップディレイ、または非常に低レベルのアンビエンスは、言葉をぼかすことなく声を配置しているように感じさせることができます。
3つの空間オプションを試してみましょう:
- ポッドキャスト風の明瞭さ、直接的なナレーション、親密な詩のためにドライで近い音にします。
- 0.7秒未満の短いルームリバーブで自然なパフォーマンス空間を作ります。
- 60〜110msのスラップディレイで長い残響なしに奥行きを出します。
エフェクトリターンにハイパスとローパスをかけます。リバーブの低域の蓄積を除去し、子音がはねないように高域を抑えます。ボーカルが音楽の上にある場合は、ドライボイスからリバーブリターンをダックして、言葉が発せられている間は空間が邪魔にならないようにします。これにより、文章を失わずに雰囲気を保てます。
ドラマチックなスポークンワード作品では、エフェクトは常にかけっぱなしにするのではなく、瞬間的に使いましょう。最後の言葉にディレイをかけると効果的です。フレーズの後に長いリバーブのスウェルを加えると感情が生まれます。すべてのフレーズに連続してウェットをかけると、作品が追いにくくなります。
音楽ベッドを声の周りで動かす
スポークンワードが音楽の上に乗る場合、音楽ベッドは声を支える役割を果たさなければなりません。すべてのマスキング問題を声を大きくすることで解決しないでください。声が大きすぎると、つながりがなく攻撃的に感じられます。代わりに、声がアクティブな間は中央とプレゼンスの範囲を開けておくようにベッドを調整しましょう。
音楽バスの主要な明瞭度範囲、通常は声やアレンジによって1.5〜4kHzあたりにダイナミックEQを使います。カットはボーカルにトリガーさせます。音楽は間奏中はトーンを保ち、話している間は避けます。これは静的なスコープより効果的で、ベッドが常に空洞に聞こえるのを防ぎます。
サイドチェインコンプレッションも効果的ですが、優しく使いましょう。声の下で1〜3dBの軽いダッキングが十分なことが多いです。強いダッキングは音楽が不自然に呼吸しているように感じさせます。ベッドを少し広げると声が中央を支配しやすくなりますが、位相問題を起こさないように注意してください。モノラルでチェックしましょう。ベッドが消えたり、ボーカルの音色が変わる場合は、幅の調整が不安定すぎます。
プレゼンスはミックス全体の問題です。鋭い中高域を避けたボーカルプレゼンスのガイドは、声を前に出したいけれど、どのブーストも鋭くなってしまう場合に役立ちます。スポークンワードは通常、声の周りに小さく賢い空間作りの動きが必要で、声自体に大きなプレゼンスブーストは不要です。
スポークンワードのボーカルチェーンを作る
実用的なチェーンは次のようになります:
- フレーズのバランス、息遣いの大きさ、破裂音、飲み込まれた言葉に対するクリップゲイン調整。
- クリック音、口のノイズ、明らかなノイズ問題を修正します。
- 低域通過フィルターと減算EQで、こもりや箱鳴り、鼻にかかったような音の蓄積を除去します。
- レベルコントロールのための穏やかなコンプレッション。
- きつい子音用のダイナミックEQまたはディエッシング。
- ボーカルにまだプレゼンスや温かみが必要な場合の小さなトーンEQ。
- ショートスペースまたはディレイセンド。
- 音楽トラックに対するオートメーション。
プリセットはクリーンな出発点を提供する場合に役立ちますが、すべての設定をそのままにしておくと逆効果です。ボーカルプリセットをルーティング、EQの順序、コンプレッション段階、エフェクトセンドの出発点として使い、スピーチに対して過剰に感じる部分は減らしてください。スポークンワードは歌唱リードよりもエア感やリバーブが少なく、フレーズレベルのオートメーションが多く必要なことが多いです。
作品が重要で録音が荒い場合は、ミキシングサービスを利用する方が、すべての細部を自分で直そうとするより良い場合があります。スポークンワードはシンプルに聞こえますが、誤差の余地は小さいです。リスナーは不明瞭な言葉をすべて気にします。
スピーチ用ボーカルプリセットの調整方法
歌唱用に作られたボーカルプリセットでもスポークンワードに役立つことがありますが、設定は通常控えめにする必要があります。まずは時間系エフェクトをバイパスします。長いリバーブ、広いディレイ、重いモジュレーション、コーラス、明らかなダブラーをオフにします。次にドライ処理だけを聴きます:クリーンアップEQ、コンプレッション、ディエッシング、サチュレーション、トーンEQ。声がすでにクリアでコントロールされているように聞こえればプリセットは役立っています。光沢があるけど信じられない感じなら、シンプルにしてください。
次にコンプレッションの強さを下げます。多くのボーカルプリセットは、密度の高いビートの中で歌のフックを大きく保つように設計されています。スポークンワードはそれほど一定の密度を必要としません。スレッショルドを上げ、レシオを下げるか、コンプレッサーの入力を減らして文のリズムが戻るようにします。ボーカルは生のテイクより安定しているべきですが、重要な言葉に演者が力を入れているのが聞こえるべきです。
次に高周波のブーストを確認します。プリセットは、歌手が際立つように10kHz以上のエア感や4〜6kHz付近のプレゼンスを加えることがあります。スポークンワードでは、同じブーストがS、T、口のクリック音、ヘッドホンの漏れを強調しすぎることがあります。まずは明るいシェルフを下げてください。明瞭さが落ちすぎる場合は、プレゼンス帯域の低めの部分に小さなリフトを加え、シラブルが目立つ部分だけにディエッシングを使います。
最後に、プリセットのエフェクトレベルを受け入れるのではなく、プロジェクトのエフェクトセンドを再構築します。まばらなピアノの上に詩の朗読を重ねる場合は、少し余裕が必要かもしれません。ポッドキャストのイントロはほぼドライのままにしておく必要があります。シネマティックなナレーションでは、短いプレートリバーブやスラップを許容することがあります。プリセットはルーティングを提供しますが、スポークンワード作品は量を決めます。
調整したチェーンがうまくいったら、スピーチバージョンとして保存してください。これにより、同じパフォーマーのための繰り返し可能な出発点ができ、すべての将来のスポークン作品を歌唱ボーカルの音に無理に合わせる必要がなくなります。イントロ、ナレーション、インタールード、アドリブが異なる日に録音されるプロジェクトでは、一貫性が役立ちます。
最終的な明瞭さのチェック
スタジオヘッドホンだけでスポークンワードミックスを承認しないでください。リスナーのようにチェックしましょう。ノートパソコンのスピーカーで静かに再生。携帯電話のスピーカーで再生。歌詞を見ずにイヤホンで再生。台詞を理解するのに文字起こしが必要なら、ミックスは十分に明瞭ではありません。
これらの最終チェックを使ってください:
- 重要な言葉はすべて低音量でも理解できます。
- 最も大きな子音がイヤホンで耳を痛めません。
- 音楽のベッドは文を覆わずにムードを支えます。
- 呼吸は人間らしく聞こえますが、気を散らしません。
- ボーカルはモノで中央に安定して定位します。
- 声は処理されたアナウンサーではなく、パフォーマーのまま感じられます。
最高のスポークンワードミックスはほとんど目立たないことが多いです。リスナーはEQやコンプレッション、ディエッシングを意識しません。彼らは話者を聞いています。それが成功です。
よくある質問
スポークンワードのミキシングはポッドキャストミキシングに近いですか、それとも音楽ミキシングに近いですか?
ボーカルチェーンはポッドキャストミキシングに近いです。なぜなら明瞭さ、自然なダイナミクス、子音の明瞭さが最優先だからです。声がビートやスコア、アンビエントベッドの上に乗る場合は、音楽ミキシングに近づきます。
スポークンワードのボーカルにはどのくらいのコンプレッションを使うべきですか?
パフォーマンスをコントロールするために十分なコンプレッションを使います。通常はクリップゲイン後に数dBのゲインリダクションです。文のリズムが平坦、ロボット的、または呼吸が多すぎると感じたら、コンプレッサーがかけすぎています。
どのEQ帯域がスポークンワードをより明瞭にしますか?
1〜4 kHzの範囲は言葉の定義の多くを担いますが、明瞭さは通常、まず低周波のゴロつきや箱鳴り、マスキングを取り除くことから始まります。減算的なクリーンアップの前にプレゼンスを上げると、スポークンワードが耳障りになり、理解しやすくはなりません。
スポークンワードの呼吸はすべて除去すべきですか?
いいえ。気を散らす呼吸は減らしますが、タイミングや感情を支える自然な呼吸は残してください。すべての呼吸を除去すると、パフォーマンスが人工的に感じられ、編集が目立つことがあります。
スポークンワードに最適なリバーブは何ですか?
短いルーム、非常に低レベルのアンビエンス、または控えめなスラップディレイは、長いリバーブよりも通常効果的です。空間は声を支えつつ、次の言葉をぼかす尾を残さないようにするべきです。
ボーカルプリセットはスポークンワードに使えますか?
はい、ボーカルプリセットは、開始チェーンとして使用し、処理を調整すれば、スポークンワードにも使えます。過度に明るいシェルフ、強いコンプレッション、長いエフェクトを減らし、フレーズのオートメーションと明瞭さに集中してください。





