はじめる

複数キャラの音声、声質はどう分けるか

最終カット前に、話者ID、感情、テンポ、間、ショット内の配置を設計します。

今すぐ作成
複数キャラの音声、声質はどう分けるか

はじめに

ショートドラマは、背景が多少荒くてもまだ持ちます。でも声が混乱すると一気に崩れます。シーンには3人いるのに、ArcLoop 内で声のレーンを割り当てていない。だから2人の役が同じトーンになり、ヒロインはカットごとに顔も年齢感も変わり、プロンプトファイルを見てもどの声が承認済みか分からない。絵がよくても、編集全体が貼り合わせに見えてしまいます。

複数キャラTTSには、最終動画の前に脚本優先の計画が必要です。世界観を開き、AIショートドラマガイドで台詞をショットカードへ結び、キャラシートで常連キャラをつなぎます。同じ顔に、同じ声のロジックを持たせるためです。

各役には声のレーンを作ります。話者ID、年齢感、質感、テンポ、感情幅、発音メモ、連続性の警告です。そのうえで、ショットリストがどの台詞に口パクが必要か、どの台詞をリアクションに重ねるか、どこで沈黙を残すかを決めます。

なぜ声に専用レーンが必要か

声は音の飾りではありません。誰が主導権を持つのか、誰が嘘をついているのか、誰が痛みを隠しているのか、誰が変わったのかを観客に伝えます。短いシーンが続くショートドラマでは、説明台詞より声のほうが文脈を持つこともあります。

声のレーンは演技を安定させます。中立、怒り、恐怖、冗談、ささやき、崩れる瞬間にそのキャラがどう聞こえるかを決めます。同時に、変えてはいけないものも決めます。年齢感、アクセント、話速、息の量、音域、感情の上限です。

声のレーンは話者の混乱も防ぎます。脚本に女性キャラが3人同じ部屋にいるなら、生成前に話者IDと別々の演技メモが必要です。「女性声1」「女性声2」では足りません。声は、そのキャラの役割、立場、感情上の機能と合っているべきです。

台詞の配置も重要です。オンカメラで言うべき台詞があります。聞き手のリアクションに重ねたほうが強い台詞もあります。キャラが入ってくる前に、画面外から始めたほうが効く台詞もあります。動画の後でTTSを作ると、演技を受け止めるための沈黙や顔の時間が足りなくなることがあります。

脚本優先のTTSワークフロー

まず脚本からすべての台詞を抜き出します。話者名、括弧内の演技指示、間、割り込み、感情の文脈を残します。台詞をナレーションに平らにしないでください。

常連キャラの声のレーンを作ります。各レーンに、話者ID、基礎声、テンポ、感情幅、ストレス時の反応、発音メモ、禁止するブレを書きます。声のレーンは、ビジュアル参照ライブラリで使う同じキャラクター ID に結びます。

台詞の配置をマークします。各台詞がオンカメラ、オフカメラ、ボイスオーバー、電話音声、記憶音声、リアクションショット下のどれかを決めます。これはショット尺とカメラに影響します。

最終動画の前にラフ声を生成します。ラフの声当てで、より長い間、少ない台詞、別のショット順が必要だと分かることがあります。 polished render の前にタイミングを直すほうが安く済みます。

シーンをまたいで声をレビューします。連続性を聴きます。主役は3シーン目でも同じ人物に聞こえますか。敵役の公の声と私的な声の違いは意図したものですか。感情のピークは正しい瞬間に来ていますか。

最終カット前に声を承認します。最終動画は、ランダムなクリップ尺へ声を押し込むのではなく、承認済みの演技を支えるべきです。

声をショットの見せ方に合わせる

同じ台詞でも、機能によって必要な画の見せ方は変わります。告白は話者の顔に乗せるべきかもしれません。口、目、息が重要だからです。嘘は聞き手のリアクションに重ねるほうが効くかもしれません。疑いが生まれる瞬間を見せたいからです。脅しの台詞は画面外から始めると、登場が重くなります。

これはTTSを確定する前に決めます。台詞がオンカメラなら、ショットには安定した顔の時間と口パクしやすい構図が必要です。オフカメラなら、手、小道具、リアクションを見せられます。電話越しなら、話者の身元を変えずに圧縮感や距離のメモを声のレーンへ入れます。声の計画はカメラの計画でもあります。

だから複数キャラTTSは、制作ワークフローの中に置くべきです。あと付けではありません。声が、編集に呼吸の場所を教えます。

例 1:声のレーン仕様

このショートドラマエピソード用に、複数キャラTTSの声のレーンを作成してください。

キャラクター:
MAYA、27歳、配達員、プレッシャー下でも抑えており、悲しみを隠している。
LEO、30歳、夫、防御的な時も温かさが残り、直接答えるのを避ける。
AVA、26歳、妹、公の場では明るい声、私的には鋭い怒り。

各キャラクターについて出力:
- 話者ID
- 基礎声の説明
- テンポと間のルール
- 感情幅
- 台詞表現のリスク
- 発音メモ
- 禁止するブレ
- 中立台詞1つと感情台詞1つの演技例

ルール:
脚本が変装、電話の歪み、記憶音声を明示しない限り、各声のレーンをシーン間で安定させること。

例 1 のイメージ

これでエピソードを切る前に声の連続性を作れます。

例 2:台詞タイミング計画

シーン:エレベーターでの対峙

台詞計画:
LEO、オフカメラ、低く防御的なテンポ:
「君がそれを見るはずじゃなかった。」
配置:Maya が契約書を持つ手のアップから始める。まだ Leo は見せない。

MAYA、オンカメラ、静かで抑えた声:
「今夜あなたが言った、初めての本当のことね。」
配置:タイトなクローズアップ。「本当」の前に0.4秒の間。

AVA、電話スピーカー、明るい声から冷たく変わる:
「Maya、今彼と一緒にいるの?」
配置:Maya のリアクションショット下に電話音声を置く。電話らしさを出すため軽く圧縮する。

カット規則:
Ava の台詞後、エレベーターのドアが開く前に0.7秒の沈黙を置く。

例 2 のイメージ

この計画は声、カメラ、編集タイミングを結びます。

例 3:声の連続性レビュー

複数キャラTTSのドラフトを、連続性の観点でレビューしてください。

シーン:
S01 アパートでの発見
S02 エレベーターでの対峙
S03 屋上での決断

チェック:
1. MAYA は全シーンで同じ低く抑えた声を保つ。
2. MAYA の感情の崩れは S03 だけに出て、S01 には出ない。
3. LEO の防御的なテンポは S02 で速くなるが、年齢感と音域の身元は変わらない。
4. AVA の電話声は圧縮後も本人だと分かる。
5. リアクションショット間で話者レーンが入れ替わらない。
6. 計画したクローズアップに十分な間が残っている。

例 3 のイメージ

このレビューで、最終合成前に声のブレを見つけられます。

よくある失敗

一番大きな失敗は、編集をロックしてから声を生成することです。台詞のタイミングは編集を形づくるもので、編集とぶつけるものではありません。

似たキャラに似た声を使うのも失敗です。キャストには、テンポ、質感、リズム、感情の出方に差が必要です。

画面外の台詞を忘れることもあります。オフカメラの声は緊張感を作れますが、それでも話者IDに結びついている必要があります。

最後に、全台詞を大げさにしないでください。ショートドラマにはピークと抑制が必要です。全部がクライマックスなら、本当のクライマックスが行き場を失います。

FAQ

ショートドラマには何本の声のレーンが必要ですか?

何度も話す役ごとに1本作ります。脚本に必要なら、ナレーター、電話音声、記憶音声、変装声にも別レーンを作ります。

声は動画の前と後、どちらで生成すべきですか?

最終動画の前にラフ声を生成します。ショット尺、リアクションのタイミング、間、カットポイントを決める助けになります。

エピソードをまたいで声を安定させるには?

話者ID、声の説明、テンポ規則、発音メモ、感情の上限を再利用します。最終ミックス前に、新しい台詞を承認済みの声のレーンと照らし合わせます。

レンダー前に声と編集を合わせる

脚本、ショットカード、声のレーンをつなぎ、台詞が編集とぶつからずシーンを支えるようにします。

今すぐ作成

もっと見る

縦型マイクロドラマを台本のビートから組み立てる

縦型マイクロドラマを台本のビートから組み立てる

AIマンガドラマ制作フロー:企画から収益化まで

AIマンガドラマ制作フロー:企画から収益化まで

動きが硬いときの直し方

動きが硬いときの直し方

AIドラマ脚本分解のためのDeepSeek V4

AIドラマ脚本分解のためのDeepSeek V4