開始使用

聲音也是故事的一層

把聲音和場景、關係、情緒 beat 綁在一起,讓它延伸 OC,而不是最後才貼上去。

立即創作
聲音也是故事的一層

介紹

AI 角色聲音常常被加得太晚。創作者先完成 clip,再找一句能貼上去的台詞。有時這能用,但通常會顯得脫節。角色的嘴型、表情、動作和情緒壓力並不是為這句台詞設計的。聲音變成補丁,而不是場景的一部分。

對動漫敘事來說,聲音應該和 OC、storyboard、鏡頭時長一起規劃。告白前的一聲低語、戰鬥中的短促命令、對手的緊張笑聲,或疲憊旁白的一句話,都能改變觀眾理解同一張畫面的方式。聲音不只是音高,它是關係、節奏、意圖和時機。

這篇指南聚焦聲音作為故事層。它不同於通用聲音 prompt 指南,因為它從場景連續性開始:誰在說話、誰在聽、剛剛發生了什麼、角色想隱藏什麼,以及這句話必須塞進多長時間。用 角色台詞聲線產生器 可以把這些部分放進同一份 brief。

核心原則

第一條是先場景,後聲音。不要從「可愛聲音」或「低沉聲音」開始。先寫這個場景意味著什麼。

第二條是關係壓力。同一句話,對朋友、對手、觀眾、導師或敵人說,聽起來都不一樣。

第三條是時長。聲音台詞必須適合鏡頭。6 秒特寫裝不下 30 秒獨白,否則會顯得很趕。

第四條是可複用角色檔案。讓 OC 的聲音習慣在多句台詞中穩定:節奏、自信度、正式程度、緊張時的小動作和情緒範圍。

第五條是邊界。說明輸出是否包含音樂、音效、唱歌、喊叫、呼吸、停頓,或只要乾淨口語對白。

聲音故事工作流程

先從 storyboard beat 開始。寫鏡頭目的:揭示、拒絕、道歉、威脅、玩笑、決定或告白。它會控制表演方式。

加入角色檔案。保持短:角色職責、情緒習慣、說話節奏和一個矛盾點。例如:「說話正式,但害羞時會變快。」

加入聽者。沒有聽者的台詞通常會很泛。聽者可以在畫面裡、畫面外,或就是觀眾。

設定目標時長。給一個範圍,比如 6-8 秒或 12-15 秒。這能幫助節奏和剪輯規劃。

把精確台詞和方向分開寫。使用標籤,讓人類 reviewer 能看清哪些詞會被說出來。

加入表演說明。一個停頓、一個情緒變化和一種 delivery mode 通常就夠。如果台詞屬於序列,可以把它錨定到 三鏡頭連續性分鏡板

聲音在 OC 流程中

聲音繼承同一份 OC brief 時會更強。character sheet 建立年齡範圍、輪廓、表情和世界。OC profile 建立機制和關係。storyboard 建立台詞前後髮生了什麼。voice prompt 表演那個瞬間。

這也能保持聲音一致。如果每句台詞都創建一個新人設,角色會像視覺設計一樣漂。複用一張小 voice card:語氣、節奏、情緒破綻、他們避開的詞、常重複的詞,以及壓力下怎麼變化。

聲音還可以降低視覺負擔。一句安靜台詞能解釋需要很高動畫成本才能表現的猶豫。一聲短呼吸能讓特寫顯得有意圖。半笑著否認,比另一個動作 beat 更能承載關係張力。

範例 Prompt 1:告白聲音 Beat

Voice direction: 表演 Nami,一位來自浮島城市的原創動漫制圖師。她平時聽起來務實、干脆、戒備,但當別人發現她害怕時會變柔軟。場景語境:Nami 剛剛遮住自己發光的羅盤吊墜,不想讓朋友知道她在假裝沒事。聽者是一位值得信任的朋友,站在鏡頭外。聲音質感:溫暖 young adult alto,清楚口語對白,克制情緒。節奏:開頭帶一點防御性的輕笑,第一句後停頓,然後放慢並變誠實。目標時長:9 到 11 秒。不要唱歌,不要音樂,不要音效,不要夸張 parody。

Line: "我沒事。真的。我只是……需要這枚羅盤在你說出真相前,先停止說真話。"

這條 prompt 把台詞連到視覺機制和角色關係上。

範例 Prompt 2:Rival 鬥嘴聲音 Beat

Voice direction: 表演 Ren,一位聰明的學院 rival,總是假裝每個錯誤都是計劃的一部分。場景語境:他的發明剛在主角面前冒火花,但他還想保持厲害的樣子。聽者:一個太了解他的友好對手。聲音質感:明亮 tenor,戲劇化自信,快速節奏,在恢復鎮定前有一小下慌張破音。目標時長:7 到 9 秒。只要口語對白,乾淨棚錄聲,不要音樂,不要人群噪音,不要喊叫失真。

Line: "那不是爆炸。那是戲劇版的預覽,而我顯然選擇不在室內完成它。"

聲音說明給笑點一個表演弧,而不是只靠文字。

範例 Prompt 3:預告旁白層

Voice direction: 為一個連載幻想短片創建冷靜動漫預告旁白。旁白者是主 OC 更年長的自己,在故事事件之後回望。聲音質感:低、溫柔、反思,帶克制悲傷,結尾有一絲淡淡微笑。場景語境:預告畫面顯示一盞破裂燈籠點亮空蕩市場巷子,然後年輕女巫走進黑暗。節奏:慢、電影感,最後一句前留短停頓。目標時長:13 到 15 秒。只要口語旁白,不要音樂,不要音效,不要重回聲 fantasy filter。

Line: "所有人都以為月亮消失了。只有我傻到在它從城市下方呼喚時,回應了它。"

這句台詞把視覺 hook 變成故事前提。

常見錯誤

最大的錯誤是只 prompt 聲音類型,沒有場景語境。音高和年齡範圍無法解釋表演。

另一個錯誤是台詞太長,不適合鏡頭。如果角色只有一個特寫反應,台詞就應該能呼吸。

創作者也會每次都改變聲音檔案。讓角色的節奏和情緒習慣在場景之間穩定。

第四個錯誤是在編輯需要乾淨聲音資產時加入音樂或音效。如果台詞用於製作,除非明確需要聲音層,否則保持 dry。

最後,不要讓每句台詞都戲劇化。動漫場景常常靠小聲音選擇承載壓力。

FAQ

什麼時候寫聲音 prompt?

在 storyboard beat 清楚之後、最終剪輯時長鎖定之前寫。這樣聲音可以影響節奏,而不是後期被硬塞進去。

多句聲音台詞之間什麼要保持一致?

保持角色的聲音質感、節奏習慣、正式程度、情緒破綻和關係模式。改變的是場景語境和情緒目標。

聲音怎樣幫助 AI 動漫短片?

聲音給觀眾意圖。它能澄清決定、揭示隱藏情緒、支援 hook,或讓反覆出現的 OC 在多場景中更鲜活。

把聲音寫進場景裡,別等場景寫完再補

在 ArcLoop 裡把角色、分鏡和聲音 prompt 放在一起,讓表演對上節拍。

查看範本

探索更多

如何利用 AI 進行轉描 (Rotoscoping):4 個步驟將真實動態製作成轉描影片

如何利用 AI 進行轉描 (Rotoscoping):4 個步驟將真實動態製作成轉描影片

如何管理資產?

如何管理資產?

Live2D 和 VTuber 要的設定表長怎樣

Live2D 和 VTuber 要的設定表長怎樣

年代 + 參考 + 質感:風格公式的三個變數

年代 + 參考 + 質感:風格公式的三個變數