字幕為什麼會毀掉一個鏡頭
字幕進來之前,這支片其實都很穩。角色探進畫面,雨打在窗上,台詞情緒也有落點。結果一大塊字幕蓋住嘴型、手勢,還有下一場會用到的小鑰匙吊飾。手機上,字是讀得到;但作為動畫,這顆鏡頭已經變弱了。
字幕和字體排版不只是後製裝飾。對 AI 漫劇短片來說,文字從第一張 shot card 就會影響構圖。如果字幕、音效字、單集標題和社群貼片到最後才處理,它們就會跟臉、道具、手勢和動作搶畫面。解法不是一套花俏字體系統,而是在生成完稿前先定好看得見的版面規則。
這篇指南會講清楚如何用 ArcLoop 裡現成的工具規劃對文字友好的動漫畫面:先在 Story Brief 裡定好畫幅,再把構圖要求直接寫進鏡頭描述,讓重要內容不落在字幕會出現的位置。你會學到怎麼定字幕區、選層級、保護角色表演、寫出給文字留空間的鏡頭提示詞,並在不犧牲可讀性的前提下複核成片。影片起步可以用 2D 動漫影片模板,鏡頭挑選時可以搭配 鏡頭挑選流程。
動漫字幕版面的規矩
生成前先規劃字幕區。如果角色的手、嘴、道具或關鍵動作都在畫面下三分之一,字幕一定會跟戲互搶。要嘛移動動作,要嘛調整裁切,要嘛在鏡頭定稿前預留側邊字幕區。
文字層級要少。對白字幕、音效字、單集標題、說話者標籤、翻譯註解和 CTA 不可能全都當主視覺。大多數短 AI 漫劇只需要一個主文字層,再加一個可選的輔助提示。其他資訊應該放到別的畫面。
用「讀完就退場」的字體。觀眾應該快速理解台詞,然後把注意力回到表演。大型裝飾字可以用在標題卡或衝擊詞,但普通對白需要穩定字級、清楚對比和可預期的位置。
保護臉和劇情道具。字幕如果蓋住角色眼睛、嘴、手勢、手機螢幕、吊飾、武器、信件或地圖,就可能讓故事崩了。分鏡階段就要把這些位置當成禁字區。
按照真實平台裁切來設計。直式短片、方形預覽和寬螢幕輸出需要不同安全區。16:9 可用的字幕,到 9:16 可能會很擠。先決定平台,再用這個構圖去生成。
怎麼在出圖前搭好文字安全構圖
先確認發布情境。這是靠字幕承載對白的靜音片?有配音但需要無障礙字幕的片?有音效字的吵鬧動作戲?還是標題卡轉場?文字的任務會決定版面。
選一個安全構圖。對白戲裡,讓臉待在畫面上方或中段,下面留出安靜的字幕帶。動作戲裡,字幕要避開正在移動的手腳或道具。直式短片裡,不要把必要文字放在最上方或最下方,因為 App 介面可能會蓋住。
寫一張字幕版面表。包含平台比例、字幕區、最多行數、文字層級、對比規則、禁字區和時間備註。例如:「9:16 直式,字幕在中下方,最多兩行,文字不要壓到眼睛、嘴、手、配送包或最後線索。」
在提示詞裡替文字留空間。除非文字本來就是場景的一部分,不要要求模型直接把最終字幕畫進影片。請它留下乾淨的負空間,後期再加字幕。這能避免爛字,也把控制權留給剪輯。
有意識地加音效字。動漫擬聲字和字幕可以很有味道,但要服務節奏。道具旁一個小小的「喀噠」可以成立,五個浮在畫面上的字只會讓乾淨鏡頭變亂。
用最小目標尺寸檢查。如果片子是給手機看的,就用手機尺寸判斷。桌面預覽讀得到還不夠。確認文字有沒有蓋住表演、換行有沒有很糟、觀眾能不能一眼看懂這顆鏡頭。
在開始生成之前,先在 ArcLoop 專案裡把這些準備到位。
開啟 IP 專案,進入 My Assets。如果主角還沒有角色資產,先建一個——上傳一張 Main image,再綁一張 Reference image,讓模型有穩定的視覺錨點。關鍵道具(掛件、快遞包、檢票鉗)如果需要在畫面裡保持一致,也用同樣的方式建成資產。
開啟劇集,點 Generate Shots。Shot cards 出來後,找到有對白或角色特寫的鏡頭。在每張卡的描述裡,動作後面加一行佈局說明,比如"中下部留出兩行字幕的空間"或"臉和手保持在畫面下四分之一以上"。用 @角色名 從資產里拉身份資訊——不需要重新描述臉。
先點生成圖片,檢查角色有沒有漂進你標出的字幕區。如果有,改一下鏡頭描述裡的站位說明,只重生成這一張卡,不用動整集。
構圖確認沒問題之後再生成影片。需要批次處理時,開啟 AI Chat Panel,輸入"Generate videos for Shots 1, 2, and 3.",一次排隊搞定。
把透過的片段拖進 Edit 時間線排好,在這裡加最終字幕。因為你在鏡頭描述裡提前留了空間,字幕放下去不會壓到表演。
把排版要求寫進鏡頭描述,別留到事後
字幕規劃不需要等到後期再補——直接寫進你已經在寫的鏡頭描述裡。除了描述動作,再加一句該留白的地方,比如「畫面下三分之一留空」或「她的臉和手別捱到畫面下邊緣」。角色的身份還是靠 @ 引用從資產裡帶出來,留字幕空間從來不需要重新描述一遍臉,加一句站位說明就夠了。
這會改變提示詞。不要寫「雨中女孩說話,加字幕」,而是寫「留出乾淨的中下方字幕帶,保持角色嘴部和鑰匙吊飾不被遮住,畫面裡不要生成文字」。等鏡頭核准後,再統一加上最終字幕。
把生成的鏡頭放到 Canvas 上,跟你寫的留白要求對照。角色如果漂進了你想留白的區域,就改裁切或站位說明,只重生成這一個鏡頭。字幕區背後的背景太花,就在精修前先簡化這塊區域。對分鏡驅動的短片,鉤子到揭示分鏡 是不錯的起點,因為每個節拍都能帶自己的留白說明。
範例 1:屋頂低聲告白,預留字幕空間
Medium close-up of @Elin on the school rooftop observatory at night. Telescope dome visible behind her, city lights low in distance. Platform: 9:16 vertical. Her face and comet collar pin stay in the upper-middle of frame. She looks down at a folded star map, inhales slowly, then whispers offscreen with a small embarrassed smile. Leave a clean lower-middle caption band — soft dark sky behind it, room for two subtitle lines added in edit. No generated text in frame. No content over eyes, mouth, hands, comet pin, or star map. Clean cel-shaded anime style, quiet blue lighting, subtle hair motion.
這段提示詞規劃了字幕區,但沒有要求模型畫字。表演和道具都保留可讀。
範例 2:列車追逐裡的音效字
Side tracking shot of @Daro on an elevated train walkway at sunrise, full body visible. Rails below, maintenance signs blurred and unreadable. Platform: 16:9 widescreen. He jumps across a narrow gap, lands on one knee, and his ticket punch clips the metal railing. Leave the lower-left corner clear for subtitles added in edit. Reserve a small upper-right space near the ticket punch impact for one editor-added sound cue. No generated text inside the shot. Keep scarf, vest, knee guards, and ticket punch visible throughout. No readable real signage, no extra limbs, no motion blur hiding the belt prop.
音效字有任務,也有位置。它不會蓋住跳躍,也不會占掉字幕區。
範例 3:替單集標題預留空畫面的開場鏡頭
Wide shot of @Suli standing on rocky tide pools at early morning. She is positioned on the lower-right third of frame. Open sky and coastal mist fill the upper-left half — preserve that negative space for a title overlay added in edit. Calm water, orange reflections on wet stones, small research flags in the distance with no readable text. Platform: square 1:1 and 9:16 crop safe. She kneels slightly, lifts the specimen case, and watches a faint glow pulse inside it. No generated title text in the video. Avoid bright detail behind the future title area. Gentle 2D anime, soft coastal light, subtle water ripples. Keep braids, jacket, boots, and case stable.
這顆鏡頭在生成前就已經為標題構圖。因為畫面本身留了空間,疊字不會跟角色搶。
最常見的字幕翻車點
最常見的坑,是核准緊裁切鏡頭後才加字幕。如果臉、手和關鍵道具已經塞滿畫面,就沒有乾淨位置放字。文字區要更早規劃。
另一個坑,是要求生成器直接做可讀字幕。生成文字常常會崩、會在影格之間變掉,或變得完全不可讀。用影片生成提示詞先預留空間,再在剪輯裡加最終字體,會更穩。
創作者也常讓每一層文字都很吵。對白字幕、標題字、衝擊詞和標籤不能一起喊。每顆鏡頭選一個主文字層就好。
第四個坑,是忽略手機 UI。平台按鈕、字幕和 App 控制項可能蓋住頂部、底部或右側邊緣。直式輸出時,讓關鍵文字和劇情道具避開這些區域。
最後,不要讓字幕蓋住表演。AI 漫劇短片裡,一個細微嘴型、眼神偏移或握手動作,可能就是整個情緒節拍。文字應該支撐那個節拍,而不是取代它。
常見問題
AI 漫劇影片需要字幕嗎?
多數時候需要。字幕有助於靜音觀看、無障礙和社群快速理解。最好在最終生成前,就把鏡頭構圖成有乾淨字幕區的版本。
我應該在影片提示詞裡直接生成字幕嗎?
通常不要。先在鏡頭中預留空間,再於剪輯階段加入最終字幕。生成文字可能變形或跨影格漂移,而後期加上的字體更可讀、更一致。
短動漫片的字幕最多幾行?
對大多數手機短片來說,兩行是實用上限。快動作最好一行。如果一句話需要更多空間,就拆到不同節拍,或把對白改短。
直式動漫短片的字幕應該放哪裡?
中下方通常好用,但要避開最底部,因為平台 UI 可能在那裡。文字要遠離眼睛、嘴、手、重要道具,以及任何必須看清的動作。
生成鏡頭前,怎麼給字幕留位置?
把留白要求直接寫進鏡頭描述,跟動作放在一起——比如「畫面下三分之一留空給字幕」。這樣不用另開一份文件就能預留安全區、標出禁字區,而且這就是模型生成鏡頭時讀到的同一段描述。





