前言
你要一個慢慢推向臉部的鏡頭,結果出來的是航拍。你要鏡頭跟在角色身後,它莫名轉到正面繞了一圈又回來。每個 AI 影片創作者都有一個這樣的資料夾——畫面挺好看,就是沒幹 shot 裡要求的事。通常的解法是再多寫幾句鏡頭描述,但往往越寫越亂。
問題不在於模型控制不了鏡頭,而在於運鏡控制是有層級的,但大多數人對所有 shot 都用同一級。一個推鏡只需要一句話。必須和前一個 shot 對齊的構圖需要一張靜幀。要俯衝、跟蹤、再拉回的複雜路徑,需要在空間裡畫出來。這篇文章解釋怎麼針對每個 shot 選對 AI 影片運鏡控制的層級,以及怎麼在 ArcLoop 裡設定,讓它穩穩地執行。
第一級:在 shot 描述裡寫鏡頭語言
對於單一清晰的運動,shot 描述就夠了——前提是鏡頭那句話要寫得像拍攝表,而不是像情緒描述。四個部分,按順序寫:
- 鏡頭起始位置。 高度和距離:「胸口高度,中景。」
- 做什麼動作。 一個動詞:推近、拉遠、左搖、跟隨、仰拍、固定。
- 落在哪裡。 「最終落在她雙手的特寫。」
- 始終保持在畫面裡的元素。 「門框全程保持在左邊緣。」
按這個順序寫一次,放在 shot 靠前的位置。不要在後面換個說法再寫一遍,兩個版本會相互干擾。推、拉、搖、跟、仰、升降——這些詞彙在鏡頭語言詞彙指南裡都有。
第一級覆蓋對話場景裡的大多數 shot、大多數定場鏡頭,以及所有靜止構圖。一個 shot 裡只有一個鏡頭動作加一個角色動作,就從這裡開始,不用往下走。
第二級:用參考靜幀鎖定構圖
有些 shot 不需要複雜運動,需要的是構圖對上——對上前一個 shot、對上分鏡圖板、對上你已經確認過的那幀。用文字描述「角色頭頂在左上三分之一,窗戶佔右半邊」這種事效果很差;一張靜幀就能說清楚。
靜幀可以來自任何地方:一張你喜歡的生成幀、一張分鏡圖、一張用手機取好景拍的照片。上傳到內容庫,繫結為 Visual reference 讓 Agent 可以複用,然後掛到這個 shot 上。文字只需要說明有什麼變化:「構圖和參考靜幀一致,鏡頭固定,她轉頭。」
適合用第二級的情況:
- 兩個 shot 需要剪輯銜接,構圖必須匹配。
- 構圖本身比運動更重要(對稱的走廊、窗前的剪影)。
- 你已經在之前的版本里確認了一張靜幀,想讓影片保持住它。
不適合的情況:參考靜幀帶著你不想要的風格。灰模靜幀會把生成結果拉向灰色;照片會拉向寫實。保留一張風格參考,讓構圖參考只負責構圖這件事。參考選用指南裡講了「一張參考只做一件事」的原則。
第三級:用預演動畫規劃鏡頭路徑
當鏡頭需要依次經過多個位置——高角度,然後穿過建築之間,然後貼著車身——一句話和一張靜幀都搞不定。這是一條路徑,路徑需要畫出來,不能靠描述。灰模預演動畫解決的是「每個時刻鏡頭在哪、角色往哪走」,匯出每個位置的靜幀後再喂回第二級處理。
第三級適用於少數 shot:追逐戲、一鏡到底的揭示、兩個角色交叉走位同時鏡頭在動的情況。值得花這個功夫的判斷標準:這個 shot 已經重新生成五次,每次出問題的都是鏡頭。完整流程在 3D 預演動畫指南裡。
怎麼逐個 shot 判斷用哪一級
- 數這個 shot 裡有幾個鏡頭動作。 零個或一個:第一級。兩個或以上:先把 shot 拆開,再重新判斷。
- 問構圖是否需要和某個東西對齊。 是:第二級,掛一張需要對齊的那個東西的靜幀。
- 問鏡頭是否改變位置,而不只是角度。 推近是改變距離;穿越高樓之間是改變位置。快速運動中跨越位置變化:第三級。
- 不管哪一級,都要把鏡頭語言寫出來。 即使用了第二級和第三級,文字仍然要說明起點、動作、終點和始終在畫面裡的元素。靜幀和預演是對文字的支撐,不是替代。
- 用
@引用角色和場景。 身份識別不是鏡頭的事。shot 描述專注於鏡頭和動作,讓資產負責面孔和佈景。 - 先生成圖片,確認構圖,再生成影片。 靜幀裡構圖錯了,影片裡構圖還是錯的。確認 shot card 沒問題再花積分出影片。
示例一:第一級,單一推鏡
Medium shot, camera at eye level, two meters from @Mira at the kitchen table. Slow push in over the whole shot, ending on a close-up of her face as she reads the letter. The window stays on the right edge throughout and the table edge stays at the bottom. She does not look up or move her hands. Warm afternoon light from the window, no camera shake, no cut, no zoom burst at the end.
示例二:第二級,對齊參考幀
Same framing as the attached reference still: @Tomas centered, the corridor vanishing point behind him, doors on both sides. Camera holds, no move. He walks toward camera from the far end to a medium shot and stops, hands at his sides. Keep the symmetry of the corridor exactly; do not tilt, drift, or reframe as he gets closer. Cold overhead light, same as the reference, no added haze.
示例三:第三級,三個位置的路徑
Shot 2 of 3 — Camera position B from the previz: low angle beside the tracks at knee height, tracking alongside @Sae's motorbike left to right at matching speed. The station platform passes in the background. She leans into the turn; the bike stays centered and does not change direction. End as she pulls half a length ahead of camera. Match previz still 02B.
運鏡控制最常見的幾種失敗方式
- 一句話裡兩個動詞。 「推近並搖向窗戶」是兩個動作。選一個,或者把 shot 拆開。
- 從角色視角描述鏡頭。 「她看到鏡頭靠近」對模型沒有任何資訊。描述鏡頭本身,不是角色的體驗。
- 參考靜幀帶了錯誤的風格。 構圖是對的,但整個片段變成了寫實風格。加一張風格參考;讓靜幀只負責構圖。
- 第一級的 shot 用了第三級。 一個靜止的雙人景做預演動畫是在浪費時間,而且灰模靜幀可能會拉歪整體風格。降級處理。
- 鏡頭描述寫在最後。 放到靠前的位置。模型對開頭幾行的權重更高。
常見問題
ArcLoop 有單獨的鏡頭控制設定嗎?
運鏡方向就寫在 shot 描述和它的參考裡。把鏡頭語言寫進 shot card,構圖需要對齊時掛靜幀,角色和場景的身份識別交給 @ 資產。
一句鏡頭描述可以在多個 shot 裡複用嗎? 可以,而且一個連續場景裡就應該這樣做:相同高度、相同距離、相同鏡頭感。每個 shot 只改動作動詞和落點。
鏡頭對了但角色錯了怎麼辦? 那是身份識別的問題,不是鏡頭問題。先檢查角色資產的 Main image 和參考,再去動鏡頭描述。
怎麼判斷用的層級太低了? 用乾淨的鏡頭描述,同一個問題連續失敗兩次,升一級。每次失敗的方式都不一樣,說明描述本身不清晰——先重寫描述,再考慮加靜幀。
下一步
拿出那個你一直在重新生成的 shot,按四部分順序寫它的鏡頭語言:起點、動作、終點、始終在畫面裡的東西。構圖需要和什麼對齊,就掛那張靜幀。在 ArcLoop 裡開啟專案,先生成圖片,確認構圖,再生成影片。大多數運鏡問題,在描述理順之後,第一級就能解決。





