前言
你腦子裡有這個鏡頭:先從高處俯瞰公路全景,接著俯衝進兩棟樓之間,在車進入畫面時抓住它,側面跟拍一拍,然後拉遠直到整座城市都收進框裡。你把這一切寫進 prompt,模型給你的是一輛反向行駛的車,或者攝像機自始至終貼著地面,或者四個畫面漂亮但根本不屬於同一組運動的片段。
問題不在模型。鏡頭運動和角色走位是空間資訊,而文字是裝空間資訊的爛容器。灰模 3D 預演——空白模型、粗糙場景、一臺攝像機——才是更好的容器。這篇指南告訴你怎麼搭一個只回答三個問題的預演,怎麼每個機位匯出一幀靜圖,再怎麼把每張靜圖變成一個 ArcLoop shot,讓整組鏡頭連起來。如果你一直在想怎麼在快速多鏡頭運動裡控住攝像機,這就是那套工作流。
預演是用來做什麼的,不是用來做什麼的
預演只回答三個問題,不多:
- 攝像機在哪裡,下一步去哪裡?
- 每個角色從哪裡出發,往哪個方向移動?
- 什麼在什麼前面? 前景柱子、角色、背景建築——就是這個順序。
它不回答任何東西長什麼樣。場景可以是照片參考搭的粗塊。角色可以是膠囊體。沒有人會看到預演;它的全部工作就是鎖住骨架,讓生成只需要填皮膚。
這改變了你審片的方式。AI 片段回來之後,你拿它跟預演比,不是跟風格參考比。鏡頭方向一致、從左到右的路線一致、前景背景的層次一致——透過。光效和材質可以是模型想要的任何東西。
如果你有 3D 背景,3D 轉 AI 動漫流程指南涵蓋了更多遷移內容。這篇文章只盯一件事:鏡頭路徑。
讓模型能跟上的預演規則
- 一個 shot,一個鏡頭運動。 預演裡有一個跟拍變成升降變成拉遠,那就是三個 shot。在那裡剪開。
- 把攝像機放在真實攝像機能待的地方。 模型學的是真實攝影。穿牆或者穿過角色的攝像機,生成出來也會這樣。
- 標記路線,不是表演。 一個膠囊體沿路徑滑過去就夠了。表演來自 shot 描述,不來自預演。
- 保持比例誠實。 如果角色站在門旁邊只有兩個頭高,生成出來的角色也會是那麼高。
- 按專案的寬高比匯出。 16:9 的預演靜幀框不住 9:16 的 shot。在 Story Brief 裡設好交付比例,讓預演攝像機跟上。
如何搭預演並交給 ArcLoop,一步一步來
- 用參考照片搭場景粗塊。 粗形狀就夠了:道路、兩棟樓的體塊、前景一根柱子。如果我的資產裡已經有一個場景資產,用它的 Main image 作為參考,讓預演和最終成片共享一個佈局。
- 放置角色並畫出走位路線。 每個角色一條路徑。記錄他們在哪裡停下來。
- 設定機位。 對於運動鏡頭,記錄起始幀和結束幀。對於多機位場景,放好每臺攝像機,按出現順序編號。
- 放一遍,修掉明顯問題。 如果攝像機把角色擋在牆後面看不見,就移牆。不要打磨其他任何東西。
- 每個機位匯出一張靜幀。 每個 shot 的起始幀和結束幀。把靜幀上傳到內容庫;也上傳預演片段,讓團隊能看到預期的運動。
- 把靜幀作為 Visual reference 資產繫結,以場景命名,這樣構圖就是 Agent 可以複用的東西,而不是散落在對話裡的備註。
- 在 episode 上 Generate Shots,然後編輯每個 shot card。 附上對應的預演靜幀,用
@引用角色和場景,只寫這個 shot 的攝像機和動作。不要描述面部或服裝;資產會處理那些。 - 先生成圖片,對比預演靜幀,再生成影片。 如果靜幀的構圖是對的,影片通常也會保持。如果不對,在花 credit 生成運動之前先修 shot card。
鏡頭路徑在 shot card 裡住哪裡
攝像機資訊屬於 shot 描述本身,用普通的攝影語言,按運動發生的順序寫:攝像機從哪裡開始,做什麼動作,到哪裡結束,什麼東西保持在畫面裡。把預演靜幀放在參考槽裡,不是放在文字裡。文字應該讀起來像 shot list 上的一行,不像劇本里的一個段落。
詞彙方面——推、拉、搖、跟、仰、升——參見攝影語言指南。兩三個角色的場景,多角色走位指南涵蓋視線和誰接哪句臺詞。
示例 1:單人奔跑,跟拍攝像機
最簡單的情況:一個角色沿山路向上跑,經過一根石柱,在山脊的雕像前停下。預演裡是一條路線和一臺從後面跟拍的攝像機。拆成一個跟拍 shot 和一個到達 shot,這樣每個各有一個明確的動作。
Shot 1 — Tracking shot, camera behind and slightly left of @Kaito, following at running pace along the mountain path. @Kaito runs uphill without slowing, passes the stone pillar on the right so it crosses the foreground for a few frames, and keeps going. Background: the ridge and the statue growing larger with every stride. Camera stays at shoulder height, no tilt, no push-in. Late afternoon light from the left. Composition: match previz still 01A.
Shot 2 — Camera continues the same track from Shot 1, then slows and tilts up as @Kaito reaches the ridge and stops in front of @Guardian Statue. He drops from a run to a standing breath, hands on his knees, chest rising. The statue fills the upper right of frame; the valley opens wide behind him as the camera settles. Same light direction as Shot 1. Composition: match previz still 01B.
示例 2:兩個角色,三臺攝像機
開放世界風格的街頭對話:攝像機住在主角背後,所以單個固定機位會穿牆。預演用三臺攝像機:A 走上來時從後面拍,B 那側的反打,以及 B 走開時的第三臺。三臺攝像機,三個 shot。
Shot 3 — Over-the-shoulder, camera behind @Ren at head height, tracking at walking pace as he walks up to @Vendor Marcus at the food cart. @Ren slows and stops two steps away. Marcus looks up from the grill and turns to face him. Foreground: Ren's shoulder on the left edge; midground: Marcus and the cart; background: the street and passing traffic. Camera stops when Ren stops. Match previz camera 1.
Shot 4 — Reverse angle from behind @Vendor Marcus, camera at chest height, static, same distance as Shot 3 so the cut feels like a real conversation. @Ren is now facing camera, talking, one hand gesturing toward the cart, the other in his jacket pocket. Marcus's shoulder frames the left edge and stays out of focus. The street behind Ren matches the background of Shot 3. Match previz camera 2.
示例 3:快速行駛的車,四個機位
速度是 prompt 最容易失敗的地方。預演設定四個機位:道路上方的高角度、在兩樓之間俯衝、車的側檢視、拉遠到廣角。每個是獨立的 shot;模型一次只需要執行一個動作。
Shot 5 — High-angle establishing shot over @Neon Expressway at night, camera slowly descending toward the road, no pan. @Vela's car enters from the bottom of frame, small, headlights on, and drives away from camera up the center lane. The road layout must read clearly: two lanes, towers on both sides, a gap between the two tallest towers ahead. Rain-wet asphalt reflecting signs. Match previz camera 1.
Shot 6 — Camera flies forward between the two towers at car height, tracking alongside @Vela's car in a clean side profile, left to right. Neon reflections streak across the door and the windows. The car stays centered in frame and does not change direction or lane. The towers pass as vertical streaks in the background. End on the car pulling slightly ahead of camera. Match previz camera 3.
最常見的崩法
- 攝像機反向。 預演是從左到右,片段卻從右到左。拒絕它。確認 shot card 裡用文字寫明瞭方向,不是隻靠參考靜幀。
- 角色跑到了錯誤的那側。 通常是路線沒寫進文字裡。加上「經過右邊的石柱」。
- 一個 shot 裡兩個運動。 如果模型得先俯衝再拉遠,其中一個會丟掉。拆開這個 shot。
- 預演靜幀被原樣複製,材質也帶進去了。 灰模靜幀可能把生成拉向灰色調。用風格參考和場景的 Main image 鎖住風格;預演靜幀是構圖參考,不是畫面參考。
- 比例漂移。 預演裡膠囊體太高,片段裡就變成了巨人。在預演裡修比例,不是在 prompt 裡修。
常見問題
我需要一個完整的 3D 場景嗎? 不需要。幾個方塊搭的照片參考粗塊就夠了。預演只需要顯示攝像機和角色在哪裡。
我能跳過靜幀,直接用文字描述預演嗎? 可以,簡單鏡頭也行得通。但凡攝像機動得快或者兩個角色有交叉,靜幀才是讓構圖保持準確的東西。
預演片段本身要放進 shot 裡嗎?
上傳到內容庫讓團隊能看到預期的運動。shot card 用靜幀做構圖參考,用 @ 資產做身份識別,用文字寫鏡頭路徑。
如果模型無視預演靜幀怎麼辦? 先檢查文字。如果鏡頭運動只在圖片裡,把它拼出來:起始位置、運動、結束位置。然後先重新生成圖片,再生成影片。
下一步
找一個你一直在反覆重生成的 shot——那個攝像機從來不聽話的那個——只為那個 shot 做預演。匯出起始幀和結束幀,繫結為 Visual reference,用 @ 資產和按順序寫好的鏡頭運動重建 shot card。在 ArcLoop 裡開啟專案,先生成靜幀,在碰影片之前拿它和預演幀對比。





