一格漫画可以压缩好几个时刻:一拳和一个痛苦表情共存于同一画面,对话气泡打断了动作,背景里的阴影暗示着一个还没开口的人。如果你只动画化中心姿势,动作本身可能看起来不错,但画格里的其他信息就全没了。
先把画师呈现的内容拆开来看:姿态、视线落点、道具状态,以及事件在时间轴上的先后顺序。理清这条序列之后,下面介绍如何在 ArcLoop 里把一格画面转化为完整的场景。
上传之前先读懂画格
看着画格,回答四个问题:
- 姿势与重心。 角色的重心在哪里?双手在做什么?用白话写下来:「左肩下沉,下巴转向门口,右手还搭在杯子上。」
- 视线目标。 眼睛看向哪里——画面内还是画外?看向画外意味着你需要自己设计一个反应镜头。
- 道具状态。 道具是在运动过程中(杯子举到一半)还是静止的(杯子放在桌上)?运动中的道具告诉你哪个 shot 是动作,哪个是结果。
- 对话顺序。 按照原版漫画的预设阅读方向和对话气泡的连接关系来看;日式漫画等作品可能采用从右往左的阅读顺序。画在前面的角色不一定是第一个说话的人。在写任何 shot 描述之前,先决定好谁什么时候说话。
那些只是暗示出来的内容——画外的角色、门后面的房间——你需要决定是自己补全还是直接跳过。把这个决定记下来。动画化暗示内容完全没问题;但假装画格里本来就有这些东西,才是连续性崩掉的根源。
上传画格并绑定你的资产
把漫画格图片上传到项目的内容库。这样就有了一份可用的参考文件,但它还没有变成资产。这个区别很重要:内容库存放文件;我的资产存放 Agent 会在各个镜头之间记住并重复使用的创作对象。
现在绑定相关的身份参考:
- character asset: 上传一张干净的正面参考图,绑定为 Main image。画格本身可以作为同一资产上的 Reference image,用来固定这套特定的服装和场景背景。某个重要服装细节的有用裁剪也可以成为另一张 Reference image。如果有反复出现的独立道具,给它单独建一个 prop asset。
- scene asset: 如果画格的背景会重复出现,上传一张环境图并绑定为 scene asset。如果是一次性的室内场景,直接在 shot 里描述就行。
- 画格作为 Visual reference: 把完整画格绑定为 Visual reference 资产,用场景名称命名——比如「屋顶对峙画格」。这给 Agent提供了一个构图锚点,同时不暗示这张画格就是最终输出。
不要指望 ArcLoop 自动把角色从背景里分离出来,或者识别对话气泡。画格是参考图,不是要被拆解的源文件。做拆分工作的,是你在上一步里的解读。
如何把一格画面拆分成三个 Shot
对于一个展示交流过程的画格,可以试试三个段落:先建立参与者的位置,再展示交流过程,最后展示反应。风景画格或单一视觉笑话可能只需要更少的 shot;别为了凑到三个而硬造一个没必要的反应镜头。
Shot 1 — 定场。 远景或中远景。在交流开始前建立空间,配合一个简单的到场动作或保持姿势。保持镜头静止。这个例子里还不需要对白;这个 shot 回答的是人物与环境的位置关系。
Shot 2 — 动作。 中景或近景。这里是画格姿势落地的地方。有运动中道具的角色完成这个动作。如果有对白,说话的角色在这里说。镜头运动要克制——缓慢推进就够了。不要在一个 shot 里叠加摇镜、变焦和焦点切换。
Shot 3 — 反应。 切到倾听者或画外视线的目标。这个 shot 通常在原画格里不存在;你是在从暗示的空间里自己发明它。保持一个表情或小动作就行。镜头可以静止。
撰写 Shot 描述
下面的 @asset 引用指向的是虚构资产,需要先创建并在我的资产里绑定好参考图才能生成。角色、场景和道具的名称都是举例用的——请把资产名称替换成你自己项目里的实际名称。
故事背景:Mara 是一个装着机械臂的快递员,她把一封密封的信件推过柜台,递向还没抬起头来、仍低头看账本的店主。信件正滑到一半,Mara 的手还放在上面。
Shot 1 — 定场镜头
Wide locked view from the doorway of @flooded-shop-interior. @mara takes one step across the threshold, keeping the sealed @letter at her side. @shopkeeper remains seated behind the counter, head down over the open ledger. Keep the counter and the clear path between them visible. The arrival is the only action; no greeting or reaction yet. Morning grey light enters through the single high window, with quiet rain outside. No camera movement or new object reveal.

这个 shot 在任何动作发生之前先建立空间关系,交代每个人在哪里,并为下一拍的冲突做铺垫——但不急着推进到那一刻。
Shot 2 — 动作(分镜的核心姿势)
Medium shot from the shopkeeper's side of the counter in @flooded-shop-interior, looking toward @mara. @mara slides the sealed @letter across the clear counter, keeping her fingertips on its near edge. Her expression remains restrained and practiced. Use a small slow camera push that keeps the entire envelope visible. Grey sidelight from the existing high window separates her hand from the wood. One sliding action only, with no release, pointing gesture, second object, or cut.

这是把分镜格里的姿势转化成时间轴上的动作。动作核心是"推过去";镜头的推进是次要的。一个 shot,一件明确的事。
Shot 3 — 反应镜头
Locked close view of @shopkeeper in @flooded-shop-interior. She lifts her gaze from the ledger toward @mara at the established position across the counter. Keep her hands outside the frame and leave the sealed @letter on the counter below. Her expression holds a guarded recognition; no smile or exaggerated alarm. Soft light from the existing high window reaches her face. The upward glance is the only action. No reaching, head turn, camera move, or cut.

这个虚构画格并没有画出店主的反应。认出对方但仍保持戒备,是一种改编选择,要确认它符合前后的故事。Mara 的目光指出了一个可能的听者,但不能证明对方有什么感受。
生成视频前先复核
先为三个 shot 各生成一张静帧,然后与原始分镜格对照:
- 姿势核对。 Shot 2 的静帧是否与分镜格中的手部和手臂位置吻合?如果不吻合,检查角色资产的 Reference image 在这个角度是否足够清晰,或者 shot 描述是否把动作带偏了。
- 空间连贯性。 Shot 1 和 Shot 2 中,柜台相对于门的位置是否一致?空间矛盾在静帧阶段更容易修正。
- 新增内容。 Shot 3 是创作发挥。店主的反应是否与原始分镜格中可见的内容相矛盾?如果分镜格里她已经抬头看过来,你的 Shot 3 就不应该再让她先低着头。
静帧整体没问题后,用 AI Chat Panel 生成视频:先输入 Generate video for Shot 1.,再依次处理 Shot 2、Shot 3。看完每段片段再请求下一段。如果 Shot 2 里信封滑动的过程不够清晰,可以补充终点描述:信封停在柜台中央附近,Mara 的指尖仍轻触着信封靠近自己的那一侧。如果故事需要展现松手或收回的动作,留到另一个 shot 处理。
在 Edit 中排列片段,并使用 Generate Voiceover 为画格中选定的台词配音,比如「这是给你的。」确认台词由对应角色的声音说出。把这句话放在信封滑过去的那一刻,再检查听者抬眼的反应是否跟在引发它的动作之后。不要仅仅因为原画格还有放对话气泡的空间,就额外加台词。
更多关于在生成视频前用静帧锁定角色姿势的方法,参见姿势参考工作流。
剪辑完成后,将三段片段和原始分镜格并排观看。问自己:这个场景是否保留了原来的情感含义,还是引入了矛盾——一个错误的表情,一个改变了角色意图的手势?目标不是像素级还原分镜格,而是把它的意义延续到时间之中。
常见问题
哪种分镜格适合作为第一个练习? 从你自己画的或有改编权限的分镜格开始。选一个互动关系清晰、道具明确、说话顺序可辨认的格子。人物密集的打斗场面或复杂的页面排版留到之后练习。
如果分镜格里有三四个角色怎么办? 确定每个 shot 的主角。那些出现在分镜格但不是动作推动者的角色,可以出现在定场镜头中,在动作和反应镜头里剪掉。
Shot 2 老是丢失机械臂的细节。
把机械臂的特写裁切图作为 Reference image 绑定到角色资产上。然后在 shot 描述里直接点名:@mara's mechanical arm, silver forearm joints visible。资产引用和描述相互加强,细节更不容易丢失。
生成之前应该绑定多少张 Reference image? 先绑定一张清晰的 Main image,只有当需要补充某个特定角度或细节时才添加 Reference image。检查每张参考图的实际贡献,有冲突或重复的及时删掉,不要指望堆更多图片来解决问题。
打开你的 ArcLoop 项目,在我的资产里绑定分镜格和角色参考,从定场镜头开始。





