兩個同天發布的模型,不同的活
MiniMax H3 和 Seedance 2.5 在七月底的同一天發布,從那以後對比文章就沒停過。大多數文章都想分出個勝負。但對真正在做動畫或短劇的人來說,這是個問錯的問題,因為這兩個模型本來就是為不同的活兒設計的——而且在 ArcLoop 裡,你根本不需要為整個專案只選一個。每個鏡頭都能單獨選自己的模型。
所以這不是一張成績單,而是一份地圖:哪些鏡頭 H3 處理得最好,哪些 Seedance 2.5 處理得最好,以及怎麼讓兩個模型都用同一套角色資產,還不讓演員的臉在切換模型之間變樣。如果你想看跟上一代 Seedance 的正面對比,H3 對比 Seedance 2.0講了這部分。
參數表背後的邏輯差異
| MiniMax H3 | Seedance 2.5 | |
|---|---|---|
| 單次生成 | 4–15 秒 | 最長 30 秒;長影片模式可以到幾分鐘 |
| 最高解析度 | 2K(雲端) | 最高 4K |
| 每次生成的參考數量 | 9 張圖片、3 段片段、3 段音訊 | 最多 50 個多模態參考(圖片、影片、音訊、指令碼) |
| 原生音訊 | 支援,32kHz 立體聲,和畫面一起生成 | 支援 |
| 編輯 | 精確影片編輯、音畫續寫 | 基於時間戳的編輯、給已有影片做延長 |
| 開源權重 | 基礎模型開源(768p);2K 階段雲端專屬 | 閉源 |
| 調優方向 | 參考還原度、音樂與節奏、全模態引導 | 長鏡頭連貫性、大規模參考集、單次生成裡的多鏡頭敘事 |
把這張表讀成兩種設計哲學。H3 把生成時長收得很短,換來的是精細的控制力——九張按順序引用的參考圖、和動作精準貼合的音訊、一個社群可以在上面二次開發的開源底座。Seedance 2.5 把生成拉得又長又寬——一次三十秒、五十個參考、一次請求裡的多鏡頭序列。
MiniMax H3 的優勢場景
音樂驅動的節拍。 動畫 PV、片頭、副歌高潮——任何聲音必須精準踩在動作上的場景。H3 會把音訊和畫面一起生成,一段音訊參考配上一張畫面就能直接引導節奏。動畫音樂影片指南基本上就是一份 H3 使用手冊。
需要精確還原參考的鏡頭。 當一個鏡頭必須匹配一張具體的插畫——OC 的臉、服裝的某個細節——H3 按順序引用參考圖的機制,能精確控制哪張圖管哪個部分。參考數量少,但每一張的話語權更重。
快速迭代。 用 H3 Max 檔位,草稿能以接近實時的速度在 768p 下回來。節奏測試、走位變體、"這個剪輯點行不行"——H3 是你用來試錯的地方。
風格化的 2D 畫風。 釘住一張風格參考圖之後,H3 在整條片段裡都能穩住平塗上色和線條;動畫提示詞指南講了具體怎麼配置。
Seedance 2.5 的優勢場景
長鏡頭一鏡到底。 三十秒的邊走邊說、緩慢的靠近、一段連貫的舞蹈——任何一剪就會打斷表演的場景。H3 需要兩條片段拼接才能做到,Seedance 2.5 一次就夠。
一條提示詞生成多鏡頭序列。 Seedance 家族從 1.0 開始就把多鏡頭敘事當成原生能力。描述三個節拍,一次生成就能拿到三個保持連貫性的鏡頭。對短劇快速出草稿來說,這是實打實省時間。
大規模參考集。 一個有四個角色、兩個場景、一套固定道具的場景,很容易超過 H3 九張圖的上限。Seedance 五十個參考的額度,能一次裝下整個班底。
4K 交付。 如果規格要求是 4K,Seedance 2.5 能直接渲染到位。H3 最高只到 2K。
鏡頭類型對照表
| 鏡頭型別 | 選誰 | 為什麼 |
|---|---|---|
| 卡點音樂的片頭 / PV 節拍 | H3 | 音訊和動作一起生成,能引導節奏 |
| 必須匹配插畫的角色特寫 | H3 | 每張參考圖的引導權重更精確 |
| 20–30 秒的連續表演 | Seedance 2.5 | 單鏡頭超過 15 秒 |
| 一次出三個節拍的場景草稿 | Seedance 2.5 | 原生支援多鏡頭 |
| 群像或多人物場景,資產多 | Seedance 2.5 | 參考數量額度大 |
| 節奏 / 走位草稿 | H3(Max 檔位) | 接近實時的迭代速度 |
| 最終 4K 成片 | Seedance 2.5 | 解析度上限更高 |
| 需要精確還原臉部的 2K 關鍵鏡頭成片 | H3 | 2K 階段加上精確的參考還原 |
ArcLoop 裡兩個模型怎麼搭配用
這份對照表只有在切換模型不會犧牲一致性的前提下才成立。在 ArcLoop 裡確實不會,因為身份是活在專案裡的,不是活在模型裡的:
- 在我的資產裡把班底建一次就夠。 繫結每個角色的 Main image 和 Reference image。當一個鏡頭用
@引用角色時,兩個模型讀的是同一套參考。 - 按 shot card 逐個選模型。 在 Storyboard 上,每張 shot card 都帶著自己的描述、時長和生成模型。同一個 episode 裡,可以把副歌高潮交給 H3,把長鏡頭的靠近交給 Seedance 2.5。
- 讓鏡頭描述跟具體模型無關。 運鏡、動作、光線、聲音——一條片段一個動作。讓參考圖去承載身份資訊,這樣切換模型也不會改變臉。
- 在還原度重要的鏡頭上先生成靜幀, 再生成影片。模型切換帶來的問題會先在靜幀上顯現出來,在那裡就能發現。
- 在 Edit 時間線上剪輯。 兩個模型出的片段都會落在同一條時間線上;如果 Seedance 的鏡頭和 H3 的鏡頭在光線上對不上,剪輯階段就能先發現,不用等觀眾來發現。
有一條來自產品文件的硬性前提要注意:要用 Seedance 2.0 系列生成影片,對應的元素必須先存在為一個資產——這正好就是上面這套配置方法。
最容易搞錯的事
- 整個專案只選一個模型。 你會白白放棄長鏡頭或者音樂節拍其中一項能力,沒必要。
- 給每個模型分別重新上傳參考圖。 把它們繫結到資產上一次就夠,兩個模型都會讀取。
- 拿 H3 去跑 30 秒的活,或者拿 Seedance 去卡 5 秒的音樂點。 每個模型在不是為它設計的場景裡,都會輸掉這場比較。
- 只靠參數列來比較。 真正決定性的測試是在你自己的班底上看連貫性;拿同樣三個鏡頭在兩個模型上都跑一遍,盯著臉看。
常見問題
MiniMax H3 比 Seedance 2.5 更好嗎?
對短的、音樂驅動的、需要精確還原參考的鏡頭,通常是的。對長鏡頭一鏡到底、多人物場景、4K 交付來說,Seedance 2.5 是更強的選擇。兩個模型在 ArcLoop 裡都能用。
我能在同一個影片裡同時用兩個模型嗎?
可以。ArcLoop 裡每張 shot card 都能單獨選生成模型,兩邊出的片段最後都落在同一條 Edit 時間線上。
哪個模型能讓我的角色更一致?
一致性主要來自繫結好的資產和 @ 引用,而不是模型本身。用同一套參考圖,兩個模型都能保持身份穩定;H3 對每張圖的控制更精細,Seedance 能接受的圖片數量更多。
哪個更便宜?
要看具體鏡頭:H3 Max 出的草稿每秒非常便宜,而一條 30 秒的 Seedance 鏡頭能頂替兩次 H3 生成加一次拼接。要算的是整個迭代迴圈的成本,不是單條片段的成本。
先給鏡頭分類,再選模型
同一天發布容易招來"誰更強"的對立敘事;但一個真正在推進的專案,會把它們當成同一張工作臺上的兩件工具。把班底建成資產,描述鏡頭時不寫角色長相,讓鏡頭型別自己決定用哪個模型。開啟你的專案,拿同樣三個鏡頭在兩個模型上都試一遍——臉會告訴你參數列說不出來的一切。





