引言
"MiniMax H3 anime" 是圍繞這個模型增長最快的搜尋詞之一,而大家曬出來的結果分成明顯兩派。一派做出的是乾淨的 2D 效果——平塗式賽璐璐上色、穩定的線條粗細、動畫式的運動節奏。另一派做出來的更像是套了動畫濾鏡的 3D 渲染:柔和的體積光、帶景深的攝影質感,臉還會一條片段比一條片段更走樣一點。
差別幾乎從來不在模型本身,而在提示詞和參考圖是怎麼配置的。H3 是一個全模態模型——它會把圖片、片段、音訊和你的文字放在一起讀——所以動畫效果是你錨定出來的,不是靠一個形容詞求來的。這篇文章講清楚動畫向提示詞該怎麼搭結構、為什麼對大多數創作者來說參考圖比 LoRA 更划算,以及怎麼用 ArcLoop 的配置讓角色從第一條片段到最後一條都是同一個人。
光寫 "anime style" 為什麼鎖不住風格
單獨寫"anime style"是個很弱的訊號。這個模型見過各種流派的動畫,也見過各種 3D-動畫混血風格,一個光禿禿的形容詞等於把選擇權交給它自己挑。真正能鎖定畫風的是這三件事:
一張已經是你想要效果的參考圖。 H3 每次生成最多能接受九張參考圖。一張風格精準的乾淨 2D 角色插畫——線條粗細、上色方式、配色——比任何一段風格描述文字都管用。這是最重要的輸入,沒有之一。
說清楚"怎麼畫",而不是"什麼型別"的風格詞彙。 "Flat cel shading, two-tone shadows, clean dark linework, no photographic depth of field, limited animation timing" 描述的是怎麼畫出來的。"Anime style, high quality, beautiful" 這種話,模型根本沒法拿去執行。2D 動畫提示詞詞彙表在 H3 上完全適用,不用改。
一份你真心想排除的負面清單。 H3 對簡短的"要避免什麼"清單反應很好:真實感皮膚質感、3D 渲染光照、鏡頭虛化。列出三四個上次毀了你效果的東西就夠了。
怎麼寫一條動畫鏡頭提示詞
一條好用的 H3 動畫提示詞,應該是一份鏡頭簡報,而不是角色描述。角色活在參考圖裡,提示詞只描述一個鏡頭:
@Rin in the school rooftop scene, 2D anime, flat cel shading with two-tone
shadows and clean dark linework. Medium shot. She leans on the railing, wind
lifts her hair once, she turns her head toward the camera and smiles. Late
afternoon sun, long soft shadows, no lens blur. Sound: distant traffic, a
single gust, her small laugh at the end.
注意這裡沒有寫的東西:髮色、眼型、校服細節。這些都屬於參考圖,每次提示詞裡都重新描述一遍,正是身份跑偏的根源——文字和圖片會開始互相打架。也注意這裡只有一個動作:靠、吹、轉、笑。H3 處理一條片段裡一個清楚節拍的效果,遠好於同時塞一堆事情,而且動畫式的節奏本來就更適合落在一個持續的動作上。
要做對白鏡頭,就在同一條提示詞裡把聲音也描述進去。H3 會把音訊和畫面一起生成,所以對好口型的臺詞加環境音,一次生成就能拿到:
@Rin, close-up, 2D anime, flat shading. She says quietly: "You came back."
Small pause, eyes drop, then meet the camera again. Sound: evening cicadas,
her line clear and close, no music.
對大多數創作者來說,參考圖比 LoRA 划算
因為 H3 的基礎權重是開源的,"minimax h3 anime lora" 確實是個有搜尋量的詞——有人在用它訓練風格介面卡。這條路是存在的,而且對需要在成千上萬條片段裡統一一種風格、又有硬體跑自定義模型的工作室來說是說得通的。
但對個人創作者或小團隊來說,這是條慢路。LoRA 鎖死一種風格,風格一變就得重新跑一次訓練;參考圖是按次生成來鎖定風格的,不花錢,你的畫風一變它也跟著變。九個圖片槽位加三段影片參考,足夠在一次請求裡釘住角色、服裝、配色和運動風格。先從這裡開始。如果你發現自己連續一個月每條提示詞都在塞同樣那九張參考圖,那才是 LoRA 開始划算的時候——在這之前都不是。
在 ArcLoop 裡讓角色不跑設定
在 ArcLoop 裡,MiniMax H3 是可選的生成模型之一,而動畫工作流的核心,基本就是在你寫任何提示詞之前,先把該放的東西放到該放的位置:
- 把 Story Brief 設成 Anime。 專案的風格設定會影響下游的每一次生成,這樣你就不用在每條提示詞裡跟預設風格較勁。
- 在我的資產裡把角色做成一個資產。 把你最乾淨的一張 2D 插畫繫結為 Main image,再加一張轉身圖和一兩張表情圖作為 Reference image。你在提示詞裡引用角色時,H3 讀的就是這些——身份錨點在這裡,不在你的提示詞裡。
- 為風格加一張 Visual reference。 一張專門展示具體畫法——上色、線條、配色——和角色分開的圖,這樣即使某個鏡頭裡角色很小或者根本不在畫面裡,畫風也能保持一致。
- 從 Episode 的 Storyboard 裡 Generate Shots。 每張 shot card 的描述用
@引用角色,只描述這個鏡頭的動作、運鏡、光線和聲音。用資產引用比每個鏡頭都從頭描述角色靠譜得多——這是產品本身的建議,對動畫來說更是加倍成立,因為哪怕眼型差一點點,一眼就能看出來。 - 先生成圖片,再生成影片。 先在靜幀上檢查風格——平塗上色有沒有穩住、線條乾不乾淨、臉對不對得上設定——再花一次影片生成的額度。一張看起來像 3D 的靜幀,動起來也不會變成 2D。
- 畫風定了之後再批次生成。 在 AI Chat Panel 裡說一句"給 Shot 1、2、3 生成影片",就能讓整批生成用同一套資產和風格。
常見踩坑
- 每條提示詞都重新描述角色。 文字和參考圖會互相打架,臉一條片段一個樣。引用資產,只描述鏡頭。
- 只寫風格詞,沒配風格參考圖。 "Anime style" 這種詞單獨用,等於讓模型自己挑一種混血風格。用一張圖把它釘住。
- 一條片段塞三個動作。 動畫式節奏需要一個持續的節拍。一次生成只放一個動作、一個運鏡、一次情緒轉折。
- 在 2D 場景裡用電影感的光線描述。 "體積光god rays、淺景深" 這種話會把 H3 拉向它的 3D 那一面。像 2D 畫師一樣去描述光:"暖色側光、硬邊陰影。"
- 用影片而不是靜幀來判斷風格。 靜幀更便宜,風格看得也更清楚。風格問題在靜幀階段就解決掉。
常見問題
MiniMax H3 能把動畫做好嗎?
能,前提是用參考圖錨定風格、提示詞描述的是畫法而不是型別。沒有參考圖的話,結果會往 3D-動畫混血風格上飄。
在 H3 上做動畫需要 LoRA 嗎?
對大多數創作者來說不需要。參考圖能按次免費鎖定風格。LoRA 更適合需要在自有硬體上大規模統一一種風格的工作室。
H3 做動畫片段能給到多高的解析度、多長的時長?
雲端模型最高 2K,單條片段 4 到 15 秒;解析度與時長限制指南把每個檔位都講了一遍,包括 H3 Max。
怎麼讓角色在很多條片段裡都保持一致?
把角色的參考圖繫結到一個資產上,每個鏡頭都用 @ 引用它。讓臉在多個鏡頭間保持穩定的那套方法,原樣適用於 H3。
先錨定,再寫提示詞
H3 把動畫創作者一直想要的東西都給了——原生音訊、混合參考、真正的 2K——但它只把這些給那些錨定了畫風、只描述一個鏡頭的提示詞。把 Story Brief 設成 Anime,繫結你的角色,加一張風格參考圖,再寫鏡頭。開啟一個專案,在生成任何一秒影片之前,先把第一張靜幀鎖定下來。





