這條流程到底是什麼——以及它不是什麼
"AI VTuber 模型生成器"是這個領域增長最快的搜尋詞之一,它暗示了一臺你實際上得不到的機器:畫稿進去,繫結好的模型出來,一鍵搞定。這臺機器並不存在。真正存在的,是一條流程線,其中兩個階段被大幅加速了——另外三個階段,還是老樣子,該怎麼幹還得怎麼幹。
這篇指南把整條路徑都畫出來:每個階段各自產出什麼、生成技術真正能省下幾周時間的地方在哪、它又在哪些地方悄悄增加了工作量,以及市場中間水平的價格實際是多少。如果你想要的是幻想版本,這篇文章不適合你。如果你想要一個真正能動的、屬於你自己原創角色的模型,那就接著往下看。
五個階段各自產出什麼
1. 設計——AI 加速。 先確定角色是誰:輪廓、配色、服裝,以及兩三個能在任何表情下都保持不變的身份錨點。這以前意味著要委託好幾輪概念稿;現在,這是整條流程裡生成技術用得最狠、最划算的一環。在 ArcLoop 裡,在一個世界裡把 VTuber 建成一個角色資產:生成多個造型,把最好的一個 Bind 為 Main Image,其餘的當作 Reference Image 附上去。從這之後,Agent 會一直記得這個角色,之後每一次請求——新角度、新表情、新服裝——都能保持不跑設定,因為你是用 @ 引用角色資產,而不是每次從頭描述一遍。如果這個角色打算承載一整個原創世界和故事,建議從 OC 優先設計開始,而不是一張一次性的肖像圖。
2. 主圖——AI 生成,人工收尾。 一張中性姿勢的插畫,解析度要夠用(4000px 量級),再加上繫結需要的一整套差分視角:閉眼、張嘴、表情組、開關狀態。這一整套都要對著鎖定的角色資產生成;你在第一階段做的設計工作,就是讓十個差分依然看起來是同一個角色的原因。姿勢規劃要考慮到繫結的需要——手臂離開軀幹、頭髮邊界清晰可辨——就像可繫結設定圖裡講的那樣佈局。
3. 素材分層——人工完成,參考圖輔助。 那張平面插畫會變成 30 到 60 個以上的命名圖層,而畫面藏起來的每一處——頭髮下面的額頭、口腔內部、外套下面的軀幹——都要在 Photoshop 或 CLIP STUDIO PAINT 裡手工畫出來。生成技術在這一步只能起到證據的作用:第二階段生成的差分視角,會告訴你每個隱藏區域裡該有什麼,讓你照著描,而不是憑空猜。完整的切圖步驟在分層清單裡。
4. 繫結(rigging)——人工完成,需要專業技能,真正的成本大頭。 在 Live2D Cubism 裡,每個圖層都要被建網格、接上引數:眨眼、對口型、頭部 XYZ 軸、身體擺動、頭髮和衣服的物理效果。目前沒有任何工具能自動化到能拿去直播的品質。這是幾周的專業工作量,也是它主導整個預算的原因。
5. 面部追蹤設定——很快。 完成的模型匯入面部追蹤軟體,針對你的攝像頭校準引數,給開關狀態配上快捷鍵。一個晚上就能搞定,算不上一個"專案"。
錢都花在哪裡
價格因地區和資歷不同差異很大,但市場的整體結構是一致的:畫稿和繫結通常分開報價,入門級的全套委託從幾百美元起,中等水平的作品要到小几千美元,頂級的繫結師-畫師組合收費能到五位數。光是繫結這一項,經常就和畫稿一樣貴,甚至更貴。
生成技術改變的是這個等式的左邊。設計探索和差分製作——過去在畫稿報價裡佔很大一塊——從幾周壓縮到幾天。它改變不了等式的右邊:繫結該花多少錢還是花多少錢,而一個邊界處理得亂七八糟的生成角色,繫結成本反而可能更高,因為清理工作最後都會落到繫結師頭上。
老實做預算:如果你自己生成畫稿,省下來的插畫預算,應該有一部分轉移到分層清理和繫結品質上,而不是就此憑空消失。
AI 來源專案獨有的兩種翻車方式
差分之間的身份跑偏。 十個生成出來的表情,十張略有差異的臉——繫結師一切換差分,模型就會看起來在明顯地變形。這是設計階段的失敗,不是繫結階段的失敗:根源在於每個差分都是從頭單獨描述出來的。解決辦法是把角色鎖定成一個角色資產,每個差分都用 @ 引用它來生成,這和讓臉在不同鏡頭間保持穩定是同一套規矩。
交付時沒有說明畫作是 AI 來源的。 VTuber 社群對 AI 來源的模型態度很分明,不少繫結師都吃過專案做到一半才發現真相的虧。有些人會直接拒絕這類工作,更多人會接,但會把清理工作算進報價裡。第一條訊息就把這件事說清楚。這既是禮貌,也符合你自己的利益——清理工作的討論應該發生在報價之前,而不是變成事後的糾紛。
一份現實的首個模型計劃
- 把角色做成角色資產,反覆設計,直到連續三次生成都不用修改、一眼就能看出是同一個人。
- 在一次會話裡把主圖姿勢和整套差分都生成出來,趁風格和光影選擇還一致的時候。
- 把主圖放大,再開始切圖——清單開啟,參考圖套組放在旁邊,邊切邊命名圖層。
- 按規範打包 PSD:格式設定、唯一命名、差分對齊到位、預覽 PNG、差分清單、AI 來源說明。
- 把你的動作預期寫清楚再去委託繫結——只做眨眼說話的半身模型,和做完整轉頭,報價會不一樣。
- 校準好追蹤,開播,把讓你不滿意的地方都記下來留給第一輪修改,而不是在出道之前追求完美。
常見問題
真的沒有一鍵生成的 AI VTuber 模型工具嗎?
確實有工具能自動切割簡單的圖片,或者生成預先繫結好的通用模板形象。但它們目前都做不到的,是給你的原創角色做出一個有品質的繫結。如果這個角色對你來說是有意義的,上面這條流程才是正路。
我能先跳過繫結,用一個"反應式 PNG"頂上嗎?
可以,而且這是一條正經的過渡路徑:一套 PNGTuber 只需要同一個角色的兩三個狀態,用角色資產的工作流幾分鐘就能生成出來。可以先拿這個出道,同時讓完整模型在後臺製作。
我應該自己繫結嗎?
Cubism 是能學會的,自己繫結一個簡單的半身模型,是一個值得尊敬的入門專案。要有心理準備,學習曲線花掉的晚上會比切圖本身還多。不管是不是自己繫結,PSD 規範都是一樣的——就算是給自己用,也要好好打包。
角色一定要是動漫風格嗎?
Live2D 能處理任何風格的分層 2D 畫作,但面部追蹤對動漫比例的眼睛和嘴巴識別得最清楚,這也是為什麼這個生態看起來是現在這個樣子。
先把角色做穩,再做模型
設計之後的每一個階段,消耗的都是設計階段的產出。一個鎖定好、有角色資產做錨點的角色,能讓差分保持一致、切圖有據可循、繫結結果可預期,委託溝通也能短一點。開啟一個專案,建立角色,在同一張臉連續三次生成都對著你之前,先別碰繪圖工具。





