이 파이프라인의 실체 — 그리고 되지 않는 것
"AI VTuber 모델 생성기"는 이 분야에서 가장 빠르게 늘고 있는 검색어 중 하나지만, 실제로는 존재하지 않는 기계를 상상하게 만듭니다: 아트를 넣으면 리깅된 모델이 원클릭으로 나오는 기계 말이죠. 그런 기계는 존재하지 않습니다. 실제로 존재하는 것은, 두 단계는 극적으로 빨라졌지만 나머지 세 단계는 여전히 예전 그대로인 파이프라인입니다.
이 가이드는 전체 경로를 짚어봅니다: 각 단계가 무엇을 만들어내는지, 생성이 진짜로 몇 주를 아껴주는 지점은 어디인지, 조용히 일을 늘리는 지점은 어디인지, 그리고 시장의 중간대가 실제로 얼마를 지불하는지까지요. 환상적인 버전을 원한다면, 이 글은 맞는 페이지가 아닙니다. 여러분의 오리지널 캐릭터가 움직이는 모델을 원한다면, 계속 읽으세요.
다섯 단계와 각 단계의 결과물
1. 디자인 — AI로 가속. 캐릭터가 누구인지 정합니다: 실루엣, 팔레트, 의상, 그리고 모든 표정에서도 살아남는 두세 개의 정체성 앵커까지요. 예전에는 이 단계에서 컨셉 라운드를 커미션해야 했지만, 지금은 전체 파이프라인에서 생성이 가장 강력하게 쓰이는 지점입니다. ArcLoop에서는 VTuber를 IP 프로젝트 안의 캐릭터 자산으로 만듭니다: 여러 룩을 생성하고, 가장 좋은 것을 main image로 지정하고, 나머지는 reference image로 첨부하세요. 그 이후로는 에이전트가 캐릭터를 기억하기 때문에, 새로운 각도, 새로운 표정, 새로운 의상 등 이후의 모든 요청이 캐릭터가 흔들리지 않게 유지됩니다. 처음부터 다시 설명하는 대신 @로 자산을 참조하기 때문이죠. 캐릭터가 오리지널 세계관과 이야기를 함께 짊어질 예정이라면, 한 장짜리 초상화가 아니라 OC 우선 디자인에서 시작하세요.
2. 마스터 아트 — AI가 생성하고 사람이 마무리. 작업 해상도(4000px급)의 중립 포즈 일러스트 한 장에, 리깅에 필요한 차분 뷰까지: 감은 눈, 벌린 입, 표정 세트, 토글 상태. 고정된 자산을 기준으로 이 세트를 생성하세요. 1단계에서 한 디자인 작업이 바로 차분 열 개를 한 캐릭터처럼 보이게 유지해주는 힘입니다. 리깅 가능한 시트가 짜는 방식대로, 포즈도 리깅을 염두에 두고 계획하세요 — 팔은 몸통에서 떨어뜨리고, 머리카락 경계는 읽기 쉽게.
3. 소재 분리 — 수작업, 레퍼런스의 도움을 받음. 평면 일러스트는 이름이 붙은 레이어 30개에서 60개 이상으로 나뉘고, 이미지가 가리고 있는 모든 영역 — 머리카락 밑의 이마, 입 안, 재킷 밑의 몸통 — 은 Photoshop이나 CLIP STUDIO PAINT에서 손으로 그려 넣습니다. 이 단계에서 생성은 오직 근거로만 도움이 됩니다: 2단계의 차분 뷰가 각 가려진 영역에 무엇이 들어가야 하는지 보여주므로, 추측 대신 트레이싱을 할 수 있습니다. 분리 체크리스트에서 파츠 분리를 자세히 다룹니다.
4. 리깅 — 수작업, 숙련된 기술, 진짜 비용 중심. Live2D Cubism에서는 모든 레이어가 메시로 만들어지고 파라미터에 연결됩니다: 눈 깜빡임, 립싱크, 머리 XYZ, 몸 흔들림, 머리카락과 옷의 물리 효과까지요. 현재 어떤 툴도 이 작업을 방송에 쓸 수 있을 만한 품질로 자동화하지 못합니다. 몇 주에 걸친 숙련된 작업이며, 그래서 예산의 대부분을 차지합니다.
5. 트래킹 설정 — 빠름. 완성된 모델을 페이스 트래킹 소프트웨어에 불러오고, 파라미터를 카메라에 맞춰 보정하고, 토글에 단축키를 지정합니다. 프로젝트가 아니라 저녁 한 번이면 끝나는 작업입니다.
돈은 어디로 가는가
가격은 지역과 경력에 따라 천차만별이지만, 시장의 구조는 일관됩니다: 아트와 리깅은 보통 따로 견적을 받고, 입문 단계의 풀 커미션은 수백 달러 선에서 시작하고, 중급 작업은 수천 달러대로 올라가며, 최상위 리거-아티스트 듀오는 다섯 자릿수를 청구합니다. 리깅만으로도 아트만큼, 혹은 그 이상의 비용이 드는 경우가 흔합니다.
생성은 이 방정식의 왼쪽 항을 바꿔놓습니다. 디자인 탐색과 차분 제작 — 전통적으로 아트 견적에서 큰 비중을 차지하던 부분 — 이 몇 주에서 며칠로 압축됩니다. 오른쪽 항은 바꾸지 못합니다: 리그는 리그 그대로의 비용이 들고, 경계가 지저분한 생성 캐릭터는 오히려 리깅 비용이 더 들 수 있습니다. 정리 작업이 결국 리거의 몫으로 넘어가기 때문입니다.
정직하게 예산을 짜세요: 아트를 직접 생성해서 아낀 돈은 사라지는 게 아니라, 일부는 분리 작업 정리와 리깅 품질로 옮겨가야 합니다.
AI 기반 프로젝트에서만 생기는 두 가지 실패 패턴
차분 사이의 정체성 드리프트. 생성된 표정 열 개, 미묘하게 다른 얼굴 열 개 — 리거는 모델이 눈에 띄게 흔들리지 않고서는 이 표정들을 서로 토글할 수 없습니다. 이건 리깅의 실패가 아니라 디자인 단계의 실패입니다: 각 차분을 처음부터 다시 프롬프트했을 때 생기는 문제입니다. 캐릭터를 자산으로 고정하고 @로 모든 차분을 그 자산 기준으로 생성하는 것이 해결책입니다 — shot마다 얼굴을 안정적으로 유지하는 것과 같은 원칙입니다.
인수인계 시점에 밝히지 않은 AI 아트. VTuber 커뮤니티는 AI 기반 모델에 대해 강한 입장을 갖고 있고, 프로젝트 중간에 이 사실을 알게 돼 곤란을 겪은 리거들도 있습니다. 일부는 작업을 거절하고, 많은 경우 정리 비용을 견적에 포함해서 받아들입니다. 첫 메시지에서 미리 밝히세요. 이건 예의이자 여러분 자신에게도 이익입니다 — 정리 작업에 대한 대화가 나중에 분쟁이 아니라 견적 전에 미리 이루어지니까요.
현실적인 첫 모델 계획
- 수정 없이 연속 세 번 생성해도 같은 인물로 읽힐 때까지 캐릭터를 자산으로 디자인합니다.
- 스타일과 조명 선택이 일관될 때, 마스터 포즈와 전체 차분 팩을 한 번의 세션에서 생성합니다.
- 마스터를 업스케일한 다음 분리합니다 — 체크리스트를 펼쳐두고, 레퍼런스 팩을 옆에 두고, 작업하면서 레이어 이름을 바로바로 붙입니다.
- 스펙에 맞춰 PSD를 패키징합니다: 포맷 설정, 고유한 이름, 제자리에 정렬된 차분, 미리보기 PNG, 차분 목록, AI 사용 고지.
- 동작 기대치를 글로 정리해서 리그를 커미션합니다 — 눈 깜빡임과 말하기만 하는 바스트냐, 완전한 고개 돌리기냐에 따라 견적이 달라집니다.
- 트래킹을 보정하고 방송을 시작한 다음, 데뷔 전에 완벽을 좇는 대신 거슬리는 부분을 모아 첫 수정 라운드에서 반영합니다.
자주 묻는 질문
정말로 원클릭 AI VTuber 모델 제작기는 없나요?
단순한 이미지를 자동으로 분리하거나 미리 리깅된 스톡 아바타를 생성해주는 툴은 있습니다. 하지만 오늘날 이런 툴이 해낼 수 없는 것은 여러분의 오리지널 캐릭터를 품질 좋게 리깅하는 일입니다. 캐릭터가 여러분에게 중요하다면, 위의 파이프라인이 그 길입니다.
"반응형 PNG"로 리깅을 우선 건너뛸 수 있나요?
네, 그리고 이건 정당한 시작 방법입니다: PNGTuber 세팅은 같은 캐릭터의 두세 가지 상태만 있으면 되는데, 자산 워크플로라면 몇 분 만에 만들 수 있습니다. 풀 모델을 제작하는 동안 이걸로 먼저 데뷔하세요.
직접 리깅해야 할까요?
Cubism은 배울 수 있고, 간단한 바스트 모델을 직접 리깅하는 것은 첫 프로젝트로 충분히 인정받는 선택입니다. 학습 곡선에 파츠 분리보다 더 많은 저녁 시간이 들 거라고 예상하세요. PSD 스펙은 어느 쪽이든 동일합니다 — 자기 자신을 위해서도 제대로 패키징하세요.
캐릭터가 꼭 애니메 스타일이어야 하나요?
Live2D는 레이어로 나뉜 2D 아트라면 어떤 것이든 다룰 수 있지만, 트래킹은 애니메 스케일의 눈과 입을 가장 잘 읽어냅니다. 그래서 이 생태계가 지금과 같은 모습을 하고 있는 것이죠.
캐릭터를 먼저 완성하고, 모델은 그다음
디자인 이후의 모든 단계는 디자인이 만들어낸 것을 그대로 소비합니다. 자산으로 고정된 캐릭터는 차분을 일관되게 만들고, 파츠 분리를 추적 가능하게 하고, 리깅을 예측 가능하게 하며, 커미션 대화를 짧게 만들어줍니다. 프로젝트를 열고 캐릭터를 만든 다음, 같은 얼굴이 연속 세 번 여러분을 바라볼 때까지 페인팅 툴에는 손대지 마세요.





