시작하기

Seed Audio 1.0 완전 해설: 애니·단편 드라마 캐릭터 보이스에 활용하는 방법

장면을 연기하는 보이스 모델. 무엇인지, 무엇을 줘야 하는지, 언제 쓰는지, 어떻게 실행하는지.

제작 시작
Seed Audio 1.0 완전 해설: 애니·단편 드라마 캐릭터 보이스에 활용하는 방법

소개

"seed audio"를 검색한 건, 어딘가에서 들은 클립이 연기처럼 들렸기 때문일 겁니다. 목소리가 한 단어에서 걸렸다가, 조용해졌다가, 다시 화를 내며 돌아오는 그런 소리. 그런데 지금까지 써본 보이스 툴들은 같은 대사를 깔끔하고, 고르고, 약간 무관심하게 읽어낼 뿐이죠. Seed Audio 1.0이 뭔지, 그 클립이 살아있게 들린 이유가 이거 때문인지, 그리고 그 결과를 얻으려면 뭘 써야 하는지 알고 싶으실 겁니다.

Seed Audio 1.0은 퍼포먼스 중심으로 설계된 보이스 생성 모델입니다. 감정 상태, 장면, 페이싱을 장식이 아닌 지시어로 받아들입니다. 이 가이드에서는 그게 어떤 의미인지, Seed Audio 프롬프트에 반드시 들어가야 할 것, ElevenLabs 같은 안정적 보이스 모델이 더 나은 경우, 그리고 ArcLoop에서 Seed Audio 1.0을 사용해 퍼포먼스를 단일 클립이 아닌 캐릭터에 귀속시키는 방법을 설명합니다.

Seed Audio 1.0이란

Seed Audio 1.0은 ArcLoop에서 캐릭터 보이스오버에 사용할 수 있는 보이스 모델 중 하나로, ElevenLabs, Doubao와 함께 제공됩니다. 대부분의 보이스 모델이 선택한 목소리로 대사를 명확하게 읽어내는 데 최적화되어 있다면, Seed Audio 1.0은 대사를 연기하는 데 최적화되어 있습니다. 누가 말하는지, 어떤 감정인지, 어디에 있는지, 문장 안에서 감정이 어떻게 변하는지에 대한 설명을 읽고, 그에 맞게 음정·속도·호흡·끊김을 조형합니다.

실제로 이런 결과를 줍니다:

  • 대사 안에서 움직이는 감정 — 처음엔 차분하다가 마지막 단어에서 무너지는 것처럼, 감정이 균일하게 덮이지 않습니다.
  • 장면을 인식한 딜리버리 — 복도에서의 속삭임, 소음 위로 높아지는 목소리, 눈물을 참으며 말하는 대사.
  • 캐릭터의 일부로서의 성대 질감과 말투 — 나중에 추가하는 필터가 아닙니다.
  • 압박을 유지하는 긴 단락 — 독백이나 대립 장면에 유용합니다.

하지만 고정된 보이스 뱅크는 아닙니다. 수백 개의 대사에서 최소한의 변화로 동일하게 인식되는 목소리가 필요하다면, 그건 다른 용도입니다. 아래에서 설명합니다.

Seed Audio 1.0 vs ElevenLabs: 어떤 작업에 뭘 쓸까

품질의 차이가 아니라 용도의 차이입니다. 더빙 비교 가이드에서 장면별로 자세히 다루고, 짧게 정리하면:

  • Seed Audio 1.0: 장면을 연기해야 할 때 — 대립, 울음, 공황을 숨기는 것, 중간에 바뀌는 고백. 프롬프트가 퍼포먼스를 묘사하면 모델이 그걸 구현합니다.
  • ElevenLabs: 여러 대사와 언어에 걸쳐 안정적이고 재사용 가능한 목소리가 필요하고, [whispers][angry] 같은 태그로 대사 단위 연출을 원할 때.

시리즈 안에서는 두 가지를 함께 쓰는 제작팀이 많습니다. 주인공의 주요 장면엔 Seed Audio 1.0, 조연과 벌크 대사엔 ElevenLabs. 클립 단위가 아니라 캐릭터 단위로 선택해야, 에피소드 사이에서 목소리가 바뀌지 않습니다.

Seed Audio 1.0 프롬프트 규칙

  • 대사 전에 상태를 먼저 쓰세요. 누구인지, 어떤 감정인지, 무엇을 숨기고 있는지, 그다음 대사.
  • 레이블이 아니라 움직임을 묘사하세요. "마지막 말에서 분노가 터져나오려는 걸 참는 중"이 "화남"보다 낫습니다.
  • 장면은 한 절로 설정하세요. 복도, 전화 통화, 카운터 너머 — 목소리가 어떻게 자리 잡는지 달라집니다.
  • 페이스를 명시하세요. 평소보다 느리게, 마지막 단어 전 멈춤, 빠르게 달리다가 멈추기.
  • 대사는 짧게 유지하세요. 자막 길이의 대사가 퍼포먼스에 여지를 줍니다. 단락은 그냥 읽힙니다.
  • 보이스 프로파일은 asset에 고정하세요. 대사마다 연출은 바뀌어도 목소리는 바뀌면 안 됩니다.

ArcLoop에서 Seed Audio 1.0 사용하는 방법, 단계별

  1. 내 資産의 asset에 캐릭터 보이스 프로파일을 작성합니다: 나이, 음높이, 페이스, 질감, 감정 범위, 버릇 하나. 이게 고정값입니다. 보이스 생성기 가이드에서 만드는 방법을 다룹니다.
  2. character asset에 캐릭터 보이스를 바인딩하고, 시즌 엔진으로 Seed Audio 1.0을 선택합니다.
  3. 각 shot card에 대사와 함께 상태와 장면을 작성합니다 — 퍼포먼스 연출은 별도 문서가 아니라 shot과 함께 있어야 합니다.
  4. shot 영상을 먼저 생성합니다, 타이밍과 표정이 있어야 목소리를 맞춰볼 수 있습니다.
  5. Edit에서 Generate Voiceover를 실행합니다. 대사가 해당 shot에 맞춰 타임라인에 얹힙니다.
  6. 영상과 함께 들어보세요. 퍼포먼스가 얼굴과 싸운다면, 해당 대사의 연출을 조정하고 — 상태, 페이스, 어디서 무너지는지 — 그 대사만 다시 생성합니다.
  7. BGM은 마지막에 추가합니다, 퍼포먼스 아래에, 연출한 끊김이 믹스에 묻히지 않도록.

예시 1: 대립 대사

Voice: @Mira (profile on asset, Seed Audio 1.0). Scene: kitchen, across the counter from @Daniel, she has already seen the boarding pass. State: controlled on the surface, anger underneath, refusing to give him a reaction. Pace: slower than her normal; a full pause before the last word. Line: "How was Osaka." Note: flat, the period audible, no rise at the end.

예시 2: 중간에 바뀌는 대사

Voice: @Kaito (profile on asset, Seed Audio 1.0). Scene: shrine steps at dawn, alone, reading the letter aloud to himself. State: starts steady, almost amused; the second sentence lands and the voice thins out. Pace: even, then a catch before "stay." Line: "You said you'd wait at the gate. You didn't say you'd stay." Note: the last word barely voiced.

예시 3: 복도에서 속삭이는 대사

Voice: @Liora (profile on asset, Seed Audio 1.0). Scene: hotel corridor at night, on the phone to @Rowan, staff could hear her. State: frightened, keeping it down, trying to sound like she is in control. Pace: quick, breath audible between phrases. Line: "It's my brother's initials. On a staff card. Don't come up." Note: whisper throughout; the last three words firmer.

Seed Audio 프롬프트가 실패하는 가장 흔한 이유

  • 대사만 있는 경우. 상태도 장면도 없으면 모델은 평균적인 퍼포먼스를 냅니다. 누가, 어떤 상황인지 추가하세요.
  • 움직임이 아닌 레이블. "슬픔"은 균일한 슬픔을 줍니다. 어디서 바뀌는지 말하세요.
  • 단락을 대사로 쓰는 경우. 긴 텍스트는 읽힙니다, 연기되지 않습니다. 한 문장으로 줄이세요.
  • 클립마다 보이스를 새로 고르는 경우. 매번 다른 사람이 됩니다. asset에 바인딩하세요.
  • 얼굴 없이 검토하는 경우. 최고의 테이크도 shot에 맞지 않을 수 있습니다. 타임라인에서 들으세요.

FAQ

Seed Audio 1.0이 ArcLoop에서 사용 가능한가요? 네. character voice 엔진 중 하나로 제공됩니다. character asset에 바인딩한 뒤 Edit에서 Generate Voiceover를 실행하면 됩니다.

실존 인물의 목소리를 복제하는 건가요? 여기서 다루는 용도는 그게 아니고, 시리즈에서 가치 있는 이유도 그게 아닙니다. asset에 오리지널 보이스 프로파일을 만들고 그걸 연출하세요.

지원 언어는 어떻게 되나요? 연출 지시는 영어로 쓰고, 대사는 작품의 언어로 작성하세요. 로케일 전체에서 같은 프로파일을 유지하면 캐릭터가 어디서나 동일하게 들립니다.

언제 ElevenLabs로 바꿔야 하나요? 캐릭터에게 수백 개의 일상적인 대사가 있고 매번 동일하게 들려야 할 때, 또는 장면 단위 퍼포먼스보다 대사 단위 오디오 태그 제어가 필요할 때입니다.

다음 단계

목소리가 가장 많은 일을 해야 하는 장면을 고르세요 — 고백, 비난, 눈물을 참으며 하는 대사. shot card의 대사 위에 상태, 장면, 페이스를 쓰고, ArcLoop에서 캐릭터에 Seed Audio 1.0을 바인딩한 뒤, 타임라인에서 보이스오버를 생성하세요. 뭔가 바꾸기 전에, 영상과 함께 한 번 들어보세요.

문장이 아니라 장면을 연출하세요

Seed Audio 1.0은 ArcLoop 안에서 실행됩니다. character asset에 바인딩하고, 각 대사마다 감정 상태와 장면을 적고, Edit 타임라인에서 보이스오버를 생성해 얼굴과 함께 들어보세요.

지금 만들기

더 알아보기

나만의 IP 세계 만들기

나만의 IP 세계 만들기

AI 숏드라마 전체 공정: 대본부터 완성본까지

AI 숏드라마 전체 공정: 대본부터 완성본까지

긴장감 있는 대화신 만들기

긴장감 있는 대화신 만들기

대본을 씬별 샷리스트로 쪼개기

대본을 씬별 샷리스트로 쪼개기