Começar

Seed Audio 1.0 explicado: como usar para vozes de personagens em anime e drama curto

Um modelo de voz que atua a cena. O que é, o que dar a ele, quando usá-lo e como rodá-lo em um character asset.

Comece a criar
Seed Audio 1.0 explicado: como usar para vozes de personagens em anime e drama curto

Introdução

Você pesquisa "seed audio" porque um clipe que ouviu soava como atuação — a voz prendeu em uma palavra, caiu para o silêncio, voltou com raiva — e todas as ferramentas de voz que já testou produzem uma leitura limpa, uniforme e levemente entediada da mesma linha. Você quer saber o que é Seed Audio 1.0, se é por isso que aquele clipe soou vivo, e o que precisa escrever para conseguir o mesmo.

Seed Audio 1.0 é um modelo de geração de voz construído em torno de performance: ele recebe o estado emocional, a cena e o ritmo como instruções reais, não como enfeite. Este guia explica o que isso significa, o que uma prompt do Seed Audio precisa conter, quando um modelo de voz estável como ElevenLabs é a escolha certa, e como usar Seed Audio 1.0 no ArcLoop para que a performance pertença ao personagem — e não a um único clipe.

O que é Seed Audio 1.0

Seed Audio 1.0 é um dos modelos de voz disponíveis no ArcLoop para voiceover de personagens, ao lado de ElevenLabs e Doubao. Enquanto a maioria dos modelos de voz é otimizada para dizer uma linha com clareza em uma voz escolhida, Seed Audio 1.0 é otimizado para atuar a linha: ele lê a descrição de quem está falando, o que sente, onde está e como o sentimento muda ao longo da frase — e molda tom, ritmo, respiração e pausas para corresponder a tudo isso.

Na prática, isso oferece:

  • Emoção que se move dentro de uma linha — calma no começo, quebrando na última palavra — em vez de uma emoção aplicada de forma uniforme.
  • Entrega consciente da cena — um sussurro num corredor, uma voz elevada sobre o barulho, uma linha dita em lágrimas.
  • Textura vocal e dialeto como parte do personagem, não como filtro adicionado depois.
  • Passagens inteiras que sustentam pressão, úteis para monólogos e confrontos.

O que ele não é: um banco de voz fixo. Se o que você precisa é da mesma voz reconhecível repetida com variação mínima em centenas de linhas, esse é um trabalho diferente — abordado abaixo.

Seed Audio 1.0 vs ElevenLabs: qual usar para cada tarefa

A divisão é por tarefa, não por qualidade. A comparação de dublagem vai cena por cena; o resumo curto:

  • Seed Audio 1.0 quando a cena precisa ser atuada — confronto, choro, escondendo pânico, uma confissão que muda no meio do caminho. A prompt descreve a performance; o modelo entrega.
  • ElevenLabs quando a voz precisa ser estável e reutilizável em muitas linhas e idiomas, e você dirige no nível da linha com tags como [whispers] ou [angry].

Dentro de uma série, muitas produções usam os dois: Seed Audio 1.0 para as grandes cenas do protagonista, ElevenLabs para personagens secundários e diálogos em massa. Escolha por personagem, não por clipe — assim um personagem não muda de voz entre episódios.

Regras para uma prompt de Seed Audio 1.0

  • Dê o estado antes da linha. Quem é, o que sente, o que está escondendo — e depois as palavras.
  • Descreva movimento, não um rótulo. "Tentando ficar quieto, a raiva explode nas últimas palavras" é melhor do que "raivoso".
  • Defina a cena em uma cláusula. Corredor, ligação telefônica, do outro lado do balcão — isso muda como a voz se encaixa.
  • Nomeie o ritmo. Mais devagar que o normal, uma pausa antes da última palavra, acelerando e parando de repente.
  • Mantenha a linha curta. Uma linha do tamanho de uma legenda dá espaço para a performance; um parágrafo é lido.
  • Mantenha o perfil de voz fixo no asset. A direção muda por linha; a voz não.

Como usar Seed Audio 1.0 no ArcLoop, passo a passo

  1. Escreva o perfil de voz do personagem no asset em My Assets: idade, tom, ritmo, textura, alcance emocional, um hábito. Esse é o elemento fixo; o guia do gerador de voz explica como construí-lo.
  2. Vincule a voz do personagem ao asset e escolha Seed Audio 1.0 como motor para a temporada.
  3. Em cada shot card, escreva a linha com seu estado e cena — a direção de performance fica junto ao shot, não em um documento separado.
  4. Gere o vídeo do shot primeiro, para que o timing e a expressão existam e você possa ouvir a voz junto a eles.
  5. Rode Generate Voiceover em Edit. As linhas aparecem na timeline junto aos seus shots.
  6. Ouça com a imagem. Se a performance brigou com o rosto, ajuste a direção na linha — o estado, o ritmo, onde ela quebra — e regenere só aquela linha.
  7. Adicione o BGM por último, sob a performance, para que o mix não esconda as pausas que você dirigiu.

Exemplo 1: uma linha de confronto

Voice: @Mira (profile on asset, Seed Audio 1.0). Scene: kitchen, across the counter from @Daniel, she has already seen the boarding pass. State: controlled on the surface, anger underneath, refusing to give him a reaction. Pace: slower than her normal; a full pause before the last word. Line: "How was Osaka." Note: flat, the period audible, no rise at the end.

Exemplo 2: uma linha que muda no meio

Voice: @Kaito (profile on asset, Seed Audio 1.0). Scene: shrine steps at dawn, alone, reading the letter aloud to himself. State: starts steady, almost amused; the second sentence lands and the voice thins out. Pace: even, then a catch before "stay." Line: "You said you'd wait at the gate. You didn't say you'd stay." Note: the last word barely voiced.

Exemplo 3: uma linha sussurrada em um corredor

Voice: @Liora (profile on asset, Seed Audio 1.0). Scene: hotel corridor at night, on the phone to @Rowan, staff could hear her. State: frightened, keeping it down, trying to sound like she is in control. Pace: quick, breath audible between phrases. Line: "It's my brother's initials. On a staff card. Don't come up." Note: whisper throughout; the last three words firmer.

Os erros mais comuns em prompts de Seed Audio

  • Só a linha. Sem estado, sem cena — o modelo performa uma média. Adicione quem é e o que sente.
  • Um rótulo em vez de movimento. "Triste" gera tristeza uniforme. Diga onde ela muda.
  • Um parágrafo como linha. Texto longo é lido, não atuado. Corte até a frase.
  • Voz escolhida de novo a cada clipe. Pessoa diferente a cada vez. Vincule ao asset.
  • Revisão sem ver o rosto. A melhor tomada pode estar errada para o shot. Ouça na timeline.

Perguntas frequentes

Seed Audio 1.0 está disponível no ArcLoop? Sim. É um dos motores de voz para personagens; vincule-o no character asset e rode Generate Voiceover em Edit.

Ele clona a voz de uma pessoa real? Esse não é o uso aqui, e não é o que o torna valioso para uma série. Construa um perfil de voz original no asset e dirija-o.

Quais idiomas ele suporta? Escreva a direção em inglês e a linha no idioma da história; mantenha o mesmo perfil entre locales para que o personagem soe igual em todo lugar.

Quando devo trocar para ElevenLabs? Quando um personagem tem centenas de linhas rotineiras e precisa soar idêntico em todas elas, ou quando você precisa de controle via tags de áudio no nível da linha em vez de uma cena atuada.

Próximo passo

Escolha a cena onde a voz precisa fazer mais — a confissão, a acusação, a linha dita em lágrimas. Escreva o estado, a cena e o ritmo acima da linha no shot card, vincule Seed Audio 1.0 ao personagem no ArcLoop e gere o voiceover na timeline. Ouça uma vez com a imagem antes de mudar qualquer coisa.

Dirija a cena, não a frase

Seed Audio 1.0 roda dentro do ArcLoop. Vincule-o ao character asset, escreva cada linha com seu estado e cena, e gere o voiceover na timeline de edição — onde você ouve a voz junto com o rosto do personagem.

Criar agora

Descubra mais

Arcloop lança GPT Image 2.5: do Image 2 ao Flare e Sunburst

Arcloop lança GPT Image 2.5: do Image 2 ao Flare e Sunburst

Controle de custos e divisão de orçamento para drama curto com IA

Controle de custos e divisão de orçamento para drama curto com IA

Dividindo um roteiro em uma shot list por cena

Dividindo um roteiro em uma shot list por cena

Chiaroscuro ou High-Key: como escrever escolas de iluminação em prompts

Chiaroscuro ou High-Key: como escrever escolas de iluminação em prompts