Introdução
Você pesquisa "seed audio" porque um clipe que ouviu soava como atuação — a voz prendeu em uma palavra, caiu para o silêncio, voltou com raiva — e todas as ferramentas de voz que já testou produzem uma leitura limpa, uniforme e levemente entediada da mesma linha. Você quer saber o que é Seed Audio 1.0, se é por isso que aquele clipe soou vivo, e o que precisa escrever para conseguir o mesmo.
Seed Audio 1.0 é um modelo de geração de voz construído em torno de performance: ele recebe o estado emocional, a cena e o ritmo como instruções reais, não como enfeite. Este guia explica o que isso significa, o que uma prompt do Seed Audio precisa conter, quando um modelo de voz estável como ElevenLabs é a escolha certa, e como usar Seed Audio 1.0 no ArcLoop para que a performance pertença ao personagem — e não a um único clipe.
O que é Seed Audio 1.0
Seed Audio 1.0 é um dos modelos de voz disponíveis no ArcLoop para voiceover de personagens, ao lado de ElevenLabs e Doubao. Enquanto a maioria dos modelos de voz é otimizada para dizer uma linha com clareza em uma voz escolhida, Seed Audio 1.0 é otimizado para atuar a linha: ele lê a descrição de quem está falando, o que sente, onde está e como o sentimento muda ao longo da frase — e molda tom, ritmo, respiração e pausas para corresponder a tudo isso.
Na prática, isso oferece:
- Emoção que se move dentro de uma linha — calma no começo, quebrando na última palavra — em vez de uma emoção aplicada de forma uniforme.
- Entrega consciente da cena — um sussurro num corredor, uma voz elevada sobre o barulho, uma linha dita em lágrimas.
- Textura vocal e dialeto como parte do personagem, não como filtro adicionado depois.
- Passagens inteiras que sustentam pressão, úteis para monólogos e confrontos.
O que ele não é: um banco de voz fixo. Se o que você precisa é da mesma voz reconhecível repetida com variação mínima em centenas de linhas, esse é um trabalho diferente — abordado abaixo.
Seed Audio 1.0 vs ElevenLabs: qual usar para cada tarefa
A divisão é por tarefa, não por qualidade. A comparação de dublagem vai cena por cena; o resumo curto:
- Seed Audio 1.0 quando a cena precisa ser atuada — confronto, choro, escondendo pânico, uma confissão que muda no meio do caminho. A prompt descreve a performance; o modelo entrega.
- ElevenLabs quando a voz precisa ser estável e reutilizável em muitas linhas e idiomas, e você dirige no nível da linha com tags como
[whispers]ou[angry].
Dentro de uma série, muitas produções usam os dois: Seed Audio 1.0 para as grandes cenas do protagonista, ElevenLabs para personagens secundários e diálogos em massa. Escolha por personagem, não por clipe — assim um personagem não muda de voz entre episódios.
Regras para uma prompt de Seed Audio 1.0
- Dê o estado antes da linha. Quem é, o que sente, o que está escondendo — e depois as palavras.
- Descreva movimento, não um rótulo. "Tentando ficar quieto, a raiva explode nas últimas palavras" é melhor do que "raivoso".
- Defina a cena em uma cláusula. Corredor, ligação telefônica, do outro lado do balcão — isso muda como a voz se encaixa.
- Nomeie o ritmo. Mais devagar que o normal, uma pausa antes da última palavra, acelerando e parando de repente.
- Mantenha a linha curta. Uma linha do tamanho de uma legenda dá espaço para a performance; um parágrafo é lido.
- Mantenha o perfil de voz fixo no asset. A direção muda por linha; a voz não.
Como usar Seed Audio 1.0 no ArcLoop, passo a passo
- Escreva o perfil de voz do personagem no asset em My Assets: idade, tom, ritmo, textura, alcance emocional, um hábito. Esse é o elemento fixo; o guia do gerador de voz explica como construí-lo.
- Vincule a voz do personagem ao asset e escolha Seed Audio 1.0 como motor para a temporada.
- Em cada shot card, escreva a linha com seu estado e cena — a direção de performance fica junto ao shot, não em um documento separado.
- Gere o vídeo do shot primeiro, para que o timing e a expressão existam e você possa ouvir a voz junto a eles.
- Rode Generate Voiceover em Edit. As linhas aparecem na timeline junto aos seus shots.
- Ouça com a imagem. Se a performance brigou com o rosto, ajuste a direção na linha — o estado, o ritmo, onde ela quebra — e regenere só aquela linha.
- Adicione o BGM por último, sob a performance, para que o mix não esconda as pausas que você dirigiu.
Exemplo 1: uma linha de confronto
Voice: @Mira (profile on asset, Seed Audio 1.0). Scene: kitchen, across the counter from @Daniel, she has already seen the boarding pass. State: controlled on the surface, anger underneath, refusing to give him a reaction. Pace: slower than her normal; a full pause before the last word. Line: "How was Osaka." Note: flat, the period audible, no rise at the end.
Exemplo 2: uma linha que muda no meio
Voice: @Kaito (profile on asset, Seed Audio 1.0). Scene: shrine steps at dawn, alone, reading the letter aloud to himself. State: starts steady, almost amused; the second sentence lands and the voice thins out. Pace: even, then a catch before "stay." Line: "You said you'd wait at the gate. You didn't say you'd stay." Note: the last word barely voiced.
Exemplo 3: uma linha sussurrada em um corredor
Voice: @Liora (profile on asset, Seed Audio 1.0). Scene: hotel corridor at night, on the phone to @Rowan, staff could hear her. State: frightened, keeping it down, trying to sound like she is in control. Pace: quick, breath audible between phrases. Line: "It's my brother's initials. On a staff card. Don't come up." Note: whisper throughout; the last three words firmer.
Os erros mais comuns em prompts de Seed Audio
- Só a linha. Sem estado, sem cena — o modelo performa uma média. Adicione quem é e o que sente.
- Um rótulo em vez de movimento. "Triste" gera tristeza uniforme. Diga onde ela muda.
- Um parágrafo como linha. Texto longo é lido, não atuado. Corte até a frase.
- Voz escolhida de novo a cada clipe. Pessoa diferente a cada vez. Vincule ao asset.
- Revisão sem ver o rosto. A melhor tomada pode estar errada para o shot. Ouça na timeline.
Perguntas frequentes
Seed Audio 1.0 está disponível no ArcLoop? Sim. É um dos motores de voz para personagens; vincule-o no character asset e rode Generate Voiceover em Edit.
Ele clona a voz de uma pessoa real? Esse não é o uso aqui, e não é o que o torna valioso para uma série. Construa um perfil de voz original no asset e dirija-o.
Quais idiomas ele suporta? Escreva a direção em inglês e a linha no idioma da história; mantenha o mesmo perfil entre locales para que o personagem soe igual em todo lugar.
Quando devo trocar para ElevenLabs? Quando um personagem tem centenas de linhas rotineiras e precisa soar idêntico em todas elas, ou quando você precisa de controle via tags de áudio no nível da linha em vez de uma cena atuada.
Próximo passo
Escolha a cena onde a voz precisa fazer mais — a confissão, a acusação, a linha dita em lágrimas. Escreva o estado, a cena e o ritmo acima da linha no shot card, vincule Seed Audio 1.0 ao personagem no ArcLoop e gere o voiceover na timeline. Ouça uma vez com a imagem antes de mudar qualquer coisa.





