Introdução
Um clipe de 37 segundos de um mannequin 3D vermelho-e-branco fazendo uma rotina de jumpstyle circula como "material pronto para IA", e os comentários se enchem sempre da mesma pergunta: como eu uso isso na prática, e em qual ferramenta? O clipe é útil justamente pelo que lhe falta. Sem rosto, sem roupa, sem iluminação, sem fundo — só um corpo se movendo no beat e uma câmera parada. É coreografia com a identidade removida.
Essa separação é exatamente o que um vídeo de dança precisa. Se você pedir a um modelo "garota anime fazendo jumpstyle", ele inventa o personagem e os movimentos ao mesmo tempo — e os dois derivam. Se os movimentos vêm do mannequin e o personagem vem de um asset que você já construiu, cada lado tem só uma função. Este guia mostra como transformar um clipe de modelo 3D em vídeo de dança anime no ArcLoop: mapeie os beats, capture poses-chave, vincule-as como referências e gere um movimento por shot.
Por que um clipe de mannequin funciona melhor do que um dançarino real
Um clipe de uma pessoa real traz rosto, roupas com dobras específicas, um ambiente e uma iluminação. O modelo vai absorver parte disso, queira você ou não, e isso levanta questões de semelhança que você não quer em um vídeo publicado. Um mannequin traz só o esqueleto da performance.
O que ele oferece:
- Timing exato. Cada chute e cada giro cai num frame visível que você pode apontar.
- Câmera fixada. A maioria desses clipes usa um ângulo fixo, que é a coisa mais fácil para um modelo reproduzir.
- Corpo neutro. Sem fantasia para combater, sem proporções para sobrescrever.
O que ele não oferece — e o que seus assets precisam fornecer: o rosto, o cabelo, a roupa do personagem e o estilo visual de todo o clipe.
Regras para usar uma referência de dança
- Um movimento por shot. Uma frase de dois ou quatro tempos, uma ação clara. Encadeie os shots para a rotina completa. Não peça os 37 segundos inteiros em uma única geração.
- Mantenha a câmera onde o clipe a colocou. Se a câmera de referência é uma vista frontal estática, faça o shot com vista frontal estática. Movimentos de câmera e coreografia competem pela atenção do modelo.
- Identidade é função do asset. Referencie o dançarino com
@e nunca descreva o rosto ou a roupa no shot. Se a roupa importa para a dança, vincule uma Reference image de roupa de dança ao mesmo character asset. - Poses estáticas em vez de descrições do clipe. "Pernas em tesoura, joelho direito levantado" é vago. Uma pose estática do mannequin naquela posição não é.
- Estilo é uma referência separada. A pose estática do mannequin é uma referência de pose. O estilo vem de um Visual reference ou da Main image do personagem — do contrário, o clipe deriva para plástico cinza.
Para estrutura de prompt ao longo de toda uma dança — beat, câmera, âncoras — veja o guia de clipes de dança. Este artigo foca em uma coisa só: trazer a coreografia de um mannequin para o seu personagem.
Como transformar o clipe em shots, passo a passo
- Conte os beats. Reproduza o clipe e marque as frases. Jumpstyle costuma rodar em blocos de 4 tempos: kick-step, kick-step, hop-turn. Anote a lista de frases com os timestamps.
- Capture um frame por frase. Pause no frame mais claro de cada frase — o topo do chute, o meio do giro — e exporte. Dez a doze frames cobrem uma rotina de 37 segundos.
- Faça upload dos frames e do clipe na Library. O clipe é para referência durante a revisão; os frames são o que os shots usam.
- Vincule os frames como um Visual reference asset com um nome como "Jumpstyle poses" para que o Agent possa reutilizar o conjunto em vários Episodes.
- Certifique-se de que o dançarino é um character asset com uma Main image e, se necessário, uma Reference image de roupa de dança vinculada ao mesmo asset. Se você estiver trabalhando no Seedance 2.5, o asset é obrigatório antes de gerar vídeo.
- Use Generate Shots no Episode e edite cada shot card para uma frase. Anexe o frame correspondente, referencie
@dançarino, declare a câmera uma vez e descreva apenas o movimento daquela frase. - Gere a imagem primeiro. Verifique se a pose corresponde ao frame e se o rosto corresponde ao asset. Só então gere o vídeo.
- Encadeie os shots no Edit na ordem das frases, corte no beat e adicione a faixa para que os cortes caiam nos tempos.
Exemplo 1: Frase de kick-step, câmera frontal estática
Static front view, camera at chest height, full body in frame with room above the head, plain studio background. @Yuki performs a jumpstyle kick-step: weight on the left foot, right leg kicks forward straight and high, then steps down and the left kicks the same height. Two kicks, two counts, no travel across the floor. Arms swing loose at the sides. Hold the pose reference for leg height. Match pose still 03.
Exemplo 2: Frase de hop-turn
Same static front camera, same framing and background as Shot 1. @Yuki hops on both feet and turns a full 360 to the right in one count, landing facing camera with knees bent and feet together. Hair and jacket follow the spin half a beat late and settle on the landing. No camera move, no zoom. Match pose still 06 for the mid-turn body angle and still 07 for the landing.
Exemplo 3: Dois dançarinos, espelhados
Static front view, slightly wider than Shot 1 so both dancers fit with space on either side. @Yuki on the left and @Hana on the right perform the same kick-step phrase mirrored: Yuki kicks right, Hana kicks left, on the same count, same height. They stay one arm's length apart and do not cross or turn toward each other. Match pose still 03 for the kick height on both.
Os problemas mais comuns e como evitá-los
- O beat deriva. O clipe parece certo, mas os chutes caem fora da música. Geralmente o shot durou mais do que a frase. Corte no Edit pelo tempo, não pelo tamanho do clipe.
- Os membros se fundem no chute. O frame foi capturado num momento borrado. Recapture no frame em que a perna está totalmente estendida.
- A roupa muda entre os shots. Não há Reference image de roupa no asset, então cada shot inventa uma. Vincule uma Reference image de roupa de dança e regenere.
- O rosto muda no giro. Giros são onde a identidade escorrega. Limite o giro a um tempo e deixe a Main image do asset fazer o trabalho; não adicione descrição de rosto ao shot.
- O clipe parece plástico cinza. O frame do mannequin está fazendo dupla função como referência de estilo. Adicione uma referência de estilo adequada e mantenha o frame apenas como referência de pose.
Perguntas frequentes
Posso usar qualquer clipe de mannequin, ou apenas os compartilhados como "material de IA"? Qualquer clipe em que o corpo esteja claramente visível e a câmera esteja estável. Os compartilhados são convenientes porque alguém já removeu a identidade.
O ArcLoop usa o clipe diretamente para guiar o movimento? O fluxo de trabalho aqui usa frames estáticos do clipe como referências de pose em cada shot. Mantenha o clipe na Library para consulta e use-o para decidir onde cada frase começa e termina.
Quantos shots para uma rotina completa? Aproximadamente um por frase. Uma rotina de 37 segundos costuma ter dez a doze shots. Menos shots significa frases mais longas, que é onde o beat começa a derivar.
Posso mudar a câmera em relação à referência? Pode, mas faça isso depois que a rotina funcionar no ângulo estático. Adicione um leve push-in em uma frase, revise, e só então tente mais movimentos.
Próximo passo
Escolha a frase mais curta do clipe — um kick-step, dois tempos. Capture o frame, vincule-o e escreva um shot com @ para o seu dançarino e nada sobre o rosto dele. Abra o projeto no ArcLoop, gere a imagem, confira a altura da perna em relação ao frame e depois gere o vídeo. Se essa frase cair no beat, o resto da rotina é o mesmo trabalho repetido.





