Uma conversa telefônica parece simples no papel: dois personagens falando em lugares diferentes. Na sequência gerada, fundos parecidos e linhas de olhar ambíguas podem fazer esses lugares parecerem um único cômodo. Falas isoladas também perdem o momento mais revelador: a reação silenciosa do ouvinte, que o público vê mas o outro personagem não.
Dê a cada interlocutor um espaço físico reconhecível, uma postura clara ao segurar o telefone e algo específico para olhar enquanto escuta. Depois decida qual reação o público precisa ver antes da próxima réplica. Este guia mostra como encenar essa lacuna de informação entre dois locais sem perder a geografia da ligação.
O que cada personagem sabe — e o que só o público vê
Antes de criar qualquer shot, anote três coisas para cada interlocutor:
- O que ele sabe quando atende. Os fatos disponíveis para ele e o estado emocional que esses fatos criam.
- O que é audível para o outro. As falas ditas e qualquer som que ele pretenda compartilhar — ou revele sem querer.
- O que só o público pode ver. Uma mão tremendo, um olhar para a porta, uma foto virada para baixo sobre a mesa.
Essa terceira camada é onde as cenas de ligação telefônica constroem sua tensão. Se o Personagem A recebe uma informação que muda tudo, o público assiste A processar isso em silêncio antes de ele falar. O Personagem B não pode ver isso. O público pode. Essa lacuna de informação é a cena.
Use essas três respostas para decidir qual personagem o público precisa ver em seguida.
Crie assets separados para cada local
Dê aos locais âncoras visuais distintas: uma bancada de cozinha com luminária quente para um personagem, uma cama de hotel com uma janela de luz fria para o outro. Revise os fundos juntos para que os espectadores consigam identificar cada ambiente antes de qualquer fala.
Em My Assets, crie dois scene assets distintos: um para o local de cada interlocutor. Dê a cada scene asset uma reference image que mostre o ambiente real, não apenas uma paleta de cores. Uma cozinha apertada de apartamento é um asset diferente de uma mesa de quarto de hotel. Vincule essas reference images como Main images e verifique cada visualização gerada em relação ao espaço estabelecido.
Para cada personagem, confirme o character asset e vincule reference images úteis. Se uma referência de como segurar o telefone ajuda a explicar a postura, adicione-a junto à referência principal de aparência. Na descrição de cada shot, especifique a mão que segura o telefone quando a continuidade depender disso; a referência do asset não substitui uma ação clara.
Crie os character assets ficcionais Nadia e Ryo, os scene assets NadiaKitchen e RyoHotelRoom e os prop assets NadiaPhone, RyoPhone e WaterGlass em My Assets. Vincule as reference images antes de selecioná-los via
@. O caso a seguir é um exercício de design original; as imagens ilustram composições propostas, não saídas de vídeo testadas.
Separe uma fala, uma reação silenciosa e uma réplica
Para uma troca em que a resposta não dita importa, considere três unidades dramáticas. Elas podem receber coberturas separadas sem transformar cada fala da ligação no mesmo padrão de três shots:
Beat 1 — A fala recebida. O personagem pronuncia sua fala. A câmera cobre o rosto ou o corpo de quem fala. A voz, o enquadramento e a nota de performance ficam aqui.
Beat 2 — A reação silenciosa. Corte para o personagem que ouve antes de ele falar. Esse é o beat mais negligenciado nas cenas de ligação em dramas curtos. O ouvinte está processando — e o público lê seu rosto para entender o peso do que acabou de ser dito. Sem fala. Uma ação. Uma emoção.
Beat 3 — A réplica falada. Agora o ouvinte se torna o falante. Fique com ele ou escolha um enquadramento diferente do mesmo local. A réplica causa impacto diferente porque o público já acompanhou sua formação.
Use o beat silencioso quando ele muda a forma como a réplica seguinte é compreendida. Não é necessário que apareça após cada fala.
Como encenar a conversa telefônica: shot a shot
Com os assets criados e os beats mapeados, abra seu Episode e gere um conjunto inicial de shots com Generate Shots. A IA vai rascunhar uma sequência com base no seu Story Outline. A partir daí, revise cada shot card e revise ou adicione shots para corresponder ao seu plano de beats.
Para cada corte em que a cena muda de localização, confirme que a referência do scene asset está incluída no shot card. Use @ para referenciar o personagem e a cena de forma explícita — não redescreva o ambiente do zero em cada card. Use a referência de cena recorrente para o espaço já estabelecido e descreva o novo ângulo, a ação e o contato com objetos relevantes. Gere as imagens primeiro e compare os dois ambientes antes de avançar para o vídeo.
Na batida de reação silenciosa, resista ao impulso de adicionar uma fala. Escreva apenas a ação e o enquadramento. Uma descrição de shot como "@Nadia fica completamente imóvel, olhando fixamente para a parede acima da pia. A ligação ainda está ativa, mas ela não disse nada. Close no rosto dela." é mais forte do que preencher com narração.
Escolha uma voz para cada personagem que liga e mantenha essa escolha de forma consistente ao preparar os diálogos. Em Edit, use Generate Voiceover nas falas necessárias e ouça os resultados ao lado dos shots correspondentes. Verifique você mesmo a identidade e a entonação do locutor; a seleção de voz não garante que todas as falas geradas terão a emoção ou o timing pretendidos.
No caso original Coastal Signal, a pesquisadora marinha Nadia liga para Ryo, o colaborador de quem se afastou, para dizer que o estudo conjunto deles será encerrado. Ela está na cozinha; ele está em um hotel do outro lado do país. Uma cena anterior estabelece que ele espera uma ligação diferente. Nadia não sabe do que se trata essa outra ligação.
Exemplo 1 — Fala recebida pelo interlocutor, localização de Nadia:
Medium locked view of @Nadia at the counter in @NadiaKitchen. @Nadia speaks the line, “The department approved the shutdown this morning. I thought you should hear it from me.” @NadiaPhone stays at her right ear and her left hand remains resting on the counter edge. Keep her delivery level, with no added head turn or hand gesture. A warm overhead lamp separates her face from the dark window. One spoken line, no camera movement or cut.

Exemplo 2 — Batida de reação silenciosa, localização de Ryo:
Medium-close locked view of @Ryo seated on the bed in @RyoHotelRoom. @Ryo slowly sets @WaterGlass on the nightstand while @RyoPhone stays at his left ear. Keep the glass, supporting hand and tabletop fully visible, with his face above the action. He remains silent and his posture otherwise still. Cool window light outlines the glass without obscuring its contact with the table. One placement only, with no jaw clench, second gesture, camera movement, or reply.

Exemplo 3 — Resposta falada, permanecendo com quem escuta:
Wide locked view across @RyoHotelRoom, with @Ryo still seated on the bed and @WaterGlass resting on the same nightstand. @Ryo speaks, “How long have you known?” in a controlled, slower delivery. @RyoPhone remains at his left ear, and his free hand rests on his thigh. Keep the bed, nightstand and cold window visible to establish the unchanged location. One spoken question only; no standing, walking, new gesture, camera movement, or other caller’s reply.

O que falha e como identificar
Uma falha comum é a geografia confusa: o espectador confunde os dois personagens achando que estão no mesmo ambiente. Revise os shots em sequência, sem o diálogo. Verifique os planos de fundo de cada localização, a posição do telefone e para onde o olhar está direcionado. Corrija o enquadramento ou a referência confusa e inspecione novamente. Linhas de olhar semelhantes por si só não indicam erro; a questão é se o conjunto de pistas torna cada localização legível.
A segunda falha é o desvio de identidade vocal entre os cortes. Ouça o diálogo sem as imagens. Cada personagem ainda soa como a mesma pessoa na próxima fala? Verifique novamente a voz do personagem selecionado e revise ou substitua a fala que quebra a continuidade. Mantenha as mudanças emocionais motivadas pela conversa e teste a substituição em contexto.
A terceira falha é esconder uma reação necessária. Se uma resposta pretende dissimular surpresa, mas o público nunca vê essa surpresa, adicione cobertura para a reação antes da fala. Compare as durações em Edit; a pausa deve revelar algo, em vez de seguir uma regra fixa de dois segundos.
Montando a cobertura alternada em Edit
Em Edit, organize a cobertura de acordo com quem fornece a próxima informação relevante. O exemplo usa A para a fala de Nadia, B para a ação silenciosa de Ryo e B novamente para a resposta dele. Uma alternância estrita A/B interromperia essa progressão de forma desnecessária.
Verifique três coisas na sequência montada:
- Reconhecimento do locutor. O público consegue identificar instantaneamente em qual localização está a cada corte? Se as cenas parecerem semelhantes, o primeiro quadro de cada shot precisa de uma âncora visual mais forte.
- Causalidade da resposta. Cada réplica segue uma informação que o personagem realmente recebeu? Use uma reação silenciosa quando ela altera o significado da resposta; uma resposta verbal direta também pode ser clara.
- Continuidade dentro de cada localização. Mantenha consistentes a mão que segura o telefone, os móveis e o estado dos objetos de cena. Se alguém se mover durante o tempo omitido pelo corte, estabeleça claramente a nova posição; não é necessário um plano de caminhada para cada movimento possível.
Use Generate Voiceover nas falas escolhidas e revise o áudio junto com o corte. Um ouvinte silencioso ainda pode escutar o outro personagem, portanto diferencie "este personagem não está falando" de "toda a trilha sonora está em silêncio." Não exija um efeito de filtro de telefone não verificado para identificar quem está falando.
Para trocas em espaço compartilhado, consulte o guia de cena de diálogo. Para planejamento de voz com um elenco completo, use o guia de voz com múltiplos personagens. Abra seu projeto no ArcLoop, prepare as duas locações e teste a fala, a reação e a réplica juntas.
Perguntas frequentes
Preciso de dois Episodes separados para cada locação? Não. As duas locações ficam dentro do mesmo Episode e Storyboard. A separação é feita pelos seus scene assets e pelas descrições dos shot cards, não pela estrutura do Episode.
Posso usar o mesmo character asset para as versões falante e ouvinte do mesmo personagem? Sim. Um único character asset cobre todas as tomadas daquele personagem. Escreva a postura e o estado emocional na descrição do Shot — o asset cuida da identidade, e a descrição cuida do que é novo em cada Shot.
E se o beat de reação silenciosa for gerado com a boca do personagem aberta? Revise a descrição do Shot para deixar explícito que o personagem não está falando — "em silêncio", "não responde" ou "segura o telefone sem falar". Uma descrição clara com uma ação por Shot reduz enquadramentos ambíguos.
A voz fora de quadro precisa de efeito de telefone? Um som distante ou comprimido é opcional. Primeiro, deixe o locutor e a localização claros por meio da imagem, da ordem das falas e das reações. Ouça o áudio que você realmente tem no Edit e evite fazer a história depender de um efeito que o resultado gerado ainda não entregou.





