Tutorial

Guia de Prompts do Seedance 2.0

O Seedance 2.0 oferece suporte nativo à geração conjunta de áudio e vídeo, com excelente compreensão semântica e capacidade de interação multimodal. Este tutorial mostra como escrever prompts para o Seedance 2.0 e traz técnicas práticas para você gerar vídeos de alta qualidade alinhados à sua visão de forma muito mais eficiente.

Fórmula Básica

Os modelos do Seedance 2.0 conseguem referenciar elementos de vídeo, imagem e áudio ao mesmo tempo, capturando com precisão a aparência do personagem, efeitos de movimento, estilo visual, timbre de voz e muito mais. Isso simplifica bastante a criação de prompts: com algumas fórmulas básicas simples, você orienta o modelo a usar seus recursos multimodais e gera rapidamente vídeos que atendem a necessidades específicas.

O trabalho com referência de vídeo divide-se em três tipos de tarefas: referência multimodal, edição de vídeo e extensão de vídeo. Escolha a fórmula básica ideal para o seu objetivo.

Referência Multimodal

Extraia elementos específicos de seus materiais de referência (como um personagem, estilo, cenário ou som) para gerar um vídeo totalmente novo.

  • Ideal para: transferência de movimento, reaproveitamento de personagens, captura de atmosfera e tarefas semelhantes
  • Padrões recomendados:
  • Referência de imagem: Referenciando o <Subject N> na <Image N>, gere...
  • Referência de vídeo: Referenciando o <motion / camera work / style / sound> no <Video N>, gere...
  • Referência de áudio: Referenciando o timbre de voz no <Audio N>, gere...

Edição de Vídeos

Faça modificações locais ou globais em um vídeo existente. Tudo o que não for mencionado permanecerá inalterado por padrão.

  • Ideal para: substituição local, remoção de elementos, alteração de atributos e tarefas semelhantes
  • Padrões recomendados:
  • Adicionar um elemento: descreva claramente as <element traits> + <when it appears> + <where it appears>
  • Modificar um elemento: Edite estritamente o <Video N>, alterando a <original trait> para a <new trait>
  • Excluir um elemento: nomeie o elemento a ser removido; para elementos que devem continuar inalterados, mencioná-los explicitamente no prompt melhora os resultados

Extensão de Vídeos

Continue o vídeo original ao longo da linha do tempo, mantendo a consistência do estilo audiovisual, dos personagens e da narrativa.

  • Ideal para: dar continuidade a uma história, estender uma ação, preencher segmentos ausentes
  • Padrões recomendados:
  • Estender um vídeo: Estenda o <Video N> para frente/trás, gerando...
  • Interpolação de faixas (Stitching): <Video 1> + <transition description> + depois <Video 2> + <transition description> + depois <Video 3>

Nota

Para tarefas de edição/extensão, refira-se ao vídeo diretamente como <Video N>. Não escreva “referenciando <Video N>”, ou a tarefa poderá ser classificada incorretamente como uma tarefa de referência.

Tarefas Combinadas

Os três tipos de tarefas acima também podem ser combinados.

  • Ideal para: referenciar um material enquanto edita outro
  • Padrão recomendado: Referenciando a [reference dimension] de <Image/Video N>, edite estritamente o <Video X>, [specific edits]

Prompt Examples

Exemplos de prompts para diferentes cenários com o Seedance 2.0 para ajudar você a dominar o controle de referências multimodais e a geração de textos. Escolha o padrão mais próximo do seu objetivo e adapte-o.

Geração de Textos

Slogans

Modelo de prompt:

「conteúdo do texto」+「quando ele aparece」+「onde ele aparece」+「como ele entra」,「características do texto (cor, estilo)」

Dica

O Seedance 2.0 define automaticamente um estilo de texto adequado ao contexto. Se você tiver requisitos rigorosos sobre a aparência do texto, consulte “Referência de Várias Imagens → Referência de logotipo” abaixo.

Materiais de Referência

Image 1
Image 1

Resultado

Prompt

Estilo de quadrinho desenhado à mão. Três pessoas estão sentadas comendo o frango frito da Image 1, em um clima caloroso e amigável. Em seguida, a cena fica gradualmente desfocada e o texto “快乐尽在 Seedance” (“A alegria está no Seedance”) aparece no centro da tela.

Legendas

Modelo de prompt:

As legendas aparecem na parte inferior da tela, lendo “…”, perfeitamente sincronizadas com o áudio.

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Gere um vídeo com locução. Uma voz masculina profunda e calma diz: “Na vastidão do cosmos, nosso mundo é apenas um instante passageiro. E, no entanto, dentro dele, a vida floresce contra todas as probabilidades.” A cena transiciona lentamente da noite para o amanhecer — as estrelas desaparecem enquanto o sol nasce atrás das montanhas. As legendas surgem na parte inferior da tela acompanhando a narração.

Resultado

Materiais de Referência

Tutorial illustration

Prompt

As duas pessoas na imagem conversam em um escritório. A mulher fala primeiro: “你每次卡点到,是不是很享受这种刚刚好的感觉?” (“Você sempre chega no último minuto — gosta de viver no limite?”). O homem responde com um sorriso: “我有我的节奏” (“Eu tenho meu próprio ritmo”). A conversa parece casual e natural, com as legendas correspondentes na parte inferior da tela.

Balões de Fala

Modelo de prompt:

「Personagem」 diz: “…”; enquanto fala, um balão aparece ao seu lado com a fala escrita dentro.

Resultado

Materiais de Referência

Tutorial illustration

Prompt

As duas pessoas na Image 1, vestindo roupas esportivas, correm na pista da escola. A garota olha para o garoto e diz com um sorriso confiante: “Nós com certeza conseguimos!” Corta para um close no garoto, que responde hesitante: “Tem certeza?”. Corta de volta para um plano médio da garota, que diz animada: “Sim!” — com tom firme e otimista. Um balão de fala aparece ao lado de quem estiver falando, com a respectiva fala dentro.

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Referenciando a garota na Image 1 e na Image 2: em um campo de morangos, ela colhe um morango, dá uma mordida e diz sorrindo: “Esse é dos bons!”. Um balão aparece ao redor dela com a fala escrita dentro.

Referência de Imagem

O Seedance 2.0 suporta referências de personagens de vários ângulos (multi-view), bem como referências de várias imagens, como cenários e storyboards.

Se a ordem as imagens for importante, faça o upload na ordem certa e refira-se a elas de forma precisa no prompt como Image 1, Image 2, ... Image n.

Referência de Personagem/Objeto Multi-Ângulo

Basta deixar claro o alvo da referência — o modelo responde a instruções que incluem (mas não se limitam a) estes exemplos. Produtos:

Eletrônicos de consumo

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Extraia a câmera da Image 1, Image 2 e Image 3, e mude o fundo para branco. A câmera está sobre uma mesa branca; a lente foca nela em close, depois gira lentamente ao seu redor como o assunto principal, mostrando claramente a frente, as laterais e a traseira.

Artigos para o lar

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Em um cenário doméstico de tons quentes, um plano médio apresenta a garrafa térmica das imagens de referência. A câmera se aproxima suavemente para um close; uma mão entra na cena naturalmente, segura o corpo da garrafa térmica e a levanta, com a câmera acompanhando o leve movimento de rotação da mão para mostrar o produto.

Personagens:

Materiais de Referência

Tutorial illustration

Resultado

Prompt

Referenciando a mulher na Image 1, Image 2 e Image 3, gere uma cena dela comendo bolo em uma cafeteria.

Referência de Várias Imagens

Referência de logotipo

Resultado

Materiais de Referência

Tutorial illustration

Prompt

O cenário de fundo é uma passarela suspensa iluminada por neon em uma cidade futurista, com veículos aéreos cruzando entre anúncios holográficos. Referenciando a garota na Image 2: primeiro, um plano médio dela soltando uma lanterna flutuante prateada que projeta um holograma; depois, a câmera recua para revelar um céu cheio de lanternas flutuantes. A tela fica gradualmente desfocada e o logotipo da Image 1 aparece. Estilo geral: animação de ficção científica cyberpunk em 3D.

Referência de vários personagens/objetos

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Referenciando o cão e o gato das imagens: em um apartamento aconchegante, o cão está deitado comendo de sua tigela; o gato se aproxima e toca o cão com a pata; o cão para de comer ao ver o gato, e o gato se aconchega nele. Paleta de cores quentes.

Referência de vários elementos

Resultado

Materiais de Referência

Tutorial illustration

Prompt

A cena se passa dentro do restaurante da Image 4, movimentado com clientes. A garota da Image 1, vestindo a roupa da Image 2, está organizando itens no balcão. O garoto da Image 3 é um cliente; ele se aproxima, querendo pedir o contato da garota. O logotipo da Image 5 permanece visível no canto inferior direito da tela durante todo o tempo.

Referência de storyboard com vários painéis

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Referenciando o storyboard da imagem, gere uma cena de luta intensa. A composição de cada painel aparece em ordem e, em seguida, os dois lutam ferozmente.

Referência de storyboard

Resultado

Materiais de Referência

Tutorial illustration

Prompt

Referenciando o enquadramento do painel da Image 3: uma garota espera o pai terminar de cozinhar e diz: “아빠, 배고파요! 밥 다 됐어요?” (sua fisionomia referencia a Image 1). A câmera então faz um movimento de panorâmica para la direita, mudando para o enquadramento da Image 4; o pai, cuja fisionomia referencia a Image 2, responde: “거의 다 됐어, 조금만 기다려!”. Corta de volta para um close do rosto ligeiramente decepcionado da filha enquanto ela diz: “아직 멀었어요? 맛있는 냄새 나는데…” Em seguida, corta para um close do pai, que diz: “이제 진짜 금방이야。 "빨리빨ly" 하지 말고 손부터 씻고 와!”

Referência de Vídeo

O Seedance 2.0 suporta referência de vídeo — basta ser explícito sobre o que gerar e o que referenciar.

Se a ordem dos vídeos for importante, faça o upload na ordem certa e refira-se a eles de forma precisa no prompt como Video 1, Video 2, ... Video n.

Referência de Ação

Cinema e TV

Resultado

Materiais de Referência

Video 1
Tutorial illustration

Prompt

Referenciando o movimento dos personagens e a linguagem de câmera do Video 1, gere uma cena de luta entre a Image 2 e a Image 1 — a Image 2 é a pessoa à esquerda, e a Image 1 é a pessoa à direita. Trilha sonora de suspense intensa.

Marketing

Resultado

Materiais de Referência

Video 1

Prompt

Referenciando a forma do galope do cavalo no Video 1, gere um corcel dourado galopando por um campo verdejante, depois congele sua pose imponente de corrida enquanto ele se transforma em um pingente de ouro em formato de cavalo.

Referência de Movimento de Câmera

Resultado

Materiais de Referência

Video 1
Image 1
Image 1

Prompt

Referenciando o movimento de câmera do Video 1, crie um vídeo conceitual de um parque tecnológico: o arranha-céu da Image 1 é o centro visual, com o mesmo mergulho em primeira pessoa, transmitindo a sensação futurista do complexo da Image 1.

Referência de Efeitos

Cinema e TV

Resultado

Materiais de Referência

Video 1
Image 1
Image 1

Prompt

Referenciando o efeito de partículas douradas do Video 1: enquanto o personagem da Image 2 toca flauta, o mesmo efeito de partículas flutua ao seu redor.

Efeitos inovadores

Resultado

Materiais de Referência

Video 1
Image 1
Image 1

Prompt

Referenciando o efeito do Video 1, dê à garota da Image 1 as mesmas asas, com uma trajetória idêntica de crescimento das asas.

Edição de Vídeo

O Seedance 2.0 suporta edição de vídeo: adição, exclusão ou modificação de elementos; extensão de um vídeo para frente ou para trás; e interpolação de faixas (Stitching).

Se a ordem dos vídeos for importante, faça o upload na ordem certa e refira-se a eles de forma precisa no prompt como Video 1, Video 2, ... Video n.

Adicionar / Excluir / Modificar Elementos

Adicionar elementos

Resultado

Materiais de Referência

Video 1

Prompt

Adicione frango frito, pizza e outros petiscos sobre o balcão no Video 1.

Excluir elementos

Resultado

Materiais de Referência

Video 1

Prompt

Remova os outros objetos e ferramentas de cima da mesa no Video 1, mantendo a mesa limpa e organizada — apenas o que ambos estão segurando nas mãos deve restar.

Modificar elementos

Resultado

Materiais de Referência

Video 1
Image 1
Image 1

Prompt

Substitua o perfume no Video 1 pelo creme facial da Image 1, mantendo o movimento e o trabalho de câmera inalterados.

Extensão de Vídeo

Nota

O modelo corta automaticamente o segmento de junção para fazer a composição — ele não gerará novamente trechos que já estejam presentes no vídeo de entrada.

Estender para trás

Resultado

Materiais de Referência

Video 1

Prompt

Gere o que acontece após o Video 1: os dois homens que se atrasaram correm em direção a eles, e os cinco finalmente se reúnem e conversam alegremente.

Estender para frente

Resultado

Materiais de Referência

Video 1

Prompt

Estenda o Video 1 para frente: plano sobre o ombro do homem de branco, que diz: “Não é tão ruim assim. Você só está estressado. Todo mundo passa por isso, você só precisa continuar.”

Interpolação de Faixas (Stitching)

Dica

  • O Seedance 2.0 aceita no máximo 3 vídeos de entrada, com uma duração total de até 15 segundos.
  • A geração corta automaticamente as seções de junção do primeiro e do último vídeo, mantendo apenas o necessário para a composição.

Resultado

Materiais de Referência

Video 1
Video 2

Prompt

Video 1 — no instante em que a folha cai, ela levanta um efeito de partículas douradas; uma rajada de vento sobra — depois Video 2.

Fórmula Avançada

O Seedance 2.0 funciona essencialmente como um diretor de IA multimodal: ele lê seu prompt de texto, imagens, vídeos e áudio simultaneamente, dividindo-os internamente em uma camada espacial (o que está na tela) e uma camada temporal (como as coisas mudam com o tempo) para compreender e gerar as cenas.

Portanto, um bom prompt não é feito de “adjetivos publicitários”, mas sim de uma instrução puramente técnica: quem, em qual cenário, realizando qual ação, com qual movimento de câmera e em qual sequência — cada detalhe direcionado às camadas espacial e temporal. A fórmula:

Fórmula do prompt avançado: Sujeito preciso + Detalhes de ação + Cenário & ambiente + Iluminação & tom + Movimento de câmera + Estilo visual + Qualidade de imagem + Restrições

Em resumo: primeiro defina quem está fazendo o quê, depois estabeleça onde e em qual clima, indique ao modelo como filmar e, finalmente, refine o resultado com termos de estilo, qualidade e restrições. Explicamos cada elemento abaixo.

1. Defina Seus Personagens/Objetos (Sujeitos)

Uma única imagem de referência costuma conter vários elementos. Para referenciar um objeto específico com precisão, você deve definir seus sujeitos explicitamente. Um sujeito pode ser uma pessoa, um acessório ou um cenário.

  • Padrão recomendado: Defina as [características principais do sujeito] na <Image/Video N> como <Subject N>
  • Requisitos das características principais: use de 2 a 3 características claras, estáveis e estáticas (roupa, cabelo, aparência, categoria) para que o sujeito seja facilmente identificável
  • Exemplos:
  • Defina a mulher de vestido vermelho usando chapéu de palha na Image 1 como Subject 1
  • Defina a mulher de vestido vermelho usando chapéu de palha na Image 1 como Zhang Hong

Nota

  • Refira-se aos sujeitos explicitamente toda vez que aparecerem — evite deixar a referência implícita. Há duas formas recomendadas:
  • Para cenas simples sem sujeitos predefinidos, escreva <Subject N>@<Image N> sempre que o sujeito aparecer, para reforçar o vínculo entre o sujeito e o material. Exemplo: Zhang San@Image 1.
  • Para cenas com sujeitos predefinidos, continue usando as mesmas etiquetas em todo o prompt. Exemplo: defina o homem alto no Video 1 como o Policial e o homem mais baixo como o Ladrão, e continue referindo-se a eles como Policial e Ladrão até o final.
  • Mantenha as descrições concisas. Evite redundâncias e conflitos semânticos (como características contraditórias para o mesmo sujeito).
  • Prefira expressar as relações espaciais por meio de imagens de referência, em vez de descrições complexas em texto.

2. Use Sequenciamento Cena a Cena

O modelo organiza internamente o espaço e o tempo de forma separada. Portanto, para um vídeo complexo, o formato ideal do prompt é uma linha do tempo de cenas: divida o vídeo em algumas cenas e descreva cada uma delas de forma dinâmica, na ordem em que as ações acontecem — quem + onde + fazendo o quê + movimento de câmera.

Dica prática: divida o vídeo em partes simples como “Cena 1 / Cena 2 / Cena 3” e, depois, junte-as no prompt final.

  • Exemplo ruim: “Um homem corre nervoso pelas ruas; o plano tem um estilo bem cinematográfico.”
  • Exemplo ideal:
  • Cena 1: Vista lateral de um beco na rua; o homem começa a correr lentamente, com uma respiração ofegante.
  • Cena 2: O homem esbarra em uma barraca de frutas; a câmera faz um movimento rápido e para em um close de seu rosto aterrorizado.
  • Cena 3: O homem salta sobre um muro baixo e desaparece; a câmera recua lentamente e permanece fixa na rua deserta.

Regras específicas

  • Use marcadores como Cena 1, Cena 2, Cena 3 e organize o conteúdo na ordem em que as coisas acontecem (o principal primeiro). Não estipule uma duração exata para cada segmento — deixe o modelo ditar o ritmo da história naturalmente.

Dica

O suporte do modelo para tempos precisos (ex.: “0-3 segundos”) é instável. Forçar durações exatas pode gerar resultados corrompidos ou estranhos.

Recomenda-se estruturar cada cena na seguinte ordem:

  1. Movimento de câmera ou transição: ex.: “plano geral se aproximando lentamente”, “câmera fixa”, “corta para...”.
  2. Ação e expressão do sujeito: as principais ações e mudanças de expressão do personagem / objeto principal.
  3. Posição ou mudança espacial: o cenário, a posição ou os relacionamentos espaciais do sujeito.
  4. Informações de áudio: os efeitos sonoros, diálogos ou música de fundo para aquela cena.

3. Descrição de Ação

  • Partes do corpo específicas + intensidade medida — Descreva as ações detalhando mãos, pernas, cabeça, ombros e costas, adicionando determinantes de amplitude, velocidade e força. Exemplos: levanta a mão lentamente, vira a cabeça rapidamente, dá um impulso forte do chão, abaixa a cabeça de leve.
  • Prefira movimentos pequenos, lentos e contínuos — Dê prioridade a microações lentas, suaves e encadeadas; evite corridas rápidas, saltos longos, giros bruscos e outros movimentos de alta velocidade e grande amplitude dinâmica. Exemplos: caminhando devagar, levantando a mão delicadamente, inclinando de leve a cabeça, sentando-se em um único movimento fluido.
  • Descreva as transições entre ações — Detalhe o fluxo e a passagem de um movimento para o outro para manter a coerência física. Exemplos: usa o impulso do giro para levantar a mão, passa naturalmente do repouso para o gesto de erguer a mão.
  • Externalize as emoções em detalhes físicos — Expresse sentimentos por meio de detalhes corporais concretos, em vez de palavras abstratas como “muito triste” ou “furioso”. Veja a tabela abaixo:
Emoção abstrataAções & detalhes externalizados
TristezaCabeça baixa, ombros tremendo de leve, olhos lacrimejando, dedos segurando inconscientemente a barra da roupa, lágrimas acumulando-se nos olhos sem cair
AlegriaCantos da boca subindo involuntariamente, testa e olhos relaxados, passos leves, cantarolando uma melodia sem perceber, sem conseguir conter a vontade de dar uma pirueta
Nervosismo / ansiedadeOlhando para o relógio a todo momento, dedos batendo na mesa sem parar, respiração curta e rápida, olhos inquietos, roendo as unhas sem perceber
RaivaPunhos cerrados, maxilar tenso, peito subindo e descendo com força, olhar cortante como uma lâmina, palavras ditas entre dentes
AlívioUm longo suspiro, ombros tensos relaxando completamente, um sorriso tímido surgindo após muito tempo, olhar direcionado para o horizonte

4. Movimento de Câmera

O modelo compreende muito bem os termos de cinema — basta usar o jargão técnico padrão diretamente, como “plano médio, close-up, plano geral, aproximação lenta, movimento lateral suave, câmera fixa”.

Nota

Especifique apenas um movimento de câmera por cena. Exigir aproximação, recuo, panorâmica e acompanhamento ao mesmo tempo aumenta a instabilidade da imagem.

5. Qualidade, Estilo & Restrições

Os termos de qualidade, estilo e restrições são cruciais para orientar a geração. Eles definem os limites criativos para o modelo, unificam a qualidade da imagem e a direção de arte e evitam defeitos visuais e variações indesejadas — elementos cruciais para resultados consistentes e estáveis.

1. Qualidade de imagem — define a nitidez, o nível de detalhes e a iluminação, elevando o padrão da entrega. Exemplo: alta definição, detalhes ricos, textura cinematográfica, cores naturais, iluminação suave.

2. Estilo — define a direção artística geral e a identidade visual, consolidando a atmosfera estética. Exemplo: paleta cyberpunk fria em azul e roxo, filme vintage, tons suaves no estilo anime japonês.

3. Restrições — de extrema importância. As restrições ajudam a evitar defeitos visuais, deformações e elementos ilógicos, limitando o escopo da geração e melhorando a estabilidade da imagem. Modelos mais comuns:

  • Evitar legendas: “mantenha o vídeo sem legendas”, “evite gerar qualquer texto ou legenda”
  • Evitar logotipos: “não gere logotipos”
  • Evitar marcas d'água: “não gere marcas d'água”

6. Exemplos Reais

Dois exemplos práticos que mostram a fórmula avançada e seus componentes integrados num prompt de verdade.

Materiais de referência:

  • @Image 1: foto de meio corpo da protagonista
  • @Image 2: imagem de referência do dormitório
  • @Video 1: referência de câmera para diálogo interno (aproximação/recuo em plano médio ou leve panorâmica)
  • @Audio 1: som ambiente interno ou música suave

Prompt

A garota em @Image 1 é a protagonista; @Image 2 é a referência de estilo para o dormitório; o movimento de câmera referencia o @Video 1. Cena 1: Ao entardecer, a garota @Image 1 caminha apressada em direção à porta do dormitório @Image 2. Plano de acompanhamento médio estável; a luz amarela do fim do dia entra no corredor pela janela. Ela hesita diante da porta e respira fundo, parecendo um pouco nervosa. Cena 2: A garota @Image 1 abre a porta e entra. Corta para um plano médio interno: suas colegas de quarto levantam os olhos da arrumação dos livros e uma delas pergunta sorrindo {Como foi a prova? Passou?}. A câmera corta suavemente entre closes de meio corpo de cada uma. Cena 3: A garota @Image 1 primeiro abaixa a cabeça com um olhar desanimado — a câmera foca em seu close — de repente, ela levanta a cabeça, sem conseguir conter o riso, cai na gargalhada e diz {Peguei vocês!}. As amigas começam a correr atrás dela de brincadeira; a câmera se afasta lentamente para um plano geral do quarto cheio de risadas. Durante todo o vídeo: alta definição, estilo documentário cinematográfico, tons quentes, iluminação suave; rostos consistentes e sem deformações, movimentos naturais e fluidos, sem travamentos ou oscilações de brilho; áudio ambiente integrado perfeitamente ao @Audio 1.

Dicas Práticas

Geração de Textos

O Seedance 2.0 consegue gerar textos comuns na tela. O modelo seleciona automaticamente um estilo e uma cor que combinem com o contexto, permitindo que você especifique a cor do texto, estilo, animação de entrada, tempo de exibição e posição diretamente no prompt. Dê preferência a caracteres comuns e evite caracteres raros ou símbolos especiais para obter a melhor renderização. Atualmente, os cenários compatíveis incluem slogans, legendas e balões de fala — consulte os exemplos de Geração de Textos acima para ver os padrões recomendados.

Extensão vs. Emenda (Stitching)

  • Plano sequência contínuo (extensão de vídeo): ideal para cenas “silenciosas” focadas em diálogo dentro de um único cenário — conversas longas, desenvolvimento emocional, deslocamento em um trajeto — proporcionando uma experiência imersiva e ininterrupta.
  • Mudanças de cena / ação (emenda segmentada): ideal para reviravoltas ou cenas de “ação” complexas e rápidas — perseguições, combates, montagens. Gere os trechos de forma independente e depois monte-os na edição para preservar o ritmo e o impacto visual.

Projetos práticos costumam combinar ambas as técnicas: primeiro faz-se a extensão para garantir a continuidade da conversa e, em seguida, inserem-se planos de detalhe ou cenas de transição na emenda — preservando a imersão e variando o dinamismo.

Estratégia de Configuração de Materiais

Pense em seus materiais de referência cobrindo quatro funções principais:

  1. Ancoragem do personagem: fixa a aparência do personagem
  2. Definição do tom da cena: fixa o cenário e o estilo
  3. Referência de câmera: fixa a linguagem visual e o ritmo da ação
  4. Ritmo & atmosfera: usa o áudio para ditar as emoções e o tom da voz

Configuração recomendada (4–5 materiais no total): 1 a 2 imagens de personagem (close de rosto / corpo inteiro) + 1 imagem de cenário + 1 vídeo de referência de câmera + 1 arquivo de áudio.

Dica

Não abuse do limite de arquivos de referência. O excesso de materiais dificulta a priorização de recursos pelo modelo, provocando facilmente conflitos de estilo, imprecisão na identificação de elementos e resultados distantes do esperado.

Diretrizes de Uso

Consistência de Idioma

Mantenha o diálogo em uma única língua. Evite misturar idiomas na mesma frase (com exceção de nomes próprios).

Caracteres Especiais

O uso correto e consistente de símbolos ajuda o modelo a diferenciar os vários tipos de informação:

Tipo de informaçãoSímboloExemplo
Música()(Música de rock acelerada toca ao fundo)
Efeitos sonoros<><Um cachorro late ao longe>
Diálogo{}{Olá, mundo}. No caso de diálogos em idiomas menos comuns (que não sejam inglês/chinês), indique o idioma, ex: diz em japonês {こんにちは}.
Legendas / letreiros【】【Capítulo 1: A Partida】

FAQ

Variação de Identidade do Personagem (ID Drift)

Sintoma — O personagem gerado não corresponde à imagem de referência ou o rosto muda no meio do vídeo (ID drift), às vezes esbarrando em filtros de segurança por se assemelhar a figuras públicas de maneira indesejada.

Causa principal — A referência do rosto não é forte o suficiente:

  • Imagens de referência misturadas: a referência facial é mesclada em um arquivo que contém planos de corpo inteiro, amostras de vestuário ou fotos de detalhes.
  • Rosto muito pequeno na tela: em imagens com muitas informações, o rosto ocupa um espaço muito reduzido, fazendo com que o modelo ignore características faciais e se distraia com o fundo ou outros elementos.

Solução — Aumente a prioridade e o foco na referência do rosto:

  1. Use um close-up facial exclusivo: além da foto de corpo inteiro, inclua um arquivo focado apenas na cabeça do personagem (uma foto de rosto — de de preferência com expressão neutra e fundo simples, sem ombros ou elementos distrativos).
  2. Defina o sujeito claramente no prompt: “O rosto do Subject 1 referencia a Image 1 (foto de rosto); a maquiagem e as roupas referenciam a Image 2 (foto de corpo inteiro)”.
  3. Coloque os recursos mais importantes primeiro: quanto mais precisa for a referência do material, mais cedo ele deve ser inserido na ordem do prompt.

Nota

Para referência de personagem, utilize combinados um close de rosto + foto de corpo inteiro. Não recomendamos folhas de múltiplos ângulos (turnarounds) — elas contêm a mesma pessoa sob vários ângulos, o que faz com que o modelo interprete a imagem como vários personagens diferentes, piorando o drift de identidade.

Antes

O rosto do personagem muda no meio do vídeo, assemelhando-se a uma figura pública

Depois

O rosto permanece totalmente consistente com a imagem de referência durante todo o vídeo

Legendas Indesejadas

Sintoma — O prompt não continha pedidos de legenda, mas o vídeo gerado exibe textos ou legendas indesejadas.

Dica

No momento, não há como garantir 100% de exclusão das legendas — as recomendações abaixo reduzem a incidência e aumentam suas chances de sucesso nas tentativas.

  1. Adicione instruções explícitas ao prompt: “mantenha o vídeo sem legendas”, “evite gerar qualquer texto ou legenda”.
  2. Se os textos em suas imagens ou vídeos de referência forem dispensáveis, remova-os antes (por exemplo, editando as imagens/vídeos no Seedream ou Seedance) e utilize o material limpo na geração.
  3. Sempre que possível, gere primeiro no formato paisagem (vídeos horizontais contêm muito menos legendas indesejadas que os verticais) e faça o recorte para retrato posteriormente em um editor.

Surgimento de Logotipos / Marcas d'Água

Sintoma — O prompt não fazia qualquer menção a marcas d'água, mas o vídeo gerado exibe logos ou marcas d'água de outras plataformas de vídeo.

Solution — Insira termos restritivos explícitos no prompt: “não gere marcas d'água”, “não gere logotipos”.

Variação de Estilo (Style Drift)

Sintoma — Você quer gerar um visual em estilo anime 2D ou 3D, mas a imagem de referência é fotorrealista e o prompt não reforça a estética escolhida — o que pode fazer com que o modelo gere imagens no estilo live-action de forma indesejada.

Solution — Use restrições explícitas de estilo no prompt, como “estilo anime japonês 2D” ou “animação chinesa em 3D”. Para obter maior fidelidade, sugerimos converter a imagem de referência original ao formato desejado antes de partir para a geração de vídeo.

Antes

O estilo xianxia desvia para o fotorrealismo (live-action)

Depois

Mantém a fidelidade ao estilo de computação gráfica 3D de ficção de fantasia chinesa (xianxia)

Salto Visual nas Emendas de Extensão

Sintoma — Ao estender um vídeo e conectá-lo ao original, o ponto de junção pode exibir um corte abrupto ou um pequeno retrocesso no conteúdo do quadro.

Solution — Por enquanto, faça o ajuste manual na pós-produção alinhando os quadros-chave (uma correção definitiva virá com as próximas atualizações de modelo):

  1. Importe os clipes que deseja unir para o CapCut ou outro programa de edição.
  2. No primeiro ponto de transição, corte 6 quadros da parte final do clipe anterior.
  3. Corte também 1 quadro da parte inicial do clipe seguinte.
  4. Repita o processo para cada ponto de corte.
  5. Exporte o vídeo e verifique se a transição entre os clipes ficou fluida.

Dica

Mesmo com o alinhamento de quadros, podem ocorrer pequenas inconsistências. Ao planejar extensões, procure terminar o clipe em um momento de corte de cena natural, deixando o próximo trecho iniciar já a nova cena após o corte.

Antes

Salto visível de quadros / retrocesso de conteúdo na emenda (aos 5s e 20s)

Depois

Ponto de emenda muito mais natural e fluido

O Problema dos “Clones” (Gêmeos)

Sintoma — Em cenas com muitos personagens, especialmente ao utilizar arquivos de referência de múltiplos ângulos (turnarounds), podem surgir cópias idênticas do mesmo personagem em um único quadro.

Causa principal:

  • Os personagens não foram bem identificados no prompt, confundindo a IA sobre quem é quem.
  • Imagens com múltiplas visões confundem as referências, gerando clones duplicados do mesmo elemento.

Dica

No momento, não há como precaver 100% o surgimento de clones — as ações abaixo reduzem a incidência e ajudam a otimizar os testes.

  1. Vincule cada personagem ao seu material correspondente: defina de forma clara cada elemento e indique a qual imagem ele responde, mantendo o padrão do formato. Exemplo: Zhang San (da Image 1) joga a caderneta verde para Li Si (da Image 2), que está de pé.
  2. Insira uma restrição global no final do prompt: “Durante todo o vídeo, nunca mostre personagens com feições, roupas e acessórios idênticos; evite qualquer efeito de clone ou gêmeos; mantenha apenas uma única versão de cada personagem em tela; sem personagens duplicados.”
  3. Otimize as imagens de referência: dê preferência a fotos com pessoas isoladas; evite usar arquivos com turnaround ou múltiplas visões.
  4. Encurte seu prompt: evite colar roteiros inteiros no campo de prompts — o excesso de informações confunde o modelo. Simplifique o texto e mantenha o foco nas instruções diretas.

Antes

Um “clone” aparece na cena aos 8 segundos

Depois

Perda de Qualidade na Extensão

Sintoma — Usar um vídeo gerado como arquivo de entrada para gerar extensões sucessivas degrada a qualidade da imagem. O acúmulo de extensões agrava o problema, revelando manchas de cores flutuantes, principalmente nos rostos.

Solution — Medidas paliativas no momento (uma solução nativa virá com as próximas versões do modelo):

  1. Converta o vídeo original para uma renderização em argila branca (clay rendering) no Seedance 2.0 antes de inseri-lo como entrada para extensão. Prompt de referência: “Converta o vídeo em um modelo 3D em estilo argila branca: todos os personagens tornam-se de gesso branco puro sem cores, sem texturas, sem sombras, com fundo branco puro, com estrutura firme e movimentos fluidos.”
  2. Dê preferência a imagens de altíssima definição como materiais de referência.
  3. Evite encadear extensões por muitas rodadas dinâmicas; limite a quantidade de repetições.

Antes

Extensão direta do vídeo de saída do modelo

Depois

Conversão do vídeo em argila branca antes de fazer a extensão

Efeitos que não Atendem às Expectativas

Sintoma — Descrever um efeito visual complexo usando apenas palavras às vezes não traz o resultado esperado. Exemplo: o prompt pede “o número 2999 surge em uma animação de contagem regressiva”, mas o modelo gera números girando ou saltando aleatoriamente em vez do efeito ordenado.

Solution — Use um vídeo de referência para moldar o efeito: insira um vídeo que exiba o movimento desejado e diga para o modelo se basear nele. Exemplo: “O número 2999 surge exatamente de acordo com o efeito apresentado no Video 1”.

Antes

Materiais de Referência

Video 1 — referência do efeito

Os números do efeito de contagem regressiva saltam de forma aleatória

Depois

Com o acréscimo do vídeo de referência correto para os números em movimento, o resultado corresponde ao esperado

Excesso de Personagens de Referência

Sintoma — Trabalhar com mais de 4 personagens de referência reduz sensivelmente a estabilidade: o vídeo de saída pode apresentar número incorreto de pessoas em tela (cortando ou adicionando elementos de forma imprecisa) ou gerando rostos duplicados.

Solution — Diretrizes de melhoria temporárias (uma correção definitiva virá em futuras versões do modelo):

  1. Gere imagens de grupos em etapas: separe os personagens em blocos de até 4 pessoas por imagem. Por exemplo, agrupe 6 personagens em 2 blocos de 3 para gerar duas imagens.
  2. Geração de imagem para vídeo subsequente: use essas imagens geradas por blocos como novos arquivos de referência ao criar o vídeo.

Antes

Entrada com 8 personagens de referência -> resultado com 9 pessoas em tela

Depois

8 personagens gerados inicialmente em 2 imagens independentes e, em seguida, transformados em vídeo

Inconsistências no Timbre da Voz

Sintoma — Ao usar um arquivo de áudio para definir o timbre da voz, a voz final gerada no vídeo pode se desviar notavelmente do timbre original inserido.

Solution:

  1. Adicione descrições minuciosas sobre as características da voz no prompt, ex.: “fala em uma voz masculina de meia-idade, profunda, agradável e levemente rouca igual ao @Audio 1”.
  2. Mantenha a entonação da fala e o vocabulário coerentes com as características do áudio de referência — isso eleva bastante a estabilidade e a qualidade do timbre final.

Antes

Materiais de Referência

Audio 1 — áudio de entrada

A voz não condiz com as características do áudio de entrada

Depois

Ao descrever formalmente as características físicas da voz no prompt, o alinhamento melhora sensivelmente