Como escrever prompts para Seedance 2.0: estrutura de planos + a fórmula dos 8 elementos
2026-06-16

Como escrever prompts para Seedance 2.0: estrutura de planos + a fórmula dos 8 elementos

Escrever prompts para o Seedance 2.0 não é sobre palavras rebuscadas — é sobre estrutura. O modelo é melhor compreendido como um "diretor de IA multimodal" que divide um plano em uma camada espacial (o que está em quadro) e uma camada temporal (como muda ao longo do tempo). Por isso, um bom prompt é uma instrução de engenharia: quem, onde, fazendo o quê, filmado como e em que ordem. Este artigo mostra como escrever o prompt de texto seguindo a estrutura oficialmente recomendada e como o VideoLens gera essa estrutura a partir de um vídeo de referência. (Apenas prompts de texto — a geração multimodal por referência está fora do escopo aqui.)

I. A fórmula dos 8 elementos

A fórmula recomendada: sujeito preciso + detalhe de ação + cena/ambiente + luz e cor + movimento de câmera + estilo visual + qualidade de imagem + restrições. Fixe primeiro "quem está fazendo o quê", depois "onde e com que clima", em seguida "como é filmado" e, por fim, ajuste o resultado com estilo, qualidade e restrições.

ElementoO que escreverExemplo
Sujeito2–3 traços estáticos estáveis (figurino/cabelo/aparência/categoria)uma mulher de vestido vermelho e chapéu de palha
Açãoaté os membros + amplitude/velocidade/forçaergue lentamente uma mão, inclina a cabeça
Cenao cenário / a posição / a relação espacialum corredor de alojamento ao entardecer
Luz e coro tom de luz e cor do quadroluz do sol amarela e quente pela janela, luz suave
Movimento de câmeratermos padrão, um movimento por planotravelling médio estável, push-in lento
Estilo visualestilo artístico e tom geraldocumentário cinematográfico / anime fresco / 3D
Qualidadenitidez, detalhe, texturaHD, cinematográfico, luz suave
Restriçõesdelimita o resultado, evita artefatossem legendas, sem logo/marca d'água, sem deformar o rosto

II. Espaço × tempo: por que sequenciar planos

O modelo desacopla espaço e tempo internamente, então o prompt ideal para um vídeo complexo é uma linha do tempo de planos: divida-o em vários planos e descreva cada um na ordem dos eventos. Um vago "um homem corre nervoso pela rua, muito cinematográfico" é muito mais fraco do que Plano 1 / Plano 2 / Plano 3.

Organize cada plano assim: ① movimento de câmera ou corte → ② ação e expressão do sujeito → ③ mudança de posição / espacial → ④ áudio (efeitos / voz / BGM).

Segundo o guia oficial: o modelo é instável com tempos exatos (ex.: 0–3 s). Não force durações por plano — ordene com "Plano 1 / 2 / 3" e deixe o ritmo surgir.

III. Como escrever a ação (quatro regras)

RegraComoExemplo
Específico + quantificadonomeie o membro + amplitude/velocidade/forçaerguer a mão devagar, virar a cabeça rápido
Prefira movimentos lentos e pequenosevite corridas/saltos/rolamentos violentosandar devagar, sentar-se com naturalidade
Adicione transiçõesindique a inércia que liga os movimentoserguer o braço aproveitando o giro
Externalize a emoçãouse detalhe corporal, não "muito triste/raivoso"veja a tabela abaixo

Externalização da emoção — traduzir o sentimento abstrato em detalhe filmável:

SentimentoExternalizado como ação e detalhe
Tristezacabeça baixa, ombros tremendo, olhos avermelhados, dedos apertando a barra da roupa, lágrimas se formando mas sem cair
Alegriaum sorriso incontrolável, sobrancelhas relaxadas, passos leves, um giro rápido
Ansiedadeolhar o relógio, tamborilar os dedos, respiração ofegante, olhos inquietos, roer as unhas
Raivapunhos cerrados, mandíbula tensa, peito ofegante, olhar cortante, palavras forçadas entre os dentes
Alíviouma longa expiração, ombros relaxando, um leve sorriso, o olhar erguido para o horizonte

IV. Câmera, qualidade e restrições

Use termos de câmera padrão diretamente — o modelo os entende bem: médio, close-up, plano geral, push-in lento, panorâmica estável, câmera fixa. Nota: use um único movimento por plano; combinar push/pull/panorâmica/tilt desestabiliza a imagem.

O trio de fechamento — qualidade, estilo e restrições — ajusta o resultado:

TipoFunçãoModelo / exemplo
Qualidadedefine nitidez e texturaHD, rico em detalhes, cinematográfico, luz suave
Estilounifica a direção de artecyberpunk azul-roxo frio, filme retrô, anime fresco, 3D
Restriçõesevita artefatos e marcas residuaissem legendas / sem texto / sem logo / sem marca d'água

V. Símbolos de áudio e diálogo

O Seedance 2.0 cogenera áudio e vídeo de forma nativa; símbolos fixos marcam o tipo de informação para que o modelo a interprete corretamente:

TipoSímboloExemplo
Música()(rock animado toca ao fundo)
Efeitos<><um cão late ao longe>
Diálogo{}{你好,世界}; marque o idioma para línguas menos comuns, ex.: diga em japonês {こんにちは}
Legenda【】【Capítulo 1: Partida】

Algumas dicas de diálogo: mantenha um idioma por linha (exceto nomes próprios); o modelo lê errado caracteres chineses raros ou polifônicos — troque por um homófono comum (ex.: 螭龙山 → 吃龙山); e adicione a restrição "sem legendas" se não quiser legendas.

VI. Gere essa estrutura com o VideoLens

Escrever isso à mão significa digitar cada plano. O VideoLens faz o inverso — dê a ele um vídeo de referência e o Assistente de Criação o decompõe plano a plano e gera prompts do Seedance 2.0 exatamente nesta estrutura:

· ancora os personagens, cenas e adereços recorrentes como entidades reutilizáveis; · gera um prompt por plano na ordem dos planos (movimento de câmera + ação do sujeito + cena e luz); · fecha com uma cauda de estilo que unifica qualidade e tom, adicionando por padrão "sem legendas, sem logo/marca d'água"; · separa diálogo, efeitos e BGM e mapeia cada um em seu plano.

Em resumo: você não parte de uma página em branco — o VideoLens entrega uma lista de planos que você pode ajustar diretamente.

A metodologia de prompts deste artigo foi compilada a partir do guia oficial de prompts da série Doubao Seedance 2.0 da ByteDance; especificações, redação e terminologia seguem a documentação oficial.

Um prompt do Seedance 2.0 é, em essência, uma "instrução de diretor" no nível do plano. Depois de internalizar as camadas de espaço + tempo, os 8 elementos, o sequenciamento de planos e a convenção de símbolos, você consegue escrever prompts que geram de forma confiável — e, quando quiser pular o trabalho manual, entregue um vídeo de referência ao VideoLens para obter uma lista de planos pronta para ajustar.