Como escrever prompts de vídeo

Um método prático para prompts de vídeo com IA no Sunra: estrutura de tomada, os presets de câmera que os modelos entendem, ritmo, dicas por modelo e como corrigir falhas comuns.

Um bom prompt de vídeo se lê como a descrição de tomada que um diretor entrega a um operador de câmera. Ele nomeia o sujeito, a ação, a câmera e a luz — e resiste a enfiar três tomadas em uma.

Uma estrutura confiável

Escreva nesta ordem:

  1. Sujeito: quem ou o quê, específico. «Uma jovem de capa de chuva vermelha.»
  2. Ação: a única coisa que muda durante o clipe. «caminha em direção à câmera e olha para cima.»
  3. Cenário: onde, e o que há ao redor. «numa rua molhada de chuva à noite, com neon refletido nas poças.»
  4. Câmera: o movimento. «travelling de aproximação lenta, na altura dos olhos.»
  5. Luz e clima: «luz azul fria, cinematográfica, sombria.»
Uma jovem de capa de chuva vermelha caminha em direção à câmera e olha para cima, numa rua molhada de chuva à noite com reflexos de neon, aproximação lenta na altura dos olhos, luz fria e cinematográfica. 9:16, 5 segundos.

A linguagem de câmera que os modelos entendem

A linha do tempo do Studio do Sunra expõe os movimentos de câmera exatos a que os modelos respondem — use estes termos em qualquer prompt:

  • Push In / Pull Out (aproximar / afastar): mover-se em direção ao sujeito ou para longe dele.
  • Pan Left / Right (panorâmica esq./dir.), Tilt Up / Down (inclinar para cima/baixo): girar a câmera no lugar.
  • Tracking (acompanhamento): seguir em paralelo um sujeito em movimento.
  • Orbit (órbita): circular em volta do sujeito.
  • Crane Up (grua para cima), Aerial (aérea): subir acima da cena.
  • Handheld (câmera na mão): movimento solto e orgânico.
  • Dolly Zoom: o efeito vertigem.
  • Static (fixa): uma tomada travada.
Dica
Nomeie um movimento principal por clipe. Pedir «panorâmica e zoom e órbita» de uma vez costuma virar um borrão — o modelo não dá conta de três direções em poucos segundos.

Uma ação por tomada

O erro mais comum é descrever uma cena inteira com vários eventos. Um clipe dura só alguns segundos — dê a ele um compasso. Se você precisa de uma sequência, gere cada tomada separadamente e monte no Flow, ou use a linha do tempo de várias tomadas no Studio sobre o Kling 3.0 para dirigir vários cortes em uma só geração.

Nota
Os prompts têm um limite máximo de comprimento (varia por modelo), e o Sunra não corta um prompt longo demais — ele falha em vez de rodar. Ponha o essencial primeiro; nomear um compasso claro vence acumular detalhe, de toda forma.

Ritmo e duração

  • Mantenha os clipes curtos enquanto itera; julgue o movimento e então parta para um render mais longo.
  • Palavras como «lento», «tranquilo», «suave» versus «rápido», «ágil», «enérgico» mudam de verdade o resultado.

Ajuste o modelo à tomada

  • Veo 3.1: a direção de câmera mais precisa, mais áudio nativo. Recorra a ele quando o movimento importa.
  • Kling 3.0: o melhor para diálogo (sincronia labial) e sequências de várias tomadas.
  • Sora 2: quando a física e o realismo de texturas sustentam a tomada.
  • Seedance 2.0: clipes sociais rápidos, expressivos e em vertical.
Nota
Uma estrutura de prompt que funciona se transfere entre modelos — a mesma descrição de tomada roda em qualquer um deles. Teste um prompt em dois ou três modelos e fique com a melhor tomada, em vez de reescrever por modelo.

Como corrigir problemas comuns

ProblemaTente isto
Rostos ou mãos deformadosAção mais simples, movimento mais lento, ou parta de uma imagem limpa via imagem para vídeo
A câmera ignora sua indicaçãoNomeie um movimento explícito da lista acima; tire as indicações que competem
Coisas demais acontecendoReduza a uma única ação; divida em várias tomadas
Visual fora da marcaForneça um Start frame (quadro inicial) em vez de descrever o estilo em palavras
Ênfase errada do sujeitoPonha o sujeito primeiro; remova a bagunça do fundo

Fixe o visual com um primeiro quadro

Quando o *estilo* importa mais que a surpresa, gere ou envie uma imagem fixa e anime-a com um Start frame (quadro inicial) no gerador de vídeo. Você deixa de apostar no visual e só pede ao modelo que cuide do movimento. Para os fundamentos, revisite Conceitos básicos de texto para vídeo.

Artigos relacionados