Cómo escribir prompts de video

Un método práctico para prompts de video con IA en Sunra: estructura de toma, los presets de cámara que entienden los modelos, ritmo, consejos por modelo y cómo arreglar fallos comunes.

Un buen prompt de video se lee como la descripción de toma que un director entrega a un operador de cámara. Nombra el sujeto, la acción, la cámara y la luz, y evita meter tres tomas en una.

Una estructura fiable

Escribe en este orden:

  1. Sujeto: quién o qué, específico. «Una joven con un impermeable rojo.»
  2. Acción: lo único que cambia durante el clip. «camina hacia la cámara y mira hacia arriba.»
  3. Escenario: dónde, y qué hay alrededor. «en una calle mojada por la lluvia de noche, con neón reflejado en los charcos.»
  4. Cámara: el movimiento. «travelling de acercamiento lento, a la altura de los ojos.»
  5. Luz y ambiente: «luz azul fría, cinematográfica, sombría.»
Una joven con un impermeable rojo camina hacia la cámara y mira hacia arriba, en una calle mojada por la lluvia de noche con reflejos de neón, acercamiento lento a la altura de los ojos, luz fría y cinematográfica. 9:16, 5 segundos.

El lenguaje de cámara que entienden los modelos

La línea de tiempo de Studio de Sunra expone los movimientos de cámara exactos a los que responden los modelos; usa estos términos en cualquier prompt:

  • Push In / Pull Out (acercar / alejar): moverse hacia el sujeto o alejarse de él.
  • Pan Left / Right (paneo izq./der.), Tilt Up / Down (inclinar arriba/abajo): girar la cámara en su sitio.
  • Tracking (seguimiento): acompañar en paralelo a un sujeto en movimiento.
  • Orbit (órbita): girar alrededor del sujeto.
  • Crane Up (grúa hacia arriba), Aerial (aérea): elevarse sobre la escena.
  • Handheld (cámara en mano): movimiento suelto y orgánico.
  • Dolly Zoom: el efecto vértigo.
  • Static (fija): una toma bloqueada.
Consejo
Nombra un movimiento principal por clip. Pedir «paneo y zoom y órbita» a la vez suele producir un revoltijo: el modelo no puede atender tres direcciones en unos segundos.

Una acción por toma

El error más común es describir una escena entera con varios eventos. Un clip dura solo unos segundos: dale un compás. Si necesitas una secuencia, genera cada toma por separado y ensámblalas en Flow, o usa la línea de tiempo de varias tomas en Studio sobre Kling 3.0 para dirigir varios cortes en una sola generación.

Nota
Los prompts tienen un límite máximo de longitud (varía según el modelo), y Sunra no recorta uno demasiado largo: falla en vez de ejecutarse. Pon lo esencial primero; nombrar un compás claro supera a amontonar detalle de todos modos.

Ritmo y duración

  • Mantén los clips cortos mientras iteras; juzga el movimiento y luego comprométete con un render más largo.
  • Palabras como «lento», «pausado», «suave» frente a «rápido», «ágil», «enérgico» cambian de verdad el resultado.

Ajusta el modelo a la toma

  • Veo 3.1: la dirección de cámara más precisa, más audio nativo. Recurre a él cuando el movimiento importa.
  • Kling 3.0: el mejor para diálogo (sincronización de labios) y secuencias de varias tomas.
  • Sora 2: cuando la física y el realismo de texturas sostienen la toma.
  • Seedance 2.0: clips sociales rápidos, expresivos y en vertical.
Nota
Una estructura de prompt que funciona se traslada entre modelos: la misma descripción de toma corre en cualquiera de ellos. Prueba un prompt en dos o tres modelos y quédate con la mejor toma, en lugar de reescribir por modelo.

Cómo arreglar problemas comunes

ProblemaPrueba esto
Caras o manos deformadasAcción más simple, movimiento más lento, o parte de una imagen limpia con imagen a video
La cámara ignora tu indicaciónNombra un movimiento explícito de la lista de arriba; quita las indicaciones que compiten
Pasan demasiadas cosasReduce a una sola acción; divide en varias tomas
El aspecto no encaja con la marcaAporta un Start frame (fotograma inicial) en vez de describir el estilo con palabras
Énfasis equivocado del sujetoPon el sujeto primero; quita el desorden del fondo

Fija el aspecto con un primer fotograma

Cuando el *estilo* importa más que la sorpresa, genera o sube una imagen fija y anímala con un Start frame (fotograma inicial) en el generador de video. Dejas de jugártela con el aspecto y solo le pides al modelo que se encargue del movimiento. Para los fundamentos, vuelve a Conceptos básicos de texto a video.

Artículos relacionados