HappyHorse Video Multi-Referencia

Sube de 1 a 9 imágenes de referencia y asigna cada una a un token de personaje en tu prompt. HappyHorse mantiene la consistencia de identidad para cada persona referenciada a lo largo de todo el clip.

La generación multi-referencia te permite proporcionar múltiples imágenes de origen — una por personaje — para que el modelo de IA mantenga la apariencia distinta de cada persona a lo largo de un video. El modelo mapea cada referencia a un token con nombre (ej., [person1], [person2]) en el prompt, vinculando características faciales, proporciones corporales y ropa a ese token. Esto es fundamentalmente diferente de los modelos de referencia única que solo pueden preservar una identidad, forzando a las escenas multi-persona a alucinar los personajes secundarios.

Qué puedes hacer

Hasta 9 imágenes de referencia por generación

HappyHorse acepta de 1 a 9 imágenes de referencia — la mayor cantidad en el panorama actual de modelos de video IA. Cada referencia se vincula a un token de personaje separado, por lo que una escena grupal con 9 personas distintas es posible en una sola generación.

Vinculación de tokens de personaje en prompts

Las imágenes de referencia se asignan a tokens como [person1] a [person9]. Usa estos tokens en tu prompt para posicionar y dirigir cada personaje independientemente: "[person1] entrega una taza de café a [person3] mientras [person2] saluda desde el fondo."

Interacción entre personajes

Debido a que todas las referencias se cargan en la misma pasada de generación, los personajes pueden interactuar naturalmente — apretones de manos, conversaciones, pasar objetos. Los modelos de referencia única requieren compositar clips separados para lograr esto.

Identidad consistente durante toda la duración

Las características faciales, tono de piel, peinado y ropa permanecen estables desde el fotograma 1 hasta el final del clip. Sin desviación de identidad a mitad del clip, incluso con cambios de ángulo de cámara u oclusiones parciales.

Tipos de referencia mixtos

Las referencias pueden ser retratos, fotos de cuerpo completo o ilustraciones estilizadas. HappyHorse extrae características de identidad independientemente del formato de la imagen de origen, aunque las fotos frontales con expresiones neutras producen los resultados más precisos.

Primeros pasos

Cómo usar

1

Abre Sunra Video y selecciona HappyHorse

Ve a Sunra Video y selecciona HappyHorse en el menú desplegable de modelos.

2

Sube tus imágenes de referencia

Haz clic en el área de subida de imágenes de referencia y añade de 1 a 9 imágenes. Cada imagen debe mostrar claramente el rostro de una persona — de frente, bien iluminada, con mínima oclusión. Etiqueta o anota el orden (person1, person2, etc.).

3

Escribe tu prompt usando tokens de personaje

Referencia cada imagen subida usando su token: [person1], [person2], etc. Describe la escena con acciones específicas para cada uno: *"[person1] se sienta en un escritorio tecleando mientras [person2] está de pie detrás señalando la pantalla. [person3] entra por la puerta llevando una carpeta."*

4

Configura duración y relación de aspecto

Elige la duración de tu clip y la relación de aspecto. Para escenas con múltiples personajes, 16:9 panorámico da más espacio para el posicionamiento de personajes. Duraciones más largas (8–10s) permiten interacciones más complejas.

5

Genera y revisa la consistencia de identidad

Haz clic en Generar y verifica que cada personaje coincida con su referencia a lo largo del clip. Si un personaje se desvía, prueba con una foto de referencia más clara con mejor iluminación o un ángulo más frontal.

Hecho para creadores

Ya seas creador independiente, agencia o marca, cada modelo se adapta a tu forma de trabajar.

F1 pit stop sequence

[person1] in a red racing suit leaps over the pit wall and changes the front-right tire while [person2] in a blue suit handles the rear-left tire. [person3] holds the lollipop sign and drops it as the car launches forward. Overhead camera, 16:9, 8 seconds.

Rollercoaster reality warp

[person1] and [person2] sit side by side in the front row of a rollercoaster. [person1] screams with arms raised while [person2] grips the bar and laughs. The track twists through a surreal neon portal. POV from the seat behind, 16:9, 6 seconds.

Bedroom explosion chaos

[person1] jumps on the bed launching pillows into the air while [person2] ducks behind the door and [person3] catches a flying blanket. Feathers drift everywhere, warm lamplight, handheld camera feel. 16:9, 10 seconds.

Copiar y usar

Plantillas de prompts

Conversación entre dos personas

[person1] and [person2] sit across from each other at a coffee shop table. [person1] gestures while speaking, [person2] nods and smiles. Warm afternoon light through the window. Shallow depth of field. 16:9, 8 seconds.

Modelo: HappyHorse · Referencias: 2 imágenes · Duración: 8s · Aspecto: 16:9

Presentación de equipo

[person1], [person2], [person3], and [person4] stand in a row in a modern office lobby. Each waves at the camera in sequence from left to right. Clean white background, professional attire. 16:9, 10 seconds.

Modelo: HappyHorse · Referencias: 4 imágenes · Duración: 10s · Aspecto: 16:9

Cena familiar

[person1] sits at the head of a dining table, [person2] and [person3] on either side, [person4] at the far end. [person1] raises a glass for a toast, others follow. Warm candlelight, rustic wooden table. 16:9, 10 seconds.

Modelo: HappyHorse · Referencias: 4 imágenes · Duración: 10s · Aspecto: 16:9

Demo de entrega de producto

[person1] in a lab coat hands a product box to [person2] in business casual. [person2] inspects the box and nods approvingly. Clean studio background, soft key light. 16:9, 6 seconds.

Modelo: HappyHorse · Referencias: 2 imágenes · Duración: 6s · Aspecto: 16:9

Para quién es

Casos de uso

Videos narrativos con múltiples personajes

Cortometrajes, series web y videos explicativos con un elenco recurrente. Sube las referencias de tus personajes una vez y genera escenas consistentes a lo largo de episodios — sin errores de continuidad entre tomas.

Animaciones de fotos de equipo y grupo

Convierte una foto de equipo corporativo en un video de presentación animada. Sube fotos individuales de cada miembro del equipo y crea una escena donde interactúan — saludando, dándose la mano o presentando juntos.

Videos familiares y de eventos

Genera videos personalizados familiares para festividades o celebraciones. Sube fotos de familiares y crea escenas como una cena familiar, una fiesta de cumpleaños o un paseo grupal en un parque — cada persona reconocible.

Consistencia de modelos para e-commerce

Las marcas de moda y lifestyle pueden mantener la misma identidad del modelo en múltiples videos de producto. Sube la referencia del modelo y genera videos de él/ella usando diferentes outfits en diferentes escenarios sin recontratar una sesión fotográfica.

Comparar

HappyHorse multi-referencia vs otros modelos

HappyHorse (1–9 referencias)Otros modelos
Máximo de imágenes de referencia9 imágenes por generación — cada una vinculada a un token de personaje separadoKling 3.0: 1 referencia. Veo 3.1: hasta 3 recursos. Seedance 2.0: 1–2 referencias
Interacción entre múltiples personajesTodos los personajes renderizados en una sola pasada — interacciones naturales entre personas referenciadasLos modelos de referencia única requieren generar personajes por separado y hacer compositing
Método de vinculación de identidadTokens con nombre ([person1]–[person9]) en los prompts — control explícito por personajeLa mayoría de los modelos usa una sola referencia implícita — sin forma de dirigir múltiples identidades
Calidad de escenas grupalesCada persona mantiene su identidad de referencia — sin mezcla de rasgos entre personajesLos modelos con 1 referencia a menudo mezclan los rasgos de los personajes secundarios con el principal
Casos de uso únicosReuniones de equipo, cenas familiares, eventos con múltiples personas con identidades realesLos modelos de referencia única son adecuados para contenido de personaje único o personas anónimas
Obtén los mejores resultados

Consejos y mejores prácticas

Usa fotos de referencia claras y frontales

La extracción de identidad funciona mejor con retratos frontales, bien iluminados o fotos de cintura para arriba. Los perfiles laterales, gafas de sol o sombras fuertes reducen la precisión de coincidencia. Una persona por imagen de referencia.

Comienza con 2–3 referencias antes de escalar

Más referencias aumentan la complejidad de generación. Comienza con 2–3 personajes para validar la estructura de tu prompt, luego añade más. Más allá de 5 personajes en una sola escena, el posicionamiento se vuelve más difícil de controlar con precisión.

Sé explícito sobre las posiciones de los personajes

Con múltiples personajes, las descripciones espaciales vagas llevan a composiciones abarrotadas o ambiguas. Especifica posiciones: "[person1] a la izquierda, [person2] en el centro, [person3] a la derecha."

Espera rendimientos decrecientes por encima de 6 referencias

Aunque HappyHorse soporta hasta 9 referencias, las escenas con 7–9 personajes dejan menos espacio visual por persona. La precisión de identidad sigue siendo alta, pero el detalle individual de los personajes disminuye a medida que el encuadre se llena más.

Comunidad

Amado por creadores en todo el mundo

Únete a miles de creadores, agencias y marcas que usan Sunra todos los días.

The quality jumped overnight

We switched our product video pipeline to Sunra last month. Kling 3.0 with native audio is genuinely usable for social ads now. Our team ships 30+ variations a week without touching After Effects.

MJ
Marcus Johansson
Head of Content, DTC Brand

Finally a tool my whole team can use

I'm technical, my co-founder isn't. She hops into Sunra, types a prompt, and gets a polished video in minutes. Canvas is the killer feature — we brainstorm visually and export straight to pitch decks.

PK
Priya Kapoor
Startup Founder

Cut our pre-production costs in half

We prototype every scene in Sunra before we shoot. Directors see framing, pacing, and mood before a single camera rolls. It's become essential to our pre-vis workflow.

JW
James Whitfield
Production Supervisor

Built our TikTok presence from zero

Brand new account, three videos a day, all on Sunra. Hit 50k followers in four months. The variety lets us test hooks constantly without burning out on production.

SC
Sofia Castellanos
TikTok Creator

Audio quality matches the visuals

Kling 3.0 audio finally feels coherent with the footage. No more awkward mismatched foley. I haven't opened my DAW for social cuts in a month.

TN
Theo Nakamura
Sound Designer

Documentary pre-vis breakthrough

Pre-visualizing reenactments and archival sequences used to cost us 15% of every doc budget. Sunra lets me block scenes for free, then shoot only what matters.

PV
Priya Venkatesan
Documentary Producer
Preguntas frecuentes

Preguntas y respuestas

¿Cuántas imágenes de referencia puede usar HappyHorse?
HappyHorse soporta de 1 a 9 imágenes de referencia por generación. Cada imagen se vincula a un token de personaje ([person1] a [person9]) que usas en tu prompt para controlar cada personaje independientemente.
¿Cómo funcionan los tokens de personaje en los prompts de HappyHorse?
Cuando subes imágenes de referencia, cada una se asigna a un token como [person1], [person2], etc. Usa estos tokens en tu prompt para referirte a personajes específicos: "[person1] le da la mano a [person2]." El modelo mapea cada token al rostro y apariencia de la referencia correspondiente.
¿Cómo se compara HappyHorse con Kling 3.0 para escenas con múltiples personajes?
Kling 3.0 solo soporta 1 imagen de referencia, lo que lo hace ideal para videos de un solo sujeto. HappyHorse soporta hasta 9 referencias, convirtiéndolo en la mejor opción para escenas con múltiples personajes identificables.
¿Qué tipo de fotos de referencia funcionan mejor?
Fotos frontales, bien iluminadas con una vista clara del rostro. Los retratos o fotos de cintura para arriba funcionan mejor. Evita gafas de sol, sombras fuertes o fotos con múltiples personas. Consulta las mejores prácticas para orientación detallada.
¿Todos los personajes mantienen consistencia durante todo el clip?
Sí. Cada personaje referenciado mantiene sus características faciales, tono de piel y peinado de principio a fin. La ropa de la referencia también se preserva a menos que describas explícitamente atuendos diferentes en el prompt.
¿Puedo usar multi-referencia con la edición video a video?
Sí. HappyHorse también soporta edición de video a video con hasta 5 imágenes de referencia. Puedes intercambiar personajes en un clip existente mientras mantienes el movimiento y la sincronización originales.
¿Es gratuito HappyHorse multi-referencia?
Los créditos diarios gratuitos en Sunra cubren las generaciones de HappyHorse incluyendo multi-referencia. Multi-referencia no tiene un cargo adicional. Consulta precios para cantidades de créditos de suscripción.
¿Qué pasa si dos imágenes de referencia son muy similares?
Si dos referencias comparten características similares (ej., hermanos), el modelo puede ocasionalmente mezclarlas. Usa referencias con peinados, formas de rostro o ropa distintos para ayudar al modelo a diferenciar. Describe explícitamente las características distintivas en el prompt.

¿Listo para crear?

Comienza con créditos diarios gratuitos. No se requiere tarjeta de crédito.