Guía · Audiovisual · Básico · Generación
Video UGC de tu producto: un influencer que lo reseña hablando a cámara (10s)
Convierte una foto de tu producto en un video UGC de 10 segundos: un influencer creado con IA lo sostiene y lo reseña hablando a cámara, con voz en español. Solo subes la foto y copias los prompts.
¿Qué es esto y cómo lo uso?
Una guía paso a paso. Síguela de arriba hacia abajo desde tu celular; no descargas nada.
Objetivo
Un video UGC de 10 segundos donde un influencer creado con IA sostiene tu producto y lo reseña hablando a cámara, con voz en español mexicano. Partes de una sola foto de tu producto y copias los prompts.
Lo que necesitas antes de empezar
- Una cuenta de ChatGPT — ahí subes tu producto y creas a los influencers.
- Una cuenta de Google Flow con el modelo Omni Flash — la herramienta de Google que convierte una imagen en video.
- Una buena foto de tu producto, de frente, con buena luz y el nombre bien visible. Esta foto es el 80% del resultado.
Paso 1 — Sube la foto de tu producto a ChatGPT
Abre ChatGPT y sube la foto de tu producto. Con eso ChatGPT ya "entiende" cómo se ve tu producto antes de crear a los influencers.

Paso 2 — Pide 5 ideas y una imagen con 6 influencers
Un solo prompt hace dos cosas: te da 5 ideas de guion (de 10 segundos, entre 22 y 28 palabras) y crea una imagen con 6 influencers distintos sosteniendo tu producto, estilo UGC, sin textos y numerados. Así eliges cara, estilo y guion de una vez.
Ver el prompt completo ↓Plegar el prompt ↑
$ Quiero crear un video UGC tipo reseña, de personaje hablando a cámara con el producto, dime 5 ideas, debe ser adecuado solo para 10 segundos de video, entre 22 y 28 palabras.
Crea una imagen de 6 cuadros donde aparezca en cada uno, un influencer distinto con el producto, estilo UGC, SIN TEXTOS.
Tamaño standard de labial de mujer, coloca la numeración de cada cuadro
Paso 3 — Elige tu influencer y pídela en vertical
Mira los 6 cuadros y elige el que más te guste. En el ejemplo elegimos el 5. Pídele a ChatGPT que lo recree en formato vertical (9:16) y sin el número. Cambia el 5 por el número que tú elegiste.
$ Elijo la imagen 5, creala en formato 9:16, sin el númeroPaso 4 — Pídele a ChatGPT el prompt para animar
En vez de escribirlo tú, deja que ChatGPT te arme el prompt de animación a la medida de tu influencer. Este prompt le pide el timeline exacto (un cambio cada 2 segundos) en inglés, con el diálogo en español.
Ver el prompt completo ↓Plegar el prompt ↑
$ Crea un PROMPT COMPLETO ADECUADO PARA ANIMAR LA IMAGEN ANTERIOR para un video TIPO DINAMICO de 10 segundos Y QUE LO PUEDA HACER CON GEMINI OMNI FLASH O SEEDANCE. NO GENERES IMAGEN, Quiero que la chica hable a la cámara con acento mexicano español y diga copy publicitario (Solo para 10 segundos) entregame PROMPT COMPLETO PARA COPIAR Y PEGAR con exactamente el timeline exacto de animación de cada cuadro con cambios cada 2 segundos, debe ser en inglés y diálogo en español.ChatGPT te devuelve un prompt en inglés listo para animar. Cópialo para el Paso 6.
Paso 5 — Así se ve el prompt de animación (ejemplo)
Este es el prompt que salió en el ejemplo. El tuyo será parecido, pero con tu producto y tu copy. Guárdalo de referencia para ver cómo queda uno bien hecho.
Ver el prompt completo ↓Plegar el prompt ↑
$ Create a dynamic 10-second vertical UGC beauty advertisement using the provided reference image as the exact first-frame visual reference.
FORMAT:
9:16 vertical, 1080 × 1920, 24–30 fps, exactly 10 seconds.
SUBJECT AND PRODUCT CONSISTENCY:
Preserve the woman's identity, facial features, fair skin, long natural red hair, green eyes, cream knitted sweater, gold earrings, makeup, hands and manicure. Keep the lipstick identical to the reference image: realistic feminine lipstick size, transparent rectangular container, dusty-rose formula and rose-gold cap. The product must remain sharp, correctly proportioned and free from visual distortions. Do not alter the logo, packaging, fingers or number of fingers.
PERFORMANCE:
The woman speaks directly to the camera with natural confidence, warmth and spontaneous UGC energy. Native Mexican Spanish accent, conversational delivery, subtle enthusiasm and precise lip synchronization. Natural blinking, breathing, eyebrow movement and small head gestures. She keeps eye contact with the lens. Her movements should feel authentic rather than choreographed.
CAMERA AND STYLE:
Handheld smartphone UGC aesthetic with controlled micro-movements, natural window lighting, realistic skin texture, shallow depth of field and quick dynamic reframing. Use smooth visual continuity between shots. No artificial beauty filter, excessive skin smoothing, cinematic black bars or dramatic commercial lighting.
EXACT TIMELINE:
0.0–2.0 seconds:
Medium close-up matching the reference image. She holds the lipstick beside her face, looks into the lens and slightly raises her eyebrows. Add a gentle handheld push-in.
Dialogue: "Este labial mate me sorprendió:"
2.0–4.0 seconds:
Quick cut to a tighter close-up. She rotates the product slightly toward the camera so the packaging and color remain visible. Her expression becomes pleasantly impressed.
Dialogue: "se siente ligero, suave"
4.0–6.0 seconds:
Cut to an extreme close-up of her lips and lower face. She smiles slightly and turns her face a few degrees to show the velvety matte finish. Keep the lipstick visible near her chin.
Dialogue: "y deja mis labios"
6.0–8.0 seconds:
Return to a medium close-up. She gently taps one finger near her lips, then presents the product closer to the lens without covering her face.
Dialogue: "con apariencia más lisa"
8.0–10.0 seconds:
Fast, smooth pull-back to the original framing. She gives a confident closed-lip smile, nods once and holds the lipstick upright beside her cheek for the final product shot.
Dialogue: "y un color precioso."
FULL SPOKEN DIALOGUE:
"Este labial mate me sorprendió: se siente ligero, suave y deja mis labios con apariencia más lisa y un color precioso."
AUDIO:
Clean close-mic smartphone voice recording. Native young adult Mexican female voice. Natural room tone at very low volume. Soft modern beauty-style background music without vocals, kept beneath the dialogue.
NEGATIVE CONSTRAINTS:
No captions, subtitles, written text, graphic overlays, transitions with flashes, extra objects, product duplication, warped packaging, changing lipstick color, altered clothing, facial morphing, frozen expressions, exaggerated gestures, lip-sync errors, robotic voice, European Spanish accent or background people.Paso 6 — Anima en Google Flow
Configura Flow así antes de escribir nada:
- Modo: Ingredientes
- Formato: 9:16 (vertical)
- Cantidad: x1
- Modelo: Omni Flash
- Duración: 10 s
Ahora sube la imagen vertical de tu influencer (la del Paso 3), pega el prompt que te dio ChatGPT (el del Paso 5) y dale generar. En un par de minutos tienes tu video con voz y sonido natural:
Si no te salió a la primera
- El producto no se ve igual que en tu foto. Casi siempre es la foto. Úsala de frente, con el nombre visible y buena luz.
- El influencer cambia de cara entre tomas. En el Paso 3 pídele mantener "la misma persona, cara, peinado y ropa" al pasarla a vertical.
- La voz no cuadra con los labios. Respeta los bloques de 2 segundos y usa frases cortas (el diálogo completo cabe en 10 segundos).