Cómo escribir prompts para video con IA que realmente funcionen: un marco de 5 dimensiones

Ana

Los generadores de video con IA pueden transformar una breve descripción en una escena en movimiento, pero un prompt impreciso a menudo genera un resultado poco definido. El sujeto puede verse bien en el primer fotograma y luego deformarse, la cámara puede quedarse inmóvil o varias acciones pueden agruparse en un único movimiento confuso.

La solución no consiste en llenar el prompt con más adjetivos. Un mejor enfoque es redactar un informe de plano conciso: definir qué aparece en pantalla, qué cambia, cómo lo observa la cámara y qué detalles deben mantenerse estables. Esta guía explica cómo escribir prompts para la generación de video con IA mediante una estructura de cinco dimensiones, ejemplos de video reales, plantillas listas para copiar y un flujo de trabajo sencillo para revisiones.

¿Qué hace que un prompt de video con IA funcione?

Un prompt eficaz de video con IA le asigna al modelo una tarea visual clara. Identifica el sujeto principal, describe una acción visible, sitúa esa acción en un entorno específico, dirige la cámara y define el aspecto visual del plano.

Prompt débil:

A beautiful woman walking in a cinematic city.

Esto deja abiertas varias decisiones importantes. ¿Cómo es la mujer? ¿Camina hacia la cámara o alejándose de ella? ¿La cámara es estática o está en movimiento? ¿Qué ciudad, qué momento del día y qué iluminación debe usar el modelo?

Prompt más sólido:

A young woman with short dark hair, a black leather jacket, and dark trousers walks slowly through a rain-soaked Tokyo street, then turns toward the camera. Medium side-tracking shot with a gentle forward push. Wet pavement reflects blue and pink neon, with light mist in the air. Realistic 35mm film look, low-saturation colors, soft neon side light, 8 seconds.

cómo escribir prompts para video con IA.jpg

La segunda versión le proporciona al generador un sujeto, una acción, un entorno, la dirección de cámara, el tratamiento visual y la duración. No garantiza un resultado perfecto, pero reduce drásticamente las conjeturas necesarias.

Las cinco dimensiones de un prompt de video con IA

Utiliza el siguiente orden como punto de partida:

[Subject] + [Action] + [Setting] + [Camera] + [Style and Lighting]

prompts de generación de video con IA.jpg

Para obtener un prompt listo para producción, añade los parámetros de salida al final:

[Duration] + [Aspect Ratio] + [Audio] + [Continuity Rules]

Las cinco dimensiones describen el contenido creativo del plano. La duración, el formato, el sonido y la continuidad son restricciones de soporte que facilitan el uso del resultado.

1. Sujeto: define lo que debe ver el espectador

Comienza con la persona, producto, animal u objeto principal. Utiliza los detalles que realmente importen para el plano en lugar de describir todo lo que puedas imaginar.

Para una persona, los detalles útiles pueden incluir:

  • edad aproximada;
  • cabello, vestimenta y accesorios;
  • postura corporal o expresión facial;
  • rasgos de identidad que deben mantenerse constantes.

Para un producto, describe:

  • forma y material;
  • color y acabado;
  • ubicación de la etiqueta o del embalaje;
  • el ángulo desde el que debe mostrarse.

Compara estas dos descripciones:

A woman
A short-haired woman in a charcoal wool coat, cream scarf, and brown leather gloves

La segunda versión le da al modelo una identidad visual que puede repetirse en planos posteriores. Para un personaje recurrente, copia la descripción clave palabra por palabra en todos los prompts en lugar de reescribirla con nuevos sinónimos cada vez.

2. Acción: describe un cambio principal a lo largo del tiempo

El video necesita un verbo. El prompt de una imagen fija puede describir a un sujeto de pie en una habitación, pero un prompt de video debe explicar qué cambia durante el clip.

Las buenas acciones son físicas y visibles:

  • sirve café en una taza de cerámica;
  • gira lentamente hacia la ventana;
  • deposita un barco de papel sobre el agua;
  • abre una laptop y presiona una tecla;
  • camina a través de la nieve que cae.

Evita comprimir una historia completa en un solo clip corto. «Abre la puerta, cruza la calle corriendo, sube a un auto y se marcha» contiene varios planos. Divídelo en prompts independientes o utiliza un guion gráfico temporizado cuando la herramienta admita secuencias más largas.

Puedes añadir un pequeño movimiento secundario para darle vida al plano:

The woman walks slowly along the pier while her scarf moves gently in the wind.

La acción principal es caminar. El movimiento de la bufanda la complementa sin competir por la atención.

3. Entorno: dale a la acción un lugar creíble

Términos como «una oficina» o «un bosque» suelen ser demasiado amplios. Añade los detalles que influyen en la atmósfera y la composición:

  • ubicación;
  • momento del día;
  • clima;
  • elementos en primer plano y de fondo;
  • texturas visibles;
  • movimiento en segundo plano.

Ejemplo:

A quiet ceramic studio at dawn, with wooden shelves, pale clay bowls, a large north-facing window, and soft dust floating in the sunlight.

No es necesario describir cada objeto de la habitación. Selecciona detalles que ayuden al modelo a comprender el lugar y que el espectador pueda ver claramente.

4. Cámara: explica cómo se rueda el plano

El lenguaje cinematográfico convierte una escena en un plano dirigido. Incluye el encuadre, el ángulo, el movimiento y la velocidad cuando sean relevantes.

Términos de encuadre habituales:

  • primerísimo primer plano;
  • primer plano;
  • plano medio;
  • plano general;
  • plano cenital;
  • plano aéreo.

Términos de movimiento habituales:

  • plano estático fijo;
  • travelling de aproximación lento;
  • travelling de alejamiento;
  • panorámica de izquierda a derecha;
  • plano de seguimiento;
  • plano orbital;
  • elevación con grúa;
  • seguimiento cámara en mano.

Utiliza un movimiento de cámara principal por cada clip corto. Por ejemplo:

Macro close-up with a slow push-in toward condensation forming on the glass bottle.

Esto es mucho más práctico y accionable que «haz que el plano del producto sea dinámico». Si el sujeto también se desplaza, describe ambos movimientos por separado:

The cyclist moves from left to right while the camera tracks alongside at a steady pace.

5. Estilo e iluminación: define el tratamiento visual

El estilo le indica al modelo el acabado visual que debe tener el metraje. La iluminación le indica cómo debe iluminarse la escena. Son aspectos relacionados, pero constituyen instrucciones diferentes.

Direcciones de estilo útiles:

  • metraje documental realista;
  • anuncio comercial de producto limpio;
  • animación artesanal con recortes de papel;
  • aspecto de película de 35 mm con tonos apagados;
  • animación en stop-motion;
  • anime con sombreado plano (cel-shaded);
  • metraje UGC grabado con teléfono móvil.

Direcciones de iluminación útiles:

  • luz matutina cálida que entra por la ventana;
  • luz diurna fría de un día nublado;
  • contraluz intenso al atardecer;
  • luz lateral tenue de neón;
  • un único foco cenital;
  • luz de velas con sombras profundas.

Sustituye las frases abstractas por cualidades visibles. En lugar de «atmósfera cinematográfica de alto nivel», prueba con «contraluz suave, movimiento de cámara contenido, profundidad de campo reducida y colores cálidos y apagados».

Controles de soporte: duración, formato, audio y continuidad

Las cinco dimensiones construyen el plano. Los siguientes controles ayudan a que el plano encaje en un proyecto real.

Duración y relación de aspecto

Indica la duración deseada cuando el modelo lo admita y elige la relación de aspecto que coincida con el destino:

  • 16:9 para video horizontal y paisajes cinematográficos;
  • 9:16 para video vertical en redes sociales;
  • 1:1 para publicaciones cuadradas en redes sociales.

Si la herramienta ofrece la duración y la relación de aspecto como controles independientes, utiliza primero esos ajustes y mantén el prompt centrado en la dirección creativa.

Audio y diálogos

Si el modelo admite audio nativo, describe el sonido que realmente deseas:

Natural café ambience, soft cup and spoon sounds, distant conversation, no music.

Para los diálogos, escribe las palabras exactas entre comillas e identifica a quien habla. Mantén la frase lo suficientemente corta como para que encaje en el clip. Si no deseas voz ni subtítulos, indícalo únicamente cuando el modelo admita ese tipo de restricciones.

Reglas de continuidad

Cuando un personaje o producto aparezca en varios planos, repite los detalles que no deben cambiar:

Keep the same face, hairstyle, cream sweatshirt, product shape, label position, and warm color palette throughout the sequence.

En el caso de imagen a video, concéntrate en qué debe moverse y qué debe permanecer fijo. La imagen de origen ya aporta gran parte de la composición, por lo que el prompt por lo general no necesita repetir cada detalle visual.

Los prompts de texto a video y de imagen a video son diferentes

En texto a video, se le pide al modelo que construya la escena a partir de palabras. Incluye el sujeto, el entorno, la acción, la cámara, la iluminación y el estilo.

En imagen a video, se parte de una referencia visual existente. Concéntrate en el movimiento, el comportamiento de la cámara y la estabilidad:

Animate the supplied product image with a slow push-in. Add a subtle highlight moving across the glass and a shallow background parallax. Keep the bottle shape, label, color, and position unchanged. Avoid extra products, packaging distortion, and unreadable text.

cómo escribir prompts para imagen a video y texto a video.jpg

La frase «anima esta imagen» suele ser demasiado vaga. Indícale al modelo qué cambia y qué no.

Ejemplos reales de video con IA y qué nos enseñan

Los siguientes ejemplos se basan en casos destacados de la biblioteca de prompts de GoEnhance. Se incluyen los videos para que puedas comparar las instrucciones escritas con el movimiento obtenido. Las páginas de origen activas y las URL de los videos se verificaron el 26 de agosto de 2026; las páginas de origen pueden cambiar con el tiempo.

Para ver más ejemplos específicos de cada modelo, explora los prompts de Seedance 2.0, los prompts de Grok Imagine y la colección más amplia de prompts de video.

Ejemplo 1: un videoblog rural de baja fidelidad (lo-fi)

Caso de uso: video de estilo de vida tipo documental.

Seedance 2.0 slice-of-life vlog, 15 seconds, 16:9. Preserve the same woman’s face, hairstyle, skin tone, and body proportions. She wears an oversized olive linen shirt, dusty burgundy wide-leg trousers, brown sandals, and small gold hoops. Set the video in an authentic Korean rural village with mossy walls, hanok roofs, ceramic jars, roosters, cooking smoke, and overgrown paths. Use a late-2000s flip-camera look: heavy handheld shake, imperfect reframing, autofocus hunting, exposure swings, rolling shutter, motion blur, faded muddy colors, digital noise, and compression artifacts. She walks, splashes water on her face, feeds a stray dog, sips from a tin cup, then waves as the recording cuts off. No posing, glamour, stabilization, music, or modern grading. Include birds, roosters, footsteps, wind, water, and village ambience.

Este prompt es deliberadamente específico sobre la época visual, las imperfecciones de la cámara, la vestimenta, el entorno, la secuencia de acciones y el sonido. Demuestra que «realista» no siempre significa limpio o pulido; el lenguaje de cámara deseado puede incluir defectos cuando forman parte del estilo.

Ejemplo 2: un plano de descubrimiento de ciencia ficción

Caso de uso: narrativa cinematográfica de ciencia ficción.

Create a cinematic sci-fi short with a lonely, contemplative tone that gradually shifts into quiet wonder. A damaged exploration robot moves through a desaturated alien landscape of dusty earth and grey rock under overcast daylight. Use one glowing blue accent in the robot’s chest. Begin with macro close-ups of scratched metal and slow mechanical movement, then track behind the robot as it discovers a tiny living plant inside a collapsed research station. Push in slowly while dust floats through the beam of light. Use 35mm cinematography, restrained camera movement, realistic surface texture, soft atmospheric haze, and a quiet electronic score. End on the robot reaching toward the plant. No comedy, no fast cuts, no extra characters, no flicker.

La lección clave es la progresión emocional. El prompt no se limita a enumerar objetos; explica cómo el plano pasa del aislamiento al asombro y le proporciona al modelo un final claro.

Ejemplo 3: un comercial de comida

Caso de uso: publicidad de productos y contenido gastronómico.

Create a premium food commercial featuring a freshly grilled burger on a dark wooden table. Begin with a macro close-up of melted cheese and crisp lettuce, then slowly orbit around the burger as steam rises from the toasted bun. Warm side lighting creates soft highlights on the ingredients, with a shallow depth of field and a rich but natural color grade. Add subtle restaurant ambience and a gentle sizzle. End with a clean hero shot centered on the burger, leaving empty space on the right for a short CTA. Keep the burger shape and ingredient layers consistent. No extra burgers, distorted food, unreadable text, or sudden cuts.

Este ejemplo añade una composición final en lugar de dejar que el clip termine de forma aleatoria. Esto es fundamental en publicidad, ya que el último fotograma a menudo debe admitir un logotipo, el nombre del producto o una llamada a la acción durante el montaje.

Ejemplo 4: un plano de producto con movimiento controlado

Caso de uso: marketing de productos tecnológicos o de estilo de vida.

Create a sleek cyberpunk product commercial featuring matte black wireless earbuds in an open charging case on a reflective metal surface. Use a slow orbital camera move while thin blue and violet light strips pass across the case. Macro close-up, shallow depth of field, crisp material texture, controlled reflections, and a dark futuristic color palette. Add a quiet electronic pulse and a soft mechanical click as the case opens. End with the earbuds centered in a clean hero composition. Keep the case shape, earbud position, and branding consistent. Avoid extra products, warped reflections, and invented text.

El producto sigue siendo la prioridad. Las luces en movimiento aportan dinamismo, pero el prompt no le pide al producto que gire, se abra, se transforme y vuele al mismo tiempo.

Plantillas de prompts de video con IA listas para copiar

Utiliza estas plantillas como punto de partida. Sustituye los campos entre corchetes y elimina cualquier instrucción que no corresponda a tu plano.

Plantilla 1: escena cinematográfica de personaje

Create a [duration] [aspect ratio] [visual style] featuring [subject description]. The scene takes place in [location] during [time of day and weather]. [Subject] [one primary action]. Use a [shot type] with [camera movement and speed]. Add [lighting, color palette, and texture]. Include [sound or dialogue] if needed. End with [final image]. Keep [identity, outfit, and important props] consistent. Avoid [specific failure modes].

Plantilla 2: comercial de producto

Create a [duration] commercial for [product]. Begin with [opening shot] that shows [material, texture, or feature]. Then [one product action or use case] with [camera movement]. Use [lighting, color, and visual style]. End with a clean hero composition of [product], leaving space for [logo or CTA]. Keep the product shape, color, label, and branding consistent. Avoid [extra objects, distorted packaging, or invented text].

Plantilla 3: animación de imagen a video

Animate the supplied image with [camera movement]. Make [specific subject or environmental element] move slowly and naturally. Add [secondary motion such as wind, light, steam, or water]. Keep [face, clothing, product shape, label, composition, and colors] unchanged. Use [style and lighting]. Duration: [duration]. Avoid [warping, flicker, extra objects, and unwanted text].

Plantilla 4: video UGC para redes sociales

Create a natural [duration] vertical UGC video featuring [creator] in [location]. 0–[x] seconds: [hook]. [x]–[y] seconds: [demonstration or transformation]. [y]–[end] seconds: [reaction and CTA]. Use phone-camera handheld movement, realistic lighting, natural speech, and authentic ambient sound. Keep [product, clothing, and creator identity] consistent. Avoid forced acting, studio polish, random subtitles, and label changes.

Plantilla 5: transformación animada

Create a [duration] [animation style] transformation. Begin with [starting object or scene]. Gradually transform it into [final object or scene] through [specific visible steps]. Keep the transformation centered and continuous. Use [camera movement], [texture], [lighting], and [sound]. End on [final pose, product, or logo]. Avoid abrupt cuts, random characters, flicker, and style changes.

Errores comunes en los prompts de video con IA y soluciones prácticas

Error 1: acumular adjetivos en lugar de dirigir un plano

Palabras como «hermoso», «épico» y «de alta calidad» no le dicen al modelo qué poner en movimiento. Sustitúyelas por decisiones concretas sobre el encuadre, el movimiento, la luz y la textura.

Error 2: solicitar varias acciones no relacionadas

Divide una secuencia en planos. Un clip de seis segundos es más fácil de controlar cuando contiene un único momento clave, como «la mujer gira hacia la ventana», en lugar de toda una rutina matutina.

Error 3: olvidarse de la cámara

Si la cámara es importante, especifícala. Un plano fijo puede ser una elección deliberada, pero no mencionar la cámara deja que el modelo elija por ti.

Error 4: describir únicamente el sujeto y no el cambio

«Un perro en un parque» describe un fotograma. «Un golden retriever corre por el césped húmedo mientras la cámara lo sigue lateralmente» describe un video.

Error 5: usar instrucciones negativas imprecisas

«No lo hagas mal» no aporta nada útil. Nombra el problema que deseas evitar: «Mantén la etiqueta legible y la forma de la botella inalterada». Además, algunos modelos responden mejor a indicaciones positivas del estado deseado, como «movimiento de cámara fluido y estable» en lugar de «sin temblor de cámara». Comprueba la redacción según el modelo que estés utilizando.

Error 6: pretender que el texto del prompt controle todos los ajustes técnicos

La resolución, la duración, la relación de aspecto, la semilla y los controles de cámara pueden estar disponibles en la interfaz de la herramienta. Utiliza esos controles cuando existan y mantén el prompt centrado en la dirección visual.

Cómo corregir una generación fallida

Considera la primera generación como una pasada de diagnóstico. Identifica el fallo principal y modifica únicamente una variable.

  1. Si el sujeto cambia, reafirma su identidad visual y elimina detalles innecesarios.
  2. Si la acción resulta confusa, reduce el clip a un solo verbo principal.
  3. Si la cámara parece plana, añade un movimiento y una velocidad específicos.
  4. Si el fondo resulta caótico, retira objetos secundarios y simplifica el entorno.
  5. Si el producto se deforma, añade una regla de continuidad y utiliza una imagen de referencia si está disponible.
  6. Si la atmósfera no es la adecuada, ajusta la descripción de la iluminación y del color en lugar de reescribir todo el prompt.
  7. Si el final es inservible, describe la composición final explícitamente.

Modificar una sola variable a la vez permite aprender qué instrucciones sigue el modelo de manera confiable. Guarda la mejor versión como tu nuevo prompt base en lugar de empezar desde cero tras cada intento.

Lo que la mayoría de las guías de prompts de video con IA pasan por alto

Tener una fórmula es útil, pero contar con un flujo de trabajo reproducible tiene más valor que una larga lista de palabras clave. Aplica estas prácticas para lograr resultados más consistentes:

  • Muestra la versión fallida y la versión corregida para que el cambio sea comprensible.
  • Separa el movimiento del sujeto, el de la cámara y el del entorno.
  • Trata cada prompt como un único plano y luego une varios planos durante la edición.
  • Repite los detalles del personaje, el vestuario, el producto y el color en los prompts relacionados.
  • Adapta el prompt al objetivo: los anuncios de productos necesitan un embalaje estable, mientras que los videoblogs lo-fi pueden requerir imperfecciones intencionales de cámara en mano.
  • Termina los clips comerciales y para redes sociales con una composición aprovechable en lugar de un corte accidental.
  • Lleva un pequeño registro de prompts que incluya el modelo, los ajustes, la redacción que funcionó y el error que corregiste.

Estas prácticas hacen que el prompt sea más fácil de revisar y reutilizar. También evitan un error muy común: añadir más palabras cuando el verdadero problema es que el plano contiene demasiadas instrucciones en conflicto.

Un plan de práctica sencillo para principiantes

No necesitas empezar con una historia compleja. Practica la estructura con planos cortos y fáciles de evaluar.

Ejercicio 1: sujeto y acción

Escribe cinco prompts utilizando la misma estructura:

[Subject] performs [one visible action].

Modifica únicamente el sujeto y la acción. Esto te ayudará a comprobar si el modelo comprende el verbo.

Ejercicio 2: añade entorno y cámara

Mantén la misma acción y prueba con tres ubicaciones y tres movimientos de cámara. Compara qué combinaciones generan el movimiento más claro.

Ejercicio 3: añade micromovimiento y continuidad

Añade un movimiento ambiental, como viento, vapor, agua o polvo flotando. Luego añade una regla de continuidad para el rostro, la ropa, el producto o el objeto de atrezo.

Ejercicio 4: modifica una sola variable

Genera dos versiones del mismo prompt. Cambia únicamente la cámara, la iluminación o la acción. Toma notas sobre qué mejoró y qué perdió estabilidad.

Lista de verificación final antes de generar

Hazte estas preguntas antes de gastar otro renderizado:

  1. ¿Es el sujeto principal lo bastante específico como para reconocerlo?
  2. ¿Contiene el prompt una acción principal clara?
  3. ¿El entorno es visible y concreto?
  4. ¿Tiene la cámara una instrucción clara de encuadre o movimiento?
  5. ¿La iluminación y el estilo visual son concretos en vez de genéricos?
  6. ¿Has configurado la duración y la relación de aspecto donde corresponde?
  7. ¿Has incluido audio o diálogos únicamente cuando son necesarios?
  8. ¿Indicaste qué elementos deben mantenerse constantes?
  9. ¿Tiene el momento final una composición aprovechable?
  10. Si el prompt falla, ¿sabes qué única variable cambiar a continuación?

Preguntas frecuentes

¿Qué extensión debe tener un prompt de video con IA?

La suficiente para describir el plano con claridad, pero lo bastante breve para mantener las instrucciones enfocadas. Un párrafo compacto o un conjunto estructurado de oraciones suele ser más fácil de revisar que un bloque largo de adjetivos inconexos.

¿Cuántas acciones debe incluir un solo prompt de video con IA?

Utiliza una acción principal para un clip corto. Si el sujeto debe completar varias acciones importantes, divide la idea en múltiples planos o diseña primero un plan de escena temporizado.

¿Se deben escribir los prompts de video con IA en inglés?

Depende del modelo. Muchas herramientas aceptan varios idiomas, pero los factores más determinantes son el uso de sustantivos específicos, verbos visibles, instrucciones de cámara claras y una estructura estable. Prueba el idioma que ofrezca los resultados más predecibles en la herramienta que elijas.

¿Son necesarios los prompts negativos para la generación de video con IA?

Pueden ayudar ante fallos concretos, pero su efectividad varía según el modelo. Comienza describiendo claramente el resultado deseado y luego añade restricciones precisas, como mantener inalterada la etiqueta de un producto o evitar objetos adicionales, siempre que la herramienta admita esa instrucción.

¿Puedo usar el mismo prompt en todas las herramientas de video con IA?

La estructura de cinco dimensiones se adapta muy bien, pero cada modelo puede interpretar los términos de cámara, las instrucciones de audio, la duración y las restricciones negativas de manera diferente. Considera un prompt multiplataforma como punto de partida y ajústalo tras hacer pruebas.

¿Un prompt más largo es siempre mejor?

No. Los detalles adicionales solo ayudan cuando clarifican algo visible o relevante para el plano. Si el prompt exige demasiados sujetos, acciones, estilos y movimientos de cámara al mismo tiempo, las instrucciones pueden entrar en conflicto entre sí.

Conclusión

La forma más confiable de redactar prompts para la generación de video con IA es pensar como un director que escribe un informe de plano conciso. Define el sujeto, una acción clara, el entorno, la cámara y el tratamiento visual. Luego añade únicamente las reglas de duración, formato, sonido y continuidad que el proyecto realmente requiera.

Comienza con un solo plano, evalúa el resultado y modifica una variable a la vez. La lógica visual clara es mucho más útil que una acumulación de palabras clave genéricas, y una pequeña biblioteca de prompts probados ganará valor con cada nueva generación.