Has escrito "dog running on the beach" en una herramienta de vídeo con IA, le has dado a generar y has visto el resultado con una sensación de decepción. El perro se parece más o menos a un perro. La playa se parece más o menos a una playa. Las patas se doblan al revés. No hay sonido. Cierras la pestaña y te dices que volverás luego. ¿Te suena? El problema no es el modelo. Es el prompt, y la solución es la misma en todas las herramientas de vídeo con IA disponibles hoy.
Qué hacen realmente estas herramientas
Un generador de vídeo con IA toma tu texto, llamado prompt (la instrucción que escribes para la IA), y produce un clip de vídeo corto. La mayoría de los modelos actuales de esta categoría hacen una de dos cosas: generan vídeo directamente a partir de texto, o toman una imagen de referencia y la animan.
Algunos lanzamientos recientes también generan audio nativo, es decir, la herramienta incorpora sonido, voz o música directamente en el clip, en lugar de dejarte un vídeo en silencio para que le añadas música después. Otras siguen produciendo vídeo sin sonido y esperan que añadas el audio en un editor aparte. Consulta la documentación de tu herramienta para saber cuál tienes.
Ese detalle importa para tu prompt: si tu herramienta puede generar audio, el bloque de "audio" que verás abajo se convierte en una palanca real. Si no, puedes simplemente saltarlo.
La fórmula de seis bloques
Un prompt útil para vídeo con IA suele cubrir seis bloques. No necesitas un lenguaje rebuscado: un inglés sencillo funciona bien. Rellena cada bloque y notarás la diferencia de inmediato.
- Sujeto: quién o qué aparece en la toma ("a golden retriever")
- Acción: qué está haciendo ("running through shallow water")
- Entorno: dónde sucede ("a quiet beach at sunrise")
- Cámara: cómo se filma ("low angle, close to the water, tracking the dog from the side")
- Movimiento: cómo se mueven las cosas ("steady, smooth, slow motion at 50% speed")
- Audio: qué escuchamos ("gentle waves, soft wind, no music"); inclúyelo solo si tu herramienta lo admite
Compara el "dog running on the beach" original con la versión rellenada. Misma idea, mucho más con lo que trabajar.
Paso 1 — Abre tu herramienta de vídeo con IA y empieza un proyecto nuevo
Elige la herramienta de vídeo con IA a la que tengas acceso (opciones habituales son Runway, Pika, Kling, Luma y otras integradas en plataformas como Adobe Firefly). Ábrela en tu navegador o app y busca un botón o campo que diga algo como "Generate", "Create" o "New video".
Púlsalo y normalmente acabarás en una pantalla con una caja de texto para tu prompt. Algunas herramientas también ofrecen un campo para subir una imagen al lado.
Sabrás que ha funcionado cuando veas una caja de texto vacía (y, posiblemente, una zona de subida) esperando tu prompt.
Paso 2 — Rellena los tres primeros bloques
Escribe una frase que cubra el sujeto, la acción y el entorno. Estos tres le dan al modelo lo básico: quién, haciendo qué y dónde.
💬 Ejemplo: "A barista in a small coffee shop, pouring latte art into a cup, warm morning light coming through the window."
No te preocupes aún por la cámara ni el movimiento: fija primero la escena. Si la composición básica sale mal, ningún detalle de cámara lo arreglará.
Sabrás que ha funcionado cuando puedas leer tu prompt en voz alta y otra persona pueda dibujar la escena solo con tus palabras.
Paso 3 — Añade los bloques de cámara y movimiento
Cuando lo básico se vea bien, añade cómo se filma la toma y cómo se mueven las cosas. Aquí es donde la mayoría de clips de principiante quedan planos: el prompt describía lo que había en el encuadre pero no decía nada sobre cómo se comportaba la cámara.
💬 Ejemplo: "Close-up on the hands and cup, slow smooth motion."
Elige un estilo de cámara por clip. Mezclar "tracking shot" con "static wide" en el mismo prompt suele confundir al modelo.
Sabrás que ha funcionado cuando tu clip tenga una sensación de dirección o ritmo, no solo un encuadre fijo.
Paso 4 — Añade audio si tu herramienta lo admite
Algunas herramientas actuales generan audio de forma nativa; muchas todavía no. Si la tuya lo hace, describe lo que debería oírse. Si no, sáltate este bloque: el modelo lo ignorará o te dará un error.
💬 Ejemplo: "Gentle cafe background sounds and a soft espresso machine hiss."
Si tu herramienta produce vídeo en silencio, siempre puedes añadir sonido después en un editor gratuito como CapCut, DaVinci Resolve o incluso las herramientas de audio dentro de Canva.
Sabrás que ha funcionado cuando veas el clip con el sonido activado y el audio coincida con la escena.
Paso 5 — Genera, mira y cambia un solo bloque
Pulsa generar, mira el resultado y, si no está bien, no reescribas el prompt entero. La forma más rápida de mejorar es cambiar un bloque cada vez entre intentos. Cambia el ángulo de cámara, reduce el movimiento, cambia la palabra de iluminación en el entorno… y regenera.
Este único hábito ahorra más tiempo que cualquier otro consejo sobre prompts.
Sabrás que ha funcionado cuando puedas señalar el nuevo clip y decir qué bloque ha producido la diferencia que ves.
Paso 6 — Guarda el prompt que funcionó
Cuando consigas un clip que te guste, copia el prompt completo en un archivo de notas o una hoja de cálculo. Ponle nombre según la escena ("coffee-barista-v3"). La próxima vez que necesites un clip similar, no estarás empezando desde una caja de texto en blanco: estarás retocando un ganador.
Sabrás que ha funcionado cuando tengas una pequeña biblioteca de prompts que puedas adaptar en menos de un minuto.
Errores comunes
- Error: Describir toda la escena en una sola frase larga sin pausas. Solución: Divídela en los seis bloques. Los modelos responden mejor a fragmentos separados por comas que a párrafos seguidos.
- Error: Pedir dos estilos de cámara distintos en un mismo prompt. Solución: Elige uno. "Tracking shot from the side AND overhead close-up" normalmente no te da ninguno de los dos.
- Error: Omitir el movimiento por completo. Solución: Incluso "slow, steady motion" o "static frame" es mejor que nada; sin él, el modelo adivina y, a menudo, adivina mal.
- Error: Reescribir todo el prompt después de un mal resultado. Solución: Cambia un solo bloque, regenera y luego juzga. Lo que quieres es aislar qué variable importó.
Qué significa esto para ti
- Si creas contenido para redes sociales: los bloques de movimiento y cámara son tu arma secreta. La mayoría de clips de IA parecen genéricos porque la gente se los salta. Elige uno (cámara lenta, transición rápida, plano fijo amplio, tracking) y tu clipará al instante como algo más intencionado.
- Si estás experimentando por diversión: empieza solo con sujeto, acción y entorno. Familiarízate. Luego añade cámara, movimiento y audio (si se admite) poco a poco. Prueba el bloque de audio incluso cuando no estés seguro de si vas a quedarte con el sonido: así aprenderás qué hace bien tu herramienta y con qué se pelea.
- Si obtienes un resultado raro: no asumas que la herramienta está rota. Comprueba qué bloque falta o es vago. Nueve de cada diez veces, el problema está en el prompt, no en la IA.
Cierre
Un prompt de seis bloques no te leerá la mente, pero casi lo logra. Escribe el sujeto, la acción, el entorno, la cámara, el movimiento y el audio (cuando se admita), genera, mira y, después, cambia un solo bloque cada vez. Prueba hoy mismo uno de los ejemplos rellenados de arriba (elige el barista, la niña con las semillas de diente de león o la escena que te haya llamado la atención) y cambia solo un bloque en tu segundo intento. Verás la diferencia en el segundo clip, no en el décimo.
