ESCRIBE MOVIMIENTO, NO UNA IMAGEN
Cómo funciona el generador de video a prompt
Un prompt de imagen describe un fotograma congelado. Un prompt de video tiene que describir el cambio: qué hace el sujeto durante los siguientes ocho segundos, cómo se mueve la cámara, cómo se comporta la luz y cuándo ocurre cada momento. Esta herramienta lee ese cambio de un clip o lo infiere a partir de una sola imagen, y luego lo escribe en la sintaxis a la que responde tu modelo de video.
Lo que el prompt lee de tus fotogramas
Los fotogramas se muestrean en orden temporal, de modo que la herramienta puede compararlos: un sujeto que se encoge entre fotogramas implica un alejamiento de cámara, un horizonte que se inclina implica un movimiento con cámara en mano, una fuente de luz que barre un rostro implica un auto pasando o una cabeza girando. Nombra el tamaño de la toma, la altura y el ángulo de cámara, la acción del sujeto y cómo progresa, el escenario, la hora del día y el clima, la dirección y calidad de la iluminación, y la firma de paleta y estilo.
Luego escribe el prompt como movimiento. Cada frase dice qué se mueve, incluida la cámara. El estilo se conserva en lugar de mejorarse: metraje granulado de teléfono sigue siendo metraje granulado de teléfono a menos que pidas algo distinto, porque eso suele ser el objetivo de extraer el prompt.
Prompt de imagen a video: animando una imagen fija
Con una sola imagen no hay movimiento que leer, así que la herramienta infiere uno plausible a partir de la imagen: un retrato recibe un lento acercamiento y un pequeño gesto, un producto recibe una órbita y un elemento en movimiento, un paisaje recibe una deriva y clima. Tu dirección anula todo eso. “Ella mira hacia arriba y sonríe” o “cámara estática, solo se mueve el agua” son las frases que hacen tuyo un prompt de imagen a video.
El prompt conserva lo que la imagen ya decidió. El sujeto, el encuadre, la luz y la paleta se describen para que el primer fotograma del modelo de video coincida con tu imagen, que es lo que los modos de imagen a video de Sora, Veo, Kling y Runway necesitan para mantenerse fieles a la referencia.
Sora 2, Veo 3, Kling y Runway leen los prompts de forma diferente
La misma idea tiene que escribirse de cinco maneras. Sora 2 y Veo 3 generan sonido, así que sus prompts terminan con una línea de audio; Kling da peso al sujeto y a un único movimiento claro; Runway quiere el movimiento de cámara primero, en su propio vocabulario. Elige el modelo en la herramienta y el prompt sigue estas reglas.
| Modelo de video | Cómo se escribe el prompt | Audio | Duración |
|---|
| Sora 2 | Prosa sencilla; una breve lista de tomas con tiempos cuando hay varios momentos | Sí, audio nativo: termina con una línea de sonido o diálogo | Menos de ~180 palabras |
|---|
| Veo 3 | Un párrafo cinematográfico: toma, acción, entorno, luz, estilo | Sí: añade una frase de diseño de sonido, diálogo entre comillas | Menos de ~160 palabras |
|---|
| Kling | Sujeto → movimiento → escena → cámara → luz, un único movimiento primario claro | No | 60–110 palabras |
|---|
| Runway Gen-4 | Movimiento de cámara primero (acercamiento, órbita, seguimiento, grúa), luego movimiento del sujeto | No | Menos de ~80 palabras |
|---|
| General | Prosa multimodelo: toma y cámara, movimiento del sujeto, escenario, estilo, duración | Opcional | 90–160 palabras |
|---|
Quién usa un generador de prompts de video
Creadores y marketers convierten una foto de producto o una foto fija de campaña en un breve clip protagonista sin escribir lenguaje de cámara desde cero. Cineastas y editores extraen el prompt de una toma de referencia para recrear su movimiento y luz en Sora o Veo. Equipos de redes sociales reproducen el ritmo de un clip que tuvo buen desempeño con un nuevo sujeto. Ingenieros de prompts usan los formatos específicos de cada modelo como punto de partida y comparan cómo Sora 2, Veo 3 y Kling interpretan la misma toma.
Privacidad, límites y costo
Tu video no se sube. Cuatro fotogramas se muestrean en tu navegador a tamaño reducido y solo esos fotogramas se analizan; nada de lo que envíes se añade a la Galería ni se muestra a nadie más. Los clips están limitados a 60 segundos y 60 MB, suficiente para una sola toma y que mantiene rápido el análisis. Una ejecución cuesta 2 créditos, el doble del precio de las herramientas de imagen, porque lee varios fotogramas y escribe un prompt más largo y con tiempos.
¿Necesitas en su lugar el prompt detrás de una imagen fija? Usa Imagen a Prompt. ¿Partes de palabras? Texto a Prompt las expande, y la Galería de Prompts muestra prompts terminados por estilo.
COMMON QUESTIONS
Video to prompt FAQ
¿Qué es un generador de video a prompt?
Lee un video corto, o una imagen fija, y escribe el prompt de texto que recrearía esa toma en un generador de video con IA. El prompt describe qué se mueve: la acción del sujeto, el movimiento de cámara, la luz, el ritmo y la duración, en el formato que Sora, Veo, Kling o Runway lee mejor.
¿Cómo extraigo un prompt de un video?
Sube un clip MP4, WebM o MOV de hasta 60 segundos. Se muestrean cuatro fotogramas a lo largo del clip en tu navegador y se envían para análisis; el archivo de video en sí nunca sale de tu dispositivo. Elige el modelo de video y la duración deseada, añade dirección opcional y haz clic en Generar. Recorta videos largos a la única toma para la que quieres un prompt.
¿Puedo generar un prompt de video a partir de una imagen en su lugar?
Sí. Añade una imagen y la herramienta escribe un prompt de imagen a video: conserva el sujeto, el encuadre, la luz y el estilo de la imagen y añade el movimiento, el movimiento de cámara y el ritmo que un modelo de video necesita para animarla. Esta es la entrada correcta para los modos de imagen a video de Sora, Veo, Kling y Runway.
¿Escribe prompts para Sora 2?
Sí. Elige Sora 2 y el prompt se escribe como prosa sencilla con una breve lista de tomas cuando el movimiento tiene varios momentos, cada uno con tiempo en segundos, y una línea final de audio, porque Sora 2 genera sonido sincronizado.
¿Qué hay de Veo 3, Kling y Runway?
Cada uno tiene su propia opción. Veo 3 recibe un párrafo cinematográfico con una línea de audio; Kling recibe un prompt compacto ordenado en sujeto, movimiento, escena, cámara, luz; Runway Gen-4 recibe un prompt breve que empieza con el movimiento de cámara en el propio vocabulario de Runway. Elige General para un prompt que funcione en todos los modelos.
¿Puede recuperar el prompt exacto detrás de un video de IA?
Ninguna herramienta puede leer el prompt oculto de un video terminado. Lo que hace es describir el movimiento visible, la cámara, la luz y el estilo con suficiente precisión para que ejecutar el prompt de nuevo produzca el mismo tipo de toma.
¿Es gratuita la herramienta de video a prompt?
Puedes probarla sin una cuenta dentro de la asignación diaria gratuita. Cada ejecución cuesta 2 créditos en un plan, porque lee varios fotogramas y escribe un prompt más largo que las herramientas de imagen.
¿Qué archivos de video funcionan?
MP4, WebM y MOV de hasta 60 MB y 60 segundos, además de imágenes JPG, PNG y WEBP. Como los fotogramas se leen en tu navegador, los navegadores muy antiguos pueden no admitir todos los códecs; si un clip no se carga, expórtalo como MP4 (H.264) e inténtalo de nuevo.