Por qué tu video con IA ignora el prompt: una acción

Una mano sostiene una taza blanca junto a las palabras « One Clear Action ».

Un prompt de imagen a video funciona mejor cuando asigna al plano una acción principal clara. Si pides cinco cambios distintos en un clip corto, el modelo puede combinarlos, reordenarlos o dejar algunos a medias. Mantén un acontecimiento como eje y usa el pelo, la tela, la luz y la cámara como apoyo.

No significa que cada prompt deba tener un solo verbo. Significa que el espectador debería poder responder: ¿qué muestra principalmente el plano?

Tu prompt dirige; no es una línea de tiempo del plano

La imagen de origen ya define el sujeto, la composición, la luz y el estado inicial. El prompt debe explicar qué cambia después del primer fotograma.

Por eso, «una mujer en una cafetería» aporta poca dirección de movimiento: la imagen ya muestra a la mujer y la cafetería.

«La mujer levanta la taza de café hasta los labios» da a Image to Video un acontecimiento visible que animar.

Un prompt no programa cada verbo en una línea de tiempo manual exacta. DomoAI usa la imagen, el prompt, el modelo, la duración y los ajustes para generar el clip.

El modelo puede interpretar una lista larga como movimientos simultáneos o terminar la primera acción y quedarse sin tiempo para las demás.

Organiza el prompt alrededor de tres ideas:

  1. Sujeto bloqueado: persona, producto u objeto que debe seguir reconocible.
  2. Una acción principal: cambio físico que debe notar el espectador.
  3. Apoyo de escena o cámara: movimiento que ayuda a leer la acción sin competir con ella.
Comparación visual entre cinco acciones de ciclista que compiten entre sí y una sola acción centrada en el casco.

Usa inicio, acción y final

Tres fotogramas muestran una taza sobre la mesa, mientras se levanta y al llegar a los labios de la mujer.

Antes de escribir, describe el plano en tres líneas breves:

  • Inicio: ¿qué muestra ya la imagen?
  • Acción: ¿qué único acontecimiento físico ocurre?
  • Final: ¿qué estado visible lo completa?

Para un plano de café:

  • Inicio: la taza descansa en la mesa junto a la mano derecha de la mujer.
  • Acción: levanta la taza hacia la boca.
  • Final: el borde llega a sus labios y se detiene.

El prompt queda así:

Plano medio fijo. La mujer alarga la mano derecha, levanta la taza blanca de café de la
mesa y lleva el borde hasta los labios. El codo se flexiona en un movimiento continuo.
Se detiene con la taza en la boca. El vapor sube y su pelo suelto se mueve levemente.
Luz cálida de ventana desde la izquierda de cámara. 5 segundos, 16:9. Sin cámara temblorosa,
taza adicional, deformación de manos, texto ni marca de agua.

«Alarga, levanta y lleva» son fases de una sola interacción. El acontecimiento principal sigue siendo tomar la taza para beber.

Compáralo con una secuencia de estados sin relación:

La mujer toma el café, bebe, se levanta, camina hasta la ventana, se gira, sonríe y deja la taza.

Ese prompt pide montar una escena entera en un clip corto. Divídela antes de añadir más adjetivos.

Movimiento del personaje: de un prompt malo a uno mejor

Los prompts de personajes ganan claridad cuando nombras un cambio corporal y su punto final.

MaloMejorPor qué ayuda
El hombre camina, saluda, gira y se sienta.El hombre da dos pasos lentos hacia la cámara y se detiene con ambos pies visibles.Una trayectoria y un final legible sustituyen cuatro momentos.
La bailarina se mueve de forma bella y dramática.La bailarina eleva ambos brazos desde los hombros hasta encima de la cabeza y mantiene la pose.El modelo recibe una trayectoria articular visible, no un ánimo abstracto.
La chica mira alrededor y sale corriendo.La chica gira la cabeza de izquierda a derecha sin mover el cuerpo.El plano aísla el giro; correr pertenece a otro clip.

No elimines el movimiento de apoyo natural. El pelo puede responder al giro y la tela asentarse tras elevar el brazo.

Ese apoyo debe reforzar la acción principal, no convertirse en otro momento narrativo.

Movimiento de producto: de un prompt malo a uno mejor

Un producto necesita una trayectoria controlada. No le pidas girar, abrirse, transformarse y mostrar texto al mismo tiempo.

MaloMejorPor qué ayuda
La botella gira, se abre, salpica y se convierte en flores.La botella gira 90 grados en sentido horario sobre el pedestal y se detiene con la etiqueta frontal hacia la cámara.Sigue una trayectoria medible y termina en una orientación definida.
Haz que el zapato parezca dinámico y premium.El zapato se inclina 15 grados hacia arriba mientras la cámara permanece fija a la altura de la mesa.Sustituye lenguaje de marca por movimiento visible.
La caja se abre y todo sale volando.La tapa se eleva sobre la bisagra trasera hasta quedar vertical; la base permanece fija.Se mueve la tapa y se bloquea la base.

Añade precios finales, texto legal y copy exacto en un editor. La tipografía pequeña generada puede no mantenerse exacta en movimiento.

Si la forma del producto ya está mal en el origen, repara primero la imagen fija. El prompt de movimiento no debe corregir el envase mientras lo anima.

Movimiento de cámara: asígnale una función

La cámara puede apoyar al sujeto o competir con él. Empieza con una intención de cámara por plano.

MaloMejorPor qué ayuda
Panea a la izquierda, acércate, orbita a su alrededor y retrocede.Acercamiento lento de plano medio a primer plano mientras el sujeto permanece inmóvil.Una trayectoria crea un cambio de encuadre legible.
Movimiento de cámara cinematográfico.La cámara fija a la cintura sigue lateralmente al ciclista a su misma velocidad.Dirección, altura y relación con el sujeto quedan explícitas.
La cámara va a todas partes mientras acelera el auto.La cámara trasera permanece a 60 cm del auto, a la altura del parachoques, mientras acelera.La posición queda vinculada a la acción.

Usa cámara fija cuando la acción ya tenga varias partes móviles. Una cámara tranquila aclara el contacto entre mano y objeto.

Usa segmentos temporales solo si el plano necesita varios movimientos de cámara. No escondas cinco acciones del sujeto tras códigos de tiempo.

Acción facial: describe un cambio visible

«Más emoción» no indica qué parte del rostro debe moverse. Nombra un cambio sencillo y limita el movimiento de cabeza.

MaloMejorPor qué ayuda
Se vuelve emotiva y expresiva.Su expresión neutra cambia a una leve sonrisa con la boca cerrada mientras mira a cámara.La expresión tiene inicio y final claros.
Parece sorprendido, ríe y empieza a llorar.Levanta las cejas y abre los ojos al girarse hacia el sonido fuera de cámara.Una reacción sustituye tres emociones en conflicto.
Movimiento facial natural.Parpadea una vez y baja un poco la barbilla sin mover los hombros.Nombra dos microacciones conectadas.

Limita especialmente los prompts de primer plano. Los cambios pequeños pesan más cuando el rostro llena el encuadre.

Interacción con objetos: nombra el contacto

Las interacciones suelen romperse cuando la mano toca, levanta o suelta un objeto. Describe el contacto en orden físico.

MaloMejorPor qué ayuda
Usa el teléfono y lo guarda.Su mano derecha agarra el teléfono, lo levanta del escritorio y lo sostiene a la altura del pecho.Agarre y trayectoria forman una interacción.
Juega con el farol y lo deja volar.Abre ambas manos y suelta el único farol luminoso sobre su cabeza.Fija la cantidad y el punto de liberación.
El ciclista se prepara y se marcha.Levanta el casco con ambas manos y lo baja hasta colocarlo en la cabeza.«Se prepara» se convierte en una acción visible; marcharse va en otro plano.

Usa «único», «uno», «mano derecha» y «mano izquierda» cuando importen la cantidad o el contacto. Los sustantivos concretos ayudan más que los adjetivos de ánimo.

Construye un prompt de movimiento completo

Breve no significa impreciso. Un prompt puede seguir enfocado e incluir movimiento físico, cámara, luz, duración, encuadre y estabilidad.

Acción del casco: plano vertical fijo

Pégalo en Image to Video con un fotograma que muestre al mismo ciclista junto a la misma bicicleta:

Cámara fija de tres cuartos a la altura del pecho, a tres metros del sujeto. El mismo ciclista
adulto joven con impermeable amarillo mostaza, pantalón gris carbón y zapatillas blancas,
de pie junto a la misma bicicleta plateada y con un casco negro mate. Levanta el casco con
ambas manos, lo baja hasta la cabeza y lo suelta al quedar colocado. La correa oscila una vez
y se detiene. La bicicleta permanece inmóvil. Mañana temprana, luz ámbar suave desde la
izquierda de cámara. 5 segundos, 9:16. Sin temblor, deriva del sujeto, movimiento de bicicleta,
casco adicional, deformación de manos, texto ni marca de agua.

La cláusula del sujeto bloquea al ciclista y los objetos. La acción principal es ponerse el casco; la correa la apoya.

La bicicleta permanece quieta porque moverla iniciaría otro momento narrativo.

Revisa una causa cada vez

Si el resultado no cumple la intención, diagnostica el fallo visible antes de reescribir todo.

Qué vesPrimera revisión
La acción no empiezaSustituye un verbo abstracto por un movimiento físico.
Empieza pero no terminaAcorta la trayectoria o dale más duración.
Dos acciones ocurren juntasConserva la más importante y mueve la otra a otro plano.
La cámara oculta la acciónBloquéala o reduce su movimiento a uno sencillo.
Se duplica un objetoIndica la cantidad y no cambies su descripción.
La imagen tiene una mano u objeto rotoRepara la imagen antes de regenerar el video.

Conserva lo que ya funciona. Si la acción está clara y la cámara se mueve demasiado, edita solo la línea de cámara.

AI Optimize puede ampliar un prompt corto cuando la herramienta de DomoAI seleccionada lo admita. Trátalo como borrador y elimina acciones o detalles que compitan con el acontecimiento.

Para estructura y lenguaje de cámara más amplios, consulta la guía de prompts de video con IA de DomoAI.

Cuando una imagen no basta

Usa otro plano si la historia necesita otra acción, lugar, posición de cámara o estado del sujeto. Coloca el casco en un clip, levanta la bicicleta en el siguiente y aléjate en el tercero.

No conviertas un prompt de imagen a video en un storyboard oculto.

Si un movimiento continuo debe pasar por estados visuales conocidos, usa Fotogramas a video. Ese flujo controla las imágenes inicial, intermedias y final.

La diferencia es breve: una imagen pide al modelo que invente el destino; varias le indican los momentos que debe alcanzar.

Preguntas sobre prompts de imagen a video

¿Por qué el video con IA ignora parte de mi prompt?

Puede faltarle tiempo o prioridad clara para cada acción. Mantén un acontecimiento central y mueve los posteriores a otros planos.

¿Un prompt de Image to Video puede incluir varias acciones?

Sí, si los movimientos menores apoyan un solo acontecimiento. Levantar una taza y flexionar el codo van juntos; ponerse de pie, caminar y sentarse son momentos separados.

¿Un prompt más corto siempre produce un video mejor?

No. Uno corto puede ser vago y uno enfocado, detallado. La claridad procede de una acción principal, dirección física y punto final visible.

¿Por qué el mismo prompt genera resultados distintos?

La generación varía. Mantén estables la fuente y los ajustes al revisar para evaluar el único cambio realizado.

¿Cambio el modelo o reescribo primero el prompt?

Comprueba si el modelo admite la duración y el control necesarios. Si es así, revisa la acción visible antes de cambiar varios ajustes.

Una acción clara no es una fórmula secreta; facilita dirigir, revisar y corregir el plano.

Abre Image to Video y escribe el primer movimiento como un cambio físico.

Artículos recientes