Un falso documental encaja con el cine con IA porque las entrevistas, los cortes directos, los encuadres de cámara en mano y los planos de recurso breves pueden construirse como módulos separados. Mi regla para un primer montaje es que cada plano revele al personaje, haga avanzar la historia u oculte un corte. Si no cumple ninguna de esas funciones, lo dejo fuera de la lista de generación.
Por qué el falso documental encaja con un flujo modular de IA
La mayoría de los formatos de vídeo con IA castigan los errores. Un plano cinematográfico lento que tiembla, un rostro que cambia entre fotogramas o una variación de luz a mitad de movimiento destruyen la ilusión en un drama cuidado o una secuencia de acción.
El falso documental invierte esa lógica. Cada «defecto» tiene una explicación plausible:
- El encuadre tembloroso de cámara en mano parece metraje documental real, no un artefacto de IA
- Los cortes directos ocultan transiciones imperfectas: nunca necesitas suavizar la unión entre clips
- Las entrevistas a cámara no requieren un trabajo cinematográfico de cámara, solo un rostro y una expresión coherente
- Los clips cortos son baratos de controlar y baratos de regenerar si salen mal
El formato se basa en que las imágenes crudas y ligeramente imperfectas resultan más creíbles que las pulidas. La generación de vídeo con IA produce precisamente eso.
Solo necesitas controlar la consistencia de los personajes y el montaje. El formato se ocupa de todo lo demás.
Planifica antes de generar
Antes de abrir DomoAI, escribe 5–8 momentos de entrevista. Un momento es una frase que describe lo que un personaje dice o hace en una escena:
- «Maya insiste en que no tuvo nada que ver».
- «Robert explica lentamente la política de la empresa».
- «Imágenes del suceso, narradas por una voz fuera de campo».
Estos momentos narrativos son tu película. No necesitas un guion completo, solo lo suficiente para saber quiénes son los personajes, cuál es su perspectiva y en qué orden se desarrolla la historia.
Los momentos se convierten en la lista de clips de entrevista y la lista de planos de recurso. Si un personaje no tiene momentos, no hace falta generarlo. Si una escena no tiene un momento, no necesita existir.
Escribe primero los momentos. Se generan los personajes del plan; los demás quedan completamente fuera del panel Assets. Ese límite mantiene manejable el número de clips y evita que la sesión de montaje se convierta en una búsqueda de archivo.
Los momentos narrativos también revelan la estructura que todavía te falta. Si todos pertenecen a un único personaje, tienes un monólogo, no un falso documental. Si tienes cinco personajes y doce momentos, tienes un problema de producción.
Un reparto pequeño y una lista breve de momentos mantienen el proyecto revisable. Planifica entrevistas, reacciones y planos de recurso según el tiempo y el presupuesto de generación disponibles.
Paso 1: Fija primero el reparto
La consistencia de los personajes es la única variable que determina el éxito o el fracaso de un falso documental. Genera el reparto antes de hacer nada más y nunca te apartes de las imágenes de referencia una vez fijadas.
Cómo fijar un personaje con Nano Banana Pro:
- Sube hasta 9 imágenes de referencia. Si tienes una foto real, úsala. Si generas desde cero, crea 3–4 variaciones y elige el rostro más consistente.
- Ejemplo de prompt de generación: «sujeto de documental, poco más de 30 años, ropa informal de oficina algo descuidada, luz interior natural, plano medio, expresión ligeramente cansada, realista»
- Genera tres ángulos: retrato frontal, plano medio y un ligero giro de tres cuartos. Guarda los tres en el panel Assets.
- Repite el proceso con cada personaje recurrente. Dos o tres «entrevistados» bastan para un falso documental convincente.
Qué rompe la consistencia de los personajes:
Los ángulos faciales extremos rompen la consistencia. Un perfil completo generado a partir de referencias frontales sufrirá desviaciones: el modelo tiene que inventar ese ángulo desde cero. Mantén los ángulos del personaje dentro de los 30 grados respecto a la referencia.
Los cambios de vestuario rompen la continuidad. Si un personaje aparece con traje en una escena y camiseta en otra sin explicación narrativa, parece dos personas distintas. Fija el vestuario en las referencias y mantenlo consistente salvo que la historia exija un cambio.
Dos o tres personajes recurrentes es el rango de trabajo para la mayoría de los cortos de falso documental. Un personaje es un monólogo. Cuatro o más resultan difíciles de gestionar.
Character to Video introduce nuevos movimientos en el personaje fijado mientras conserva su aspecto. Mantén la iluminación y el encuadre entre clips para que cada escena parezca proceder del mismo rodaje.
Mantén unas reglas visuales para el reparto
Uso una fila por personaje recurrente. Es más útil que pegar la descripción completa del personaje en cada prompt de movimiento.
| Fijar | Registrar una vez | Revisar en cada clip |
|---|---|---|
| Cara | Retrato aprobado y rango de expresiones | Ojos, mandíbula, nacimiento del pelo |
| Vestuario | Color, corte, accesorio | Detalles ausentes o intercambiados |
| Accesorio | Objeto distintivo y mano | Escala y lado del cuerpo |
| Localización | Imagen de fondo y dirección de la luz | Ventana, luces visibles, horizonte |
| Encuadre | Entrevista, plano medio o cuerpo entero | Coincide con la función prevista en la escena |
| Voz | Archivo del hablante, ritmo, emoción | El personaje sigue siendo reconocible sin imagen |
La guía de storyboard con IA ayuda a convertir la lista de momentos en cobertura de planos. Como referencia de reparto, estudia la escena de comedia con tres personajes; para más ideas narrativas, explora la colección de vídeos narrativos.
Paso 2: Crea las entrevistas a cámara
Las entrevistas a cámara son la columna vertebral de cualquier falso documental. Sostienen la historia, presentan los chistes y te dan un punto desde el que cortar a otros planos. Genéralas primero.
Con Talking Avatar: sube la imagen fijada de tu personaje y tu audio. Las duraciones son de 5, 10 y 20 segundos en los planes estándar; los clips de 30 y 60 segundos están disponibles en Pro. Escribe respuestas breves de entrevista, no monólogos: entre 10 y 15 segundos de voz por clip se montan de forma natural.
Genera primero la voz en Text to Speech. Las etiquetas de emoción como [Cheerful] se aplican al guion TTS. Después envía ese audio a Talking Avatar y usa el prompt independiente de acción o expresión para sonrisas, asentimientos, miradas y gestos.
[Neutral] — respuestas tranquilas y medidas[Sad] — un momento de confesión o admisión a regañadientes[Surprised] — una revelación o reacción[Angry] — una discusión que va a más
Prompts de expresión y acción, introducidos por separado del guion:
- «sonrisa ligeramente nerviosa, mira brevemente fuera de cámara, se mueve en el asiento»
- «brazos cruzados, expresión escéptica, una ceja levantada»
- «se inclina un poco hacia delante, atento, asiente lentamente»
- «mira abajo y vuelve a levantar la vista, pausa incómoda antes de responder»
- «seguro, contacto visual directo, manos juntas, barbilla ligeramente elevada»
- "trail off mid-thought, eyes move to corner, recover with a tight smile"
La velocidad de TTS como rasgo del personaje: El control de velocidad va de 0,5x a 2,0x en las voces clonadas. Una interpretación algo más lenta (0,85x) hace que el personaje suene más reflexivo, como si confesara algo o hablara con cautela. Una algo más rápida (1,1x) suena nerviosa o evasiva. Usa la velocidad como rasgo del personaje, no solo como ajuste del ritmo.
Genera tomas alternativas solo para las frases importantes. Talking Avatar funciona en Fast Mode, por lo que los reintentos consumen créditos.
Paso 3: Genera planos de recurso e insertos
Los planos de recurso interrumpen las entrevistas y añaden textura al mundo. En un documental real, cubren puntos de montaje y prolongan escenas. Aquí también ocultan los saltos de continuidad entre clips.
1. Planos de situación: Usa Image to Video (Seedance 2.0) sobre una imagen fija generada. Prompt: "empty office hallway, fluorescent lights, late afternoon, slightly desaturated, handheld look"
2. Planos de reacción: Muestra al sujeto mirando fuera de pantalla, sin audio, solo con una expresión. Prompt de expresión sin voz para Talking Avatar: "subject watches something out of frame, slight discomfort, handheld medium shot"
3. Insertos de objetos y detalles: Genera una imagen fija y anímala después. Prompt: «pila de papeles sobre un escritorio desordenado, bolígrafo suelto cerca, primer plano documental, luz natural de ventana, ligera deriva de cámara»
4. Sujeto en movimiento: Usa Character to Video con un clip de referencia caminando. Indicación: «persona camina por un pasillo alejándose de la cámara, seguimiento con cámara en mano, ligeramente inestable»
5. Clips de estilo archivo o metraje encontrado: Genera clips cortos con una gradación de grano de película intenso, colores desvaídos y un encuadre ligeramente inestable. Estos insertos dan profundidad al mundo y sugieren una historia más allá de los acontecimientos actuales. Prompt: "16mm film look, heavy grain, slight colour fade, institutional office hallway, 1990s, unsteady handheld"
6. Confesión a cámara fuera de entrevista: Un personaje al que la cámara sorprende, fuera de la silla de una entrevista formal. Prompt de Talking Avatar: "caught mid-task, slightly startled by camera, recovers to direct address, documentary veríté"
En DomoAI 2.4.1, Frames to Video admite 2–8 fotogramas clave y generaciones de varios fotogramas de 1–56 segundos. En cambio, Frames to Video con Seedance 2.0 utiliza un fotograma inicial y otro final y sigue el rango de 4–15 segundos de Seedance.
Paso 4: Mantén los clips breves y construye la película en el editor
La película vive en la línea de tiempo, no en un clip aislado. Un plano de recurso flojo de 3 segundos cuesta muy poco de regenerar. Un clip de entrevista de 45 segundos, innecesariamente largo, es difícil de arreglar.
Duraciones objetivo por tipo de clip:
- Respuesta de entrevista: 5–20 segundos
- Plano de reacción: 3–8 segundos
- Plano de situación: 5–10 segundos
- Inserto de detalle: 2–5 segundos
Edita en CapCut, Premiere Pro o DaVinci Resolve. Corta sobre la voz, no sobre el silencio. El ritmo del falso documental es entrecortado y algo ansioso: los cortes que parecen llegar un instante demasiado pronto suelen ser los adecuados.
Paso 5: Añade el aspecto documental en el editor
El acabado puede influir mucho en que los clips separados parezcan una sola película. Mantén consistentes los rótulos identificativos, el estilo de subtítulos, el sonido ambiente, el grano y el tratamiento de color a lo largo de la secuencia.
Rótulos identificativos: Texto blanco, sin remates, en la esquina inferior izquierda. Rótulo: «Nombre, cargo». Este único elemento convierte cualquier plano de alguien hablando a cámara en una entrevista. CapCut incluye plantillas de rótulos inferiores. En Premiere Pro, usa el panel Essential Graphics.
Textos y subtítulos: Genéralos automáticamente a partir del audio en CapCut o Premiere Pro. Incluso los falsos documentales claramente ficticios se benefician de los subtítulos: mantienen a los espectadores y refuerzan el lenguaje visual documental.
Narración: Genérala con Text to Speech. Usa Neutral o una voz ligeramente cansada. Colócala bajo planos de recurso y situación, no sobre entrevistas. Mantén la narración breve: una o dos frases por transición de escena.
Etalonaje: Reduce la saturación aproximadamente un 20 %. Añade un ligero grano de película y una viñeta sutil. Esta combinación se interpreta de inmediato como «archivo» o «real». No te la saltes.
Música y ambiente: Coloca un sonido ambiental continuo a bajo volumen o una música mínima bajo el montaje. Suno funciona bien para generar piezas cortas que se puedan repetir en bucle. El ambiente de sala entre los puntos de montaje rellena el silencio que hace que los clips unidos parezcan desconectados: incluso 0,5 segundos de ruido ambiental suavizan un corte directo.
Un arranque de 30 segundos antes del título que sí planificaría
| Tiempo | Plano | Función narrativa |
|---|---|---|
| 0–4 s | Entrevista con cámara fija: «La impresora empezó la reunión». | Presenta la premisa absurda |
| 4–7 s | Primer plano de la impresora con cámara en mano | Aporta pruebas visuales |
| 7–13 s | Un segundo empleado niega su responsabilidad | Crea conflicto |
| 13–18 s | Inserto de pasillo con aspecto de cámara de seguridad | Oculta la transición de la entrevista |
| 18–25 s | El responsable muestra una pila de exigencias impresas | Intensifica el chiste |
| 25–30 s | Reacción silenciosa y después tarjeta de título | Deja que el remate haga efecto |
Es un ejemplo de ritmo, no una regla universal de duración. Si cambia la cara, regenero la entrevista. Si el chiste llega tarde, monto. Si un texto o logotipo está mal, lo corrijo fuera del vídeo generado. Si una transición resulta abrupta, acepto el corte directo o la planifico con Frames to Video.
Para elegir la cámara, la guía de control de movimiento ayuda a separar la energía intencionada de cámara en mano de la deriva accidental. La página de flujos para cineastas es el siguiente paso más amplio cuando el corto crece y abarca varias escenas.
Montar la versión final
Equilibrio entre entrevistas y planos de recurso: Usa suficiente entrevista para sostener la historia y corta cuando una reacción, contradicción, detalle del entorno o chiste visual aporte información. Juzga el equilibrio por la claridad y el ritmo, no por un porcentaje fijo.
Si te atascas en el montaje, comprueba la proporción antes de cambiar cualquier otra cosa.
Duración de escena: Corta cuando cambie la información o el momento emocional. Una reacción, un detalle del lugar o un plano de recurso contradictorio puede renovar la atención sin obligar a todas las escenas a durar lo mismo.
La regla de tres para las secuencias de entrevista: Una secuencia de entrevista suele tener tres partes. El primer clip presenta la postura, el segundo aporta pruebas o una contradicción y el tercero remata con la reacción o consecuencia. Construye las entrevistas de tres en tres y la historia parecerá estructurada incluso con un guion mínimo.
Dónde colocar la cartela del título: Abre con 10–15 segundos de planos de recurso o de situación antes de la primera entrevista. Introduce la cartela entre los segundos 8 y 12 de esos planos: el público ya tendrá suficiente contexto para leer el título como confirmación de lo que ve.
Dónde suelen fallar los falsos documentales de IA en el montaje: El fallo más habitual es encadenar demasiados clips de entrevista del mismo personaje. Tres clips seguidos de una persona sin un plano de recurso parecen un monólogo, no una entrevista.
Interrumpe cada segundo o tercer clip de entrevista con una reacción, un plano de recurso o un corte a otro personaje. No tiene que durar mucho. Tres segundos de una pila de papeles o un pasillo restablecen el ritmo y dan un nuevo impulso al siguiente clip de entrevista.
Preguntas frecuentes
¿Puede DomoAI generar una película entera de una vez? No, y es intencionado. Las generaciones largas de un solo clip son más difíciles de controlar y más propensas a desviarse. Construyes la película uniendo clips cortos y controlados. Eso te da más precisión sobre la actuación, el ritmo y la consistencia de los personajes que una única generación larga.
¿Cómo mantengo consistentes los personajes en distintas escenas? Fija las referencias del personaje en Assets antes de generar nada. Cada clip de ese personaje debe usar la misma imagen guardada. Nano Banana Pro permite subir hasta 9 referencias para crear una identidad estable: usa variantes frontales, de plano medio y de tres cuartos como base.
¿Qué hace que un falso documental con IA parezca realista? Tres cosas: personajes consistentes, encuadre documental correcto (entrevistas a cámara, planos de recurso con cámara en mano y rótulos inferiores) y una gradación desaturada con grano ligero. Un rostro que cambia entre escenas o clips que no comparten gramática visual rompen la inmersión.
¿Por qué los clips largos se ven peor que los cortos? La generación de vídeo con IA acumula desviaciones con el tiempo. Un clip de 30 segundos ofrece más oportunidades de que un rostro cambie sutilmente, un movimiento falle o la iluminación varíe que uno de 10 segundos. Los clips cortos te dan control. El montaje los une para conseguir la duración.
¿Cuánto se tarda en hacer un corto de falso documental terminado? El tiempo de producción varía según el tamaño del reparto, el número de clips, los reintentos y el montaje. Reserva tiempo por separado para fijar el reparto, generar entrevistas y planos de recurso y terminar el sonido y la línea de tiempo.
¿Cuánto debería durar un falso documental con IA terminado? No existe una duración ideal universal. Empieza con la versión más corta que complete la historia y añade escenas solo cuando aporten un nuevo momento narrativo, una reacción o una prueba.
¿Necesito escribir un guion completo? No. Escribe 5–8 momentos de entrevista, una frase cada uno, y una lista aproximada de planos de recurso. El guion real de cada entrevista puede desarrollarse en TTS: escribe respuestas de 2–3 frases, genera y comprueba si encajan. Los momentos narrativos importan más que el guion.
¿Necesito un plan de pago? Puedes empezar con el plan gratuito para probar la generación de personajes y los clips cortos. Los clips de Talking Avatar más largos (30 y 60 segundos) y un mayor volumen de generación requieren un plan de pago, desde 6,99 $ al mes con facturación anual.
Empieza con la prueba gratuita limitada de DomoAI y comprueba los límites actuales del plan antes de generar una película más larga.


