folio 4 de 26
el plano para clonar videos con ia: cómo recrear un video con ia
- fecha
- 02 JUL 2025
- era
- pre-Fable
- estado
- completo
- forma
- ensayo
- actualizado
- 29 JUL 2026
cómo convierto un video de referencia en un brief de planos, prompts de generación y un plan de edición sin confundir la imitación con una película terminada.
publicado por primera vez el 2 jul 2025. actualizado el 29 jul 2026. la primera versión se construyó alrededor de veo 3. el flujo sobrevivió a los nombres de los modelos.
El video de arriba es mi reconstrucción de 2025 de ¿qué pasaría si la bomba del zar cayera sobre Nueva York?. Uso "clonar" como abreviatura, pero copiar píxel por píxel el trabajo de un creador no es lo interesante. Lo útil es aprender a ver por qué funciona un video y convertir esas decisiones en algo que puedas probar.
Escribí la primera versión de esta guía con dos buenas ideas enterradas bajo un prompt gigante. Estas son las ideas que sobrevivieron.
Empieza con un brief de planos, no con un prompt de generación
Dale el video de referencia a un modelo multimodal y pídele un brief escena por escena. Es más rápido que pausar el video cada dos segundos y te entrega un documento que puedes editar.
No trates su primera respuesta como una verdad absoluta. Mira la referencia con el brief abierto. Corrige las marcas de tiempo, señala los planos que omitió y separa lo visible de lo que el modelo supuso sobre el ánimo o la intención. Aquí decides qué importa de verdad.
Pide estas cosas:
- la premisa del video y el ritmo del montaje
- una lista de planos con marcas de tiempo
- el sujeto, la acción, el escenario, la luz, la paleta, el encuadre y el movimiento de cámara de cada plano
- el paisaje sonoro: voz, música, ambiente y los momentos en que cambian
- el texto en pantalla y dónde aparece
- la función de cada plano: establecer, explicar, sorprender, liberar tensión o hacer avanzar la historia
- todo lo incierto, marcado como incierto en vez de inventado
Este es el prompt que usaría ahora:
watch this reference video and make a shot brief for a new video.
do not praise it or invent intent. separate observations from guesses.
start with the premise, overall visual language, edit rhythm, and audio approach.
then list every shot with:
- timestamp
- subject and action
- setting, light, and palette
- framing and camera movement
- sound, dialogue, music, and on-screen text
- the shot's job in the sequence
flag anything you cannot determine from the video.
Convierte cada plano en una instrucción pequeña y completa
Un generador no conoce tu edición. Cada prompt necesita suficiente contexto para sostenerse por sí solo. Repite los detalles que hacen reconocible el mundo: el personaje, el vestuario, el lugar, la hora del día, el lenguaje de lentes, la paleta y la textura del audio. Después dale al clip una sola cosa clara que hacer.
Intentar que una escena completa ocurra en un solo prompt suele producir un montaje vago. Divide en planos. El corte es donde recuperas el ritmo.
shot 04, intended for the moment after the flash
subject: a lone person in a dark jacket, seen from behind
action: stops at a storefront and looks up
setting: empty city street at blue hour, wet pavement, distant smoke
camera: slow push-in from a wide, eye-level shot
look: muted blue-grey palette, sodium streetlights, slight film grain
sound: wind, a far-off siren, no dialogue, no text on screen
continuity: keep the same jacket, street, palette, and grain as shots 01-03
La descripción no es magia. Es una lista de comprobación. Si el resultado sale mal, puedes señalar qué decisión está mal en vez de pedirle vagamente al modelo que lo "mejore".
Prueba un plano difícil antes de hacer todo
Elige el plano que carga con la identidad visual de la pieza. Genera primero varias versiones de ese único plano. Te dirá si la descripción del personaje, el lenguaje visual y el vocabulario de cámara funcionan antes de que tengas cincuenta clips que tirar.
Conserva una pequeña hoja de contactos o una línea de tiempo con los candidatos. Elige con la referencia al lado. No es trabajo inútil. El modelo puede crear opciones, pero no sabe qué imperfección es la que quieres conservar.
Usa el modelo para aquello en lo que realmente es bueno
Las herramientas cambiaron desde que hice esto por primera vez. La documentación actual de Google apunta a Gemini omni flash para la generación general de video y la edición conversacional. Mantiene veo 3.1 para cosas como audio nativo, extensión de video y generación específica por fotograma. Usa la capacidad que necesitas, no el nombre del modelo de un tutorial viejo.
Vale la pena revisar la guía actual de veo y la guía de prompts de Google antes de una ejecución grande. Cubren los controles que suelen importar aquí: sujeto, acción, escena, cámara, estilo visual, audio, prompts negativos y flujos basados en fotogramas.
Edita después de generar
La generación te da material. El video ocurre en la edición.
Pon los clips en una línea de tiempo normal. Compara los cortes con la referencia. Ajusta el ritmo, reconstruye el sonido, añade los títulos fuera del modelo cuando las palabras deban ser exactas y reemplaza solo los planos que rompen la secuencia. El resultado puede tener el mismo ritmo sin fingir que es el original.
Créditos y consentimiento
Usa una referencia que hayas creado tú, material con licencia o algo que tengas permiso para estudiar. No uses esto para imitar el rostro o la voz de una persona sin su consentimiento, ni presentes un estudio generado como si lo hubiera hecho el creador original. La idea es aprender el lenguaje visual y después hacer tu propio trabajo con él.
folio 4 de 26 · escrito en cusco, perú, 02 JUL 2025 · actualizado 29 JUL 2026