GUIDES · August 20, 2026 · 8 MIN READ

Cómo Hacer un Video con IA a Partir de un Guion en 2026

Convierte un guion escrito en prompts de video con IA toma a toma: extrae sujeto, acción, cámara, luz y final por línea de escena y mantén la continuidad entre cortes.

Un guion ya es una lista de prompts — la mayoría de la gente simplemente lo entrega completo. Los modelos de video generan una toma a la vez, de cuatro o cinco segundos cada una. Si les das tres páginas de descripción de escena, obtendrás un revoltijo. Si les das una línea formateada por toma, la edición se ensambla sola.

Esta guía explica cómo convertir un guion de dos escenas en dos prompts, generar ambos clips con ManifoldGen y unirlos en una secuencia coherente. El flujo de trabajo se adapta a cualquier duración: cada encabezado de escena se convierte en uno o más prompts de toma, nunca más de una toma por prompt.

El flujo de trabajo: de la línea del guion al prompt de toma

  1. Divide el guion en tomas. Cada línea de escena EXT./INT. es al menos una toma; las líneas de acción con su propia lógica de cámara se convierten en tomas adicionales. Una pieza de 60 segundos suele tener entre 12 y 16 clips de cuatro segundos.
  2. Extrae cinco campos de cada línea de escena: sujeto, acción, movimiento de cámara, iluminación, estado final. Si falta un campo en el guion, invéntalo una vez y bloquéalo — esa decisión ahora pertenece al mundo.
  3. Escribe un prompt por toma usando el esqueleto a continuación. La cláusula de cámara directamente después del sujeto, exactamente como lo harías para cualquier toma dirigida.
  4. Repite los detalles del mundo en los prompts textualmente. Las mismas palabras de paleta ("azul-gris frío"), el mismo clima ("cortinas de lluvia"), la misma hora del día en cada toma de la secuencia. La continuidad reside en los adjetivos repetidos.
  5. Genera primero con poca duración, revisa todas las tomas juntas en una línea de tiempo, regenera solo las débiles.
  6. Edita en un editor: recorta cada clip a sus 2.5-3.5 segundos más potentes, el orden sigue el guion, sin transiciones. Los cortes duros son la gramática.

Un guion de dos escenas

Aquí está todo el material fuente — un desglose de escena estándar:

EXT. STORM CLIFF - NIGHT

Rain hammers a stone lighthouse on a cliff.
Huge waves explode against the rocks below.
The beam sweeps through the storm.

INT. LAMP ROOM - NIGHT

Weathered hands grip a brass wheel.
The giant Fresnel lens rotates, blades of
light sweeping across rain-streaked glass.

Dos encabezados de escena, dos detalles de establecimiento, dos acciones. Eso se traduce limpiamente en dos prompts.

Prompts de tomas, generados

SCENE 1 — EXT. STORM CLIFF – NIGHT

PROMPT

A stone lighthouse on a storm-battered cliff at night. Huge waves explode against the rocks while the beam sweeps through sheets of rain. Slow aerial push toward the lantern room, wide establishing shot, cold blue-grey palette, dramatic documentary energy.

OUTPUT — GENERATED WITH MANIFOLDGEN

· 4s

Esta toma lleva el encabezado de la escena en sí: exterior, noche, clima, escala. El amplio empuje aéreo establece la geografía antes de que exista cualquier primer plano, que es para lo que sirve una toma de establecimiento — y "hacia la sala de la linterna" dirige el movimiento hacia donde nos llevará la Escena 2.

SCENE 2 — INT. LAMP ROOM – NIGHT

PROMPT

Close-up inside a lighthouse lantern room at night. Weathered hands grip a brass wheel as the giant Fresnel lens rotates, throwing moving blades of light across rain-streaked glass. Slow dolly-in, shallow depth of field, warm amber light against cold blue night.

OUTPUT — GENERATED WITH MANIFOLDGEN

· 4s

El encabezado INT. se convierte en un primer plano interior con poca profundidad de campo — el contraste con la Toma 1 hace la narración. El cristal empañado por la lluvia y la noche azul fría repiten el clima y la paleta de la Escena 1 textualmente, por lo que el corte se lee como el mismo mundo con minutos de diferencia.

La continuidad es repetición

Los modelos no tienen memoria entre generaciones. El único mecanismo de continuidad que controlas es la repetición palabra por palabra en los prompts. Elige un vocabulario pequeño por proyecto y reutilízalo mecánicamente:

  • Paleta: nombra dos o tres colores una vez ("azul grisáceo frío", "ámbar cálido") y úsalos en cada toma.
  • Clima y hora: "noche", "cortinas de lluvia" aparecen en ambos prompts anteriores. Quítalos y el segundo clip se convierte silenciosamente en una noche diferente.
  • Objetos recurrentes: si el haz del faro importa, aparece en el exterior y como luz en movimiento dentro del interior. Mismo objeto, diferente ángulo.
  • Ancla de estilo: una frase como "energía de documental dramático" en cada prompt mantiene la gradación y la textura consistentes incluso cuando los sujetos cambian.

Cortando clips de cuatro segundos

Planea renders de 4 segundos incluso cuando tu edición necesite tomas más largas. Los clips cortos se generan más rápido, fallan más barato y fuerzan la disciplina de una idea por toma. En la línea de tiempo, recorta cada clip a sus mejores 2.5-3.5 segundos para que el movimiento nunca se repita visiblemente o se detenga en los bordes. Corta en acción — manos girando una rueda, olas en plena explosión — y las costuras desaparecen. Para referencia de ritmo, secuencias sin diálogo como esta se sitúan cómodamente en un corte cada 2-4 segundos.

[Subject and setting], matching the scene's INT/EXT and time of day.
[One action from the script].
[Camera move] toward [target], [shot size], [palette words],
[style anchor phrase repeated from previous shots].
Una toma por prompt

Nunca pidas a una sola generación que cubra una escena completa. Un prompt que describe el faro, luego el interior, luego el guardián subiendo las escaleras produce un compromiso cambiante. Cada encabezado de escena produce su propio prompt; cada prompt produce una composición, un movimiento, una acción.

Solución de problemas

  • Las tomas parecen mundos diferentes — un detalle cambió entre prompts. Audita las palabras de paleta, clima y hora del día; deben coincidir carácter por carácter.
  • El clip contiene dos ubicaciones: el prompt cubría más de una toma. Divídelo en el encabezado de la escena y genera de nuevo.
  • El interior se siente desconectado del exterior: la toma de establecimiento no nombraba ningún destino. Termina los exteriores con un movimiento hacia lo que muestre el siguiente interior.
  • La secuencia se siente plana: cada toma usa el mismo tamaño. Alterna tomas de establecimiento amplias con primeros planos, de la misma manera que el guion alterna EXT/INT.
  • El movimiento se detiene antes de que termine el corte: no se definió un estado final. Agrega una cláusula de "asentamiento" ("se asienta sobre la lente giratoria") para que los últimos fotogramas mantengan una imagen estable.

Redacta tu desglose de escenas, convierte cada encabezado con el esqueleto y ejecuta las tomas una al lado de la otra en /studio antes de comprometerte con los renders finales. Para el vocabulario de movimientos de cámara con el que rellenar el esqueleto, consulta /tools/cinematic-cameras.

Try these prompts on your own shot.

Every example on this page was generated with ManifoldGen. Open the Studio and run the same structure on your idea.

Open Studio