Guía para crear videos épicos con IA
Tu protagonista cambia de cara entre tomas. Es un problema de mecanismo, no de prompt. Las tres cosas que realmente mantienen a un personaje intacto de una toma a otra.
En resumen
Los personajes cambian entre tomas de video con IA porque cada generación los reinventa a partir del texto, y el texto es una descripción imprecisa de un rostro. Tres mecanismos lo resuelven: las imágenes de referencia, compatibles con 12 modelos de video; el primer y último fotograma, compatible con Seedance 2.0 y 2.0 Fast; y la cadena, en la que cada segmento lleva el clip terminado del segmento anterior y continúa desde su último fotograma. Define primero al personaje, porque todas las tomas posteriores lo heredan.
Tu protagonista tiene una cicatriz en la mejilla izquierda en la primera toma, ninguna cicatriz en la segunda y una chaqueta distinta en la cuarta.
Ese es el verdadero problema del video con IA, y no es un problema de prompt. Puedes escribir la descripción de personaje más precisa del mundo y la siguiente generación seguirá desviándose, porque cada generación parte de cero y reinventa a tu personaje a partir de las palabras.
Épico significa varias tomas que pertenecen al mismo mundo. Así que todo el oficio consiste en la continuidad, y la continuidad es una cuestión de mecanismo, no de redacción.
Esto es lo que realmente mantiene a un personaje intacto de una toma a otra.
Por qué repetir la descripción no funciona
El consejo habitual es ponerle nombre al personaje y repetir su ropa en cada prompt.
Ayuda un poco. No puede resolver el problema, porque el texto es una descripción imprecisa de un rostro. "Mujer de cabello oscuro, unos treinta y cinco años, chaqueta de cuero" describe a millones de personas, y el modelo elige a una distinta cada vez.
Cada toma generada solo a partir de texto es una suposición nueva. La consistencia requiere que el modelo vea el resultado anterior, no que lea sobre él.
Los tres mecanismos que realmente funcionan
Imágenes de referencia. Dale al modelo una imagen del personaje, no una descripción. Trece modelos admiten referencia a video, entre ellos Seedance 2.0 y 2.5, Veo 3.1, Wan 2.7, 3.0 y 3.0 Prime, Kling 3.0 Motion Control, MiniMax H3 y Gemini Omni Flash. La referencia viaja con la solicitud, de modo que el rostro se muestra en lugar de describirse.
Primer y último fotograma. Dos modelos, Seedance 2.0 y Seedance 2.0 Fast, aceptan tanto un fotograma inicial como uno final y generan el movimiento entre ambos. Pásale a la segunda toma el último fotograma de la primera y el corte se vuelve continuo en lugar de un salto.
La cadena. El más potente de los tres, y la razón por la que existe el Long Video Generator.
Cómo funciona la cadena
El primer segmento se genera a partir de tus referencias de personaje. Cada segmento posterior lleva el clip terminado del segmento anterior como referencia de video y continúa desde su último fotograma. Las referencias de personaje también acompañan a cada segmento.
Así, cada toma ve dos cosas: quiénes son los personajes y cómo se veía exactamente el mundo un momento antes. Tanto la identidad como el entorno se mantienen continuos, porque después de la primera toma nada se reinventa desde cero.
Esa es la diferencia entre cuatro clips de una persona parecida y una sola pieza continua. Funciona con Seedance 2.5, y la guía completa está en cómo hacer videos largos con IA.
Un flujo de trabajo que se sostiene
Define al personaje antes de generar cualquier movimiento. Primero consigue una imagen del personaje que te convenza. Todas las tomas posteriores la heredan, así que una referencia mediocre se propaga por toda la pieza. Este es el paso en el que vale la pena invertir tiempo de verdad.
Decide si necesitas tomas o una secuencia. Las escenas independientes que cortan entre ubicaciones van mejor con el Series Generator. Una acción continua va mejor con el Long Video Generator y su cadena. Elegir mal te cuesta volver a generar, así que elige con intención.
Prueba un segmento antes de comprometerte con ocho. Genera el primero, examina con atención el último fotograma y continúa solo si está bien, porque en una cadena cada segmento posterior hereda ese fotograma. Un defecto en el primer segmento es un defecto en todos.
Dirige la cámara por separado del sujeto. Kling 3.0 Motion Control y Control de movimiento existen exactamente para esto. Describir el movimiento de cámara dentro de un prompt sobre el sujeto suele no darte ni una cosa ni la otra.
Agrega los diálogos al final. Genera lo visual y luego llévalo a Sincronización labial. Hacerlo al revés significa que cualquier regeneración tira a la basura el trabajo de sincronización.
Sobre el costo en créditos, y por qué ningún artículo debería citarlo
Encontrarás guías que enumeran costos exactos en créditos por modelo y por segundo. Tómalas como ficción.
Los costos cambian con los modelos, los proveedores y las campañas. Y lo más importante: la app obtiene el precio real del servidor antes de que generes; ves la cifra real para tu configuración real, no una estimación que alguien anotó hace meses.
Revisa la cotización en la herramienta. Los precios actuales de los paquetes están en la página de precios. Todo lo demás es una suposición disfrazada de especificación.
Elegir un modelo sin una tabla de benchmarks falsa
Nadie tiene una puntuación fiable de consistencia entre modelos, y todo artículo que publica una con dos decimales se la inventó. Lo que sí existe son capacidades y comportamiento.
Acción continua, un solo mundo: Seedance 2.5 a través de la cadena. Creado exactamente para esto.
Tomas independientes a partir de una referencia de personaje: cualquiera de los trece modelos de referencia a video. Seedance, Veo 3.1 y Wan son los que más se usan.
Trabajo de cámara deliberado: Kling 3.0 Motion Control.
Unir dos fotogramas conocidos: Seedance 2.0 o 2.0 Fast, los únicos dos con primer y último fotograma.
Velocidad mientras exploras: las variantes Fast y Turbo: Seedance 2.0 Fast, Kling 3.0 Turbo, Veo 3.1 Fast. Explora barato, termina caro.
La lista completa está en Modelos. Hay cuarenta y cuatro modelos de video disponibles, y el adecuado depende de cuál de los casos anteriores estés trabajando.
Acabado final
Mejora la resolución después de editar, no antes, con el Video Upscaler. Mejorar la resolución y luego cortar significa pagar por nitidez en fotogramas que vas a descartar.
Subtítulos automáticos para todo lo que vaya a redes sociales, ya que la mayor parte se ve sin sonido. Shorts Generator para cortar versiones verticales de la pieza terminada. Motion Poster si necesitas un arte principal en movimiento con el mismo personaje.
La parte que sigue siendo oficio
Nada de esto sustituye saber para qué sirve la toma.
Los mecanismos anteriores mantienen estable a un personaje. No deciden dónde debe estar la cámara, cuánto sostener el plano ni de qué trata la escena. La continuidad es el piso, no el techo, y es el piso que la mayoría del video con IA nunca alcanza, por eso resolverla merece tanta atención.
Define al personaje, encadena las tomas y las herramientas dejarán de pelear contigo. Lo que queda es el trabajo de verdad.
Preguntas frecuentes
¿Por qué mis personajes de video con IA cambian entre tomas?▾
Porque cada generación parte de cero y reinventa al personaje a partir de tus palabras. El texto es una descripción imprecisa de un rostro: "mujer de cabello oscuro, unos treinta y cinco años, chaqueta de cuero" describe a millones de personas, así que el modelo elige a una distinta cada vez. La consistencia requiere que el modelo vea el resultado anterior en lugar de leer sobre él.
¿Sirve repetir la descripción del personaje en cada prompt?▾
Un poco, pero no resuelve el problema. Repetir la ropa y el nombre orienta al modelo, pero cada toma generada solo a partir de texto sigue siendo una suposición nueva. Las imágenes de referencia, el primer y último fotograma o la cadena son lo que realmente mantiene la identidad entre tomas.
¿Qué es la cadena en el Long Video Generator?▾
El primer segmento se genera a partir de tus referencias de personaje. Cada segmento posterior lleva el clip terminado del segmento anterior como referencia de video y continúa desde su último fotograma, y las referencias de personaje acompañan a todos los segmentos. Tanto la identidad como el entorno se mantienen continuos, porque después de la primera toma nada se reinventa desde cero.
¿Qué modelos admiten imágenes de referencia de personajes?▾
Trece modelos de video admiten referencia a video, entre ellos Seedance 2.0 y 2.5, Veo 3.1 y Veo 3.1 Lite, Wan 2.7, Wan 3.0 y Wan 3.0 Prime, Kling 3.0 Motion Control, MiniMax H3, Happy Horse y Gemini Omni Flash. La referencia viaja con la solicitud, de modo que el rostro se muestra en lugar de describirse.
¿Cómo hago que una toma continúe a partir de otra?▾
Usa primer y último fotograma, compatible con Seedance 2.0 y Seedance 2.0 Fast. Dale el último fotograma de la toma anterior como fotograma inicial y generará el movimiento entre ese y tu fotograma final, así el corte es continuo en lugar de un salto.
¿Cuántos créditos cuesta una secuencia consistente?▾
Ningún artículo debería decírtelo, porque los costos cambian con los modelos, los proveedores y las campañas. La app obtiene el precio real del servidor antes de que generes, así ves la cifra real para tu configuración real. Revisa la cotización en la herramienta y consulta la página de precios para ver los precios actuales de los paquetes.
¿Debo usar el Series Generator o el Long Video Generator?▾
Las escenas independientes que cortan entre ubicaciones van mejor con el Series Generator. Una acción continua va mejor con el Long Video Generator y su cadena. Elegir mal cuesta volver a generar, así que decide qué forma tiene tu pieza antes de empezar.
