Cómo crear un video de 5 segundos
No existe un control deslizante de intensidad de movimiento. El prompt es tu superficie de control, así que aquí te explicamos cómo escribir uno que te dé un clip de cinco segundos utilizable al segundo intento.

En resumen
En los 37 modelos de generación de video, los controles reales son el prompt, la duración, la relación de aspecto y la resolución, además de una imagen de referencia, un prompt negativo o un primer y último fotograma en algunos modelos. No hay ajuste de intensidad de movimiento, escala de guía ni interpolación, así que el prompt hace casi todo el trabajo. Elige la duración y la relación de aspecto antes de generar, escribe el prompt como una sola acción describiendo la cámara, explora con una variante Fast y termina con el modelo completo.
No existe un control deslizante de intensidad de movimiento. Tampoco escala de guía, ni motion bucket, ni ajuste de interpolación de fotogramas.
En los 37 modelos de generación de video de la plataforma, los controles que realmente tienes son: prompt, duración, relación de aspecto y resolución, y, según el modelo, una imagen de referencia, un prompt negativo o un primer y último fotograma.
Esa es toda la superficie. Y eso importa muchísimo para un clip de cinco segundos, porque significa que el prompt hace casi todo el trabajo, y cada minuto que pasas buscando un control deslizante es un minuto que no dedicas a corregir la frase.
Así es como se consigue de verdad un buen video de cinco segundos.
Decide la forma antes de generar
Dos ajustes que eliges una sola vez y que no puedes corregir después sin volver a generar:
Duración. Cinco segundos es el punto ideal por una razón. Los modelos de video mantienen la coherencia en tramos cortos y la pierden en los largos, así que un clip de cinco segundos es donde obtienes la mejor calidad de movimiento por crédito.
Relación de aspecto. Elige vertical desde el principio si el clip va para Reels, Shorts o TikTok. Recortar un clip 16:9 a 9:16 después descarta dos tercios del encuadre y todas las decisiones de composición que tomó el modelo.
Equivocarse en esto es la razón más común por la que un primer intento termina en la basura.
Escribe el prompt como una lista de planos
Como el prompt es la superficie de control, estructúralo como un director describe un plano: el sujeto, luego lo que hace y después cómo está iluminado y encuadrado.
"Un frasco de perfume gira lentamente sobre una superficie negra reflectante, softbox cenital, poca profundidad de campo, la cámara permanece quieta."
Tres cosas hacen que los prompts cortos funcionen:
Una acción, no tres. En cinco segundos cabe un solo movimiento. Un prompt que pide un paneo, un zoom y un giro del sujeto te da un desastre apresurado de los tres.
Di lo que hace la cámara. "La cámara permanece quieta" es una instrucción. Si la omites, el modelo inventa movimiento, y de ahí viene la mayor parte de la deriva.
Describe el estado final. "El último fotograma se detiene en la etiqueta" le da al modelo un lugar donde aterrizar en vez de cortar a mitad del movimiento.
Cuando un modelo acepta un prompt negativo, esa es la verdadera palanca para eliminar cosas: temblor, artefactos de texto, extremidades de más. Es un parámetro real, a diferencia de los controles deslizantes que inventan otras guías.
Empieza con la herramienta adecuada
Texto a video para un clip desde cero. Video Generator es el espacio de trabajo más amplio sobre el mismo catálogo.
Si ya tienes una imagen fija que te gusta, imagen a video la anima, lo que suele ser un camino más rápido hacia un estilo concreto que describir ese estilo desde cero.
Si sabes exactamente dónde empieza y termina la toma, primer a último fotograma genera el movimiento entre dos imágenes que tú aportas. Solo Seedance 2.0 y Seedance 2.0 Fast lo admiten, y es la opción más controlable de la plataforma para un clip corto.
Elige un modelo por su comportamiento, no por una tabla de benchmarks
Encontrarás artículos con tablas que enumeran tiempos de generación y tamaños de archivo por modelo. Esas cifras son inventadas y, de todos modos, quedarían desactualizadas. La velocidad varía con la carga y el tamaño del archivo varía con el contenido.
Lo que sí es estable es el comportamiento:
- Variantes Fast y Turbo (Seedance 2.0 Fast, Kling 3.0 Turbo, Veo 3.1 Fast) para explorar. Intentos baratos, respuestas rápidas.
- Modelos completos (Seedance 2.5, Kling 3.0, Veo 3.1) cuando el prompt ya esté bien.
- Trabajo basado en referencias: cualquiera de los trece modelos que aceptan una imagen de referencia, cuando un rostro o producto concreto debe seguir siendo el mismo.
Explora con los baratos y termina con el caro. El catálogo completo está en Modelos, y la app te muestra el costo de cada generación antes de confirmar, así que nunca tienes que adivinar.
Itera sobre el prompt, no sobre los ajustes
Cuando un clip sale mal, el instinto es buscar una perilla. No la hay. Cambia la frase.
| Qué salió mal | Qué cambiar |
|---|---|
| La cámara se desplaza cuando debería estar fija | Añade "cámara estática" o "plano fijo" |
| El movimiento es frenético | Describe una acción más lenta, no una duración más corta |
| El sujeto se deforma a mitad del clip | Usa imagen a video a partir de una imagen fija que ya te guste |
| Aparece algo indeseado en el encuadre | Ponlo en el prompt negativo si el modelo lo admite |
| Termina a mitad de un movimiento | Describe explícitamente el último fotograma |
Volver a generar con una frase mejor es mejor que volver a generar con la misma frase y esperanza. Los modelos son estocásticos, así que una segunda tirada de los mismos dados a veces ayuda, pero es la forma cara de arreglar un problema de prompt.
Sonido, subtítulos y el último tramo
El video generado es mudo, a menos que el modelo admita generate_audio y lo hayas pedido.
Music Generation te da una base musical que no hará que silencien tu publicación por derechos de autor. Auto Captions incrusta el texto, algo que no es opcional en redes sociales, porque la mayoría del contenido se ve sin sonido; un clip sin subtítulos es un clip mudo para casi toda la audiencia.
Si vas a recortar de algo más largo en lugar de generar, Shorts Generator encuentra clips y renderiza subtítulos palabra por palabra, colocados arriba, en el centro o abajo.
Todo lo que generas está en el Historial, que es adonde debes ir cuando un cliente te pide "el de la semana pasada", en vez de intentar reproducirlo a partir de una semilla.
Cinco minutos realistas
- Decide la duración y la relación de aspecto.
- Escribe el prompt como una lista de planos, con una sola acción.
- Genera con una variante Fast. Míralo con honestidad.
- ¿Está mal? Reescribe la frase, no los ajustes. Repite hasta que la forma sea la correcta.
- ¿Está bien? Vuelve a generar una vez con el modelo completo.
- Subtítulos, música si hace falta, y listo.
La mayor parte del tiempo se va en el paso 4, y es justo donde debe estar.
Lo que cinco segundos no pueden hacer
No pueden contar una historia con principio y final. Pueden mostrar una sola cosa sucediendo, con claridad.
Los clips que funcionan con esta duración son un producto girando, un logotipo formándose, un rostro reaccionando, una puerta abriéndose. Los que fallan son los que intentan comprimir una narrativa en una duración que no tiene espacio para ella.
Si necesitas una secuencia, genera varios clips cortos y móntalos juntos en lugar de pedirle a una sola generación que lo cubra todo. Los clips cortos fallan barato y se montan bien. Los largos pierden la coherencia a la mitad y cuestan más cuando eso ocurre.
Preguntas frecuentes
¿Qué ajustes puedo controlar realmente al generar un video?▾
El prompt, la duración, la relación de aspecto y la resolución en la mayoría de los modelos, además de una imagen de referencia, un prompt negativo o un primer y último fotograma según el modelo. Ninguno de los 37 modelos de generación de video tiene ajustes de intensidad de movimiento, escala de guía, motion bucket ni interpolación de fotogramas, así que las guías que enumeran esos valores describen controles que no existen.
¿Cómo evito que la cámara se mueva cuando quiero un plano estático?▾
Dilo en el prompt. "Cámara estática" o "plano fijo" es una instrucción que el modelo sigue. Si no especificas el movimiento de cámara, el modelo se lo inventa, y de ahí viene la mayor parte de la deriva no deseada.
¿Por qué mi clip de cinco segundos se ve apresurado?▾
Normalmente porque el prompt pide más de una acción. En cinco segundos cabe un solo movimiento. Un prompt que pide un paneo, un zoom y un giro del sujeto produce una versión apresurada de los tres. Describe una sola acción y el estado final en el que quieres que termine el clip.
¿Debo elegir vertical u horizontal antes de generar?▾
Antes. La relación de aspecto se elige al generar, y recortar después descarta la mayor parte del encuadre junto con la composición que eligió el modelo. Si el clip va para Reels, Shorts o TikTok, genera en vertical desde el principio.
¿Qué modelo debo usar para un clip corto?▾
Explora con una variante Fast o Turbo como Seedance 2.0 Fast, Kling 3.0 Turbo o Veo 3.1 Fast, y luego vuelve a generar una vez con el modelo completo cuando el prompt esté listo. Para un rostro o producto concreto usa uno de los trece modelos de referencia a video, y para puntos de inicio y fin precisos usa Seedance 2.0 o 2.0 Fast, los únicos dos que admiten primer y último fotograma.
Mi clip salió mal. ¿Qué debo cambiar?▾
La frase, no los ajustes, porque no hay ajustes que afinar. Añade una instrucción de cámara si hay deriva, describe una acción más lenta si el movimiento es frenético, parte de una imagen fija con imagen a video si el sujeto se deforma y describe explícitamente el último fotograma si termina a mitad de un movimiento.
¿Un video generado tiene sonido?▾
No, a menos que el modelo admita generación de audio y lo hayas pedido. De lo contrario el clip es mudo, y puedes añadir una pista con Music Generation. En redes sociales, los subtítulos de Auto Captions importan más que la música, porque la mayoría de los videos cortos se ven sin sonido.