MiniMax H3 Max para insertar una escena en un vídeo existente: elige dónde empieza la nueva escena y dónde se retoma el original, descríbela (con imágenes de referencia si quieres) y recibe el vídeo completo con una escena generada de 5 a 13 segundos, en 480p o 768p.
~1-3 min
curl https://www.flixly.ai/api/v1/generate \
-H "Authorization: Bearer flx_live_..." \
-H "Content-Type: application/json" \
-d '{
"model": "h3-max-insert",
"prompt": "A beautiful sunset over the ocean",
"type": "VIDEO_TO_VIDEO"
}'Consigue tu clave de API en el portal para desarrolladores.
Modelo de generación de vídeo premium con audio nativo
El modelo de vídeo más reciente de ByteDance. Genera hasta 30 segundos en una sola toma con audio sincronizado —diálogo, música y efectos en la misma pasada— a partir de un Prompt, un fotograma inicial o hasta 50 referencias de imagen, vídeo y audio.
El nivel premium de Wan 3.0 de Alibaba: entrega más rápida, movimiento cinematográfico y mayor continuidad visual. Modos de texto, imagen y referencia, clips nativos de 30 segundos en una sola pasada, con audio.
MiniMax H3 con post-entrenamiento, #1 en calidad general, comprensión del Prompt y estética frente a los principales modelos de vídeo. Clips de 5-15 segundos en 480p, 768p o 1080p nativos a partir de un Prompt, un fotograma inicial o hasta 9 imágenes de referencia, 3 clips de movimiento y 3 clips de audio. Referencia a vídeo ya disponible de forma general: hasta 2x más rápido, con una preservación del sujeto mucho mayor.