MiniMax H3
⧉Modelo de vídeo MiniMax H3 (Hailuo 03): salida en 1080P, audio nativo generado siempre, de 5 a 15 segundos de segundo en segundo y seis relaciones de aspecto. Texto a vídeo sin imagen de referencia, imagen a vídeo con una (usada como primer fotograma). Asíncrono: envías y luego consultas el id del trabajo para obtener un enlace mp4 estable rehospedado. Facturado por segundo; los trabajos fallidos se reembolsan íntegramente.
Prueba en directo · Playground
Prueba MiniMax H3 aquí mismo (disponible tras iniciar sesión)。
Input
VídeoOutput
videoAcerca de MiniMax H3
MiniMax H3 (Hailuo 03) es el modelo de vídeo de mayor resolución de aquí: salida en 1080P con audio nativo siempre activo. La duración es cualquier entero de 5 a 15 segundos en seis relaciones de aspecto; omite la imagen de referencia para texto a vídeo e inclúyela (primer fotograma por defecto) para imagen a vídeo. Trabajo asíncrono: POST /v1/videos/generations devuelve al instante HTTP 202 y un id de trabajo; consulta GET /v1/videos/jobs/{id} hasta status=succeeded y lee data[0].url. Ese enlace es un mp4 rehospedado por nosotros, así que no caduca como sí lo hace el enlace de la CDN del proveedor.
Casos de uso
1920x1088, con el mejor detalle por fotograma y la mejor iluminación de todos los modelos de vídeo de la plataforma.
El audio nativo se genera siempre sin parámetros adicionales, lo que elimina todo un paso de producción.
Resolvió un travelling que encadena con una inclinación rápida y termina en contrapicado, así que encaja con trabajos que tienen un guion de planos real.
Con la referencia como primer fotograma, el sujeto y la composición se mantienen estables: va bien para poner en movimiento arte conceptual.
Cómo elegir
Elígelo cuando quieras resolución, audio nativo o una coreografía de cámara completa. Para más de 15 segundos usa seedance-2.5; para apagar la banda sonora o partir de un vídeo de origen, usa la línea Seedance. También es el que más tarda en renderizar de todos (unos 11 minutos para un clip de 15 segundos), así que usa seedance-2.0-fast cuando importe la velocidad.
Preguntas frecuentes
¿Puedo desactivar el audio?
¿Por qué tarda tanto?
¿Cómo funciona imagen a vídeo?
¿Cómo se factura y se me cobra si falla?
Modelos relacionados
Descubre otros modelos que puedes integrar.
GPT-5.6 Sol
Buque insignia de frontera para programación agéntica
GPT-5.6 Terra
Modelo equilibrado de programación agéntica para el día a día
GPT-5.6 Luna
Modelo rápido y económico de programación agéntica
GPT-5.5
Modelo insignia de chat y razonamiento
GPT-6 Astra
Buque insignia de nueva generación de OpenAI · contexto de 1,05M
GPT Image 2
Modelo de alta calidad para texto a imagen e imagen a imagen
GPT Image 2.5 Flare
Modelo de imagen de nueva generación · limpio y suave
GPT Image 2.5 Sunburst
Modelo de imagen de nueva generación · más textura
Nano Banana 2
Modelo de alta calidad para texto a imagen e imagen a imagen
Nano Banana Pro
Modelo insignia para texto a imagen e imagen a imagen
Claude Sonnet 4.6
Modelo equilibrado y eficiente para chat y código
Claude Opus 5
Buque insignia de nueva generación de Anthropic
Claude Fable 5
Serie Fable de Anthropic · narrativa y textos largos
Gemini 3.1 Pro
Modelo insignia de razonamiento de nueva generación de Google
Gemini 3.8 Flash
El Flash más reciente · razonamiento adaptativo
Gemini 3.7 Flash
Flash anterior · razonamiento adaptativo
Gemini 3.6 Flash
Modelo rápido de nueva generación · cuatro presupuestos de razonamiento
Gemini 3.6 Flash High
Nivel de razonamiento profundo
Gemini 3.6 Flash Low
El nivel más rápido y económico
Gemini 3.6 Flash Tiered
Razonamiento por niveles automático
Gemini 3 Flash
Modelo de chat rápido, de baja latencia y económico
Gemini 3.5 Flash
Modelo rápido con razonamiento de nueva generación
Gemini 2.5 Flash
Chat rápido, de baja latencia y económico
Veo 3.1
Texto / imagen a vídeo · varios niveles · varias resoluciones
Seedance 2.5
Texto / imagen a vídeo · hasta 30 segundos
Seedance 2.0
Texto / imagen a vídeo · de 5 a 15 segundos
Seedance 2.0 Fast
Baja latencia · el coste más bajo
Seedance 2.0 Mini
Nivel de entrada · el coste más bajo
Wan 3.0
Un endpoint, cinco modos · hasta 30 segundos
Wan 3.0 Prime
Las mismas capacidades · varias veces más rápido
Grok Imagine Video 1.5
Facturado por clip · hasta 15 segundos