NezhaGate
Vídeo

MiniMax H3

minimax-h3

Modelo de vídeo MiniMax H3 (Hailuo 03): salida en 1080P, audio nativo generado siempre, de 5 a 15 segundos de segundo en segundo y seis relaciones de aspecto. Texto a vídeo sin imagen de referencia, imagen a vídeo con una (usada como primer fotograma). Asíncrono: envías y luego consultas el id del trabajo para obtener un enlace mp4 estable rehospedado. Facturado por segundo; los trabajos fallidos se reembolsan íntegramente.

Texto a vídeoImagen a vídeo1080PAudio nativo

Prueba en directo · Playground

Prueba MiniMax H3 aquí mismo (disponible tras iniciar sesión)。

Input

Vídeo
0 / 2000 bytes
Con varias referencias, menciónalas en el prompt como @Image1 / @Image2; por ejemplo: «el personaje de @Image1 aparece en la escena de @Image2». Sin esas marcas, el modelo decide por su cuenta.
El render suele tardar entre 5 y 20 minutos; si el backend está saturado puede superar los 60 (esperamos hasta 90). Consulta el id del trabajo en lugar de reenviarlo: cada reenvío se factura por separado. Se factura por segundo y se reembolsa íntegramente si falla. Límite del prompt: 2000 bytes (unos 666 caracteres chinos).

Output

video
Los resultados aparecerán aquí al ejecutar.

Acerca de MiniMax H3

MiniMax H3 (Hailuo 03) es el modelo de vídeo de mayor resolución de aquí: salida en 1080P con audio nativo siempre activo. La duración es cualquier entero de 5 a 15 segundos en seis relaciones de aspecto; omite la imagen de referencia para texto a vídeo e inclúyela (primer fotograma por defecto) para imagen a vídeo. Trabajo asíncrono: POST /v1/videos/generations devuelve al instante HTTP 202 y un id de trabajo; consulta GET /v1/videos/jobs/{id} hasta status=succeeded y lee data[0].url. Ese enlace es un mp4 rehospedado por nosotros, así que no caduca como sí lo hace el enlace de la CDN del proveedor.

Casos de uso

Salida en alta definición

1920x1088, con el mejor detalle por fotograma y la mejor iluminación de todos los modelos de vídeo de la plataforma.

Clips con sonido, sin pasada de audio

El audio nativo se genera siempre sin parámetros adicionales, lo que elimina todo un paso de producción.

Coreografía de cámara completa

Resolvió un travelling que encadena con una inclinación rápida y termina en contrapicado, así que encaja con trabajos que tienen un guion de planos real.

Imagen a vídeo

Con la referencia como primer fotograma, el sujeto y la composición se mantienen estables: va bien para poner en movimiento arte conceptual.

Cómo elegir

Elígelo cuando quieras resolución, audio nativo o una coreografía de cámara completa. Para más de 15 segundos usa seedance-2.5; para apagar la banda sonora o partir de un vídeo de origen, usa la línea Seedance. También es el que más tarda en renderizar de todos (unos 11 minutos para un clip de 15 segundos), así que usa seedance-2.0-fast cuando importe la velocidad.

Preguntas frecuentes

¿Puedo desactivar el audio?
No. Este modelo genera siempre audio nativo, y audio=false se rechaza explícitamente en lugar de ignorarse en silencio. Para clips mudos usa la línea Seedance con audio=false.
¿Por qué tarda tanto?
1080P con audio nativo es sencillamente pesado: alrededor de 4 minutos para 5 segundos y 11 minutos para 15. Es un trabajo asíncrono, así que te quedas con un id de trabajo y lo consultas; no se mantiene ninguna conexión abierta.
¿Cómo funciona imagen a vídeo?
Pasa una imagen (URL pública, data: URI o base64). Por defecto se convierte en el primer fotograma, de modo que el clip conserva el sujeto y el encuadre de la referencia. Una segunda imagen pasa a ser el último fotograma; pon image_role=reference para cambiar al modo de referencia de sujeto o estilo. Los modos de primer/último fotograma y de referencia son mutuamente excluyentes.
¿Cómo se factura y se me cobra si falla?
Se factura por segundo: la retención que se hace al enviar se calcula con la duración que pediste y el cargo final es exactamente ese mismo número. Un render fallido o caducado devuelve la retención completa, así que nunca pagas por un clip que no recibiste.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

Buque insignia de frontera para programación agéntica

$2.00/1M entrada · $12.00/1M salida ↓75% Ver →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

Modelo equilibrado de programación agéntica para el día a día

$1.20/1M entrada · $7.00/1M salida ↓77% Ver →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

Modelo rápido y económico de programación agéntica

$0.80/1M entrada · $4.80/1M salida ↓68% Ver →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

Modelo insignia de chat y razonamiento

$0.70/1M entrada · $4.20/1M salida ↓86% Ver →
GPT-6 Astra Chat

GPT-6 Astra

gpt-6-astra

Buque insignia de nueva generación de OpenAI · contexto de 1,05M

$2.80/1M entrada · $14.00/1M salida ↓72% Ver →
GPT Image 2 Imagen

GPT Image 2

gpt-image-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.015/img y más Ver →
GPT Image 2.5 Flare Imagen

GPT Image 2.5 Flare

gpt-image-2.5-flare

Modelo de imagen de nueva generación · limpio y suave

$0.015/img y más Ver →
GPT Image 2.5 Sunburst Imagen

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

Modelo de imagen de nueva generación · más textura

$0.015/img y más Ver →
Nano Banana 2 Imagen

Nano Banana 2

nano-banana-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.025/img y más Ver →
Nano Banana Pro Imagen

Nano Banana Pro

nano-banana-pro

Modelo insignia para texto a imagen e imagen a imagen

$0.040/img y más Ver →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

Modelo equilibrado y eficiente para chat y código

$1.50/1M entrada · $7.50/1M salida ↓50% Ver →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Buque insignia de nueva generación de Anthropic

$4.00/1M entrada · $20.00/1M salida Ver →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Serie Fable de Anthropic · narrativa y textos largos

$8.00/1M entrada · $40.00/1M salida Ver →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Modelo insignia de razonamiento de nueva generación de Google

$0.50/1M entrada · $3.00/1M salida ↓75% Ver →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

El Flash más reciente · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

Flash anterior · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

Modelo rápido de nueva generación · cuatro presupuestos de razonamiento

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

Nivel de razonamiento profundo

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

El nivel más rápido y económico

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

Razonamiento por niveles automático

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

Modelo de chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓57% Ver →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

Modelo rápido con razonamiento de nueva generación

$0.45/1M entrada · $2.70/1M salida ↓70% Ver →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

Chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓46% Ver →
Veo 3.1 Vídeo

Veo 3.1

veo-3.1

Texto / imagen a vídeo · varios niveles · varias resoluciones

$0.075/clip+ Ver →
Seedance 2.5 Vídeo

Seedance 2.5

seedance-2.5

Texto / imagen a vídeo · hasta 30 segundos

$0.158/s Ver →
Seedance 2.0 Vídeo

Seedance 2.0

seedance-2.0

Texto / imagen a vídeo · de 5 a 15 segundos

$0.150/s Ver →
Seedance 2.0 Fast Vídeo

Seedance 2.0 Fast

seedance-2.0-fast

Baja latencia · el coste más bajo

$0.100/s Ver →
Seedance 2.0 Mini Vídeo

Seedance 2.0 Mini

seedance-2.0-mini

Nivel de entrada · el coste más bajo

$0.066/s Ver →
Wan 3.0 Vídeo

Wan 3.0

wan3.0-video

Un endpoint, cinco modos · hasta 30 segundos

$0.120/s Ver →
Wan 3.0 Prime Vídeo

Wan 3.0 Prime

wan3.0-video-prime

Las mismas capacidades · varias veces más rápido

$0.160/s Ver →
Grok Imagine Video 1.5 Vídeo

Grok Imagine Video 1.5

grok-imagine-video-1.5

Facturado por clip · hasta 15 segundos

$0.300/clip+ Ver →