Skip to main content
POST

Autorización

string
requerido
Todos los endpoints de la API requieren autenticación mediante Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyAñádala al encabezado de la solicitud:

Modos de generación

MiniMax-H3 enruta automáticamente al modo correspondiente según los campos de la solicitud. No necesita el campo mode:
Exclusión mutua estricta: los campos de image-to-video (first_frame_image / last_frame_image, y first_frame / last_frame en image_with_roles) no pueden combinarse con los campos de referencia multimodal (image_urls, video_urls, audio_urls, y reference_image en image_with_roles). Mezclarlos devuelve 400.
El audio por sí solo no está permitido. Si envía audio_urls, también debe proporcionar al menos una imagen de referencia o un video de referencia.

Parámetros de la solicitud

Campos generales

string
requerido
Valor fijo: MiniMax-H3
model es obligatorio y debe enviarse de forma explícita. Los clientes ya integrados con Hailuo pueden cambiar configurando model a MiniMax-H3.
string
requerido
Descripción del contenido del video. Obligatorio y no vacío en todos los escenarios, máximo 7000 caracteres por solicitud.Describa la escena, el sujeto, el movimiento y el estilo con detalle para obtener mejores resultados.Ejemplo: "A boy playing basketball by the sea at dusk, waves crashing, cinematic camera work"
integer
predeterminado:"5"
Duración de salida (segundos)
  • Rango: entero de 4 a 15
  • Por defecto: 5
string
predeterminado:"2K"
Resolución del video
  • Valor soportado: solo 2K (por defecto)
string
Proporción de aspecto. También puede enviar size o ratio con el mismo efecto.Proporciones permitidas: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16El comportamiento por escenario se describe en “Reglas de proporción de aspecto” más abajo.
boolean
predeterminado:"false"
Si se debe añadir una marca de agua AIGCPor defecto: falseAlias compatible: aigc_watermark
string
URL que recibe un push cuando la tarea alcanza un estado terminal (éxito / fallo)
Use webhook. No envíe el callback_url oficial. callback_url está reservado para uso interno y no se acepta de los usuarios.

Campos de image-to-video

Para image-to-video de primer / último fotograma, especifique los roles de forma explícita. No infiera a partir del recuento de image_urls.
string
URL de la imagen del primer fotogramaCuando se proporciona, esta imagen se utiliza como el fotograma inicial del video.
string
URL de la imagen del último fotogramaCuando se proporciona, esta imagen se utiliza como el fotograma final. Combínela con first_frame_image para el control de primer+último fotograma.

Campos de referencia multimodal

string[]
Array de URLs de imágenes de referencia
Cada imagen en image_urls se trata como una imagen de referencia (reference_image), independientemente del recuento. Nunca se mapean automáticamente a primer / primer+último fotograma según la longitud.
  • Cantidad: ≤ 9
string[]
Array de URLs de videos de referencia
  • Cantidad: ≤ 3
  • Formato y límites: consulte “Límites de medios de entrada” más abajo
string[]
Array de URLs de audio de referencia
  • Cantidad: ≤ 3
  • No puede usarse solo; debe emparejarse con una imagen de referencia o un video de referencia

Array de imágenes compartido (formulario opcional)

object[]
Array de imágenes con rol etiquetado. Puede reemplazar first_frame_image / last_frame_image / image_urls. Cada elemento:Ejemplo (primer + último fotograma):
Ejemplo (imagen de referencia):

Reglas de proporción de aspecto

Proporciones concretas permitidas: 21:9, 16:9, 4:3, 1:1, 3:4, 9:16.

Límites de medios de entrada

Tamaño total del cuerpo de la solicitud ≤ 64 MB. Use URLs públicas para archivos grandes; no use Base64.

Imágenes

Video (solo referencia multimodal)

Audio (solo referencia multimodal)

Restricciones de parámetros

Las infracciones se rechazan con 400 (el contenido sensible puede devolver 422) y no se facturan:

Respuesta

integer
Código de estado de la respuesta, 200 en caso de éxito
array
Array de datos de la respuesta

Ejemplos de solicitud

Caso 1: Text-to-Video

Caso 2: Image-to-Video — Primer fotograma

Caso 3: Image-to-Video — Primer + último fotograma

Caso 4: Referencia multimodal a video

Caso 5: Primer + último fotograma mediante image_with_roles

Consultar resultados de la tareaLa generación de video es asíncrona y devuelve un task_id al enviarse. Use el endpoint Obtener estado de la tarea para consultar el progreso y los resultados.Intervalo de sondeo recomendado: cada 5 ~ 10 segundos. Tiempo de espera del cliente: 15 minutos. En caso de éxito, result.videos[0].url es la URL mp4. Las URLs de video caducan en aproximadamente 24 horas — guárdelas a tiempo. Las tareas fallidas se reembolsan automáticamente.