MiniMax-H3
MiniMax-H3 Context-IR mejora de prompt
- Comprensión multimodal del contexto que produce un prompt estructurado mejorado (solo texto, sin video)
- Comparte los mismos campos de medios y reglas de exclusión mutua que la generación de video H3
- Facturación por tokens; suele completarse en 20~40 segundos
- Úselo solo, o como paso 1 del workflow vista previa 768P → regeneración 2K
POST
Full 2K Workflow (opcional): ① Context-IR mejora el prompt → ② MiniMax-H3 con
768P para una vista previa → ③ Regeneration sube a 2K. Los precios unitarios combinados coinciden con el 2K directo, con reintentos más baratos. También puede llamar a este endpoint solo.Autorización
string
requerido
Autenticación Bearer Token. Obtenga una clave en la página de gestión de API Keys.
Resumen
Envíe su idea y medios opcionales para comprensión multimodal; reciba un prompt estructurado y más rico.- No se produce video. El resultado está en
result.prompt(no enresult.videos) - Los campos de medios usan las mismas reglas de validación que la generación de video (exclusión mutua fotogramas vs referencias; el audio no puede ir solo) para que las mismas entradas puedan pasar a la generación
result.prompt tal cual a MiniMax-H3 como prompt.
Parámetros de la solicitud
string
requerido
Valor fijo:
MiniMax-H3-Context-IRstring
requerido
Texto de la idea original, ≤ 7000 caracteres
integer
predeterminado:"5"
Duración objetivo del video (segundos), 4~15, valor predeterminado
5. Afecta el lenguaje de ritmo en el prompt mejorado.string
Relación de aspecto objetivo. Obligatorio para entrada solo de texto, y no puede ser
adaptive.Valores comunes: 16:9, 9:16, 1:1, 4:3, 3:4, 21:9, etc.string
URL de la imagen del primer fotograma
string
URL de la imagen del último fotograma
string[]
Imágenes de referencia (siempre tratadas como referencias), ≤ 9
object[]
Imágenes con roles:
first_frame / last_frame / reference_imagestring[]
Videos de referencia, ≤ 3; cada uno 2~15 s, total ≤ 15 s
string[]
Audio de referencia, ≤ 3; no se puede usar solo — combínelo con imagen o video
Facturación
Basada en tokens (único modelo de la familia H3 facturado por tokens):
Una llamada típica (~5,6k entrada + ~3,4k salida tokens) cuesta unos $0.0167.
Se preautoriza un depósito fijo al enviar y luego se liquida con los
prompt_tokens / completion_tokens reales (reembolso del exceso / cargo del déficit). Las entradas multimodales aumentan mucho los tokens de entrada.
Notas
- Suele tardar 20~40 segundos; consulte el estado de la tarea cada 3~5 segundos.
- Parámetros incorrectos → 400 síncrono (sin tarea, sin cargo); fallos en runtime pasan a
failedcon reembolso automático. - Las notas del workflow completo están en la página Regeneration.
Response
integer
Código de estado; 200 en caso de éxito
array
Al enviar:
status / task_id