MiniMax-H3
MiniMax-H3 Context-IR amélioration de prompt
- Compréhension multimodale du contexte produisant un prompt structuré enrichi (texte uniquement, pas de vidéo)
- Partage les mêmes champs médias et règles d’exclusion mutuelle que la génération vidéo H3
- Facturation au token ; se termine en général en 20~40 secondes
- Utilisable seul, ou comme étape 1 du workflow aperçu 768P → régénération 2K
POST
Full 2K Workflow (optionnel) : ① Context-IR enrichit le prompt → ② MiniMax-H3 en
768P pour un aperçu → ③ Regeneration monte en 2K. Les prix unitaires combinés correspondent au 2K direct, avec des itérations moins chères. Vous pouvez aussi appeler cet endpoint seul.Autorisation
string
requis
Authentification Bearer Token. Obtenez une clé sur la page de gestion des API Keys.
Aperçu
Envoyez votre idée et éventuellement des médias pour une compréhension multimodale ; recevez un prompt structuré et plus riche.- Aucune vidéo n’est produite. Le résultat est dans
result.prompt(pasresult.videos) - Les champs médias utilisent les mêmes règles de validation que la génération vidéo (exclusion mutuelle trames vs références ; l’audio ne peut pas être seul), afin de réutiliser les mêmes entrées pour la génération
result.prompt tel quel à MiniMax-H3 comme prompt.
Paramètres de la requête
string
requis
Valeur fixe :
MiniMax-H3-Context-IRstring
requis
Texte d’idée original, ≤ 7000 caractères
integer
défaut:"5"
Durée cible de la vidéo (secondes), 4~15, défaut
5. Influence le langage de rythme dans le prompt enrichi.string
Ratio d’aspect cible. Obligatoire pour une entrée texte seule, et ne peut pas être
adaptive.Valeurs courantes : 16:9, 9:16, 1:1, 4:3, 3:4, 21:9, etc.string
URL de l’image de première trame
string
URL de l’image de dernière trame
string[]
Images de référence (toujours traitées comme références), ≤ 9
object[]
Images avec rôles :
first_frame / last_frame / reference_imagestring[]
Vidéos de référence, ≤ 3 ; chacune 2~15 s, total ≤ 15 s
string[]
Audio de référence, ≤ 3 ; ne peut pas être utilisé seul — associez-le à une image ou une vidéo
Facturation
Basée sur les tokens (seul modèle de la famille H3 facturé aux tokens) :
Un appel typique (~5,6k entrée + ~3,4k sortie tokens) coûte environ $0.0167.
Un dépôt fixe est prélevé à la soumission, puis régularisé sur les
prompt_tokens / completion_tokens réels (remboursement de l’excédent / complément). Les entrées multimodales augmentent fortement les tokens d’entrée.
Notes
- Habituellement 20~40 secondes ; interrogez le statut de tâche toutes les 3~5 secondes.
- Mauvais paramètres → 400 synchrone (pas de tâche, pas de facturation) ; échecs d’exécution →
failedavec remboursement auto. - Les notes du workflow complet sont sur la page Regeneration.
Response
integer
Code de statut ; 200 en cas de succès
array
À la soumission :
status / task_id