MiniMax-H3
MiniMax-H3 Context-IR Prompt-Verbesserung
- Multimodales Kontextverständnis erzeugt einen verbesserten strukturierten Prompt (nur Text, kein Video)
- Dieselben Medienfelder und wechselseitigen Ausschlussregeln wie bei der H3-Videogenerierung
- Token-basierte Abrechnung; typisch 20~40 Sekunden
- Einzeln nutzbar oder als Schritt 1 des Workflows 768P-Vorschau → 2K-Regeneration
POST
Full 2K Workflow (optional): ① Context-IR verbessert den Prompt → ② MiniMax-H3 mit
768P als Vorschau → ③ Regeneration skaliert auf 2K. Die kombinierten Einzelpreise entsprechen direktem 2K, mit günstigeren Wiederholungen. Sie können diesen Endpunkt auch allein aufrufen.Autorisierung
string
erforderlich
Bearer-Token-Auth. Holen Sie einen Key auf der API-Key-Verwaltungsseite.
Überblick
Senden Sie Ihre Idee plus optionale Medien zur multimodalen Verarbeitung; Sie erhalten einen strukturierten, reicheren Prompt.- Es wird kein Video erzeugt. Das Ergebnis liegt in
result.prompt(nichtresult.videos) - Medienfelder nutzen dieselben Validierungsregeln wie die Videogenerierung (wechselseitiger Ausschluss Frame vs. Referenz; Audio nicht allein), damit dieselben Eingaben als Nächstes an die Generierung gehen können
result.prompt unverändert an MiniMax-H3 als prompt.
Anfrageparameter
string
erforderlich
Fester Wert:
MiniMax-H3-Context-IRstring
erforderlich
Ursprünglicher Ideentext, ≤ 7000 Zeichen
integer
Standard:"5"
Ziel-Videodauer (Sekunden), 4~15, Standard
5. Beeinflusst die Tempobeschreibung im verbesserten Prompt.string
Ziel-Seitenverhältnis. Bei reiner Texteingabe erforderlich, und darf nicht
adaptive sein.Häufige Werte: 16:9, 9:16, 1:1, 4:3, 3:4, 21:9 usw.string
URL des ersten Einzelbilds
string
URL des letzten Einzelbilds
string[]
Referenzbilder (immer als Referenzen behandelt), ≤ 9
object[]
Rollenmarkierte Bilder:
first_frame / last_frame / reference_imagestring[]
Referenzvideos, ≤ 3; jeweils 2~15 s, gesamt ≤ 15 s
string[]
Referenz-Audio, ≤ 3; nicht allein nutzbar — mit Bild oder Video kombinieren
Abrechnung
Token-basiert (einziges H3-Familienmodell mit Token-Abrechnung):
Ein typischer Aufruf (~5.6k Eingabe + ~3.4k Ausgabe-Tokens) kostet etwa $0.0167.
Beim Submit wird eine feste Kaution vorab belastet und danach gegen reale
prompt_tokens / completion_tokens abgerechnet (Überschuss erstatten / Unterdeckung nachziehen). Multimodale Eingaben erhöhen die Eingabe-Tokens deutlich.
Hinweise
- Üblicherweise 20~40 Sekunden; pollen Sie den Task-Status alle 3~5 Sekunden.
- Ungültige Parameter → synchron 400 (kein Task, keine Belastung); Laufzeitfehler →
failedmit automatischer Erstattung. - Hinweise zum vollständigen Workflow stehen auf der Regeneration-Seite.
Response
integer
Statuscode; 200 bei Erfolg
array
Beim Submit:
status / task_id