MiniMax-H3
MiniMax-H3 Context-IR aprimoramento de prompt
- Compreensão multimodal de contexto que produz um prompt estruturado aprimorado (somente texto, sem vídeo)
- Compartilha os mesmos campos de mídia e regras de exclusão mútua da geração de vídeo H3
- Cobrança por tokens; normalmente conclui em 20~40 segundos
- Use sozinho ou como etapa 1 do workflow prévia 768P → regeneração 2K
POST
Full 2K Workflow (opcional): ① Context-IR aprimora o prompt → ② MiniMax-H3 com
768P para prévia → ③ Regeneration sobe para 2K. Os preços unitários combinados equivalem ao 2K direto, com tentativas mais baratas. Você também pode chamar este endpoint sozinho.Autorização
string
obrigatório
Autenticação Bearer Token. Obtenha uma chave na página de gerenciamento de chaves de API.
Visão geral
Envie sua ideia e mídia opcional para compreensão multimodal; receba um prompt estruturado e mais rico.- Nenhum vídeo é produzido. O resultado fica em
result.prompt(não emresult.videos) - Os campos de mídia usam as mesmas regras de validação da geração de vídeo (exclusão mútua quadro vs referência; áudio não pode ficar sozinho), para que as mesmas entradas possam seguir para a geração
result.prompt como está para o MiniMax-H3 como prompt.
Parâmetros da requisição
string
obrigatório
Valor fixo:
MiniMax-H3-Context-IRstring
obrigatório
Texto da ideia original, ≤ 7000 caracteres
integer
padrão:"5"
Duração alvo do vídeo (segundos), 4~15, padrão
5. Afeta a linguagem de ritmo no prompt aprimorado.string
Proporção alvo. Obrigatório para entrada somente texto, e não pode ser
adaptive.Valores comuns: 16:9, 9:16, 1:1, 4:3, 3:4, 21:9, etc.string
URL da imagem do primeiro quadro
string
URL da imagem do último quadro
string[]
Imagens de referência (sempre tratadas como referências), ≤ 9
object[]
Imagens com papéis:
first_frame / last_frame / reference_imagestring[]
Vídeos de referência, ≤ 3; cada um 2~15 s, total ≤ 15 s
string[]
Áudio de referência, ≤ 3; não pode ser usado sozinho — combine com imagem ou vídeo
Cobrança
Baseada em tokens (único modelo da família H3 cobrado por tokens):
Uma chamada típica (~5,6k entrada + ~3,4k saída tokens) custa cerca de $0.0167.
Um depósito fixo é pré-cobrado no envio e depois liquidado com os
prompt_tokens / completion_tokens reais (reembolso do excesso / cobrança da diferença). Entradas multimodais aumentam bastante os tokens de entrada.
Observações
- Normalmente 20~40 segundos; consulte o status da tarefa a cada 3~5 segundos.
- Parâmetros inválidos → 400 síncrono (sem tarefa, sem cobrança); falhas em runtime vão para
failedcom reembolso automático. - Notas do workflow completo estão na página Regeneration.
Response
integer
Código de status; 200 em caso de sucesso
array
No envio:
status / task_id