Skip to main content
POST

Autorização

string
obrigatório
Todos os endpoints da API exigem autenticação via Bearer TokenObtenha sua chave de API:Acesse a página de gerenciamento de chaves de API para obter sua chave de APIAdicione ao cabeçalho da requisição:

Roteamento de modos

happyhorse-1.1 é a entrada unificada para Text-to-Video / Image-to-Video / Reference-Image-to-Video. O backend determina automaticamente o modo com base nos parâmetros recebidos. Todos os modos são cobrados pela mesma regra (apenas resolução × segundos): Prioridade de roteamento (alta para baixa): first_frame_image > image_urls > apenas prompt. Regras de exclusão mútua: os dois campos de mídia (first_frame_image / image_urls) são mutuamente exclusivos. Passar dois campos mutuamente exclusivos ao mesmo tempo retorna 400 mixed_media_not_allowed.

Parâmetros da requisição

string
obrigatório
Nome do modelo de geração de vídeo, fixo como happyhorse-1.1
string
Descrição do conteúdo do vídeo, até 2500 caracteres; não pode conter tokens especiaisExemplo: "A little girl walking down the road, cinematic feel"
string
Imagem do primeiro quadro, aciona o I2V (Image-to-Video). Suporta URL ou base64 (data:image/<mime>;base64,<payload>, o gateway faz upload para o OSS automaticamente)Mutuamente exclusivo com image_urls
Requisitos da imagem do primeiro quadro:
  • Formato: JPEG / JPG / PNG / BMP / WEBP
  • Lado curto: ≥ 300px
  • Proporção: 1:2.5 a 2.5:1
  • Tamanho do arquivo: ≤ 10MB
array<string>
Array de imagens (Modo R2V): 1–9 imagens, usadas como referências de sujeito/estilo para gerar uma nova cenaSuporta URL ou base64Mutuamente exclusivo com first_frame_image
Requisitos da imagem de referência:
  • Formato: JPEG / JPG / PNG / BMP / WEBP
  • Lado curto: ≥ 720p recomendado
  • Proporção: curto / longo ≥ 0,4
  • Tamanho do arquivo: ≤ 10MB
  • Quantidade: 1–9 imagens
string
padrão:"1080P"
Resolução do vídeo (afeta a cobrança)Opções:
  • 720P - Padrão
  • 1080P - Alta definição (padrão)
integer
padrão:"5"
Duração do vídeo em segundos (afeta a cobrança)Intervalo suportado: qualquer inteiro de 3 a 15Padrão: 5
string
padrão:"16:9"
Proporção de telaFormatos suportados:
  • 16:9 - Paisagem widescreen (padrão)
  • 9:16 - Retrato
  • 1:1 - Quadrado
  • 4:3 - Paisagem
  • 3:4 - Retrato
Ignorado no modo I2V — a proporção de saída é determinada automaticamente pela mídia de entrada (imagem do primeiro quadro)
boolean
padrão:"false"
Se deve adicionar uma marca d’água ao vídeo gerado
  • true: adiciona marca d’água
  • false: sem marca d’água (padrão)
integer
Seed aleatório usado para controlar a aleatoriedade do conteúdo geradoIntervalo de valores: [0, 2147483647]. Se omitido, um seed aleatório é usado.
  • Para requisições idênticas, o modelo gera resultados diferentes ao receber valores de seed diferentes (por exemplo, omitindo o seed)
  • Para requisições idênticas, o modelo gera resultados semelhantes ao receber o mesmo valor de seed, mas a consistência exata não é garantida

Resposta

integer
Código de status da resposta, 200 em caso de sucesso
array
Array de dados da resposta

Casos de uso

Caso 1: Texto para vídeo T2V (Requisição mais simples)

Caso 2: Texto para vídeo T2V (Parâmetros completos)

Caso 3: Imagem para vídeo I2V (first_frame_image)

Caso 4: Referência-Imagem para vídeo R2V (múltiplas referências)

Caso 5: 720P para economizar custo

Guia de seleção de modo

Dicas de uso

  1. Lógica de entrada unificada: os campos de entrada decidem o modo. Note que os dois campos de mídia (first_frame_image / image_urls) são mutuamente exclusivos
  2. size efetivo apenas em T2V/R2V: no modo I2V, size é ignorado — a proporção de saída é determinada pela mídia de entrada
  3. Duração: 5–10 segundos é o ponto ideal. Muito curto causa movimento truncado; muito longo aumenta significativamente o tempo de processamento upstream
  4. Qualidade da imagem do primeiro quadro: clara, bem composta, sujeito centralizado — melhora significativamente a saída I2V
  5. Escrita do prompt: descreva movimento / câmera / atmosfera (por exemplo, “slow push-in, cinematic, warm tones”) para obter melhores resultados do que descrições puramente estáticas de cena
Consultar resultados da tarefaA geração de vídeos é uma tarefa assíncrona que retorna um task_id no envio. Use o endpoint Obter status da tarefa para consultar o progresso e os resultados da geração.