Skip to main content
POST

Авторизация

string
обязательно
Все эндпоинты API требуют аутентификации по Bearer TokenПолучение API Key:Перейдите на страницу управления API Key, чтобы получить ваш API KeyДобавьте в заголовок запроса:

Маршрутизация режимов

happyhorse-1.1 — единая точка входа для Text-to-Video / Image-to-Video / Reference-Image-to-Video. Бэкенд автоматически определяет режим на основе входных параметров. Все режимы тарифицируются по одному правилу (только разрешение × секунды): Приоритет маршрутизации (от высокого к низкому): first_frame_image > image_urls > только prompt. Правила взаимоисключения: два медиа-поля (first_frame_image / image_urls) взаимоисключающие. Передача двух взаимоисключающих полей одновременно вернёт 400 mixed_media_not_allowed.

Параметры запроса

string
обязательно
Имя модели генерации видео, фиксированное значение happyhorse-1.1
string
Описание содержания видео, до 2500 символов; не может содержать специальных токеновПример: "A little girl walking down the road, cinematic feel"
string
Изображение первого кадра, активирует режим I2V (Image-to-Video). Поддерживает URL или base64 (data:image/<mime>;base64,<payload>, шлюз автоматически загружает его в OSS)Взаимоисключающее с image_urls
Требования к изображению первого кадра:
  • Формат: JPEG / JPG / PNG / BMP / WEBP
  • Короткая сторона: ≥ 300 px
  • Соотношение сторон: от 1:2.5 до 2.5:1
  • Размер файла: ≤ 10 МБ
array<string>
Массив изображений (режим R2V): 1–9 изображений, используются как опоры по субъекту/стилю для генерации новой сценыПоддерживает URL или base64Взаимоисключающее с first_frame_image
Требования к опорным изображениям:
  • Формат: JPEG / JPG / PNG / BMP / WEBP
  • Короткая сторона: рекомендуется ≥ 720p
  • Соотношение сторон: короткая / длинная ≥ 0.4
  • Размер файла: ≤ 10 МБ
  • Количество: 1–9 изображений
string
по умолчанию:"1080P"
Разрешение видео (влияет на тарификацию)Варианты:
  • 720P — стандартное
  • 1080P — высокая чёткость (по умолчанию)
integer
по умолчанию:"5"
Длительность видео в секундах (влияет на тарификацию)Поддерживаемый диапазон: любое целое число от 3 до 15По умолчанию: 5
string
по умолчанию:"16:9"
Соотношение сторонПоддерживаемые форматы:
  • 16:9 — широкоэкранный пейзаж (по умолчанию)
  • 9:16 — портретный
  • 1:1 — квадрат
  • 4:3 — пейзаж
  • 3:4 — портрет
Игнорируется в режиме I2V — соотношение сторон вывода автоматически определяется входным медиа (изображение первого кадра)
boolean
по умолчанию:"false"
Добавлять ли водяной знак к сгенерированному видео
  • true: добавить водяной знак
  • false: не добавлять (по умолчанию)
integer
Случайное зерно для управления случайностью генерируемого содержимогоДиапазон значений: [0, 2147483647]. Если опущено, используется случайное зерно.
  • Для идентичных запросов модель генерирует разные результаты при разных значениях seed (например, при пропуске seed)
  • Для идентичных запросов модель генерирует похожие результаты при одинаковом значении seed, но точное совпадение не гарантируется

Ответ

integer
Код статуса ответа, 200 при успехе
array
Массив данных ответа

Сценарии использования

Сценарий 1: Текст в видео T2V (простейший запрос)

Сценарий 2: Текст в видео T2V (полный набор параметров)

Сценарий 3: Изображение в видео I2V (first_frame_image)

Сценарий 4: Опорное изображение в видео R2V (несколько опорных изображений)

Сценарий 5: 720P для экономии

Руководство по выбору режима

Советы по использованию

  1. Логика единой точки входа: входные поля определяют режим. Учтите, что два медиа-поля (first_frame_image / image_urls) взаимоисключающие
  2. size действует только в T2V/R2V: в режиме I2V size игнорируется — соотношение сторон вывода определяется входным медиа
  3. Длительность: 5–10 секунд — оптимальный диапазон. Слишком короткое видео приводит к рваному движению; слишком длинное значительно увеличивает время обработки на восходящем сервисе
  4. Качество изображения первого кадра: чёткое, хорошо скомпонованное, субъект в центре — значительно улучшает результат I2V
  5. Написание промпта: описывайте движение / камеру / атмосферу (например, «slow push-in, cinematic, warm tones») для лучших результатов, чем при чисто статичных описаниях сцены
Запрос результатов задачиГенерация видео — асинхронная задача, которая при отправке возвращает task_id. Используйте эндпоинт Получение статуса задачи для запроса прогресса и результатов генерации.