Kling v3 Omni
Генерация видео Kling v3 Omni
- Асинхронный режим обработки, возвращает идентификатор задачи для последующих запросов
- Единый интерфейс text-to-video / image-to-video с синтаксисом ссылок на изображения
- Поддерживает стандартный режим (720P), профессиональный режим (1080P) и режим 4K
- Ссылка на изображения в промпте через синтаксис image_N
- Поддерживает генерацию видео со звуком (взаимоисключаемо с video_list)
POST
Авторизация
string
обязательно
Все эндпоинты API требуют аутентификации по Bearer TokenПолучение API-ключа:Перейдите на страницу управления API-ключами, чтобы получить свой API-ключДобавьте его в заголовок запроса:
Параметры запроса
string
обязательно
Название модели генерации видеоПоддерживаемые модели:
kling-v3-omni— Kling v3 Omni (единый интерфейс)
boolean
по умолчанию:"false"
Выполнять ли проверку содержимого перед отправкой задачи генерации видео.
true: проверить промпты и входные изображения с помощьюomni-moderation-latestfalseили параметр не указан: не отправлять запрос на проверку, без дополнительных затрат и задержки (по умолчанию)
string
обязательно
Позитивный текстовый промптПоддерживает ссылки на изображения из
image_urls через синтаксис <<<image_N>>>, где N начинается с 1.Пример: "Make the person in <<<image_1>>> wave at the camera"Если изображения переданы, но промпт не содержит ни одной ссылки
<<<image_N>>>, система автоматически добавит <<<image_1>>> в начало промпта.string
Негативный промпт для исключения нежелательного содержимого. Максимальная длина — 2500 символов.
string
по умолчанию:"std"
Режим генерацииВарианты:
std— стандартный режим (720P)pro— профессиональный режим (1080P)4k— режим 4K Ultra HD
stdinteger
по умолчанию:"5"
По умолчанию:
5
Длительность видео (секунды)Диапазон: 3–15 (минимум 3 секунды, максимум 15 секунд)⚠️ Примечание: должно быть обычным числом (например, 6), без кавычек, иначе произойдёт ошибкаstring
по умолчанию:"16:9"
Соотношение сторон видеоВарианты:
16:9— горизонтальное9:16— вертикальное1:1— квадратное
16:9array<url>
Массив URL изображений для ссылок на нихСсылайтесь на соответствующие изображения в промпте через синтаксис
<<<image_N>>> (N начинается с 1)Пример: ["https://example.com/photo.jpg"]array<object>
Массив изображений с ролями, рекомендуется для image-to-video.Формат каждого элемента:
{ "url": "...", "role": "..." }first_frame: первый кадрlast_frame: последний кадрreference: референсное изображение
array
Список референсных видео (на основе URL), до 1 видео.Используйте
refer_type для различения типов:base: видео для редактирования (по умолчанию)feature: референсное видео для признаков
keep_original_sound для управления оригинальным звуком:no: не сохранять (по умолчанию)yes: сохранять оригинальный звук
boolean
по умолчанию:"false"
Включать ли многокадровый режим.
string
Способ разбивки на кадры:
customize / intelligence.Обязателен при multi_shot=true.array<object>
Список многокадровых элементов, каждый элемент —
{ index, prompt, duration }.- Минимум 1 кадр, максимум 6 кадров
durationкаждого кадра должна быть целым числом и >= 1- Сумма длительностей всех кадров должна равняться значению верхнего уровня
duration indexдолжен начинаться с 1 и непрерывно возрастать- Обязателен при
multi_shot=trueиshot_type=customize
array<object>
Список референсных субъектов, до 3 субъектов. Поддерживает:Примечания:
- Создание субъектов «на лету» через
name,description,element_input_urls
- Для создания «на лету» требуются
name,description,element_input_urls element_input_urls: 2–4 изображения на каждый субъект (первое — фронтальное, остальные — референсные)- Используйте
@nameвprompt, например"@element_dog and @element_cat are playing on the grass"
boolean
Добавлять ли водяной знак
boolean
по умолчанию:"false"
Генерировать ли видео со звуком
Ограничения и границы параметров
image_urlsиimage_with_rolesвзаимоисключаемыmode=4kдоступен дляkling-v3-omni- Ввод только последнего кадра (
last_frameбез первого кадра) недопустим - Первый/последний кадры и редактирование видео взаимоисключаемы: при
video_list.refer_type=base(или его отсутствии) первый/последний кадры не допускаются - При наличии
video_listпараметрaudioигнорируется video_listподдерживает не более 1 видеоmulti_promptподдерживает до 6 кадров,indexначинается с 1 и непрерывно возрастает
Синтаксис ссылок на изображения
Модель Omni использует синтаксис<<<image_N>>> для ссылок на изображения в промптах, обеспечивая единый интерфейс text-to-video / image-to-video:
Автоматическая ссылка: если
image_urls передан, но в промпте нет ни одной ссылки <<<image_N>>>, система автоматически добавит <<<image_1>>> в начало промпта.Ответ
integer
Код состояния ответа, 200 при успехе
array
Массив данных ответа
Сценарии использования
Сценарий 1: Текст в видео (стандартный режим)
Сценарий 2: Ссылка на изображение (одно изображение)
Сценарий 3: Ссылки на несколько изображений
Сценарий 4: Изображение передано без явной ссылки (добавляется автоматически)
Система автоматически добавит<<<image_1>>>в начало промпта, что эквивалентно"<<<image_1>>>The person slowly turns and smiles".
Сценарий 5: Генерация видео со звуком
Примечание:audioвзаимоисключаем сvideo_list. Когдаvideo_listимеет значение, параметрaudioне требуется.
Получение результатов задачиГенерация видео — это асинхронная задача, при отправке возвращающая
task_id. Используйте эндпоинт Получить статус задачи, чтобы узнать прогресс и результаты генерации.