Kling v3 Omni
Génération vidéo Kling v3 Omni
- Mode de traitement asynchrone, renvoie un identifiant de tâche pour les requêtes ultérieures
- Interface unifiée text-to-video / image-to-video avec syntaxe de référence d’image
- Prend en charge le mode standard (720P), le mode professionnel (1080P) et le mode 4K
- Référencement d’images dans les prompts via la syntaxe image_N
- Prend en charge la génération de vidéos avec audio (mutuellement exclusif avec video_list)
POST
Autorisation
string
requis
Tous les points de terminaison API nécessitent une authentification par Bearer TokenObtenir votre clé API :Rendez-vous sur la page de gestion des clés API pour obtenir votre clé APIAjoutez-la à l’en-tête de la requête :
Paramètres de la requête
string
requis
Nom du modèle de génération vidéoModèles pris en charge :
kling-v3-omni— Kling v3 Omni (interface unifiée)
boolean
défaut:"false"
Indique s’il faut modérer le contenu avant d’envoyer la tâche vidéo.
true: vérifier les prompts et les images d’entrée avecomni-moderation-latestfalseou omis : ne pas envoyer de requête de modération, sans coût ni latence de modération supplémentaires (par défaut)
string
requis
Prompt textuel positifPermet de référencer les images de
image_urls via la syntaxe <<<image_N>>>, où N commence à 1.Exemple : "Make the person in <<<image_1>>> wave at the camera"Si des images sont fournies mais que le prompt ne contient aucune référence
<<<image_N>>>, le système ajoute automatiquement <<<image_1>>> au début du prompt.string
Prompt négatif utilisé pour exclure les contenus indésirables. Longueur maximale : 2500 caractères.
string
défaut:"std"
Mode de générationOptions :
std— mode standard (720P)pro— mode professionnel (1080P)4k— mode 4K Ultra HD
stdinteger
défaut:"5"
Par défaut :
5
Durée de la vidéo (en secondes)Plage : 3 à 15 (minimum 3 secondes, maximum 15 secondes)⚠️ Note : doit être un nombre simple (par ex. 6), sans guillemets, sinon une erreur se produirastring
défaut:"16:9"
Format d’image de la vidéoOptions :
16:9— paysage9:16— portrait1:1— carré
16:9array<url>
Tableau d’URL d’images pour le référencement d’imagesRéférencez les images correspondantes dans le prompt via la syntaxe
<<<image_N>>> (N commence à 1)Exemple : ["https://example.com/photo.jpg"]array<object>
Tableau d’images avec rôles, recommandé pour l’image-to-video.Format de chaque élément :
{ "url": "...", "role": "..." }first_frame: première imagelast_frame: dernière imagereference: image de référence
array
Liste de vidéos de référence (basée sur URL), jusqu’à 1 vidéo.Utilisez
refer_type pour distinguer les types :base: vidéo à éditer (par défaut)feature: vidéo de référence de caractéristiques
keep_original_sound pour contrôler l’audio d’origine :no: ne pas conserver (par défaut)yes: conserver le son d’origine
boolean
défaut:"false"
Activer ou non le mode multi-plans.
string
Méthode de découpage des plans :
customize / intelligence.Obligatoire lorsque multi_shot=true.array<object>
Liste multi-plans, chaque élément est
{ index, prompt, duration }.- Minimum 1 plan, maximum 6 plans
- Chaque
durationde plan doit être un entier >= 1 - La somme des durées de tous les plans doit être égale à la
durationde premier niveau indexdoit commencer à 1 et augmenter de manière continue- Obligatoire lorsque
multi_shot=trueetshot_type=customize
array<object>
Liste des sujets de référence, jusqu’à 3 sujets. Prend en charge :Notes :
- La création de sujets à la volée avec
name,description,element_input_urls
- Pour la création à la volée,
name,description,element_input_urlssont obligatoires element_input_urls: 2 à 4 images par sujet (la première comme image frontale, les autres comme références)- Utilisez
@namedansprompt, par ex."@element_dog and @element_cat are playing on the grass"
boolean
Ajouter ou non un filigrane
boolean
défaut:"false"
Générer ou non la vidéo avec audio
Contraintes et limites des paramètres
image_urlsetimage_with_rolessont mutuellement exclusifsmode=4kest disponible pourkling-v3-omni- L’entrée de la dernière image seule (
last_framesans première image) est invalide - Les images de début/fin et l’édition vidéo sont mutuellement exclusives : lorsque
video_list.refer_type=base(ou omis), les images de début/fin ne sont pas autorisées - Lorsque
video_listest présent,audioest ignoré video_listprend en charge au maximum 1 vidéomulti_promptprend en charge jusqu’à 6 plans, avecindexcommençant à 1 et augmentant de manière continue
Syntaxe de référence d’image
Le modèle Omni utilise la syntaxe<<<image_N>>> pour référencer des images dans les prompts, offrant une expérience unifiée text-to-video / image-to-video :
Référence automatique : si
image_urls est fourni mais que le prompt ne contient aucune référence <<<image_N>>>, le système ajoute automatiquement <<<image_1>>> au début du prompt.Réponse
integer
Code de statut de la réponse, 200 en cas de succès
array
Tableau de données de la réponse
Cas d’usage
Cas 1 : Texte vers vidéo (mode standard)
Cas 2 : Référence d’image (image unique)
Cas 3 : Références à plusieurs images
Cas 4 : Image fournie sans référence explicite (ajoutée automatiquement)
Le système ajoute automatiquement<<<image_1>>>au début du prompt, ce qui équivaut à"<<<image_1>>>The person slowly turns and smiles".
Cas 5 : Générer une vidéo avec audio
Note :audioest mutuellement exclusif avecvideo_list. Lorsquevideo_lista une valeur, le paramètreaudion’est pas nécessaire.
Interroger les résultats de la tâcheLa génération vidéo est une tâche asynchrone qui renvoie un
task_id lors de la soumission. Utilisez le point de terminaison Obtenir le statut de la tâche pour interroger la progression et les résultats.