Skip to main content
POST

Authentification

string
requis
Toutes les API nécessitent une authentification par Bearer Token.Obtenir une clé API :Accédez à la page de gestion des clés API pour obtenir votre clé API.Ajoutez-la à l’en-tête de la requête :

Paramètres de requête

string
requis
Nom du modèle de génération vidéo. Doit être gemini-omni-1.1-flash.
string
Instruction textuelle. Pour le texte-vers-vidéo, décrivez la scène. Pour l’image-vers-vidéo, l’édition ou la prolongation, décrivez le mouvement, le style ou la modification souhaitée.
Fournissez au moins prompt ou un média (image_urls, images de première/dernière image ou video_urls).
string
défaut:"720p"
Résolution de la vidéo de sortie. La casse n’est pas prise en compte.Valeurs disponibles :
  • 360p
  • 720p (par défaut)
  • 1080p
  • 4k
2160p est traité comme 4k. La résolution détermine le niveau de dépôt prélevé et le coût principal de la sortie vidéo.
Une résolution non prise en charge renvoie l’erreur invalid_resolution.
string
défaut:"16:9"
Format d’image de la vidéo, utilisé pour choisir une sortie paysage ou portrait.Pris en charge :
  • 16:9 - Paysage (par défaut)
  • 9:16 - Portrait
Les autres valeurs sont traitées comme 16:9.
Lorsque video_urls est fourni, la sortie suit généralement le format de la vidéo source ; aspect_ratio peut donc ne pas s’appliquer.
array<string>
Tableau d’images de référence. Seules les URL HTTP/HTTPS accessibles publiquement sont prises en charge.
  • 1 image : utilisée par défaut comme première image de la vidéo
  • Plusieurs images : utilisées comme références de sujets ou de style ; décrivez leur rôle et leurs relations dans prompt
image_urls et les images de début/fin sont limités à 10 images au total.
string
Première image. Seule une URL HTTP/HTTPS accessible publiquement est prise en charge.
  • Fournie seule : utilisée comme première image de la vidéo
  • Fournie avec last_frame_image : génère une transition fluide de la première à la dernière image
string
Dernière image. Seule une URL HTTP/HTTPS accessible publiquement est prise en charge et elle doit être fournie avec first_frame_image.
Fournir uniquement last_frame_image renvoie invalid_frame_images. Utilisez le même format pour les deux images et faites-le correspondre à aspect_ratio.
Pour une première image ou une paire première/dernière image, les deux méthodes suivantes sont équivalentes. Choisissez-en une et ne fournissez pas les deux :
  • Utiliser first_frame_image / last_frame_image
  • Utiliser image_with_roles avec role défini sur first_frame / last_frame
array<object>
Tableau d’images avec rôles. Il constitue une alternative équivalente à first_frame_image / last_frame_image et permet aussi de déclarer des images de référence.Exemple :
Si image_urls est également fourni, il prévaut pour les références et n’est pas combiné aux références de image_with_roles. Toutes les images effectivement utilisées, y compris les images de début et de fin, sont limitées à 10 au total.
array<string>
Tableau de vidéos à éditer ou prolonger. Une seule vidéo de 10 secondes maximum est actuellement acceptée.Seules les URL HTTP/HTTPS directes et accessibles publiquement sont prises en charge. Les liens YouTube ne le sont pas.
video_urls et extend_from_task_id sont mutuellement exclusifs. Fournissez-en un seul.
object
Objet de paramètres supplémentaires permettant d’indiquer explicitement l’intention de génération.
Pour l’interpolation de première et dernière image, le modèle déduit automatiquement la tâche et la plateforme ne transmet pas metadata.task.
string
task_id local de la tâche de génération précédente. Utilisez-le pour l’édition conversationnelle ou une nouvelle prolongation sans recharger la vidéo précédente.La tâche référencée doit appartenir à l’utilisateur actuel, avoir réussi et utiliser un modèle Gemini Omni.
extend_from_task_id et video_urls sont mutuellement exclusifs. Fournissez-en un seul.
Ce modèle ne possède pas de paramètre duration. La durée de chaque sortie est déterminée automatiquement selon le contenu, généralement entre 3 et 10 secondes. Pour contrôler le rythme, décrivez-le dans prompt en langage naturel ou avec des plages temporelles.

Réponse

integer
Code de réponse. 200 indique un succès.
array
Tableau de tâches renvoyé.

Consulter le résultat de la tâche

La génération vidéo est asynchrone. Après réception du task_id, utilisez l’API Obtenir l’état de la tâche pour consulter la progression et le résultat.
cURL
Interrogez la tâche toutes les 5 à 10 secondes et arrêtez lorsque l’état devient completed ou failed. Un délai d’expiration global de 10 minutes est recommandé côté client.

Exemple de résultat réussi

Cas d’utilisation

Cas 1 : texte-vers-vidéo (4K)

Cas 2 : interpolation de première et dernière image

Cas 3 : références multi-sujets

Cas 4 : déclarer les images de début et de fin avec des rôles

Cas 5 : édition vidéo

Utilisez des prompts courts et précis pour l’édition vidéo. Pour ne modifier qu’une partie, ajoutez Keep everything else the same afin de préserver la cohérence du reste.

Cas 6 : prolongation conversationnelle