Skip to main content
POST

Autorisierung

string
erforderlich
Alle API-Endpunkte erfordern eine Authentifizierung per Bearer TokenAPI-Schlüssel abrufen:Besuchen Sie die Seite zur API-Schlüsselverwaltung, um Ihren API-Schlüssel zu erhaltenFügen Sie ihn dem Anfrage-Header hinzu:

Anfrageparameter

string
erforderlich
Name des VideogenerierungsmodellsUnterstützte Modelle:
  • kling-v3 — Kling v3 (empfohlen)
boolean
Standard:"false"
Legt fest, ob der Inhalt vor dem Absenden des Videoauftrags moderiert wird.
  • true: Prompts und Eingabebilder mit omni-moderation-latest prüfen
  • false oder nicht angegeben: keine Moderationsanfrage und damit keine zusätzlichen Moderationskosten oder Verzögerung (Standard)
string
erforderlich
TextpromptBeschreiben Sie Szenen, Aktionen und Stile detailliert für bessere Generierungsergebnisse. Englische Prompts werden empfohlen.Beispiel: "a golden retriever running on the beach, sunset, cinematic"
string
Negativer Prompt, um unerwünschte Inhalte auszuschließenBeispiel: "blurry, low quality, distorted"
string
Standard:"std"
GenerierungsmodusOptionen:
  • std — Standardmodus (720P)
  • pro — Profimodus (1080P)
  • 4k — 4K-Modus
Standard: std
integer
Standard:"5"
Standard: 5 Videodauer (Sekunden)Bereich: 3–15 (mindestens 3 Sekunden, maximal 15 Sekunden)⚠️ Hinweis: Muss eine einfache Zahl sein (z. B. 6), keine Anführungszeichen, sonst tritt ein Fehler auf
string
Standard:"16:9"
Seitenverhältnis des VideosOptionen:
  • 16:9 — Querformat
  • 9:16 — Hochformat
  • 1:1 — Quadrat
Standard: 16:9
array<url>
Array mit Bild-URLs für die Image-to-Video-Generierung
  • 1 Bild übergeben: wird als erstes Bild verwendet
  • 2 Bilder übergeben: werden automatisch als erstes Bild + letztes Bild zugewiesen
Es werden maximal 2 Bilder unterstütztBeispiel: ["https://example.com/first.jpg"]
  • Maximal 2 Bilder unterstützt
  • Bild-URLs müssen öffentlich zugänglich sein, ohne Hotlink-Schutz
  • Im Image-to-Video-Modus kann aspect_ratio durch das tatsächliche Seitenverhältnis des Bildes überschrieben werden
boolean
Ob ein Wasserzeichen hinzugefügt werden soll
boolean
Standard:"false"
Ob das Video mit Audio generiert werden soll
boolean
Standard:"false"
Ob der Multi-Shot-Modus aktiviert werden soll.
  • true
  • false
string
Methode zur Shot-Aufteilung: customize / intelligence.Erforderlich, wenn multi_shot=true.
array<object>
Informationen pro Shot, z. B. Prompt und Dauer.Definieren Sie Reihenfolge, Prompt und Dauer der Shots über index, prompt und duration.
  • Unterstützt 1 bis 6 Shots
  • Maximale Inhaltslänge pro Shot: 512
  • Jede Shot-Dauer muss >= 1 sein und darf die Gesamtdauer der Aufgabe nicht überschreiten
  • Die Summe aller Shot-Dauern muss der duration auf oberster Ebene entsprechen
Format:
Erforderlich, wenn multi_shot=true und shot_type=customize.
array<object>
Liste der Referenzsubjekte, bis zu 3 Subjekte.
  • Werden direkt über name, description, element_input_urls erstellt
Beispiel:
Hinweise:
  • Für die direkte Erstellung sind name, description und element_input_urls erforderlich
  • element_input_urls: 2–4 Bilder pro Subjekt (erstes Bild als Frontalansicht, restliche als Referenzen)
  • Verweisen Sie im prompt mit @name auf Elemente, z. B. "@element_dog chasing @element_cat on grass"

Parameter-Einschränkungen

  • mode=4k wird für kling-v3 unterstützt
  • image_urls unterstützt bis zu 2 Bilder (1 erstes Bild, 2 erstes + letztes Bild)
  • Eingabe nur des letzten Bildes ist ungültig (muss das erste Bild enthalten)
  • Bei multi_shot=true kann der prompt auf oberster Ebene weggelassen werden
  • multi_prompt unterstützt bis zu 6 Shots, wobei index bei 1 beginnen und fortlaufend sein muss

Funktions-Support-Matrix

Text-zu-Video (Text-to-Video) vs Bild-zu-Video (Image-to-Video)

Das System bestimmt den Modus automatisch anhand der Bereitstellung von image_urls: ohne Bilder bedeutet Text-to-Video, mit Bildern bedeutet Image-to-Video.

Antwort

integer
Statuscode der Antwort, 200 bei Erfolg
array
Datenarray der Antwort

Anwendungsfälle

Fall 1: Text-zu-Video (Standardmodus)

Fall 2: Text-zu-Video (Pro-Modus + Negativer Prompt)

Fall 3: Text-zu-Video (15 Sekunden)

Fall 4: Bild-zu-Video (Erstes Bild)

Fall 5: Bild-zu-Video (Steuerung erstes + letztes Bild)

Fall 6: Video mit Audio generieren

Fall 7: Multi-Shot-Storyboard (customize, 15 Sekunden, Hochformat mit Audio)

Aufgabenergebnisse abfragenDie Videogenerierung ist eine asynchrone Aufgabe, die bei der Einreichung eine task_id zurückgibt. Verwenden Sie den Endpunkt Aufgabenstatus abrufen, um Fortschritt und Ergebnis abzufragen.