Skip to main content
POST

Autorisierung

string
erforderlich
Alle API-Endpunkte erfordern eine Bearer-Token-AuthentifizierungAPI-Key abrufen:Besuchen Sie die Seite zur API-Key-Verwaltung, um Ihren API-Key zu erhaltenFügen Sie ihn zum Request-Header hinzu:

Modus-Routing

happyhorse-1.0 ist der einheitliche Einstieg für Text-to-Video / Image-to-Video / Reference-Image-to-Video / Video Edit. Das Backend ermittelt den Modus automatisch anhand der eingehenden Parameter. Alle Modi werden nach derselben Regel abgerechnet (nur Auflösung × Sekunden): Routing-Priorität (hoch nach niedrig): video_url > first_frame_image > image_urls > nur prompt. Regeln zur gegenseitigen Ausschließlichkeit: Die drei Medienfelder (first_frame_image / image_urls / video_url) sind paarweise gegenseitig ausschließend. Die einzige gültige Kombination ist video_url + image_urls (EDIT-Modus + Referenzbilder). Werden zwei sich ausschließende Felder übergeben, wird 400 mixed_media_not_allowed zurückgegeben.

Anfrageparameter

string
erforderlich
Name des Videogenerierungsmodells, fest auf happyhorse-1.0
boolean
Standard:"false"
Legt fest, ob der Inhalt vor dem Absenden des Videoauftrags moderiert wird.
  • true: Prompts und Eingabebilder mit omni-moderation-latest prüfen
  • false oder nicht angegeben: keine Moderationsanfrage und damit keine zusätzlichen Moderationskosten oder Verzögerung (Standard)
string
Beschreibung des Videoinhalts, bis zu 2500 Zeichen; darf keine Sondertoken enthalten
  • T2V- / R2V- / EDIT-Modi: erforderlich
  • I2V-Modus: optional, aber empfohlen zur Steuerung von Kamerabewegung und Aktionen
Beispiel: "A little girl walking down the road, cinematic feel"
string
Erstes Einzelbild, löst I2V (Image-to-Video) aus. Unterstützt URL oder base64 (data:image/<mime>;base64,<payload>, das Gateway lädt es automatisch in OSS hoch)Schließt sich gegenseitig aus mit image_urls / video_url
Anforderungen an das Erstbild:
  • Format: JPEG / JPG / PNG / BMP / WEBP
  • Kurze Seite: ≥ 300 px
  • Seitenverhältnis: 1:2.5 bis 2.5:1
  • Dateigröße: ≤ 10 MB
array<string>
Bilder-Array:
  • R2V-Modus (nur image_urls angegeben): 1–9 Bilder, dienen als Subjekt-/Stilreferenzen zur Generierung einer neuen Szene
  • EDIT-Modus (zusammen mit video_url angegeben): 0–5 Bilder, dienen als Stilreferenz
Unterstützt URL oder base64Schließt sich gegenseitig aus mit first_frame_image; kann mit video_url kombiniert werden
Anforderungen an Referenzbilder:
  • Format: JPEG / JPG / PNG / BMP / WEBP
  • Kurze Seite: empfohlen ≥ 720p
  • Seitenverhältnis: kurz / lang ≥ 0,4
  • Dateigröße: ≤ 10 MB
  • Anzahl: R2V muss 1–9 sein; EDIT bis zu 5
string
URL des Quellvideos, löst EDIT (Video Edit) aus. Base64 wird nicht unterstützt — geben Sie einen HTTP/HTTPS-Direktlink anSchließt sich gegenseitig aus mit first_frame_image; kann mit image_urls (≤ 5) kombiniert werden
Anforderungen an das Quellvideo:
  • Dauer: 3–60 Sekunden (> 15s wird vom Upstream automatisch von 0 bis 15s gekürzt)
  • Auflösung: mindestens 480p, kurze Seite ≥ 360
  • Seitenverhältnis: 1:8 bis 8:1
  • Format: MP4 / MOV (H.264 empfohlen)
  • Bildrate: > 8 fps
  • Dateigröße: ≤ 100 MB
Im EDIT-Modus entspricht die Dauer des generierten Videos der Dauer des Quellvideos (begrenzt auf die gekürzten 15s, wenn die Quelle länger ist). Der Parameter duration hat hier keine Wirkung. Um die Ausgabelänge zu steuern, schneiden Sie das Quellvideo vor dem Hochladen auf die Zieldauer.
string
Standard:"auto"
Audio-Einstellung, nur im EDIT-Modus wirksam (video_url muss übergeben werden)Optionen:
  • auto – Audio automatisch generieren (Standard)
  • origin – Audiospur des Quellvideos beibehalten
Wird dieses Feld außerhalb des EDIT-Modus übergeben, wird 400 audio_setting_only_for_edit zurückgegeben
string
Standard:"1080P"
Videoauflösung (beeinflusst die Abrechnung)Optionen:
  • 720P – Standard
  • 1080P – Hohe Auflösung (Standard)
integer
Standard:"5"
Videodauer in Sekunden (beeinflusst die Abrechnung)Unterstützter Bereich: jede Ganzzahl von 3 bis 15Standard: 5
Hat im EDIT-Modus keine Wirkung (wenn video_url angegeben ist): Die Dauer des generierten Videos entspricht der des Quellvideos (Abrechnung nach den gekürzten 15s, wenn die Quelle länger als 15s ist). Um die Ausgabelänge zu steuern, schneiden Sie das Quellvideo zuerst.
string
Standard:"16:9"
SeitenverhältnisUnterstützte Formate:
  • 16:9 – Querformat Breitbild (Standard)
  • 9:16 – Hochformat
  • 1:1 – Quadrat
  • 4:3 – Querformat
  • 3:4 – Hochformat
In den Modi I2V / EDIT ignoriert — das Ausgabe-Seitenverhältnis wird automatisch durch das Eingabemedium (Erstbild / Quellvideo) bestimmt
boolean
Standard:"false"
Soll dem generierten Video ein Wasserzeichen hinzugefügt werden?
  • true: Wasserzeichen hinzufügen
  • false: kein Wasserzeichen (Standard)
integer
Zufallsseed zur Steuerung der Zufälligkeit des generierten InhaltsWertebereich: [0, 2147483647]. Wenn weggelassen, wird ein zufälliger Seed verwendet.
  • Bei identischen Anfragen erzeugt das Modell unterschiedliche Ergebnisse, wenn unterschiedliche Seed-Werte empfangen werden (z. B. ohne Seed)
  • Bei identischen Anfragen erzeugt das Modell ähnliche Ergebnisse, wenn derselbe Seed-Wert empfangen wird, eine exakte Übereinstimmung ist jedoch nicht garantiert

Antwort

integer
Statuscode der Antwort, 200 bei Erfolg
array
Datenarray der Antwort

Anwendungsfälle

Fall 1: Text-zu-Video T2V (einfachste Anfrage)

Fall 2: Text-zu-Video T2V (vollständige Parameter)

Fall 3: Bild-zu-Video I2V (first_frame_image)

Fall 4: Referenz-Bild-zu-Video R2V (mehrere Referenzen)

Fall 5: Video Edit EDIT (Originalton beibehalten + Stilreferenz)

Fall 6: 720P zur Kosteneinsparung

Leitfaden zur Moduswahl

Tipps zur Nutzung

  1. Logik des einheitlichen Einstiegs: Die Eingabefelder bestimmen den Modus. Beachten Sie, dass die drei Medienfelder (first_frame_image / image_urls / video_url) paarweise gegenseitig ausschließend sind
  2. size wirkt nur in T2V/R2V: In den Modi I2V / EDIT wird size ignoriert — das Ausgabe-Seitenverhältnis wird durch das Eingabemedium bestimmt
  3. Dauer: 5–10 Sekunden ist der optimale Bereich. Zu kurz führt zu ruckartiger Bewegung; zu lang erhöht die Upstream-Verarbeitungszeit erheblich
  4. Qualität des Erstbildes: klar, gut komponiert, Subjekt zentriert — verbessert die I2V-Ausgabe deutlich
  5. Prompt-Formulierung: Beschreiben Sie Bewegung / Kamera / Atmosphäre (z. B. „slow push-in, cinematic, warm tones”) für bessere Ergebnisse als rein statische Szenenbeschreibungen
  6. EDIT-Eingangsvideo: > 15 Sekunden wird vom Upstream automatisch von 0 bis 15s gekürzt. Wenn Sie andere Abschnitte benötigen, schneiden Sie das Video zuerst selbst zu
Aufgabenergebnisse abfragenDie Videogenerierung ist eine asynchrone Aufgabe, die nach der Übermittlung eine task_id zurückgibt. Verwenden Sie den Endpunkt Aufgabenstatus abrufen, um den Generierungsfortschritt und die Ergebnisse abzufragen.