Skip to main content
POST

Autorisierung

string
erforderlich
Alle API-Endpunkte erfordern eine Bearer-Token-AuthentifizierungAPI-Key abrufen:Besuchen Sie die API-Key-Verwaltungsseite, um Ihren API-Key zu erhaltenFügen Sie ihn dem Request-Header hinzu:
Einzelbildmodell: seedream-5-0-pro erzeugt pro Anfrage nur 1 Bild (außer bei der Ebenenzerlegung). Die folgenden Parameter werden abgelehnt (HTTP 400, kein Task, keine Kosten):
  • n > 1
  • sequential_image_generation (Gruppengenerierung wird nicht unterstützt)
  • stream (Streaming wird nicht unterstützt)
  • tools (Websuche wird nicht unterstützt)
  • mehr als 10 Einträge in image_urls

Interaktive Bearbeitung

Verwenden Sie <point>-/<bbox>-Koordinaten im Prompt oder laden Sie ein Bild mit handgezeichneten Markierungen hoch, um Bearbeitungsbereiche präzise festzulegen.
  • Punktkoordinaten: <point>x y</point> (geben einen einzelnen Punkt an; das Modell bestimmt den Wirkungsbereich)
  • Begrenzungsrahmen-Koordinaten: <bbox>x1 y1 x2 y2</bbox> (geben die Koordinaten oben links und unten rechts an, um die Größe des Bearbeitungsbereichs präzise zu steuern)

Ebenenzerlegung

Zerlegen Sie ein Bild in ein Basisbild und bis zu 16 transparente PNG-Ebenen samt Positions- und Stapelinformationen.

Body

string
Standard:"seedream-5-0-pro"
erforderlich
Name des Bildgenerierungsmodells
  • seedream-5-0-pro (empfohlen)
  • Ebenfalls akzeptiert: seedream-5.0-pro
boolean
Standard:"false"
Legt fest, ob der Inhalt vor dem Absenden des Bildauftrags moderiert wird.
  • true: Prompts und Eingabebilder mit omni-moderation-latest prüfen
  • false oder nicht angegeben: keine Moderationsanfrage und damit keine zusätzlichen Moderationskosten oder Verzögerung (Standard)
string
erforderlich
Textbeschreibung für die BildgenerierungBei layer_decomposition: true optional; wird der Prompt weggelassen, erkennt und trennt das Modell die Hauptelemente des Bildes automatisch.Neben Chinesisch und Englisch unterstützt die native Texterzeugung Russisch, Arabisch, Filipino, Thailändisch, Türkisch, Koreanisch, Malaiisch, Spanisch, Portugiesisch, Indonesisch, Französisch, Deutsch, Vietnamesisch und Japanisch.
Tipp: Bleiben Sie bei maximal 600 englischen Wörtern; zu lange Beschreibungen können Detailverlust verursachen.
string
Standard:"1K"
Auflösungsstufe (Kleinschreibung wird akzeptiert). Dies ist eine API-Mart-Erweiterung und entspricht der direkten Angabe der Stufe in size.
  • 1K (Standard)
  • 1.5K (gleicher Preis wie 1K, bessere Qualität — bevorzugt 1.5K, sofern kein Grund dagegen)
  • 2K
Nicht unterstützte Stufen wie 3K / 4K liefern 400.Wenn sowohl size als Stufe als auch resolution angegeben werden, hat size Vorrang.
Wenn size ein exakter Pixelwert ist (z. B. 2048x1024), wird dieses Feld ignoriert und die Abmessungen kommen nur aus size.
string
Standard:"auto"
Ein Stufenschlüsselwort, Seitenverhältnis, auto oder exakte Pixelmaße.

Schreibweise ①: Auflösungsstufe (empfohlen)

Die Stufe kann direkt in size oder über das API-Mart-Erweiterungsfeld resolution angegeben werden:
Beide Schreibweisen sind gleichwertig. Wenn nur eine Stufe angegeben wird, beschreiben Sie das gewünschte Layout im Prompt (z. B. “Poster im Hochformat” oder “Titelbild im Querformat”) und lassen Sie das Modell das Seitenverhältnis wählen.

Schreibweise ②: Stufe + Seitenverhältnis

Zusammen mit resolution. Unterstützte Verhältnisse:
  • 1:1, 4:3, 3:4, 16:9, 9:16, 3:2, 2:3, 2:1, 1:2, 21:9
  • Auch x-Trenner im Stil 16x9
  • 2x1 entspricht 2:1, und 1x2 entspricht 1:2. Das x muss kleingeschrieben werden; Leerzeichen sind nicht zulässig.
  • auto (Standard): nur Auflösungsstufe; finales Seitenverhältnis aus Prompt / Referenzen
Verhältnisse außerhalb der Liste (z. B. 9:21) liefern 400 — kein stiller Fallback auf 1:1.Stufe × Verhältnis → Ausgabepixel:

Schreibweise ③: exakte Pixel

Wenn size widthxheight ist, werden Pixel unverändert verwendet und resolution greift nicht. Akzeptiert 2048X1024 / 2048×1024.
Grenzen gelten für das Produkt aus Breite und Höhe, nicht für jede Kante allein. Beispiel: 512×512 ist zu klein (400); 2048×1024 ist gültig.
string
Standard:"opaque"
Ausgabe-Hintergrundmodus:
  • opaque: deckender Hintergrund (Standard)
  • transparent: transparenter Hintergrund
transparent ist nur für Bild-zu-Bild-Anfragen mit genau einem Eingabebild verfügbar, das bereits einen Alphakanal besitzt; zusätzlich ist output_format: "png" erforderlich.
boolean
Standard:"false"
Legt fest, ob das Bild in Ebenen zerlegt wird. Bei Aktivierung gibt das Modell ein Basisbild und bis zu 16 PNG-Ebenen mit Alphakanal zurück.Es ist genau ein PNG- oder JPEG-Bild erforderlich. Es muss insgesamt [262144, 36000000] Pixel enthalten und darf höchstens 30 MB groß sein. size akzeptiert nur 1K, 1.5K, 2K oder auto und verwendet standardmäßig auto. output_format steuert nur das Format des Basisbilds; zerlegte Ebenen sind immer PNG.
object
Standard:"{\"mode\":\"standard\"}"
Modus der Prompt-Optimierung:
  • standard: Standardmodus mit besserer Qualität (Standard)
Die flache Schreibweise "optimize_prompt_options.mode": "standard" wird ebenfalls akzeptiert.
integer
Standard:"1"
Anzahl der zu erzeugenden Bilder. Es wird nur 1 unterstützt; verwenden Sie seedream-5-0-lite für die Gruppenerzeugung.
array
Liste der Referenzbild-URLs für Einzel- / Mehrfach-Referenz-Image-to-Image, bis zu 10Zwei Formate:1. Öffentliche URL
  • http:// oder https://
  • Beispiel: https://example.com/image.jpg
2. Base64 (Data URI)
  • Format: data:image/<format>;base64,<data><format> muss kleingeschrieben sein
  • Beispiel: data:image/jpeg;base64,/9j/4AAQSkZJRgABAQEAYABg...
Limits pro Bild:
  • Formate: jpeg / png / webp / bmp / tiff / gif / heic / heif
  • Seitenverhältnis (w/h): [1/16, 16]
  • Jede Kante > 14 px
  • Größe ≤ 30 MB
  • Gesamtpixel ≤ 6000×6000 (36,000,000)
Abrechnung: Erstes Referenzbild kostenlos; jedes weitere mit fester Aufpreisgebühr.
string
Standard:"jpeg"
Ausgabeformat des Bildes
  • jpeg (Standard)
  • png
Kompatibilität: response_format entspricht output_format; andere Werte werden als jpeg behandelt.
boolean
Standard:"false"
Ob unten rechts ein “AI generated”-Wasserzeichen gesetzt wird
  • true: Wasserzeichen hinzufügen
  • false: kein Wasserzeichen (Standard)

Anfragebeispiele

Text-zu-Bild (Stufe + Verhältnis)

Text-zu-Bild (exakte Pixel)

Mehrere Referenzen

Empfohlen: 1.5K gleicher Preis, bessere Qualität

Ebenenzerlegung

Sie können auch auf 0–1000 normalisierte <bbox>-Koordinaten verwenden, um die zu extrahierenden Elemente präzise anzugeben:

Interaktive Bearbeitung

Beschreiben Sie handgezeichnete Markierungen im Bild in natürlicher Sprache:
Oder geben Sie Positionen mit <point> / <bbox> präzise an:

Bearbeitung mit Alphakanal

Vollständiges Beispiel: Task senden und Bild abrufen

Das folgende Skript zeigt den vollständigen Ablauf: einen asynchronen Task senden, den Status abfragen, Fehlerzustände behandeln und die finale Bild-URL auslesen. Ersetzen Sie vor der Ausführung YOUR_API_KEY.
Python
Bei Erfolg gibt der Endpunkt zur Task-Abfrage Folgendes zurück:
Zurückgegebene Bilder werden in einen von der Plattform verwalteten Speicher gespiegelt. Laden Sie sie dennoch zeitnah herunter und speichern Sie sie dauerhaft in Ihrem eigenen System; behandeln Sie die Ergebnis-URL nicht als permanenten Speicher.

Vollständige cURL-Szenarien

Komposition aus mehreren Bildern (bis zu 10 Referenzen)

Exakte Pixel, Prompt-Optimierung und Wasserzeichen

Transparente Ebene zerlegen und separat bearbeiten

Zerlegen Sie zuerst das Ausgangsbild:
Rufen Sie danach die URL einer transparenten Ebene ab und bearbeiten Sie sie separat:

Antwort der Ebenenzerlegung und Rekonstruktion

Die Arrays url, sizes, output_formats und layers entsprechen einander nach Index; Index 0 ist immer das Basisbild:
Setzen Sie die Ebenen in aufsteigender z_index-Reihenfolge zusammen. Für die Rekonstruktion auf dem Ausgabe-Basisbild mit absoluten Koordinaten gilt:
Verwenden Sie für die Rekonstruktion auf einer beliebigen W × H-Zeichenfläche normalisierte Koordinaten:
Die Ebenenzerlegung wird pro Bild abgerechnet. Beim Senden des Tasks werden bis zu 17 Bilder vorautorisiert. Nach Abschluss wird jede Ausgabe anhand ihrer tatsächlichen Pixelzahl eingestuft und einzeln abgerechnet; eine überschüssige Vorautorisierung wird automatisch erstattet. Ihr Guthaben muss die Vorautorisierung für 17 Bilder decken; size: "auto" wird in der 2K-Stufe vorautorisiert.

Abrechnungshinweise

Die Ausgabe wird nach tatsächlichen Gesamtpixeln gestuft (ca. 2.61M = 2,601,124):
  • 1.5K kostet dasselbe wie 1K ($0.045).
  • Bei exakten Pixeln in size zählt die tatsächliche Ausgabefläche; resolution hat keinen Einfluss (z. B. size: "2048x2048" → $0.09).
  • Das erste Referenzbild ist gratis; ab dem zweiten gilt ein Zuschlag.
  • Fehlgeschlagene Tasks werden voll erstattet.

Vorautorisierung und Abrechnung der Ebenenzerlegung

Da Anzahl und Abmessungen der Ebenen beim Senden des Tasks noch unbekannt sind, erfolgt die Vorautorisierung nach konservativen Regeln anhand der Anfrage:
  • Exakte Pixel: Einstufung nach der angeforderten Pixelfläche.
  • 1K / 1.5K: Vorautorisierung in der 1K-Stufe.
  • 2K: Vorautorisierung in der 2K-Stufe.
  • auto: kann bis zu 2K ausgeben und wird daher in der 2K-Stufe vorautorisiert.
Nach Abschluss werden Basisbild und jede tatsächliche Ebene anhand ihrer realen Pixelfläche einzeln eingestuft und summiert. Eine überschüssige Vorautorisierung wird automatisch erstattet. Ebenen sind meist deutlich kleiner als das Basisbild, sodass selbst ein in der 2K-Stufe vorautorisierter Task letztlich vollständig in der 1K-Stufe abgerechnet werden kann.
Beispiel: Eine 1080×1080-Eingabe wird in 10 Bilder zerlegt. Der Task wird als 17 Bilder × 2K-Stufe vorautorisiert. Wenn alle 10 finalen Bilder höchstens 2,61 Millionen Pixel enthalten, erfolgt die Abrechnung als 10 Bilder × 1K-Stufe; das verbleibende Guthaben wird automatisch erstattet.

Häufige Fehler

⏱️ Langsamere Generierung: ca. 90 s für 1K, ca. 160 s für 2K (Qualität hat Vorrang). Fragen Sie den Task-Status alle 5–10 Sekunden ab und setzen Sie das Client-Timeout auf 5 Minuten. Speichern Sie erzeugte Ergebnisse zeitnah.

Response

integer
Antwort-Statuscode
array
Antwortdaten-Array