Seedream-5.0-Pro
Seedream-5.0-Pro Bildgenerierung
- Asynchroner Verarbeitungsmodus, gibt eine Aufgaben-ID für nachfolgende Abfragen zurück
- Unterstützt Text-zu-Bild, Bild-zu-Bild mit einem Bild und Generierung mit mehreren Referenzbildern (bis zu 10)
- Unterstützt Auflösungsstufen 1K / 1.5K / 2K oder exakte Pixel über
size - Einzelbildmodell: ein Bild pro Anfrage; Ausgabe PNG / JPEG
- Links zu generierten Bildern sind 72 Stunden gültig, bitte speichern Sie sie umgehend
POST
Autorisierung
string
erforderlich
Alle API-Endpunkte erfordern eine Bearer-Token-AuthentifizierungAPI-Key abrufen:Besuchen Sie die API-Key-Verwaltungsseite, um Ihren API-Key zu erhaltenFügen Sie ihn dem Request-Header hinzu:
Einzelbildmodell:
seedream-5-0-pro erzeugt pro Anfrage nur 1 Bild (außer bei der Ebenenzerlegung). Die folgenden Parameter werden abgelehnt (HTTP 400, kein Task, keine Kosten):n > 1sequential_image_generation(Gruppengenerierung wird nicht unterstützt)stream(Streaming wird nicht unterstützt)tools(Websuche wird nicht unterstützt)- mehr als 10 Einträge in
image_urls
Interaktive Bearbeitung
Verwenden Sie
<point>-/<bbox>-Koordinaten im Prompt oder laden Sie ein Bild mit handgezeichneten Markierungen hoch, um Bearbeitungsbereiche präzise festzulegen.- Punktkoordinaten:
<point>x y</point>(geben einen einzelnen Punkt an; das Modell bestimmt den Wirkungsbereich) - Begrenzungsrahmen-Koordinaten:
<bbox>x1 y1 x2 y2</bbox>(geben die Koordinaten oben links und unten rechts an, um die Größe des Bearbeitungsbereichs präzise zu steuern)
Ebenenzerlegung
Zerlegen Sie ein Bild in ein Basisbild und bis zu 16 transparente PNG-Ebenen samt Positions- und Stapelinformationen.
Body
string
Standard:"seedream-5-0-pro"
erforderlich
Name des Bildgenerierungsmodells
seedream-5-0-pro(empfohlen)- Ebenfalls akzeptiert:
seedream-5.0-pro
boolean
Standard:"false"
Legt fest, ob der Inhalt vor dem Absenden des Bildauftrags moderiert wird.
true: Prompts und Eingabebilder mitomni-moderation-latestprüfenfalseoder nicht angegeben: keine Moderationsanfrage und damit keine zusätzlichen Moderationskosten oder Verzögerung (Standard)
string
erforderlich
Textbeschreibung für die BildgenerierungBei
layer_decomposition: true optional; wird der Prompt weggelassen, erkennt und trennt das Modell die Hauptelemente des Bildes automatisch.Neben Chinesisch und Englisch unterstützt die native Texterzeugung Russisch, Arabisch, Filipino, Thailändisch, Türkisch, Koreanisch, Malaiisch, Spanisch, Portugiesisch, Indonesisch, Französisch, Deutsch, Vietnamesisch und Japanisch.Tipp: Bleiben Sie bei maximal 600 englischen Wörtern; zu lange Beschreibungen können Detailverlust verursachen.
string
Standard:"1K"
Auflösungsstufe (Kleinschreibung wird akzeptiert). Dies ist eine API-Mart-Erweiterung und entspricht der direkten Angabe der Stufe in
size.1K(Standard)1.5K(gleicher Preis wie 1K, bessere Qualität — bevorzugt 1.5K, sofern kein Grund dagegen)2K
size als Stufe als auch resolution angegeben werden, hat size Vorrang.string
Standard:"auto"
Ein Stufenschlüsselwort, Seitenverhältnis, Beide Schreibweisen sind gleichwertig. Wenn nur eine Stufe angegeben wird, beschreiben Sie das gewünschte Layout im Prompt (z. B. “Poster im Hochformat” oder “Titelbild im Querformat”) und lassen Sie das Modell das Seitenverhältnis wählen.
auto oder exakte Pixelmaße.Schreibweise ①: Auflösungsstufe (empfohlen)
Die Stufe kann direkt insize oder über das API-Mart-Erweiterungsfeld resolution angegeben werden:Schreibweise ②: Stufe + Seitenverhältnis
Zusammen mitresolution. Unterstützte Verhältnisse:1:1,4:3,3:4,16:9,9:16,3:2,2:3,2:1,1:2,21:9- Auch
x-Trenner im Stil16x9 2x1entspricht2:1, und1x2entspricht1:2. Dasxmuss kleingeschrieben werden; Leerzeichen sind nicht zulässig.auto(Standard): nur Auflösungsstufe; finales Seitenverhältnis aus Prompt / Referenzen
9:21) liefern 400 — kein stiller Fallback auf 1:1.Stufe × Verhältnis → Ausgabepixel:Schreibweise ③: exakte Pixel
Wennsize widthxheight ist, werden Pixel unverändert verwendet und resolution greift nicht. Akzeptiert 2048X1024 / 2048×1024.string
Standard:"opaque"
Ausgabe-Hintergrundmodus:
opaque: deckender Hintergrund (Standard)transparent: transparenter Hintergrund
transparent ist nur für Bild-zu-Bild-Anfragen mit genau einem Eingabebild verfügbar, das bereits einen Alphakanal besitzt; zusätzlich ist output_format: "png" erforderlich.boolean
Standard:"false"
Legt fest, ob das Bild in Ebenen zerlegt wird. Bei Aktivierung gibt das Modell ein Basisbild und bis zu 16 PNG-Ebenen mit Alphakanal zurück.Es ist genau ein PNG- oder JPEG-Bild erforderlich. Es muss insgesamt
[262144, 36000000] Pixel enthalten und darf höchstens 30 MB groß sein. size akzeptiert nur 1K, 1.5K, 2K oder auto und verwendet standardmäßig auto. output_format steuert nur das Format des Basisbilds; zerlegte Ebenen sind immer PNG.object
Standard:"{\"mode\":\"standard\"}"
Modus der Prompt-Optimierung:
standard: Standardmodus mit besserer Qualität (Standard)
"optimize_prompt_options.mode": "standard" wird ebenfalls akzeptiert.integer
Standard:"1"
Anzahl der zu erzeugenden Bilder. Es wird nur
1 unterstützt; verwenden Sie seedream-5-0-lite für die Gruppenerzeugung.array
Liste der Referenzbild-URLs für Einzel- / Mehrfach-Referenz-Image-to-Image, bis zu 10Zwei Formate:1. Öffentliche URL
http://oderhttps://- Beispiel:
https://example.com/image.jpg
- Format:
data:image/<format>;base64,<data>—<format>muss kleingeschrieben sein - Beispiel:
data:image/jpeg;base64,/9j/4AAQSkZJRgABAQEAYABg...
- Formate: jpeg / png / webp / bmp / tiff / gif / heic / heif
- Seitenverhältnis (w/h):
[1/16, 16] - Jede Kante > 14 px
- Größe ≤ 30 MB
- Gesamtpixel ≤
6000×6000(36,000,000)
Abrechnung: Erstes Referenzbild kostenlos; jedes weitere mit fester Aufpreisgebühr.
string
Standard:"jpeg"
Ausgabeformat des Bildes
jpeg(Standard)png
Kompatibilität:response_formatentsprichtoutput_format; andere Werte werden alsjpegbehandelt.
boolean
Standard:"false"
Ob unten rechts ein “AI generated”-Wasserzeichen gesetzt wird
true: Wasserzeichen hinzufügenfalse: kein Wasserzeichen (Standard)
Anfragebeispiele
Text-zu-Bild (Stufe + Verhältnis)
Text-zu-Bild (exakte Pixel)
Mehrere Referenzen
Empfohlen: 1.5K gleicher Preis, bessere Qualität
Ebenenzerlegung
0–1000 normalisierte <bbox>-Koordinaten verwenden, um die zu extrahierenden Elemente präzise anzugeben:
Interaktive Bearbeitung
Beschreiben Sie handgezeichnete Markierungen im Bild in natürlicher Sprache:<point> / <bbox> präzise an:
Bearbeitung mit Alphakanal
Vollständiges Beispiel: Task senden und Bild abrufen
Das folgende Skript zeigt den vollständigen Ablauf: einen asynchronen Task senden, den Status abfragen, Fehlerzustände behandeln und die finale Bild-URL auslesen. Ersetzen Sie vor der AusführungYOUR_API_KEY.
Python
Zurückgegebene Bilder werden in einen von der Plattform verwalteten Speicher gespiegelt. Laden Sie sie dennoch zeitnah herunter und speichern Sie sie dauerhaft in Ihrem eigenen System; behandeln Sie die Ergebnis-URL nicht als permanenten Speicher.
Vollständige cURL-Szenarien
Komposition aus mehreren Bildern (bis zu 10 Referenzen)
Exakte Pixel, Prompt-Optimierung und Wasserzeichen
Transparente Ebene zerlegen und separat bearbeiten
Zerlegen Sie zuerst das Ausgangsbild:Antwort der Ebenenzerlegung und Rekonstruktion
Die Arraysurl, sizes, output_formats und layers entsprechen einander nach Index; Index 0 ist immer das Basisbild:
z_index-Reihenfolge zusammen. Für die Rekonstruktion auf dem Ausgabe-Basisbild mit absoluten Koordinaten gilt:
W × H-Zeichenfläche normalisierte Koordinaten:
Abrechnungshinweise
- 1.5K kostet dasselbe wie 1K ($0.045).
- Bei exakten Pixeln in
sizezählt die tatsächliche Ausgabefläche;resolutionhat keinen Einfluss (z. B.size: "2048x2048"→ $0.09). - Das erste Referenzbild ist gratis; ab dem zweiten gilt ein Zuschlag.
- Fehlgeschlagene Tasks werden voll erstattet.
Vorautorisierung und Abrechnung der Ebenenzerlegung
Da Anzahl und Abmessungen der Ebenen beim Senden des Tasks noch unbekannt sind, erfolgt die Vorautorisierung nach konservativen Regeln anhand der Anfrage:- Exakte Pixel: Einstufung nach der angeforderten Pixelfläche.
1K/1.5K: Vorautorisierung in der 1K-Stufe.2K: Vorautorisierung in der 2K-Stufe.auto: kann bis zu 2K ausgeben und wird daher in der 2K-Stufe vorautorisiert.
Beispiel: Eine
1080×1080-Eingabe wird in 10 Bilder zerlegt. Der Task wird als 17 Bilder × 2K-Stufe vorautorisiert. Wenn alle 10 finalen Bilder höchstens 2,61 Millionen Pixel enthalten, erfolgt die Abrechnung als 10 Bilder × 1K-Stufe; das verbleibende Guthaben wird automatisch erstattet.Häufige Fehler
⏱️ Langsamere Generierung: ca. 90 s für 1K, ca. 160 s für 2K (Qualität hat Vorrang). Fragen Sie den Task-Status alle 5–10 Sekunden ab und setzen Sie das Client-Timeout auf 5 Minuten. Speichern Sie erzeugte Ergebnisse zeitnah.
Response
integer
Antwort-Statuscode
array
Antwortdaten-Array