GPT-Image-2
GPT-Image-2 Bildgenerierung (offizieller Kanal)
- OpenAI-offizielles Modell
gpt-image-2, basierend auf dem mit/v1/images/generationskompatiblen Protokoll - Asynchrone Verarbeitung, gibt
task_idfür nachfolgende Abfragen zurück - Text-zu-Bild / Bild-zu-Bild / Inpainting (Maske) — alles in einem
- Unterstützt transparente Hintergründe in PNG / WebP (Alphakanal)
- Neues Feld
resolutionfür die Stufe — Auswahl 1K / 2K / 4K - 15 Seitenverhältnisse in den Stufen 1K / 2K / 4K verfügbar
- Bis zu 4 Bilder pro Anfrage, bis zu 16 Referenzbilder
- 95 % Parameter-Übereinstimmung mit
gpt-image-1.5-official— für die Migration genügt eine Änderung des Modellnamens
POST
Autorisierung
string
erforderlich
Alle Endpunkte erfordern eine Authentifizierung per Bearer TokenAPI-Schlüssel erhalten:Besuchen Sie die Seite zur Verwaltung von API-Schlüsseln, um Ihren API-Schlüssel zu erhaltenFügen Sie ihn in den Anfrage-Header ein:
Body
string
Standard:"gpt-image-2-official"
erforderlich
Name des BildgenerierungsmodellsFest auf
gpt-image-2-official (offizielles OpenAI-Modell gpt-image-2) gesetztboolean
Standard:"false"
Legt fest, ob der Inhalt vor dem Absenden des Bildauftrags moderiert wird.
true: Prompts und Eingabebilder mitomni-moderation-latestprüfenfalseoder nicht angegeben: keine Moderationsanfrage und damit keine zusätzlichen Moderationskosten oder Verzögerung (Standard)
string
erforderlich
Textbeschreibung für die Bildgenerierung
- Unterstützt Englisch und Chinesisch, detaillierte Beschreibungen werden empfohlen
- Inhaltsmoderation / Sicherheitsprüfung vor dem Einreichen — Verstöße werden sofort abgelehnt
string
Standard:"1:1"
Seitenverhältnis des BildesExtern werden Verhältniswerte verwendet; intern werden sie gemäß
resolution automatisch auf tatsächliche Pixel abgebildet.Unterstützte Seitenverhältnisse, plus auto, damit der Server automatisch ein passendes Verhältnis auswählt:auto– Automatisch (Server wählt ein Verhältnis basierend auf Prompt / Referenzbildern)1:1– Quadrat (Standard, Social-Avatare / Logos)3:2– Querformat (gängiges DSLR-Verhältnis)2:3– Hochformat (vertikale Poster)4:3– Querformat (klassischer Monitor / Diashow)3:4– Hochformat5:4– Querformat4:5– Hochformat (Instagram-Hochformat-Post)16:9– Querformat (Breitbild-Video-Thumbnail)9:16– Hochformat (Telefon-Vollbild / Short-Video-Cover)2:1– Querformat (Web-Banner)1:2– Hochformat3:1– Querformat (ultrabreiter Banner)1:3– Hochformat (extra hohes Poster)21:9– Querformat (Kinoformat ultrabreit)9:21– Hochformat
1881x836 / 887x1774.string
Standard:"1k"
Auflösungsstufe (neues Feld)Steuert die tatsächliche Ausgabeschärfe.
1k– Basis 1024, kosteneffizient für den täglichen Einsatz (Standard)2k– Basis 2048, geeignet für Poster / Anforderungen an hohe Auflösung4k– Basis 3840, unterstützt die 15 Verhältnisse in der Zuordnungstabelle unten
string
Standard:"auto"
Bildqualität
auto– Automatisch (Standard, typischerweise gleichwertig mitlow)low– Schnell und sparsam, ausreichend für grobe Umrissemedium– Ausgewogenhigh– Höchste Präzision (4K + high kann über 120 s dauern)
string
Standard:"auto"
Hintergrundmodus
auto– Automatisch (Standard)opaque– Undurchsichtigtransparent– Fordert einen transparenten Hintergrund an; die Ausgabe enthält einen Alphakanal
string
Standard:"auto"
Moderationsstärke
auto– Standard-Moderationsstärkelow– Mildere Moderation
string
Standard:"png"
Ausgabeformat
png– Standardformat, unterstützt transparente Hintergründejpeg– Kleinere Dateien, unterstützt keinen Alphakanalwebp– Unterstützt transparente Hintergründe, geeignet für moderne Browser
integer
Ausgabe-Kompressionsstufe, Bereich
0–100- Nur für
jpeg/webpwirksam
integer
Standard:"1"
Anzahl der zu generierenden BilderBereich:
1 ~ 4array
Array mit Referenzbild-URLs
string
Masken-Bild-URL, für Inpainting verwendet
- Muss zusammen mit
image_urlsverwendet werden
Size × Resolution Zuordnung
size × resolution → tatsächliche OpenAI-Pixel (15 Verhältnisse × 3 Stufen):
Hinweis: Einige Abmessungen sind auf Vielfache von 16 und Pixelgrenzen angenähert, z. B.3:2/2:3@ 2K mit 2048×1360 und21:9@ 4K mit 3840×1648. Als verbindliche Quelle gelten die tatsächlichen Pixel in der Tabelle.
Anwendungsbeispiele
Text-zu-Bild (minimale Anfrage)Response
integer
Statuscode der Antwort
array
Array mit Antwortdaten
Abfrage der Aufgabenergebnisse
Nach erfolgreicher Einreichung wird einetask_id zurückgegeben. Pollen Sie den Aufgabenstatus über GET /v1/tasks/{task_id}, siehe API zur Aufgabenabfrage für Details.
Beispiel einer erfolgreichen Antwort
usage gibt den abrechenbaren Token-Verbrauch dieser Anfrage an:
Bei der Bildgenerierung besteht die Ausgabe hauptsächlich aus Bild-Tokens, daher entspricht
output_tokens_details.image_tokens in der Regel output_tokens. Im obigen Beispiel gilt total_tokens = 22 + 196 = 218.
Aufgabenstatusverlauf: submitted → in_progress → completed / failed.
Bildzugriff: data.result.images[0].url[0].