GPT-Image-2
Generación de imágenes con GPT-Image-2 canal oficial
- Modelo oficial
gpt-image-2de OpenAI, basado en el protocolo compatible/v1/images/generations - Procesamiento asíncrono, devuelve
task_idpara consultas posteriores - Texto a imagen / imagen a imagen / inpainting (máscara) — todo en uno
- Compatibilidad con fondos transparentes PNG / WebP (canal alfa)
- Nuevo campo de nivel
resolution— selección de 1K / 2K / 4K - 15 proporciones admitidas en los niveles 1K / 2K / 4K
- Hasta 4 imágenes por solicitud, hasta 16 imágenes de referencia
- 95% de alineación de parámetros con
gpt-image-1.5-official— la migración solo requiere cambiar el nombre del modelo
POST
Autorizaciones
string
requerido
Todos los endpoints requieren autenticación con Bearer TokenObtenga su API Key:Visite la página de gestión de API Keys para obtener su API KeyInclúyala en el encabezado de la solicitud:
Body
string
predeterminado:"gpt-image-2-official"
requerido
Nombre del modelo de generación de imágenesFijo en
gpt-image-2-official (modelo oficial gpt-image-2 de OpenAI)boolean
predeterminado:"false"
Indica si se debe moderar el contenido antes de enviar la tarea de imagen.
true: revisar los prompts y las imágenes de entrada conomni-moderation-latestfalseu omitido: no enviar una solicitud de moderación, sin coste ni latencia de moderación adicionales (predeterminado)
string
requerido
Descripción textual para la generación de la imagen
- Admite inglés y chino, se recomiendan descripciones detalladas
- Moderación de contenido / revisión de seguridad antes del envío — las violaciones se rechazan inmediatamente
string
predeterminado:"1:1"
Proporción de la imagenExternamente usa valores de proporción; internamente se mapean a píxeles reales según
resolution.Proporciones admitidas, más auto para dejar que el servidor elija una proporción adecuada automáticamente:auto- Automática (el servidor elige una proporción según el prompt / imágenes de referencia)1:1- Cuadrada (predeterminada, avatares sociales / logos)3:2- Horizontal (proporción común de DSLR)2:3- Vertical (pósters verticales)4:3- Horizontal (monitor clásico / presentación de diapositivas)3:4- Vertical5:4- Horizontal4:5- Vertical (publicación vertical de Instagram)16:9- Horizontal (miniatura de video panorámico)9:16- Vertical (pantalla completa de móvil / portada de video corto)2:1- Horizontal (banner web)1:2- Vertical3:1- Horizontal (banner ultra panorámico)1:3- Vertical (póster extra alto)21:9- Horizontal (cinematográfico ultra panorámico)9:21- Vertical
1881x836 / 887x1774.string
predeterminado:"1k"
Nivel de resolución (nuevo campo)Controla la nitidez real de la salida.
1k- Línea base 1024, rentable para uso diario (predeterminado)2k- Línea base 2048, adecuado para pósters / necesidades de alta definición4k- Línea base 3840, admite las 15 proporciones de la tabla de mapeo siguiente
string
predeterminado:"auto"
Calidad de la imagen
auto- Automática (predeterminado, normalmente equivale alow)low- Rápida y económica, suficiente para bocetosmedium- Equilibradahigh- Precisión máxima (4K + high puede tardar >120s)
string
predeterminado:"auto"
Modo de fondo
auto- Automático (predeterminado)opaque- Opacotransparent- Solicita un fondo transparente; la salida incluye un canal alfa
string
predeterminado:"auto"
Nivel de moderación
auto- Nivel de moderación predeterminadolow- Moderación más permisiva
string
predeterminado:"png"
Formato de salida
png- Formato predeterminado, admite fondos transparentesjpeg- Archivos más pequeños, no admite canal alfawebp- Admite fondos transparentes, adecuado para navegadores modernos
integer
Nivel de compresión de salida, rango
0-100- Solo efectivo para
jpeg/webp
integer
predeterminado:"1"
Número de imágenes a generarRango:
1 ~ 4array
Array de URLs de imágenes de referencia
string
URL de la imagen de máscara, usada para inpainting
- Debe usarse junto con
image_urls
Mapeo Size × Resolution
size × resolution → píxeles reales de OpenAI (15 proporciones × 3 niveles):
Nota: Algunas dimensiones se aproximan en función de múltiplos de 16 y límites de píxeles, como3:2/2:3@ 2K siendo 2048×1360 y21:9@ 4K siendo 3840×1648. Use los píxeles reales de la tabla como fuente de verdad.
Ejemplos de uso
Texto a imagen (solicitud mínima)Response
integer
Código de estado de la respuesta
array
Array de datos de la respuesta
Consulta de resultados de la tarea
Tras un envío correcto, se devuelve untask_id. Consulte el estado de la tarea mediante GET /v1/tasks/{task_id}, consulte la API de consulta de tareas para más detalles.
Ejemplo de respuesta exitosa
usage indica el consumo de tokens facturable de esta solicitud:
En la generación de imágenes la salida son principalmente tokens de imagen, por lo que
output_tokens_details.image_tokens suele ser igual a output_tokens. En el ejemplo anterior, total_tokens = 22 + 196 = 218.
Flujo de estado de la tarea: submitted → in_progress → completed / failed.
Acceso a la imagen: data.result.images[0].url[0].