Familia GPT Image
Los modelos de generación de imágenes de OpenAI: gpt-image-2.5-flare, gpt-image-2.5-sunburst y gpt-image-2. Los tres se invocan a través de la API compatible con OpenAI.
Todo lo que figura en estas páginas se ha medido contra la API en producción, y cada ejemplo de código se ha ejecutado tal cual. Última verificación: 2026-09-30.
¿Qué desea hacer?
La estructura de la petición y los campos de la respuesta comunes a estos endpoints se describen en Images API.
Qué modelo utilizar
- Generación cotidiana y por lotes; rápido
- 6 niveles de calidad: de low a max
- Edición y combinación de imágenes; mayor fidelidad
- 6 niveles de calidad: de low a max
- Adecuado para proyectos existentes
- 4 niveles de calidad; sin xhigh ni max
Al pasar de gpt-image-2 a 2.5, vuelva a elegir el nivel de calidad; consulte Calidad y precio más abajo. Ambos proveedores ofrecen texto a imagen y edición, y el gateway enruta las peticiones automáticamente.
openai/gpt-image-2.5-flareGeneración cotidiana y por lotes; rápidoopenai/gpt-image-2.5-sunburstEdición y combinación de imágenes; mayor fidelidadopenai/gpt-image-2Sin los niveles xhigh ni maxCalidad (quality) y precio
quality es el parámetro que más influye en el precio. Los niveles superiores cuestan más y tardan más.
Precios de referencia oficiales de OpenAI (por imagen, solo la imagen de salida; no incluyen la instrucción ni las imágenes de referencia):
OpenAI no ha publicado una tabla de precios por imagen para los dos modelos 2.5. En su lugar, indica precios unitarios: $30 por millón de tokens de imagen de salida, $8 por millón de tokens de entrada de imágenes de referencia y $5 por millón de tokens de entrada de texto. Ejemplo de cálculo de OpenAI: una imagen de 1024×1024 en low produce 196 tokens de salida, aproximadamente $0.00588. Para otros niveles y tamaños, haga la estimación con la calculadora oficial .
Estas son cifras oficiales de OpenAI; el cargo real se rige por el campo usage de cada respuesta. Los precios vigentes de OfoxAI (descuentos incluidos) figuran en la página del modelo .
Niveles admitidos por cada modelo:
standard y hd (valores antiguos de DALL·E) no se admiten y devuelven 400.
Latencia y tiempos de espera (timeout)
La API es síncrona: la respuesta solo se devuelve una vez generada la imagen. Si el cliente se desconecta antes, la imagen se pierde, pero la petición se factura igualmente.
Configure el tiempo de espera del cliente en 600 segundos. La latencia varía según el modelo, la calidad y el tamaño; las peticiones de alta calidad, de gran tamaño y de edición pueden tardar varios minutos, y los tiempos de espera predeterminados habituales de 60 o 120 segundos no son suficientes.
Tamaño (size)
size acepta un ANCHOxALTO personalizado, siempre que se cumplan las cuatro reglas siguientes; si se incumple cualquiera de ellas, se devuelve 400.
- Ancho y alto divisibles entre 16
- Ningún lado supera 3840
- Entre 1:3 y 3:1
- Al menos 655.360 píxeles en total
Omitido o auto: el modelo elige el tamaño. No se garantiza que sea 1024×1024 ni que coincida con su imagen de referencia. En nuestras pruebas, tanto texto a imagen como edición devolvieron 1254×1254. Indique un tamaño explícitamente cuando necesite uno fijo.
El máximo documentado es 3840×2160; todo lo que supere 2560×1440 se considera experimental.
Especificaciones técnicas
Seleccionar un proveedor
Normalmente no es necesario. Seleccione uno cuando tenga requisitos de moderación de contenido: los proveedores aplican umbrales de moderación distintos; por ejemplo, gpt-image-2 es más estricto en Azure y comparativamente más permisivo en OpenAI.
El gateway elige automáticamente un proveedor disponible entre Azure y OpenAI.
Las peticiones se envían solo a ese proveedor; si no está disponible, no se redirigen a otro proveedor.
X-OfoxAI-Provider-Type: openaiFunciona tanto en texto a imagen como en edición; valores: azure_foundry, openai"extra_body": { "provider": { "type": "openai" } }Solo texto a imagen; la edición es una subida multipart y solo acepta la cabeceraDetalles completos: Enrutamiento de proveedores.
Errores habituales
Referencia completa de errores: Gestión de errores.
Mensajes de error exactos
Los mensajes completos que medimos, para que pueda buscarlos o compararlos:
Invalid size '1000x1000'. Width and height must both be divisible by 16.
Invalid size '4096x4096'. The longest edge must be less than or equal to 3840.
Invalid size '3200x1024'. The maximum supported aspect ratio is 3:1.
Invalid size '768x768'. Requested resolution is below the current minimum pixel budget.
The model 'gpt-image-2' does not support quality 'xhigh'.
Invalid value: 'standard'. Supported values are: 'low', 'medium', 'high', and 'auto'.
Invalid 'n': integer above maximum value. Expected a value <= 10, but got 11 instead.
Unknown parameter: 'style'.
The model 'gpt-image-2.5-sunburst' does not support the 'input_fidelity' parameter.
Transparent background is not supported for JPEG output format
Invalid file 'image[0]': unsupported mimetype ('text/plain; charset=utf-8'). Supported file formats are 'image/jpeg', 'image/png', and 'image/webp'.
unknown provider type in X-OfoxAI-Provider-Type header
Model 'GPT-Image-2' not found
Invalid image file or mode for image 1Tenga en cuenta que la lista de valores admitidos en Invalid value: 'standard' está incompleta: los modelos 2.5 también aceptan xhigh y max. Guíese por la tabla de niveles de esta página.
Parámetros sin efecto
Estos parámetros no provocan un error, pero no tienen ningún efecto en esta familia. La petición se completa y se factura con normalidad:
La ausencia de error no significa que haya funcionado: style, por ejemplo, se rechaza directamente, mientras que los anteriores se ignoran sin aviso.
Documentación oficial
La documentación de OpenAI describe el comportamiento al llamar directamente a OpenAI. Cuando llama a través de OfoxAI, prevalecen los resultados medidos en estas páginas. Por ejemplo, la facturación se rige por el campo usage de la respuesta y por las páginas de los modelos.
- Guía de generación de imágenes de OpenAI
- Guía de generación de imágenes de OpenAI · Limitaciones
- Referencia de la Images API de OpenAI
- Página del modelo en OpenAI: gpt-image-2.5-flare
- Página del modelo en OpenAI: gpt-image-2.5-sunburst
- Página del modelo en OpenAI: gpt-image-2
Preguntas frecuentes
¿GPT Image 2.5 acepta cualquier tamaño?
Acepta tamaños personalizados siempre que se cumplan cuatro reglas: ancho y alto divisibles entre 16, lado mayor no superior a 3840, relación de aspecto entre 1:3 y 3:1, y al menos 655.360 píxeles en total. Si se incumple cualquiera de ellas, se devuelve 400. Por ejemplo, 768x768 tiene muy pocos píxeles y se rechaza, mientras que 1024x768 funciona.
¿Qué tamaño obtengo si omito size?
Decide el modelo. No es necesariamente 1024x1024 ni coincide necesariamente con la imagen de referencia. En nuestras pruebas, tanto texto a imagen como edición devolvieron 1254x1254. Indique un tamaño explícitamente si necesita uno fijo.
¿gpt-image-2 admite las calidades xhigh y max?
No, ambas devuelven 400. xhigh y max solo las admiten gpt-image-2.5-flare y gpt-image-2.5-sunburst. gpt-image-2 acepta low, medium, high y auto.
¿La calidad de GPT Image 2.5 puede ser hd o standard?
No, esos valores devuelven 400. Los valores válidos son low, medium, high, xhigh, max y auto. Si se omite, el modelo elige un nivel por sí mismo (low en nuestras pruebas), por lo que conviene indicarlo explícitamente para obtener una calidad constante.
¿Qué tiempo de espera debo configurar para la API de gpt-image-2 / GPT Image 2.5?
Configure el tiempo de espera del cliente en 600 segundos. La latencia varía según el modelo, la calidad y el tamaño; las peticiones de alta calidad, de gran tamaño y de edición pueden tardar varios minutos.
¿Cómo soluciono el error de GPT Image moderation_blocked (Your request was rejected by the safety system)?
La instrucción o la imagen de referencia fue bloqueada por el sistema de seguridad del proveedor de origen, normalmente por tratarse de personas reales, personajes protegidos por derechos de autor o contenido sensible. Modifique la instrucción o la imagen de referencia y vuelva a intentarlo; reintentar sin cambios da el mismo resultado. El campo error.moderation_details de la respuesta indica si el bloqueo se produjo en la entrada o en la salida. Los proveedores aplican umbrales de moderación distintos, por lo que puede considerar seleccionar un proveedor si tiene requisitos de moderación.
¿Cómo soluciono el error de GPT Image Unknown parameter: response_format?
response_format es un parámetro antiguo de DALL·E. GPT Image solo devuelve base64 (data[0].b64_json) y no proporciona URL de imágenes. Elimine response_format y utilice output_format para elegir png, jpeg o webp. A través de OfoxAI, el parámetro se ignora y no provoca un error.
¿Qué hago ante el mensaje "Your organization must be verified" al llamar a gpt-image?
Se trata de la verificación de organización que OpenAI exige para el acceso directo. A través de OfoxAI no necesita verificar ninguna organización: una clave de API de OfoxAI puede llamar a gpt-image-2.5-flare, gpt-image-2.5-sunburst y gpt-image-2.
¿Qué hago cuando las peticiones a GPT Image agotan el tiempo de espera o devuelven 504 o 524?
La API es síncrona, y las peticiones de alta calidad, de gran tamaño y de edición pueden tardar varios minutos. Configure el tiempo de espera del cliente en 600 segundos y revise los tiempos de espera de los proxies intermedios, como Nginx, Vercel o Cloudflare, cuyos valores predeterminados suelen ser de solo 60 a 100 segundos.
¿Cómo soluciono el error de GPT Image does not support the input_fidelity parameter?
GPT Image 2.5 y gpt-image-2 procesan siempre las imágenes de referencia con alta fidelidad, por lo que el endpoint de edición no acepta input_fidelity. Elimínelo; el parámetro solo se aplica a gpt-image-1.5.
¿Cómo soluciono el error de GPT Image Invalid size?
El tamaño incumple una de las cuatro reglas, y el mensaje indica cuál: divisible by 16 significa que el ancho o el alto no es múltiplo de 16; longest edge significa que el lado mayor supera 3840; aspect ratio significa que la relación supera 3:1; minimum pixel budget significa menos de 655.360 píxeles, p. ej. 768x768. Utilice un tamaño que cumpla las cuatro, como 1024x768, 1024x1024 o 1536x1024.
¿Cuánto cuesta una imagen de GPT Image?
La facturación es por tokens, y el nivel de calidad es lo que más influye. Precios de referencia oficiales de OpenAI para una imagen de 1024x1024 con gpt-image-2: aproximadamente $0.006 en low, $0.053 en medium y $0.211 en high. Para los dos modelos 2.5, los tokens de imagen de salida cuestan $30 por millón, de modo que 1024x1024 en low cuesta aproximadamente $0.006. Lo que se le cobra realmente es el usage de la respuesta; los precios vigentes de OfoxAI figuran en las páginas de los modelos.
¿Necesito fijar un proveedor al editar con GPT Image 2.5?
No. Tanto Azure como OpenAI ofrecen el endpoint de edición de 2.5, y el gateway enruta las peticiones automáticamente.