GPT-Image-2.5 Flare: The Fast API Model for High-Volume Image Generation

GPT-Image-2.5 Flare es el modelo de imagen API predeterminado de OpenAI, lanzado el 8 de September de 2026 junto con GPT-Image-2.5 Sunburst. Ofrece mayor calidad de imagen que GPT-Image-2 con una latencia de Generation aproximadamente un 50 % menor, lo que lo convierte en la opción preferida para productos que necesitan calidad y velocidad a gran escala. Forma parte del lanzamiento general de ChatGPT Images 2.5.

Logo de ChatGPT

Por qué Flare es el predeterminado

OpenAI posicionó Flare como el punto de partida recomendado para la mayoría de las integraciones API. El razonamiento es sencillo: iguala o supera la calidad visual de GPT-Image-2 mientras reduce los tiempos de espera a la mitad. For productos en los que la experiencia del usuario depende de una entrega rápida de Images —aplicaciones sociales, herramientas creativas, búsqueda en comercio electrónico—, esa mejora en la latencia es significativa.

Las evaluaciones independientes respaldan el benchmark. El equipo de Manus informó que Flare entregaba Images a 2–4× la velocidad de GPT-Image-2, con una generación notablemente mejorada de fondos transparentes. Ese tipo de ganancia en rendimiento, sin penalización en calidad, es la razón por la que Flare es el modelo predeterminado y no la excepción.

Casos de uso ideales

Flare está diseñado específicamente para cargas de trabajo que priorizan la capacidad de respuesta y el volumen:

  • Contenido para creadores y redes sociales — iteración rápida para feeds, stories y publicaciones donde los usuarios esperan vistas previas casi instantáneas.
  • Experiencias de producto — imágenes de comercio electrónico, fotografías de estilo de vida y generación de variantes a escala.
  • Búsqueda visual — integración de Generation de Images en interfaces de búsqueda o recomendación donde la latencia es una restricción de UX.
  • Prototipado rápido — equipos de diseño que iteran conceptos con rapidez sin esperar largas colas de Generation.
  • Pipelines de alto volumen — trabajos por lotes y flujos de trabajo automatizados donde el rendimiento importa más que el tiempo máximo de renderizado por Image.

Compara esto con GPT-Image-2.5 Sunburst, que apunta a campañas premium que requieren un control editorial más estricto en ediciones de varios pasos, a costa de tiempos de Generation más prolongados.

Precios de la API

Ambos modelos GPT-Image-2.5 se facturan con las mismas tarifas por tokens, según la página de precios de OpenAI:

Tipo de tokenTarifaEn caché
Entrada de imagen$8.00 / 1M tokens$2.00 / 1M
Salida de imagen$30.00 / 1M tokens—
Entrada de texto$5.00 / 1M tokens$1.25 / 1M

Para casos de uso de alto volumen, la tarifa de entrada de imagen en caché ($2.00/1M) reduce los costos de forma significativa cuando se reutilizan las mismas imágenes de referencia en múltiples solicitudes.

Seguridad y Procedencia

Flare incluye el mismo sistema de seguridad por capas que el resto de la familia Images 2.5, detallado en la tarjeta del sistema publicada en el lanzamiento. Las evaluaciones adversariales automatizadas registraron una tasa final de generación no segura del 1.41% para Flare — inferior al 1.64% de Images 2.0.

Cada imagen lleva metadatos de procedencia C2PA y la marca de agua invisible SynthID de Google DeepMind, aplicados de forma uniforme en ChatGPT, Codex y la API.

Primeros pasos

Flare está disponible ahora a través de la OpenAI API. Para flujos de trabajo que priorizan la calidad y pueden asumir tiempos de generación más largos, Sketch es otra herramienta de la suite Images 2.5 que vale la pena explorar: te permite proporcionar referencias dibujadas a mano directamente en ChatGPT.

Para una visión completa de lo que se lanzó el 8 de September de 2026 — incluyendo Sketch, plantillas y el uso compartido de indicaciones — consulta el resumen de ChatGPT Images 2.5.