El 8 de septiembre de 2026, OpenAI lanzó ChatGPT Images 2.5 — su modelo de imágenes de nueva generación, con resultados más nítidos, una generación hasta un 50 % más rápida y una experiencia de edición renovada. Sucede a ChatGPT Images 2, lanzado en April de 2026, y se convierte de inmediato en el motor de imágenes predeterminado dentro de ChatGPT para todos los usuarios en cada nivel de suscripción.

El contexto de este lanzamiento es extraordinario: cada semana ya se crean más de 3 mil millones de imágenes en ChatGPT Images y en los modelos GPT-Image disponibles en la API. Images 2.5 llega a todos los usuarios de ChatGPT, ChatGPT Work y Codex en escritorio, móvil y web — junto con dos nuevos modelos de API diseñados para distintas cargas de trabajo en producción.
OpenAI lanzó ChatGPT Images 2.5 el 8 de septiembre de 2026, posicionándolo como el modelo de imágenes más capaz de la compañía hasta la fecha. Sucede a ChatGPT Images 2, que llegó en April de 2026 aproximadamente cinco meses antes, y se publica tras el lanzamiento de GPT-6 Astra. El nuevo modelo de imágenes de OpenAI está diseñado para ser el motor de generación predeterminado dentro de ChatGPT, lo que significa que cada nueva solicitud de imagen se ejecuta automáticamente en Images 2.5 sin necesidad de cambiar ninguna configuración.
El modelo ocupa el lugar más alto de una línea que se remonta a DALL-E, la primera investigación de imágenes de OpenAI. A lo largo de ese período, el enfoque ha pasado de simples demostraciones de investigación a herramientas de nivel productivo: la edición en múltiples turnos, la fidelidad a las referencias y la velocidad a escala importan más que los simples benchmarks de novedad.
Images 2.5 está disponible para todos los niveles de ChatGPT — incluido el nivel gratuito — así como para los suscriptores de ChatGPT Work y Codex. El acceso abarca las aplicaciones de escritorio, la aplicación móvil y la interfaz web. Para los desarrolladores, dos nuevos modelos de API (GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst) se lanzaron simultáneamente y son accesibles a través del endpoint estándar de la API de OpenAI.
La mejora más destacada es la latencia: Images 2.5 ofrece hasta un 50% menos de latencia en la generación de imágenes en comparación con su predecesor. Esto se traduce en resultados notablemente más rápidos al obtener la primera imagen en sesiones interactivas y en un rendimiento sustancialmente mayor para las cargas de trabajo de la API. Más allá de la velocidad, OpenAI reporta condiciones de iluminación más naturales, texturas de superficie más ricas y una representación más precisa de la información del mundo real incorporada en las imágenes.
| Atributo | ChatGPT Images 2 (April 2026) | ChatGPT Images 2.5 (Sept 2026) |
|---|---|---|
| Latencia de generación | Línea base | Hasta un 50% menor |
| Iluminación y textura | Estándar | Más natural, más rica |
| Edición en múltiples turnos | Buena | Más fiable y acumulativa |
| Manejo de fondos | Limitado | Compatibilidad total con fondos transparentes |
| Consistencia de estilo | Moderada | Más consistente entre turnos |
| Precisión del texto del mundo real | Estándar | Mejorada |
El predecesor Images 2 introdujo salida en resolución 2K, múltiples relaciones de aspecto, integración de búsqueda web, compatibilidad con escrituras no latinas y dos niveles de inteligencia (Instant y Thinking). Images 2.5 se construye sobre todo eso en lugar de reemplazarlo.
Una de las mejoras más prácticas es la forma en que el modelo gestiona las fotos de referencia. Images 2.5 conserva los sujetos de tus imágenes de referencia con mayor fidelidad: rostros, objetos y elementos de marca se reproducen con más precisión cuando se utilizan como entradas.

La precisión en la edición también mejoró de forma significativa. El modelo ahora modifica únicamente los elementos que solicitas de manera explícita, dejando el resto de la imagen intacto incluso cuando el fondo u otros sujetos son visualmente complejos. Los fondos transparentes y los diseños compuestos complejos se gestionan de forma fiable, lo que elimina un punto de fricción habitual en los flujos de trabajo de productos y comercio electrónico.
En conversaciones largas con múltiples turnos, las ediciones anteriores se mantienen: cada nueva instrucción se construye sobre el trabajo previo en lugar de restablecer el estado visual, y la calidad no se degrada a medida que el hilo de conversación crece. Los estilos visuales solicitados también se mantienen de forma más consistente de una edición a otra.
La nueva función más destacada de ChatGPT incluida con Images 2.5 es Sketch. Escribe “@Sketch” en cualquier conversación para abrir un lienzo de dibujo directamente dentro de ChatGPT, donde puedes esbozar una referencia visual aproximada —una composición, una forma, una relación espacial— que el modelo utiliza como guía al generar la imagen final. La superficie de Sketch está disponible en los clientes web y de escritorio. Esto elimina la brecha entre las descripciones verbales y la intención visual: en lugar de describir una composición con palabras, simplemente la dibujas. Para una guía completa, consulta nuestro artículo sobre la función de dibujo Sketch.
Templates ofrece puntos de partida listos para usar en los formatos visuales más habituales. Entre las opciones disponibles se encuentran “Poster” para carteles de eventos y marketing, y “Merch” para mockups de productos; ambas cubren los casos de uso más frecuentes que antes requerían crear los prompts manualmente desde cero.
Ahora es posible colocar comentarios directamente sobre una imagen generada para señalar con precisión qué área o elemento necesita ajuste, sin necesidad de describir la ubicación espacial con largas explicaciones de texto. La función funciona de manera similar a las anotaciones en herramientas de diseño: haz clic en una región y escribe la instrucción de edición.

El uso compartido de prompts te permite exportar el prompt que hay detrás de cualquier imagen generada para que otras personas puedan reproducir la misma idea usando sus propias fotos y detalles contextuales. Es especialmente útil para equipos que iteran sobre un estilo visual y para creadores que desean construir recetas de imágenes reutilizables en lugar de resultados cerrados.
Junto con la actualización de ChatGPT se lanzaron dos modelos de API diferenciados: GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst. Comparten la misma arquitectura de generación subyacente, pero están ajustados para distintos contextos de producción.
| Modelo | Caso de uso objetivo | Latencia | Puntos fuertes |
|---|---|---|---|
| GPT-Image-2.5 Flare | Contenido para creadores, redes sociales, UX de producto, prototipado rápido, alto volumen | 50% menor que GPT-Image-2 | Velocidad, fondos transparentes, alto rendimiento |
| GPT-Image-2.5 Sunburst | Creatividades para campañas, imágenes de producto pulidas, flujos de trabajo visuales premium | Mayor | Control de edición más preciso, consistencia en producción |
GPT-Image-2.5 Flare es la elección predeterminada en el API para la mayoría de las aplicaciones: ofrece imágenes de mayor calidad que GPT-Image-2 con una latencia un 50 % menor. Las primeras evaluaciones del equipo de Manus, liderado por Lucky Liao, revelaron que Flare funciona entre dos y cuatro veces más rápido que GPT-Image-2, con una generación de fondos transparentes notablemente mejorada, un indicador clave para la fotografía de producto y los elementos superpuestos en e-commerce.
Flare está orientado a flujos de trabajo donde el volumen y la capacidad de respuesta son prioritarios:
GPT-Image-2.5 Sunburst está diseñado para flujos de trabajo visuales de alto nivel que requieren un control más preciso a lo largo de una secuencia de ediciones. El material creativo listo para producción en campañas y las imágenes de producto muy elaboradas son sus puntos fuertes declarados. Los tiempos de generación son más largos que en Flare, pero a cambio ofrece mayor consistencia y precisión cuando un briefing creativo así lo exige.
Cómo elegir entre ambas opciones en la práctica:
Ambos modelos de GPT-Image-2.5 aplican las mismas tarifas en la página de precios de OpenAI:
La estructura de precios sigue el mismo modelo basado en tokens que OpenAI utiliza en sus APIs de lenguaje, lo que significa que las entradas en caché son considerablemente más económicas, algo relevante para cualquier flujo de trabajo que procese imágenes de referencia similares de forma repetida.

GPT-Image-2.5 ya está integrado en Adobe Firefly, el conjunto de herramientas de diseño generativo, gracias a una asociación anunciada junto con el lanzamiento. Matt Chotin de Adobe confirmó la integración. Higgsfield AI y Manus también fueron nombradas como socias iniciales que desarrollan sus productos sobre los nuevos modelos de API.
Estamos poniendo el modelo de generación y edición de imágenes más potente al alcance de todos —desde creadores individuales hasta equipos empresariales— porque la inteligencia visual se está convirtiendo en algo tan fundamental como la inteligencia lingüística.OpenAI, al anunciar ChatGPT Images 2.5
Una ficha de sistema publicada el 8 de septiembre de 2026 describe la arquitectura de seguridad que respalda Images 2.5. El enfoque es por capas: controles de política basados en LLM evalúan y rechazan las solicitudes que infringen las normas antes de que comience cualquier generación, y un modelo de razonamiento de seguridad independiente supervisa tanto las entradas de texto como las de imagen, además de inspeccionar todos los resultados tras la generación.
OpenAI realizó evaluaciones adversariales automatizadas para medir la tasa de resultados no seguros que lograron eludir esas defensas:
Ambos modelos nuevos puntúan por debajo de la línea base del modelo anterior. La evaluación del Marco de Preparación determinó que ninguno de los modelos supera los umbrales Bio Alto o Cibernético Alto —las dos categorías de riesgo más sensibles que OpenAI monitorea para sus modelos de frontera.
Cada imagen generada por Images 2.5 lleva dos capas de marcado de procedencia. La primera es los metadatos C2PA —un registro legible por máquina con información de origen incrustada según el estándar del Programa de Conformidad C2PA, que permite a herramientas, plataformas y navegadores intermediarios mostrar la procedencia verificada sin modificar la imagen visible.
La segunda capa es SynthID, el sistema de marcas de agua invisibles de Google DeepMind. A diferencia de las marcas de agua visibles, SynthID codifica una señal imperceptible en la estructura de píxeles que sobrevive a transformaciones habituales como el redimensionamiento o la recompresión JPEG. Según la descripción general de SynthID en Wikipedia, la tecnología se desarrolló originalmente para imágenes —lanzada por primera vez en agosto de 2023 para fotos generadas por Imagen— y desde entonces se ha extendido a audio, vídeo y texto.
Ambos mecanismos de procedencia se aplican en ChatGPT, Codex y la OpenAI API, de modo que cada superficie que genera una imagen a través de Images 2.5 produce un resultado trazable. Para una explicación más detallada, lee nuestro análisis sobre cómo funciona la marca de agua SynthID en imágenes de IA.

ChatGPT Images 2.5 se lanzó el 8 de septiembre de 2026, aproximadamente cinco meses después de ChatGPT Images 2, que llegó en abril de 2026.
Flare es el modelo de API predeterminado, optimizado para velocidad: ofrece mayor calidad que GPT-Image-2 con una latencia un 50 % menor, lo que lo hace ideal para casos de uso en tiempo real y con grandes volúmenes. Sunburst está orientado a flujos de trabajo visuales de alto nivel, con un control de edición más preciso y una coherencia lista para producción, aunque a costa de tiempos de generación más largos.
Tanto Flare como Sunburst aplican las mismas tarifas: entrada de imágenes a $8,00 por cada millón de tokens ($2,00 en caché), salida de imágenes a $30,00 por cada millón de tokens, y entrada de texto a $5,00 por cada millón de tokens ($1,25 en caché).
Escribe “@Sketch” en cualquier conversación de ChatGPT para abrir el lienzo de dibujo. Traza un boceto aproximado de la composición o la forma como referencia visual y, a continuación, describe la imagen que deseas: ChatGPT Images 2.5 utilizará tu dibujo para orientar el resultado final.
Sí. Cada imagen incluye metadatos C2PA (procedencia legible por máquina) y la marca de agua invisible SynthID de Google DeepMind. Ambas se aplican en ChatGPT, Codex y la API.
Images 2.5 está disponible para todos los niveles de ChatGPT, incluido el gratuito, así como para ChatGPT Work y Codex. El uso de la API con GPT-Image-2.5 Flare o Sunburst se factura por token según los precios estándar de OpenAI.