ChatGPT Images 2.5: What’s New in OpenAI’s State-of-the-Art Image Model

El 8 de septiembre de 2026, OpenAI lanzó ChatGPT Images 2.5 — su modelo de imágenes de nueva generación, con resultados más nítidos, una generación hasta un 50 % más rápida y una experiencia de edición renovada. Sucede a ChatGPT Images 2, lanzado en April de 2026, y se convierte de inmediato en el motor de imágenes predeterminado dentro de ChatGPT para todos los usuarios en cada nivel de suscripción.

Cada imagen de ChatGPT Images 2.5 lleva una marca de agua invisible SynthID y metadatos de procedencia C2PA

El contexto de este lanzamiento es extraordinario: cada semana ya se crean más de 3 mil millones de imágenes en ChatGPT Images y en los modelos GPT-Image disponibles en la API. Images 2.5 llega a todos los usuarios de ChatGPT, ChatGPT Work y Codex en escritorio, móvil y web — junto con dos nuevos modelos de API diseñados para distintas cargas de trabajo en producción.

What Is ChatGPT Images 2.5?

Release and positioning

OpenAI lanzó ChatGPT Images 2.5 el 8 de septiembre de 2026, posicionándolo como el modelo de imágenes más capaz de la compañía hasta la fecha. Sucede a ChatGPT Images 2, que llegó en April de 2026 aproximadamente cinco meses antes, y se publica tras el lanzamiento de GPT-6 Astra. El nuevo modelo de imágenes de OpenAI está diseñado para ser el motor de generación predeterminado dentro de ChatGPT, lo que significa que cada nueva solicitud de imagen se ejecuta automáticamente en Images 2.5 sin necesidad de cambiar ninguna configuración.

El modelo ocupa el lugar más alto de una línea que se remonta a DALL-E, la primera investigación de imágenes de OpenAI. A lo largo de ese período, el enfoque ha pasado de simples demostraciones de investigación a herramientas de nivel productivo: la edición en múltiples turnos, la fidelidad a las referencias y la velocidad a escala importan más que los simples benchmarks de novedad.

Who can use it

Images 2.5 está disponible para todos los niveles de ChatGPT — incluido el nivel gratuito — así como para los suscriptores de ChatGPT Work y Codex. El acceso abarca las aplicaciones de escritorio, la aplicación móvil y la interfaz web. Para los desarrolladores, dos nuevos modelos de API (GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst) se lanzaron simultáneamente y son accesibles a través del endpoint estándar de la API de OpenAI.

Novedades frente a ChatGPT Images 2

Velocidad y calidad

La mejora más destacada es la latencia: Images 2.5 ofrece hasta un 50% menos de latencia en la generación de imágenes en comparación con su predecesor. Esto se traduce en resultados notablemente más rápidos al obtener la primera imagen en sesiones interactivas y en un rendimiento sustancialmente mayor para las cargas de trabajo de la API. Más allá de la velocidad, OpenAI reporta condiciones de iluminación más naturales, texturas de superficie más ricas y una representación más precisa de la información del mundo real incorporada en las imágenes.

AtributoChatGPT Images 2 (April 2026)ChatGPT Images 2.5 (Sept 2026)
Latencia de generaciónLínea baseHasta un 50% menor
Iluminación y texturaEstándarMás natural, más rica
Edición en múltiples turnosBuenaMás fiable y acumulativa
Manejo de fondosLimitadoCompatibilidad total con fondos transparentes
Consistencia de estiloModeradaMás consistente entre turnos
Precisión del texto del mundo realEstándarMejorada

El predecesor Images 2 introdujo salida en resolución 2K, múltiples relaciones de aspecto, integración de búsqueda web, compatibilidad con escrituras no latinas y dos niveles de inteligencia (Instant y Thinking). Images 2.5 se construye sobre todo eso en lugar de reemplazarlo.

Fidelidad de referencias y edición precisa

Una de las mejoras más prácticas es la forma en que el modelo gestiona las fotos de referencia. Images 2.5 conserva los sujetos de tus imágenes de referencia con mayor fidelidad: rostros, objetos y elementos de marca se reproducen con más precisión cuando se utilizan como entradas.

ChatGPT Images 2 versus Images 2.5: hasta un 50% más rápido, mayor nitidez de detalle y fondos transparentes nativos

La precisión en la edición también mejoró de forma significativa. El modelo ahora modifica únicamente los elementos que solicitas de manera explícita, dejando el resto de la imagen intacto incluso cuando el fondo u otros sujetos son visualmente complejos. Los fondos transparentes y los diseños compuestos complejos se gestionan de forma fiable, lo que elimina un punto de fricción habitual en los flujos de trabajo de productos y comercio electrónico.

En conversaciones largas con múltiples turnos, las ediciones anteriores se mantienen: cada nueva instrucción se construye sobre el trabajo previo en lugar de restablecer el estado visual, y la calidad no se degrada a medida que el hilo de conversación crece. Los estilos visuales solicitados también se mantienen de forma más consistente de una edición a otra.

Nuevas herramientas de creación: Sketch, Templates, comentarios y uso compartido de prompts

Sketch

La nueva función más destacada de ChatGPT incluida con Images 2.5 es Sketch. Escribe “@Sketch” en cualquier conversación para abrir un lienzo de dibujo directamente dentro de ChatGPT, donde puedes esbozar una referencia visual aproximada —una composición, una forma, una relación espacial— que el modelo utiliza como guía al generar la imagen final. La superficie de Sketch está disponible en los clientes web y de escritorio. Esto elimina la brecha entre las descripciones verbales y la intención visual: en lugar de describir una composición con palabras, simplemente la dibujas. Para una guía completa, consulta nuestro artículo sobre la función de dibujo Sketch.

Templates, comentarios y uso compartido de prompts

Templates ofrece puntos de partida listos para usar en los formatos visuales más habituales. Entre las opciones disponibles se encuentran “Poster” para carteles de eventos y marketing, y “Merch” para mockups de productos; ambas cubren los casos de uso más frecuentes que antes requerían crear los prompts manualmente desde cero.

Ahora es posible colocar comentarios directamente sobre una imagen generada para señalar con precisión qué área o elemento necesita ajuste, sin necesidad de describir la ubicación espacial con largas explicaciones de texto. La función funciona de manera similar a las anotaciones en herramientas de diseño: haz clic en una región y escribe la instrucción de edición.

Cómo usar la función Sketch en ChatGPT: escribe @Sketch, dibuja una referencia y obtén la imagen

El uso compartido de prompts te permite exportar el prompt que hay detrás de cualquier imagen generada para que otras personas puedan reproducir la misma idea usando sus propias fotos y detalles contextuales. Es especialmente útil para equipos que iteran sobre un estilo visual y para creadores que desean construir recetas de imágenes reutilizables en lugar de resultados cerrados.

GPT-Image-2.5 Flare vs Sunburst (API)

Junto con la actualización de ChatGPT se lanzaron dos modelos de API diferenciados: GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst. Comparten la misma arquitectura de generación subyacente, pero están ajustados para distintos contextos de producción.

ModeloCaso de uso objetivoLatenciaPuntos fuertes
GPT-Image-2.5 FlareContenido para creadores, redes sociales, UX de producto, prototipado rápido, alto volumen50% menor que GPT-Image-2Velocidad, fondos transparentes, alto rendimiento
GPT-Image-2.5 SunburstCreatividades para campañas, imágenes de producto pulidas, flujos de trabajo visuales premiumMayorControl de edición más preciso, consistencia en producción

Flare — la opción rápida por defecto

GPT-Image-2.5 Flare es la elección predeterminada en el API para la mayoría de las aplicaciones: ofrece imágenes de mayor calidad que GPT-Image-2 con una latencia un 50 % menor. Las primeras evaluaciones del equipo de Manus, liderado por Lucky Liao, revelaron que Flare funciona entre dos y cuatro veces más rápido que GPT-Image-2, con una generación de fondos transparentes notablemente mejorada, un indicador clave para la fotografía de producto y los elementos superpuestos en e-commerce.

Flare está orientado a flujos de trabajo donde el volumen y la capacidad de respuesta son prioritarios:

  • Pipelines de contenido para creadores y redes sociales
  • Miniaturas de experiencia de producto y funciones de búsqueda visual
  • Ciclos de prototipado rápido
  • Escenarios de alto volumen en el API donde el rendimiento es un factor limitante

Sunburst — precisión premium

GPT-Image-2.5 Sunburst está diseñado para flujos de trabajo visuales de alto nivel que requieren un control más preciso a lo largo de una secuencia de ediciones. El material creativo listo para producción en campañas y las imágenes de producto muy elaboradas son sus puntos fuertes declarados. Los tiempos de generación son más largos que en Flare, pero a cambio ofrece mayor consistencia y precisión cuando un briefing creativo así lo exige.

Cómo elegir entre ambas opciones en la práctica:

  1. Empieza con Flare en cualquier proyecto nuevo: cubre la gran mayoría de los casos de uso.
  2. Evalúa la calidad del resultado frente a tus estándares visuales tras 10-20 generaciones de prueba.
  3. Si la consistencia a nivel de campaña o la precisión en la edición por pasos no es suficiente, cambia a Sunburst.
  4. Realiza un benchmark de latencia para tus dimensiones de imagen y la complejidad de tus prompts concretos.
  5. Ten en cuenta el coste en la decisión: ambos modelos tienen el mismo precio por token, así que la elección es puramente calidad frente a velocidad.
  6. Monitoriza las tasas de rechazo de resultados en producción; la menor tasa de generación adversarial de Sunburst puede ser relevante para contenido sujeto a mayor escrutinio.

Precios y disponibilidad en el API

Precios por token

Ambos modelos de GPT-Image-2.5 aplican las mismas tarifas en la página de precios de OpenAI:

  • Entrada de imagen: $8,00 por 1M de tokens ($2,00 en caché)
  • Salida de imagen: $30,00 por 1M de tokens
  • Entrada de texto: $5,00 por 1M de tokens ($1,25 en caché)

La estructura de precios sigue el mismo modelo basado en tokens que OpenAI utiliza en sus APIs de lenguaje, lo que significa que las entradas en caché son considerablemente más económicas, algo relevante para cualquier flujo de trabajo que procese imágenes de referencia similares de forma repetida.

Precios del API de GPT-Image-2.5 por 1M de tokens: entrada de imagen $8, salida de imagen $30, entrada de texto $5

Ecosistema

GPT-Image-2.5 ya está integrado en Adobe Firefly, el conjunto de herramientas de diseño generativo, gracias a una asociación anunciada junto con el lanzamiento. Matt Chotin de Adobe confirmó la integración. Higgsfield AI y Manus también fueron nombradas como socias iniciales que desarrollan sus productos sobre los nuevos modelos de API.

Estamos poniendo el modelo de generación y edición de imágenes más potente al alcance de todos —desde creadores individuales hasta equipos empresariales— porque la inteligencia visual se está convirtiendo en algo tan fundamental como la inteligencia lingüística.OpenAI, al anunciar ChatGPT Images 2.5

Seguridad, marcas de agua y procedencia

Seguridad en capas

Una ficha de sistema publicada el 8 de septiembre de 2026 describe la arquitectura de seguridad que respalda Images 2.5. El enfoque es por capas: controles de política basados en LLM evalúan y rechazan las solicitudes que infringen las normas antes de que comience cualquier generación, y un modelo de razonamiento de seguridad independiente supervisa tanto las entradas de texto como las de imagen, además de inspeccionar todos los resultados tras la generación.

OpenAI realizó evaluaciones adversariales automatizadas para medir la tasa de resultados no seguros que lograron eludir esas defensas:

  • Sunburst: tasa de generación adversarial no segura del 1,09 %
  • Flare: tasa de generación adversarial no segura del 1,41 %
  • Línea base de Images 2.0: 1,64 %

Ambos modelos nuevos puntúan por debajo de la línea base del modelo anterior. La evaluación del Marco de Preparación determinó que ninguno de los modelos supera los umbrales Bio Alto o Cibernético Alto —las dos categorías de riesgo más sensibles que OpenAI monitorea para sus modelos de frontera.

Procedencia: SynthID + C2PA

Cada imagen generada por Images 2.5 lleva dos capas de marcado de procedencia. La primera es los metadatos C2PA —un registro legible por máquina con información de origen incrustada según el estándar del Programa de Conformidad C2PA, que permite a herramientas, plataformas y navegadores intermediarios mostrar la procedencia verificada sin modificar la imagen visible.

La segunda capa es SynthID, el sistema de marcas de agua invisibles de Google DeepMind. A diferencia de las marcas de agua visibles, SynthID codifica una señal imperceptible en la estructura de píxeles que sobrevive a transformaciones habituales como el redimensionamiento o la recompresión JPEG. Según la descripción general de SynthID en Wikipedia, la tecnología se desarrolló originalmente para imágenes —lanzada por primera vez en agosto de 2023 para fotos generadas por Imagen— y desde entonces se ha extendido a audio, vídeo y texto.

Ambos mecanismos de procedencia se aplican en ChatGPT, Codex y la OpenAI API, de modo que cada superficie que genera una imagen a través de Images 2.5 produce un resultado trazable. Para una explicación más detallada, lee nuestro análisis sobre cómo funciona la marca de agua SynthID en imágenes de IA.

Nuevas herramientas de ChatGPT Images 2.5: Sketch, Templates, comentarios, compartir prompts, fondos transparentes y ediciones en múltiples turnos

FAQ

¿Cuándo salió ChatGPT Images 2.5?

ChatGPT Images 2.5 se lanzó el 8 de septiembre de 2026, aproximadamente cinco meses después de ChatGPT Images 2, que llegó en abril de 2026.

¿Cuál es la diferencia entre GPT-Image-2.5 Flare y Sunburst?

Flare es el modelo de API predeterminado, optimizado para velocidad: ofrece mayor calidad que GPT-Image-2 con una latencia un 50 % menor, lo que lo hace ideal para casos de uso en tiempo real y con grandes volúmenes. Sunburst está orientado a flujos de trabajo visuales de alto nivel, con un control de edición más preciso y una coherencia lista para producción, aunque a costa de tiempos de generación más largos.

¿Cuánto cuesta ChatGPT Images 2.5 en la API?

Tanto Flare como Sunburst aplican las mismas tarifas: entrada de imágenes a $8,00 por cada millón de tokens ($2,00 en caché), salida de imágenes a $30,00 por cada millón de tokens, y entrada de texto a $5,00 por cada millón de tokens ($1,25 en caché).

¿Cómo se usa la función Sketch en ChatGPT?

Escribe “@Sketch” en cualquier conversación de ChatGPT para abrir el lienzo de dibujo. Traza un boceto aproximado de la composición o la forma como referencia visual y, a continuación, describe la imagen que deseas: ChatGPT Images 2.5 utilizará tu dibujo para orientar el resultado final.

¿Las imágenes de ChatGPT Images 2.5 llevan marca de agua?

Sí. Cada imagen incluye metadatos C2PA (procedencia legible por máquina) y la marca de agua invisible SynthID de Google DeepMind. Ambas se aplican en ChatGPT, Codex y la API.

¿ChatGPT Images 2.5 es gratuito?

Images 2.5 está disponible para todos los niveles de ChatGPT, incluido el gratuito, así como para ChatGPT Work y Codex. El uso de la API con GPT-Image-2.5 Flare o Sunburst se factura por token según los precios estándar de OpenAI.