در ۸ سپتامبر ۲۰۲۶، OpenAI نسخه ChatGPT Images 2.5 را منتشر کرد — مدل تصویری نسل بعدی این شرکت با خروجی واضحتر، سرعت تولید تا ۵۰٪ بیشتر، و تجربه ویرایش کاملاً بازطراحیشده. این مدل جانشین ChatGPT Images 2 از April ۲۰۲۶ است و بلافاصله به موتور پیشفرض تولید تصویر در ChatGPT برای تمام کاربران در همه سطحها تبدیل میشود.

زمینه این انتشار شگفتانگیز است: مردم هماکنون هر هفته بیش از ۳ میلیارد تصویر از طریق ChatGPT Images و مدلهای GPT-Image موجود در API میسازند. Images 2.5 برای تمام کاربران ChatGPT، ChatGPT Work و Codex در نسخههای دسکتاپ، موبایل و وب عرضه میشود — همراه با دو مدل API جدید که برای بارهای کاری تولیدی متفاوت طراحی شدهاند.
OpenAI در ۸ سپتامبر ۲۰۲۶ مدل ChatGPT Images 2.5 را منتشر کرد و آن را به عنوان توانمندترین مدل تصویری شرکت تا به امروز معرفی نمود. این مدل پس از ChatGPT Images 2 که در April ۲۰۲۶ و تقریباً پنج ماه پیش از آن عرضه شده بود، و در پی راهاندازی GPT-6 Astra منتشر میشود. مدل تصویری جدید OpenAI طراحی شده تا به عنوان موتور تولید پیشفرض فعلی در ChatGPT عمل کند — یعنی هر درخواست تصویر جدید بهطور خودکار روی Images 2.5 اجرا میشود و نیازی به تغییر تنظیمات نیست.
این مدل در بالای یک سلسلهنسب قرار دارد که از DALL-E، اولین پژوهش تصویری OpenAI، آغاز میشود. در طول این مسیر، تمرکز از نمایشهای پژوهشی صرف به ابزارهای سطح تولید تغییر یافته است: ویرایش چندمرحلهای، دقت در بازتولید مرجع، و سرعت در مقیاس، همه مهمتر از معیارهای نوآوری به تنهایی هستند.
Images 2.5 برای تمام سطحهای ChatGPT — از جمله سطح رایگان — و همچنین مشترکان ChatGPT Work و Codex در دسترس است. دسترسی شامل اپلیکیشنهای دسکتاپ، اپلیکیشن موبایل و رابط وب میشود. برای توسعهدهندگان، دو مدل API جدید (GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst) بهطور همزمان عرضه شدهاند و از طریق endpoint استاندارد OpenAI API قابل دسترسی هستند.
مهمترین پیشرفت، کاهش تأخیر است: Images 2.5 در مقایسه با نسخه قبلی، تأخیر تولید تصویر را تا ۵۰٪ کاهش میدهد. این به معنای دریافت سریعتر اولین تصویر در جلسات تعاملی و افزایش چشمگیر توان عملیاتی برای بارهای کاری API است. فراتر از سرعت، OpenAI از بهبود شرایط نوردهی طبیعیتر، بافتهای سطحی غنیتر و رندر دقیقتر اطلاعات واقعی جاسازیشده در تصاویر خبر میدهد.
| ویژگی | ChatGPT Images 2 (April 2026) | ChatGPT Images 2.5 (Sept 2026) |
|---|---|---|
| تأخیر تولید | پایه | تا ۵۰٪ کمتر |
| نوردهی و بافت | استاندارد | طبیعیتر و غنیتر |
| ویرایش چندمرحلهای | خوب | قابلاعتمادتر و افزایشی |
| مدیریت پسزمینه | محدود | پشتیبانی کامل از شفافیت |
| ثبات سبک | متوسط | سازگارتر در طول مکالمه |
| دقت متن واقعی | استاندارد | بهبودیافته |
نسخه پیشین Images 2 قابلیتهایی مانند خروجی با وضوح ۲K، نسبتهای تصویر متعدد، یکپارچهسازی با جستجوی وب، پشتیبانی از خطوط غیرلاتین و دو سطح هوشمندی (Instant و Thinking) را معرفی کرد. Images 2.5 بر تمام این قابلیتها میافزاید و جایگزین آنها نمیشود.
یکی از عملیترین ارتقاها، نحوه پردازش تصاویر مرجع توسط مدل است. Images 2.5 سوژههای موجود در تصاویر مرجع شما را با وفاداری بیشتری حفظ میکند — چهرهها، اشیاء و عناصر برنددار هنگام استفاده بهعنوان ورودی با دقت بیشتری بازتولید میشوند.

دقت ویرایش نیز بهطور قابلتوجهی بهبود یافته است. اکنون مدل تنها عناصری را تغییر میدهد که صریحاً درخواست کردهاید و بقیه تصویر را حتی در صورت پیچیدگی بصری پسزمینه یا سایر سوژهها دستنخورده باقی میگذارد. پسزمینههای شفاف و چیدمانهای ترکیبی پیچیده بهشکلی قابلاعتماد مدیریت میشوند که این امر نقطه اصطکاک رایج در گردشکارهای محصول و تجارت الکترونیک را برطرف میکند.
در مکالمات طولانی چندمرحلهای، ویرایشهای قبلی حفظ میشوند: هر دستورالعمل جدید بر اساس کارهای پیشین ساخته میشود نه اینکه وضعیت بصری را از نو شروع کند، و کیفیت با رشد رشته مکالمه کاهش نمییابد. سبکهای بصری درخواستشده نیز از ویرایشی به ویرایش دیگر با ثبات بیشتری حفظ میشوند.
برجستهترین قابلیت جدید ChatGPT که همراه با Images 2.5 ارائه شده، Sketch است. با تایپ کردن «@Sketch» در هر مکالمه، یک بوم طراحی مستقیماً درون ChatGPT باز میشود؛ جایی که میتوانید یک طرح اولیه بکشید — یک چیدمان، یک شکل، یک رابطه فضایی — تا مدل از آن به عنوان راهنما برای تولید تصویر نهایی استفاده کند. سطح Sketch در نسخه وب و کلاینتهای دسکتاپ در دسترس است. این قابلیت شکاف میان توصیف کلامی و قصد بصری را پر میکند: به جای توضیح ترکیببندی با کلمات، آن را رسم میکنید. برای راهنمای کامل، راهنمای ویژگی طراحی Sketch را ببینید.
Templates نقاط شروع آمادهای برای قالبهای بصری رایج فراهم میکنند. گزینههای نامگذاریشده شامل «Poster» برای فلایرهای رویداد و بازاریابی و «Merch» برای موکاپهای محصول هستند — هر دو پرکاربردترین موارد استفادهای را پوشش میدهند که پیش از این نیاز به پرامپتنویسی دستی از صفر داشتند.
اکنون میتوان نظرات را مستقیماً روی تصویر تولیدشده قرار داد تا دقیقاً مشخص شود کدام ناحیه یا المان نیاز به اصلاح دارد؛ این قابلیت جایگزین توصیفهای طولانی متنی درباره موقعیت فضایی میشود. این ویژگی مشابه حاشیهنویسی در ابزارهای طراحی کار میکند: روی یک ناحیه کلیک کنید و دستور ویرایش را تایپ کنید.

اشتراکگذاری پرامپت به شما امکان میدهد پرامپت پشت هر تصویر تولیدشده را صادر کنید تا دیگران بتوانند همان ایده را با عکسها و جزئیات بافتی خود دوباره اجرا کنند. این قابلیت برای تیمهایی که روی یک سبک بصری تکرار میکنند و برای سازندگانی که میخواهند دستورالعملهای تصویری قابل ریمیکس بسازند — نه خروجیهای قفلشده — بسیار مفید است.
دو مدل API مجزا همزمان با بهروزرسانی ChatGPT عرضه شدند: GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst. این دو مدل از همان معماری تولید پایه بهره میبرند اما برای بافتهای تولیدی متفاوت تنظیم شدهاند.
| مدل | حوزه استفاده هدف | تأخیر | نقاط قوت |
|---|---|---|---|
| GPT-Image-2.5 Flare | محتوای سازندگان، شبکههای اجتماعی، UX محصول، نمونهسازی سریع، حجم بالا | ۵۰٪ کمتر از GPT-Image-2 | سرعت، پسزمینههای شفاف، توان عملیاتی بالا |
| GPT-Image-2.5 Sunburst | محتوای کمپینهای تبلیغاتی، تصاویر محصول صیقلی، جریانکاری بصری درجه یک | بیشتر | کنترل ویرایش دقیقتر، ثبات در تولید |
GPT-Image-2.5 Flare گزینهی پیشفرض API برای اکثر برنامههاست: کیفیتی بالاتر از GPT-Image-2 با تأخیر ۵۰٪ کمتر ارائه میدهد. ارزیابیهای اولیهی تیم Manus به رهبری Lucky Liao نشان داد که Flare با سرعتی دو تا چهار برابر GPT-Image-2 کار میکند و تولید تصاویر با پسزمینهی شفاف را به شکل محسوسی بهبود بخشیده است — معیاری که برای عکاسی محصول و لایهگذاری در فروشگاههای اینترنتی اهمیت دارد.
Flare برای کارهایی طراحی شده که حجم بالا و پاسخدهی سریع در آنها اهمیت دارد:
GPT-Image-2.5 Sunburst برای جریانهای کاری بصری ممتازی ساخته شده که نیاز به کنترل دقیقتر در یک توالی از ویرایشها دارند. خلاقیت کمپینهای آماده برای تولید و تصاویر محصول صیقلی، حوزههای اصلی هدف آن هستند. زمان تولید از Flare بیشتر است، اما در مقابل، زمانی که یک بریف خلاقانه به آن نیاز دارد، انسجام و دقت بیشتری ارائه میدهد.
نحوهی انتخاب میان آنها در عمل:
هر دو مدل GPT-Image-2.5 نرخهای یکسانی در صفحهی قیمتگذاری OpenAI دارند:
ساختار قیمتگذاری از همان مدل مبتنی بر توکنی پیروی میکند که OpenAI در APIهای زبانی خود به کار میبرد، به این معنا که ورودیهای کَششده به طور قابل توجهی ارزانتر هستند — نکتهای که برای هر جریان کاری که تصاویر مرجع مشابه را به طور مکرر پردازش میکند اهمیت دارد.

GPT-Image-2.5 از همان ابتدا در Adobe Firefly، مجموعه ابزارهای طراحی مولد، ادغام شده است؛ این همکاری همزمان با عرضه مدل اعلام شد. Matt Chotin از Adobe این ادغام را تأیید کرد. Higgsfield AI و Manus نیز بهعنوان از شرکای اولیهای نام برده شدند که روی مدلهای جدید API توسعه میدهند.
ما قدرتمندترین مدل تولید و ویرایش تصویر را برای همه در دسترس میگذاریم — از سازندگان مستقل گرفته تا تیمهای سازمانی — چون هوش بصری دارد به اندازه هوش زبانی بنیادی میشود.OpenAI، در هنگام معرفی ChatGPT Images 2.5
یک کارت سیستم که در ۸ September ۲۰۲۶ منتشر شد، معماری ایمنی پشت Images 2.5 را توضیح میدهد. رویکرد بهصورت چندلایه طراحی شده است: بررسیهای مبتنی بر LLM درخواستهای نقضکننده را پیش از شروع هرگونه تولید، ارزیابی و رد میکنند، و یک مدل استدلال ایمنی مجزا هم ورودیهای متنی و هم تصویری را رصد میکند و همه خروجیها را پس از تولید بررسی مینماید.
OpenAI ارزیابیهای خصمانه خودکار انجام داد تا نرخ خروجیهای ناایمنی را که از این سدها عبور کردهاند، اندازهگیری کند:
هر دو مدل جدید پایینتر از نسل قبلی قرار دارند. ارزیابی چارچوب Preparedness نشان داد که هیچکدام از مدلها از آستانههای Bio High یا Cyber High عبور نمیکنند — دو دسته ریسک حساسی که OpenAI برای مدلهای مرزی دنبال میکند.
هر تصویری که توسط Images 2.5 تولید میشود، دو لایه نشانهگذاری منشأ دارد. لایه اول متادیتای C2PA است — یک رکورد قابل خواندن توسط ماشین که اطلاعات منشأ را بر اساس استاندارد C2PA Conformance Program در تصویر جاسازی میکند و به ابزارها، پلتفرمها و مرورگرهای پاییندستی امکان میدهد منشأ تأییدشده را بدون تغییر در تصویر قابل مشاهده نمایش دهند.
لایه دوم SynthID، سیستم واترمارکگذاری نامرئی Google DeepMind است. برخلاف واترمارکهای قابل مشاهده، SynthID یک سیگنال نامحسوس را در ساختار پیکسلی رمزگذاری میکند که در برابر تبدیلهای رایجی مانند تغییر اندازه یا فشردهسازی مجدد JPEG دوام میآورد. طبق مروری بر SynthID در ویکیپدیا، این فناوری در اصل برای تصاویر توسعه یافت — برای اولین بار در August ۲۰۲۳ برای عکسهای تولیدشده توسط Imagen راهاندازی شد — و از آن زمان به صوت، ویدئو و متن نیز گسترش یافته است.
هر دو مکانیزم منشأ در ChatGPT، Codex و OpenAI API اعمال میشوند — بنابراین هر سطحی که از طریق Images 2.5 تصویری تولید کند، خروجی قابل ردیابی بهجا میگذارد. For توضیح عمیقتر، مقاله ما را درباره نحوه کارکرد واترمارک SynthID روی تصاویر هوش مصنوعی بخوانید.

تصاویر ChatGPT 2.5 در ۸ سپتامبر ۲۰۲۶ منتشر شد — تقریباً پنج ماه پس از تصاویر ChatGPT 2 که در آوریل ۲۰۲۶ عرضه شده بود.
Flare مدل پیشفرض API است که برای سرعت بهینه شده — کیفیتی بالاتر از GPT-Image-2 با تأخیر ۵۰٪ کمتر ارائه میدهد و برای موارد استفاده با حجم بالا و بلادرنگ ایدهآل است. Sunburst برای جریانهای کاری بصری حرفهای طراحی شده و کنترل دقیقتری بر ویرایش و یکپارچگی مناسب محیط تولید دارد، اما زمان تولید طولانیتری میطلبد.
هر دو مدل Flare و Sunburst نرخ یکسانی دارند: ورودی تصویر ۸.۰۰ دلار به ازای هر ۱ میلیون توکن (۲.۰۰ دلار برای حالت کششده)، خروجی تصویر ۳۰.۰۰ دلار به ازای هر ۱ میلیون توکن، و ورودی متن ۵.۰۰ دلار به ازای هر ۱ میلیون توکن (۱.۲۵ دلار برای حالت کششده).
در هر گفتگوی ChatGPT عبارت «@Sketch» را تایپ کنید تا بوم طراحی باز شود. یک طرح اولیه یا شکل کلی به عنوان مرجع بصری بکشید، سپس تصویر مورد نظرتان را توصیف کنید — تصاویر ChatGPT 2.5 از طراحی شما برای هدایت نتیجه نهایی استفاده میکند.
بله. هر تصویر دارای متادیتای C2PA (منشأ قابل خواندن توسط ماشین) و واترمارک نامرئی SynthID گوگل دیپمایند است. هر دو در ChatGPT، Codex و API اعمال میشوند.
Images 2.5 برای تمام سطوح ChatGPT از جمله سطح رایگان، و همچنین ChatGPT Work و Codex در دسترس قرار میگیرد. استفاده از API با GPT-Image-2.5 Flare یا Sunburst بر اساس قیمتگذاری استاندارد OpenAI به ازای هر توکن محاسبه میشود.