ChatGPT Images 2.5: چه چیزی در مدل تصویری پیشرفته OpenAI تازه است؟

در ۸ سپتامبر ۲۰۲۶، OpenAI نسخه ChatGPT Images 2.5 را منتشر کرد — مدل تصویری نسل بعدی این شرکت با خروجی واضح‌تر، سرعت تولید تا ۵۰٪ بیشتر، و تجربه ویرایش کاملاً بازطراحی‌شده. این مدل جانشین ChatGPT Images 2 از April ۲۰۲۶ است و بلافاصله به موتور پیش‌فرض تولید تصویر در ChatGPT برای تمام کاربران در همه سطح‌ها تبدیل می‌شود.

هر تصویر ChatGPT Images 2.5 دارای واترمارک نامرئی SynthID و متادیتای منشأ C2PA است

زمینه این انتشار شگفت‌انگیز است: مردم هم‌اکنون هر هفته بیش از ۳ میلیارد تصویر از طریق ChatGPT Images و مدل‌های GPT-Image موجود در API می‌سازند. Images 2.5 برای تمام کاربران ChatGPT، ChatGPT Work و Codex در نسخه‌های دسکتاپ، موبایل و وب عرضه می‌شود — همراه با دو مدل API جدید که برای بارهای کاری تولیدی متفاوت طراحی شده‌اند.

ChatGPT Images 2.5 چیست؟

انتشار و جایگاه‌بندی

OpenAI در ۸ سپتامبر ۲۰۲۶ مدل ChatGPT Images 2.5 را منتشر کرد و آن را به عنوان توانمندترین مدل تصویری شرکت تا به امروز معرفی نمود. این مدل پس از ChatGPT Images 2 که در April ۲۰۲۶ و تقریباً پنج ماه پیش از آن عرضه شده بود، و در پی راه‌اندازی GPT-6 Astra منتشر می‌شود. مدل تصویری جدید OpenAI طراحی شده تا به عنوان موتور تولید پیش‌فرض فعلی در ChatGPT عمل کند — یعنی هر درخواست تصویر جدید به‌طور خودکار روی Images 2.5 اجرا می‌شود و نیازی به تغییر تنظیمات نیست.

این مدل در بالای یک سلسله‌نسب قرار دارد که از DALL-E، اولین پژوهش تصویری OpenAI، آغاز می‌شود. در طول این مسیر، تمرکز از نمایش‌های پژوهشی صرف به ابزارهای سطح تولید تغییر یافته است: ویرایش چندمرحله‌ای، دقت در بازتولید مرجع، و سرعت در مقیاس، همه مهم‌تر از معیارهای نوآوری به تنهایی هستند.

چه کسانی می‌توانند از آن استفاده کنند

Images 2.5 برای تمام سطح‌های ChatGPT — از جمله سطح رایگان — و همچنین مشترکان ChatGPT Work و Codex در دسترس است. دسترسی شامل اپلیکیشن‌های دسکتاپ، اپلیکیشن موبایل و رابط وب می‌شود. برای توسعه‌دهندگان، دو مدل API جدید (GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst) به‌طور همزمان عرضه شده‌اند و از طریق endpoint استاندارد OpenAI API قابل دسترسی هستند.

چه چیزی در ChatGPT Images 2.5 نسبت به ChatGPT Images 2 تغییر کرده است

سرعت و کیفیت

مهم‌ترین پیشرفت، کاهش تأخیر است: Images 2.5 در مقایسه با نسخه قبلی، تأخیر تولید تصویر را تا ۵۰٪ کاهش می‌دهد. این به معنای دریافت سریع‌تر اولین تصویر در جلسات تعاملی و افزایش چشمگیر توان عملیاتی برای بارهای کاری API است. فراتر از سرعت، OpenAI از بهبود شرایط نوردهی طبیعی‌تر، بافت‌های سطحی غنی‌تر و رندر دقیق‌تر اطلاعات واقعی جاسازی‌شده در تصاویر خبر می‌دهد.

ویژگیChatGPT Images 2 (April 2026)ChatGPT Images 2.5 (Sept 2026)
تأخیر تولیدپایهتا ۵۰٪ کمتر
نوردهی و بافتاستانداردطبیعی‌تر و غنی‌تر
ویرایش چندمرحله‌ایخوبقابل‌اعتمادتر و افزایشی
مدیریت پس‌زمینهمحدودپشتیبانی کامل از شفافیت
ثبات سبکمتوسطسازگارتر در طول مکالمه
دقت متن واقعیاستانداردبهبودیافته

نسخه پیشین Images 2 قابلیت‌هایی مانند خروجی با وضوح ۲K، نسبت‌های تصویر متعدد، یکپارچه‌سازی با جستجوی وب، پشتیبانی از خطوط غیرلاتین و دو سطح هوشمندی (Instant و Thinking) را معرفی کرد. Images 2.5 بر تمام این قابلیت‌ها می‌افزاید و جایگزین آن‌ها نمی‌شود.

وفاداری به مرجع و ویرایش دقیق

یکی از عملی‌ترین ارتقاها، نحوه پردازش تصاویر مرجع توسط مدل است. Images 2.5 سوژه‌های موجود در تصاویر مرجع شما را با وفاداری بیشتری حفظ می‌کند — چهره‌ها، اشیاء و عناصر برند‌دار هنگام استفاده به‌عنوان ورودی با دقت بیشتری بازتولید می‌شوند.

ChatGPT Images 2 در برابر Images 2.5: تا ۵۰٪ سریع‌تر، جزئیات واضح‌تر و پس‌زمینه‌های شفاف بومی

دقت ویرایش نیز به‌طور قابل‌توجهی بهبود یافته است. اکنون مدل تنها عناصری را تغییر می‌دهد که صریحاً درخواست کرده‌اید و بقیه تصویر را حتی در صورت پیچیدگی بصری پس‌زمینه یا سایر سوژه‌ها دست‌نخورده باقی می‌گذارد. پس‌زمینه‌های شفاف و چیدمان‌های ترکیبی پیچیده به‌شکلی قابل‌اعتماد مدیریت می‌شوند که این امر نقطه اصطکاک رایج در گردش‌کارهای محصول و تجارت الکترونیک را برطرف می‌کند.

در مکالمات طولانی چندمرحله‌ای، ویرایش‌های قبلی حفظ می‌شوند: هر دستورالعمل جدید بر اساس کارهای پیشین ساخته می‌شود نه اینکه وضعیت بصری را از نو شروع کند، و کیفیت با رشد رشته مکالمه کاهش نمی‌یابد. سبک‌های بصری درخواست‌شده نیز از ویرایشی به ویرایش دیگر با ثبات بیشتری حفظ می‌شوند.

ابزارهای جدید: Sketch، Templates، نظرات و اشتراک‌گذاری پرامپت

Sketch

برجسته‌ترین قابلیت جدید ChatGPT که همراه با Images 2.5 ارائه شده، Sketch است. با تایپ کردن «@Sketch» در هر مکالمه، یک بوم طراحی مستقیماً درون ChatGPT باز می‌شود؛ جایی که می‌توانید یک طرح اولیه بکشید — یک چیدمان، یک شکل، یک رابطه فضایی — تا مدل از آن به عنوان راهنما برای تولید تصویر نهایی استفاده کند. سطح Sketch در نسخه وب و کلاینت‌های دسکتاپ در دسترس است. این قابلیت شکاف میان توصیف کلامی و قصد بصری را پر می‌کند: به جای توضیح ترکیب‌بندی با کلمات، آن را رسم می‌کنید. برای راهنمای کامل، راهنمای ویژگی طراحی Sketch را ببینید.

Templates، نظرات و اشتراک‌گذاری پرامپت

Templates نقاط شروع آماده‌ای برای قالب‌های بصری رایج فراهم می‌کنند. گزینه‌های نام‌گذاری‌شده شامل «Poster» برای فلایرهای رویداد و بازاریابی و «Merch» برای موکاپ‌های محصول هستند — هر دو پرکاربردترین موارد استفاده‌ای را پوشش می‌دهند که پیش از این نیاز به پرامپت‌نویسی دستی از صفر داشتند.

اکنون می‌توان نظرات را مستقیماً روی تصویر تولیدشده قرار داد تا دقیقاً مشخص شود کدام ناحیه یا المان نیاز به اصلاح دارد؛ این قابلیت جایگزین توصیف‌های طولانی متنی درباره موقعیت فضایی می‌شود. این ویژگی مشابه حاشیه‌نویسی در ابزارهای طراحی کار می‌کند: روی یک ناحیه کلیک کنید و دستور ویرایش را تایپ کنید.

نحوه استفاده از ویژگی Sketch در ChatGPT: تایپ @Sketch، رسم یک مرجع، دریافت تصویر

اشتراک‌گذاری پرامپت به شما امکان می‌دهد پرامپت پشت هر تصویر تولیدشده را صادر کنید تا دیگران بتوانند همان ایده را با عکس‌ها و جزئیات بافتی خود دوباره اجرا کنند. این قابلیت برای تیم‌هایی که روی یک سبک بصری تکرار می‌کنند و برای سازندگانی که می‌خواهند دستورالعمل‌های تصویری قابل ریمیکس بسازند — نه خروجی‌های قفل‌شده — بسیار مفید است.

GPT-Image-2.5 Flare در برابر Sunburst (API)

دو مدل API مجزا همزمان با به‌روزرسانی ChatGPT عرضه شدند: GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst. این دو مدل از همان معماری تولید پایه بهره می‌برند اما برای بافت‌های تولیدی متفاوت تنظیم شده‌اند.

مدلحوزه استفاده هدفتأخیرنقاط قوت
GPT-Image-2.5 Flareمحتوای سازندگان، شبکه‌های اجتماعی، UX محصول، نمونه‌سازی سریع، حجم بالا۵۰٪ کمتر از GPT-Image-2سرعت، پس‌زمینه‌های شفاف، توان عملیاتی بالا
GPT-Image-2.5 Sunburstمحتوای کمپین‌های تبلیغاتی، تصاویر محصول صیقلی، جریان‌کاری بصری درجه یکبیشترکنترل ویرایش دقیق‌تر، ثبات در تولید

Flare — پیش‌فرض سریع

GPT-Image-2.5 Flare گزینه‌ی پیش‌فرض API برای اکثر برنامه‌هاست: کیفیتی بالاتر از GPT-Image-2 با تأخیر ۵۰٪ کمتر ارائه می‌دهد. ارزیابی‌های اولیه‌ی تیم Manus به رهبری Lucky Liao نشان داد که Flare با سرعتی دو تا چهار برابر GPT-Image-2 کار می‌کند و تولید تصاویر با پس‌زمینه‌ی شفاف را به شکل محسوسی بهبود بخشیده است — معیاری که برای عکاسی محصول و لایه‌گذاری در فروشگاه‌های اینترنتی اهمیت دارد.

Flare برای کارهایی طراحی شده که حجم بالا و پاسخ‌دهی سریع در آن‌ها اهمیت دارد:

  • خطوط تولید محتوا برای سازندگان و شبکه‌های اجتماعی
  • تصاویر بند انگشتی تجربه‌ی محصول و ویژگی‌های جستجوی تصویری
  • چرخه‌های نمونه‌سازی سریع
  • سناریوهای API با حجم بالا که توان عملیاتی محدودیت ایجاد می‌کند

Sunburst — دقت ممتاز

GPT-Image-2.5 Sunburst برای جریان‌های کاری بصری ممتازی ساخته شده که نیاز به کنترل دقیق‌تر در یک توالی از ویرایش‌ها دارند. خلاقیت کمپین‌های آماده برای تولید و تصاویر محصول صیقلی، حوزه‌های اصلی هدف آن هستند. زمان تولید از Flare بیشتر است، اما در مقابل، زمانی که یک بریف خلاقانه به آن نیاز دارد، انسجام و دقت بیشتری ارائه می‌دهد.

نحوه‌ی انتخاب میان آن‌ها در عمل:

  1. هر پروژه‌ی جدید را با Flare شروع کنید — اکثریت قریب به اتفاق موارد استفاده را پوشش می‌دهد.
  2. پس از ۱۰ تا ۲۰ تولید آزمایشی، کیفیت خروجی را با استاندارد بصری خود ارزیابی کنید.
  3. اگر انسجام در سطح کمپین یا دقت ویرایش چندمرحله‌ای کافی نبود، به Sunburst بروید.
  4. برای ابعاد تصویر و پیچیدگی پرامپت خاص خود، معیارسنجی تأخیر انجام دهید.
  5. هزینه را در تصمیم لحاظ کنید — هر دو مدل قیمت‌گذاری یکسان بر اساس توکن دارند، پس انتخاب صرفاً میان کیفیت و سرعت است.
  6. نرخ رد خروجی را در محیط تولید پایش کنید؛ نرخ پایین‌تر تولید مخرب در Sunburst ممکن است برای محتوای با بررسی دقیق اهمیت داشته باشد.

قیمت‌گذاری و دسترسی در API

قیمت‌گذاری بر اساس توکن

هر دو مدل GPT-Image-2.5 نرخ‌های یکسانی در صفحه‌ی قیمت‌گذاری OpenAI دارند:

  • ورودی تصویر: $۸.۰۰ به ازای هر ۱M توکن ($۲.۰۰ کَش‌شده)
  • خروجی تصویر: $۳۰.۰۰ به ازای هر ۱M توکن
  • ورودی متن: $۵.۰۰ به ازای هر ۱M توکن ($۱.۲۵ کَش‌شده)

ساختار قیمت‌گذاری از همان مدل مبتنی بر توکنی پیروی می‌کند که OpenAI در API‌های زبانی خود به کار می‌برد، به این معنا که ورودی‌های کَش‌شده به طور قابل توجهی ارزان‌تر هستند — نکته‌ای که برای هر جریان کاری که تصاویر مرجع مشابه را به طور مکرر پردازش می‌کند اهمیت دارد.

قیمت‌گذاری API برای GPT-Image-2.5 به ازای هر ۱M توکن: ورودی تصویر $۸، خروجی تصویر $۳۰، ورودی متن $۵

اکوسیستم

GPT-Image-2.5 از همان ابتدا در Adobe Firefly، مجموعه ابزارهای طراحی مولد، ادغام شده است؛ این همکاری همزمان با عرضه مدل اعلام شد. Matt Chotin از Adobe این ادغام را تأیید کرد. Higgsfield AI و Manus نیز به‌عنوان از شرکای اولیه‌ای نام برده شدند که روی مدل‌های جدید API توسعه می‌دهند.

ما قدرتمندترین مدل تولید و ویرایش تصویر را برای همه در دسترس می‌گذاریم — از سازندگان مستقل گرفته تا تیم‌های سازمانی — چون هوش بصری دارد به اندازه هوش زبانی بنیادی می‌شود.OpenAI، در هنگام معرفی ChatGPT Images 2.5

ایمنی، واترمارک و منشأ

ایمنی چندلایه

یک کارت سیستم که در ۸ September ۲۰۲۶ منتشر شد، معماری ایمنی پشت Images 2.5 را توضیح می‌دهد. رویکرد به‌صورت چندلایه طراحی شده است: بررسی‌های مبتنی بر LLM درخواست‌های نقض‌کننده را پیش از شروع هرگونه تولید، ارزیابی و رد می‌کنند، و یک مدل استدلال ایمنی مجزا هم ورودی‌های متنی و هم تصویری را رصد می‌کند و همه خروجی‌ها را پس از تولید بررسی می‌نماید.

OpenAI ارزیابی‌های خصمانه خودکار انجام داد تا نرخ خروجی‌های ناایمنی را که از این سدها عبور کرده‌اند، اندازه‌گیری کند:

  • Sunburst: نرخ تولید ناایمن خصمانه ۱.۰۹٪
  • Flare: نرخ تولید ناایمن خصمانه ۱.۴۱٪
  • پایه Images 2.0: ۱.۶۴٪

هر دو مدل جدید پایین‌تر از نسل قبلی قرار دارند. ارزیابی چارچوب Preparedness نشان داد که هیچ‌کدام از مدل‌ها از آستانه‌های Bio High یا Cyber High عبور نمی‌کنند — دو دسته ریسک حساسی که OpenAI برای مدل‌های مرزی دنبال می‌کند.

منشأ: SynthID + C2PA

هر تصویری که توسط Images 2.5 تولید می‌شود، دو لایه نشانه‌گذاری منشأ دارد. لایه اول متادیتای C2PA است — یک رکورد قابل خواندن توسط ماشین که اطلاعات منشأ را بر اساس استاندارد C2PA Conformance Program در تصویر جاسازی می‌کند و به ابزارها، پلتفرم‌ها و مرورگرهای پایین‌دستی امکان می‌دهد منشأ تأییدشده را بدون تغییر در تصویر قابل مشاهده نمایش دهند.

لایه دوم SynthID، سیستم واترمارک‌گذاری نامرئی Google DeepMind است. برخلاف واترمارک‌های قابل مشاهده، SynthID یک سیگنال نامحسوس را در ساختار پیکسلی رمزگذاری می‌کند که در برابر تبدیل‌های رایجی مانند تغییر اندازه یا فشرده‌سازی مجدد JPEG دوام می‌آورد. طبق مروری بر SynthID در ویکی‌پدیا، این فناوری در اصل برای تصاویر توسعه یافت — برای اولین بار در August ۲۰۲۳ برای عکس‌های تولیدشده توسط Imagen راه‌اندازی شد — و از آن زمان به صوت، ویدئو و متن نیز گسترش یافته است.

هر دو مکانیزم منشأ در ChatGPT، Codex و OpenAI API اعمال می‌شوند — بنابراین هر سطحی که از طریق Images 2.5 تصویری تولید کند، خروجی قابل ردیابی به‌جا می‌گذارد. For توضیح عمیق‌تر، مقاله ما را درباره نحوه کارکرد واترمارک SynthID روی تصاویر هوش مصنوعی بخوانید.

ابزارهای جدید ChatGPT Images 2.5: Sketch، Templates، نظرات، اشتراک‌گذاری پرامپت، پس‌زمینه‌های شفاف، ویرایش‌های چندمرحله‌ای

سؤالات متداول

تصاویر ChatGPT 2.5 کِی منتشر شد؟

تصاویر ChatGPT 2.5 در ۸ سپتامبر ۲۰۲۶ منتشر شد — تقریباً پنج ماه پس از تصاویر ChatGPT 2 که در آوریل ۲۰۲۶ عرضه شده بود.

تفاوت بین GPT-Image-2.5 Flare و Sunburst چیست؟

Flare مدل پیش‌فرض API است که برای سرعت بهینه شده — کیفیتی بالاتر از GPT-Image-2 با تأخیر ۵۰٪ کمتر ارائه می‌دهد و برای موارد استفاده با حجم بالا و بلادرنگ ایده‌آل است. Sunburst برای جریان‌های کاری بصری حرفه‌ای طراحی شده و کنترل دقیق‌تری بر ویرایش و یکپارچگی مناسب محیط تولید دارد، اما زمان تولید طولانی‌تری می‌طلبد.

هزینه استفاده از تصاویر ChatGPT 2.5 در API چقدر است؟

هر دو مدل Flare و Sunburst نرخ یکسانی دارند: ورودی تصویر ۸.۰۰ دلار به ازای هر ۱ میلیون توکن (۲.۰۰ دلار برای حالت کش‌شده)، خروجی تصویر ۳۰.۰۰ دلار به ازای هر ۱ میلیون توکن، و ورودی متن ۵.۰۰ دلار به ازای هر ۱ میلیون توکن (۱.۲۵ دلار برای حالت کش‌شده).

چطور از قابلیت Sketch در ChatGPT استفاده کنم؟

در هر گفتگوی ChatGPT عبارت «‎@Sketch» را تایپ کنید تا بوم طراحی باز شود. یک طرح اولیه یا شکل کلی به عنوان مرجع بصری بکشید، سپس تصویر مورد نظرتان را توصیف کنید — تصاویر ChatGPT 2.5 از طراحی شما برای هدایت نتیجه نهایی استفاده می‌کند.

آیا تصاویر تولیدشده توسط ChatGPT Images 2.5 واترمارک دارند؟

بله. هر تصویر دارای متادیتای C2PA (منشأ قابل خواندن توسط ماشین) و واترمارک نامرئی SynthID گوگل دیپ‌مایند است. هر دو در ChatGPT، Codex و API اعمال می‌شوند.

آیا ChatGPT Images 2.5 رایگان است؟

Images 2.5 برای تمام سطوح ChatGPT از جمله سطح رایگان، و همچنین ChatGPT Work و Codex در دسترس قرار می‌گیرد. استفاده از API با GPT-Image-2.5 Flare یا Sunburst بر اساس قیمت‌گذاری استاندارد OpenAI به ازای هر توکن محاسبه می‌شود.