২০২৬ সালের ৮ September, OpenAI ChatGPT Images 2.5 প্রকাশ করেছে — এটি তাদের পরবর্তী প্রজন্মের ইমেজ মডেল, যেখানে আরও উন্নত আউটপুট, ৫০% পর্যন্ত দ্রুততর জেনারেশন এবং নতুনভাবে ডিজাইন করা এডিটিং অভিজ্ঞতা রয়েছে। এটি April ২০২৬-এর ChatGPT Images 2-এর স্থলাভিষিক্ত হয়েছে এবং তাৎক্ষণিকভাবে সব টিয়ারের সকল ব্যবহারকারীর জন্য ChatGPT-এর ডিফল্ট ইমেজ ইঞ্জিন হয়ে উঠেছে।

এই লঞ্চের প্রেক্ষাপটটি অবিশ্বাস্য: মানুষ ইতিমধ্যে ChatGPT Images এবং API-তে পাওয়া GPT-Image মডেলগুলো ব্যবহার করে প্রতি সপ্তাহে ৩ বিলিয়নেরও বেশি ইমেজ তৈরি করছে। Images 2.5 ডেস্কটপ, মোবাইল এবং ওয়েবে সমস্ত ChatGPT, ChatGPT Work এবং Codex ব্যবহারকারীদের কাছে পৌঁছে দেওয়া হচ্ছে — পাশাপাশি বিভিন্ন প্রোডাকশন ওয়ার্কলোডের জন্য দুটি নতুন API মডেলও আনা হয়েছে।
OpenAI ২০২৬ সালের ৮ September ChatGPT Images 2.5 প্রকাশ করেছে এবং এটিকে এখন পর্যন্ত কোম্পানির সবচেয়ে সক্ষম ইমেজ মডেল হিসেবে উপস্থাপন করেছে। এটি April ২০২৬-এ আসা ChatGPT Images 2-এর পরে আসছে, প্রায় পাঁচ মাসের ব্যবধানে, এবং GPT-6 Astra লঞ্চের ঠিক পরপরই এটি এসেছে। OpenAI-এর এই নতুন ইমেজ মডেলটি ChatGPT-এর ভেতরে বর্তমান ডিফল্ট জেনারেশন ইঞ্জিন হিসেবে কাজ করার জন্য তৈরি — অর্থাৎ প্রতিটি নতুন ইমেজ রিকোয়েস্ট কোনো সেটিং পরিবর্তন ছাড়াই স্বয়ংক্রিয়ভাবে Images 2.5-এ চলে।
মডেলটি একটি বংশধারার শীর্ষে রয়েছে যা DALL-E পর্যন্ত বিস্তৃত, যেটি OpenAI-এর প্রাথমিক ইমেজ গবেষণা ছিল। সেই সময় থেকে, মনোযোগ কেবল গবেষণার প্রদর্শনী থেকে সরে গিয়ে প্রোডাকশন-উপযোগী টুলের দিকে গেছে: মাল্টি-টার্ন এডিটিং, রেফারেন্স ফিডেলিটি এবং স্কেলে গতি এখন শুধু অভিনবত্বের মানদণ্ডের চেয়ে অনেক বেশি গুরুত্বপূর্ণ।
Images 2.5 সমস্ত ChatGPT টিয়ারে পাওয়া যাচ্ছে — বিনামূল্যের টিয়ার সহ — এবং ChatGPT Work ও Codex সাবস্ক্রাইবারদের জন্যও। ডেস্কটপ অ্যাপ, মোবাইল অ্যাপ এবং ওয়েব ইন্টারফেস — সবখানেই অ্যাক্সেস পাওয়া যাবে। ডেভেলপারদের জন্য, দুটি নতুন API মডেল (GPT-Image-2.5 Flare এবং GPT-Image-2.5 Sunburst) একই সময়ে প্রকাশিত হয়েছে এবং এগুলো স্ট্যান্ডার্ড OpenAI API এন্ডপয়েন্টের মাধ্যমে অ্যাক্সেসযোগ্য।
সবচেয়ে বড় উন্নতি হলো লেটেন্সিতে: Images 2.5 তার পূর্ববর্তী সংস্করণের তুলনায় ছবি তৈরির লেটেন্সি সর্বোচ্চ ৫০% কমিয়ে এনেছে। এর ফলে ইন্টারঅ্যাক্টিভ সেশনে প্রথম ছবি উল্লেখযোগ্যভাবে দ্রুত পাওয়া যায় এবং API ওয়ার্কলোডে থ্রুপুট অনেকটা বৃদ্ধি পায়। গতির পাশাপাশি, OpenAI জানিয়েছে যে আলোর অবস্থা আরও স্বাভাবিক হয়েছে, সারফেস টেক্সচার আরও সমৃদ্ধ হয়েছে এবং ছবিতে এমবেড করা বাস্তব-বিশ্বের তথ্য আরও নির্ভুলভাবে রেন্ডার হচ্ছে।
| বৈশিষ্ট্য | ChatGPT Images 2 (April 2026) | ChatGPT Images 2.5 (Sept 2026) |
|---|---|---|
| তৈরির লেটেন্সি | বেসলাইন | সর্বোচ্চ ৫০% কম |
| আলো ও টেক্সচার | সাধারণ | আরও স্বাভাবিক, আরও সমৃদ্ধ |
| মাল্টি-টার্ন এডিটিং | ভালো | আরও নির্ভরযোগ্য, যোগাত্মক |
| ব্যাকগ্রাউন্ড হ্যান্ডলিং | সীমিত | সম্পূর্ণ ট্রান্সপারেন্ট সাপোর্ট |
| স্টাইলের সামঞ্জস্য | মাঝারি | একাধিক টার্নে আরও সামঞ্জস্যপূর্ণ |
| বাস্তব-বিশ্বের টেক্সট নির্ভুলতা | সাধারণ | উন্নত |
পূর্ববর্তী সংস্করণ Images 2 ২K রেজোলিউশন আউটপুট, একাধিক আসপেক্ট রেশিও, ওয়েব রিসার্চ ইন্টিগ্রেশন, নন-লাটিন স্ক্রিপ্টের সাপোর্ট এবং দুটি ইন্টেলিজেন্স লেভেল (Instant ও Thinking) চালু করেছিল। Images 2.5 সেগুলো প্রতিস্থাপন না করে তার উপর ভিত্তি করে তৈরি হয়েছে।
সবচেয়ে ব্যবহারিক উন্নতিগুলোর একটি হলো মডেলটি রেফারেন্স ফটো কীভাবে সামলায়। Images 2.5 আপনার রেফারেন্স ছবির বিষয়বস্তু আরও বেশি বিশ্বস্ততার সাথে সংরক্ষণ করে — ইনপুট হিসেবে ব্যবহার করলে মুখ, বস্তু এবং ব্র্যান্ডের উপাদানগুলো আরও নির্ভুলভাবে উঠে আসে।

এডিটিং নির্ভুলতাও উল্লেখযোগ্যভাবে উন্নত হয়েছে। মডেলটি এখন কেবল সেই উপাদানগুলোই পরিবর্তন করে যা আপনি স্পষ্টভাবে চেয়েছেন, ব্যাকগ্রাউন্ড বা অন্যান্য বিষয়বস্তু দৃশ্যত জটিল হলেও বাকি ছবি অপরিবর্তিত থাকে। ট্রান্সপারেন্ট ব্যাকগ্রাউন্ড এবং জটিল কম্পোজিট লেআউট নির্ভরযোগ্যভাবে হ্যান্ডেল হয়, যা পণ্য ও ই-কমার্স ওয়ার্কফ্লোতে একটি সাধারণ সমস্যা দূর করে।
দীর্ঘ মাল্টি-টার্ন কথোপকথনে, আগের এডিটগুলো এগিয়ে যায়: প্রতিটি নতুন নির্দেশনা আগের কাজের উপর ভিত্তি করে তৈরি হয়, ভিজ্যুয়াল স্টেট রিসেট হয় না এবং কথোপকথন বাড়তে থাকলেও মান কমে না। চাওয়া ভিজ্যুয়াল স্টাইলগুলোও এক এডিট থেকে আরেক এডিটে আরও সামঞ্জস্যপূর্ণভাবে বজায় থাকে।
Images 2.5-এর সঙ্গে আসা ChatGPT-এর সবচেয়ে আলাদা নতুন ফিচারটি হলো Sketch। যেকোনো চ্যাটে “@Sketch” টাইপ করলে ChatGPT-এর মধ্যেই একটি ড্রইং ক্যানভাস খুলে যায়, যেখানে আপনি একটি মোটামুটি ভিজ্যুয়াল রেফারেন্স — একটি লেআউট, একটি আকৃতি, স্থানিক সম্পর্ক — স্কেচ করতে পারেন, যা চূড়ান্ত ছবি তৈরির সময় মডেলটি গাইড হিসেবে ব্যবহার করে। Sketch surface ওয়েব ও ডেস্কটপ ক্লায়েন্টে পাওয়া যায়। এটি মৌখিক বর্ণনা ও ভিজ্যুয়াল উদ্দেশ্যের মধ্যে ফাঁকটা পূরণ করে: রচনা শব্দে বর্ণনা করার বদলে আপনি সরাসরি এঁকে দেখান। বিস্তারিত জানতে আমাদের Sketch ড্রইং ফিচারের গাইড দেখুন।
Templates সাধারণ ভিজ্যুয়াল ফরম্যাটের জন্য প্রস্তুত শুরুর বিন্দু দেয়। নামযুক্ত বিকল্পগুলোর মধ্যে আছে ইভেন্ট ও মার্কেটিং ফ্লায়ারের জন্য “Poster” এবং পণ্যের মকআপের জন্য “Merch” — দুটিই সেই সবচেয়ে বেশি ব্যবহৃত ক্ষেত্রগুলো কভার করে, যেগুলোতে আগে শুরু থেকে হাতে প্রম্পট লিখতে হতো।
এখন সরাসরি তৈরি হওয়া ছবির উপর মন্তব্য রাখা যায়, যাতে ঠিক কোন জায়গা বা উপাদানটি পরিবর্তন দরকার তা নির্দিষ্ট করা সম্ভব — স্থানিক অবস্থান দীর্ঘ টেক্সটে বর্ণনা করার দরকার পড়ে না। ফিচারটি ডিজাইন-টুলের অ্যানোটেশনের মতো কাজ করে: একটি অংশে ক্লিক করুন, সম্পাদনার নির্দেশ টাইপ করুন।

প্রম্পট শেয়ারিং দিয়ে যেকোনো তৈরি ছবির পেছনের প্রম্পটটি এক্সপোর্ট করা যায়, যাতে অন্যরা নিজেদের ছবি ও প্রাসঙ্গিক বিবরণ ব্যবহার করে একই ধারণাটি পুনরায় চালাতে পারেন। একটি ভিজ্যুয়াল স্টাইলে পুনরাবৃত্তি করা দলের জন্য এবং যেসব নির্মাতা লকড আউটপুটের বদলে রিমিক্সযোগ্য ইমেজ রেসিপি তৈরি করতে চান তাদের জন্য এটি কাজে আসে।
ChatGPT আপডেটের পাশাপাশি দুটি আলাদা API মডেল এসেছে: GPT-Image-2.5 Flare এবং GPT-Image-2.5 Sunburst। উভয়ের একই মূল জেনারেশন আর্কিটেকচার থাকলেও ভিন্ন প্রোডাকশন প্রেক্ষাপটের জন্য সুর করা হয়েছে।
| মডেল | লক্ষ্য ব্যবহারক্ষেত্র | লেটেন্সি | শক্তিমত্তা |
|---|---|---|---|
| GPT-Image-2.5 Flare | নির্মাতা কন্টেন্ট, সোশ্যাল, পণ্য UX, দ্রুত প্রোটোটাইপিং, বেশি পরিমাণ | GPT-Image-2-এর চেয়ে ৫০% কম | গতি, স্বচ্ছ ব্যাকগ্রাউন্ড, উচ্চ থ্রুপুট |
| GPT-Image-2.5 Sunburst | ক্যাম্পেইন ক্রিয়েটিভ, পরিশীলিত পণ্য চিত্র, প্রিমিয়াম ভিজ্যুয়াল ওয়ার্কফ্লো | বেশি | সূক্ষ্ম সম্পাদনা নিয়ন্ত্রণ, প্রোডাকশন সামঞ্জস্য |
GPT-Image-2.5 Flare বেশিরভাগ অ্যাপ্লিকেশনের জন্য ডিফল্ট API পছন্দ: এটি GPT-Image-2-এর চেয়ে উন্নত মানের Images তৈরি করে এবং লেটেন্সি ৫০% কম। Manus টিমের প্রাথমিক মূল্যায়নে, যার নেতৃত্বে ছিলেন Lucky Liao, দেখা গেছে Flare GPT-Image-2-এর তুলনায় দুই থেকে চার গুণ দ্রুত চলে এবং স্বচ্ছ-পটভূমি তৈরিতে উল্লেখযোগ্যভাবে উন্নত — যা পণ্য ফটোগ্রাফি এবং ই-কমার্স ওভারলের জন্য গুরুত্বপূর্ণ।
Flare সেসব কাজের জন্য উপযুক্ত যেখানে পরিমাণ ও দ্রুত প্রতিক্রিয়া গুরুত্বপূর্ণ:
GPT-Image-2.5 Sunburst সেসব প্রিমিয়াম ভিজ্যুয়াল ওয়ার্কফ্লোর জন্য তৈরি যেখানে একাধিক সম্পাদনার ধাপ জুড়ে আরও কঠোর নিয়ন্ত্রণ প্রয়োজন। প্রোডাকশন-রেডি ক্যাম্পেইন ক্রিয়েটিভ এবং পরিমার্জিত পণ্য চিত্র এর প্রধান ব্যবহারক্ষেত্র। Flare-এর তুলনায় তৈরির সময় বেশি লাগে, তবে বিনিময়ে মিলবে অধিক সামঞ্জস্য ও নির্ভুলতা — যখন কোনো ক্রিয়েটিভ ব্রিফে তা জরুরি।
ব্যবহারিক ক্ষেত্রে কোনটি বেছে নেবেন:
উভয় GPT-Image-2.5 মডেল OpenAI pricing page-এ একই হার ব্যবহার করে:
মূল্য কাঠামো OpenAI-এর ভাষা API জুড়ে ব্যবহৃত একই টোকেন-ভিত্তিক মডেল অনুসরণ করে, অর্থাৎ ক্যাশড ইনপুট উল্লেখযোগ্যভাবে সস্তা — যা এমন যেকোনো ওয়ার্কফ্লোর জন্য প্রাসঙ্গিক যেখানে বারবার একই ধরনের রেফারেন্স ইমেজ প্রক্রিয়া করা হয়।

GPT-Image-2.5 ইতিমধ্যে Adobe Firefly-এ একীভূত হয়েছে — এটি একটি জেনারেটিভ ডিজাইন টুলকিট — লঞ্চের পাশাপাশি ঘোষিত একটি অংশীদারিত্বের মাধ্যমে। Adobe-এর ম্যাট চোটিন এই একীভূতকরণের বিষয়টি নিশ্চিত করেছেন। Higgsfield AI এবং Manus-কেও নতুন API মডেলের উপর ভিত্তি করে তৈরি করা প্রাথমিক অংশীদার হিসেবে নাম দেওয়া হয়েছে।
ব্যক্তিগত স্রষ্টা থেকে শুরু করে এন্টারপ্রাইজ দল পর্যন্ত সবার কাছে সবচেয়ে শক্তিশালী Images তৈরি ও সম্পাদনার মডেল সহজলভ্য করে তুলছি আমরা — কারণ দৃশ্যমান বুদ্ধিমত্তা ভাষাগত বুদ্ধিমত্তার মতোই মৌলিক হয়ে উঠছে।OpenAI, ChatGPT Images 2.5 ঘোষণা করতে গিয়ে
September 8, 2026 তারিখে প্রকাশিত একটি system card Images 2.5-এর পেছনের নিরাপত্তা কাঠামো বর্ণনা করে। পদ্ধতিটি স্তরবিন্যস্ত: LLM-ভিত্তিক নীতি পরীক্ষা যেকোনো তৈরি শুরু হওয়ার আগেই নিয়মলঙ্ঘনমূলক অনুরোধগুলো মূল্যায়ন করে প্রত্যাখ্যান করে, এবং একটি আলাদা নিরাপত্তা রিজনিং মডেল টেক্সট ও Images উভয় ইনপুট পর্যবেক্ষণ করে পাশাপাশি তৈরির পরে সমস্ত আউটপুটও পরীক্ষা করে।
OpenAI সেই প্রতিরক্ষাগুলো এড়িয়ে যাওয়া অনিরাপদ আউটপুটের হার পরিমাপ করতে স্বয়ংক্রিয় অ্যাডভার্সেরিয়াল মূল্যায়ন পরিচালনা করেছে:
উভয় নতুন মডেলই পূর্ববর্তী বেসলাইনের নিচে স্কোর করে। Preparedness Framework মূল্যায়নে দেখা গেছে, কোনো মডেলই Bio High বা Cyber High সীমা অতিক্রম করে না — এগুলো OpenAI যে দুটি সবচেয়ে সংবেদনশীল ঝুঁকি বিভাগ ফ্রন্টিয়ার মডেলের জন্য ট্র্যাক করে।
Images 2.5 দ্বারা তৈরি প্রতিটি Images দুটি স্তরের উৎস-তথ্য চিহ্ন বহন করে। প্রথমটি হলো C2PA মেটাডেটা — উৎস তথ্যের একটি মেশিন-পাঠযোগ্য রেকর্ড যা C2PA Conformance Program মানদণ্ড অনুযায়ী এমবেড করা হয়, যা ডাউনস্ট্রিম টুল, প্ল্যাটফর্ম এবং ব্রাউজারকে দৃশ্যমান Images পরিবর্তন না করেই যাচাইকৃত উৎস-তথ্য প্রদর্শন করতে সক্ষম করে।
দ্বিতীয় স্তরটি হলো SynthID — Google DeepMind-এর অদৃশ্য ওয়াটারমার্কিং সিস্টেম। দৃশ্যমান ওয়াটারমার্কের বিপরীতে, SynthID পিক্সেল কাঠামোতে একটি অনুভবযোগ্য নয় এমন সংকেত এনকোড করে যা রিসাইজিং বা JPEG পুনরায় কম্প্রেশনের মতো সাধারণ রূপান্তর থেকে টিকে যায়। Wikipedia-তে SynthID সংক্রান্ত ওভারভিউ অনুযায়ী, প্রযুক্তিটি মূলত Images-এর জন্য তৈরি করা হয়েছিল — August 2023-এ Imagen-তৈরি ছবির জন্য প্রথম চালু হয়েছিল — এবং তখন থেকে অডিও, ভিডিও এবং টেক্সটে প্রসারিত হয়েছে।
উভয় উৎস-তথ্য প্রক্রিয়াই ChatGPT, Codex এবং OpenAI API জুড়ে প্রযোজ্য — তাই Images 2.5-এর মাধ্যমে Images তৈরি করে এমন প্রতিটি পৃষ্ঠ একটি ট্রেসযোগ্য আউটপুট তৈরি করে। আরও গভীর ব্যাখ্যার জন্য, AI Images-এ SynthID ওয়াটারমার্ক কীভাবে কাজ করে সে সম্পর্কে আমাদের বিশ্লেষণ পড়ুন।

ChatGPT Images 2.5 প্রকাশিত হয়েছে ৮ সেপ্টেম্বর, ২০২৬ তারিখে — ChatGPT Images 2 প্রকাশের প্রায় পাঁচ মাস পর, যা ২০২৬ সালের এপ্রিলে এসেছিল।
Flare হলো গতির জন্য অপ্টিমাইজ করা ডিফল্ট API মডেল — এটি GPT-Image-2-এর চেয়ে বেশি মানের আউটপুট দেয়, তবে লেটেন্সি ৫০% কম, যা বড় পরিসরের ও রিয়েল-টাইম ব্যবহারের জন্য আদর্শ। Sunburst উচ্চমানের ভিজ্যুয়াল ওয়ার্কফ্লোর জন্য তৈরি, যেখানে এডিটিং নিয়ন্ত্রণ আরও নিখুঁত এবং প্রোডাকশনের উপযোগী ধারাবাহিকতা রয়েছে — তবে ইমেজ তৈরিতে বেশি সময় লাগে।
Flare এবং Sunburst উভয়ের জন্য একই রেট প্রযোজ্য: ইমেজ ইনপুট প্রতি ১M টোকেনে $8.00 (ক্যাশড $2.00), ইমেজ আউটপুট প্রতি ১M টোকেনে $30.00, এবং টেক্সট ইনপুট প্রতি ১M টোকেনে $5.00 (ক্যাশড $1.25)।
যেকোনো ChatGPT চ্যাটে “@Sketch” টাইপ করলে ড্রইং ক্যানভাস খুলে যাবে। একটি মোটামুটি লেআউট বা আকৃতি এঁকে ভিজ্যুয়াল রেফারেন্স হিসেবে দিন, তারপর আপনি যে ইমেজ চান তা বর্ণনা করুন — ChatGPT Images 2.5 আপনার স্কেচকে গাইড হিসেবে ব্যবহার করে চূড়ান্ত ফলাফল তৈরি করবে।
হ্যাঁ। প্রতিটি ছবিতে C2PA মেটাডেটা (মেশিন-পাঠযোগ্য উৎস তথ্য) এবং Google DeepMind-এর SynthID অদৃশ্য ওয়াটারমার্ক যুক্ত থাকে। এটি ChatGPT, Codex এবং API — সব ক্ষেত্রেই প্রযোজ্য।
Images 2.5 ChatGPT-এর সব স্তরে পাওয়া যাবে, বিনামূল্যের স্তরসহ, পাশাপাশি ChatGPT Work এবং Codex-এও। GPT-Image-2.5 Flare বা Sunburst দিয়ে API ব্যবহারের ক্ষেত্রে OpenAI-এর স্ট্যান্ডার্ড মূল্য অনুযায়ী প্রতি টোকেনে চার্জ নেওয়া হবে।