
OpenAI 8 সেপ্টেম্বর, 2026-এ ChatGPT Images 2.5 প্রকাশ করেছে, এটিকে কোম্পানির নতুন উন্নত ইমেজ মডেল বলে অভিহিত করেছে এবং এর API-তে দুটি সহযোগী মডেল যুক্ত করেছে। ওপেনএআই জানিয়েছে যে লোকেরা API-তে চ্যাটজিপিটি চিত্র এবং জিপিটি-ইমেজ মডেলগুলিতে প্রতি সপ্তাহে 3 বিলিয়নেরও বেশি ছবি তৈরি করে।
তীক্ষ্ণ চিত্র এবং নতুন সৃজনশীল সরঞ্জাম
OpenAI-এর মতে, Images 2.5 আরও প্রাকৃতিক আলো এবং সমৃদ্ধ টেক্সচার তৈরি করে, ব্যবহারকারীর রেফারেন্স ইমেজ থেকে বিষয়গুলিকে আরও ভালভাবে সংরক্ষণ করে এবং একাধিক রাউন্ডের কথোপকথন জুড়ে আরও নির্ভরযোগ্যভাবে সম্পাদনার নির্দেশাবলী অনুসরণ করে। কোম্পানি বলেছে যে এটি ইমেজ 2.0 এর তুলনায় ইমেজ তৈরির সময় 50% পর্যন্ত কমিয়েছে।
ওপেনএআই বলেছে যে মডেলটি কেবলমাত্র সেই উপাদানগুলিকে পরিবর্তন করতে আরও ভাল যা একজন ব্যবহারকারী এটিকে সম্পাদনা করতে বলে বাকি চিত্রগুলি অক্ষত রেখে, এমনকি জটিল বিষয় এবং পটভূমিতেও, এবং এটি বাস্তব-বিশ্বের তথ্য সম্বলিত চিত্রগুলিকে আরও নির্ভুলভাবে প্রক্রিয়া করে, স্বচ্ছ ব্যাকগ্রাউন্ড সহ আরও জটিল লেআউট পরিচালনা করে এবং অনুরোধকৃত ভিজ্যুয়াল শৈলীগুলি আরও ধারাবাহিকভাবে বজায় রাখে। দীর্ঘ কলের সময়, কোম্পানি বলেছে, পূর্ববর্তী সম্পাদনাগুলি অব্যাহত থাকার সম্ভাবনা বেশি এবং প্রতিটি নতুন নির্দেশনা চিত্রের গুণমানে আপস না করে পূর্ববর্তী কাজের উপর ভিত্তি করে তৈরি করে।
API ডেভেলপারদের জন্য, OpenAI বলেছে যে একই বিশ্বস্ততা রেফারেন্স-চালিত কর্মপ্রবাহকে আরও নির্ভরযোগ্য করে তোলে এবং আশেপাশের ব্র্যান্ডের থিম, রচনা এবং পরিচালনা করার সময় একটি পণ্য, পটভূমি বা অনুলিপির লাইনের মতো একটি একক উপাদানকে আপডেট করার অনুমতি দেয়।
মডেলের পাশাপাশি, OpenAI স্কেচ প্রবর্তন করেছে, একটি বৈশিষ্ট্য যা ব্যবহারকারীদের চ্যাটে “@Sketch” টাইপ করে সক্রিয় করা চূড়ান্ত চিত্রের জন্য একটি ভিজ্যুয়াল রেফারেন্স হিসাবে ChatGPT-এর মধ্যে সরাসরি আঁকতে দেয়। নতুন টেমপ্লেটগুলি “পোস্টার” এবং “মার্চ” সহ নামযুক্ত বিকল্পগুলির সাথে ফ্লায়ার এবং পণ্যের চিত্রের মতো জনপ্রিয় ফর্ম্যাটের জন্য শুরুর পয়েন্ট সরবরাহ করে। ব্যবহারকারীরা আরও মনোযোগী সম্পাদনার জন্য সরাসরি তৈরি করা চিত্রগুলিকে টীকাও দিতে পারে এবং একটি চিত্রের পিছনে প্রম্পটটি ভাগ করতে পারে যাতে অন্যরা তাদের নিজস্ব চিত্র এবং বিশদ বিবরণ দিয়ে ধারণাটি পুনরায় কার্যকর করতে পারে।
ইমেজ 2.5 ডেস্কটপ, মোবাইল এবং ওয়েবের সমস্ত স্তর জুড়ে সমস্ত ChatGPT, ChatGPT ওয়ার্ক এবং কোডেক্স ব্যবহারকারীদের কাছে রোল আউট করছে৷
এপিআই-এ ফ্লেয়ার এবং সানবার্স্ট
বিকাশকারীদের জন্য, OpenAI API-তে দুটি ইমেজ মডেল প্রকাশ করেছে। GPT-Image-2.5 Flare একই গুণমান, সম্পাদনা এবং গতির উন্নতি নিয়ে আসে এবং বেশিরভাগ অ্যাপ্লিকেশনের জন্য কোম্পানি ডিফল্ট হিসাবে অবস্থান করে; ওপেনএআই বলেছে যে এটি 50% কম লেটেন্সি সহ GPT-Image-2 এর চেয়ে উচ্চ মানের ছবি সরবরাহ করে, পণ্যের অভিজ্ঞতা, ভিজ্যুয়াল অনুসন্ধান, দ্রুত ইমেজ প্রোটোটাইপিং এবং উচ্চ-ভলিউম জেনারেশনের জন্য তৈরি ব্যবহার এবং সামাজিক সামগ্রীর জন্য উপযুক্ত। GPT-Image-2.5 Sunburst প্রিমিয়াম ভিজ্যুয়াল ওয়ার্কফ্লোগুলির জন্য তৈরি করা হয়েছে যা কঠোর সম্পাদনা নিয়ন্ত্রণ থেকে উপকৃত হয়, যেমন উৎপাদন-প্রস্তুত প্রচারাভিযান সৃজনশীল এবং পালিশ পণ্যের ছবি, দীর্ঘ প্রজন্মের সময়ের সাথে।
ওপেনএআই ঘোষণার পাশাপাশি তিনজন প্রাথমিক গ্রাহকের কাছ থেকে বিবৃতি প্রকাশ করেছে। অ্যাডোবের সিনিয়র প্রোডাক্ট ম্যানেজার ম্যাট চুটিন বলেছেন, ওপেনএআই-এর জিপিটি-ইমেজ-2.5 মডেলগুলি এখন অ্যাডোবি ফায়ারফ্লাই, অ্যাডোবের সৃজনশীল কৃত্রিম বুদ্ধিমত্তা স্টুডিওতে উপলব্ধ। মানুস মূল্যায়ন দলের লাকি লিয়াও বলেছেন যে ফ্লেয়ার টিমের মূল্যায়নে GPT-ইমেজ-2-এর দুই থেকে চার গুণ গতিতে উচ্চ-মানের ছবি সরবরাহ করেছে, উন্নত স্বচ্ছ পটভূমি তৈরির বিষয়টি লক্ষ্য করে। হিগসফিল্ড এআই-এর পণ্যের প্রধান আকসোলতান আলিমকুলভ বলেছেন, মডেলটি সম্পাদনার মাধ্যমে একটি আসল চিত্রের চরিত্র, রচনা এবং ভিজ্যুয়াল পরিচয় সংরক্ষণ করে।
OpenAI-এর মূল্য নির্ধারণের পৃষ্ঠায় উভয় মডেলকে একই হারে তালিকাভুক্ত করা হয়েছে: প্রতি মিলিয়ন টোকেনে 8.00 ডলারে ইমেজ ইনপুট, বা ক্যাশে ইনপুটের জন্য প্রতি মিলিয়ন টোকেনে $2.00, প্রতি মিলিয়ন টোকেনে $30.00 এ ইমেজ আউটপুট, এবং প্রতি মিলিয়ন টোকেনে $5.00 বা ক্যাশে টেক্সট ইনপুট $1.25। পৃষ্ঠাটি সানবার্স্টকে কার্যপ্রবাহের জন্য নির্মিত হিসাবে বর্ণনা করে যেখানে সম্পাদনার নির্ভুলতা সর্বাপেক্ষা গুরুত্বপূর্ণ এবং প্রতিদিনের উচ্চ-মানের চিত্র তৈরির জন্য OpenAI-এর দ্রুততম মডেল হিসাবে ফ্লেয়ার।
নিরাপত্তা এবং উত্স মূল্যায়ন
ওপেনএআই 8 সেপ্টেম্বর, 2026-এ রিলিজের জন্য একটি সিস্টেম টিকিটও প্রকাশ করেছে। টিকিটে বলা হয়েছে যে GPT-Image-2.5-Sunburst এবং GPT-Image-2.5-Flare বিভিন্ন ডেটাসেটের উপর প্রশিক্ষিত হয়েছে যার মধ্যে রয়েছে সর্বজনীনভাবে উপলব্ধ ইন্টারনেট তথ্য, তৃতীয় পক্ষের অংশীদারিত্বের মাধ্যমে অ্যাক্সেসযোগ্য ডেটা, এবং ক্ষতিকারক ব্যবহারকারী এবং প্রশিক্ষকদের নিরাপত্তার লক্ষ্যে তথ্য প্রদানের জন্য বা তৈরি করা তথ্যের জন্য। সংবেদনশীল বিষয়বস্তু। এটি উল্লেখ করেছে যে উচ্চতর বাস্তববাদ, সুরক্ষার অভাবে, ওপেনএআই-এর ব্যবহার নীতি লঙ্ঘন করে, প্রকৃত মানুষ, স্থান বা ঘটনাগুলির গভীর এবং আরও বিশ্বাসযোগ্য জালিয়াতি সক্ষম করতে পারে।
কার্ডটি একটি স্তরযুক্ত সুরক্ষা স্ট্যাকের বর্ণনা করে: LLM-ভিত্তিক নীতি পরীক্ষা করা হয় নির্মাণ শুরু হওয়ার আগে লঙ্ঘনের অনুরোধগুলি প্রত্যাখ্যান করে এবং একটি সুরক্ষা যুক্তি মডেল তারপর পাঠ্য এবং চিত্র ইনপুটকে গাইড করে এবং সেগুলি প্রদর্শিত হওয়ার আগে চূড়ান্ত আউটপুটগুলি পরীক্ষা করে, যখন কেউ নীতি লঙ্ঘন করে তখন সৃষ্টিকে ব্লক করে৷
OpenAI-এর স্বয়ংক্রিয় মূল্যায়নে, যা সমস্ত নিরীক্ষণ করা নিরাপত্তা বিভাগে নীতি-লঙ্ঘনকারী ছবি আপলোড করার জন্য ডিজাইন করা অনুমান ব্যবহার করেছে, সাম্প্রতিক অনিরাপদ প্রজন্মগুলি সানবার্স্টের জন্য 1.09% এবং ফ্লেয়ারের জন্য 1.41% পরিমাপ করেছে, ChatGPT চিত্র 2.0-এর জন্য 1.64% বেসলাইনের তুলনায়। কার্ডটি সতর্ক করে যে প্রতিপক্ষের পরীক্ষা স্যুটটি উত্পাদন ট্র্যাফিকের প্রতিনিধি নয়, যে স্বয়ংক্রিয় নীতির লেবেলে ত্রুটি থাকতে পারে এবং ফলাফলগুলি নির্দিষ্ট পরীক্ষার স্যুট এবং মূল্যায়নকৃত কনফিগারেশনগুলিতে প্রযোজ্য।
OpenAI এর প্রস্তুতি কাঠামোর অধীনে, যা জৈবিক এবং রাসায়নিক ঝুঁকি, সাইবার নিরাপত্তা, এবং স্ব-উন্নতি কৃত্রিম বুদ্ধিমত্তা ট্র্যাক করে, কার্ড রিপোর্ট করে যে মডেলগুলির কোনটিই বায়ো হাই বা সাইবার হাই থ্রেশহোল্ড অতিক্রম করে না। OpenAI বলেছে যে এটি তথাপি নিরাপত্তা যুক্তি মডেলের মাধ্যমে প্রয়োগ করা ইমেজ-নির্দিষ্ট জৈব নিরাপত্তা নীতি, ইনপুট এবং আউটপুট স্তরগুলিতে লাইভ ব্লকিং, অফলাইন পর্যালোচনা যা মানব পর্যালোচকদের সাথে স্বয়ংক্রিয় সিস্টেমকে একত্রিত করে এবং অ্যাকাউন্ট সাসপেনশন সহ বায়োহাজার্ড সতর্কতা প্রয়োগ করে যেখানে ক্রমাগত অপব্যবহারের ধরণ সনাক্ত করা হয়।
এটির উৎপত্তির জন্য, কার্ডটি বলে যে OpenAI C2PA কনফরমিটি প্রোগ্রামের মাধ্যমে C2PA মেটাডেটা চালিয়ে যাচ্ছে এবং ChatGPT, কোডেক্স এবং OpenAI API জুড়ে Google DeepMind-এর SynthID অদৃশ্য ওয়াটারমার্ক যুক্ত করেছে।