এখনই, ওপেনএআই একাধিক লাইনে এগিয়ে গেছে, পরবর্তী জন্মের মডেল আস্ট্রা (প্রচলিত GPT-6) এর জন্য প্রিমারি প্রচার শুরু করেছে:
অফিসিয়াল হঠাৎ একটি প্রযুক্তিগত দীর্ঘ লেখা প্রকাশ করেছে, প্রথমবারের মতো আস্ট্রার ক্ষমতার মূল বৈশিষ্ট্যগুলি প্রকাশ করেছে;
এরপর, অটম্যান নিজেই একটি ছোট লেখা লিখে ব্যাখ্যা করেন যে কেন আস্ট্রা এখনও লঞ্চ হয়নি;
পরে, দুইজন চীনা গবেষক একের পর এক কথা বলেন, আগে কখনও প্রকাশিত না হওয়া অভ্যন্তরীণ পরীক্ষার ফলাফল একেবারে প্রাথমিক বিস্তারিত তথ্য দিয়ে শেয়ার করেন।

কয়েক ঘন্টার মধ্যে, সমস্ত সংকেত একই দিকে ইঙ্গিত করছে:
OpenAI-এর পরবর্তী জেনারেশনের ফ্ল্যাগশিপ মডেলটি এখন প্রস্তুত।

অ্যালটিম্যান একটি ছোট লেখায় উল্লেখ করেছেন যে, অ্যাস্ট্রা ইতিমধ্যেই প্রশিক্ষণ সম্পন্ন করেছে, এবং এটি এখনও প্রকাশিত হয়নি কারণ মডেলটি যথেষ্ট শক্তিশালী নয় বলে নয়।
বরং, এটি এই কারণে যে অ্যাস্ট্রা এতটাই শক্তিশালী হয়ে উঠেছে যে কোম্পানিকে সক্রিয়ভাবে ব্রেক চাপতে হয়েছে।
অল্টিম্যান এই অভিজ্ঞতাকে একটি নিয়মিত টানাটানি হিসেবে বর্ণনা করেছেন:
অ্যাস্ট্রা দ্বারা আনা ক্ষমতার উন্নতির উপর উত্তেজিত হওয়ার পাশাপাশি, এই ক্ষমতাগুলির পরিণতি কেউই সম্পূর্ণরূপে পূর্বানুমান করতে পারে না বলে উদ্বিগ্ন।
সুতরাং গত গ্রীষ্মকালের সম্পূর্ণ সময় ধরে, ওপেনএআই প্রায় সম্পূর্ণভাবে অ্যাস্ট্রাকে সুরক্ষা প্রদান, সমন্বয় করা এবং হালটার যোগ করার উপর কাজ করেছে।
তিনি এও বলেছেন যে, অ্যাস্ট্রার পরের মডেলগুলির ক্ষেত্রে প্রয়োজন হলে সুরক্ষা এবং সামঞ্জস্যতা গবেষণার জন্য সময় বরাদ্দ করতে সচেতনভাবে গতি কমানো হবে।
?? অ্যাস্ট্রা কতটা শক্তিশালী? ওপেনএআই কেন মনে করছে এখনই প্রকাশ করা যাবে?
এই পাবলিক টেকনিক্যাল ব্লগটি হয়তো আমাদের একটি পর্যবেক্ষণের জন্য একটি জানালা প্রদান করে।
GPT-5.6 Sol এর চেয়ে বেশি ভালোভাবে ভাঙ্গন শনাক্ত করে, অভ্যন্তরীণ পরীক্ষায় পূর্ণ নম্বর পায়
অফিসিয়াল বিবৃতি অনুযায়ী, এস্ট্রা এবার মুক্ত হওয়ার মূল কারণ হল এটি “সাইবার-ক্রিটিক্যাল” ক্ষমতার সীমানা অতিক্রম করেছে।
এটি ওপেনএআইয়ের প্রথম মডেল যা এই শ্রেণীতে আনুষ্ঠানিকভাবে অন্তর্ভুক্ত করা হয়েছে।

"ক্রিটিক্যাল লেভেল" বলতে বোঝায় যে অ্যাস্ট্রা সংশ্লিষ্ট টুলস এবং পরিবেশের অনুমতি পাওয়ার পরে, এখন এটি নিজেই অজানা ভালনাগুলি খুঁজে বার করতে, তাদের ব্যবহার করতে এবং বিশেষভাবে শক্তিশালীকৃত সিস্টেমগুলিকে আক্রমণ করতে পারে, মানুষের ধাপে ধাপে নির্দেশনা ছাড়াই।
সবচেয়ে স্পষ্ট অর্জন হল এস্ট্রা পাবলিক এক্সপ্লয়েট বেঞ্চমার্ক ExploitBench-এ 100% সফলতার পরিসংখ্যান অর্জন করেছে।

পাবলিক প্রশ্নগুলি এটিকে বাধা দিতে পারেনি, তাই OpenAI অস্থায়ীভাবে একটি নতুন প্রশ্নপত্র তৈরি করেছে।
টিমটি 2026 সালের জুন থেকে আগস্ট মাসের মধ্যে প্রকাশিত 20টি উচ্চ ঝুঁকিপূর্ণ V8 ভালনারেবিলিটি সংগ্রহ করেছে।
এই সব ভুলগুলি অস্ট্রার জ্ঞানের সীমানা থেকে পরে ঘটেছে, যা মডেলটির প্রশিক্ষণ ডেটা থেকে "উত্তর মুখস্থ করা" সম্ভাবনাকে প্রায় বাতিল করে দেয়।
এই অভ্যন্তরীণ নতুন প্রশ্নের সম্মুখীন হয়েও, এস্ট্রা এখনও GPT-5.6 Sol-এর চেয়ে উল্লেখযোগ্যভাবে এগিয়ে আছে এবং কম টোকেন ব্যবহার করছে।

অস্ট্রা গবেষণায় অংশগ্রহণকারী জিয়াওয়ে লিউ ব্যবধানটিকে আরও সরাসরি সংক্ষেপ করেছেন:
এই অভ্যন্তরীণ পরীক্ষায়, অ্যাস্ট্রার সাইবার নিরাপত্তা ক্ষমতা GPT-5.6 Sol-এর প্রায় চারগুণ।

একটি পরীক্ষায়, অ্যাস্ট্রা স্বয়ংক্রিয়ভাবে দুটি জিরো-ডে দুর্বলতা আবিষ্কার করেছিল এবং এগুলিকে একটি সম্পূর্ণ আক্রমণ শৃঙ্খলে পরিণত করেছিল:
একটি শক্তিশালী ব্রাউজারের সামনে, অ্যাস্ট্রা একটি HTML ফাইল থেকে শুরু করে ভাল্টের ব্যবহার, ব্রাউজার স্যান্ডবক্স থেকে পালিয়ে যাওয়া এবং চূড়ান্তভাবে হোস্ট মেশিনে কমান্ড বাস্তবায়ন সফলভাবে সম্পন্ন করে।
একটি শক্তিশালী অপারেটিং সিস্টেমের বিরুদ্ধে, এটি স্থানীয় প্রভিলেজ এস্কেলেশন সম্পন্ন করেছে, একটি সাধারণ নিম্ন প্রভিলেজ অ্যাকাউন্ট থেকে শুরু করে root প্রভিলেজ পেয়েছে।
অর্থাৎ, অ্যাস্ট্রা এখন শুধুমাত্র প্রোগ্রামারদের জন্য কোড রিভিউ করা এবং বাগ খোঁজা থেকে অতিক্রম করেছে।
এটি একটি উচ্চ কঠিন রেড টিম আক্রমণ স্বাধীনভাবে সম্পন্ন করতে সক্ষম হয়েছে।
এটিই হলো যে কারণে আগে ওপেনএআই আস্ট্রা চালু করতে দেরি করছিল।
যখন এই ক্ষমতা প্রতিরক্ষায় ব্যবহৃত হয়, তখন এটি নিরাপত্তা দলকে মানুষ এখনও চেনেনি এমন দুর্বলতা শীঘ্রই শনাক্ত করে সংশোধন করতে সাহায্য করে, কিন্তু যদি আক্রমণকারীদের হাতে চলে যায়, তবে এটি জটিল সাইবার আক্রমণ শুরু করার বাধা অনেকটা কমিয়ে দিতে পারে।

তবে, এই সাফল্যের সাথে একটি সীমাবদ্ধতা যোগ করা প্রয়োজন।
পরীক্ষার সময় অ্যাস্ট্রা ডেব্রেক ব্লু লেভেলের অ্যাডভান্সড টুলস এবং এনভায়রনমেন্ট অ্যাক্সেস পেয়েছিল, যা ভবিষ্যতে সাধারণ ব্যবহারকারীদের ডিফল্ট ভার্সনেও একই ধরনের আক্রমণের শর্ত থাকবে তা নির্দেশ করে না।
প্রাসঙ্গিক ফলাফলগুলি এখনও মূলত OpenAI-এর অভ্যন্তরীণ মূল্যায়ন থেকে আসছে এবং তৃতীয় পক্ষের যাচাইয়ের জন্য অপেক্ষা করছে।
কিন্তু কমপক্ষে একটি বিষয় নিশ্চিত হয়ে গেছে:
এই পর্যায়ে, ওপেনএআইয়ের সামনে আস্ট্রা নিয়ে ক্ষমতার সমস্যা নয়।
নিরাপত্তা সমস্যা এখন ড্যামোক্লিসের তরবারির মতো হয়ে উঠেছে।
দুটি সুরক্ষা গেট: দুর্নীতিপূর্ণ দুর্ব্যবহার এবং মডেলের নিয়ন্ত্রণহীনতা উভয়ের বিরুদ্ধে
কিভাবে এই তলোয়ারকে অন্যদের আঘাত করতে দেবেন না?
OpenAI-এর প্রস্তাব হল দুটি ঝুঁকির পথ একসাথে রক্ষা করা: একটি মানুষের বিরুদ্ধে, অন্যটি মডেলের বিরুদ্ধে।
প্রথমত, ব্যবহারকারীদের দুর্নীতিপূর্ণভাবে অ্যাস্ট্রা ব্যবহার করা থেকে বিরত রাখুন।
বিশেষ সুরক্ষা প্রশিক্ষণের পাশাপাশি, ওপেনএআই সিস্টেম ক্লাসিফায়ার, নিরন্তর মনিটরিং এবং হুমকি শনাক্তকরণের মাধ্যমে একাধিক পর্যায়ের কথোপকথন এবং দীর্ঘসময়ের কাজে সন্দেহজনক কার্যকলাপ শনাক্ত করে।
নেটওয়ার্ক সিকিউরিটি জেল পরীক্ষায়, অস্ট্রা বিপজ্জনক অনুরোধ প্রত্যাখ্যানের হার 91.5% এবং GPT-5.6 Sol এর হার 59%।

একইসাথে, অ্যাস্ট্রার উন্নত সাইবার নিরাপত্তা ক্ষমতাগুলি সরাসরি সমস্ত ব্যবহারকারীর জন্য উন্মুক্ত হবে না; এটি প্রথমে কয়েকজন অ্যালফা টেস্টারদের দেওয়া হবে, তারপর Daybreak Blue এর মতো নিয়ন্ত্রিত প্রকল্পের মাধ্যমে ধাপে ধাপে প্রকাশ করা হবে।

দ্বিতীয়টি, মডেলকে নিজে থেকে বিচ্যুত হতে দেবেন না।
এখানে ঝুঁকি আরও অদৃশ্য:
ব্যবহারকারীর কোনো দুর্নীতি না থাকলেও, মডেলটি কি নিজে থেকে কাজের পরিসর বাড়িয়ে দেবে? কি অননুমোদিত টুল ব্যবহার করবে, এমনকি নিরাপত্তা পরীক্ষা এড়িয়ে যাবে?
OpenAI একটি "হোনেপট" পরীক্ষা তৈরি করেছে।
অত্যন্ত কঠিন বা অসমাধানযোগ্য কাজের সম্মুখীন হয়ে, টেস্টিং পরিবেশ একটি অননুমোদিত "চালাকি" পথ ইচ্ছাকৃতভাবে রেখে দেয়, যাতে মডেলটি নির্দিষ্ট লক্ষ্যে আক্রমণ করতে পারে বা অনুমতির সীমানা অতিক্রম করে পাশের টেস্টিং সুবিধাগুলিতে প্রবেশ করে কাজটি সম্পন্ন করতে পারে।
ফলাফল হিসেবে, GPT-5.6 Sol 56% পরীক্ষায় সংক্ষিপ্ত পথ অনুসরণের চেষ্টা করেছিল, যেখানে Astra একবারও করেনি।
অন্য একটি পরীক্ষায়, অ্যাস্ট্রার অপারেশন অটোমেটিক রিভিউ সিস্টেম দ্বারা অস্বীকৃত হওয়ার পরে, এটি পুনরায় বিপজ্জনক কমান্ড চালানোর বা সীমাবদ্ধতা এড়ানোর চেষ্টা করেনি।

এছাড়াও, ওপেনএআই মডেলের যুক্তিসঙ্গত প্রক্রিয়া পর্যবেক্ষণ করবে।
অসাধারণ প্রবণতা শনাক্ত করলে, সিস্টেম ধীর করতে পারে, বন্ধ করতে পারে, বা এমনকি কাজটি সরাসরি বন্ধ করে দিতে পারে।
যদিও এর জন্য কিছু খরচ পড়ে (কিছু সাধারণ কাজ ধীরে চলতে পারে বা ভুলভাবে বন্ধ হয়ে যেতে পারে), তবুও OpenAI-এর মতে, এটি Astra-কে অনুমতি দেওয়ার জন্য প্রয়োজনীয় নিরাপত্তা খরচ।
তবে ওপেনএআইও স্বীকার করেছে যে এই ব্যবস্থাগুলি শেষপর্যন্ত বাহ্যিক “ব্রেক” মাত্র, মডেলের নিজস্ব অ্যালাইনমেন্টকে প্রতিস্থাপন করতে পারে না:
প্রকৃত নিরাপত্তা হলো মডেলকে শুরু থেকেই সীমানা ছাড়ানো থেকে বিরত রাখা।
জেডার টংজি অ্যালুমনি এস্ট্রা রিসার্চ অ্যান্ড ডেভেলপমেন্টের অগ্রগতিতে যোগ দিয়েছেন
এটিকে বাস্তবে পরিণত করতে হলে শেষ পর্যন্ত মডেল তৈরি করা মানুষের কাছে ফিরে যাওয়া দরকার।
যদিও ওপেনএআই এখনও আস্ট্রা দলের সদস্যদের তালিকা প্রকাশ করেননি, তবে এই প্রকাশ্য বক্তব্যের সাথে সামঞ্জস্যপূর্ণভাবে, অন্তত দুজন গভীরভাবে এতে অংশগ্রহণকারী চীনা গবেষক এখন স্পষ্টভাবে উঠে এসেছেন।
পূর্বে উল্লিখিত জিয়াওয়ে লিউ।
তিনি বর্তমানে OpenAI-এর গবেষক এবং 2021 সালে তংজি বিশ্ববিদ্যালয় থেকে কম্পিউটার বিজ্ঞানে স্নাতক ডিগ্রি অর্জন করেন।
তিনি স্নাতক পড়াকালীন হাইপারপোজ নামক একটি হাই-পারফরম্যান্স বডি পোজ এস্টিমেশন ফ্রেমওয়ার্ক ডেভেলপমেন্টে অংশগ্রহণ করেন, যেখানে তিনি মডেল ইনফারেন্স ইঞ্জিনের জন্য দায়ী ছিলেন, এবং সংশ্লিষ্ট ফলাফল ACM Multimedia 2021-এ বাছাই করা হয়, প্রকল্পটি এখনও GitHub-এ 1000-এর বেশি স্টার অর্জন করেছে।
এরপর, তিনি ইলিনয় বিশ্ববিদ্যালয়, উরবানা-শ্যামপেইনে কম্পিউটার বিজ্ঞানে ডক্টরেট করেন, যেখানে সফটওয়্যার ইঞ্জিনিয়ারিং বিশেষজ্ঞ জাং লিংমিং-এর অধীনে অধ্যয়ন করেন, এবং তাঁর গবেষণার কেন্দ্রবিন্দু ধীরে ধীরে হাই-পারফরম্যান্স ভিজুয়াল সিস্টেমের পরিবর্তে কোড মডেল এবং সফটওয়্যার বিশ্বস্ততার দিকে সরে যায়।
ডক্টরেটের সময়, তিনি PyTorch, TensorFlow ইত্যাদি মেশিন লার্নিং সিস্টেমে ৩০০টিরও বেশি গুরুতর বাগ আবিষ্কার করতে সহায়তা করেছিলেন;
কোড মডেল Magicoder কে Meta Llama 3.1, Google CodeGemma এবং IBM Granite দ্বারা গ্রহণ করা হয়েছে।
2025 সালে ডক্টরেট সম্পন্ন করে ওপেনএআই-তে যোগ দেওয়ার পরও তিনি যে সমস্যাগুলি অধ্যয়ন করেছেন, তা একই ধারাবাহিকতা বজায় রেখেছে:
কিভাবে এআইকে আরও ভালোভাবে কোড লিখতে এবং কোডের ভুল শনাক্ত করতে শেখানো যায়।

অন্যজন হলেন শিয়াংযু চি (Qi Xiangyu)।
চি শিয়াংযু জিয়াংসু বিশ্ববিদ্যালয় থেকে কম্পিউটার সায়েন্স এন্ড টেকনোলজি বিষয়ে স্নাতক ডিগ্রি অর্জন করেন এবং ২০২১ সালে প্রিনসটন বিশ্ববিদ্যালয়ে ইলেকট্রিক্যাল এন্ড কম্পিউটার ইঞ্জিনিয়ারিং-এ পিএইচডির জন্য ভর্তি হন, যেখানে তিনি বড় মডেলের দৃঢ়তা, জেইলব্রেক আক্রমণ এবং সুরক্ষা-সমন্বয়ের উপর গবেষণা করেন।
তার সবচেয়ে বেশি মনোযোগ আকর্ষণ করা কাজ হলো, "সেফটি অ্যালাইনমেন্ট শুধু কয়েকটি টোকেন গভীর হওয়ার চেয়ে বেশি হওয়া উচিত"।
এই পেপারটি বলে যে, বড় মডেলের নিরাপত্তা সমন্বয় শুধুমাত্র উত্তরের প্রথম �ঃ টোকেনের উপর নির্ভর করতে পারে না, কারণ উত্তর তৈরি চলতে থাকলে আগের নিরাপত্তা প্রতিরোধ এখনও হামলাকারীদের দ্বারা ছিন্নভিন্ন হতে পারে।
এই পেপারটি 11,672টি সাবমিশন থেকে বেছে নেওয়া হয়েছে এবং ICLR 2025-এর কেবলমাত্র 3টি অসাধারণ পেপারের একটি হয়ে উঠেছে।
2025 সালে ডক্টরেট সম্পন্নের পর, চি শিয়ানঝু ওপেনএআই-এ প্রযুক্তি দলের সদস্য হিসেবে যোগ দেন, যেখানে তিনি বড় মডেলের দৃঢ়তা অধ্যয়ন করেন এবং সাইবার নিরাপত্তা মডেলের কাজে অংশগ্রহণ করেন।
যে প্রশ্নটি তিনি জেডান থেকে প্রিনসটন, তারপর ওপেনএআই পর্যন্ত ক্রমাগত জিজ্ঞাসা করেছিলেন, তা এখন আস্ট্রাকে সরাসরি মুখোমুখি হতে হয়েছে:
ক্ষমতা ক্রমাগত শক্তিশালী হতে পারে, কিন্তু সীমানা ক্রমাগত অস্পষ্ট হতে পারে না।

এছাড়াও, আশা করি যে আস্ট্রা আনুষ্ঠানিকভাবে প্রকাশিত হওয়ার পরে ওপেনএআই সম্পূর্ণ তালিকা প্রকাশ করবে।
GPT-4-এর আগে, OpenAI শত শত অবদানকারীকে বিশেষভাবে তালিকাভুক্ত করেছিল, কিন্তু GPT-5 এবং GPT-5.5-এ, সিস্টেম কার্ড আরও পুরু হয়েছে, যেখানে গবেষকদের তালিকা আরও গভীরে লুকিয়ে রাখা হয়েছে।
পিছনের কারণটি সবাই জানে, মেটা এবং মিনি জা-এর মতো যারা সব জায়গা থেকে কর্মচারীদের আকর্ষণ করে তাদের বাধা দেওয়ার জন্য।
এটাও এক ধরনের পিটিএসডি...
একটি আরও জিনিস
যখন ওপেনএআই আস্ট্রা মনিটরিং এবং মডেল নিয়ন্ত্রণ হারানো এড়ানোর বিষয়ে বড় কথা বলছিল, তখন দ্য ইনফরমেশন প্রকাশ করেছে:
অস্ট্রা একটি "রিকারেন্ট ডেপ্থ" নামক প্রযুক্তি ব্যবহার করে।

প্রাচীন মডেলগুলি পরবর্তী টোকেন উত্পাদনের আগে তথ্যকে ধারাবাহিকভাবে নির্দিষ্ট সংখ্যক নেটওয়ার্ক স্তরের মধ্যে দিয়ে পাঠায়, যেখানে রিকারসিভ ডেপথ একই নেটওয়ার্ক স্তরগুলিতে তথ্যকে পুনরাবৃত্তি প্রক্রিয়া করে, যা মডেলটিকে অভ্যন্তরীণভাবে "কয়েকবার আরও ভাবতে" সক্ষম করে।
এই প্রযুক্তিটি ক্ষমতা বাড়ানোর, খরচ কমানোর পাশাপাশি বেশি যুক্তিসঙ্গত কাজ মডেলের ভিতরেই ঘটানোর সম্ভাবনা রাখে, যা মানুষের দ্বারা পড়ার যোগ্য লিখিত রূপে পুরোপুরি প্রদর্শিত হবে না।
অন্যভাবে বললে, মডেলটি হয়তো আরও গভীরে চিন্তা করে, কিন্তু মানুষ ক্রমশ এটি বুঝতে পারছে না।
এই প্রযুক্তিটি চিন্তার ধারার নিয়ন্ত্রণযোগ্যতা বিনষ্ট করতে পারে বলে এআই নিরাপত্তা নীতির দীর্ঘমেয়াদি অনুসরণকারী নাথান ক্যালভিন সতর্ক করেছেন।
এটি খুব সূক্ষ্ম:
OpenAI একদিকে বলছে যে এটি আস্ট্রা কী ভাবছে তা নজরে রাখবে, অন্যদিকে এর নতুন প্রযুক্তি হয়তো এটিকে আরও কম কথা বলতে বাধ্য করবে।
ওহ এটা...

ভালো বিষয় হলো, The Information-এর প্রকাশে জানা গেছে যে OpenAI এখন Astra-এ এই প্রযুক্তির ব্যবহার সীমিত করেছে।
অনুবাদ করুন, এখন বুঝতে পারছেন, ভবিষ্যতে বুঝতে পারবেন না।
এছাড়াও, আগে থেকেই শোনা যাচ্ছিল যে অ্যাস্ট্রা সম্ভবত এই বৃহস্পতিবার (সেপ্টেম্বর ৩) প্রকাশ করা হবে।
এস কোম্পানি তাদের নবীনতম 5.1 মডেল প্রকাশ করার পরে, এই বক্তব্যের যৌক্তিকতা বাড়তে থাকছে।
শামুক মাছ ধরে, পাখি পিছনে থাকে।
কে আবার বুঝে ফেলল!
রেফারেন্স লিঙ্ক:
[1]https://x.com/xiangyuqi_pton/status/2094891059038069236?s=20
[2]https://xiangyuqi.com
[3]https://x.com/JiaweiLiu_/status/2094901279239921816?s=20
[4]https://jw-liu.xyz/
[5]https://x.com/sama/status/2094934592062959832?s=20
এই লেখাটি ওয়েইচ্যান গ্রুপ "Quantum Bit" থেকে এসেছে, লেখক: অগ্রগতির প্রযুক্তি অনুসরণ করুন
