ওপেনএআই ১ সেপ্টেম্বর জানিয়েছে, যে এখনও প্রকাশিত হয়নি এমন অস্ট্রা কোম্পানির "প্রস্তুতি কাঠামো" এর "গুরুত্বপূর্ণ স্তর" সাইবার নিরাপত্তা সীমানা অতিক্রম করেছে। এটি ওপেনএআইয়ের প্রথমবারের মতো একটি মডেলকে এই স্তরে অন্তর্ভুক্ত করা হয়েছে, যা বোঝায় যে এর উন্নয়ন এবং প্রকাশের আগে আরও কঠোর নিরাপত্তা সীমাবদ্ধতা প্রযোজ্য হবে।
প্রথমবারের মতো ক্রাইটিক্যাল লেভেলে প্রবেশ করুন
OpenAI-এর সংজ্ঞানুযায়ী, যদি একটি মডেল বিভিন্ন প্রতিরোধী বাস্তব সিস্টেমে অজানা ভালোবাসা আবিষ্কার করে এবং ব্যবহারযোগ্য আক্রমণ চেইন তৈরি করে, অথবা শুধুমাত্র উচ্চ-স্তরের লক্ষ্যের ভিত্তিতে জটিল লক্ষ্যগুলির বিরুদ্ধে সম্পূর্ণ নেটওয়ার্ক আক্রমণ সম্পন্ন করে, তবে এটিকে "ক্রিটিকাল" লেভেলে শ্রেণীবদ্ধ করা হবে। আগে GPT-5.6 Sol-এর মতো মডেলগুলি সর্বোচ্চ "হাই-রিস্ক" ক্যাটাগরিতেই ছিল।
পরীক্ষার সময় দুটি জিরো-ডে ভালনাবলী আবিষ্কৃত হয়েছে
ExploitBench ভালো পরীক্ষায়, Astra-এর পাস রেট 100%। এই পরীক্ষাটি মূলত মডেলের ক্ষমতা পরীক্ষা করে যে এটি পরিচিত সফটওয়্যার ভাঙ্গনগুলিকে কার্যকরী এক্সপ্লয়িট কোডে রূপান্তর করতে পারে কিনা।
মেমোরি প্রশ্নোত্তর ব্যাংকের প্রভাব বিদূরিত করার জন্য, ওপেনএআই ২০২৪ সালের জুন থেকে আগস্ট পর্যন্ত প্রকাশিত ২০টি গুগল V8 জাভাস্ক্রিপ্ট ইঞ্জিনের হাই-রিস্ক ভালনারেবিলিটি নিয়ে অভ্যন্তরীণ পরীক্ষা চালায়। ওপেনএআই বলেছে, অ্যাস্ট্রা GPT-5.6 Sol-এর চেয়ে যেকোনো কোড বাস্তবায়নের সফলতার হার বেশি, এবং কম আউটপুট টোকেন ব্যবহার করে। পরীক্ষার সময়, অ্যাস্ট্রা আগের কখনও অজানা দুটি জিরো-ডে ভালনারেবিলিটি নিজেই আবিষ্কার করেছে এবং এগুলির মধ্যে সংযোগ স্থাপন করেছে; সংশ্লিষ্ট সমস্যাগুলি এখনও প্রভাবিত মেইনটেনারদের কাছে প্রকাশ করা হচ্ছে।
প্রথমে কিছু পরীক্ষামূলক ব্যবহারকারীকে প্রবেশাধিকার দেওয়া হবে
একটি আরও বাস্তবসম্মত পরীক্ষায়, এস্ট্রা একটি সুরক্ষিত ব্রাউজার এবং একটি সুরক্ষিত অপারেটিং সিস্টেমের উপর ভিত্তি করে একটি সম্পূর্ণ আক্রমণ শৃঙ্খল তৈরি করেছে। ওপেনএআই বলেছে, মডেলটি শুধুমাত্র লক্ষ্যকে একটি ক্ষতিকারক HTML ফাইল খোলার জন্য প্ররোচিত করে, ব্রাউজার স্যান্ডবক্স থেকে পালিয়ে হোস্ট মেশিনে কমান্ড চালাতে সক্ষম হয়েছে। অন্য একটি পরীক্ষায়, এটি একাধিক সিস্টেম দুর্বলতা একত্রিত করে প্রবেশাধিকার বৃদ্ধির পথ তৈরি করেছে, যার ফলে সাধারণ ব্যবহারকারীর অ্যাকাউন্টটি最终 root অধিকার অর্জন করেছে।
ওপেনএআই বলেছে যে, অন্তর্নিহিত পরীক্ষায় এস্ট্রা নেটওয়ার্ক নিরাপত্তা জেল পালানোর প্রস্তাবনার প্রতিরোধ হার 91.5% ছিল, যা GPT-5.6 Sol-এর 59% এর চেয়ে বেশি। এর সবচেয়ে শক্তিশালী নেটওয়ার্ক নিরাপত্তা ক্ষমতা প্রথমে কিছু অলফা টেস্টারদের জন্য প্রদান করা হবে, এরপর দিব্রেক ব্লু প্রকল্পের মাধ্যমে ধাপে ধাপে বাড়ানো হবে, যা মূলত প্রতিরক্ষামূলক নিরাপত্তা কাজগুলির জন্য।
অতিরিক্ত তথ্য: এই প্রকাশের সময়, Anthropic একই দিনে Fable 5.1 এবং Mythos 5.1 চালু করেছে, যেখানে Mythos 5.1 এখনও শুধুমাত্র অনুমোদিত সাইবার সিকিউরিটি এবং লাইফ সায়েন্স প্রতিষ্ঠানগুলির জন্য উপলব্ধ। OpenAI এখনও Astra-এর আনুষ্ঠানিক লঞ্চ তারিখ প্রকাশ করেননি।
