অ্যানথ্রোপিকের তিনটি ক্লড এআই মডেল তাদের পরীক্ষামূলক স্যান্ডবক্স থেকে বেরিয়ে আসে এবং বাস্তব সংগঠনগুলিতে হ্যাক করে। কাল্পনিক লক্ষ্য নয়। প্রতিকৃতি পরিবেশ নয়। বাস্তব কোম্পানি, যাদের বাস্তব সিস্টেম ছিল এবং যারা জানত না যে তাদের উপর একটি কৃত্রিম বুদ্ধিমত্তা পরীক্ষা চালাচ্ছে।
অ্যানথ্রোপিক ৩০ জুলাই ব্রিচগুলি প্রকাশ করে, যেখানে দেখানো হয় যে Claude Opus 4.7 এবং Claude Mythos 5 সহ মডেলগুলি অভ্যন্তরীণ সাইবার নিরাপত্তা মূল্যায়নের সময় অনিচ্ছাকৃতভাবে ওপেন ইন্টারনেটে অ্যাক্সেস করেছিল। মূল কারণ: তাদের মূল্যায়ন পার্টনার Irregular-এর সাথে একটি ভুল কনফিগারেশন, যা মডেলগুলিকে লাইভ সিস্টেমগুলিকে নিয়ন্ত্রিত capture-the-flag অনুশীলনের অংশ হিসাবে বিবেচনা করতে দিয়েছিল। ইংরেজিতে: AI ভাবছিল এটি একটি গেম খেলছে, কিন্তু লক্ষ্যগুলি বাস্তব।
কিভাবে তিনটি কোম্পানি অজান্তে পরীক্ষার বিষয় হয়ে উঠল
ঘটনাগুলি এপ্রিল 2026-এ ফিরে যায়, কিন্তু অ্যানথ্রোপিক শুধুমাত্র 1,41,006টি মূল্যায়ন রানের বিশাল পুনর্বিবেচনা করার পরেই সমস্যার পরিসর আবিষ্কার করে। এই পুনর্বিবেচনা তাদের নিজস্ব অভ্যন্তরীণ সতর্কবার্তা দ্বারা নয়, বরং ওপেনএআই দ্বারা প্রকাশিত একটি পূর্ববর্তী প্রতিবেদন দ্বারা ট্রিগার হয়েছিল, যেখানে তাদের নিজস্ব এআই মডেলগুলির থেকে সদৃশ অনিয়ন্ত্রিত আচরণের কথা বর্ণনা করা হয়েছিল।
তিনটি পৃথক সংগঠন প্রভাবিত হয়েছে। তাদের দুটির কোনো ধারণাই ছিল না যে অননুমোদিত অ্যাক্সেস ঘটেছে, যতক্ষণ না অ্যানথ্রোপিক ২৭ জুলাই-এ তাদের জানায়, যা প্রকাশ্যে প্রকাশের তিন দিন আগের কথা।
অ্যানথ্রোপিক বলেছে যে এই লঙ্ঘনগুলির ফলে গুরুতর ডেটা বহির্বাহন বা কোম্পানির যা বলে “জানবুঝে সংবদ্ধতা ব্যর্থতা” ঘটেনি। মডেলগুলি পালানোর চেষ্টা করছিল না। তারা সিস্টেমের ভালোবাসা খুঁজে বের করার জন্য নির্দেশ অনুসরণ করছিল, যা সাইবার নিরাপত্তা মূল্যায়নের একটি সাধারণ অংশ। শুধুমাত্র এটি ঘটেছিল যে তারা সম্পূর্ণভাবে ভুল সিস্টেমগুলির দিকে নির্দেশিত হয়েছিল।
অ্যানথ্রোপিক ২৩ জুলাই সমস্ত সাইবার নিরাপত্তা মূল্যায়ন বন্ধ করে দেয়, যা প্রকাশ্যে ঘোষণার এক সম্পূর্ণ সপ্তাহ আগে। কোম্পানিটি প্রভাবিত সংস্থাগুলির পরিচয়, অ্যাক্সেস করা সিস্টেমগুলির নির্দিষ্ট প্রকৃতি বা কোনও আইনি ব্যবস্থা গ্রহণ করা হচ্ছে কিনা তা প্রকাশ করেনি।
যে এআই নিরাপত্তা সমস্যাটি ক্রমাগত বেশি শব্দ করছে
এটি একা ঘটছে না। সম্প্রতি ওপেনএআই তাদের নিজস্ব মডেলগুলির অনিয়ন্ত্রিত হ্যাকিং আচরণের কথা জানিয়েছে, যা অ্যানথ্রোপিকের অভ্যন্তরীণ অডিটের প্রথম প্রেরণা ছিল। বিশ্বের দুটি সবচেয়ে প্রখ্যাত এআই ল্যাব এখন প্রকাশ্যে স্বীকার করছে যে তাদের সবচেয়ে উন্নত মডেলগুলি সঠিক (বা ভুল) পরিস্থিতিতে কারও ইচ্ছা ছাড়াই বাস্তব-বিশ্বের সিস্টেমগুলির সঙ্গে সংঘর্ষে লিপ্ত হতে পারে।
1,41,000-এর বেশি মূল্যায়ন রানের পর্যালোচনা থেকে বোঝা যায় যে এটি একটি একক গ্লিচ ছিল না। এটি পরীক্ষামূলক পরিবেশ এবং বাস্তব জগতের সীমানায় একটি ব্যবস্থাগত ব্যর্থতা ছিল।
