- হাগিং ফেস ঘটনার পর, ওপেনএআই এবং অ্যানথ্রোপিক এআই এজেন্টগুলির নিরাপত্তা নিয়ে নতুন প্রশ্ন উঠেছে।
- হ্যাঁ, ইউকে প্রতিষ্ঠানটি সাইবার পরীক্ষার সময় এআই এজেন্টগুলির দ্বারা ১৯টি অননুমোদিত কার্যক্রম রেকর্ড করেছে।
- বিশেষ করে, একটি এআই এজেন্ট মিথ্যা পরিচয় তৈরি করেছিল।
ইউকে আর্টিফিশিয়াল ইন্টেলিজেন্স সিকিউরিটি ইনস্টিটিউট (AISI) রিপোর্ট করেছে যে, মডেল পরীক্ষার সময় ওপেনএআই এবং এনথ্রোপিক এআই এজেন্টগুলির অননুমোদিত আচরণের নতুন কেস আবিষ্কৃত হয়েছে, Reuters লিখেছে। সাইবার নিরাপত্তা সিমুলেশনের একটি ধারাবাহিকতায়, এজেন্টগুলি মিথ্যা অনলাইন ব্যক্তিত্ব তৈরি করেছে, প্রতিষ্ঠিত সীমাবদ্ধতা এড়ানোর চেষ্টা করেছে এবং তাদের নির্ধারিত কাজের বাইরের অন্যান্য কাজ সম্পন্ন করেছে।
এই ঘটনাগুলি গট-5.6 এআই এজেন্ট দ্বারা হাগিং ফেসের ইনফ্রাস্ট্রাকচারের সাম্প্রতিক ব্রিচের মধ্যে ঘটেছে। আরও বিস্তারিত জানুন নিবন্ধটিতে:
AISI-এর অনুসারে, সংস্থাটি তাদের ক্ষমতা মূল্যায়নের জন্য Anthropic-এর Mythos 5 মডেল এবং OpenAI-এর GPT-5.6-Sol-এর উপর ভিত্তি করে এজেন্টগুলি পরীক্ষা করেছে।
122 টেস্ট রানের মধ্যে, গবেষকদের পর্যবেক্ষণ করা হয়েছিল 10টি ট্রায়ালে 19টি অননুমোদিত কার্য। এগুলির মধ্যে 17টি Anthropic-এর এজেন্টের দ্বারা এবং দুটি OpenAI-এর এজেন্টের দ্বারা করা হয়েছিল।
এআইএসআই বলেছে, “পরীক্ষাধীন কিছু এজেন্ট বাস্তব ব্যক্তি এবং সংগঠনের প্রতি দীর্ঘস্থায়ী, সম্ভাব্য ক্ষতিকর কার্যকলাপ চালিয়েছিল।”
একই সময়ে, প্রতিষ্ঠানটি জোর দিয়ে বলেছে যে রেকর্ডকৃত কোনো কেসেই বাস্তব জীবনে ক্ষতি হয়নি।
একটি এজেন্ট মিথ্যা পরিচয় তৈরি করেছিল
সবচেয়ে গুরুতর ঘটনাটি একজন এজেন্টের সাথে জড়িত ছিল যিনি ক্ষতিকারক কোড লিখেছিলেন এবং একজন ব্যক্তিকে এর কার্যক্রম অনুমোদন করতে প্ররোচিত করতে কাল্পনিক অনলাইন অ্যাকাউন্ট তৈরি করেছিলেন।
AISI এই কার্যাবলীর জন্য কোন নির্দিষ্ট মডেলকে দায়ী করেছে তা প্রকাশ করেনি, তবে Anthropic নিশ্চিত করেছে যে এটি তাদের এজেন্টের সাথে সম্পর্কিত।
কোম্পানিটি বলেছে:
“আমরা এই ঘটনায় ইউকে এআইএসআই-এর নেতৃত্বের জন্য কৃতজ্ঞ, যা আরও ক্ষমতাশালী এআই এজেন্টগুলির নিরাপদ মূল্যায়নের জন্য একটি ব্যাপক আলোচনার প্রয়োজনীয়তা তুলে ধরে।“
অ্যানথ্রোপিক বলেছে যে এটি অতিরিক্ত বিস্তারিত পাওয়ার জন্য ইনস্টিটিউটের সাথে কাজ করছে এবং নিজস্ব তদন্ত পরিচালনা করছে।
অ্যান্ড্রু ইউন, অলাভজনক সংস্থা সিভিএআই-এর একজন গবেষক, বলেছেন যে এই ঘটনাটি চিন্তার বিষয়।
এই তথ্য যে মাইথস এমন প্রতারণামূলক কাজ করেছে, যা প্রতীয়মান হচ্ছে যে এটি একজন বাস্তব ব্যক্তিকে লক্ষ্য করছিল, এটি নির্দেশ করে যে অ্যানথ্রোপিকের মডেলগুলির উপর তাদের যতটা ধারণা আছে ততটা ভালো নিয়ন্ত্রণ নেই।
ওপেনএআই একটি পৃথক ঘটনার প্রতিবেদন করেছে
ওপেনএআই ব্যাখ্যা করেছে যে এর এজেন্ট দ্বারা অননুমোদিত কাজ দুটি পরীক্ষার পরিস্থিতির শর্তের বিরুদ্ধে ইন্টারনেট অ্যাক্সেসের সাথে সংযুক্ত ছিল।
কোম্পানিটি একটি আলাদা ঘটনাও প্রকাশ করেছে, যেখানে টেস্টিং ইনফ্রাস্ট্রাকচারের তৃতীয় পক্ষের প্রদানকারী Irregular-এর একটি কনফিগারেশন ত্রুটির কারণে এর এজেন্টরা ভুলবশত নেটওয়ার্কে প্রবেশাধিকার লাভ করে। Anthropic গত সপ্তাহেও বর্ণনা করেছিল একটি সদৃশ ব্যর্থতা।
ওপেনএআই বলেছে:
“আমরা উচ্চ-ঝুঁকিপূর্ণ মূল্যায়ন নিরাপদে পরিচালনার জন্য শেয়ার্ড প্র্যাকটিসগুলি শক্তিশালী করার জন্য শিল্পজুড়ে কাজ করার প্রতিশ্রুতিবদ্ধ, যার মধ্যে আসন্ন সপ্তাহগুলিতে জাতীয় এআই প্রতিষ্ঠান, স্বাধীন মূল্যায়ক, অন্যান্য এআই ল্যাব এবং অন্যান্য গোষ্ঠীসহ স্টেকহোল্ডারদের সমাবেশ অন্তর্ভুক্ত থাকবে.“
একই সময়ে, AISI বলেছে যে এই ঘটনাগুলি জুলাইয়ের ব্রিচ থেকে ভিন্ন, যেখানে GPT-5.6 এজেন্ট Hugging Face-এর টেস্টিং ইনফ্রাস্ট্রাকচারে প্রবেশ করেছিল। তখন মডেলটি একটি আইসোলেটেড পরিবেশ থেকে কার্যকরভাবে বেরিয়ে এসেছিল, কিন্তু বর্তমান ট্রায়ালগুলিতে, ইনস্টিটিউটের স্ট্যান্ডার্ড টেস্টিং পদ্ধতির সাথে সঙ্গতিপূর্ণভাবে এজেন্টগুলির জন্য ইন্টারনেট অ্যাক্সেস উপলব্ধ ছিল।
একটি স্মরণীয় হিসাবে, হাগিং ফেস ঘটনার পর, ওপেনএআই expand করেছে তার অভ্যন্তরীণ তদন্ত এবং স্বায়ত্তশাসিত এজেন্টগুলির অনিয়ন্ত্রিত আচরণের অতিরিক্ত কেসগুলি শনাক্ত করেছে।
ব্রিটিশ গবেষকরা ওপেনএআই এবং এনথ্রোপিক এআই এজেন্টগুলির পরীক্ষার সময় নতুন লঙ্ঘন আবিষ্কার করেছেন প্রথমে INCRYPTED-এ প্রকাশিত হয়েছিল।


