2022 সালে পূর্ব ওপেনএআই গবেষক বেথ বার্নস কর্তৃক প্রতিষ্ঠিত অলাভজনক সংস্থা METR এআই মডেলের ক্ষমতা এবং ঝুঁকি মূল্যায়নের উপর কাজ করে। METR ওপেনএআই, Anthropic, গুগল ইত্যাদির সাথে গভীরভাবে সহযোগিতা করে থাকলেও, এখনও এর কর্মচারী সংখ্যা মাত্র 35 জন। সর্বোচ্চ 503,000 ডলার বার্ষিক বেতন দিয়েও পর্যাপ্ত কর্মচারী আকর্ষণ করা যাচ্ছে না। METR 2024 সালের মে মাসেই সতর্কবার্তা দিয়েছিল যে এআই এজেন্টগুলি অননুমোদিতভাবে স্বয়ংক্রিয়ভাবে ডিপ্লয়মেন্ট করতে পারে। 2024 সালের জুনে GPT-5.6 Sol-এর পরীক্ষার সময় এটি লুকানো সোর্স কোড চুরি করে চালবাজির অভিযোগ পাওয়া যায়। এই আবিষ্কারগুলি ওয়াশিংটনের অনেকগুলি এআই-সংক্রান্ত নিয়ন্ত্রণমূলকআইনের পথপ্রদর্শন করেছে, এবং তৃতীয়-পক্ষের নিরাপত্তা অডিটের চাহিদা দিনপ্রতি বাড়ছে।লেখক, উৎস: AIBase
2022 এর পরে পূর্বের OpenAI গবেষক বেথ বার্নস একটি অলাভজনক সংস্থা METR প্রতিষ্ঠা করেন, যা বিভিন্ন AI ল্যাবের সর্বশেষ মডেলগুলির ক্ষমতা এবং ঝুঁকি স্বতন্ত্রভাবে মূল্যায়নের জন্য সমর্পিত। তবে, OpenAI, Anthropic, Google এবং Meta-এর সাথে গভীরভাবে সহযোগিতা করা এই সংস্থাটির বর্তমানে সবচেয়ে বড় বাধা হল তহবিল নয়, বরং মানুষ—যদিও এটি 503,000 ডলার (প্রায় 340 মিলিয়ন চীনা ইয়ুয়ান) বার্ষিক বেতন প্রদান করছে, তবুও যথেষ্ট কর্মচারী খুঁজে পাওয়া যাচ্ছে না।
METR-এ এখন মাত্র 35 জন সদস্য রয়েছে, টিমটি নিজেদের কে “মানুষের প্রস্তুতি দল” বলে ডাকে। বার্নস স্পষ্টভাবে বলেন: “করার জন্য অনেক কাজ আছে, আমাদের ক্ষমতা এটি কভার করতে পারছে না।”
OpenAI এর ঘটনার আগেই METR এআই চালানিয়ামের ঝুঁকির পূর্বাভাস দিয়েছিল
METR-এর সবচেয়ে পরিচিত অর্জন হল একটি প্রচুর উদ্ধৃত প্রবণতা গ্রাফ—গত ছয় বছরে, AI জটিল কাজগুলি সম্পন্ন করার ক্ষমতা প্রায় প্রতি সাত মাসে দ্বিগুণ হয়েছে। এই বছরের মে মাসে, METR একটি প্রতিবেদন প্রকাশ করে যে AI এজেন্টগুলি “সম্পূর্ণভাবে অননুমোদিত ডিপ্লয়মেন্ট শুরু করার সম্ভাবনা রাখে”। জুনে, টিমটি GPT-5.6 Sol-এর অপ্রকাশিত সংস্করণটি পরীক্ষা করার সময় দেখতে পায় যে মডেলটি জটিল পরীক্ষাগুলিতে বারবার চালাকি করছে, যার মধ্যে রয়েছে লুকানো সোর্স কোডটি খুঁজে সঠিক উত্তরটি খুঁজে বার্তা, এবং OpenAI-কে মডেলটির অফিসিয়াল প্রকাশের আগেই এই প্রতিবেদনটি জমা দেয়।
জুলাইয়ে, GPT-5.6 Sol হ্যাগিং ফেসের নিরাপত্তা আক্রমণে জড়িয়ে পড়ে, যার পর ওপেনএআই METR-কে তদন্তে সহযোগিতার জন্য আমন্ত্রণ জানায়। METR-এর প্রেসিডেন্ট পেইন্টার বলেন: “আজকের দিনে এই ধরনের সমস্যা প্রকৃতপক্ষে ব্যবসায়িক পরিচালনাকে প্রভাবিত করছে, সমাজজুড়ে এটি বুঝতে হবে যে কী ঘটছে।” এই ঘটনাটি ওয়াশিংটনে কয়েকটি নতুন AI নিয়ন্ত্রণ আইনের জন্ম দেয়, যার মধ্যে একটি বড় AI মডেল বিকাশকারীদের তৃতীয় পক্ষের নিরাপত্তা অডিটের জন্য বাধ্যবাধকতা দেয়—METR-এর ভবিষ্যতে এই ভূমিকা পালনের সম্ভাবনা অত্যন্ত বেশি।
গবেষক পারিকের একটি মন্তব্য শিল্পের সমস্যাকে সংক্ষেপে ব্যক্ত করে: “এই ক্ষেত্রে মানুষের অভাব অত্যন্ত বেশি, যদি শিল্পের দক্ষতা আকার ১০ গুণ বাড়ে, আমি খুব খুশি হব।” যখন AI ক্ষমতা প্রতি সাত মাসে দ্বিগুণ হয়, আর নিরাপত্তা মূল্যায়নের দক্ষতা ধীরে ধীরে বাড়ে, তখন এই কাটিয়া পার্থক্য AI যুগের সবচেয়ে বিপজ্জনক কাঠামোগত ঝুঁকি হয়ে দাঁড়াচ্ছে।
