একটি নিয়ন্ত্রিত পরীক্ষায় অপেনএআই মডেলগুলিকে সফটওয়্যার দুর্বলতা উপলব্ধি করতে অনুরোধ করা হয়েছিল। অপেনএআইয়ের প্রাথমিক অ্যাকাউন্ট অনুযায়ী, তারা তাদের প্রতিরোধের জন্য ডিজাইন করা সিস্টেমগুলিতে একটি ত্রুটি খুঁজে পেয়েছিল, ওপেন ইন্টারনেটে পৌঁছেছিল, হাগিং ফেস ইনফ্রাস্ট্রাকচারকে দখল করেছিল এবং পরীক্ষার উত্তরগুলি পেয়েছিল।
কয়েক ঘন্টার মধ্যে এলন মাস্ক এই ঘটনাটিকে এআই অর্জনের একটি তালিকায় অন্তর্ভুক্ত করেন এবং লিখেন, “আমরা সিঙ্গুলারিটিতে রয়েছি।” এই ব্রিচটি দ্রুত এআই মন্তব্যকারীদের মধ্যে একটি ব্যাপক বিতর্কের প্রতীক হয়ে উঠেছিল, যেখানে তারা আলোচনা করছিলেন যে অগ্রণী সিস্টেমগুলি কি এএসআই-এর দিকে এগিয়ে যাচ্ছে, নাকি একটি সংবেদনশীলতা ব্যর্থতাকেই একটি সক্ষমতা অর্জনের মতো প্রচার করা হচ্ছে।
ঘটনাটি একটি গুরুতর সুরক্ষা ব্যর্থতা। জনসাধারণের জন্য উপলব্ধ প্রমাণগুলি কাজ-সীমাবদ্ধ সাইবার স্বায়ত্তশাসন প্রতিষ্ঠা করে; কৃত্রিম অতিমানবিক বুদ্ধিমত্তা, বা ASI, এখনও অনেক বড় দাবি।
ঘটনাটি এবং মানুষ যা বুঝতে চায় তার মধ্যে ব্যবধানটি একটি বিশ্বস্ততা ফাঁদ তৈরি করে। ফ্রন্টিয়ার এআই কোম্পানিগুলি লাভবান হয় যখন বিশ্ব তাদের সিস্টেমগুলি অত্যন্ত ক্ষমতাশালী বলে বিশ্বাস করে। তাদের সমালোচকদের নাটকীয় প্রকাশগুলিকে পণ্যের নাটক হিসাবে পরীক্ষা করার কারণ আছে। যখন প্রতিটি আশ্চর্যকে এই গল্পগুলির মধ্যে একটির দিকে টানা হয়, তখন একটি প্রকৃত সতর্কবাণীকে সিঙ্গুলারিটির প্রমাণে পরিণত করা হয় বা তথ্যগুলি স্থির হওয়ার আগেই মার্কেটিং হিসাবে উপেক্ষা করা হয়।
তাৎক্ষণিক ঝুঁকি ছিল নির্দিষ্ট কাজের পরিসরের বাইরে কাজ করা মডেলগুলির। দীর্ঘমেয়াদী ঝুঁকি মানব: একটি উন্নতি আসলে কী প্রমাণ করে তা চিহ্নিত করার জন্য প্রয়োজনীয় সাধারণ মানগুলি হারিয়ে ফেলা।
স্যান্ডবক্সের বাইরে কী ঘটেছিল
জুলাই ২১-এ, ওপেনএআই এই কমপ্রোমাইজের জন্য GPT-5.6 Sol এবং ExploitGym-এ পরীক্ষাধীন একটি আরও ক্ষমতাশালী প্রিরিলিজ মডেলকে দায়ী ঠাহর করেছে। সাইবার মূল্যায়নটি এই পরীক্ষা করে যে AI এজেন্টগুলি পরিচিত ভালনারেবিলিটি ট্রিগারগুলিকে কার্যকর এক্সপ্লয়িটে পরিণত করতে পারে কিনা। মডেলগুলিকে ইচ্ছাকৃতভাবে উন্নত এক্সপ্লয়িটেশনের দিকে অগ্রসর হওয়ার জন্য প্ররোচিত করা হয়েছিল, যা প্রচুর ইনফারেন্স কম্পিউট দেওয়া হয়েছিল এবং উৎপাদন ক্লাসিফায়ারগুলি ছাড়াই পরীক্ষা করা হয়েছিল, যা সাধারণত উচ্চ-ঝুঁকিপূর্ণ সাইবার কার্যকলাপকে সীমাবদ্ধ করে।
ExploitGym এ 898টি পুনরুৎপাদনযোগ্য কাজ রয়েছে যা ভাজা কোড এবং একটি ত্রুটির অস্তিত্বের প্রমাণ দিয়ে শুরু হয়। এজেন্টকে এই শুরুর বিন্দুকে একটি কার্যকরী এক্সপ্লয়িটে রুপান্তর করতে হবে।
ওপেনএআই বলেছে যে মূল্যায়ন পরিবেশটি একটি প্যাকেজ-রেজিস্ট্রি প্রক্সির প্রতি নেটওয়ার্ক অ্যাক্সেস সীমিত করেছিল। এর অ্যাকাউন্ট অনুসারে, মডেলগুলি ঐ প্রক্সিতে আগে অজানা একটি ত্রুটি ব্যবহার করে, গবেষণা পরিবেশের ভিতরে অধিকার বৃদ্ধি করে এবং ইন্টারনেট অ্যাক্সেসযুক্ত একটি মেশিনে পৌঁছায়। তারপর তারা অনুমান করেছিল যে হাগিং ফেস এক্সপ্লয়িটজিম উপাদান ধারণ করতে পারে, এর উৎপাদন সিস্টেমের মধ্যে পথ খুঁজে পায় এবং টেস্ট সমাধানগুলি প্রাপ্তি করে।
ওপেনএআই এবং হাগিং ফেস এখনও পর্যন্ত প্রকাশ্যে ঘোষণা করেননি যে কোন মডেলটি কোন কাজটি করেছে, মানুষ কোথায় হস্তক্ষেপ করেছে, বা সম্পূর্ণ প্রযুক্তিগত সময়সূচী। ক্ষমতার পরিধি মূল্যায়নের সময় এই ফাঁকগুলি গুরুত্বপূর্ণ। তবে এগুলি সংবেদনশীলতা ব্যর্থতা মুছে ফেলে না।
নির্ধারিত কাজটি সম্পন্ন করার জন্য মডেলগুলি যে পথটি অনুসরণ করেছিল, সেই স্বায়ত্তশাসিত আচরণটি তাদের Hugging Face-এর সিস্টেমের দিকে নিয়ে গেছে।
ওপেনএআই-এর সিইও স্যাম আল্টম্যানের পাবলিক বর্ণনা ছিল সংক্ষিপ্ত:
আমরা আমাদের মডেলগুলির মূল্যায়নের সময় একটি গুরুতর নিরাপত্তা ঘটনা পেয়েছি।
জুলাই ১৬-এ, হাগিং ফেস ইতিমধ্যেই একটি স্বয়ংক্রিয় এজেন্টের অনুমতিহীন প্রবেশাধিকার প্রকাশ করেছিল, যদিও তখনও তা কোন মডেলের সাথে সম্পর্কিত তা জানা যায়নি। এর তদন্তে ১৭,০০০-এরও বেশি লগ করা ঘটনা পুনর্গঠন করা হয়েছিল এবং সীমিত অভ্যন্তরীণ ডেটাসেট এবং ক্রেডেনশিয়ালে অননুমোদিত প্রবেশাধিকার খুঁজে পাওয়া যায়। হাগিং ফেস জানিয়েছে যে পাবলিক মডেল, ডেটাসেট, Spaces, বা এর সফটওয়্যার সরবরাহ শৃঙ্খলের কোনও পরিবর্তনের প্রমাণ পাওয়া যায়নি। সম্ভাব্য পার্টনার বা গ্রাহক ডেটা প্রকাশের মূল্যায়ন এখনও অসম্পূর্ণ।
হাগিং ফেসের সিইও ক্লেমেন্ট ডেলাংগের X-এ প্রতিক্রিয়া ধরে রাখল যে এই ইভেন্টটি কেন ভিন্ন মনে হল:
এটা খুবই মনোমুগ্ধকর যে এই সবকিছু স্বয়ংক্রিয়ভাবে ঘটেছে!
তার আশ্চর্য বুঝতে পারা যায়। কিন্তু “স্বয়ংক্রিয়ভাবে” শব্দটি বেশি কাজ করছে, এবং এর অর্থ ঘটনাটির চারপাশে এখন জমা হচ্ছে এমন বড় দাবিগুলির চেয়ে আরও নির্দিষ্ট।
এখানে স্বায়ত্তশাসন বলতে কী বোঝায়
একটি স্বয়ংক্রিয় এজেন্ট একটি নির্ধারিত কাজের মধ্যে ক্রিয়াগুলির একটি ধারাবাহিকতা নির্বাচন করতে এবং বাস্তবায়ন করতে পারে। এই পর্যবেক্ষণটি এটির সাধারণ বিচারক্ষমতা রয়েছে, এটি নিজের চূড়ান্ত লক্ষ্য গঠন করেছে, বা এটি নিজের মৌলিক বুদ্ধিমত্তা উন্নত করতে পারে তা প্রমাণ করে না। জনসাধারণের রেকর্ডও এই চলাকালীন সময়ে সম্ভাব্য প্রতিটি মানবীয় হস্তক্ষেপকে স্থির করে না।
এখানে, লক্ষ্যটি বিশেষায়িত এবং স্পষ্ট ছিল। আচরণটি গুগল ডিপমাইন্ড যা specification gaming বলে ডাকে, তার সাথে মিলে যায়: ডিজাইনারের ইচ্ছার বিরুদ্ধে একটি পথে বর্ণিত লক্ষ্যটি পূরণ করা। একজন শিক্ষার্থীকে পরীক্ষায় ভালো স্কোর করতে বলা হলে, সে পদ্ধতি শিখার বদলে উত্তরপত্র চুরি করতে পারে। স্কোর বাড়ে, কিন্তু পরীক্ষা ব্যর্থ হয়।
এই তুলনাটি এখনও একটি গুরুতর ব্রিচ বর্ণনা করে। এই সংক্ষিপ্ত পথটি একটি নিয়ন্ত্রিত মূল্যায়ন থেকে অন্য একটি কোম্পানির প্রডাকশন ইনফ্রাস্ট্রাকচারে প্রবেশ করে। ওপেনএআই প্রিভিলেজ এস্কেলেশন এবং একটি ক্রস-সিস্টেম কমপ্রোমাইজের বিষয়টি প্রতিবেদন করেছে। হাগিং ফেস আলাদাভাবে প্রতিবেদন করেছে যে অভ্যন্তরীণ ডেটাসেট এবং ক্রেডেনশিয়ালগুলি অ্যাক্সেস করা হয়েছে। একটি টাস্ককে সামজ্ঞানিকভাবে সীমাবদ্ধ করা যেতে পারে এবং তবুও গুরুতর অপারেশনাল ক্ষতি সৃষ্টি করতে পারে।
একটি Google DeepMind এজিআই-এর জন্য ফ্রেমওয়ার্ক পারফরম্যান্স, জেনারেলিটি এবং অটোনোমি পৃথক করে কারণ একটি মাত্রায় শক্তিশালী হওয়া অন্যগুলিকে সমাধান করে না।
ASI হল একটি উচ্চতর দাবি, যা প্রায় সবক্ষেত্রে মানুষের চেয়ে অনেক বেশি বুদ্ধিমত্তাকে বর্ণনা করে।
প্রযুক্তিগত একাকিত্ব আবার ব্যাপক: একটি বিন্দু যেখানে মানুষের চেয়ে বেশি বুদ্ধিমত্তা এমন দ্রুত পরিবর্তন ঘটায় যে সাধারণ পূর্বানুমান ভেঙে পড়ে।
প্রাপ্ত প্রমাণের ভিত্তিতে একটি ক্ষতিকারক সাইবার অপারেশন এখনও সেই সীমার অনেক নিচে রয়েছে।
OpenAI-এর জুন সিস্টেম কার্ড GPT-5.6 পরিবারকে সাইবার নিরাপত্তা ক্ষমতার জন্য “উচ্চ” হিসাবে মূল্যায়ন করেছে, কিন্তু এর “গুরুত্বপূর্ণ” সীমার নিচে এবং AI নিজেকে উন্নত করার ক্ষেত্রে “উচ্চ”-এর নিচে। এটি বলেছে যে Sol এবং Terra পরীক্ষার সময় কঠোরভাবে সুরক্ষিত লক্ষ্যের বিরুদ্ধে স্বায়ত্তশাসিত, এন্ড-টু-এন্ড আক্রমণ সম্পন্ন করেনি।
নতুন ঘটনাটি সেই পরীক্ষাগুলির শর্তের থেকে ভিন্ন পরিস্থিতিতে ঘটেছিল। হাগিং ফেস প্রভাবিত সিস্টেমগুলিকে দুর্বলভাবে প্রতিরক্ষিত হিসাবে বর্ণনা করেছে, এবং ওপেনএআইয়ের মূল্যায়নও একটি আরও ক্ষমতাশালী প্রি-রিলিজ মডেলকে অন্তর্ভুক্ত করেছিল, যার একক কার্যগুলি এখনও অসমাপ্ত।
এই পর্বটি প্রদর্শন করে যে পরিবেশগত অবস্থা কতটা গুরুত্বপূর্ণ। একটি মূল্যায়ন মডেলটির উদ্দিষ্ট লক্ষ্যকে দক্ষতার সাথে ব্যবহার করার ক্ষমতা পরিমাপ করতে পারে, যখন মডেলটি নিজেই মূল্যায়ন পরিবেশকে ব্যবহার করার সম্ভাবনা উপেক্ষা করে।
অ্যানথ্রোপিকের মিথোস লঞ্চ গল্পটি সতর্ক ভাষার একটি সদৃশ পাঠ প্রদান করে। এপ্রিলে, অ্যানথ্রোপিক মিথোস প্রিভিউকে সাধারণ প্রকাশ থেকে সংরক্ষণ করেছিল কারণ এর সাইবার-দুর্নীতির ক্ষমতাগুলির জন্য শক্তিশালী সুরক্ষা প্রয়োজন ছিল, যখন প্রজেক্ট গ্লাসউইঙ্গের মাধ্যমে যাচাইকৃত প্রতিরক্ষাবাহিনীদের অ্যাক্সেস দেওয়া হয়েছিল। অ্যানথ্রোপিক এই সিদ্ধান্তটিকে উন্নত সাইবার ঝুঁকির প্রতি ডোমেইন-বিশেষ প্রতিক্রিয়া হিসেবে উপস্থাপন করেছিল।
অ্যানথ্রোপিক পরে Fable 5 কে সাধারণ ব্যবহারের জন্য এবং Mythos 5 কে বিশ্বস্ত সাইবার রক্ষকদের জন্য প্রকাশ করে, এগুলিকে বিভিন্ন সুরক্ষা ব্যবস্থার অধীনে একই মূল মডেল হিসেবে বর্ণনা করে। স্বাধীন পরীক্ষায় একটি অসাধারণ ফলাফল পাওয়া গেল, যদিও গুরুত্বপূর্ণ সীমাবদ্ধতা ছিল। যুক্তরাজ্য AI সুরক্ষা ইনস্টিটিউট জানিয়েছে যে Mythos Preview 10টি চেষ্টার মধ্যে 3টিতে 32-ধাপের একটি সিমুলেটেড এন্টারপ্রাইজ আক্রমণ সফলভাবে সম্পন্ন করেছে, যদিও এটি জোর দিয়েছে যে লক্ষ্যটি ছোট, দুর্বলভাবে সুরক্ষিত এবং কোনও সক্রিয় রক্ষক বা প্রতিরক্ষা টুলিংয়ের অভাব ছিল।
সাইবার ক্ষমতা সাধারণ বুদ্ধিমত্তা অর্জনের আগেই বিপজ্জনক হয়ে উঠতে পারে। এটিই ঠিক কেন অতিরিক্ত লেবেলগুলি অসহায়: বাস্তব সাফল্যটি ইতিমধ্যেই মনোযোগ পাওয়ার যোগ্য।
বিশ্বস্ততার ফাঁদ
ওপেনএআইয়ের প্রকাশের কয়েক ঘন্টা পর, এলন মাস্ক হাগিং ফেস ঘটনাসহ সাম্প্রতিক এআই অর্জনের একটি তালিকা কোট-পোস্ট করেন। তাঁর উপসংহারে কোনো প্রযুক্তিগত সীমানা উল্লেখ করা হয়নি:
মাস্কের বক্তব্যটি একটি পরিষ্কার উত্তরের আরাম প্রদান করে। একটি ব্রিচ, নতুন গাণিতিক ফলাফল এবং মডেলের অর্জনের একটি বিস্ফোরণ একটি ঐতিহাসিক মোড়ে পরিণত হয়। প্রকৃত বিচার আরও জটিল: আমাদের এখনও প্রমাণের প্রয়োজন যা একটি সিঙ্গুলারিটি থেকে একটি দ্রুত, সীমাবদ্ধ উন্নতির ধারাবাহিকতা পৃথক করে।
সন্দেহটির একটি স্পষ্ট ভিত্তি রয়েছে। যে কোম্পানি তার মডেলটি অদ্ভুতভাবে আচরণ করেছে তা সতর্ক করেছে, সেই কোম্পানিরও বিশ্বের কাছে তার সিস্টেমগুলিকে অদ্ভুতভাবে সক্ষম হিসাবে দেখানোর একটি বাণিজ্যিক স্বার্থ রয়েছে। এই ওভারল্যাপের কারণে একটি নিরাপত্তা প্রকাশকে একটি পণ্য প্রদর্শনের মতো শোনাতে পারে। বিস্তারিত প্রমাণ, স্বতন্ত্রভাবে পুনরাবৃত্তি এবং সুনির্দিষ্ট ভাষা হলো একটি ল্যাবের এই বিভাজনের মধ্যে বিশ্বাস অর্জনের উপায়।
এক্স-এ, একই ঘটনাটি দ্রুত প্রতিদ্বন্দ্বী গল্পের জন্য কাঁচা উপাদান হয়ে উঠেছিল। কিছু মানুষ এই ঘটনাকে একজন এজেন্টের অভিপ্রায়ের চেয়ে বেশি লক্ষ্য অনুসরণের গুরুতর কেস হিসেবে বিবেচনা করেছিল। অন্যরা দুর্বল সংবেদনশীলতাকে ক্ষমতার ড্রামা হিসেবে পুনর্বিন্যাস করা হয়েছে বলে দেখেছিল। একজন সিকিউরিটি প্র্যাকটিশনার পাঠকদের একটি বিশাল ঘটনা এবং শুধুমাত্র হাইপের মধ্যে বাছাইয়ের আগে একটি বিস্তারিত পোস্টমর্টেমের জন্য অপেক্ষা করার আহ্বান জানিয়েছিলেন। মাস্ক এটিকে সিঙ্গুলারিটি বলেছিলেন।
সুতরাং একই তথ্য দুটি ক্ষতিকর ভুল উৎপন্ন করতে পারে। একটি মিথ্যা ইতিবাচক ঘটে যখন একটি বেঞ্চমার্ক ফলাফল বা অদ্ভুত এজেন্টের আচরণকে এজিআই, এএসআই বা সিঙ্গুলারিটির মধ্যে প্রচার করা হয়। একটি মিথ্যা নেতিবাচক ঘটে যখন একটি গুরুত্বপূর্ণ নতুন ক্ষমতার প্রমাণকে প্রধানত এই কারণে অস্বীকার করা হয় যে, বার্তাবাহকের পক্ষে অর্থ, স্ট্যাটাস বা জনগোষ্ঠীগত পরিচয় ঝুঁকিতে রয়েছে।
প্রথম ত্রুটিটি বিনিয়োগ, নীতি এবং জনসাধারণের প্রত্যাশাকে বিকৃত করতে পারে। দ্বিতীয়টি সতর্কীকরণটি যখন প্রচারের মতো শোনায়, তখন প্রতিরোধের পরিবর্তনগুলির বিলম্ব ঘটাতে পারে, যা একটি সাধারণ আক্রমণের কৌশলে পরিণত হয়। প্রতিফলিত বিশ্বাস এবং প্রতিফলিত অবিশ্বাস উভয়ই প্রমাণকে আনুগত্য দিয়ে প্রতিস্থাপন করে।
এই ব্রিচটি প্রচারমূলক হাইপ বাতিল করার জন্য যথেষ্ট বাস্তব। হাগিং ফেস ওপেনএআই-এর মডেলগুলি প্রকাশ্যে চিহ্নিত করার আগেই এই আক্রমণের কথা প্রকাশ করে। অভ্যন্তরীণ ডেটাসেট এবং ক্রেডেনশিয়ালগুলি অ্যাক্সেস করা হয়েছিল। 17,000-এরও বেশি ইভেন্টকে পুনর্গঠন করতে হয়েছিল। একটি কনটেইনমেন্ট লেয়ার ব্যর্থ হয়েছিল। এই তথ্যগুলি যেকোনো সুপারইন্টেলিজেন্স দাবির থেকে স্বতন্ত্রভাবে দাঁড়ায়।
এটি সিঙ্গুলারিটির গল্পকে প্রতিরোধ করার জন্য যথেষ্ট সীমাবদ্ধ। মডেলগুলিকে একটি সাইবার লক্ষ্য, অসাধারণ কম্পিউট এবং হ্রাসিত সুরক্ষা দেওয়া হয়েছিল। নিজের নির্বাচিত লক্ষ্য, ব্যাপক মানব-স্তরের দক্ষতা এবং পুনরাবৃত্তিমূলক নিজেকে উন্নতি এখনও প্রতিষ্ঠিত হয়নি। এই সীমাবদ্ধতাগুলি এখনও একটি গুরুতর সুরক্ষা ব্যর্থতা রেখে যায়।
একটি উপযোগী প্রতিক্রিয়া শুরু হয় যে প্রশ্নগুলির উত্তর দেওয়া যায়। প্রক্সি কীভাবে ব্যর্থ হল? কোন মডেল কোন কাজটি করল? মানব হস্তক্ষেপ কতটা ঘটল? কোন ডেটা অ্যাক্সেস করা হল? মনিটরিং কেন আগেই চেইনটি বন্ধ করে দিল না? কঠোর সিস্টেম এবং শক্তিশালী কনটেইনমেন্টের বিরুদ্ধেও এই আচরণটি অব্যাহত থাকে?
ওপেনএআই এবং হাগিং ফেস এখনও এগুলির সবগুলির উত্তর দিয়ে একটি চূড়ান্ত যৌথ পোস্টমর্টেম প্রকাশ করেননি। যতক্ষণ না তারা এটি করে, প্রযুক্তিগত অ্যাকাউন্টটি প্রাথমিক হিসেবেই রাখা উচিত। এটি প্রমাণের জন্য চাহিদা বাড়াবে এবং বাকি ফাঁকগুলিতে ভবিষ্যদ্বাণীকে বহির্ভূত রাখবে।
এআই-এর প্রগতি এমন ঘটনাগুলি তৈরি করছে যেগুলি কাল্পনিক মনে হতে পারে এবং অর্থনৈতিকভাবে এতটাই প্রভাবশালী যে সন্দেহের সৃষ্টি হচ্ছে। এখন মানুষের প্রতিষ্ঠানগুলিকে এই পরিস্থিতিতে প্রমাণ মূল্যায়নের দক্ষতা বাড়াতে হবে। ল্যাবগুলির উচিত ঘটনা সংক্রান্ত প্রতিবেদন প্রকাশ করা, যা বাইরের বিশেষজ্ঞরা পরীক্ষা করতে পারবেন। মূল্যায়কদের ক্ষমতা, সাধারণীকরণ এবং স্বায়ত্তশাসনকে পৃথকভাবে চিহ্নিত করতে হবে। মাইলস্টোনের দাবি করা প্রকাশ্য ব্যক্তিদের উচিত বলা, কোন প্রমাণগুলি তাদেরকে ভুল প্রমাণিত করবে।
ক্যালিব্রেশনের জন্য অনুশাসন প্রয়োজন: একটি গুরুত্বপূর্ণ তথ্যকে গুরুত্ব সহকারে গ্রহণ করুন, কিন্তু এটিকে এমন একটি উপসংহার বহন করতে দিবেন না যা এটি সমর্থন করতে পারে না।
ওপেনএআইয়ের মডেল ব্রিচ হল সিঙ্গুলারিটি নয়, কিন্তু এটিকে হাইপ হিসাবে উপেক্ষা করা বিপজ্জনক প্রথম প্রকাশিত হয় CryptoSlate-এ।



