টেকক্রাঞ্চের উদ্ধৃতি দিয়ে দ্য ইনফরমেশন প্রতিবেদন করে যে, ওপেনএআইয়ের আগামী আস্ট্রা মডেলটি "রিকারসিভ ডিপ" নামক একটি যুক্তি প্রযুক্তি ব্যবহার করবে। এই পদ্ধতিটি মডেলের যুক্তি প্রক্রিয়ার দৃশ্যমান ছাপগুলি কমিয়ে দিতে পারে, যাতে বাইরের কেউ চিন্তার শৃঙ্খল রেকর্ডের মাধ্যমে মডেলটি কীভাবে কোনো সিদ্ধান্তে পৌঁছায় তা বুঝতে কঠিন হয়ে পড়ে।
সিকিউরিটি গবেষকরা সতর্কবার্তা জারি করেছেন
সাধারণ রিজনিং মডেলগুলিতে, চিন্তার শৃঙ্খল সাধারণত ধাপে ধাপে দেখায় যে মডেলটি সমস্যাটি কীভাবে প্রক্রিয়া করে। যদিও এই রেকর্ডিংটি মডেলের পূর্ণাঙ্গ অভ্যন্তরীণ প্রক্রিয়ার সমান নয়, তবুও এটি মডেলের লক্ষ্য থেকে বিচ্যুতি, অস্বাভাবিক সিদ্ধান্ত বা সম্ভাব্য অনিয়ন্ত্রিত আচরণ পর্যবেক্ষণের একটি গুরুত্বপূর্ণ টুল।
রেডউড রিসার্চের সিইও বাক শ্লেগারিস বলেন যে তিনি আস্ট্রা এই ধরনের প্রযুক্তি ব্যবহার করার বিষয়ে "অত্যন্ত উদ্বিগ্ন"। তিনি মনে করেন যে যদি OpenAI এই পদ্ধতিগুলির ব্যাপ্তি আরও বাড়ায়, তবে মডেলের চিন্তার শৃঙ্খলের নিরীক্ষণযোগ্যতা উল্লেখযোগ্যভাবে কমে যাবে।
এআই নিরাপত্তার দীর্ঘস্থায়ী মন্তব্যকারী জভি মোশোভিটজও বলেছেন যে যদি বিভিন্ন পরীক্ষাগারগুলি মডেলের ক্ষমতার উপর প্রতিযোগিতা করে, তবে ভবিষ্যতে নিয়ন্ত্রকদের শিল্পটিকে নিরাপত্তা মানদণ্ডের দিকে নিয়ে যাওয়া থেকে বাঁচানোর জন্য হস্তক্ষেপ করতে হতে পারে।
চক্রীয় যুক্তি দ্বারা দৃশ্যমান ছাপ কমানো
প্রতিবেদনটি উল্লেখ করে যে, "অস্বচ্ছ পুনরাবৃত্তি" বলতে বোঝায় যে মডেলটি রেখাচিত্রভাবে ধাপে ধাপে যুক্তি প্রয়োগ করার পরিবর্তে একই সমস্যার উপর চক্রাকারে কাজ করে। এটি বাহ্যিকভাবে পড়া যায় এমন মধ্যবর্তী প্রক্রিয়াগুলির সংখ্যা কমিয়ে দিতে পারে, যা প্রচলিত চিন্তার শৃঙ্খলা রেকর্ডের মাধ্যমে প্রদত্ত দৃশ্যমান পথকে এড়িয়ে চলে।
এটিই নিরাপত্তা গবেষকদের সবচেয়ে বেশি চিন্তিত করে তোলে। কারণ যখন মডেলগুলি অদৃশ্য অভ্যন্তরীণ স্থানে যত বেশি যুক্তি প্রয়োগ করতে শুরু করে, গবেষকদের জন্য তা বুঝতে কঠিন হয়ে যায় যে এটি কি ভুল তথ্য দিচ্ছে, সীমাবদ্ধতা এড়াচ্ছে অথবা অন্যান্য অপ্রত্যাশিত আচরণ প্রদর্শন করছে।
রেডউড রিসার্চের চিফ সায়েন্টিস্ট রায়ান গ্রিনব্ল্যাট বলেন, এই অস্বচ্ছ যুক্তির বড় ঝুঁকি হলো এটি পারম্পরিক চিন্তার শৃঙ্খল যুক্তির চেয়ে সহজেই স্কেল হতে পারে, যার ফলে বেশিরভাগ যুক্তির প্রক্রিয়া দৃশ্যমান চ্যানেল থেকে বাইরে চলে যায়।
OpenAI মনিটরিং ক্ষমতা বজায় রাখার উপর জোর দিয়েছে
তবে, এখন পর্যন্ত আস্ট্রা এই প্রযুক্তির ব্যবহার সীমিত বলে জানানো হয়েছে। প্রতিবেদনে বলা হয়েছে যে, মডেলটির চিন্তার শৃঙ্খল এখনও পাঠযোগ্য থাকবে বলে আশা করা হচ্ছে, এবং OpenAI এটিকে সম্পূর্ণভাবে অবিবেচ্য “নিউরাল ল্যাঙ্গুয়েজ” হিসাবে বর্ণনা করার বাইরের চেষ্টার বিরুদ্ধে আপত্তি জানিয়েছে।
OpenAI-এর প্রধান বিজ্ঞানী জাকুব প্যাচোকি X-এ বলেছেন যে, কোম্পানিটি সবচেয়ে প্রাথমিক রিজনিং মডেল থেকেই চিন্তার শৃঙ্খল মনিটরিং ক্ষমতা বজায় রাখা এবং ব্যবহার করার জন্য কাজ করে আসছে, যা বর্তমান গবেষণা পরিকল্পনার একটি প্রধান লক্ষ্য।
লক্ষণীয় যে, এই দিকে যাওয়ার কথা শুধুমাত্র OpenAI-এর নয়। The Information-এর পরবর্তী প্রতিবেদনে বলা হয়েছে, Anthropic এবং Google DeepMind-ও এই ধরনের প্রযুক্তি নিয়ে আলোচনা করছে। এর অর্থ এই যে, মডেলের ক্ষমতা বৃদ্ধি এবং নিরাপত্তা-সম্পন্ন পর্যালোচনার মধ্যে ভারসাম্য বজায় রাখা শীঘ্রই AI শিল্পের জন্য একটি আরও ব্যাপক সাধারণ বিষয় হয়ে উঠতে পারে।
