ওপেনএআইয়ের নতুন রিকার্সিভ রিজনিং এআই সুরক্ষা চিন্তার সৃষ্টি করেছে

icon币界网
শেয়ার
AI summary iconসারাংশ
এআই এবং ক্রিপ্টো সংবাদ মাধ্যমগুলি জানিয়েছে যে ওপেনএআইয়ের নতুন অ্যাস্ট্রা মডেলটি যুক্তির ধাপগুলি গোপন রাখতে রিকার্সিভ গভীরতা ব্যবহার করবে। রেডওডের বাক শ্লেগারিস এবং জভি মোশোভিটজ সতর্ক করেছেন যে এটি মডেলের স্বচ্ছতা কমিয়ে দিতে পারে। ওপেনএআই বলেছে যে এটি এখনও পাঠযোগ্য চেইন-অফ-থought লগগুলির সমর্থন করে। দ্য ইনফরমেশন উল্লেখ করেছে যে অ্যানথ্রোপিক এবং ডিপমাইন্ডও এই ধরনের পদ্ধতি পরীক্ষা করছে। বড় এক্সচেঞ্জগুলিতে নতুন টোকেন তালিকাভুক্তি এখনও এই উন্নতির প্রতিফলন ঘটায়নি।
ক্রিপ্টো নিউজ ওয়েবসাইট রিপোর্ট করছে:

টেকক্রাঞ্চের উদ্ধৃতি দিয়ে দ্য ইনফরমেশন প্রতিবেদন করে যে, ওপেনএআইয়ের আগামী আস্ট্রা মডেলটি "রিকারসিভ ডিপ" নামক একটি যুক্তি প্রযুক্তি ব্যবহার করবে। এই পদ্ধতিটি মডেলের যুক্তি প্রক্রিয়ার দৃশ্যমান ছাপগুলি কমিয়ে দিতে পারে, যাতে বাইরের কেউ চিন্তার শৃঙ্খল রেকর্ডের মাধ্যমে মডেলটি কীভাবে কোনো সিদ্ধান্তে পৌঁছায় তা বুঝতে কঠিন হয়ে পড়ে।

সিকিউরিটি গবেষকরা সতর্কবার্তা জারি করেছেন

সাধারণ রিজনিং মডেলগুলিতে, চিন্তার শৃঙ্খল সাধারণত ধাপে ধাপে দেখায় যে মডেলটি সমস্যাটি কীভাবে প্রক্রিয়া করে। যদিও এই রেকর্ডিংটি মডেলের পূর্ণাঙ্গ অভ্যন্তরীণ প্রক্রিয়ার সমান নয়, তবুও এটি মডেলের লক্ষ্য থেকে বিচ্যুতি, অস্বাভাবিক সিদ্ধান্ত বা সম্ভাব্য অনিয়ন্ত্রিত আচরণ পর্যবেক্ষণের একটি গুরুত্বপূর্ণ টুল।

রেডউড রিসার্চের সিইও বাক শ্লেগারিস বলেন যে তিনি আস্ট্রা এই ধরনের প্রযুক্তি ব্যবহার করার বিষয়ে "অত্যন্ত উদ্বিগ্ন"। তিনি মনে করেন যে যদি OpenAI এই পদ্ধতিগুলির ব্যাপ্তি আরও বাড়ায়, তবে মডেলের চিন্তার শৃঙ্খলের নিরীক্ষণযোগ্যতা উল্লেখযোগ্যভাবে কমে যাবে।

এআই নিরাপত্তার দীর্ঘস্থায়ী মন্তব্যকারী জভি মোশোভিটজও বলেছেন যে যদি বিভিন্ন পরীক্ষাগারগুলি মডেলের ক্ষমতার উপর প্রতিযোগিতা করে, তবে ভবিষ্যতে নিয়ন্ত্রকদের শিল্পটিকে নিরাপত্তা মানদণ্ডের দিকে নিয়ে যাওয়া থেকে বাঁচানোর জন্য হস্তক্ষেপ করতে হতে পারে।

চক্রীয় যুক্তি দ্বারা দৃশ্যমান ছাপ কমানো

প্রতিবেদনটি উল্লেখ করে যে, "অস্বচ্ছ পুনরাবৃত্তি" বলতে বোঝায় যে মডেলটি রেখাচিত্রভাবে ধাপে ধাপে যুক্তি প্রয়োগ করার পরিবর্তে একই সমস্যার উপর চক্রাকারে কাজ করে। এটি বাহ্যিকভাবে পড়া যায় এমন মধ্যবর্তী প্রক্রিয়াগুলির সংখ্যা কমিয়ে দিতে পারে, যা প্রচলিত চিন্তার শৃঙ্খলা রেকর্ডের মাধ্যমে প্রদত্ত দৃশ্যমান পথকে এড়িয়ে চলে।

এটিই নিরাপত্তা গবেষকদের সবচেয়ে বেশি চিন্তিত করে তোলে। কারণ যখন মডেলগুলি অদৃশ্য অভ্যন্তরীণ স্থানে যত বেশি যুক্তি প্রয়োগ করতে শুরু করে, গবেষকদের জন্য তা বুঝতে কঠিন হয়ে যায় যে এটি কি ভুল তথ্য দিচ্ছে, সীমাবদ্ধতা এড়াচ্ছে অথবা অন্যান্য অপ্রত্যাশিত আচরণ প্রদর্শন করছে।

রেডউড রিসার্চের চিফ সায়েন্টিস্ট রায়ান গ্রিনব্ল্যাট বলেন, এই অস্বচ্ছ যুক্তির বড় ঝুঁকি হলো এটি পারম্পরিক চিন্তার শৃঙ্খল যুক্তির চেয়ে সহজেই স্কেল হতে পারে, যার ফলে বেশিরভাগ যুক্তির প্রক্রিয়া দৃশ্যমান চ্যানেল থেকে বাইরে চলে যায়।

OpenAI মনিটরিং ক্ষমতা বজায় রাখার উপর জোর দিয়েছে

তবে, এখন পর্যন্ত আস্ট্রা এই প্রযুক্তির ব্যবহার সীমিত বলে জানানো হয়েছে। প্রতিবেদনে বলা হয়েছে যে, মডেলটির চিন্তার শৃঙ্খল এখনও পাঠযোগ্য থাকবে বলে আশা করা হচ্ছে, এবং OpenAI এটিকে সম্পূর্ণভাবে অবিবেচ্য “নিউরাল ল্যাঙ্গুয়েজ” হিসাবে বর্ণনা করার বাইরের চেষ্টার বিরুদ্ধে আপত্তি জানিয়েছে।

OpenAI-এর প্রধান বিজ্ঞানী জাকুব প্যাচোকি X-এ বলেছেন যে, কোম্পানিটি সবচেয়ে প্রাথমিক রিজনিং মডেল থেকেই চিন্তার শৃঙ্খল মনিটরিং ক্ষমতা বজায় রাখা এবং ব্যবহার করার জন্য কাজ করে আসছে, যা বর্তমান গবেষণা পরিকল্পনার একটি প্রধান লক্ষ্য।

লক্ষণীয় যে, এই দিকে যাওয়ার কথা শুধুমাত্র OpenAI-এর নয়। The Information-এর পরবর্তী প্রতিবেদনে বলা হয়েছে, Anthropic এবং Google DeepMind-ও এই ধরনের প্রযুক্তি নিয়ে আলোচনা করছে। এর অর্থ এই যে, মডেলের ক্ষমতা বৃদ্ধি এবং নিরাপত্তা-সম্পন্ন পর্যালোচনার মধ্যে ভারসাম্য বজায় রাখা শীঘ্রই AI শিল্পের জন্য একটি আরও ব্যাপক সাধারণ বিষয় হয়ে উঠতে পারে।

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।