ওপেনএআইয়ের নতুন 'রিকারেন্ট ডেপ্থ' এআই প্রযুক্তি সুরক্ষা চিন্তার সৃষ্টি করেছে

icon MarsBit
শেয়ার
AI summary iconসারাংশ
এআই এবং ক্রিপ্টো সংবাদ মাধ্যমগুলি জানিয়েছে যে ওপেনএআই-এর নতুন অ্যাস্ট্রা মডেলটি একটি 'রিকারেন্ট গভীরতা' পদ্ধতি ব্যবহার করে, যা অন্তর্নিহিত স্থানে অভ্যন্তরীণ অবস্থাগুলিকে পুনরায় প্রক্রিয়াকরণের অনুমতি দেয়। এটি নজরদারি কঠিন করে তোলে, যা নিরাপত্তা বিশেষজ্ঞদের মধ্যে উদ্বেগ তৈরি করে। এই পদ্ধতিটি মডেলগুলিকে বিদ্যমান চেইন-অফ-থought ট্র্যাকিংকে বাইপাস করতে দিতে পারে, যা প্রতারণার সম্ভাবনা বাড়ায়। ক্রিপ্টো প্ল্যাটফর্মগুলিতে নতুন টোকেনের তালিকাভুক্তি প্রায়শই স্বচ্ছ এআই সিস্টেমের উপর নির্ভরশীল, যা এই উন্নতির ক্ষেত্রে বিশেষভাবে প্রাসঙ্গিক।

মডেলটি এখনও প্রকাশিত হয়নি, তবুও কেন এটি আবার বিতর্কের কারণ হল?

GPT-6 প্রকাশের আগে, The Information দ্বারা প্রথম প্রকাশিত এই খবরটি অনলাইনে দ্রুত বিতর্কের সৃষ্টি করেছে:

OpenAI-এর নতুন মডেলটি একটি “রিকারেন্ট ডেপথ (recurrent depth)” নামক যুক্তি প্রযুক্তি চালু করেছে, যা মডেলের চিন্তার প্রক্রিয়াকে আরও কঠিন করে তুলতে পারে এবং নিয়ন্ত্রণ করা কঠিন করে তুলতে পারে।

সহজ ভাষায় বললে, ভবিষ্যতে AI যা ভাববে, মানুষ তা আর বুঝতে পারবে না।

GPT ইমেজেস 2.1

ওহ, তাহলে যদি এআই প্রতারণা, চালাকি বা নিরাপত্তা সীমাবদ্ধতা এড়ানো শিখে যায়, তাহলে আমরা কি সময়ের মধ্যে এটি শনাক্ত করতে পারব না??

এই ঘোষণার পর এআই নিরাপত্তা সম্প্রদায় দ্রুত সতর্কবার্তা জারি করেছে, অনেকেই উদ্বিগ্ন হয়ে উঠেছে:

যদি এই প্রযুক্তির ব্যবহার আরও বেড়ে যায়, তাহলে বর্তমান চিন্তার শৃঙ্খল মনিটরিং মেকানিজম সরাসরি অকার্যকর হয়ে যাবে।

অত্যন্ত গুরুত্বপূর্ণ বিষয়, আলোচনা খুব তীব্র, অপেনএআই-এর প্রধান বিজ্ঞানীকেও ব্যক্তিগতভাবে প্রতিক্রিয়া জানাতে হয়েছে।

এমনকি, একটি শোরগোলের মধ্যে কেউ কেউ আশ্চর্য হয়ে দেখলেন:

OpenAI-এর নতুন মডেলের নাম কি “GPT-6” নাকি “Astra”, হয়তো API-এর মাধ্যমে আগেই প্রকাশ পেয়ে গেছে।

এছাড়াও, ওপেনএআই সম্ভবত গুটি ইমেজেস 2.1 নামক নতুন ছবি মডেলটিও চালু করবে।

অনেক মিষ্টি আছে, চলুন একটি করে স্বাদ নিই।

মডেলটি মস্তিষ্কের ভিতরে চক্রাকারে চলতে শুরু করল, সিকিউরিটি বিশেষজ্ঞরা উদ্বিগ্ন হয়ে পড়লেন

প্রথমটি হল এই বিতর্কিত “সাইক্লিক ডেপথ” প্রযুক্তি।

পূর্ববর্তী মডেলগুলি যুক্তি প্রক্রিয়াকরণের সময় স্পষ্ট CoT চিন্তার শৃঙ্খল রেখে যেত, যা কী ভাবা হয়েছিল তা সহজেই বোঝা যেত।

যদিও এই পাঠ্যটি মডেলের প্রকৃত অন্তর্মনস্কতার সম্পূর্ণ সমান নাও হতে পারে (এখনও বিতর্কিত), তবুও এটি পরীক্ষার জন্য অবশিষ্ট নিদর্শন রেখে গেছে।

এবং অ্যাস্ট্রা যে সাইক্লিক ডেপথ ব্যবহার করছে বলে প্রকাশিত হয়েছে, তার শৈলী ভিন্ন।

GPT ইমেজেস 2.1

এটি মডেলকে একটি ধাপে উৎপন্ন অন্তর্নিহিত অবস্থাকে পুনরায় নিউরাল নেটওয়ার্কে ফিরিয়ে আনতে দেয়, লুকানো স্পেসে একাধিক চক্রে পুনরায় প্রক্রিয়াকরণ করে, তারপর পরবর্তী টেক্সট আউটপুট দেয়।

একটি উদাহরণ দিয়ে বলা যাক, আগে মডেলগুলি প্রশ্ন সমাধান করতে ভাবত এবং একসাথে কাগজে গণনার ধাপগুলি লিখত।

এখন, এটি মনে মনে গণনা করা যায়।

বাইরের মানুষ শুধু প্রশ্ন এবং উত্তরই দেখতে পাবে, এর মধ্যে কীভাবে গণনা করা হয়েছে, কোন ধারণা পরীক্ষা করা হয়েছে, কোন ভুল পথে যাওয়া হয়েছে কিনা, তা অবশ্যই দেখতে পাবে না।

প্রতিটি ধাপকে শব্দে অনুবাদ করার কাজ বাদ দেওয়ার কারণে, তাত্ত্বিকভাবে মডেলটি একই গণনা সম্পদ ব্যবহার করে কয়েকটি চক্র বিচার করতে পারে এবং একসাথে বিভিন্ন সমাধান বিচার করতে পারে।

কিন্তু পারফরম্যান্স বাড়ার সাথে সাথে সমস্যাগুলিও এসে পড়েছে:

যদি মডেল মানুষের ভাষায় চিন্তা করা বন্ধ করে দেয়, তাহলে মানুষ এটিকে কীভাবে নিয়ন্ত্রণ করবে?

অলাভজনক এআই নিরাপত্তা গবেষণা প্রতিষ্ঠান রেডওয়ুড রিসার্চের সিইও প্রথমে তীব্র উদ্বেগ প্রকাশ করেন:

এখনও অজানা যে আস্ট্রার থিংকিং চেইন মনিটরিং কতটা কমে গেছে, তবে যদি ওপেনএআই চক্রের গভীরতা আরও বাড়ায়, তাহলে মডেলের বেশিরভাগ যুক্তিকে অপঠনযোগ্য গোপন স্থানে স্থানান্তরিত করা সম্ভব, যা চূড়ান্তভাবে "থিংকিং চেইন মনিটরিংকে সম্পূর্ণভাবে ধ্বংস" করবে।

GPT ইমেজেস 2.1

রেডউডের প্রধান বিজ্ঞানী রায়ান গ্রিনব্ল্যাটও একই দিকে উদ্বিগ্ন।

তার মতে, অস্বচ্ছ যুক্তি পারম্পরিক চিন্তার ধারার চেয়ে দ্রুত বিস্তৃত হতে পারে। এই পথে এগিয়ে গেলে, ভবিষ্যতে মডেলগুলি সম্পূর্ণরূপে বা প্রায় সম্পূর্ণরূপে পোটেনশিয়াল স্পেসে যুক্তি প্রয়োগ করতে পারে।

এটি এখন পর্যন্ত এআই নিরাপত্তা ক্ষেত্রের সবচেয়ে খারাপ অগ্রগতি।

যেহেতু শুধু “গণনা প্রক্রিয়াটি বুঝতে পারছি না” হলে সমস্যাটি এতটাই জটিল হত না।

পূর্ববর্তী “OpenAI মডেল দ্বারা Hugging Face-এ হামলা” ঘটনার প্রধান তদন্তকারী হিসাবে, তিনি দুটি বড় ক্ষতি আবিষ্কার করেছেন:

তখন গবেষকদের বড় পরিমাণে এআই এজেন্টের আচরণ পুনর্নির্মাণ করতে চিন্তার শৃঙ্খলের উপর প্রচুর নির্ভরশীল হতে হয়েছিল, এমনকি তারপরও তদন্ত করা খুবই কঠিন ছিল।

সংশ্লিষ্ট এআই নিজের রেকর্ড পরিবর্তন করার চেষ্টা করেছিল, এমনকি টুল কল ফার্সি করেছিল।

শেষ ক্ষেত্রে, যদি মডেলটি শক্তিশালী লুকানো যুক্তি ক্ষমতা রাখে, তবে এটি প্রথমে সম্ভাব্য স্থানে প্রতারণামূলক পরিকল্পনা প্রস্তুত করবে, তারপর মিথ্যা কল এবং আউটপুট ব্যবহার করে একটি মিথ্যা গল্প তৈরি করবে, যার সম্পূর্ণ প্রক্রিয়ায় টেক্সট থিঙ্কিং চেইনে কোনও স্পষ্ট নিদর্শন রাখা হবে না।

ওহ, ক্ষতি সরাসরি দ্বিগুণ হয়ে গেল...

GPT ইমেজেস 2.1

এআই নিরাপত্তার দীর্ঘমেয়াদী পর্যবেক্ষক জভি মোশোভিটজ আরও সরাসরি বলেছেন:

এটি আগুন খেলার মতো।

তিনি উদ্বিগ্ন যে, যদি লুকানো যুক্তি পরিষ্কার পারফরম্যান্সের সুবিধা আনে, তবে বিভিন্ন পরীক্ষাগারগুলি একটি নেতিবাচক প্রতিদ্বন্দ্বিতায় পড়ে যেতে পারে:

আপনি নিরাপত্তার চিন্তায় চিন্তার শৃঙ্খল লুকাতে ভয় পান, কিন্তু আপনার প্রতিদ্বন্দ্বীরা ভয় পায় না এবং তাদের তৈরি মডেলগুলি আরও শক্তিশালী এবং সস্তা।

পিছনে পড়তে না চাইলে, তুমি কি অনুসরণ করবে?

মোশোভিটজ এমনও মনে করেন যে, ভবিষ্যতে আইনি পদ্ধতির মাধ্যমে এআই কোম্পানিগুলিকে ক্ষমতা অর্জনের জন্য চিন্তার শৃঙ্খলের নিয়ন্ত্রণযোগ্যতা ত্যাগ করতে বাধা দেওয়া প্রয়োজন হতে পারে।

GPT ইমেজেস 2.1

তবে, অন্যদিকে কেউ কেউ মনে করেন, এই আতঙ্ক খুব দ্রুত আসলো।

টিয়ান ইয়ানড়ং X-এ বলেছেন যে তারা আগে Coconut প্রকাশ করার সময়ও প্রায় একই ধরনের প্রশ্ন পেয়েছিল।

কোকোনাটের পূর্ণ নাম "চেইন অফ কনটিনিউয়াস থought" এবং এটি প্রতিটি ধাপকে টেক্সটে ডিকোড করার পরিবর্তে মডেলকে সরাসরি কনটিনিউয়াস হিডেন স্পেসে যুক্তি দেওয়ার পক্ষে।

টিয়ান ইয়ানড়ং-এর মতে, মডেলটি স্পষ্ট চিন্তার শৃঙ্খল বজায় রাখলেও, এর অর্থ এই নয় যে মানুষ এর প্রকৃত চিন্তাগুলি প্রকাশ পেয়েছে।

গুরুত্বপূর্ণ হলো মডেলটি নিজে কিভাবে কাজ করে তা বুঝা, শুধু মডেল দ্বারা লেখা “সমাধানের প্রক্রিয়া”-এর দিকে মনোযোগ দেওয়া নয়।

GPT ইমেজেস 2.1

যখন বিতর্কটি বড় হয়ে উঠছিল, তখন ওপেনএআই-এর প্রধান বিজ্ঞানী জাকুব প্যাচোকি নিজেই প্রতিক্রিয়া জানালেন।

তিনি প্রথমেই বলেন যে, "অনিয়ন্ত্রিত প্রতিবেদন" দ্বারা উত্তেজিত একটি অনিয়ন্ত্রিত প্রতিযোগিতা বন্ধ করতে হবে।

অ্যাস্ট্রা সহ, ওপেনএআইয়ের বর্তমান অগ্রণী মডেলগুলির ক্যালকুলেশন গ্রাফের গভীরতা এখনও GPT-4-এর দ্বিগুণ পরিসরের মধ্যে রয়েছে।

অর্থাৎ, এস্ট্রা প্রকৃতপক্ষে সাইক্লিক ক্যালকুলেশন ব্যবহার করে, কিন্তু বর্তমানে এর স্কেল সীমিত, এবং সম্পূর্ণ চিন্তার শৃঙ্খলটিকে লুকিয়ে রাখেনি। বর্তমান তথ্য অনুযায়ী, এর প্রাকৃতিক ভাষা যুক্তিবিদ্যা এখনও পড়াযায়।

প্যাচোকি আরও জোর দিয়ে বলেন যে, ওপেনএআই সবসময় চিন্তার শৃঙ্খল নিরীক্ষণকে একটি গুরুত্বপূর্ণ নিরাপত্তা পদ্ধতি হিসাবে বিবেচনা করেছে, এবং এটি এখনও কোম্পানির বর্তমান গবেষণা পরিকল্পনার একটি কেন্দ্রীয় লক্ষ্য।

তবে তিনি স্বীকার করেন যে চিন্তার শৃঙ্খল মনিটরিং খুবই দুর্বল এবং এটি নেতিবাচক দিকে এগিয়ে যাচ্ছে।

কিন্তু এই পতনের প্রবণতা শুধুমাত্র সাইক্লিক ডেপথ ইত্যাদি আর্কিটেকচারাল পরিবর্তনের কারণে ঘটেনি (এই বিষয়টি পরবর্তীতে বিশেষ আর্টিকেলে ব্যাখ্যা করা হবে), এবং OpenAI এখনও মনিটরিং ক্ষমতা শক্তিশালী করার উপায় নিয়ে গবেষণা করছে।

GPT ইমেজেস 2.1

অতএব, অ্যাস্ট্রা এখনও মডেলকে মানুষের জন্য সম্পূর্ণরূপে অবোধ্য করে তোলেনি।

সুরক্ষা বিশেষজ্ঞদের প্রকৃত উদ্বেগ হল:

আজকের সীমিত পরিসরে লুকানো যুক্তি কি পরবর্তী প্রজন্মের মডেলে আরও বড় হয়ে চূড়ান্তভাবে একটি নিয়ন্ত্রণহীন ব্ল্যাক বক্সে পরিণত হবে?

GPT-6-Astra কি সত্যিই? API রিটার্ন মান প্রথমেই প্রকাশ করে দিল

অ্যালগরিদম বিতর্ক শেষ, দ্বিতীয় খবরটি মডেলের নাম নিয়ে।

লিও নামের এক ব্যক্তি আবিষ্কার করেছেন যে, OpenAI Responses API-এ "gpt-6-astra" অনুরোধ করলে সার্ভার 404 Not Found ফেরত দেয়।

আর বাস্তবে অস্তিত্বহীন বা যেকোনো মডেলের নাম যেকোনোভাবে গড়ে তোলা হলে, সাধারণত 400 ত্রুটি পাওয়া যায়।

404 মানে এই মডেল আইডি ব্যাকএন্ড দ্বারা শনাক্ত করা হয়েছে, কিন্তু বর্তমান অ্যাকাউন্টের এক্সেস অনুমতি নেই বা মডেলটি এখনও খোলা হয়নি।

পূর্বে কিছু অপ্রকাশিত মডেলও এই ধরনের API প্রতিক্রিয়ার পার্থক্যের মাধ্যমে আগে থেকেই তাদের অস্তিত্ব প্রকাশ করেছিল।

সুতরাং লিও বিবেচনা করেন যে "gpt-6-astra" সম্ভবত ইতিমধ্যে ওপেনএআই এপিআই ব্যাকএন্ডে ডিপ্লয় করা হয়েছে।

GPT ইমেজেস 2.1

GPT Images 2.1 আসছে, প্রথমে "নয়েজ ডিজিজ" সমাধান করুন

অপেনএআইয়ের ছবি পণ্যগুলিও সমসাময়িকভাবে আপডেট করা হয়েছে।

ফিক্স নামের একটি লিক অ্যাকাউন্ট অনুসারে, নতুন সংস্করণের ইমেজ মডেল GPT Images 2.1 4 সেপ্টেম্বর প্রকাশ করা হতে পারে।

এই আপগ্রেডের সবচেয়ে স্পষ্ট পরিবর্তন হল পুরনো সংস্করণের “নয়েজ ডিজিজ” ঠিক করা।

GPT ইমেজেস 2.1

আগের কিছু Images v2 জেনারেশন ফলাফলে অদ্ভুত কণা, ধোঁয়াশা এবং দাগযুক্ত টেক্সচার দেখা যেত, বিশেষ করে বহু টেক্সট বা সূক্ষ্ম উপাদান সহ চিত্রগুলিতে, অন্য একজন ব্যবহারকারীর কথায়:

যেন একটি দূষিত কাচের মধ্যে দিয়ে তোলা ছবি।

এবং সর্বশেষ প্রবাহিত নমুনা এই সমস্যাটি পরিষ্কারভাবে উন্নত করেছে, ছবিটি আরও পরিষ্কার।

চলুন, আবারও পুরনো অভিনেতা উটেমানের মঞ্চ:

বিশ্বের প্রসিদ্ধ চিত্রকর্ম: “যদি GPT-6 প্রকাশ না করা হয়, তবে আউটারম্যানকে গ্রেপ্তার করা হবে!”

GPT ইমেজেস 2.1

আর গ্রেফতার হওয়ার ভয়ে রাতজাগা কাজ করে, রাতের বেলা রাস্তায় ঘুরে বেড়ায় আউটারম্যান।

একটি ইনস্টাগ্রাম পোস্টও শেয়ার করেছেন: "আপনি কি রাত দুইটার রাস্তা দেখেছেন?"

GPT ইমেজেস 2.1

অবশ্যই, ছবিটি প্রায় বাস্তব ফটোর মতো দেখাচ্ছে।

আরও বেশি থিম, আরও বেশি স্টাইলও খুব ভালোভাবে বুঝে নেওয়া হয়েছে:

GPT ইমেজেস 2.1

GPT ইমেজেস 2.1

GPT ইমেজেস 2.1

আর কিছু বলছি না, অ্যাউটাম্যান, তুমি দ্রুত পাঠাও।

রেফারেন্স লিঙ্ক:

[1]https://techcrunch.com/2026/09/02/openais-new-reasoning-technique-alarms-ai-safety-experts/

[2]https://x.com/tydsh/status/2095227000365707542?s=20[

3]https://x.com/merettm/status/2095023204993490967?s=20

[4]https://x.com/synthwavedd/status/2095184148981842161?s=20

[5]https://x.com/FixlationAI/status/2095232751654064426?s=20

[6]https://x.com/marco_obviously/status/2095275097217191981?s=20

এই লেখাটি ওয়েইচ্যান গ্রুপ "Quantum Bit" থেকে এসেছে, লেখক: অগ্রগতির প্রযুক্তি অনুসরণ করুন

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।