সবচেয়ে বড় শিক্ষাগত এআই কনফারেন্সটি এখন কৃত্রিম বুদ্ধিমত্তাকে তার নিজের হোমওয়ার্ক মূল্যায়ন করতে দিয়েছে। এআই গবেষণার একটি প্রধান মঞ্চ, AAAI-26, 22,977টি মূল ট্র্যাক পেপার সাবমিশনের জন্য এআই-প্রেরিত পিয়ার রিভিউ তৈরি করার একটি পাইলট প্রোগ্রাম চালু করেছে, যা একটি প্রধান শিক্ষাগত কনফারেন্সে এআই-সক্ষম পিয়ার রিভিউয়ের প্রথম সম্পূর্ণ-স্কেল বাস্তবায়ন।
টুইস্ট: পাইলটের পরে পরিচালিত সমীক্ষায় দেখা গেল যে লেখক এবং প্রোগ্রাম কমিটির সদস্যদের মধ্যে বাস্তবে এআই-জেনারেটেড পর্যালোচনাগুলির পছন্দ বেশি। বিশেষভাবে, তারা এই পর্যালোচনাগুলিকে প্রযুক্তিগত সঠিকতা এবং গবেষণা প্রস্তাবের মানের ক্ষেত্রে মানব-প্রস্তুত পর্যালোচনাগুলির চেয়ে বেশি রেটিং দিয়েছিল।
ডাবল-ব্লাইন্ড এআই রিভিউ সিস্টেম কিভাবে কাজ করেছিল
প্রোগ্রামটি একটি ডাবল-ব্লাইন্ড কাঠামোর মধ্যে কাজ করেছিল, যার অর্থ লেখকদের কোনো কোনো পর্যালোচকদের পরিচয় জানা ছিল না। প্রতিটি পেপারের জন্য AI-জেনারেটেড পর্যালোচনাগুলি কমপক্ষে দুটি মানব পর্যালোচনার পাশাপাশি স্থান পেয়েছিল, যা গবেষকদের জন্য উভয় উৎসের প্রতি পক্ষপাতহীনভাবে মূল্যায়নের সুযোগ করে দিয়েছিল।
একটি গুরুত্বপূর্ণ ডিজাইন বাছাই: এআই পর্যালোচনাকারীদের পরিচয় এআই-জেনারেটেড হিসাবে চিহ্নিত করা হয়েছিল। এটি একটি টিউরিং পরীক্ষা ছিল না। লক্ষ্য ছিল মানব পর্যালোচনাকারীদের সম্পূরক করা, কোনোকেও এমন ভাবতে বাধ্য করা যে একটি ভাষা মডেল একজন স্থায়ী অধ্যাপক।
এআই পর্যালোচনাগুলি একটি বহু-পর্যায়ের এলএলএম-ভিত্তিক সিস্টেম ব্যবহার করে তৈরি করা হয়েছিল, যা একদিনের মধ্যে পেপারগুলি প্রক্রিয়া করতে পারে। অংশগ্রহণকারীরা এআই পর্যালোচনাগুলির সহায়ক প্রকৃতি উল্লেখ করেছেন এবং এগুলির মাধ্যমে সামগ্রিক পর্যালোচনা প্রক্রিয়াটি বৃদ্ধি পেয়েছে, এটিকে দুর্বল করেনি।
শুধু শিক্ষাগত প্রেক্ষাপটের বাইরে কেন এআই পিয়ার রিভিউ গুরুত্বপূর্ণ
স্ট্যানফোর্ড থেকে ২০২৩ সালের একটি অধ্যয়নে পাওয়া গেছে যে, শীর্ষ মেশিন লার্নিং কনফারেন্সগুলিতে এআই-তৈরি টেক্সট ইতিমধ্যেই পিয়ার রিভিউয়ের একটি পরিমাপযোগ্য অংশে দেখা গিয়েছে, যদিও সেই ক্ষেত্রে এটি ছিল রিভিউয়ারদের চুপচাপ ChatGPT ব্যবহার করে তাদের ফিডব্যাক তৈরি করা, একটি আনুমতিকৃত সিস্টেম নয়।
AAAI-26-এর পাইলট বিপরীত পদ্ধতি অনুসরণ করেছিল। এটি এই কথা ভান করেনি যে কৃত্রিম বুদ্ধিমত্তা এখনও ঘরে নেই, বরং এটি প্রক্রিয়াটিকে ঔপচারিক করেছিল, এর চারপাশে সীমানা নির্ধারণ করেছিল এবং ফলাফলগুলি পরীক্ষামূলকভাবে অধ্যয়ন করেছিল।
গবেষণার ফলাফলগুলি arXiv পেপার 2604.13940-এ দাখিল করা হয়েছে, এবং পূর্ণাঙ্গ ডেটাসেট এবং বিশ্লেষণের সার্বজনীন প্রকাশ আগস্ট 2026-এর জন্য নির্ধারিত।
এই পাইলটে প্রক্রিয়াকৃত 22,977টি পেপার একটি স্কেল নির্দেশ করে যা আগের কোনো AI-সহায়িত পিয়ার রিভিউ গবেষণা কখনোই অর্জন করেনি। পূর্ববর্তী কাজগুলি সিমুলেটেড পরিবেশে বা ছোট নমুনা আকারে পরিচালিত হয়েছিল, যার ফলে সাধারণীকরণযোগ্য উপসংহার টানা কঠিন হয়ে পড়েছিল।
