৬৭তম আন্তর্জাতিক গণিত অলিম্পিয়াড IMO2026-এর ফলাফল প্রকাশিত হয়েছে, যেখানে ছোট লাল বইয়ের বড় মডেল dots-note-3.0 ছয়টি প্রশ্নের সবগুলোর উত্তর সঠিকভাবে দিয়ে পূর্ণমান অর্জন করে স্বর্ণপদক জিতেছে। এটি চীনা বড় মডেলের পক্ষে IMO-এর অফিসিয়াল স্বর্ণপদক অর্জনের প্রথম ক্ষেত্র, এবং গুগল Gemini-এর পর এই ফলাফল অর্জনকারী বিশ্বের দ্বিতীয় বড় মডেল—এবং এটি পূর্ণমান, যখন গুগল আগে ৬-এর মধ্যে ৫টি প্রশ্নেরই উত্তর দিয়েছিল। IMO-কে বড় মডেলের বুদ্ধিমত্তা এবং যুক্তিসঙ্গত ক্ষমতার পরীক্ষার মাপকাঠি হিসাবে বিবেচনা করা হয়, যেখানে প্রতিযোগীদেরকে যুক্তিগতভাবে সম্পূর্ণ প্রমাণের প্রক্রিয়াটি লিখতে হয়, যা অত্যন্ত কঠিন। এইবারের স্বর্ণপদকের সীমা ২৯, dots-note-3.0 ১৩ পয়েন্টেরও বেশি উপরে। দুটি CMO-স্বর্ণপদকধারীদের মতে, “এটির সমাধানটি সঠিক এবং সুন্দর, গঠনটি ঘনীভূত, যুক্তি সহজ।” এই পূর্ণমানটি প্রমাণ করেছে যে Xiao Hong Shu-এর কাছে স্থানান্তরযোগ্য, সাধারণযুক্তির (general reasoning) ক্ষমতা রয়েছে, এবং বেসিক মডেলের ক্ষেত্রে একটি উল্লেখযোগ্য নতুনখেলোয়াড়ের উদয়।লেখক এবং উৎস: শাওয়েনশু
৬৭তম আন্তর্জাতিক গণিত অলিম্পিয়াড (IMO2026) এর ফলাফল সাম্প্রতিক সময়ে প্রকাশিত হয়েছে, যেখানে ছোট লাল বইয়ের বড় মডেল dots-note-3.0 ছয়টি প্রশ্নের সমস্তই সঠিকভাবে উত্তর দিয়ে পূর্ণমান অর্জন করে স্বর্ণপদক অর্জন করেছে। এটি চীনা মডেলের পক্ষে IMO-এর অফিসিয়াল স্বর্ণপদক স্তরের স্বীকৃতি অর্জনের প্রথম ক্ষেত্র, এবং গুগল Gemini-এর পর এই স্তরের পূর্ণমান অর্জনকারী বিশ্বের দ্বিতীয় মডেল—এবং এটি পূর্ণমান, যখন গুগল আগে ৬-এর মধ্যে ৫টি প্রশ্নেরই উত্তর দিয়েছিল।
IMO হল ইন্টারন্যাশনাল ম্যাথমেটিক্স অলিম্পিয়াডের সংক্ষিপ্ত রূপ, যা প্রতি বছর বিশ্বের শীর্ষস্থানীয় মধ্যম বিদ্যালয়ের ছাত্রদের একত্রিত করে; টেরেন্স টাও সহ আধুনিক ফিল্ডস পুরস্কার বিজয়ীদের অর্ধেকই এই প্রতিযোগিতা থেকে এসেছেন। প্রতিযোগিতাটি দুই দিনে বিভক্ত, প্রতিদিন 4.5 ঘন্টা সময়ে 3টি প্রশ্ন সমাধান করতে হয়, যা বীজগণিত, সংযোজন, জ্যামিতি এবং সংখ্যাতত্ত্ব—চারটি দিককে কভার করে, প্রতিটি প্রশ্নের জন্য 7 পয়েন্ট, মোট 42 পয়েন্ট। প্রতিযোগীদেরকে যুক্তিসঙ্গত, ধাপে ধাপে পরীক্ষা-নিরীক্ষা করা যায় এমন প্রমাণগুলি লিখতে হয়, যা বড় মডেলগুলির জন্য অত্যন্ত কঠিন।

গুগল জেমিনির IMO পথ একটি রেফারেন্স হিসেবে বিবেচনা করা যেতে পারে: 2024 সালে প্রথম চ্যালেঞ্জে শুধুমাত্র 28 পয়েন্টের রৌপ্যপদক অর্জন করেছিল এবং প্রশ্নগুলিকে প্রথমে Lean ইত্যাদি ফর্মাল ভাষায় অনুবাদ করতে হয়েছিল, কিছু প্রশ্নের জন্য কয়েকদিন সময় লেগেছিল; 2025 সালে, Gemini Deep Think প্রাকৃতিক ভাষায় এন্ড-টু-এন্ড প্রমাণ সম্পন্ন করে 4.5 ঘন্টার মধ্যে 5টি প্রশ্ন সমাধান করে সোনার পদক অর্জন করেছে। গণিতের প্রতিযোগিতা বড় মডেলের বুদ্ধিমত্তা এবং যুক্তিবিদ্যার পরীক্ষার মাপকাঠি হিসেবে বিবেচিত, এবং IMO-এর সাধারণ Benchmark-এর চেয়ে একটি অনন্য সুবিধা রয়েছে—অজানা। প্রতিবছরের প্রশ্নগুলি বিশেষজ্ঞদের দ্বারা তৈরি করা হয় এবং কঠোরভাবে গোপনীয়তা বজায় রাখা হয়, যাতে মডেলটি আগেথেকেই লক্ষ্যযুক্তভাবে প্রশিক্ষণ নিতে না পারে, এবং এটির জন্যশুধুমাত্র বাস্তবসময়ের বোঝা, অনুসন্ধান এবং কঠোর যুক্তিবিদ্যা-এরউপরই নির্ভরশীল।
এই বছরের IMO-এর স্বর্ণপদকের কাটঅফ স্কোর 29 পয়েন্ট, যা গত বছরের 35 পয়েন্ট থেকে 6 পয়েন্ট কম। সম্পূর্ণ প্রশ্নপত্রটির স্কোরিং কঠিনতা গত বছরের তুলনায় প্রায় অনেক বেশি। 29 পয়েন্ট মানে চারটি প্রশ্ন সম্পূর্ণভাবে সমাধান করে বাকি দুটি প্রশ্ন থেকে একটিতে 1 পয়েন্ট পাওয়াই স্বর্ণপদকের পরিসরে প্রবেশ করার জন্য যথেষ্ট, কিন্তু Xiao Hong Shu-এর বড় মডেল dots-note-3.0 সমস্ত প্রশ্নের উত্তর সঠিকভাবে দিয়েছে, যা স্বর্ণপদকের কাটঅফের চেয়ে 13 পয়েন্ট বেশি।
পূর্ণ নম্বর প্রথমত প্রমাণ করে যে Agentic যুক্তি সিস্টেমটি স্থিতিশীল। মডেলটিকে প্রাকৃতিক ভাষার শর্তগুলি বুঝতে হবে, গুরুত্বপূর্ণ তথ্য চিহ্নিত করতে হবে, মধ্যবর্তী উপসংহার প্রস্তুত করতে হবে এবং এগুলিকে একটি সম্পূর্ণ প্রমাণের মধ্যে সাজাতে হবে; যেকোনো শর্তের ভুল বোঝাবুঝি বা যুক্তির ধাপ লাফানোকে রিভিউয়াররা সরাসরি উল্লেখ করবেন। dots-note-3.0 ছয়টি ভিন্ন ধরনের প্রশ্নে ক্রমাগত পূর্ণনম্বর পাওয়ার মানে এটি কোনো একটি প্রশ্নের দৈব অনুপ্রেরণার উপর নির্ভরশীল নয়। দ্বিতীয়ত, মডেলটি সরাসরি প্রাকৃতিক ভাষায় এন্ড-টু-এন্ডভাবে প্রক্রিয়াকরণ করে, যা প্রশ্নের বোঝাবুঝি থেকে উত্তরের প্রকাশের পূর্ণচক্রকে নির্দেশ করে, যা এটির স্থানান্তরযোগ্য সাধারণ যুক্তি ক্ষমতা রয়েছে বলেই ইঙ্গিত করে।

নির্দিষ্ট উত্তর প্রক্রিয়ায়, dots-note-3.0 একটি বুদ্ধিমান এজেন্টের মতো কাজ করে, প্রাকৃতিক ভাষা এবং Python কোড বাস্তবায়নের মাধ্যমে যুক্তি প্রয়োগ করে এবং নিজের যুক্তির সমালোচনা করার জন্য পুনরাবৃত্তিমূলক আত্ম-সমালোচনার ক্ষমতা ব্যবহার করে। সত্যিই আশ্চর্যজনক হলো তৃতীয় প্রশ্ন—একটি সংমিশ্রণগত খেলা সমস্যা। সাধারণত এই সমস্যাটির সমাধান হলো মূল সমস্যাটিকে গ্রাফ তত্ত্বের সংযুক্ততা সমস্যায় রূপান্তরিত করে প্রমাণ করা, কিন্তু dots-note-3.0 পদ্ধতিটি পরিবর্তন করে আরোহী পদ্ধতি ব্যবহার করে, সমস্যাটির সবচেয়ে মৌলিক কাঠামোটি ধরে রেখেছে এবং উপযুক্ত আরোহী বস্তু এবং প্রস্তাবনা ডিজাইন করেছে।
সিএমও স্বর্ণপদক বিজয়ী লিউ হানজুয়ে এটিকে "সঠিক এবং সুন্দর, কাঠামোগতভাবে ঘনীভূত এবং যুক্তিসঙ্গত" বলে মন্তব্য করেন, যা IMO সমাধানের মধ্যেও অপেক্ষাকৃত সরল ও সুন্দর হিসাবে বিবেচিত হবে। সিএমও স্বর্ণপদক বিজয়ী ওয়াং চিয়ানটং এটিকে "সরল, স্পষ্ট এবং মূল বিষয়ের দিকে সরাসরি নির্দেশ করে, প্রতিটি ধাপই যুক্তিসঙ্গত, কিন্তু মানবিক প্রতিযোগীদের জন্য এই দৃষ্টিকোণ থেকে শুরু করা কঠিন" বলে মন্তব্য করেন।
ছোট হার্টের জন্য, IMO-এ পূর্ণ মার্ক একটি গুরুত্বপূর্ণ প্রযুক্তিগত উপস্থিতি। অতীতে বাইরের লোকেরা তাদের প্রযুক্তি সম্পর্কে কনটেন্ট কমিউনিটি, রিকমেন্ডেশন অ্যালগরিদম এবং কনটেন্ট বোঝার উপর ফোকাস করত, যেখানে বেসিক মডেল ক্ষেত্রে তাদের অবস্থানের জন্য কোনো প্রকাশিত, বিশ্বস্ত প্রমাণ ছিল না। IMO-এর পূর্ণ মার্ক ভিন্ন—42 মার্কটি সরাসরি রয়েছে, জটিল ব্যাখ্যার প্রয়োজন নেই, যা প্রমাণ করে যে ছোট হার্টের কাছে শিল্পের গুরুত্বপূর্ণভাবে পর্যালোচনার যোগ্য বেসিক মডেল দক্ষতা রয়েছে, এবং বেসিক মডেল ক্ষেত্রে একটি মনোযোগযোগ্য নতুন খেলোয়াড় উঠেছে। জানা যাচ্ছে, dots-note-3.0-এর ওপেন-সোর্সিংয়ের পরিকল্পনা।
