Xiaohongshu-এর Dots-Note-3.0 IMO 2026-এ পারফেক্ট স্কোর অর্জন করেছে

iconMetaEra
শেয়ার
AI summary iconসারাংশ
৬৭তম আন্তর্জাতিক গণিত অলিম্পিয়াড (IMO 2026)-এ শিয়াওহংশুর ডটস-নোট-3.0 পারফেক্ট ৪২/৪২ স্কোর করে স্বর্ণপদক অর্জন করে। চীনা বড় মডেলের মধ্যে এটি প্রথমবারের মতো আনুষ্ঠানিক IMO স্বর্ণ-স্তরের সার্টিফিকেশন অর্জন করেছে এবং গুগলের জেমিনির পর বিশ্বে দ্বিতীয়। মডেলটি ছয়টি সমস্যার সমাধান করেছে, পুরোপুরি যুক্তিসঙ্গত প্রমাণসহ, যা তৃতীয় সমস্যার জন্য এর মনোনীত সমাধানের জন্য বিশেষজ্ঞদের মনোযোগ আকর্ষণ করেছে। CFT-এর নিয়মকানুন কঠোর হওয়ায়, ক্রিপ্টো বাজারে তরলতা প্রতিষ্ঠানগুলির জন্য একটি প্রধান ফোকাস হয়ে রয়েছে।
৬৭তম আন্তর্জাতিক গণিত অলিম্পিয়াড IMO2026-এর ফলাফল প্রকাশিত হয়েছে, যেখানে ছোট লাল বইয়ের বড় মডেল dots-note-3.0 ছয়টি প্রশ্নের সবগুলোর উত্তর সঠিকভাবে দিয়ে পূর্ণমান অর্জন করে স্বর্ণপদক জিতেছে। এটি চীনা বড় মডেলের পক্ষে IMO-এর অফিসিয়াল স্বর্ণপদক অর্জনের প্রথম ক্ষেত্র, এবং গুগল Gemini-এর পর এই ফলাফল অর্জনকারী বিশ্বের দ্বিতীয় বড় মডেল—এবং এটি পূর্ণমান, যখন গুগল আগে ৬-এর মধ্যে ৫টি প্রশ্নেরই উত্তর দিয়েছিল। IMO-কে বড় মডেলের বুদ্ধিমত্তা এবং যুক্তিসঙ্গত ক্ষমতার পরীক্ষার মাপকাঠি হিসাবে বিবেচনা করা হয়, যেখানে প্রতিযোগীদেরকে যুক্তিগতভাবে সম্পূর্ণ প্রমাণের প্রক্রিয়াটি লিখতে হয়, যা অত্যন্ত কঠিন। এইবারের স্বর্ণপদকের সীমা ২৯, dots-note-3.0 ১৩ পয়েন্টেরও বেশি উপরে। দুটি CMO-স্বর্ণপদকধারীদের মতে, “এটির সমাধানটি সঠিক এবং সুন্দর, গঠনটি ঘনীভূত, যুক্তি সহজ।” এই পূর্ণমানটি প্রমাণ করেছে যে Xiao Hong Shu-এর কাছে স্থানান্তরযোগ্য, সাধারণযুক্তির (general reasoning) ক্ষমতা রয়েছে, এবং বেসিক মডেলের ক্ষেত্রে একটি উল্লেখযোগ্য নতুনখেলোয়াড়ের উদয়।

লেখক এবং উৎস: শাওয়েনশু

৬৭তম আন্তর্জাতিক গণিত অলিম্পিয়াড (IMO2026) এর ফলাফল সাম্প্রতিক সময়ে প্রকাশিত হয়েছে, যেখানে ছোট লাল বইয়ের বড় মডেল dots-note-3.0 ছয়টি প্রশ্নের সমস্তই সঠিকভাবে উত্তর দিয়ে পূর্ণমান অর্জন করে স্বর্ণপদক অর্জন করেছে। এটি চীনা মডেলের পক্ষে IMO-এর অফিসিয়াল স্বর্ণপদক স্তরের স্বীকৃতি অর্জনের প্রথম ক্ষেত্র, এবং গুগল Gemini-এর পর এই স্তরের পূর্ণমান অর্জনকারী বিশ্বের দ্বিতীয় মডেল—এবং এটি পূর্ণমান, যখন গুগল আগে ৬-এর মধ্যে ৫টি প্রশ্নেরই উত্তর দিয়েছিল।

IMO হল ইন্টারন্যাশনাল ম্যাথমেটিক্স অলিম্পিয়াডের সংক্ষিপ্ত রূপ, যা প্রতি বছর বিশ্বের শীর্ষস্থানীয় মধ্যম বিদ্যালয়ের ছাত্রদের একত্রিত করে; টেরেন্স টাও সহ আধুনিক ফিল্ডস পুরস্কার বিজয়ীদের অর্ধেকই এই প্রতিযোগিতা থেকে এসেছেন। প্রতিযোগিতাটি দুই দিনে বিভক্ত, প্রতিদিন 4.5 ঘন্টা সময়ে 3টি প্রশ্ন সমাধান করতে হয়, যা বীজগণিত, সংযোজন, জ্যামিতি এবং সংখ্যাতত্ত্ব—চারটি দিককে কভার করে, প্রতিটি প্রশ্নের জন্য 7 পয়েন্ট, মোট 42 পয়েন্ট। প্রতিযোগীদেরকে যুক্তিসঙ্গত, ধাপে ধাপে পরীক্ষা-নিরীক্ষা করা যায় এমন প্রমাণগুলি লিখতে হয়, যা বড় মডেলগুলির জন্য অত্যন্ত কঠিন।

image.png

গুগল জেমিনির IMO পথ একটি রেফারেন্স হিসেবে বিবেচনা করা যেতে পারে: 2024 সালে প্রথম চ্যালেঞ্জে শুধুমাত্র 28 পয়েন্টের রৌপ্যপদক অর্জন করেছিল এবং প্রশ্নগুলিকে প্রথমে Lean ইত্যাদি ফর্মাল ভাষায় অনুবাদ করতে হয়েছিল, কিছু প্রশ্নের জন্য কয়েকদিন সময় লেগেছিল; 2025 সালে, Gemini Deep Think প্রাকৃতিক ভাষায় এন্ড-টু-এন্ড প্রমাণ সম্পন্ন করে 4.5 ঘন্টার মধ্যে 5টি প্রশ্ন সমাধান করে সোনার পদক অর্জন করেছে। গণিতের প্রতিযোগিতা বড় মডেলের বুদ্ধিমত্তা এবং যুক্তিবিদ্যার পরীক্ষার মাপকাঠি হিসেবে বিবেচিত, এবং IMO-এর সাধারণ Benchmark-এর চেয়ে একটি অনন্য সুবিধা রয়েছে—অজানা। প্রতিবছরের প্রশ্নগুলি বিশেষজ্ঞদের দ্বারা তৈরি করা হয় এবং কঠোরভাবে গোপনীয়তা বজায় রাখা হয়, যাতে মডেলটি আগেথেকেই লক্ষ্যযুক্তভাবে প্রশিক্ষণ নিতে না পারে, এবং এটির জন্যশুধুমাত্র বাস্তবসময়ের বোঝা, অনুসন্ধান এবং কঠোর যুক্তিবিদ্যা-এরউপরই নির্ভরশীল।

এই বছরের IMO-এর স্বর্ণপদকের কাটঅফ স্কোর 29 পয়েন্ট, যা গত বছরের 35 পয়েন্ট থেকে 6 পয়েন্ট কম। সম্পূর্ণ প্রশ্নপত্রটির স্কোরিং কঠিনতা গত বছরের তুলনায় প্রায় অনেক বেশি। 29 পয়েন্ট মানে চারটি প্রশ্ন সম্পূর্ণভাবে সমাধান করে বাকি দুটি প্রশ্ন থেকে একটিতে 1 পয়েন্ট পাওয়াই স্বর্ণপদকের পরিসরে প্রবেশ করার জন্য যথেষ্ট, কিন্তু Xiao Hong Shu-এর বড় মডেল dots-note-3.0 সমস্ত প্রশ্নের উত্তর সঠিকভাবে দিয়েছে, যা স্বর্ণপদকের কাটঅফের চেয়ে 13 পয়েন্ট বেশি।

পূর্ণ নম্বর প্রথমত প্রমাণ করে যে Agentic যুক্তি সিস্টেমটি স্থিতিশীল। মডেলটিকে প্রাকৃতিক ভাষার শর্তগুলি বুঝতে হবে, গুরুত্বপূর্ণ তথ্য চিহ্নিত করতে হবে, মধ্যবর্তী উপসংহার প্রস্তুত করতে হবে এবং এগুলিকে একটি সম্পূর্ণ প্রমাণের মধ্যে সাজাতে হবে; যেকোনো শর্তের ভুল বোঝাবুঝি বা যুক্তির ধাপ লাফানোকে রিভিউয়াররা সরাসরি উল্লেখ করবেন। dots-note-3.0 ছয়টি ভিন্ন ধরনের প্রশ্নে ক্রমাগত পূর্ণনম্বর পাওয়ার মানে এটি কোনো একটি প্রশ্নের দৈব অনুপ্রেরণার উপর নির্ভরশীল নয়। দ্বিতীয়ত, মডেলটি সরাসরি প্রাকৃতিক ভাষায় এন্ড-টু-এন্ডভাবে প্রক্রিয়াকরণ করে, যা প্রশ্নের বোঝাবুঝি থেকে উত্তরের প্রকাশের পূর্ণচক্রকে নির্দেশ করে, যা এটির স্থানান্তরযোগ্য সাধারণ যুক্তি ক্ষমতা রয়েছে বলেই ইঙ্গিত করে।

image.png

নির্দিষ্ট উত্তর প্রক্রিয়ায়, dots-note-3.0 একটি বুদ্ধিমান এজেন্টের মতো কাজ করে, প্রাকৃতিক ভাষা এবং Python কোড বাস্তবায়নের মাধ্যমে যুক্তি প্রয়োগ করে এবং নিজের যুক্তির সমালোচনা করার জন্য পুনরাবৃত্তিমূলক আত্ম-সমালোচনার ক্ষমতা ব্যবহার করে। সত্যিই আশ্চর্যজনক হলো তৃতীয় প্রশ্ন—একটি সংমিশ্রণগত খেলা সমস্যা। সাধারণত এই সমস্যাটির সমাধান হলো মূল সমস্যাটিকে গ্রাফ তত্ত্বের সংযুক্ততা সমস্যায় রূপান্তরিত করে প্রমাণ করা, কিন্তু dots-note-3.0 পদ্ধতিটি পরিবর্তন করে আরোহী পদ্ধতি ব্যবহার করে, সমস্যাটির সবচেয়ে মৌলিক কাঠামোটি ধরে রেখেছে এবং উপযুক্ত আরোহী বস্তু এবং প্রস্তাবনা ডিজাইন করেছে।

সিএমও স্বর্ণপদক বিজয়ী লিউ হানজুয়ে এটিকে "সঠিক এবং সুন্দর, কাঠামোগতভাবে ঘনীভূত এবং যুক্তিসঙ্গত" বলে মন্তব্য করেন, যা IMO সমাধানের মধ্যেও অপেক্ষাকৃত সরল ও সুন্দর হিসাবে বিবেচিত হবে। সিএমও স্বর্ণপদক বিজয়ী ওয়াং চিয়ানটং এটিকে "সরল, স্পষ্ট এবং মূল বিষয়ের দিকে সরাসরি নির্দেশ করে, প্রতিটি ধাপই যুক্তিসঙ্গত, কিন্তু মানবিক প্রতিযোগীদের জন্য এই দৃষ্টিকোণ থেকে শুরু করা কঠিন" বলে মন্তব্য করেন।

ছোট হার্টের জন্য, IMO-এ পূর্ণ মার্ক একটি গুরুত্বপূর্ণ প্রযুক্তিগত উপস্থিতি। অতীতে বাইরের লোকেরা তাদের প্রযুক্তি সম্পর্কে কনটেন্ট কমিউনিটি, রিকমেন্ডেশন অ্যালগরিদম এবং কনটেন্ট বোঝার উপর ফোকাস করত, যেখানে বেসিক মডেল ক্ষেত্রে তাদের অবস্থানের জন্য কোনো প্রকাশিত, বিশ্বস্ত প্রমাণ ছিল না। IMO-এর পূর্ণ মার্ক ভিন্ন—42 মার্কটি সরাসরি রয়েছে, জটিল ব্যাখ্যার প্রয়োজন নেই, যা প্রমাণ করে যে ছোট হার্টের কাছে শিল্পের গুরুত্বপূর্ণভাবে পর্যালোচনার যোগ্য বেসিক মডেল দক্ষতা রয়েছে, এবং বেসিক মডেল ক্ষেত্রে একটি মনোযোগযোগ্য নতুন খেলোয়াড় উঠেছে। জানা যাচ্ছে, dots-note-3.0-এর ওপেন-সোর্সিংয়ের পরিকল্পনা।

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।