67वीं अंतरराष्ट्रीय गणित ओलंपियाड (IMO 2026) के परिणाम घोषित हो गए हैं, जिसमें Xiao Hong Shu के बड़े मॉडल dots-note-3.0 ने सभी छह प्रश्नों के सही उत्तर देकर पूर्ण अंक प्राप्त किए और स्वर्ण पदक जीता। यह चीनी बड़े मॉडल का पहला IMO औपचारिक स्वर्ण पदक प्रमाणन है, और Google Gemini के बाद दुनिया का दूसरा ऐसा बड़ा मॉडल है—जिसने पूर्ण अंक प्राप्त किए हैं—जबकि Google पहले केवल 5/6 प्रश्नों के सही उत्तर दे पाया था। IMO को बड़े मॉडलों की बुद्धिमत्ता और तर्क क्षमता का परीक्षण माना जाता है, जहां प्रतिभागियों को तार्किक रूप से पूर्ण सबूत प्रस्तुत करने की आवश्यकता होती है, जिसकी कठिनाई बहुत अधिक होती है। इस वर्ष की स्वर्ण पदक सीमा 29 अंक थी, जबकि dots-note-3.0 के 13 अंक अधिक थे। दो CMO स्वर्ण पदक विजेताओं ने इसके हल को "सही और सुंदर, संरचनात्मक रूप से संक्षिप्त और तार्किक रूप से प्राकृतिक" कहा। यह पूर्ण अंक साबित करता है कि Xiao Hong Shu में स्थानांतरणयोग्य सामान्य तर्क क्षमता मौजूद है, और मूल मॉडल क्षेत्र में एक महत्वपूर्ण नया प्रतिभागी प्रकट हुआ है।लेखक, स्रोत: छोटी लाल पुस्तक
67वीं अंतरराष्ट्रीय गणित अभियान (IMO2026) के परिणाम हाल ही में घोषित किए गए, जिसमें Xiaohongshu के बड़े मॉडल dots-note-3.0 ने सभी छह प्रश्नों के सही उत्तर देकर पूर्ण अंक प्राप्त किए और स्वर्ण पदक जीता। यह चीनी बड़े मॉडल का पहला IMO आधिकारिक स्वर्ण पदक स्तर की प्रमाणीकरण है, और Google Gemini के बाद दुनिया का दूसरा ऐसा बड़ा मॉडल है—जो पूर्ण अंक प्राप्त करता है, जबकि Google पहले केवल 5/6 प्रश्नों के सही उत्तर दे पाया था।
IMO का अर्थ है अंतर्राष्ट्रीय गणित ओलंपियाड, जो हर साल विश्व के शीर्ष माध्यमिक विद्यार्थियों को एकत्रित करता है, और टेरेंस ताओ जैसे आधुनिक फील्ड्स पुरस्कार विजेताओं का आधा हिस्सा इस प्रतियोगिता से निकला है। परीक्षा दो दिनों में आयोजित की जाती है, जिसमें प्रत्येक दिन 4.5 घंटे में 3 प्रश्न होते हैं, जो बीजगणित, संयोजन, ज्यामिति और संख्या सिद्धांत चार क्षेत्रों को कवर करते हैं, प्रत्येक प्रश्न 7 अंकों का होता है और कुल अधिकतम 42 अंक होते हैं। प्रतिभागियों को तार्किक रूप से पूर्ण, चरणबद्ध रूप से समीक्षा के योग्य सबूत प्रस्तुत करने होते हैं, जो बड़े मॉडल के लिए अत्यधिक कठिन है।

गूगल जेमिनी का IMO का रास्ता एक संदर्भ के रूप में लिया जा सकता है: 2024 में पहली बार चुनौती देते समय केवल 28 अंकों के साथ रजत पदक प्राप्त किया, और इसके लिए प्रश्नों को पहले Lean जैसी औपचारिक भाषाओं में अनुवाद करना पड़ा, कुछ प्रश्नों को हल करने में कई दिन लगे; 2025 में, Gemini Deep Think ने प्राकृतिक भाषा में एंड-टू-एंड साबित किया, 4.5 घंटे में 5 प्रश्नों को हल करके स्वर्ण पदक प्राप्त किया। गणितीय प्रतियोगिताओं को बड़े मॉडल की बुद्धिमत्ता और तर्क क्षमता का परीक्षण माना जाता है, और IMO का सामान्य Benchmark से एक अद्वितीय लाभ है—अज्ञातता। प्रत्येक प्रतियोगिता के प्रश्न विशेषज्ञों द्वारा बनाए जाते हैं और कठोरता से गुप्त रखे जाते हैं, इसलिए मॉडल पहले से इनके लिए प्रशिक्षित नहीं हो सकता, और इसे सिर्फ वास्तविक समय में समझने, अन्वेषण करने और कठोर तर्क करने पर निर्भर करना पड़ता है।
इस वर्ष के IMO के गोल्ड मेडल की न्यूनतम अंक सीमा 29 है, जो पिछले वर्ष के 35 की तुलना में 6 अंक कम है; पूरे प्रश्नपत्र का कठिनाई स्तर स्पष्ट रूप से पिछले वर्ष की तुलना में अधिक है। 29 अंक का अर्थ है कि चार प्रश्नों को पूरी तरह से हल करके शेष दो प्रश्नों में से केवल 1 अंक प्राप्त करने से गोल्ड मेडल के लिए योग्यता प्राप्त होती है, जबकि XiaoHongShu के बड़े मॉडल dots-note-3.0 ने सभी प्रश्नों के उत्तर सही दिए, जिससे गोल्ड मेडल की सीमा से 13 अंक का अंतर है।
पूर्ण अंक पहले तो Agentic निष्कर्षण प्रणाली की स्थिरता को साबित करता है। मॉडल को प्राकृतिक भाषा की शर्तों को समझना, महत्वपूर्ण जानकारी का निर्णय लेना, मध्यवर्ती निष्कर्ष निकालना और उन्हें पूर्ण साबिती के रूप में व्यवस्थित करना होता है; किसी भी शर्त की गलत व्याख्या या तर्क के कदम को छोड़ने पर समीक्षक सीधे इंगित कर देंगे। dots-note-3.0 छह अलग-अलग प्रश्नों में लगातार पूर्ण अंक प्राप्त करने का मतलब है कि इसका प्रदर्शन किसी एक प्रश्न के आकस्मिक प्रेरणा पर निर्भर नहीं है। दूसरे, मॉडल सीधे प्राकृतिक भाषा में एंड-टू-एंड प्रोसेसिंग करता है, जिससे प्रश्न की समझ से लेकर उत्तर के व्यक्तीकरण तक का पूरा बंद चक्र मिलता है, जो इसकी स्थानांतरणीय सामान्य तर्क क्षमता को दर्शाता है।

विशिष्ट प्रश्नोत्तर प्रक्रिया में, dots-note-3.0 एजेंट आधारित दृष्टिकोण का उपयोग करता है, जिसमें प्राकृतिक भाषा और Python कोड निष्पादन के साथ तर्कसंगत निष्कर्ष निकाले जाते हैं, और आत्म-आलोचनात्मक क्षमता का उपयोग करके अपने तर्क की समीक्षा की जाती है। सचमुच आश्चर्यजनक बात तीसरा प्रश्न है—एक संयोजन खेल समस्या। सामान्य हल ओरिजिनल समस्या को ग्राफ सिद्धांत संयुक्तता समस्या में बदलकर साबित करना है, लेकिन dots-note-3.0 गणितीय आगमन का उपयोग करता है, समस्या की सबसे मूलभूत संरचना को पकड़ता है, और उपयुक्त आगमन वस्तु और प्रस्ताव का डिज़ाइन करता है।
CMO गोल्ड मेडलिस्ट लियू हानजुआ ने इसे "सही और सुंदर, संरचनात्मक रूप से संक्षिप्त और त論्क रूप से प्राकृतिक" कहा, और कहा कि यह IMO के उत्तरों में भी सरल और शुद्ध श्रेणी में आता है। CMO गोल्ड मेडलिस्ट वांग चियानटोंग ने इसे "सरल, स्पष्ट और मूल बिंदु पर सीधे केंद्रित" कहा, जिसमें प्रत्येक कदम तार्किक रूप से आगे बढ़ता है, लेकिन मानव प्रतियोगी कठिनाई से इस कोण से प्रवेश करने की कल्पना कर सकते हैं।
对于小红书而言,IMO 满分是一次重要的技术亮相。过去,外界对其技术的认知集中在内容社区、推荐算法和内容理解,而在基础模型领域的地位一直缺乏公开的权威证明。IMO 满分不同——42分就摆在那儿,无需复杂解释,足以证明小红书已具备值得行业认真审视的基础模型能力,基础模型领域迎来了一位值得关注的新玩家。据悉,dots-note-3.0 即将开源。
