كُشفت نتائج المسابقة الدولية السادسة والسبعين للرياضيات (IMO 2026)، حيث حصل نموذج دوتس-نوت-3.0 من Xiaohongshu على ميدالية ذهبية بدرجة كاملة، حيث أجاب بشكل صحيح على جميع المسائل الست. هذه هي المرة الأولى التي يحصل فيها نموذج صيني على شهادة ذهبية رسمية من IMO، وهي أيضًا ثاني نموذج عالمي يحقق هذا الإنجاز بعد جيميني من جوجل — وبنفس الدرجة الكاملة، في حين أن جوجل سبق أن أجاب بشكل صحيح على 5 من 6 مسائل فقط. تُعد IMO معيارًا لاختبار الذكاء والقدرة الاستدلالية للنماذج الكبيرة، حيث يجب على المشاركين تقديم إثباتات منطقية كاملة، مما يجعلها صعبة للغاية. كان الحد الأدنى للحصول على الميدالية الذهبية هذا العام 29 درجة، وتفوق نموذج دوتس-نوت-3.0 هذا الحد بـ13 درجة. وقد وصف حاملو الميداليتين الذهبية من CMO حله بأنه "صحيح وأنيق، ذو بنية مكثفة ومنطق طبيعي". يُثبت هذا الأداء الكامل أن Xiaohongshu تمتلك الآن قدرة استدلالية عامة قابلة للنقل، مما يُظهر دخول لاعب جديد يستحق الملاحظة في مجال النماذج الأساسية.كاتب المقال، المصدر: Xiaohongshu
كُشفت نتائج المسابقة الدولية السادسة والسبعين للرياضيات (IMO2026) مؤخرًا، حيث فاز نموذج دوتس-نوت-3.0 من Xiaohongshu بميدالية ذهبية بدرجة كاملة، حيث أجاب بشكل صحيح على جميع الأسئلة الستة. هذا هو أول نموذج صيني يحصل على شهادة رسمية من IMO بمستوى الميدالية الذهبية، وهو ثاني نموذج عالميًا يحقق هذا الإنجاز بعد جوجل جيميني — وبدرجة كاملة، في حين أن جوجل سبق أن أجابت بشكل صحيح على 5 من 6 أسئلة.
IMO هي اختصار لمسابقة الرياضيات الدولية للطلاب، وتجتمع سنويًا أفضل الطلاب المراهقين من جميع أنحاء العالم، حيث خرج نصف الفائزين بجائزة فيلدز الحديثة، مثل تاو تشي شين، من هذه المسابقة. تُقام المسابقة على يومين، حيث يُطلب من المشاركين إكمال ثلاث مسائل خلال 4.5 ساعات كل يوم، وتغطي المسابقة أربعة مجالات: الجبر، التوافقيات، الهندسة ونظرية الأعداد، وكل مسألة تُقيّم بـ7 نقاط، بمجموع 42 نقطة. يجب على المشاركين تقديم إثباتات كاملة منطقيًا وقابلة للمراجعة التدريجية، وهو ما يمثل صعوبة كبيرة للنماذج الكبيرة.

يمكن اعتبار طريق جوجل جيميني إلى IMO مرجعاً: في التحدي الأول عام 2024، حصلت فقط على ميدالية فضية بدرجة 28، وكان يجب تحويل المسائل أولاً إلى لغات تشكيلية مثل Lean، حيث استغرقت بعض المسائل عدة أيام؛ وفي عام 2025، نجح Gemini Deep Think في إكمال الإثباتات من البداية إلى النهاية بلغة طبيعية، وحلّ خمس مسائل في غضون 4.5 ساعات للفوز بالميدالية الذهبية. تُعتبر مسابقات الرياضيات معياراً لذكاء النماذج الكبيرة وقدرتها على الاستدلال، وتمتاز IMO عن المعايير القياسية العادية بميزة فريدة — وهي عدم اليقين. يتم إعداد أسئلة كل دورة من قبل خبراء وسرّيتها بدقة، لذا لا يمكن للنماذج التدريب المسبق عليها، بل يجب الاعتماد فقط على الفهم الفوري والاستكشاف والاستدلال الدقيق.
خط الميدالية الذهبية في هذه الدورة من الأولمبياد الدولي للرياضيات هو 29 درجة، بانخفاض قدره 6 درجات مقارنة بـ 35 درجة في العام الماضي، مما يشير إلى أن صعوبة مجموعة الأسئلة كانت أعلى بكثير من العام الماضي. تعني 29 درجة حلًا كاملًا لأربع مسائل، مع الحصول على درجة واحدة من المسألتين المتبقيتين للدخول إلى نطاق الميدالية الذهبية، بينما أجاب النموذج الكبير من Xiaohongshu dots-note-3.0 على جميع الأسئلة بشكل صحيح، بفارق 13 درجة كاملة عن خط الميدالية الذهبية.
تحقيق درجة كاملة يثبت أولاً استقرار نظام الاستدلال Agentic. يجب على النموذج فهم الشروط بلغة طبيعية، وتحديد المعلومات الأساسية، وطرح استنتاجات وسيطة، وتنظيمها في إثبات كامل؛ وأي خطأ في فهم الشرط أو قفزة في الاستدلال سيتم تحديده مباشرة من قبل المُقيّم. إن حصول dots-note-3.0 على درجة كاملة بشكل متواصل في ست فئات مختلفة من الأسئلة يعني أن الأداء لا يعتمد على لحظة إلهام عرضية في سؤال معين. ثانياً، يعالج النموذج مباشرة بلغة طبيعية من البداية إلى النهاية، ويتمتع بحلقة مغلقة كاملة من فهم السؤال إلى التعبير عن الإجابة، مما يدل على امتلاكه لقدرة استدلالية عامة قابلة للنقل.

خلال عملية الإجابة، يستخدم dots-note-3.0 نهج الوكلاء، مدمجًا اللغة الطبيعية وتنفيذ كود Python للاستدلال وحل المسائل، مع الاستفادة من قدرته التكرارية على النقد الذاتي لمراجعة حججه. ما أثار الإعجاب حقًا هو السؤال الثالث — مسألة لعبة توليفية. الحل الشائع هو تحويل المسألة الأصلية إلى مشكلة اتصال في نظرية الرسوم البيانية ثم إقامة البرهان، بينما استخدم dots-note-3.0 الاستقراء، ملتقطًا البنية الأساسية للمسألة وتصميم كائن واستنتاج استقرائي مناسبين تمامًا.
قام ليو هانزuo، حامل الميدالية الذهبية في CMO، بتقييمه بأنه "صحيح وجميل، ذو بنية مكثفة ومنطق طبيعي، حتى أنه يُصنف من بين الحلول الأكثر إيجازًا وأناقة حتى في سياق حلول IMO". ورأى وانغ تشيانتونغ، حامل الميدالية الذهبية في CMO، أنه "موجز وواضح ويصل إلى جوهر المسألة، وكل خطوة منه منطقية بسلاسة، لكن من الصعب على المتنافسين البشريين التفكير في هذا المنظور".
بالنسبة لـ Xiaohongshu، فإن الحصول على الدرجة الكاملة في IMO كان ظهورًا تقنيًا مهمًا. في الماضي، كان التركيز الخارجي على تقنياتها يدور حول مجتمع المحتوى وخوارزميات التوصية وفهم المحتوى، ولم تكن هناك أدلة رسمية وموثوقة تُثبت موقعها في مجال النماذج الأساسية. لكن الحصول على الدرجة الكاملة في IMO يختلف—الدرجة 42 موجودة هناك، ولا تحتاج إلى شرح معقد، فهي تكفي لإثبات أن Xiaohongshu تمتلك الآن قدرات في النماذج الأساسية تستحق التقييم الجاد من قبل الصناعة، مما يضيف لاعبًا جديدًا يستحق الاهتمام في مجال النماذج الأساسية. وفقًا للمعلومات المتاحة، سيتم فتح مصدر dots-note-3.0 قريبًا.
