Ipinahayag ang mga resulta ng 67th International Mathematical Olympiad (IMO) 2026, kung saan ang dots-note-3.0 na malaking modelo ng Xiaohongshu ay nakuha ang ginto sa pamamagitan ng perfect na score na 6/6 sa lahat ng mga tanong. Ito ang unang pagkakataon na isang malaking modelo ng Tsina ay nakakuha ng opisyal na ginto sa IMO, at ikalawang malaking modelo sa buong mundo na nakamit ang ganitong resulta pagkatapos ng Google Gemini—at ito ay perfect na score, habang ang Google ay nakasagot lamang ng 5/6 na tanong. Ang IMO ay itinuturing na pagsusulit sa intelektuwal at pag-iisip ng mga malaking modelo, kung saan ang mga kalahok ay kailangang isulat ang buong lohikal na patunay, na sobrang hirap. Ang porsyento para sa ginto sa taong ito ay 29 puntos, samantalang ang dots-note-3.0 ay naiiba ng 13 puntos mula dito. Ang mga dalawang ginto sa CMO ay nag-evaluate na ang kanilang solusyon ay "tama at maganda, may maayos na istruktura at natural na lohika." Ang perfect na score na ito ay patotoo na ang Xiaohongshu ay may kakayahang mag-transfer ng pangkalahatang pag-iisip, at may bagong manlalaro na dapat tandaan sa larangan ng base model.May-akda ng artikulo, pinagkunan: Xiaohongshu
Kasalukuyang ipinahayag ang mga resulta ng 67th International Mathematical Olympiad (IMO2026), kung saan ang dots-note-3.0 na malaking modelo ni Xiaohongshu ay nakakuha ng ginto sa perfektong skor ng tamang sagot sa lahat ng anim na tanong. Ito ang unang pagkakataon na isang malaking modelo ng Tsina ay nakakamit ang opisyal na sertipikasyon ng IMO sa antas ng ginto, at ikalawang malaking modelo sa buong mundo na nakamit ang ganitong resulta pagkatapos ng Google Gemini—at may perfektong skor, habang ang Google ay nakasagot lamang ng 5/6 na tanong.
Ang IMO ay ang maikling pangalan ng International Mathematical Olympiad, na kada taon ay nagpupulong ng mga pinakamahusay na mag-aaral sa gitnang-paaralan, kung saan ang kalahati ng mga kasalukuyang nagwagi ng Fields Medal tulad ni Terence Tao ay nagmula sa kompetisyon na ito. Ang pagsusulit ay ginagawa sa loob ng dalawang araw, kung saan sa bawat araw ay may 4.5 oras upang matapos ang tatlong tanong, na sumasaklaw sa alhebra, kombinatorika, heometriya, at teorya ng bilang, na may 7 puntos bawat tanong, na may kabuuang 42 puntos. Dapat ng mga kalahok na isulat ang mga patunay na may buong lohika at maaaring masuri nang hakbang-hakbang, na isang malaking hamon para sa mga malalaking modelo.

Ang paglalakbay ni Google Gemini sa IMO ay maaaring maging gabay: noong 2024, sa kanyang unang pagsubok, nakakuha lang siya ng 28 puntos at bakal na medalya, at kailangan muna niyang isalin ang mga tanong sa mga pormalisadong wika tulad ng Lean, na kung saan ang ilang mga tanong ay nagsasagawa ng ilang araw; noong 2025, ang Gemini Deep Think ay nakakumpleto ng patunay nang end-to-end gamit ang natural na wika, at nakakasolve ng 5 tanong sa loob ng 4.5 oras upang makakuha ng ginto. Ang mga kompetisyon sa matematika ay itinuturing na pagsusulit sa intelektuwal na kakayahan at pag-iisip ng malalaking modelo, at may isang natatanging kahusayan ang IMO kumpara sa karaniwang benchmark—ang kawalan ng kaalaman. Ang bawat set ng tanong ay nililikha ng mga eksperto at napapalibutan ng mahigpit na lihim, kaya hindi makapag-train ang modelo nang pasadya; kailangan lamang itong magandang basahin, mag-explor, at magbigay ng mahigpit na pag-iisip sa real-time.
Ang cutoff para sa ginto sa kasalukuyang IMO ay 29 puntos, bumaba ng 6 puntos kumpara sa 35 puntos noong nakaraan, at mas malaki ang antas ng hirap ng buong set ng mga tanong kumpara sa nakaraan. Ang 29 puntos ay nangangahulugan na kailangan mong sagutin nang tama ang apat na tanong at makakuha ng 1 punto mula sa natitirang dalawa upang makapasok sa antas ng ginto, habang ang buong modelong malaki ng Xiaohongshu, dots-note-3.0, ay sumagot nang tama sa lahat, at may 13 puntos ang kalayuan nito mula sa cutoff para sa ginto.
Ang perfektong skor ay una nang patotoo sa katatagan ng Agentic reasoning system. Kailangan ng modelo na maintindihan ang mga kondisyon sa natural na wika, matukoy ang mga mahahalagang impormasyon, magbigay ng mga intermediate na konklusyon, at isama ito sa isang buong patotoo; anumang maling pag-unawa sa kondisyon o paglilipat sa pagdededuksyon ay agad na tatalakayin ng mga tagapagsuri. Ang dots-note-3.0 ay nakakuha ng perfektong skor nang tuloy-tuloy sa anim na iba’t ibang uri ng tanong, na nangangahulugan na ang pagganap ay hindi nakabatay sa isang panlabas na pagkakataon o inspirasyon. Pangalawa, ang modelo ay direktang nagproseso sa natural na wika mula sa pag-unawa sa tanong hanggang sa pagpapahayag ng sagot, na nagpapakita ng isang buong loop, na nagpapakita na ito ay may transferable at pangkalahatang kakayahang mag-isip.

Sa proseso ng pag-solve, gumagamit ang dots-note-3.0 ng agent-based approach, na nagkakaisa ang natural language at Python code execution para sa logical reasoning, at gumagamit ng recursive self-critique upang suriin ang sariling argumento. Ang totoong nakakagulat ay ang ikatlong tanong—isang kombinatoryal game problem. Ang karaniwang solusyon ay ang pagpapalit ng orihinal na problema sa graph theory connectivity problem bago mabuo ang patotoo, ngunit gumamit ang dots-note-3.0 ng mathematical induction, na nakakuha ng pinakamahalagang istruktura ng problema, at nagdisenyo ng tamang induction object at proposition.
Ipinapakita ni Liu Hanzuo, dalawang beses na nagwagi ng ginto sa CMO, na "tama at maganda, may maayos na istruktura at natural na lohika, kahit isama sa mga solusyon ng IMO, ito ay isa sa mga pinakamaliwanag at elegante." Sa kabilang banda, sinasabi ni Wang Qiantong, nagwagi ng ginto sa CMO, na "maikli at malinaw, direktang tumutok sa esensya, bawat hakbang ay natural, ngunit mahirap para sa mga humanong kalahati na makaisip na magsimula sa ganitong pananaw."
Para sa Xiaohongshu, ang perfect score sa IMO ay isang mahalagang teknikal na paglalabas. Sa nakaraan, ang pananaw ng labas tungkol sa kanilang teknolohiya ay nakatuon sa content community, recommendation algorithm, at content understanding, at ang kanilang posisyon sa larangan ng base model ay laging kulang sa pampublikong, awtoridad na patunay. Ang perfect score sa IMO ay iba—ang 42 puntos ay nandoon na, walang kailangang masalimuot na paliwanag, sapat na patunay na mayroon na ang Xiaohongshu ng kakayahan sa base model na dapat mabigyan ng seryosong pagmamasid ng industriya; isang bagong manlalaro na dapat tandaan ay lumabas sa larangan ng base model. Ayon sa mga ulat, ang dots-note-3.0 ay malapit nang mag-open source.
