Kết quả kỳ thi Olympic Toán học Quốc tế lần thứ 67 (IMO 2026) đã được công bố, mô hình lớn của Xiaohongshu dots-note-3.0 đã giành huy chương vàng với điểm tuyệt đối bằng cách trả lời đúng cả sáu câu hỏi. Đây là lần đầu tiên một mô hình lớn của Trung Quốc được công nhận huy chương vàng chính thức từ IMO, đồng thời cũng là mô hình lớn thứ hai trên toàn cầu đạt thành tích này sau Google Gemini—và là mô hình duy nhất đạt điểm tuyệt đối, trong khi Google trước đó chỉ trả lời đúng 5/6 câu. IMO được coi là thước đo chuẩn để đánh giá trí tuệ và khả năng suy luận của các mô hình lớn, người tham gia phải trình bày đầy đủ các chứng minh logic, độ khó cực cao. Điểm chuẩn huy chương vàng năm nay là 29 điểm, dots-note-3.0 vượt xa điểm này 13 điểm. Các nhà vô địch hai lần CMO đánh giá cách giải của nó là “đúng đắn và đẹp mắt, cấu trúc chặt chẽ, logic tự nhiên”. Thành tích điểm tuyệt đối này chứng minh Xiaohongshu đã sở hữu khả năng suy luận tổng quát có thể chuyển giao, mở ra một người chơi mới đáng chú ý trong lĩnh vực mô hình nền tảng.Tác giả bài viết, nguồn: Xiaohongshu
Kết quả kỳ thi Olympic Toán học Quốc tế lần thứ 67 (IMO2026) vừa được công bố, mô hình lớn của Xiaohongshu dots-note-3.0 đã giành huy chương vàng với điểm tuyệt đối, giải đúng cả sáu câu hỏi. Đây là lần đầu tiên một mô hình lớn của Trung Quốc được xác nhận đạt cấp độ huy chương vàng chính thức của IMO, đồng thời cũng là mô hình lớn thứ hai trên toàn cầu đạt thành tích này sau Google Gemini—và là mô hình duy nhất đạt điểm tuyệt đối, trong khi Google trước đó chỉ giải đúng 5/6 câu hỏi.
IMO là viết tắt của Kỳ thi Toán học Quốc tế, hàng năm quy tụ những học sinh trung học xuất sắc nhất toàn cầu, nửa số người đoạt giải Fields hiện đại như Terence Tao đều xuất thân từ kỳ thi này. Cuộc thi diễn ra trong hai ngày, mỗi ngày thí sinh giải 3 bài toán trong 4,5 giờ, bao gồm bốn lĩnh vực: đại số, tổ hợp, hình học và lý thuyết số, mỗi bài được 7 điểm, tổng điểm tối đa là 42. Thí sinh phải trình bày các chứng minh logic đầy đủ và có thể được kiểm tra từng bước, điều này cực kỳ khó đối với các mô hình lớn.

Con đường IMO của Google Gemini có thể được tham khảo: Trong lần thử thách đầu tiên năm 2024, nó chỉ giành huy chương bạc với 28 điểm và phải chuyển đổi đề bài sang các ngôn ngữ hình thức như Lean, một số câu hỏi mất vài ngày để giải; năm 2025, Gemini Deep Think đã hoàn thành chứng minh端到端 bằng ngôn ngữ tự nhiên, giải quyết 5 câu hỏi trong 4,5 giờ và giành huy chương vàng. Các kỳ thi toán học được coi là thước đo trí tuệ và khả năng suy luận của các mô hình lớn, trong khi IMO có một lợi thế độc đáo so với các benchmark thông thường—tính không biết trước. Đề thi mỗi năm do các chuyên gia biên soạn và giữ bí mật nghiêm ngặt, mô hình không thể luyện tập trước một cách nhắm mục tiêu, mà chỉ có thể dựa vào khả năng hiểu, khám phá và suy luận chặt chẽ trong thời gian thực.
Điểm chuẩn huy chương vàng kỳ IMO năm nay là 29 điểm, giảm 6 điểm so với 35 điểm của năm ngoái, cho thấy độ khó của toàn bộ đề thi rõ ràng cao hơn nhiều so với năm trước. 29 điểm có nghĩa là hoàn thành đầy đủ 4 bài toán và kiếm thêm 1 điểm từ 2 bài còn lại là có thể vào vùng huy chương vàng, trong khi mô hình lớn của Xiaohongshu dots-note-3.0 trả lời đúng tất cả các câu hỏi, cách xa điểm chuẩn huy chương vàng tới 13 điểm.
Điểm tuyệt đối trước hết chứng minh sự ổn định của hệ thống suy luận Agentic. Mô hình cần đọc hiểu các điều kiện bằng ngôn ngữ tự nhiên, xác định thông tin then chốt, đưa ra các kết luận trung gian và sắp xếp thành một chứng minh hoàn chỉnh; bất kỳ sự hiểu nhầm điều kiện nào hay bước suy luận bị bỏ qua đều sẽ bị ban giám khảo chỉ ra ngay lập tức. dots-note-3.0 liên tục đạt điểm tuyệt đối trong sáu loại câu hỏi khác nhau, điều này cho thấy hiệu suất không phụ thuộc vào cảm hứng tình cờ với một câu hỏi cụ thể. Thứ hai, mô hình xử lý trực tiếp端到端 bằng ngôn ngữ tự nhiên, sở hữu vòng khép kín hoàn chỉnh từ việc hiểu vấn đề đến biểu đạt câu trả lời, cho thấy nó có khả năng suy luận phổ quát có thể chuyển giao.

Trong quá trình giải bài cụ thể, dots-note-3.0 sử dụng phương pháp tác nhân, kết hợp ngôn ngữ tự nhiên và thực thi mã Python để suy luận giải bài, đồng thời tận dụng khả năng tự phê phán đệ quy để xem xét lại lập luận của chính mình. Điều thực sự khiến người ta ngạc nhiên là câu hỏi thứ ba—một bài toán lý thuyết trò chơi tổ hợp. Các phương pháp thông thường chuyển bài toán ban đầu thành vấn đề liên thông trong lý thuyết đồ thị rồi xây dựng chứng minh, trong khi dots-note-3.0 lại sử dụng phương pháp quy nạp, nắm bắt được cấu trúc cốt lõi nhất của bài toán và thiết kế đối tượng quy nạp cùng mệnh đề phù hợp một cách chính xác.
Lưu Hàn Tác, huy chương vàng CMO, đánh giá nó là "đúng đắn và đẹp đẽ, cấu trúc chặt chẽ, logic tự nhiên, ngay cả khi đặt trong lời giải IMO cũng thuộc loại đơn giản và thanh lịch." Vương Thiên Đồng, huy chương vàng CMO, cho rằng nó "ngắn gọn, rõ ràng và chạm đến bản chất, từng bước đều hợp lý, nhưng các thí sinh người khó có thể nghĩ đến việc tiếp cận từ góc độ này."
Đối với Xiaohongshu, IMO đạt điểm tuyệt đối là một lần trình diễn kỹ thuật quan trọng. Trước đây, nhận thức bên ngoài về công nghệ của họ chủ yếu tập trung vào cộng đồng nội dung, thuật toán đề xuất và hiểu biết nội dung, còn vị trí của họ trong lĩnh vực mô hình nền tảng chưa từng có bằng chứng công khai và đáng tin cậy. Nhưng IMO đạt điểm tuyệt đối thì khác—42 điểm đã được công bố rõ ràng, không cần giải thích phức tạp, đủ để chứng minh Xiaohongshu đã sở hữu năng lực mô hình nền tảng đáng để ngành công nghiệp xem xét nghiêm túc, và xuất hiện một người chơi mới đáng chú ý trong lĩnh vực mô hình nền tảng. Theo thông tin, dots-note-3.0 sắp được mở nguồn.
