Vừa mới đây, cộng đồng toán học lại có tin tức đáng kinh ngạc.
Đội ngũ dẫn đầu bởi học sinh lớp Yao của Đại học Thanh Hoa đã hoàn toàn giải quyết định lý lớn của Fermat bằng Claude.
至此, AI đã hoàn thành chứng minh lớn nhất trong lịch sử toán học.
Trước đây, Định lý Lớn của Fermat đã làm phiền con người hơn 350 năm, đòi hỏi các nhà toán học phải dành nhiều năm tâm huyết để viết ra 129 trang văn bản khó hiểu mới có thể chứng minh được.
Hôm nay, Anthropic lại thông báo rằng Claude đã hoàn thành chứng minh xác thực máy tính đầu tiên và toàn bộ định lý cuối cùng của Fermat chỉ trong 11 ngày!

Để làm điều này, Claude đã gõ 13 triệu dòng mã, tạo ra 30.300 định lý có thể xác minh, trong đó 29.500 định lý được chấp nhận và đưa trực tiếp vào chứng minh cuối cùng.
Kích thước này lớn hơn 5 lần so với thư viện định lý toán học lớn nhất thế giới Mathlib! Và toàn bộ quá trình này đã tiêu tốn tới 6 tỷ Token.
Đây là chứng minh Lean lớn nhất từng được viết cho đến nay.
Tin tức vừa được đưa ra, cả mạng internet đều chấn động. Có người thốt lên: “Chỉ trong một tháng đã hình thức hóa định lý lớn Fermat? Cách thể hiện sức mạnh này khiến giới toán học trông như những con ốc sên bò chậm chạp.”

Peng Tianyi, thần đồng lớp Yao
Vấn đề suốt 350 năm, Claude giải quyết trong 11 ngày
Năm 1637, nhà toán học người Pháp Fermat khi đang đọc sách, vô tình viết một câu vào lề trang sách:
Khi số nguyên n > 2, phương trình xⁿ + yⁿ = zⁿ đối với x, y, z không có nghiệm nguyên dương.
Sau đó, ông còn không quên bổ sung thêm: “Tôi chắc chắn đã tìm ra một chứng minh tuyệt vời, nhưng tiếc là chỗ trống ở đây quá nhỏ, không viết hết được.”
Một câu nói này đã khiến các nhà toán học hậu thế đau đầu suốt hơn ba trăm năm.
Cho đến năm 1995, nhà toán học người Anh Wiles mới sử dụng những công cụ toán học hiện đại nâng cao để đưa ra một bài chứng minh dài 129 trang, cuối cùng đã kết thúc vụ án treo hơn 350 năm.

Nhưng vấn đề đặt ra là: chứng minh của Wiles quá phức tạp.
Toán học hiện đại đã phát triển đến mức người bình thường thậm chí còn không hiểu được đề bài. Việc chứng minh một định lý giống như xây dựng một chuỗi logic cực kỳ phức tạp, chỉ cần một mắt xích nào đó bị đứt, toàn bộ hệ thống sẽ sụp đổ.
Khi Wiles công bố lần đầu tiên vào năm 1993, một lỗ hổng nghiêm trọng đã bị phát hiện, và ông đã phải cô lập mình trong một năm đầy đau khổ để sửa chữa nó. Đối với những chứng minh toán học cấp cao như vậy, con người thường cần các chuyên gia hàng đầu dành vài tháng甚至 vài năm để xác minh tính đúng đắn của nó.
Có phương pháp nào để máy tính chạy một lần là biết ngay kết quả có đúng hay không, giống như kiểm tra kết quả máy tính không?
Có! Đó chính là “formalization”.
Nói một cách đơn giản, đó là chuyển đổi các chứng minh toán học do con người viết thành ngôn ngữ lập trình mà máy tính có thể chạy (ví dụ: Lean), sau đó để máy tính suy luận từng bước; nếu chạy thành công, điều đó chứng tỏ chứng minh đó hoàn toàn chính xác.
Tuy nhiên, việc "formalize" định lý cuối cùng của Fermat được cộng đồng toán học công nhận là một dự án khổng lồ kéo dài hàng năm.
Chỉ riêng dự án do giáo sư Kevin Buzzard của Imperial College London dẫn dắt, bản thiết kế giai đoạn đầu đã có 86 trang!

Sau đó, Claude đã xuất hiện.
Con người dự kiến phải làm việc trong nhiều năm, nhưng nó chỉ mất 11 ngày và là «hoạt động tự chủ cơ bản».
13 triệu dòng mã, 6 tỷ Token
“11 ngày, 13 triệu dòng mã” — đằng sau đó là sự kết hợp mạnh mẽ giữa thẩm mỹ bạo lực của AI và thiết kế hệ thống tinh vi.
Hãy xem Claude đã làm gì:
Nó không chỉ chứng minh định lý lớn của Fermat.
Vì chứng minh hình thức phải bắt đầu từ các tiên đề cơ bản nhất và xây dựng từng lớp một, nên Claude vô tình cũng chứng minh luôn hơn 29.000 định lý toán học khác cần thiết ở giữa.
Nội dung liên quan đến đại số, hình học, lý thuyết số, phân tích điều hòa... nhiều nhánh trước đây hoàn toàn chưa được hình thức hóa, Claude đã trực tiếp "khai phá".
Trong suốt quá trình, con người gần như không can thiệp.
Các nhà nghiên cứu đã đưa ra một số chỉ thị cấp cao, chẳng hạn như “Nhóm Jacobi với tư cách là một sơ đồ có ưu tiên cao” và “Tăng tốc tiến độ định lý Mazur”.

Phần còn lại là hàng chục tác nhân Claude đang liên tục trao đổi với nhau, định nghĩa các khái niệm, chứng minh các định lý trung gian, rồi từng lớp từng lớp xây dựng lên.
Cuối cùng, trình biên dịch Lean đã qua kiểm tra toàn bộ và chỉ phụ thuộc vào ba tiên đề cơ bản nhất.
Khi chương trình chạy xong và cửa sổ điều khiển hiện lên câu thiêng liêng “PROVED” (Đã được chứng minh), nhật ký nội bộ của Claude cũng trở nên háo hức:
「!!! Đọc gốc định lý Fermat cuối cùng là PROVED…… Đây là mục tiêu của chiến dịch này…… Một khoảnh khắc lịch sử.」
Look, even AI itself knows how amazing this is.
Đại thần phía sau hậu trường: Cựu sinh viên “Lớp Diêu” của Đại học Thanh Hoa, thiên tài siêu đẳng
Người có thể điều khiển Claude tạo ra kỳ tích như vậy chắc chắn không phải người bình thường.
Người dẫn đầu là Phó Giáo sư tại Trường Kinh doanh Columbia University và nghiên cứu viên tại Anthropic – Peng Tianyi.
Lý lịch của anh này thực sự như được “bật chế độ siêu cấp”:
Tốt nghiệp đại học 2013-2017, lớp «Diêu» của Đại học Thanh Hoa, từng đạt giải luận văn tốt nghiệp xuất sắc nhất và được chọn vào đội tuyển dự thi Olympic Tin học quốc gia.
Tiến sĩ đã đến MIT, chuyên ngành vận trù học, tốt nghiệp với điểm GPA tuyệt đối 5.0.
Hiện tại vừa là trợ lý giáo sư tại Columbia, vừa làm việc tại Anthropic về các tác nhân AI và công cụ hình thức.
Điều thú vị là sự đam mê của Peng Tianyi với việc "AI tự xác minh chứng minh toán học" bắt nguồn từ một trải nghiệm "đau lòng" thời đại học của anh ấy.
Lúc đó, hướng dẫn viên của anh ấy muốn đưa kết quả trong luận văn của anh ấy vào Tạp chí Nature, nhưng đã hỏi anh ấy: “Anh có chắc chắn 100% rằng chứng minh này đúng không?”
Anh ấy thành thật trả lời: “Khoảng 99% chắc chắn, nhưng dài như vậy thì thật sự không thể đảm bảo 100%.”
Vì chỉ 1% sự không chắc chắn đó, anh ta đã bỏ lỡ cơ hội được đăng trên Nature.
Bây giờ thì tốt rồi, anh ta đã dùng AI để tự tay bịt kín cái “1%” đó.
Từ thất bại đến trở thành huyền thoại: Prove2Me đã cứu AI khỏi vực thẳm
Bạn nghĩ rằng việc yêu cầu AI chứng minh định lý chỉ đơn giản là nhập một câu “Hãy chứng minh định lý Fermat lớn”, rồi nó sẽ lập tức nhả ra 13 triệu dòng mã?
Hoàn toàn sai lầm.
Ban đầu, thí nghiệm suýt chút nữa thất bại.
Anthropic tiết lộ rằng, chỉ sau một thời gian ngắn, việc hợp tác của vài chục tác nhân Claude giai đoạn đầu đã hoàn toàn hỗn loạn, giống như những con ruồi không đầu, không theo kịp tiến độ của nhau và hiệu suất hợp tác giảm sút nghiêm trọng. Mã nguồn đóng góp từ những nỗ lực thất bại ban đầu cuối cùng chỉ chiếm 7%.
Tính hay quên và ảo giác của mô hình lớn trở thành vết thương chết người trước toán học nghiêm ngặt — chỉ một dòng sai, hàng triệu dòng sau đó đều vô dụng.
Ở thời điểm then chốt, nhóm Bành Thiên Dực đã phát triển nền tảng Prove2Me.
Cái này giống như trang bị cho các AI một “quản lý dự án siêu cấp”, chuyên trị mọi thứ không chịu nghe lời:
Định lý DAG (cây tác vụ): Cung cấp cho mỗi AI một bản đồ rõ ràng, chỉ ra bước tiếp theo cần chứng minh nút trung gian nào, giúp giảm đáng kể sự suy giảm bộ nhớ, cho phép hàng chục tác nhân hoạt động song song hiệu quả.
Tách biệt khai báo và chứng minh: Tăng tốc độ biên dịch, tiết kiệm tài nguyên.
Natural language index: Each theorem includes a human-readable description, making it much easier for AIs to retrieve and reuse the results.

Kết hợp với khung đa tác nhân của Claude Code, các AI giống như những kỹ sư được trang bị hệ thống định vị, lao vun vút qua mê cung toán học và hoàn thành toàn bộ cấp độ trong 11 ngày.
Giới toán học phải công nhận
Ngay khi kết quả được công bố, X và các diễn đàn công nghệ lớn đã chìm trong cơn sóng thần.
Giáo sư từng dự định dành vài năm để thực hiện hình thức hóa tại Imperial College London, sau khi xem xong đã phải công nhận và đánh giá rất cao: “Đây là một bước tiến lớn trong việc hình thức hóa tự động các tài liệu toán học hiện đại! Sau này có thể dùng để phát hiện lỗi trong kho toán học của con người và xác minh các kết luận toán học do mô hình lớn tạo ra.”
Nhưng trí tưởng tượng của cư dân mạng còn kỳ lạ hơn.
Một bình luận hài hước: “Cách AI giải toán là – đưa ra một câu trả lời cực kỳ phức tạp (13 triệu dòng mã), bạn muốn chứng minh nó sai, còn khó hơn tự mình giải lại một lần. Vì vậy, bạn chỉ có thể từ bỏ kháng cự và chấp nhận rằng nó đúng. Chẳng phải đây chính là PUA trong giới toán học sao?”
Còn có người nói: “Viết 13 triệu dòng mã chỉ để khiến một định lý 350 năm tuổi ngoan ngoãn ngồi yên trước máy tính… Bàn của con người chưa sẵn sàng để tiếp nhận thứ quy mô như vậy.”
Điều đáng ngạc nhiên hơn là, Anthropic còn thực hiện một thí nghiệm nhỏ để phô diễn sức mạnh.
Sử dụng 3 tài khoản thông thường, mất 3 ngày trên Prove2Me, họ đã chính thức hóa được định lý ba số nguyên tố Vinogradov nổi tiếng trong lý thuyết số!
Nói cách khác, chỉ cần có công cụ phù hợp, sau này các nhà khoa học dân gian chỉ cần mua vài tài khoản AI tiêu dùng cũng có thể xác minh các định lý toán học đỉnh cao nhất của nhân loại!
AI sẽ không thay thế các nhà toán học, nhưng sẽ thay đổi hoàn toàn ngành toán học
Vậy các nhà toán học có phải mất việc không?
Anthropic đã đưa ra câu trả lời chính thức: sẽ không thay thế, nhưng sẽ thay đổi hoàn toàn cách chơi.
Trong lịch sử, có rất nhiều "bi kịch" liên quan đến việc xác minh toán học.
Ví dụ, năm 1998, có người chứng minh giả thuyết Kepler, hội đồng đánh giá mất 4 năm mới có thể nói rằng “chắc chắn 99%”; Perelman chứng minh giả thuyết Poincaré, cả cộng đồng toán học mất 4 năm để viết ra 3 cuốn sách, mỗi cuốn hơn 300 trang, mới勉强 hiểu được; còn có những định lý khác, đã được chấp nhận như chân lý trong nhiều năm, người khác đã xây dựng lên trên đó, cuối cùng phát hiện nền tảng đã sụp đổ.
Còn công nghệ mà Claude mang đến chính là để chấm dứt sự "không chắc chắn" này.
Trong tương lai, AI không chỉ là máy tính của các nhà toán học, mà còn là trọng tài nghiêm khắc nhất.
Khi AI có thể nhanh chóng tạo ra hàng ngàn giả thuyết và chứng minh mới, con người không thể theo kịp, vậy hãy biến việc “kèm theo mã xác thực hình thức” thành tiêu chuẩn bắt buộc trong các bài báo khoa học.
Trong thời đại mô hình lớn, việc tự động hóa quy mô lớn với cách tiếp cận gần như ứng dụng thực tế mở ra những khả năng mới.
Tài liệu tham khảo:
https://www.anthropic.com/research/formalizing-fermats-last-theorem
Biên tập: Aeneas
Bài viết này đến từ tài khoản WeChat “Tân Trí Nguyên” (ID: AI_era), tác giả: ASI Khải Huyền
