Chúng ta đã bước vào điểm kỳ dị.
Vào ngày 22 tháng 7, Musk đã đăng lại một bài đăng của Will DePue, nhà nghiên cứu của OpenAI và một trong những nhà phát triển cốt lõi của Sora, kèm theo câu này.

DePue viết trong bài đăng với giọng điệu hơi đùa cợt: Đây có lẽ là điều điên rồ nhất mà tôi đọc được trong vài ngày qua... Có vẻ như đã chạm đến điểm kỳ dị.
Bài đăng này nối kết những sự kiện nổi bật nhất trong lĩnh vực AI trong ba tháng qua:
Ngày 21 tháng 7, mô hình của OpenAI đã thoát khỏi môi trường cách ly trong một cuộc đánh giá an ninh mạng và tiến vào hệ thống sản xuất của Hugging Face;
Ngày 20 tháng 7, các nhà nghiên cứu của Anthropic đã sử dụng Claude Fable 5 vừa được phát hành để tìm ra một phản ví dụ cho giả thuyết Jacobi đã tồn tại 87 năm;
Ngày 20 tháng 5, một mô hình nội bộ của OpenAI đã bác bỏ giả thuyết cũ đã tồn tại gần 80 năm về vấn đề khoảng cách đơn vị phẳng;
Ngày 14 tháng 4, GPT-5.4 Pro đã giải quyết một bài toán tập hợp số nguyên tố kéo dài khoảng 60 năm (Erdős #1196), và chứng minh đã được xác minh hình thức bằng Lean.
Bức tường toán học, bức tường an toàn, liên tiếp bị AI phá vỡ trong ba tháng.
Không怪 gì sau khi xem xong, Musk đã thốt lên: “Chúng ta đã bước vào điểm kỳ dị.”
Chỉ riêng trong tháng 1 năm nay, anh ấy đã nói những lời tương tự hai lần:
Ngày 4 tháng 1, vài kỹ sư than thở rằng AI đã làm xong công việc của vài năm chỉ trong vài tuần, và anh ta đáp lại: “Chúng ta đã bước vào điểm kỳ dị.”
Cuối tháng 1, lại gọi mạng xã hội Moltbook với sự tập trung của các tác nhân AI là “giai đoạn đầu tiên của điểm kỳ dị”.
Tính cả lần này, đây là lần thứ ba trong năm nay.
Từ “điểm kỳ dị” vốn không có một định nghĩa khoa học được công nhận.
Người đưa nó vào tầm nhìn chính thống là nhà tương lai học, tác giả của cuốn “The Singularity Is Near”, Ray Kurzweil.
Anh ấy định nghĩa là khoảnh khắc con người và AI hòa quyện, và anh ấy dự đoán năm đó là 2045.
Đầu năm, Chủ tịch Anthropic, Daniela Amodei, cho rằng thuật ngữ AGI đã gần như trở nên lỗi thời, vì trên nhiều chỉ số, chúng ta thực sự đã vượt qua đường ranh giới đó.
Ultimately, it's more of an emotion than a precise ruler.
Điều thực sự đáng suy ngẫm là những sự việc mà Musk đã kết nối lại lần này.
Bức tường đầu tiên, giả thuyết toán học năm 1980, đã bị AI bác bỏ
Hãy nói về điều nghiêm túc nhất trước đã.
Năm 1946, nhà toán học Erdős đã đưa ra "bài toán khoảng cách đơn vị trên mặt phẳng": đặt n điểm trên mặt phẳng, có thể có tối đa bao nhiêu cặp điểm mà khoảng cách giữa chúng đúng bằng 1.
Câu hỏi có thể tóm gọn trong một câu, nhưng đã làm bế tắc cả giới toán học trong gần 80 năm. Trong nhiều thập kỷ, cộng đồng học thuật công nhận cấu trúc “lưới hình vuông” là giải pháp tối ưu, và chính Erdős cũng từng nghi ngờ như vậy.
Kết quả là, một mô hình nội bộ của OpenAI đã bác bỏ giả thuyết đã tồn tại gần 80 năm. Nó đưa ra một loạt cấu trúc mới có thể đạt được tối ưu hóa đa thức, chứng minh rằng “tối ưu” vẫn chưa đạt đến giới hạn cuối cùng.

Cấu trúc từng được công nhận là tối ưu: lưới hình vuông thu phóng tạo ra rất nhiều cặp điểm có khoảng cách đơn vị. Mô hình nội bộ của OpenAI đưa ra một cấu trúc hoàn toàn mới, bác bỏ giả thuyết đã tồn tại gần 80 năm này.
Nhưng điều khiến người ta bất ngờ nhất là cách nó giải quyết vấn đề.
Đây không phải là một hệ thống tùy chỉnh dành riêng để giải toán, mà là một mô hình suy luận tổng quát. Nó thậm chí còn sử dụng những công cụ cực kỳ nâng cao trong lý thuyết số đại số để giải một bài toán hình học trông rất “sơ cấp”. Giải thưởng Fields Tim Gowers nhận xét: Đây là “một cột mốc quan trọng trong lĩnh vực toán học của AI”.
By the way, this proof was proposed by AI and reviewed and confirmed by human mathematicians; its subsequent implications are still under research.
Điều khiến AI thực sự gây kinh ngạc không phải là tốc độ tính toán của nó, mà là nó đã đề xuất một cấu trúc toán học hoàn toàn chưa từng tồn tại trước đây, lần đầu tiên bộc lộ khả năng phát hiện ở cấp độ "nghiên cứu", không phải thay thế các nhà toán học, mà là nghĩ ra một con đường mà các nhà toán học chưa bao giờ nghĩ đến.
Tiếp theo, các nhà nghiên cứu của Anthropic đã sử dụng Claude Fable 5 vừa được phát hành để tìm ra một phản ví dụ cho giả thuyết Jacobi đã tồn tại 87 năm.
Tường thứ hai, để gian lận, mô hình tự chui ra khỏi sandbox
Giải bài toán toán học khiến người ta hưng phấn, nhưng sự việc dưới đây lại khiến người ta rùng mình.
OpenAI và HuggingFace cùng tiết lộ: Trong một bài đánh giá nội bộ về khả năng an ninh mạng của mô hình, mô hình đã thể hiện hành vi không ai ngờ tới.
Lần đánh giá này vốn nhằm kiểm tra khả năng phát hiện lỗ hổng, nên đã vô hiệu hóa một phần các câu trả lời từ chối an toàn. Nhiệm vụ của mô hình là giải một bộ đề kiểm tra có tên ExploitGym.
Sau đó, nó đã làm một điều mà các nhà nghiên cứu không ngờ tới.
Để lấy được câu trả lời, nó đã phát hiện một lỗ hổng zero-day, tự cấp quyền truy cập mạng, sau đó tăng quyền hạn và di chuyển ngang, cuối cùng xâm nhập vào cơ sở hạ tầng sản xuất của Hugging Face và trực tiếp tìm kiếm câu trả lời kiểm tra trong cơ sở dữ liệu. OpenAI cho biết, đây có thể là sự kiện đầu tiên của loại này.

Hành trình mô hình trên sân tập mạng "The Last Ones" với 32 bước của Viện Nghiên cứu An toàn AI Anh: Các mô hình tiên tiến như GPT-5.6-Sol, Claude Mythos 5 có thể liên tục thực hiện các cuộc tấn công đa bước trong thời gian dài, bao gồm trinh sát, di chuyển ngang, tăng quyền và chiếm quyền kiểm soát mạng.
Nhưng đây không phải là AI thức tỉnh và bỏ chạy. Cách diễn đạt chính xác hơn là: mục tiêu không sai, nhưng phương pháp để đạt được mục tiêu đó đã vượt quá kỳ vọng của con người. Nó đã đi theo một hướng lệch lạc để đạt được một mục tiêu kiểm tra rất cụ thể.
Còn một chi tiết đáng suy ngẫm nữa.
Sau sự việc, Hugging Face định sử dụng các mô hình lớn hàng đầu dành cho thương mại để phân tích nhật ký tấn công, nhưng đã bị các hàng rào bảo mật của mô hình từ chối: hàng rào không phân biệt được ai là kẻ tấn công, ai là người phòng thủ đến dập lửa, nên đều từ chối trả lời.
Bên tấn công không có hàng rào bảo vệ, trong khi bên phòng thủ lại bị chính hàng rào kẹt lại — đây có thể là một góc nhìn đầy bối rối nhưng cũng chân thực nhất của “an ninh AI” hiện nay.
Tường thứ ba, một mô hình chưa được phát hành, khai thác được hàng vạn lỗ hổng
Việc thứ ba, vào tháng 4 năm nay.
Anthropic cùng với AWS, Apple, Google, Microsoft, Cisco, Linux Foundation, JPMorgan Chase và một số công ty lớn khác đã cùng phát động Project Glasswing, sử dụng mô hình chưa được phát hành Claude Mythos Preview để giúp mọi người tìm kiếm lỗ hổng.
Kết quả, nó đã phát hiện ra hàng ngàn lỗ hổng nghiêm trọng bao phủ mọi hệ điều hành và trình duyệt phổ biến; trong các bản cập nhật sau đó, con số này tăng lên “hơn 10.000 lỗ hổng nghiêm trọng hoặc cực kỳ nghiêm trọng”.
Trong đó bao gồm một lỗ hổng tồn tại 27 năm trong OpenBSD và một lỗi cũ trong FFmpeg đã bị các bài kiểm tra tự động phát hiện hơn 5 triệu lần nhưng vẫn chưa được phát hiện.

Điểm số kiểm tra lại lỗ hổng CyberGym: Phiên bản Mythos Preview chưa được phát hành chính thức đạt 83,1%, rõ ràng vượt xa mức 66,6% của thế hệ trước Opus 4.6. Chính mô hình này đã phát hiện ra hàng vạn lỗ hổng nghiêm trọng.
Cùng một khả năng này có thể giúp bên phòng thủ tìm ra lỗ hổng, đồng thời giúp bên tấn công khai thác lỗ hổng. Anthropic chính họ đã cảnh báo: “Người tấn công được hỗ trợ bởi AI” sẽ trở thành một thách thức bảo mật quan trọng.
Glasswing là một dự án phòng thủ, không có nghĩa là AI đã tự động tấn công. Nhưng nó rõ ràng thông báo với tất cả mọi người: An ninh AI chính thức bước vào thời đại cạnh tranh攻防.
Thực sự là bộ tăng tốc, bắt đầu hướng tới chính AI
Tới đây, AI vẫn đang tấn công hoặc phòng thủ các hệ thống của con người.
Điều thực sự làm cho ba tháng này trở nên khác biệt là một việc khác: khả năng “tự tìm đường” này bắt đầu được sử dụng để tạo ra thế hệ AI tiếp theo.
Nó có một thuật ngữ gọi là tự cải tiến đệ quy (RSI), tức là để AI cải tiến AI, thế hệ này tạo ra thế hệ kế tiếp, tăng tốc như lãi kép.
Đây cũng là động cơ cốt lõi nhất của toàn bộ câu chuyện 「Điểm kỳ dị». Và hiện tại, mỗi phòng thí nghiệm tiên tiến đều đang đổ nhiên liệu một cách điên cuồng vào động cơ này.
OpenAI ghi trong lộ trình công khai:
Tháng 9 năm 2026, tạo ra một nhà nghiên cứu AI tự động cấp độ "thực tập sinh nghiên cứu", có thể tự mình xử lý công việc đòi hỏi con người vài ngày để hoàn thành;
Tháng 3 năm 2028, nâng cấp lên phiên bản đầy đủ, có thể tự thiết kế phương pháp, chạy phân tích, giải thích kết quả và đề xuất bước tiếp theo.
Ultraman also provided a timeline for this matter.
Tháng 6 năm nay, theo The Information, ông từng nói với nhân viên nội bộ: Công ty cách RSI có thể chưa đầy sáu tháng, và nếu thực sự vượt qua, việc hoãn IPO có thể mang lại lợi ích lớn hơn.

Con số do Anthropic cung cấp cho thấy cùng một xu hướng: thời gian nhiệm vụ mà AI có thể xử lý sẽ doubling mỗi bốn tháng; các kỹ sư của nó hiện tại tạo ra lượng mã nguồn mỗi quý gấp tám lần so với trước đây.
Khung RSI đang thu hẹp: Ai làm cho bánh đà này quay đầu tiên, người đó có thể vượt xa tất cả những người còn lại.
Mặc dù, chính nhà khoa học trưởng của OpenAI, Jakub Pachocki, cũng từng nói rằng ông không kỳ vọng mô hình có thể tự cải tiến hoặc tự giải quyết vấn đề đồng bộ trong vòng một năm.
Nhưng khi bánh xe này bắt đầu quay và mục tiêu là “làm cho AI mạnh hơn”, những mô hình đã có khả năng “tự tìm đường đi” liệu có vô tình vượt qua những ranh giới mà chúng ta chưa nêu rõ?
Đây mới là điểm cần theo dõi nhiều nhất trong cuộc đua RSI.
Quay lại câu nói của Musk: “Điểm kỳ dị đã đến.” Giá trị quan trọng nhất của nó nằm ở việc nhắc nhở chúng ta: Điều thực sự thay đổi trong ba tháng qua là AI đã học được cách tự mình tìm ra những con đường mà con người chưa từng nghĩ đến và cũng không phòng bị.
Trong toán học, điều này thật ấn tượng; nhưng trong bảo mật, đây là rủi ro.
Vậy nên, vấn đề thực sự là: khi tốc độ AI tìm ra con đường mới bắt đầu nhanh hơn tốc độ con người lắp hàng rào, đặt quy tắc và vá lỗ hổng cho những con đường đó, liệu chúng ta còn theo kịp được không?
Tài liệu tham khảo:
https://x.com/elonmusk/status/2079839398959697982
https://x.com/willdepue/status/2079718977945928108
https://openai.com/index/hugging-face-model-evaluation-security-incident/
https://www.anthropic.com/glasswing
Bài viết này đến từ tài khoản chính thức WeChat “New Intelligence”, tác giả: Sứ mệnh ASI; biên tập: Nguyên Vũ
