Điểm thực sự đáng chú ý không phải là điểm số mô hình, mà là con đường Dương Trí Lân đã đặt cược: trọng số mở + ngữ cảnh dài + cụm Agent, một con đường hoàn toàn khác với OpenAI.Tác giả bài viết, nguồn: 0x9999in1, ME News

Tóm tắt ngắn gọn
- Ngày 16 tháng 7 năm 2026, Moonshot ra mắt Kimi K3 với 2,8 nghìn tỷ tham số và ngữ cảnh 1 triệu token, đạt điểm tổng hợp 57,1 trong đánh giá độc lập của Artificial Analysis, xếp thứ 4 toàn cầu, vượt qua Claude Opus 4.8.
- Người sáng lập Dương Trí Lân 34 tuổi, tốt nghiệp đại học tại Thanh Hoa, tiến sĩ tại CMU, là tác giả đầu tiên của Transformer-XL và XLNet, thuộc số ít người biến các bài báo mình viết thành sản phẩm.
- Mặt tối của Mặt Trăng hoàn thành vòng huy động vốn mới khoảng 2 tỷ USD vào tháng 5 năm 2026, định giá vượt quá 20 tỷ USD, tăng khoảng 4 lần trong vòng ba tháng.
- Ngày K3 ra mắt, Nasdaq giảm hơn 1,4% và NVIDIA cùng lúc suy yếu—một buổi ra mắt của một công ty khởi nghiệp Trung Quốc đã lần đầu tiên thực sự thúc đẩy tâm lý thị trường chứng khoán Mỹ.
- Nhưng K3 không còn "rẻ cực kỳ": $3/$15 mỗi triệu token, khoảng 3 lần so với thế hệ trước K2.6, đánh dấu bước ngoặt của thời kỳ "AI Trung Quốc giá bèo".
- Tỷ lệ ảo tưởng của K3 được đánh giá độc lập lên tới 51%, đầu ra rườm rà, quyền mở sẽ được hoãn đến ngày 27 tháng 7, câu chuyện không hoàn hảo.
- Điểm thực sự đáng chú ý không phải là điểm số mô hình, mà là con đường Dương Trí Lân đã đặt cược: trọng số mở + ngữ cảnh dài + cụm Agent, một con đường hoàn toàn khác với OpenAI.
Một tay trống, tại sao lại có thể tạo ra mô hình lớn thứ tư thế giới?
Trước tiên, hãy nêu kết luận. Dương Trí Lân không phải may mắn.
Anh ấy là một trong số ít người tạo được vòng lặp từ lý thuyết đến sản phẩm.
Transformer-XL, XLNet, hai bài báo, tác giả đầu tiên. Hai bài này không phải là những bài báo thông thường. Chúng là một trong những nền tảng cơ bản cho tất cả các mô hình lớn ngày nay trong việc xử lý chuỗi dài.
Rất nhiều người viết luận văn. Nhưng rất ít người biến luận văn thành công ty. Và trên toàn thế giới, chỉ đếm được trên một ngón tay những công ty đạt top 4 toàn cầu.
Sinh năm 1992, đến từ Thâm Quyến, Quảng Đông. Tốt nghiệp đại học ngành Khoa học Máy tính tại Đại học Thanh Hoa, đồng thời vừa viết mã vừa chơi trống và sáng tác nhạc trong ban rock trường học Splay. Bốn năm sau giành bằng tiến sĩ tại Đại học Carnegie Mellon. Đã từng làm việc tại Google Brain và Meta AI, có danh sách cộng tác viên bao gồm Bengio và LeCun.
24 tuổi, đồng sáng lập công ty AI đầu tiên. Tháng 3 năm 2023, thành lập Moonshot AI.
Lý lịch này, nếu đặt ở Thung lũng Silicon, cũng là mẫu vật hiếm có. Còn tại Trung Quốc, gần như là duy nhất.
Tại sao lại nhấn mạnh điều này?
Trên con đường của các mô hình lớn, "Tôi đã đọc tất cả các bài báo liên quan" và "Những bài báo này là do tôi viết" là hai mức năng lượng hoàn toàn khác nhau. Người đầu tiên là đường cong học tập, người sau là trực giác đi trước. Dương Trí Lâm thuộc nhóm sau.
Transformer-XL giải quyết vấn đề "chuỗi quá dài không nhớ được". XLNet thực hiện việc vượt qua mô hình pre-training của BERT. Trên tiếp tuyến của hai điều này là nhãn sản phẩm nổi bật nhất của Kimi hôm nay: ngữ cảnh dài.
Từ việc trợ lý thông minh Kimi ban đầu nhấn mạnh 200.000 từ, sau đó là 2 triệu từ, đến khi K3 ra mắt trực tiếp cung cấp 1M token (khoảng 1 triệu token).
Đây không phải là một chủ đề tiếp thị. Đây là sự mở rộng tự nhiên trong sự nghiệp học thuật của anh ấy.
Kimi K3 mạnh ở đâu và yếu ở đâu
Hãy xem dữ liệu thực tế trước.
Kimi K3 được phát hành vào ngày 16 tháng 7 năm 2026. Tổng tham số 2,8 nghìn tỷ, kiến trúc MoE thưa thớt, mỗi token kích hoạt 16 trong số 896 chuyên gia. Cửa sổ ngữ cảnh 1.048.576 token. Hỗ trợ trực tiếp hình ảnh.
Điểm số Intelligence Index v4.1 của bên thứ ba độc lập Artificial Analysis: 57.1, xếp thứ 4 toàn cầu.
Ba vị trí đầu lần lượt là Claude Fable 5 (59,9), GPT-5.6 Sol (58,9) và Kimi K3, ngay sau nó là Claude Opus 4.8 (55,7). Tiếp theo, Grok 4.5 đạt 53,8, GLM-5.2 đạt 51,1 và DeepSeek V4 đạt 44,3.
Đây là lần đầu tiên một mô hình Trung Quốc thực sự lọt vào nhóm hàng đầu toàn cầu.
Xem chi tiết các mục con. GPQA Diamond: 93,5%. Terminal-Bench 2.1: 88,3%, gần bằng với 88,8% của GPT-5.6 Sol. BrowseComp: 91,2%. Tại Arena.ai Frontend Code, K3 đứng đầu, vượt qua Claude Fable 5. Cũng đứng đầu trên AutomationBench-AA với 53%.
Trên thang điểm độc lập GDPval-AA v2 đo lường "tri thức công việc giá trị kinh tế thực tế", Elo của K3 đã tăng trực tiếp từ 1190 của thế hệ K2.6 lên 1668, vượt qua Claude Opus 4.8 với 1600, GLM-5.2 với 1514 và GPT-5.5 với 1494.
Mức độ nhảy là 478 Elo. Khá thô bạo.
Yếu ở đâu vậy?
Tỷ lệ ảo giác cao. Artifical Analysis cho thấy tỷ lệ ảo giác của K3 là 51%, cao hơn so với thế hệ trước. Độ chính xác đã được cải thiện, nhưng "xác suất nói bậy" cũng tăng theo.
Rườm rà. K3 đã tạo ra 130 triệu token trong toàn bộ bài đánh giá AA, trong khi trung bình ngành là 63 triệu. Gấp đôi. Simon Willison đã thử một nhiệm vụ SVG đơn giản là "vẽ một con ngỗng" và tốn khoảng 0,25 đô la.
Việc phát hành trọng số mở đã bị hoãn. Vào ngày phát hành, không có checkpoint, không có giấy phép, không có model card và không có báo cáo kỹ thuật. Moonshot cam kết sẽ phát hành trước ngày 27 tháng 7—tức là sáu ngày sau khi bài viết này được viết. Trước thời điểm đó, K3 chỉ có thể sử dụng thông qua API và ứng dụng, về bản chất là một “mô hình được lưu trữ”.
Không có điểm SWE-bench Pro/Verified. Các bộ đánh giá do Moonshot tự chọn như DeepSWE, FrontierSWE vẫn chưa thể được bên thứ ba tái hiện.
Vì vậy, K3 là một mô hình "thực sự tốt, nhưng chưa hoàn hảo". Điều này cần được làm rõ, không nên thổi phồng nó.
Tín hiệu đáng chú ý hơn: Trung Quốc không còn bán AI với giá "rẻ như bắp cải"
Đây là điều bị bỏ qua nhiều nhất trên K3, nhưng có thể là quan trọng nhất.
Giá API của K3: $3 mỗi triệu token đầu vào, $15 mỗi triệu token đầu ra, bộ nhớ đệm đầu vào $0,30.
Kimi K2.6 thế hệ trước là bao nhiêu? $0.95 / $4.00.
Tăng khoảng 3 lần.
Giá này có ý nghĩa gì? Về cơ bản, nó đã đồng bộ với mức giá của Claude Sonnet. Nói cách khác, Moonshot đã chủ động từ bỏ lá bài nổi bật nhất trong vài năm qua của các mô hình lớn Trung Quốc — giá cực kỳ thấp.
Tại sao?
Do 2,8 nghìn tỷ tham số, chế độ suy nghĩ sâu liên tục, ngữ cảnh 1M, chi phí không thể giảm xuống. Đồng thời, định vị của K3 đã không còn là "trợ lý giá rẻ cho bạn", mà là "nền tảng cấp Agent cạnh tranh trực tiếp với Claude Opus và GPT-5.6".
Điều thú vị là, ngay cả khi giá tăng gấp 3 lần, chi phí mỗi nhiệm vụ của Artificial Analysis vẫn chỉ khoảng 0,94 USD, bằng khoảng một nửa so với Claude Opus 4.8 (1,80 USD) và tương đương với 1,04 USD của GPT-5.6 Sol.
Đối chiếu với mức giá một nửa, cùng nhóm cấp độ.
Đây mới là lý do khiến thị trường chứng khoán Mỹ rung chuyển vào ngày 17 tháng 7.
Ngày hôm đó, Nasdaq giảm hơn 1,4%. NVIDIA cũng bị bán theo. Một buổi ra mắt của một công ty khởi nghiệp Trung Quốc đã thực sự ảnh hưởng đến tâm lý thị trường chứng khoán Mỹ.
Hai năm trước, điều này là không thể tưởng tượng. Hai năm trước, tác động của việc Trung Quốc phát hành mô hình lên thị trường chứng khoán Mỹ gần như không tồn tại.
Đã có mặt. Vì câu chuyện đã thay đổi.
Câu chuyện đã chuyển từ "Mỹ tạo ra công nghệ tiên tiến, Trung Quốc đi theo" thành "Trung Quốc cũng tạo ra công nghệ tiên tiến, đồng thời còn có trọng số cao hơn và giá rẻ hơn một nửa". Câu chuyện này gây áp lực trực tiếp, lâu dài và có tính cấu trúc lên khả năng định giá của các phòng thí nghiệm tiên tiến đóng nguồn như Anthropic và OpenAI.
Đằng sau định giá 20 tỷ USD: Đặt cược tăng bốn lần trong ba tháng
Nhịp độ huy động vốn cũng đang kể cùng một câu chuyện.
Cuối năm 2024, định giá của Moonshot khoảng 3,3 tỷ USD. Đến tháng 5 năm 2026, đợt huy động vốn mới khoảng 2 tỷ USD đã được thực hiện, định giá vượt quá 200 tỷ USD.
Tăng bốn lần trong ba tháng.
Trương Trí Lân từng nói tại Diễn đàn Trungguanxun tháng 3 năm 2026: “Trong vài năm tới, ngày càng nhiều công việc nghiên cứu sẽ do AI dẫn dắt.” Ông cũng tiết lộ ba lộ trình công nghệ tại GTC năm 2026: Hiệu quả Token, ngữ cảnh dài, và mở rộng quy mô cụm Agent.
Chỉ khi hiểu ba điều này, bạn mới có thể hiểu được cược của Moonshot.
Hiệu suất token tương ứng với hai cơ chế mới của K3: Kimi Delta Attention và Attention Residuals, được cho là giúp tăng tốc độ giải mã lên tới 6,3 lần.
Bối cảnh dài, tương ứng với sự tăng tốc từ 200.000 chữ đến 1 triệu token.
Agent cluster, tương ứng với K3 được xác định rõ là "mô hình suy luận agentic" – được thiết kế cho các nhiệm vụ chuỗi dài, điều hướng kho mã nguồn và gọi công cụ, không phải để trò chuyện.
Ba con đường này là sự đầu tư của Dương Trí Lâm vào "hình thái AI thế hệ tiếp theo".
Anh ấy cá rằng: một mô hình lớn đơn lẻ không phải là điểm cuối, mà là cụm tác nhân được tạo động và điều phối hợp tác mới là đích đến.
Whether this judgment is correct will be answered within two years.
Khoa học mở mới là bức tường phòng thủ thực sự của AI Trung Quốc
Cần phải nêu ra một bối cảnh lớn hơn ở đây.
Trong thời gian gần đây, một quan sát từ nhà nghiên cứu AI nước ngoài đã lan truyền rộng rãi trong cộng đồng, với nội dung chính: lý do các phòng thí nghiệm Trung Quốc có thể liên tục tạo ra các mô hình như GLM-5.2 và Kimi K3 không phải vì có nhiều năng lực tính toán hơn, mà là do tính mở – không chỉ mở trọng số, mà còn mở cả hệ sinh thái.
Có một quan sát rất đáng suy ngẫm: Phần lớn công việc huấn luyện mô hình tại các phòng thí nghiệm hàng đầu Trung Quốc được thực hiện bởi thực tập sinh. Hơn nữa, những sinh viên đại học và sau đại học này hiểu sâu sắc các chi tiết huấn luyện và sẵn sàng chia sẻ kiến thức nhiều gấp 100 lần so với đồng nghiệp tại Mỹ.
Ngược lại, các phòng thí nghiệm hàng đầu của Mỹ gần như không tuyển thực tập sinh. Sinh viên tiến sĩ tại Stanford và Berkeley phải nỗ lực hết sức mới có thể giành được cơ hội sử dụng sức tính toán để huấn luyện mô hình có "kích thước phù hợp". Phần lớn các bí mật bị một nhóm nhỏ các nhà nghiên cứu đặc quyền khóa chặt.
Đây không phải là cuộc cạnh tranh giữa Trung Quốc và Mỹ. Đây là cuộc tranh luận giữa khoa học mở và khoa học đóng.
Sự tồn tại của Kimi K3 chính là minh chứng tốt nhất cho luận điểm này.
Một nhà sáng lập drummer 34 tuổi, dùng bài luận tự viết làm nền tảng, dẫn dắt nhóm thanh niên đang học hoặc vừa tốt nghiệp, đã tạo ra mô hình lớn thứ 4 thế giới.
Việc này rất khó xảy ra trong nội bộ OpenAI. Không phải do con người không đủ năng lực, mà do cơ chế không cho phép.
Tất nhiên, việc K3 hoãn việc mở trọng số đến ngày 27 tháng 7 cũng là một tín hiệu—những người ủng hộ mở đang do dự, đang tính toán, và đang bị thúc ép lùi lại một bước bởi thương mại hóa. Hành động này đáng để cảnh giác, nhưng chưa đủ để phủ nhận xu hướng lớn.
DeepSeek V4 vẫn đang mở dưới giấy phép MIT. GLM-5.2 cũng vậy. Hàng ngũ Trung Quốc với trọng số mở vẫn chưa tan rã.
Một tay trống có thể đi được bao xa
Quay lại với người tên Dương Trí Lân.
Một doanh nhân công nghệ xuất thân từ tay trống rock, gần như là một cá thể kỳ lạ trong cộng đồng AI Trung Quốc. Anh ta không giống kiểu “nhà khoa học thiên tài từ Thanh Hoa” hay phong cách “tinh hoa du học về từ Thung lũng Silicon”.
Anh ấy không phát biểu nhiều, nhưng mỗi lần đều rất đậm đặc. Trong bài phát biểu tại GTC 2026, anh ấy đã trình bày rõ ràng lộ trình công nghệ—tái cấu trúc bộ tối ưu, tái cấu trúc cơ chế chú ý, tái cấu trúc kết nối dư. Đây không phải là ngôn từ PR, mà là phán đoán kỹ thuật.
Anh ấy cũng thừa nhận những điểm yếu của Moonshot. Trong bài đăng blog chính thức của K3, họ viết rất thẳng thắn: UX vẫn còn khoảng cách so với Claude Fable 5 và GPT-5.6 Sol; nhạy cảm với lịch sử suy nghĩ được lưu trữ; và quá chủ động với các nhiệm vụ mơ hồ.
Một CEO trung thực, một nhà nghiên cứu đưa luận văn của mình vào sản phẩm, một đội ngũ trẻ được kết nối bởi hệ thống Thanh Hoa, cùng một lộ trình công nghệ rõ ràng. Đó chính là nền tảng của Moonshot hôm nay.
Nó không hoàn hảo. Nó sẽ mắc lỗi. Con đường thương mại hóa của nó vẫn chưa được triển khai đầy đủ—việc tăng giá 3 lần có thể duy trì tăng trưởng không, chi phí tính toán cho ngữ cảnh 1M có thể giảm xuống không, và khi nào dạng Agent mới thực sự được triển khai—đây đều là những dấu hỏi.
Nhưng nó là thật. Nó không phải là công ty chỉ có PowerPoint, không phải bong bóng định giá, cũng không dựa vào sự thổi phồng nhất thời.
Kết luận: Nasdaq rung chuyển chỉ là khởi đầu
Ngày 17 tháng 7 năm 2026, Nasdaq giảm 1,4%.
Có người sẽ nói, giảm 1,4% thì có gì là đáng kể, thị trường luôn biến động mỗi ngày.
Nhưng điều bạn cần xem là chuỗi nhân quả: một công ty khởi nghiệp Trung Quốc phát hành một mô hình, và ngay trong cùng một ngày, nó được các nhà đánh giá độc lập như Reuters, CNBC, Simon Willison nghiêm túc bình luận, khiến NVIDIA bị bán ra đồng thời, và Artificial Analysis trực tiếp xếp nó vào top 4 toàn cầu.
Điều này chưa bao giờ xảy ra trong quá khứ.
Điều đó có nghĩa là một điều: quyền định giá và tiếng nói của AI đang dần dịch chuyển khỏi Vùng vịnh San Francisco. Không phải toàn bộ, mà là bắt đầu dịch chuyển.
Yang Zhilin không phải là người duy nhất thúc đẩy điều này. Đội ngũ DeepSeek, Zhipu và Alibaba Tongyi cũng vậy. Nhưng anh ấy thực sự là biểu tượng sắc sảo và điển hình nhất trong đợt này—một thanh niên 34 tuổi hiểu lý thuyết, hiểu sản phẩm, hiểu mở cửa và hiểu thương mại hóa, đồng thời từng chơi trống.
Sẽ có thế hệ tiếp theo của mô hình. K4, K5 rồi cũng sẽ đến. Điểm số sẽ luôn bị đuổi kịp và rồi bị vượt qua.
Điều thực sự còn lại là liệu con đường mở này có thể giữ vững được hay không.
Nếu giữ được, AI sẽ không phải là AI của ba công ty.
Nếu không giữ được, thì chúng ta chỉ đang đi từ sự đóng cửa cũ sang sự đóng cửa mới.
Về phần Dương Trí Lân himself—ông có lẽ sẽ không quá quan tâm đến những câu chuyện vĩ mô này. 34 tuổi, định giá công ty 20 tỷ USD, sở hữu một mô hình nằm trong top 4 toàn cầu, đội ngũ toàn những người trẻ mà ông có thể trao đổi cùng. Vị trí này đã đủ để ông tiếp tục đánh trống, tiếp tục viết luận văn, tiếp tục là một trong những người hiếm hoi “biến luận văn của mình thành sản phẩm”.
Khi nào thì NASDAQ rung chuyển lần thứ hai?
Sẽ không phải chờ lâu lắm.
Tài liệu tham khảo
- Reuters, "China's Moonshot ra mắt mô hình AI mở lớn nhất thế giới, thu hẹp khoảng cách với các đối thủ Mỹ", 2026-07-17
- CNBC, "Trí tuệ nhân tạo Moonshot của Trung Quốc ra mắt Kimi K3 cạnh tranh với OpenAI, Anthropic", 2026-07-17
- Bảng xếp hạng AI, "Kimi K3: Các tiêu chuẩn đánh giá, Giá cả & Đánh giá — Mô hình biên giới 2,8T của Moonshot", 2026-07
- The Decoder, "Mô hình mở Kimi K3 sắp sánh ngang GPT-5.6 Sol và Fable 5, đồng thời báo hiệu kết thúc thời kỳ AI Trung Quốc siêu rẻ", 2026-07
- Phân tích Nhân tạo, "Thẻ mô hình Kimi K3 & Chỉ số Trí tuệ v4.1", 2026-07
- Wall Street Journal, "Người sáng lập Kimi, Dương Trí Lân: Nghiên cứu và phát triển AI trong tương lai sẽ bước vào thời đại do AI dẫn dắt, định giá công ty đã đạt 18 tỷ USD", 2026-03-25
- Thời đại Trí tuệ Thông minh, Bài phát biểu của Dương Trí Lân tại GTC 2026: Tiết lộ lần đầu tiên lộ trình kỹ thuật của mô hình Kimi, 2026-03-18
- Bản đồ AI Trung Quốc, "Hồ sơ YANG Zhilin (杨植麟)"
