Alibaba ra mắt Qwen3.8-Max: Mô hình AI miễn phí và hiệu quả để tự lưu trữ trong lĩnh vực tiền điện tử

iconChainGPT
Chia sẻ
AI summary iconTóm tắt
Alibaba đã phát hành Qwen3.8-Max, một mô hình AI với 2,4 nghìn tỷ tham số và thiết kế kích hoạt thưa để giảm chi phí và tăng hiệu quả suy luận. Mô hình này miễn phí và có sẵn trên Hugging Face và ModelScope, hỗ trợ tự lưu trữ và các hệ thống phi tập trung. Với sự quan tâm ngày càng tăng đối với các mô hình có trọng số mở và các thay đổi quy định tiềm tàng như MiCA (Quy định về Thị trường Tài sản Tiền ảo của EU), việc ra mắt này có thể ảnh hưởng đến thanh khoản và thị trường tiền điện tử.

Alibaba vừa tung ra một bất ngờ lớn dành cho thế giới AI — và điều này có thể ảnh hưởng rất lớn đến các dự án tiền mã hóa quan tâm đến việc tự lưu trữ và suy luận chi phí thấp. Điều gì đã xảy ra - Alibaba vừa phát hành Qwen3.8-Max, mô hình được công ty gọi là mạnh mẽ nhất từ trước đến nay. Lần đầu tiên, họ công khai toàn bộ trọng số “Max” cho công chúng: chúng sẽ được đăng tải trên Hugging Face và ModelScope vào tuần tới. - Mô hình này có quy mô khổng lồ về mặt lý thuyết — tổng cộng 2,4 nghìn tỷ tham số — nhưng nó sử dụng thiết kế kích hoạt thưa thớt, nên chỉ khoảng 95 tỷ tham số được kích hoạt cùng một lúc. Thiết kế này giúp giảm đáng kể nhu cầu về tính toán và bộ nhớ so với một mô hình 2,4T thông thường. Tại sao điều này quan trọng - Kích hoạt thưa/thụ động giống như một thư viện khổng lồ, nơi chỉ những kệ sách liên quan đến truy vấn cụ thể mới được bật sáng. Hiệu quả này cho phép các tổ chức nhỏ, phòng thí nghiệm, và thậm chí cả các nút mạng phi tập trung chạy một mô hình hiện đại nhất mà không cần chi phí của một trung tâm dữ liệu quy mô siêu lớn. - Đối với các nhà phát triển tiền mã hóa, điều này nghĩa là có thêm những lựa chọn thực tế hơn để triển khai suy luận tự lưu trữ, triển khai tác nhân riêng tư, hoặc chạy các dịch vụ dựa trên LLM trên hạ tầng phân tán. Hiệu suất và hành vi - Alibaba nhấn mạnh vào khả năng bền bỉ và tự chủ thay vì các chỉ số benchmark nổi bật. Một số ví dụ họ nêu ra: - Qwen đã tự động xây dựng một công cụ lập trình trong 16 ngày: 265 commit, 127 pull request, 151 issue — không có bất kỳ thao tác gõ phím nào từ con người trong suốt thời gian đó. - Nó tái tạo kết quả của một bài nghiên cứu trong năm ngày (không có quyền truy cập trước vào mã nguồn của bài viết) và sau đó vượt qua kết quả gốc 2,7 điểm. - Trong một cuộc thi ML kéo dài 24 giờ, nó đánh bại 458 trong số 526 đội ngũ con người. - Mô hình này đi kèm khả năng tương thích với giao thức Claude Code của Anthropic và Codex của OpenAI — API của Alibaba có thể giao tiếp với cả hai — và nhiều bài kiểm tra lập trình đã được thực hiện thông qua Claude Code. Benchmarks và chi phí - Trên các bài kiểm tra văn bản thuần túy (31 bài), Fable 5 của Anthropic dẫn đầu với 15 vị trí đầu tiên, GPT-5.6 Sol của OpenAI đạt 9, và Qwen giành 7. - Trên 12 bài kiểm tra lập trình, Qwen chỉ giành chiến thắng một lần. - Nhưng điểm nổi bật thực sự của Qwen là hiệu quả chi phí: “chi phí trí tuệ” suy luận của nó có thể chỉ bằng khoảng 30% so với Claude Fable 5. Về thực tế, điều này có nghĩa là ngay cả khi Qwen cần nhiều bước suy luận hơn, tổng chi phí để hoàn thành nhiệm vụ vẫn có thể thấp hơn nhiều. - Trong các nhiệm vụ đa phương tiện — tài liệu, video, suy luận không gian — Qwen dẫn đầu trong hầu hết các so sánh. Một bước ngoặt chiến lược và thời điểm - Đầu năm nay, Alibaba chuyển hướng sang các mô hình đóng và trả phí (họ loại bỏ phiên bản miễn phí của Qwen Code vào tháng Tư). Qwen 3.7 Max giữ nguyên trọng số Max dưới dạng API và chỉ mở phiên bản Plus. Bây giờ khi trọng số Max được công khai, Alibaba đã mở lại cánh cửa này. - Thời điểm này đáng chú ý: các mô hình mở trọng số của Trung Quốc đã tăng mạnh trên OpenRouter từ dưới 2% token vào cuối năm 2024 lên khoảng 61% vào giữa năm 2026. Qwen đã vượt qua Llama của Meta trở thành mô hình được tự lưu trữ nhiều nhất toàn cầu. - Địa chính trị cũng quan trọng: Washington đã áp đặt hạn chế xuất khẩu đối với Fable 5 và Mythos 5 của Anthropic vào tháng Sáu, trong khi Bắc Kinh được cho là đang xem xét hạn chế các mô hình Trung Quốc xuất khẩu ra nước ngoài. Điều này khiến việc phát hành miễn phí các trọng số Trung Quốc trở thành một bước đi phân phối mạnh mẽ. Tóm lại dành cho cộng đồng tiền mã hóa - Alibaba có thể không đứng đầu mọi bảng xếp hạng, nhưng bằng cách phát hành miễn phí một mô hình Max gần như hiện đại nhất và cực kỳ hiệu quả, họ đang giành chiến thắng về phân phối và khả năng tiếp cận. Đối với các nhóm Web3 đang xây dựng tác nhân riêng tư, nút suy luận hoặc dịch vụ AI phi tập trung, Qwen3.8-Max có thể hạ thấp rào cản triển khai và chuyển nhiều tải công việc AI hơn sang hạ tầng tự lưu trữ và phân tán. Vị trí thứ hai trên bảng xếp hạng vẫn có thể là lợi thế lớn khi bạn kiểm soát việc phân phối.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.