Theo dữ liệu từ OpenRouter, tổng lượng token được gọi sử dụng bởi các mô hình AI quy mô lớn toàn cầu vào tuần trước là 115 nghìn tỷ token, tăng 1,77% so với tuần trước. Lượng token được gọi sử dụng bởi các mô hình AI quy mô lớn của Trung Quốc đạt 56,72 nghìn tỷ token, tăng 2,83% so với tuần trước, đã liên tục vượt Mỹ trong 19 tuần liên tiếp và giữ vững vị trí số một toàn cầu. Tencent Hunyuan Hy4 preview dẫn đầu với 14,7 nghìn tỷ token được gọi sử dụng trong tuần, tăng 379% so với tuần trước. Trong top 5, có bốn mô hình đến từ Trung Quốc. MiniMax M3 quay lại danh sách và được công ty AI Ả Rập Xê Út HUMAIN lựa chọn làm nền tảng phát triển mô hình ngôn ngữ Ả Rập, đánh dấu bước đột phá quan trọng trong việc xuất khẩu công nghệ mô hình AI của Trung Quốc.Tác giả bài viết, nguồn: AIBase
Theo dữ liệu mới nhất từ OpenRouter, tổng lượng gọi mô hình AI toàn cầu trong tuần trước (từ ngày 31 tháng 8 đến ngày 6 tháng 9) là 115 nghìn tỷ Token, tăng 1,77% so với tuần trước. Trong đó, tổng lượng gọi mô hình AI Trung Quốc nằm trong danh sách đạt 56,72 nghìn tỷ Token, tăng 2,83% so với tuần trước; trong cùng kỳ, tổng lượng gọi mô hình AI Hoa Kỳ là 16,54 nghìn tỷ Token, giảm 3,1% so với tuần trước. Lượng gọi mô hình AI của Trung Quốc đã liên tục vượt Hoa Kỳ trong 19 tuần liên tiếp và duy trì vị trí số một toàn cầu.
Trong top 5, có 4 sản phẩm đến từ Trung Quốc, Hy4 preview của Hunyuan đứng đầu
Tuần trước, trong top 5 mô hình AI lớn được sử dụng nhiều nhất toàn cầu, có bốn mô hình đến từ Trung Quốc. Tencent HunYuan Hy4 preview đứng đầu với lượng gọi mô hình trong tuần đạt 14,7 nghìn tỷ Token, tăng 379% so với tuần trước. Mô hình này chính thức được phát hành và mở nguồn vào ngày 28 tháng 8, với tổng tham số 770B và tham số kích hoạt 49B, độ dài ngữ cảnh vượt quá 1M, được tối ưu hóa đặc biệt cho các cảnh ứng dụng Agent, Coding và năng suất. Ngày 1 tháng 9, đội ngũ Tencent HunYuan tiếp tục ra mắt phiên bản nhẹ của Hy4 preview, giảm kích thước trọng số từ 1,5TB xuống còn khoảng 214GB, làm giảm thêm rào cản triển khai tại chỗ; khả năng hiểu văn bản dài sau khi nén gần như tương đương với mô hình gốc.
Tiếp theo lần lượt là: GPT-5.6 Luna đứng thứ hai với 12,9 nghìn tỷ Token được gọi mỗi tuần, tăng 66% so với tuần trước; ZhiPu GLM-5.3 Flash tăng lên vị trí thứ ba với 12,4 nghìn tỷ Token được gọi mỗi tuần, tăng 101% so với tuần trước; DeepSeek-V4-Flash-0731 (bản chính thức) đứng thứ tư với 12,4 nghìn tỷ Token được gọi mỗi tuần; DeepSeek-V4-Flash-0423 (bản xem trước) đứng thứ năm với 5,19 nghìn tỷ Token được gọi mỗi tuần.
MiniMax M3 quay lại bảng xếp hạng, trở thành nền tảng phát triển mô hình bản địa tại nước ngoài
Sau gần một tháng, MiniMax M3 quay trở lại bảng xếp hạng, đứng vị trí thứ sáu với lượng gọi mô hình trong tuần đạt 5,02 nghìn tỷ Token, tăng 95% so với tuần trước. MiniMax trước đó đã thông báo rằng từ ngày 24 tháng 8 đến ngày 6 tháng 9, các nhà phát triển có thể sử dụng miễn phí các mô hình như MiniMax M3 thông qua GMI Cloud và OpenRouter. Mô hình này được phát hành và mở nguồn vào tháng 6 năm nay, hướng đến các kịch bản Coding, Agent và đa mô tả bản địa, được huấn luyện đa mô tả kết hợp văn bản, hình ảnh và video ngay từ giai đoạn đầu, hỗ trợ ngữ cảnh lên đến hàng triệu Token.
Tuần trước, công ty trí tuệ nhân tạo HUMAIN thuộc Quỹ Đầu tư Công cộng Saudi Arabia (PIF) đã ra mắt mô hình ngôn ngữ lớn đầu tiên bằng tiếng Ả Rập, HUMAIN M3, được huấn luyện dựa trên MiniMax M3 để nâng cao khả năng tiếng Ả Rập và địa phương hóa. Khác với các mô hình lớn của Trung Quốc trước đây chủ yếu xuất khẩu thông qua API hoặc sản phẩm ứng dụng, trong hợp tác lần này, MiniMax M3 trực tiếp trở thành mô hình nền tảng cho việc phát triển mô hình bản địa tại nước ngoài.
Lưu ý rằng, MiMo-V2.5 của Xiaomi, trước đây xếp thứ ba trong tuần trước, và Gemini 3.7 Flash xếp thứ chín đã rơi khỏi danh sách.
