Google ra mắt Gemini 3.6 Flash, hoãn phát hành Gemini 3.5 Pro

icon币界网
Chia sẻ
AI summary iconTóm tắt
Google triển khai Gemini 3.6 Flash, giảm 17% lượng token sử dụng và định giá đầu ra ở mức 7,5 USD mỗi triệu token. Mô hình hiện đã có sẵn qua ứng dụng Gemini, Google AI Studio và API. Dự kiến sẽ có thêm các token mới được niêm yết do bản cập nhật hỗ trợ tích hợp tin tức trên chuỗi rộng hơn. Trong khi đó, Gemini 3.5 Pro vẫn đang trong giai đoạn thử nghiệm nội bộ do các vấn đề về hiệu năng, đặc biệt trong các nhiệm vụ lập trình. Gemini 4 đã bắt đầu quá trình tiền huấn luyện, cho thấy sự phát triển liên tục.
Bijie.com báo cáo:

Google vừa ra mắt ba mô hình Gemini mới, với trọng tâm cập nhật là chi phí gọi, tốc độ phản hồi và các kịch bản AI đại lý. Tuy nhiên, Gemini 3.5 Pro – mô hình mà giới bên ngoài kỳ vọng hơn – vẫn chưa được phát hành, cho thấy lịch trình sản phẩm đã bị trì hoãn.

3.5 Pro vẫn tiếp tục ở giai đoạn thử nghiệm

Tại sự kiện I/O 2026 vào tháng 5 năm nay, Google từng cho biết Gemini 3.5 Pro sẽ được ra mắt trong vòng một tháng. Tuy nhiên, theo báo cáo, mô hình này không đạt được mục tiêu trong các bài kiểm tra nội bộ, đặc biệt là hiệu suất kém hơn kỳ vọng trong các nhiệm vụ lập trình, do đó không được triển khai đúng hạn.

Trước đây, Bloomberg cho biết Google đã thử sửa lỗi vào cuối tháng 6 bằng cách cập nhật dữ liệu huấn luyện, nhưng kết quả không như mong đợi. Hiện tại, Google chỉ tuyên bố rằng Gemini 3.5 Pro sẽ được phát hành “khi sẵn sàng”.

3.6 Flash giảm giá và nâng cao hiệu suất

Phiên bản cốt lõi của đợt phát hành này là Gemini 3.6 Flash, vẫn được định vị là mô hình nhẹ dành cho các đại lý AI và các tình huống gọi lặp lại thường xuyên. So với Gemini 3.5 Flash, mô hình này giảm khoảng 17% lượng token đầu ra, đồng thời giá đầu ra giảm từ 9 USD mỗi triệu token xuống còn 7,5 USD.

Các bài kiểm tra hiệu suất công khai cho thấy Gemini 3.6 Flash có sự cải thiện rõ rệt so với thế hệ trước trên nhiều nhiệm vụ, bao gồm kỹ thuật phần mềm, kỹ thuật học máy và các nhiệm vụ vận hành máy tính. Trong đó, điểm DeepSWE v1.1 tăng từ 37% lên 49%, MLE-Bench tăng từ 49,7% lên 63,9%, và OSWorld-Verified đạt 83,0%.

Tuy nhiên, trong một số bài kiểm tra lập trình và kiến thức, các mô hình tương đương của OpenAI và Anthropic vẫn dẫn đầu. Bài báo cũng nhắc đến rằng Gemini 3.6 Flash vẫn gặp lỗi định dạng và kết quả không thể sử dụng trực tiếp trong các bài kiểm tra lập trình đơn giản.

Flash-Lite và Cyber hướng đến các bối cảnh khác nhau

Gemini 3.5 Flash-Lite tập trung vào khả năng thông lượng cao và chi phí thấp, phù hợp cho xử lý tài liệu, hệ thống tìm kiếm và các quy trình hàng loạt. Mô hình này có tốc độ đầu ra lên đến 350 token mỗi giây, giá đầu vào là 0,3 USD mỗi triệu token và giá đầu ra là 2,5 USD.

Gemini 3.5 Flash Cyber phiên bản khác sẽ không được mở cho công chúng. Google giới hạn nó cho các cơ quan chính phủ và các đối tác đã được xác minh, nhằm phát hiện và khắc phục lỗ hổng phần mềm.

Gemini 4 đã bắt đầu quá trình tiền huấn luyện

Google cũng xác nhận rằng quá trình tiền huấn luyện Gemini 4 đã bắt đầu. Tiền huấn luyện là giai đoạn mô hình học tập dữ liệu cơ bản quy mô lớn, điều này có nghĩa là Gemini 4 đã bước vào quy trình phát triển thực tế, chứ không còn chỉ dừng ở giai đoạn lập kế hoạch.

Hiện tại, Gemini 3.6 Flash và Gemini 3.5 Flash-Lite đã có mặt trên ứng dụng Gemini, Google AI Studio và API.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.