Google DeepMind ra mắt ba bản cập nhật mô hình Gemini: Mô hình chính 3.6 Flash tiết kiệm tới 65% Token trong các nhiệm vụ mã hóa, giá chỉ 1,5 USD cho đầu vào và 7,5 USD cho đầu ra mỗi triệu Token, rẻ hơn đáng kể, đồng thời hiệu năng tăng rõ rệt trong các bài kiểm tra như DeepSWE; phiên bản nhẹ 3.5 Flash-Lite đạt tốc độ đầu ra lên đến 350 Token/giây, giá thấp nhất chỉ 0,3 USD cho đầu vào và 2,5 USD cho đầu ra, vượt trội hơn cả Gemini 3 Flash lớn hơn trong nhiều bài kiểm tra; mô hình an toàn 3.5 Flash Cyber chuyên về sửa lỗ hổng. Google đồng thời công bố khởi động quá trình tiền huấn luyện "lớn nhất từ trước đến nay", nhắm thẳng vào Gemini 4. Đối với người dùng, lợi ích cốt lõi là giá cả, lượng Token tiêu thụ và chi phí chạy Agent đều giảm mạnh.Tác giả bài viết, nguồn: Newzhong
Đối với những người như chúng tôi bỏ tiền thật để mua Token và xây dựng Agent, buổi ra mắt hôm nay thực chất chỉ có một chữ thiết thực nhất – giảm.
Ba liên tiếp trong một hơi, Google lần này thật sự không giấu nữa.
Hôm nay, Google DeepMind liên tục tung ra những đòn mạnh, đồng thời công bố ba lá bài chủ:
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash Cyber

Một lực lượng mạnh mẽ hơn, một phiên bản nhẹ nhanh hơn, và một đội đặc nhiệm an ninh chuyên về lỗ hổng.
Ba sản phẩm Gemini đều hướng đến một mục đích duy nhất: giúp các AI Agent chạy trong môi trường sản xuất nhanh hơn, thông minh hơn và rẻ hơn.

Cùng ngày công bố, Google còn ném thêm một quả bom lớn hơn—
Google DeepMind đã bắt đầu cuộc tiền huấn luyện "điên rồ nhất từ trước đến nay", nhắm tới mô hình thế hệ tiếp theo Gemini 4.

Một bên là Gemini liên tiếp ba lần ra mắt, một bên là Gemini 4 đã bắt đầu.
Tín hiệu từ Google rõ ràng đến mức không thể nhầm lẫn, ván bài cuối cùng của AI mới chỉ bắt đầu.
Google đêm khuya tung chiêu lớn, ra mắt đồng thời ba phiên bản Gemini
Ba loại Gemini, tiếp theo sẽ phân tích từng cái một.
Gemini 3.6 Flash, tiết kiệm tới 65% token
Hãy cùng xem đến “vị trí trung tâm” thực sự lần này — Gemini 3.6 Flash.
Lần này, nó nổi bật với một điểm nhấn: tiết kiệm Token cực lớn.
Theo tính toán của Chỉ số Phân tích Nhân tạo, nó sử dụng ít hơn 17% Token đầu ra so với thế hệ trước là 3.5 Flash.
Trên các bộ chuẩn mã hóa như DeepSWE, có thể tiết kiệm tới 65%.

Ngoài việc nói ít từ hơn, nó cũng cần ít bước suy luận và gọi công cụ hơn để hoàn thành nhiệm vụ nhiều bước, đường vòng ngắn hơn, tức là vừa nhanh vừa tiết kiệm.
Không chỉ vậy, Gemini 3.6 Flash còn tiết kiệm Token đồng thời có giá thấp hơn:
Nhập 1,5 USD, đầu ra 7,5 USD mỗi triệu Token, rẻ hơn 3,5 Flash.
Tiết kiệm hơn, rẻ hơn, và mạnh mẽ hơn mới gọi là chân thành. 3.6 Flash đã vượt xa thế hệ trước trên vài bài kiểm tra then chốt—
- DeepSWE: Bài kiểm tra lập trình 37% ➔ 49%
- MLE Bench: Nghiên cứu máy học tăng từ 49,7% ➔ 63,9%
- OSWorld-Được xác minh: Cho phép mô hình thao tác trực tiếp trên máy tính để kiểm tra 78,4% ➔ 83%
- GDPVal-AA v2: Đã hoàn thành 1.421 nhiệm vụ công việc dựa trên kiến thức, cao hơn 70 điểm so với thế hệ trước

Trong demo dưới đây, 3.6 Flash thể hiện xuất sắc khả năng sắp xếp đa tác nhân, không chỉ dễ dàng hoàn thành nhiệm vụ di chuyển mã phức tạp, mà còn vượt trội hoàn toàn so với 3.5 Flash về tốc độ phản hồi và chất lượng mã.

Với Gemini Canvas, 3.6 Flash đã kết nối liền mạch vào quy trình 3D, chỉ trong vài phút đã “tự chế” ra một công cụ trích xuất văn bản chuyên nghiệp cấp ảnh.
Nó còn có thể hóa thân thành “Nhà thiết kế tương tác AI”, dễ dàng tạo ra các phòng làm việc chủ đề đầy tính chìm đắm.


3.5 Flash-Lite, đã đánh bại người anh cả
Phiên bản thứ hai, Gemini 3.5 Flash-Lite, theo một hướng khác: nhấn mạnh tốc độ nhanh và giá rẻ.
3.5 Flash-Lite có tốc độ đầu ra lên đến 350 token mỗi giây, nhanh nhất trong toàn bộ dòng 3.5.
Giá cũng thấp đến mức khó tin, chỉ $0,3 USD để nhập một triệu token và $2,5 USD để xuất.
Nhanh và rẻ, được thiết kế sẵn cho các kịch bản có tần suất cao và khối lượng lớn như “xử lý tài liệu quy mô lớn” và “tìm kiếm của Agent”.
Điều đáng kinh ngạc nhất là nó lại quay lại giẫm đạp lên “người anh cả” của chính mình.
Trên nhiều bài kiểm tra lập trình và Agent, mô hình nhỏ nhẹ này đã vượt qua Gemini 3 Flash với kích thước lớn hơn—
- SWE-Bench Pro: 54,2% so với 49,6%
- OSWorld-Đã xác minh: 74,0% so với 65,1%

3.6 Flash đóng vai trò “bộ não chính” để phân tích nhiệm vụ, Flash-Lite đóng vai trò “phân thân” xử lý hàng loạt công việc.
Một người phụ trách suy nghĩ, nhiều người phụ trách thực hiện, dễ dàng xóa bỏ áp lực đồng thời cao.
Trong bản trình diễn chính thức, Flash-Lite đã tạo liên tiếp 25 thiết kế giao diện web khả dụng cao, tốc độ nhanh đến mức gần như “chỉ cần nghĩ là ra ngay một bộ”.
Flash-Lite hiện đã được ra mắt trên ứng dụng Gemini và sẽ lần lượt xuất hiện trên Google Tìm kiếm.
Flash Cyber: Có thể sửa lỗ hổng, nhưng không phải ai cũng có thể sử dụng
Gemini 3.5 Flash Cyber, một mô hình chuyên sâu về an ninh mạng.
Nhiệm vụ của nó chỉ có một: tìm lỗ hổng và vá lỗ hổng.
Hiện tại, một thực tế khó xử là tốc độ AI phát hiện lỗ hổng đã nhanh hơn tốc độ sửa lỗ hổng của các hệ thống hiện có.

Google đã tích hợp mô hình này vào tác nhân an toàn mã CodeMender, sử dụng nhiều tác nhân Cyber phối hợp hành động, đạt thành tích SOTA mới trên bộ tiêu chuẩn an toàn CyberGym với chi phí thấp hơn so với các mô hình lớn hơn—
Sử dụng một mô hình nhẹ hơn để thực hiện những nhiệm vụ đòi hỏi độ chính xác cao nhất.
Tuy nhiên, mô hình này hiện tại người bình thường chưa thể tiếp cận.
Gemini 4 đã khởi động, tiền huấn luyện táo bạo nhất từ trước đến nay
Mặc dù chưa sở hữu Gemini 3.5 Pro, Gemini 4 đã bắt đầu được huấn luyện.
Ba đợt tung ra lần này chỉ là món khai vị, nhưng câu công bố chính thức cuối cùng mới là điểm nhấn thực sự.
Google đã xác nhận rằng họ đã khởi động đợt tiền huấn luyện quyết liệt nhất từ trước đến nay, nhắm thẳng vào Gemini 4.

Một chuyên gia cho biết, theo chu kỳ đào tạo thông thường 6 tháng của Google, có thể đến cuối năm chúng ta sẽ thấy Gemini 4.

Đối với những người như chúng tôi bỏ tiền thật để mua Token và xây dựng Agent, buổi ra mắt hôm nay thực chất chỉ có một chữ thiết thực nhất – giảm.
Giá giảm, lượng tiêu thụ Token giảm, chi phí chạy một lần Agent giảm.
Về chiếc flagship vẫn chưa xuất hiện và Gemini 4 vừa mới ra mắt, cả hai đều vẫn là “hợp đồng tương lai”.
Những thứ hữu dụng và giá rẻ mới là những thứ bạn có thể bỏ vào ví ngay hôm nay. Dù flagship có mạnh đến đâu, cũng phải trước tiên được đưa xuống thực tế.
