Google ra mắt các mô hình Gemini 3.6 Flash, Flash Lite và Flash Cyber AI

iconCryptoBriefing
Chia sẻ
AI summary iconTóm tắt
Google đã công bố ba mô hình AI Gemini mới—Gemini 3.6 Flash, Gemini 3.5 Flash Lite và Gemini 3.5 Flash Cyber—với trọng tâm vào tốc độ, hiệu quả và chi phí. Gemini 3.6 Flash cải thiện các nhiệm vụ lập trình và đa phương tiện với việc sử dụng token thấp hơn. Flash Lite xử lý các khối lượng công việc lớn với tốc độ nhanh hơn. Flash Cyber nhắm đến an ninh mạng và sẽ có sẵn trong một chương trình thử nghiệm giới hạn. Việc tiền huấn luyện Gemini 4 đã bắt đầu. Bản cập nhật tin tức AI + tiền điện tử này nhấn mạnh tiềm năng danh sách token mới khi các công cụ AI không ngừng phát triển.

Google đã ra mắt ba mô hình Gemini mới nhằm giúp các tác nhân AI nhanh hơn, rẻ hơn và hiệu quả hơn khi cạnh tranh ngày càng gay gắt trong các lĩnh vực lập trình, tự động hóa doanh nghiệp và an ninh mạng.

Danh sách bao gồm Gemini 3.6 Flash, Gemini 3.5 Flash Lite và Gemini 3.5 Flash Cyber. Google cũng xác nhận rằng Gemini 3.5 Pro đang được thử nghiệm với các đối tác và đã bắt đầu chuỗi pretraining đầy tham vọng nhất từ trước đến nay cho Gemini 4.

Gemini 3.6 Flash là mô hình chính trong bản phát hành, mang lại hiệu suất mạnh mẽ hơn trong lập trình, công việc kiến thức và đa phương tiện trong khi tiêu tốn ít token hơn so với Gemini 3.5 Flash.

Theo Google, mô hình sử dụng ít hơn 17% số token đầu ra trên Chỉ số Phân tích Nhân tạo. Công ty cho biết việc giảm token đạt tới 65% trong một số bài kiểm tra DeepSWE, đồng thời mô hình cũng yêu cầu ít bước suy luận và gọi công cụ hơn để hoàn thành các quy trình đa bước.

Gemini 3.6 Flash có giá $1,50 mỗi triệu token đầu vào và $7,50 mỗi triệu token đầu ra, mang lại mức giá thấp hơn cho mỗi tác vụ agentic so với phiên bản tiền nhiệm.

Mô hình đạt 49% trên DeepSWE, so với 37% của Gemini 3.5 Flash, phản ánh độ chính xác cao hơn và ít thay đổi mã không cần thiết hơn. Điểm MLE Bench của nó tăng lên 63,9% từ 49,7%.

Việc sử dụng máy tính cũng được cải thiện, với Gemini 3.6 Flash đạt 83% trên OSWorld Verified, so với 78,4% của mô hình trước đó. Việc sử dụng máy tính có sẵn như một công cụ tích hợp phía client thông qua Gemini API và Gemini Enterprise.

Google cho biết mô hình đặc biệt phù hợp với các quy trình tác nhân, các nhiệm vụ lập trình và các quy trình doanh nghiệp kéo dài. Nó hỗ trợ văn bản, hình ảnh, âm thanh và video, với cửa sổ ngữ cảnh lên đến một triệu token.

Quảng cáo

Flash Lite nhắm đến các tải trọng AI khối lượng lớn

Gemini 3.5 Flash Lite được thiết kế cho các ứng dụng nơi tốc độ, thông lượng và chi phí quan trọng hơn việc sử dụng mô hình lớn hơn.

Theo Artificial Analysis, mô hình tạo ra khoảng 350 token đầu ra mỗi giây, khiến nó trở thành mô hình nhanh nhất trong dòng Gemini 3.5.

Giá là 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra. Google đang định vị nó cho các tác vụ khối lượng lớn như tìm kiếm theo tác nhân, xử lý tài liệu, trích xuất dữ liệu, dịch thuật và tóm tắt.

Các nhà phát triển có thể điều chỉnh mức độ suy nghĩ của mô hình tùy theo nhiệm vụ. Các cài đặt tối thiểu và thấp ưu tiên thực thi nhanh hơn và rẻ hơn, trong khi các cài đặt cao hơn hỗ trợ các quy trình làm việc của các subagent phức tạp hơn.

Gemini 3.5 Flash Lite đạt 54% trên Terminal Bench 2.1, so với 31% của Gemini 3.1 Flash Lite. Nó cũng đạt 72,2% trên GDM MRCR v2, tăng từ 60,1%, và 1.140 trên GDPval AA v2, so với 642.

Google cho biết Flash Lite cũng vượt trội hơn Gemini 3 Flash lớn hơn trên một số bài kiểm tra mã hóa và tác nhân, bao gồm SWE Bench Pro và OSWorld Verified.

Google đặt Flash Cyber đối đầu với Mythos của Anthropic

Mô hình thứ ba, Gemini 3.5 Flash Cyber, được chuyên biệt hóa để tìm kiếm, xác thực và sửa chữa các lỗ hổng phần mềm.

Được xây dựng trên Gemini 3.5 Flash, mô hình hoạt động thông qua CodeMender, tác nhân bảo mật mã của Google. Nhiều tác nhân Flash Cyber có thể làm việc cùng nhau để phân tích lỗ hổng và tạo báo cáo tổng hợp.

Google cho biết hệ thống đạt hiệu suất cạnh tranh trên CyberGym trong khi hoạt động với chi phí thấp hơn mỗi token so với các mô hình an ninh mạng lớn hơn.

Việc ra mắt vị thế này giúp Flash Cyber trở thành đối thủ chi phí thấp hơn so với các mô hình bảo mật nâng cao như Mythos của Anthropic, được thiết kế để phát hiện lỗ hổng và suy luận mạng phức tạp.

Google đang áp dụng cách tiếp cận hạn chế đối với việc triển khai mô hình do nguy cơ bị lạm dụng trong không gian mạng. Flash Cyber ban đầu sẽ chỉ khả dụng cho các chính phủ và đối tác đáng tin cậy thông qua chương trình thử nghiệm CodeMender giới hạn.

Công ty cho biết việc triển khai này nhằm cung cấp cho các nhà bảo vệ quyền truy cập vào các công cụ phát hiện và khắc phục lỗ hổng trước khi mô hình được phổ biến rộng rãi hơn.

Bắt đầu quá trình tiền huấn luyện Gemini 4

Gemini 3.6 Flash và Gemini 3.5 Flash Lite đã có sẵn thông qua Gemini API, Google AI Studio, Android Studio và Gemini Enterprise.

Gemini 3.6 Flash cũng có sẵn thông qua Google Antigravity và ứng dụng Gemini, trong khi Flash Lite đang được triển khai thông qua Google Search.

Các bản phát hành được ra mắt trong khi Google tiếp tục thử nghiệm Gemini 3.5 Pro với các đối tác. Mô hình chủ lực vẫn chưa có ngày phát hành rộng rãi.

Google cũng xác nhận rằng việc phát triển thế hệ tiếp theo đang được tiến hành, với công ty bắt đầu cuộc chạy pretraining đầy tham vọng nhất từ trước đến nay cho Gemini 4.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.