Google DeepMind 推出三款 Gemini 模型升級,並啟動 Gemini 4 的預訓練

iconMetaEra
分享
AI summary icon精華摘要
Google DeepMind 宣布推出三款新的 Gemini 模型升級版——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber,每款均針對成本、速度和性能進行優化。Gemini 3.6 Flash 在編程任務中將代碼標記使用量減少 65% 並降低定價。Flash-Lite 以更低的成本提供每秒 350 個標記的處理速度。Flash Cyber 專注於網絡安全,針對漏洞新聞,檢測並修復系統缺陷。Google 同時為即將推出的 Gemini 4 模型啟動了迄今為止最大規模的預訓練計劃,這可能透過全新的 AI 驅動工具影響鏈上新聞。
谷歌 DeepMind 發布三款 Gemini 模型更新:主力模型 3.6 Flash 在編碼任務中最多可節省 65% Token,輸入價格為每百萬 Token 1.5 美元,輸出為 7.5 美元,價格更實惠,且在 DeepSWE 等測試中性能顯著提升;輕量版 3.5 Flash-Lite 輸出速度達每秒 350 Token,價格低至輸入每百萬 Token 0.3 美元、輸出 2.5 美元,多項測試表現超越更大的 Gemini 3 Flash;安全模型 3.5 Flash Cyber 專注於漏洞修復。谷歌同時宣布啟動「歷史上最激進」的預訓練,目標直指 Gemini 4。對用戶而言,核心好處是價格、Token 消耗量和 Agent 運行成本的全面下降。

文章作者、來源:新智元

對我們這些真金白銀掏錢買 Token、搭 Agent 的人來說,今天這場發布其實只有一個字最實在——降。

一氣呵成三連,谷歌這波是真的不裝了。

今天,谷歌 DeepMind 連放大招,一次性擺出三張王牌:

  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite
  • Gemini 3.5 Flash Cyber

一個更強大的主力、一個更快的輕量版、一個專精漏洞防禦的安全特種兵。

三款 Gemini 指向的是同一件事:讓跑在生產環境裡的 AI Agent,更快、更聰明、更便宜。

而在發布的同一天,谷歌還順手扔下了一枚更大的雷——

谷歌 DeepMind「史上最激進的一次預訓練已開始」,目標是下一代模型 Gemini 4。

一邊是 Gemini 三連發,一邊是 Gemini 4 開跑。

Google 傳遞的訊號再清晰不過,AI 這場終極牌局,好戲才剛剛開始。

Google 深夜放大招 三款 Gemini 齊發

三款 Gemini,接下來一一拆解。

Gemini 3.6 Flash,節省 65% Token

先來看這次真正的「C位」—— Gemini 3.6 Flash。

這次它主打一個亮點:超省 Token。

根據 Artificial Analysis Index 的計算,與上一代 3.5 Flash 相比,其輸出的 Token 減少 17%。

在 DeepSWE 這類編碼基準上,最多可節省 65%。

不僅吐字更少,它完成多步任務所需的推理步驟和工具調用也更少,走的彎路更短,等於又快又省。

此外,Gemini 3.6 Flash 在節省 Token 的同時,價格也更低了:

輸入 1.5 美元,輸出 7.5 美元每百萬 Token,比 3.5 Flash 更便宜。

更省、更便宜,还得更能打,這才叫誠意。3.6 Flash 在幾條關鍵測試上,都甩開了前代——

  • DeepSWE:程式設計測試 37% ➔ 49%
  • MLE Bench:機器學習研究測試 49.7% ➔ 63.9%
  • OSWorld-Verified:讓模型直接操作電腦測試,準確率從 78.4% ➔ 83%
  • GDPVal-AA v2:知識型工作任務已完成1421項,比上一代高出70多分

在以下 demo 中,3.6 Flash 展示了多智能體編排的絕活,不僅輕鬆完成複雜的代碼遷移任務,更在響應速度和代碼質量上對 3.5 Flash 實現了降維打擊。

With Gemini Canvas, 3.6 Flash has streamlined the 3D workflow, enabling users to instantly "hand-craft" a professional, photography-grade texture extraction tool.

它還能化身「AI 交互設計師」,輕鬆搞定沉浸感爆棚的主題工作室。

3.5 Flash-Lite,擊敗了老大哥

The second Gemini 3.5 Flash-Lite takes a different approach: focusing on speed and affordability.

3.5 Flash-Lite 的輸出速度達到每秒 350 個 Token,是整個 3.5 系列中最快的。

價格也低得離譜,每百萬 Token 輸入 $0.3 美元、輸出 $2.5 美元。

快速且低成本,專為「大量處理文件」和「Agent 搜索」這類高頻、大批量的場景而設計。

最厲害的是,它竟然反手將自家的「大哥」踩在腳下。

在多項編程和 Agent 測試上,這個輕量小模型居然跑贏了體量更大的 Gemini 3 Flash——

  • SWE-Bench Pro:54.2% 與 49.6%
  • OSWorld-Verified:74.0% vs 65.1%

3.6 Flash 作為「主腦」拆解任務,Flash-Lite 作為「分身」批量處理。

一個負責想,一堆負責跑,輕鬆化解高併發壓力。

在官方演示中,Flash-Lite 一氣呵成地推出了 25 套高可用性網頁設計方案,速度之快簡直是「想一下就出一批」。

Flash-Lite 現已在 Gemini App 上線,還將陸續進入谷歌搜索。

Flash Cyber:能修漏洞,但不是誰都能用

Gemini 3.5 Flash Cyber,一款專攻網路安全的硬核模型。

它的任務只有一個:找漏洞、補漏洞。

目前一個尷尬的現實是,AI 找出漏洞的速度已經快過現有系統修復漏洞的速度。

谷歌將這款模型整合進程式碼安全智能體 CodeMender,透過多個 Cyber 智能體協同作戰,在安全基準 CyberGym 上刷新 SOTA,成本卻比更大的模型更低——

使用一個更輕量的模型,執行最需要精準度的任務。

不過這款模型,普通人暫時接觸不到。

Gemini 4 已啟動,史上最具侵略性的預訓練

雖然還未拿到 Gemini 3.5 Pro,Gemini 4 已經開始訓練了。

這次三連彈只是前菜,但壓軸的那句官宣,才是真正的重頭戲。

谷歌已確認,內部已啟動了史上最激進的一次預訓練,目標直指 Gemini 4。

大神表示,按照谷歌常規的6個月訓練節奏,年底或許就能看到 Gemini 4 了。

對我們這些真金白銀掏錢買 Token、搭 Agent 的人來說,今天這場發布其實只有一個字最實在——降。

價格下降,Token 消耗量減少,運行一次 Agent 的成本降低。

至於那個遲遲不來的旗艦,和剛剛開跑的 Gemini 4,都還是「期貨」。

能用得上、還便宜的,才是今天就能裝進你錢包的東西。旗艦再強,也得先落地。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露