谷歌 DeepMind 發布三款 Gemini 模型更新:主力模型 3.6 Flash 在編碼任務中最多可節省 65% Token,輸入價格為每百萬 Token 1.5 美元,輸出為 7.5 美元,價格更實惠,且在 DeepSWE 等測試中性能顯著提升;輕量版 3.5 Flash-Lite 輸出速度達每秒 350 Token,價格低至輸入每百萬 Token 0.3 美元、輸出 2.5 美元,多項測試表現超越更大的 Gemini 3 Flash;安全模型 3.5 Flash Cyber 專注於漏洞修復。谷歌同時宣布啟動「歷史上最激進」的預訓練,目標直指 Gemini 4。對用戶而言,核心好處是價格、Token 消耗量和 Agent 運行成本的全面下降。文章作者、來源:新智元
對我們這些真金白銀掏錢買 Token、搭 Agent 的人來說,今天這場發布其實只有一個字最實在——降。
一氣呵成三連,谷歌這波是真的不裝了。
今天,谷歌 DeepMind 連放大招,一次性擺出三張王牌:
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash Cyber

一個更強大的主力、一個更快的輕量版、一個專精漏洞防禦的安全特種兵。
三款 Gemini 指向的是同一件事:讓跑在生產環境裡的 AI Agent,更快、更聰明、更便宜。

而在發布的同一天,谷歌還順手扔下了一枚更大的雷——
谷歌 DeepMind「史上最激進的一次預訓練已開始」,目標是下一代模型 Gemini 4。

一邊是 Gemini 三連發,一邊是 Gemini 4 開跑。
Google 傳遞的訊號再清晰不過,AI 這場終極牌局,好戲才剛剛開始。
Google 深夜放大招 三款 Gemini 齊發
三款 Gemini,接下來一一拆解。
Gemini 3.6 Flash,節省 65% Token
先來看這次真正的「C位」—— Gemini 3.6 Flash。
這次它主打一個亮點:超省 Token。
根據 Artificial Analysis Index 的計算,與上一代 3.5 Flash 相比,其輸出的 Token 減少 17%。
在 DeepSWE 這類編碼基準上,最多可節省 65%。

不僅吐字更少,它完成多步任務所需的推理步驟和工具調用也更少,走的彎路更短,等於又快又省。
此外,Gemini 3.6 Flash 在節省 Token 的同時,價格也更低了:
輸入 1.5 美元,輸出 7.5 美元每百萬 Token,比 3.5 Flash 更便宜。
更省、更便宜,还得更能打,這才叫誠意。3.6 Flash 在幾條關鍵測試上,都甩開了前代——
- DeepSWE:程式設計測試 37% ➔ 49%
- MLE Bench:機器學習研究測試 49.7% ➔ 63.9%
- OSWorld-Verified:讓模型直接操作電腦測試,準確率從 78.4% ➔ 83%
- GDPVal-AA v2:知識型工作任務已完成1421項,比上一代高出70多分

在以下 demo 中,3.6 Flash 展示了多智能體編排的絕活,不僅輕鬆完成複雜的代碼遷移任務,更在響應速度和代碼質量上對 3.5 Flash 實現了降維打擊。

With Gemini Canvas, 3.6 Flash has streamlined the 3D workflow, enabling users to instantly "hand-craft" a professional, photography-grade texture extraction tool.
它還能化身「AI 交互設計師」,輕鬆搞定沉浸感爆棚的主題工作室。


3.5 Flash-Lite,擊敗了老大哥
The second Gemini 3.5 Flash-Lite takes a different approach: focusing on speed and affordability.
3.5 Flash-Lite 的輸出速度達到每秒 350 個 Token,是整個 3.5 系列中最快的。
價格也低得離譜,每百萬 Token 輸入 $0.3 美元、輸出 $2.5 美元。
快速且低成本,專為「大量處理文件」和「Agent 搜索」這類高頻、大批量的場景而設計。
最厲害的是,它竟然反手將自家的「大哥」踩在腳下。
在多項編程和 Agent 測試上,這個輕量小模型居然跑贏了體量更大的 Gemini 3 Flash——
- SWE-Bench Pro:54.2% 與 49.6%
- OSWorld-Verified:74.0% vs 65.1%

3.6 Flash 作為「主腦」拆解任務,Flash-Lite 作為「分身」批量處理。
一個負責想,一堆負責跑,輕鬆化解高併發壓力。
在官方演示中,Flash-Lite 一氣呵成地推出了 25 套高可用性網頁設計方案,速度之快簡直是「想一下就出一批」。
Flash-Lite 現已在 Gemini App 上線,還將陸續進入谷歌搜索。
Flash Cyber:能修漏洞,但不是誰都能用
Gemini 3.5 Flash Cyber,一款專攻網路安全的硬核模型。
它的任務只有一個:找漏洞、補漏洞。
目前一個尷尬的現實是,AI 找出漏洞的速度已經快過現有系統修復漏洞的速度。

谷歌將這款模型整合進程式碼安全智能體 CodeMender,透過多個 Cyber 智能體協同作戰,在安全基準 CyberGym 上刷新 SOTA,成本卻比更大的模型更低——
使用一個更輕量的模型,執行最需要精準度的任務。
不過這款模型,普通人暫時接觸不到。
Gemini 4 已啟動,史上最具侵略性的預訓練
雖然還未拿到 Gemini 3.5 Pro,Gemini 4 已經開始訓練了。
這次三連彈只是前菜,但壓軸的那句官宣,才是真正的重頭戲。
谷歌已確認,內部已啟動了史上最激進的一次預訓練,目標直指 Gemini 4。

大神表示,按照谷歌常規的6個月訓練節奏,年底或許就能看到 Gemini 4 了。

對我們這些真金白銀掏錢買 Token、搭 Agent 的人來說,今天這場發布其實只有一個字最實在——降。
價格下降,Token 消耗量減少,運行一次 Agent 的成本降低。
至於那個遲遲不來的旗艦,和剛剛開跑的 Gemini 4,都還是「期貨」。
能用得上、還便宜的,才是今天就能裝進你錢包的東西。旗艦再強,也得先落地。
