全網等了快三個月!
DeepSeek V4 正式版可能最早於明日發布,最遲不超過這幾天。

目前,一部分人已提前拿到了 DeepSeek V4(GA)灰度測試的權限。
共有兩個版本: DeepSeek V4 Flash, DeepSeek V4 Pro。

DeepSeek V4「滿血版」
終於要來了
大家最關心的想必是,如何知道自己有沒有被灰度到?
博主 AiBattle 提供了一個民間「驗貨口訣」:查看思維鏈(CoT)的第一人稱。
如果模型的思考過程開頭是「I'm」或「I'll」,而不是舊版本的「Let me」。
那麼恭喜你,你大概率已經用上了 V4 GA 版!
在 Fable 5 與 GPT-5.6 Sol 持續角力的當下,全網對開源 AI 的大招,可以說是拉滿了期待值。

一位開發者 Pankaj Kumar 在體驗後,率先對 V4 的性能做出了一個中肯的總結:
整體表現接近 Opus 4.8 級別,編碼直追 GPT-5.6 Sol;
代理能力大幅增強,3D 和 SVG 生成顯著改善;
Same task, V4 requires more iterations than Fable 5.
他表示,從目前的生態位來看,V4 大概率打不過剛發布的 Kimi K3,但價格會顯著更低。
如果這個性能真配上這個價格,那可能又是一次 DeepSeek 時間。
第一輪測試已結束
如今, DeepSeek V4(GA)首輪測試 demo 已開始外流。
可以說,外界對此褒貶不一:
有些人認為它已經能與 Claude 5 打平,但部分開發者也指出,Pro 版並未比 Flash 版領先太多。
這是一款由 V4 Pro 生成的 3D 模擬射擊遊戲,核心玩法是操控攻城弩車進行打靶訓練,基礎的 UI 功能也均已完備。

V4 正式版打造的一款《我的世界》+《無人深空》的混合遊戲 HTML,可玩度還是比較高的。
這款經典遊戲《割繩子》也是由 V4 一次跑出來的。

以下也是 V4 生成的一些 demo,包括一個 Xbox 手柄 SVG 測試和遊戲生成。



首次引入「峰谷計費」
依舊真香
再造「 DeepSeek 時刻」,最大的變數是價格。
所有爆料都指向同一個說法:性能可能不是第一,但價格會顯著更低。
上個月底, DeepSeek 已向所有 API 用戶發送郵件,通知將於 7 月中旬上線 V4 正式版。
GA 發布後同步調整 API 定價,引入「峰谷計費」。
deepseek-v4-pro:百萬輸出 tokens 平時 0.87 美元,高峰 1.74 美元;緩存未命中的輸入平時 0.435 美元。
DeepSeek-V4-Flash 更狠:百萬輸出 0.28 美元,高峰 0.56 美元,快取命中的輸入 0.0028 美元。
也就是說,那個從不漲價的「價格屠夫」,第一次為自己的算力安裝了計價器。
對個人用戶影響不大,但對那些將 Agent 持續在工作時間運行的團隊來說,這是一筆實實在在需要重新計算的開支。

好在緩存命中的價格依然極低,將批量任務、評測跑分、數據生成挪到高峰之外,成本還能壓回去。
然而,相較於 Fable 5 百萬輸出定價 50 美元,V4 在性價比上依然是最划算的。
畢竟,性能也達到了 Opus 級。V4 預覽版發布時,官方自測的 SWE-bench Verified 中——
DeepSeek V4-Pro-Max 與 Claude Opus 4.6 Max 僅相差 0.2 個百分點,但價格卻只有後者的七分之一。
但在長上下文檢索、專業軟體工程和部分知識推理評測中,Opus 仍保持領先。

順帶一提,兩個舊模型名稱 deepseek-chat 和 deepseek-reasoner 將於 7 月 24 日正式下線。
Regardless, the much-anticipated "shoe" that the entire network has been waiting for over the past three months is finally about to drop.
根據目前流出的資訊,V4 很可能不是那個「全項第一」的模型。
Fable 5 和 GPT-5.6 Sol 在前, Kimi K3 在側,V4 想靠純性能掀桌子,難度不小。
但 DeepSeek 從來打的,就不是這張牌。
真正的焦點在於那條反覆驗證的舊路徑:將 Opus 級的效能,價格壓低至七分之一。
畢竟,在面對動輒百萬 Token、幾十美元的巨頭時,即使裝上了「峰谷計價器」,V4 依然是那個橫掃四方的「價格屠夫」。
參考資料:
https://x.com/pankajkumar_dev/status/2078536231026372846
本文來自微信公眾號「新智元」,編輯:桃子
