本週二晚间, DeepSeek 開放平台發佈公告,計劃再次調整大模型 API 定價,這次是喜聞樂見的降價。

閒置時段價格統一為:輸入(快取命中)0.02 元、輸入(快取未命中)1 元、輸出 4 元(單位均為元 / 百萬 token)。高峰時段價格仍為閒置時段的兩倍,即快取命中 0.04 元、快取未命中 2 元、輸出 8 元。

本次調整僅涉及 V4-Flash 系列,定位更高的 V4-Pro 價格維持不變。新價格將於北京時間 9 月 10 日 12:00 生效。
官方同時明確,高峰時段為北京時間週一至週五 9:00–12:00、14:00–18:00,其餘為空閒時段。
此前, DeepSeek 的漲價引發了廣泛討論。官方給出的解釋是為了更合理地調配資源,鼓勵用戶調整任務執行時間。外界則普遍認為是 DeepSeek V4 Flash 0731 性價比很高,吸引了全球用戶的大量調用,以及 DeepSeek 算力不足。
縱向對比,8 月 17 日零時漲價前,Flash 的統一價格為 0.02 元(快取命中)/ 1 元(未命中)/ 2 元(輸出)。將此次的新價格列於下方:

也就是說,輸入側的兩項價格回到了漲價前的水平,輸出仍是漲價前的兩倍。若按高峰時段計算差距則更大:新高峰價 0.04 / 2 / 8 元,對比漲價前的 0.02 / 1 / 2 元,分別是 2 倍、2 倍和 4 倍。
因此,用戶能否真正回到過去「放開了用」的狀態,取決於自身應用的三個變量:快取命中率、輸入輸出比例,以及任務可錯峰的程度。對於長上下文、固定系統提示詞、Agent 循環調用這類快取命中率高的場景,降幅會很明顯;對於以生成輸出為主的場景,感受有限。众所周知 DeepSeek The API cache hit rate is relatively high, so the current feedback from users is quite optimistic.
本次降價並非孤立事件,昨天下午, DeepSeek 在官方交流群宣布 V4.1 Flash 中間版本開啟內測:模型名為 deepseek-v4.1-flash-expires-on-0910,base_url 不變,每帳號限流 20 並發,計費暫與 V4 Flash 相同。
新模型除了原生多模態、極快的推理速度之外,官方還表示通過架構的升級讓成本更低。可見通過大模型本身的工程與技術優化, DeepSeek 我們一直致力於改善推理成本的問題。
expires-on-0910 這個模型名稱表示,新模型將於 9 月 10 日自動過期下線——與降價生效日期相同。
這個月,前沿 AI 公司紛紛更新了自己的大模型, DeepSeek V4.1 正式版如果能夠帶來明顯的能力躍升,配合這次降價,或許可以再來一波大的。
本文來自微信公眾號「機器之心」(ID:almosthuman2014),作者:關注大模型的機器之心,編輯:機器之心編輯部
