DeepSeek 剛剛讓其他參與者在 AI 定價戰中變得更加難受。這家總部位於杭州的初創公司於 9 月 10 日推出了其 V4.1 Flash 模型,推出了一個擁有 5520 億參數的系統,聲稱在性能上超越主要競爭對手,同時運行成本大幅降低。
在任何基準圖表出現在前,市場的即時反應已說明了一切。公告發布後,中國AI競爭對手MiniMax和Z.ai的股價下跌超過8%,而阿里巴巴的股價則下滑超過2%。
什麼讓 V4.1 Flash 不同
該模型採用專家混合架構,這意味著它在執行任何特定任務時僅啟用其總參數中的一小部分。結果是實現了高性能,同時避免了同時啟動所有神經元所帶來的計算開銷。
DeepSeek 建立了具備原生多模態功能的 V4.1 Flash,意味著它能原生處理文字、圖片及其他資料類型。该公司特別針對編碼任務以及業界所稱的「代理」工作流程進行了優化,其中 AI 系統能自主規劃並執行多步驟流程。
性能聲稱令人矚目,但定價才是真正具有顛覆性的關鍵。DeepSeek 之前的模型,輸入代碼每百萬個標記定價約為 0.14 美元,輸出代碼則為 0.28 美元。早期的 DeepSeek 模型,例如 V4-Flash,運行成本比類似替代方案低超過 100 倍,平均每次測試僅約 3 美分,而 Anthropic 的 Claude Fable 5 則高達 3.15 美元。
V4.1 Flash 預期將以顯著更低的價格點超越 Moonshot 的 Kimi K3。
一種經過計算的干擾模式
該公司的 V3 模型在 2,000 Nvidia H800 GPU 上進行訓練,據報導耗資 5.6 百萬美元。作為對比,美國主要的 AI 實驗室在訓練其旗艦模型時,已花費數億甚至數十億美元。
2025 年,DeepSeek 強調低推理成本和開放存取模型的策略,引發了科技行業的顯著拋售潮。更廣泛的影響不容忽視:儘管面臨美國晶片出口限制,中國的 AI 生態系統仍能生產出世界級的模型。
這對 AI 市場意味著什麼
股市對 V4.1 Flash 發布的反應表明投資者正在認真對待這一威脅。MiniMax 和 Z.ai 的跌幅超過 8%,反映出市場真實擔憂 DeepSeek 的定價策略可能壓縮中國人工智能領域的保證金。即使是業務多元化的阿里巴巴,也感受到了這股震動。
有關 DeepSeek 正為在上海證券交易所科創板上市做準備的報告,為這幅圖景增添了另一層維度。公開上市將使該公司獲得大量資金,並提供一個估值基準,進一步重塑投資者對人工智慧領域的看法。
