DeepSeek 推出 V4.1 Flash AI 模型,參數達 5520 億且成本更低

iconCryptoBriefing
分享
AI summary icon精華摘要
DeepSeek 於 9 月 10 日推出 V4.1 Flash AI 模型,提供 5520 億個參數,成本低於主要競爭對手。該模型採用專家混合設計,支援文字、圖像和編碼任務。市場反應顯示恐懼與貪婪指數出現波動,MiniMax、Z.ai 和阿里巴巴的股價均下跌。值得关注的山寨幣可能包括與 AI 基礎設施相關的項目,因為定價變化可能重塑該領域。

DeepSeek 剛剛讓其他參與者在 AI 定價戰中變得更加難受。這家總部位於杭州的初創公司於 9 月 10 日推出了其 V4.1 Flash 模型,推出了一個擁有 5520 億參數的系統,聲稱在性能上超越主要競爭對手,同時運行成本大幅降低。

在任何基準圖表出現在前,市場的即時反應已說明了一切。公告發布後,中國AI競爭對手MiniMax和Z.ai的股價下跌超過8%,而阿里巴巴的股價則下滑超過2%。

什麼讓 V4.1 Flash 不同

該模型採用專家混合架構,這意味著它在執行任何特定任務時僅啟用其總參數中的一小部分。結果是實現了高性能,同時避免了同時啟動所有神經元所帶來的計算開銷。

廣告

DeepSeek 建立了具備原生多模態功能的 V4.1 Flash,意味著它能原生處理文字、圖片及其他資料類型。该公司特別針對編碼任務以及業界所稱的「代理」工作流程進行了優化,其中 AI 系統能自主規劃並執行多步驟流程。

性能聲稱令人矚目,但定價才是真正具有顛覆性的關鍵。DeepSeek 之前的模型,輸入代碼每百萬個標記定價約為 0.14 美元,輸出代碼則為 0.28 美元。早期的 DeepSeek 模型,例如 V4-Flash,運行成本比類似替代方案低超過 100 倍,平均每次測試僅約 3 美分,而 Anthropic 的 Claude Fable 5 則高達 3.15 美元。

V4.1 Flash 預期將以顯著更低的價格點超越 Moonshot 的 Kimi K3。

一種經過計算的干擾模式

該公司的 V3 模型在 2,000 Nvidia H800 GPU 上進行訓練,據報導耗資 5.6 百萬美元。作為對比,美國主要的 AI 實驗室在訓練其旗艦模型時,已花費數億甚至數十億美元。

2025 年,DeepSeek 強調低推理成本和開放存取模型的策略,引發了科技行業的顯著拋售潮。更廣泛的影響不容忽視:儘管面臨美國晶片出口限制,中國的 AI 生態系統仍能生產出世界級的模型。

這對 AI 市場意味著什麼

股市對 V4.1 Flash 發布的反應表明投資者正在認真對待這一威脅。MiniMax 和 Z.ai 的跌幅超過 8%,反映出市場真實擔憂 DeepSeek 的定價策略可能壓縮中國人工智能領域的保證金。即使是業務多元化的阿里巴巴,也感受到了這股震動。

有關 DeepSeek 正為在上海證券交易所科創板上市做準備的報告,為這幅圖景增添了另一層維度。公開上市將使該公司獲得大量資金,並提供一個估值基準,進一步重塑投資者對人工智慧領域的看法。

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露