7月17日,月之暗面發布Kimi K3大模型,參數規模達2.8萬億,擁有100萬token上下文窗口,原生支援視覺理解,搭載自研KDA注意力算法。馬斯克隨即評價“令人印象深刻”,但隔天便宣布xAI正在訓練2萬億參數新模型試圖超越Kimi。面對挑戰,月之暗面以“歡迎加入2萬億+俱樂部”幽默回應,凸顯2.8萬億參數的先發優勢。這場隔空互動展現兩家AI企業的技術角力,也反映中國AI力量在全球大模型競爭中的崛起。文章作者、來源:華爾街見聞
於7月17日凌晨,月之暗面正式發佈新一代大模型 Kimi K3。該模型參數規模達 2.8 萬億,擁有 100 萬 token 上下文窗口,原生支援視覺理解,月之暗面稱其為「迄今能力最強的模型」。

多項海外 AI 評測榜單數據顯示,Kimi K3 在代碼生成、長文本邏輯推理、多文檔處理等測試項目中排名靠前。官方披露,Kimi K3 搭載自研 KDA 注意力算法,擁有 896 個獨立專家模塊,單次計算激活 16 個單元,算力使用效率較前代產品提升 2.5 倍。公司計劃於 7 月 27 日完整開源 Kimi K3 模型權重,面向全球開發者開放商用權限。
On the day the report on Kimi K3 was released, Musk left a comment on the report’s comment section, describing the model as “impressive”.
這是今年以來馬斯克第二次公開肯定 Kimi 團隊的技術能力。3 月時,月之暗面發布《Attention Residuals》論文,提出「注意力殘差」機制,旨在替代傳統 Transformer 架構中的殘差連接,解決深層網路資訊稀釋問題。
當時,馬斯克在 X 平台轉發該論文並評論:「Kimi 的工作令人印象深刻」。隨後,月之暗面 Kimi 官方以一句「你的火箭造得也不錯!」幽默回應,這場隔空互動被視為頂尖技術者的惺惺相惜,同時也開啟了雙方後續的良性互動模式。
不過,剛表揚完 Kimi K3 不久,馬斯克便開始「隔空放狠話」,展示旗下產品的競爭力。
7月18日,馬斯克於社交平台 X 發布內容,披露 xAI 的研發計劃,當前訓練參數規模為 2 兆的 Grok 4.6 大模型,計劃在一周內完成首輪完整訓練,新版本性能相較 1.5 兆參數的 Grok 4.5 有所提升,馬斯克在文中提及該模型有望實現對 Kimi 的性能超越。
馬斯克於2023年成立 AI 企業 xAI,團隊成員主要來自 OpenAI、Google DeepMind、Meta 等機構,核心產品 Grok 系列大模型同步啟動研發,產品深度聯動 X 社交平台、特斯拉、SpaceX 生態。
2023 年 8 月,xAI 完成初代基礎模型 Grok-0 的訓練,參數規模為 330 億;同年 11 月 5 日,首款面向用戶的 Grok 正式發布,接入 X 平台 Premium + 付費訂閱體系,支援聯網調取 X 實時資訊流,主打無過度約束的對話風格。
2024 年 3 月,xAI 推出 Grok-1,參數規模 3140 億,遵循 Apache 2.0 協議開源完整模型權重;同月迭代至 Grok-1.5,將上下文窗口擴展至 128K Token,優化長文本推理能力;4 月發布 Grok-1.5V,新增圖像視覺處理能力。同年 8 月,多模態版本 Grok 2 上線,同步推出輕量化版本 Grok 2 mini,覆蓋通用對話、代碼編寫、圖文分析場景,同期 xAI 自建 Colossus 超算集群投入模型訓練。
2025 年 2 月,xAI 發布 Grok 3,基於十萬塊英偉達 H100 芯片的算力完成訓練,官方披露其推理與多模態綜合性能大幅提升;7 月推出 Grok 4,分為標準版與 Grok 4 Heavy 多智能體版本,最高支援 256K 上下文視窗,新增多音色語音互動與影片基礎解析能力。原定規劃的 Grok 3.5 版本後續取消研發計畫,技術路線併入 Grok 4 系列迭代體系。
2026 年,Grok 進入萬億參數模型研發階段。5 月,xAI 完成 1.5 萬億參數 V9-Medium 基座模型訓練,訓練過程導入代碼工具 Cursor 行業數據,側重工程編程場景優化;6 月 28 日,基於該基座打造的 Grok 4.5 啟動特斯拉、SpaceX 內部封閉測試,7 月 8 日面向開發者與付費用戶全面開放 API 調用服務。
面對馬斯克的隔空「宣戰」,月之暗面官方微博賬號「月之暗面 Kimi」直接 @ElonMusk,並發文:歡迎加入 2 萬億 + 俱樂部。此次,月之暗面簡短回應,用「俱樂部」一詞釋放出開放競爭姿態,而潛台詞則指出 Kimi K3 實際已擁有 2.8 萬億參數,清晰凸顯自身先發優勢。有網友說,當馬斯克說出「可能超越Kimi」時,贏家就是Kimi了。
此次「隔空喊話」背後,也折射出全球 AI 行業競爭格局的發展轉變。最初全球大模型技術對標基準長期由 OpenAI、Anthropic 等矽谷企業主導,近兩年 DeepSeek、GLM、Kimi 等國產大模型持續更新迭代,站上全球技術競爭的核心舞台。
公開資訊顯示,月之暗面的工商主體為北京月之暗面科技有限公司,海外品牌名為 Moonshot AI,於 2023 年在北京註冊成立,法定代表人及 CEO 為楊植麟。楊植麟擁有清華大學學士學位及卡內基梅隆大學計算機博士學位,是 Transformer-XL 和 XLNet 兩大經典預訓練框架的核心發明人,曾任職於 Google Brain 和 Meta AI 人工智慧研發部門。
公司成立後持續完成多輪大額融資,投資方包括阿里、騰訊、美團龍珠、紅杉中國、高榕資本等機構。
2023 年 10 月,月之暗面推出首款 C 端智能助手 Kimi Chat,並發布初代 8K 上下文基礎模型,同時上線支援 20 萬漢字的超長文本讀取功能;2025 年 1 月,公司發布 K1.5 基座模型,在數學運算、代碼生成與多模態推理方面完成升級;同年 4 月開源 160 億參數圖文模型 Kimi-VL;7 月發布萬億參數混合專家架構 K2 系列基座模型,上下文窗口達 256K Token 並對外開源。2026 年 1 月,月之暗面發布 K2.5 多模態開源模型,整合視覺、代碼與智能體能力,同步上線程式設計工具 Kimi Code;7 月 17 日正式發布當前旗艦基座 Kimi K3。
7月17日,月之暗面發布Kimi K3大模型,參數規模達2.8萬億,擁有100萬token上下文窗口,原生支援視覺理解,搭載自研KDA注意力算法。馬斯克隨即評價“令人印象深刻”,但隔天便宣布xAI正在訓練2萬億參數新模型試圖超越Kimi。面對挑戰,月之暗面以“歡迎加入2萬億+俱樂部”幽默回應,凸顯2.8萬億參數的先發優勢。這場隔空互動展現兩家AI企業的技術角力,也反映中國AI力量在全球大模型競爭中的崛起。文章來源:界面新聞
