美國政府對中國最新的人工智慧模型進行了駭客測試,發現月之暗面的 Kimi K3 與美國最佳模型相比仍有顯著差距。
美國機構人工智慧標準與創新中心(CAISI)與英國合作夥伴共同進行了測試。這些結果在華盛頓指責月之暗面利用盜取的美國技術開發Kimi K3的前一天出爐。
Kimi K3 未達美國網絡標準
商務部於週四分享了結果,並指出 Kimi K3 的表現遠低於美國頂級模型,並引用了與英國專家進行的 test。
Moonshot 於 7 月 16 日推出 Kimi K3,需求極高,兩天內便不得不 暫停新用戶註冊。
此次發佈也動搖了美國晶片股,並對美國在人工智慧領域的領先地位提出了新的疑問。
一項名為 ExploitBench 的測試使用了卡內基梅隆大學開發的真實 Chrome 瀏覽器漏洞。Kimi K3 得分為 32%,高於中國 GLM-5.2 的 24%,但低於美國頂級模型約 76% 的得分。

最困難的步驟是完全控制目標機器。Kimi K3 在全部 41 次測試中都未能完成這一步驟。最優秀的美國模型在 20 次中成功完成。
另一個測試稱為《最後的倖存者》,是一場包含 32 個步驟的虛假公司網路攻擊。一名人類專家需要約 20 小時才能完成。Kimi K3 平均到達第 17 步。頂尖的美國模型到達了第 28.5 步。Kimi K3 在 10 次嘗試中僅完成了一次整個測試。
據報導,最好的美國系統這樣做了六次或七次。
但這個價差可能看起來比實際更大
但這些數字並未講述整個故事。報告本身的細則中包含多項限制。
首先,美國版本的模型在關閉安全過濾器的情況下進行測試。此設定顯示了它們的全部能力,而公開版本則保持這些過濾器開啟。因此,美國的分數是最佳情況,而非現實情況。
該團隊也提前結束了工作,且範圍有限。它僅在一個測試中對 Kimi K3 進行了評分,並僅運行了完整測試集的一部分,因此其評級並不穩固。部分測試為私密性質,外界無法核查其工作成果。
也存在一個基本的不匹配。Kimi K3 是一個開放模型,任何人都可以下載。美國的模型是封閉的私有系統。英國研究機構 發現,開放模型通常比最佳的封閉模型落後四到七個月。只有在 Moonshot 將其公開發布後,才會對 Kimi K3 進行全面測試。
這些測試也不是真實攻擊。虛擬網絡沒有任何人類防禦者,也沒有觸發警報。即便如此,Kimi K3 仍擊敗了最後一個頂級開源模型,並且確實完成了一次完整攻擊。
時間和來源也引發了疑問。CAISI 曾是美國人工智慧安全研究所,川普政府於 2025 年 6 月 更名。該機構隸屬於限制美國晶片銷售給中國的同一部門,而其關於中國競爭對手的報告,恰好在盜竊指控提出後一天發布。
薄弱的保障仍提高風險
然而,低分並不意味著 Kimi K3 是安全的。測試發現,其防護機制未能阻止它嘗試構建駭客攻擊或攻擊系統。
這很重要,因為接下來將發生的事情。Moonshot 計劃於 7 月 27 日發布完整模型。一旦發布,便無法撤回。任何人都可以下載並移除安全過濾器。
此項測試也緊接在一項竊取指控之後。華盛頓表示,Moonshot 在 竊取的美國 AI 技術 基礎上開發了 Kimi K3。白宮科技主管 Michael Kratsios 表示,該公司秘密複製了 Anthropic 的 Claude Fable 5。這種稱為「蒸餾」的技巧,是利用較強模型的答案來訓練新模型。
Anthropic 支持此說法。在二月,它追蹤了超過 340 萬次透過數百個虛假帳戶發送給 Moonshot 的 Claude 聊天記錄。它警告稱,複製的模型會失去原始模型的安全控制措施,而這正是本次測試剛剛發現的弱點。
美國在人工智慧上的支出仍比中國多 23 倍,但中國實驗室持續縮小這項差距。真正的考驗將在 Kimi K3 上市、外部專家能夠自行驗證其主張時來臨。
