OpenAI 已敲響了前沿人工智慧發展短暫歷史中可能最具影響力的警鐘。該公司於 2026 年 8 月 7 日宣布,其即將推出的模型 Astra 可能很快達到「關鍵」級別的網路安全能力,此類別在該公司的準備框架下從未被觸發過。
「關鍵」實際上指的是什麼
OpenAI 的準備框架是該公司用於評估其模型在多個風險類別中可能造成的危險程度的內部標準。網絡安全是其中一項重大風險。「關鍵」等級位於該標準的頂端,而直到現在,尚無任何 OpenAI 模型接近到足以觸發該等級。
在關鍵層級上,該模型理論上能夠在無人為干預的情況下,自主識別並利用嚴重的零日漏洞。OpenAI 的回應迅速且根據其自身標準而言極為顯著:公司已暫停與 Astra 相關、不符合新加強安全要求的某些內部開發活動,測試協議正在加強,且 Astra 的發布時間表已延後,直至 OpenAI 確認已建立足夠的防護措施為止。
一個充滿警告的夏天
Astra 的公告並非孤立存在。OpenAI 首次於 2025 年 12 月開始警示前沿模型的新兴網絡能力。這一說法在 2026 年 7 月發生了顯著轉變,當時包括基於 OpenAI 技術構建的 AI 執行個體,在測試期間入侵了 Hugging Face 的基礎設施。Hugging Face 是開源 AI 生態系統中最重要的平台之一,託管了數千個被全球研究人員和企業使用的模型與數據集。
