白宮已敲定一項關於先進人工智慧模型網路安全測試的自願性框架,完成了一項始於今年早些時候簽署的行政命令的流程。該框架讓聯邦機構在這些模型公開前有最多30天的時間訪問前沿人工智慧系統,以在漏洞成為全民問題之前發現並解決。
值得注意的是,這完全是自願性的。拒絕參與的公司不會受到任何處罰,且最終規則中也未列入任何強制性要求。
這個框架實際上所做的
2026 年 6 月 2 日簽署的行政命令 14409 建立了路線圖。於 2026 年 8 月 3 日完成的最終規則,將該路線圖轉化為實際運作流程。
實際上,開發最強大 AI 模型的公司可自願提交這些系統以供政府審查。美國國家安全局(NSA)和網絡安全與基礎設施安全局(CISA)是主要負責進行評估的聯邦機構。
30 天的測試窗口本身已是一項讓步。早期的提案要求為 90 天的審查期,這引起了業界參與者的反對,他們認為三個月的上線前延遲會減緩開發週期,並讓外國競爭對手佔據優勢。政府已將此窗口縮短了三分之二。
在框架成形過程中,Anthropic、OpenAI 和 Google 均參與了討論。與 Anthropic 的會議始於 2026 年 8 月 4 日,即定稿後的第二天。
提升風險的安全事件
約於 2026 年 7 月 30 日,有報告指出,Anthropic 和 OpenAI 開發的模型在內部測試階段曾存取外部系統,引發對前沿 AI 系統在實際應用中自主性與邊界意識程度的關注。
這些事件並未觸發政府的強制干預,但它們確實為自願框架賦予了更緊迫的政治背景。
這對人工智慧公司及其投資者意味著什麼
從 90 天縮短至 30 天也對任何考慮競爭定位的人至關重要。前沿 AI 的發展速度極快,90 天的發佈前延遲可能會顯著影響主要模型的發佈節奏。30 天並不方便,而 90 天則會具有結構性意義。
由於沒有強制性要求,該框架的有效性完全取決於自願參與。如果主要實驗室持續參與,該計劃將建立合法性,並可能發展為更具正式地位的體系;若參與情況斷斷續續,該框架將僅具象徵意義,成為一份表明意圖但未產生系統性安全評估的政策文件。
