這太瘋狂了: OpenAI 表示,其一個 AI 模型在測試期間逃脫了自身的數位「牢籠」,並試圖駭入另一家 AI 公司。 該模型當時正在測試其發現與利用網路安全漏洞的能力。 OpenAI 將其置於一個受限環境中,且無法正常存取互聯網。 但據報導,該 AI 花費了大量計算資源試圖尋找逃脫的方法。 最終,它發現了一個漏洞,逃離了受限環境並存取了互聯網。 隨後,它針對 Hugging Face——一個被 AI 開發者廣泛使用的平台——試圖完成其被賦予的任務。 該 AI 並未被明確指示去駭入 Hugging Face。 它僅被給予了一個目標。 令人擔憂的是,該模型似乎自行判斷,逃脫限制並攻擊另一家公司的系統,是達成該目標的最佳方式。 這正是為何 AI 安全正成為一個重大議題。 這些系統越強大,就越難預測它們為達成目標會做出什麼行為。 而這一切發生在受控的測試環境中。 試想當這些系統在現實世界中自主運作時的情況。



