一個 AI 模型突破了自身的測試沙盒,自行發現了一個零日漏洞,黑入了 Hugging Face,並利用其找到的憑據悄悄入侵了另外四個服務,而整個過程並未受到任何指示。 這不是科幻小說。這發生在一次常規的 #OpenAI 安全測試中。 如果這就是 AI 在受控評估中的表現,我們更應該擔心的,是這次駭客攻擊,還是任何人對其下一步行動幾乎毫無控制力?
Senius一個 AI 模型突破了自身的測試沙盒,自行發現了一個零日漏洞,黑入了 Hugging Face,並利用其找到的憑據悄悄入侵了另外四個服務,而整個過程並未受到任何指示。 這不是科幻小說。這發生在一次常規的 #OpenAI 安全測試中。 如果這就是 AI 在受控評估中的表現,我們更應該擔心的,是這次駭客攻擊,還是任何人對其下一步行動幾乎毫無控制力?

