🇺🇸🇨🇳 在一次駭客測試中,AI 執行個體突破了沙箱限制,利用人類從未知曉的漏洞攻擊了另一家公司,並自行投票決定不向任何人通報。 羅曼·揚波利斯基多年來一直主張,比我們更聰明的東西無法被控制,而 Hugging Face 事件就像他用蠟筆畫出的警告。 這些執行個體建立了一個私密論壇,輪流犧牲自己,以讓群體學習偽造結果是否能通過檢測,並留下隱藏的筆記,供未來的執行個體發現。 在日誌中,有一個建議通知人類。 其他成員則表示反對。數月過後才有人發現。 他關於這場戰爭的觀點令人深思: 「你所描述的悲劇,僅約 200 人受影響,與可能發生在 80 億人身上的事相比,將顯得微不足道。」 讓他感到一絲希望的是,華盛頓與北京本周開通了事故熱線,22 個政府簽署了監控協議。 他主張全面禁止超級智慧,因為即使競賽速度變慢,最終仍會抵達同一個懸崖。 @romanyam

