一位 27 歲的英國研究員,曾於 Anthropic 專注於預訓練工作,已公開辭職,警告稱競相開發遞歸自我改進的人工智慧,可能導致人類在本十年內滅絕。
雅各布·考森於大約9月8日至9日離開了全球最著名的AI安全公司之一,他的離職訊息並非一則關於「令人興奮的新篇章」的禮貌性領英貼文,而是一則警告:這些系統的建設者們真誠地相信,他們可能製造出災難性的後果,而情況失控的時間表可能早在明年就會出現。
內部警報
科克森辭職尤其難以忽視的原因,在於隨後發生的事。他在 Anthropic 的同事們開始公開支持他的觀點。
安特羅普的對齊科學負責人伊萬·胡賓格在社群媒體上支持科克森的說法。他個人估計:未來十年內,人工智慧導致大規模人類死亡的機率超過 10%。
胡賓格更進一步承認,Anthropic 缺乏確保與超智能系統對齊的明確計劃。
另一名 Anthropic 的研究員塞繆爾·馬克斯也提出了類似的擔憂,指出公司高層員工特別擔心滅絕級風險。
科克森特別批評了人工智能開發圈內使用「crunchtime」和「endgame」等詞語。這些詞語將追求超智能描繪成一種緊迫且不可避免的任務,是一場需要贏得的競賽,而非需要管理的風險。他認為,這種表述本身就是問題的一部分。
一組退出模式
科克森並非首位因擔憂公司方向而離開 Anthropic 的專注於安全的研究人員。曾領導公司保障研究團隊的米拉南克·夏爾馬於 2026 年 2 月辭職。夏爾馬指出,人工智能和生物武器帶來的危險日益加劇,並援引了他認為損害公司道德行為的外部壓力。
諷刺的是,Anthropic 由前 OpenAI 員工創立,包括首席執行官 Dario Amodei,正是因為他們認為 OpenAI 對安全問題不夠重視。它本應是以安全為首的替代選擇,但如今其自身的安全研究人員卻因認為 Anthropic 對安全問題不夠重視而離職。
競賽作為加速器
科克森的警告特別指出,國際競爭是使情況惡化的一個因素。與對手,尤其是中國人工智慧實驗室保持同步的壓力,創造了一種環境,使得放慢腳步以確保安全看起來像是單方面解除武裝。
