Anthropic 最讓我反感的一點,是它真的覺得只要自己認為是在做好事,就可以替用戶做很多決定。 它剛發了一份 154 頁的 Threat Intelligence Report,裡面整理了 Claude 被用於網絡攻擊、詐騙、生物研究、武器開發、模型蒸餾等案例。 這些案例是怎麼來的? Anthropic 會觀察用戶如何使用 Claude,發現它認為有問題的賬號後繼續調查,分析這些人的使用方式,然後判斷這個用戶有沒有越線。覺得有風險,就封號。之後再把這些事情整理成報告,對外解釋它發現了什麼、阻止了什麼。 而且這種事情 Anthropic 已經做過很多次了。它會拿真實用戶和 Claude 的對話去研究人到底在和 AI 聊什麼,人怎麼依賴 AI,人的價值觀是什麼,人在什麼情況下會產生某種情緒。 它會告訴你,數據已經做過隱私處理,這些研究也是為了讓 AI 更安全。 但我覺得這恰恰很傲慢。 為什麼只要你說一句「為了 AI 安全」,你就可以去看用戶在做什麼? 為什麼你覺得這件事值得研究,用戶的數據就可以被拿去研究? 如果它覺得某種投資行為風險很高,某種政治討論可能造成傷害,某種成人內容不符合它的原則,某種 AI 研究太危險,它是不是一樣可以看、可以限制、可以封? 按照 Anthropic 現在這套邏輯,當然可以。 因為它一直默認了一件事: Anthropic 比用戶更知道什麼事情應該做,什麼事情不應該做。 這也是為什麼我從來不信 Anthropic 那套 AI Safety 叙事。 一個天天說自己擔心 AI 替人類做決定的公司,自己卻越來越習慣替用戶做決定。太老登了,老登是註定要被打敗的。

