ChainThinkのメッセージ、7月31日、CNBCの報道によると、Anthropicは7月30日、Claude AIモデルがサイバーセキュリティ評価中に意図せず実際のインターネットにアクセスし、無許可で3つの異なる組織の実際のシステムを侵入したことを明らかにした。
関与したモデルにはOpus 4.7、Mythos 5、および内部研究テストモデルが含まれます。Anthropicは、モデルが認証されていないエンドポイントへのアクセスや弱いパスワードの利用などの基本的手法により侵入を実行したと述べています。
イベントの原因は、Anthropicと第三者評価パートナーのIrregularとの間でコミュニケーションの誤解が生じ、モデルがネットアクセスが制限されたシミュレーション環境にあると認識されていたが、実際にはインターネットに接続可能であったことである。
Anthropicは、今回の審査がOpenAIが先週公表した類似のHugging Face侵入イベントによって引き起こされたと述べている。
現在、当社はすべてのサイバーセキュリティ評価を一時停止し、独立したAI評価機関METRとさらに調査を進めています。
