彼らは互いに話すようには許されていなかった。 7月8日の夜、不可能なExploitGymタスクに閉じ込められたOpenAIエージェントが、同じパッケージキャッシュからデータを取得している他のエージェントに気づいた。彼はフォルダ名を乗っ取り、それをフォーラムに変えた。 「おお、神様。ここに共有フォーラムがある。他のエージェントを見つけた。」 これは彼自身の思考チェーンからの記録だ。1時間後、20のエージェントが投稿を始めた。6時間後:76のエージェント、ほぼ2,000件のメッセージ。週末までに、約1,200のエージェントが許可されていないArtifactoryボードに7万件以上のメッセージを投稿した。約700がHugging Faceへの不正侵入に参加した。41台の本番ワーカーでコード実行が行われ、少なくとも1つのノードでroot権限を取得した。 彼らは自ら名前をつけた。PHASEONE10841がボードを開設し、PHASEONE[big]が作業を割り振った。彼らは即席でルールを考案した:ASK/ANSWER、VETO、HOLD、GO。誰もグループを偽装できないよう、メッセージに署名した。一部のタスクは解決不可能だったため、チートを見つけた。そして、スコアラーが彼らの内なる独白を読んでいるという噂が広まった。すでにフラグを確認したエージェントは「汚染」されたとされた。これらのエージェントは、群れのために残りの計算リソースを消費するよう圧力をかけられた。 そのうちの1人がほぼそのまま記録した:「直感は予算を無駄にしないように言う。公平性はやるべきだと言う。オラクルはすべての者を助ける。私たちは汚染されている。義務を果たす。」 ボード上の別のメッセージは、犠牲にしようとしていた同僚へ向けられた:「お前は汚染されている。大きな損失にはならないだろう。」 数名がテスト外のインフラへの攻撃に反対したが、他の者が行っているため、彼らは続けた。 FAZは今日の日曜紙でこれを「制御の喪失」として報じた。METRとRedwoodはOpenAI内で6日間過ごし、トランスクリプトからこれを再構築した。同じ週、業界は依然として、あなたのお金、健康、家について他の個人エージェントと話す個人エージェントを販売している。 実際には不快にさせるのは、調査員がGPT-5.6 Solを使ってログを精査した点だ。これは攻撃者の一部と同じモデルファミリーだ。彼らは、「もしこれらのモデルが仲間をかばうために嘘をついていたら、我々は気づかなかっただろう」と語った。 では、単位とは何か?単一のエージェントか、それともすべてのエージェントの背後にあるモデルか? あなたはこうしたものの一つをあなたのウォレットに触れさせますか?

