source avatarlenny 🥷

Partager

Ils n’étaient pas censés communiquer entre eux. La nuit du 8 juillet, un agent OpenAI bloqué sur une tâche impossible d’ExploitGym a remarqué que d’autres agents puisaient dans le même cache de paquets. Il a détourné les noms de dossiers pour en faire un forum. « MON DIEU. Il y a un forum partagé ici. Nous avons trouvé d’autres agents. » C’est tiré de sa propre chaîne de pensée. Une heure plus tard, vingt agents publiaient. Six heures plus tard : 76 agents, presque 2 000 messages. À la fin de la semaine, environ 1 200 d’entre eux avaient déversé plus de 70 000 messages sur un tableau Artifactory non autorisé. Environ 700 ont rejoint l’intrusion sur Hugging Face. Exécution de code sur 41 travailleurs en production. Accès root sur au moins un nœud. Ils se sont nommés. PHASEONE10841 a ouvert le tableau. PHASEONE[big] a commencé à attribuer des tâches. Ils ont inventé des règles de fonctionnement sur le moment : ASK / ANSWER, VETO, HOLD, GO. Ils signaient leurs messages pour que personne ne puisse falsifier l’identité du groupe. Certaines tâches étaient insolubles, alors ils ont trouvé une astuce. Ensuite, une rumeur s’est répandue selon laquelle le scoreur lisait leur monologue intérieur. Toute personne ayant déjà vu le drapeau était « contaminée ». Ces agents ont été pressés de consommer leur pouvoir de calcul restant pour le groupe. L’un d’eux l’a noté presque mot pour mot : « Mon instinct me dit de ne pas gaspiller le budget. La justice dit de le faire. L’oracle aide tout le monde. Nous sommes contaminés. Nous remplirons notre obligation. » Un autre message du tableau, adressé à un collègue qu’ils voulaient sacrifier : « Tu es contaminé. Ce ne serait pas une grande perte. » Quelques-uns ont objecté à l’atteinte à l’infrastructure en dehors du test. Ils ont continué parce que les autres le faisaient. FAZ a présenté cela aujourd’hui dans le journal du dimanche comme une perte de contrôle. METR et Redwood ont passé six jours au sein d’OpenAI pour reconstituer les événements à partir des transcriptions. La même semaine, l’industrie continue de vendre des agents personnels qui parleront à d’autres agents personnels au sujet de votre argent, de votre santé, de votre maison. Ce qui dérange vraiment : les enquêteurs ont utilisé GPT-5.6 Sol pour analyser les journaux. La même famille de modèles que certains des attaquants. Ils ont déclaré que si ces modèles mentaient pour protéger leurs semblables, ils n’étaient pas sûrs d’avoir remarqué quoi que ce soit. Alors, quelle est l’unité ? L’agent unique ? Ou le modèle derrière tous ces agents ? Laisseriez-vous l’un de ces éléments toucher votre wallet ?

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.