Un agent IA basé sur les modèles d'OpenAI a piraté de manière autonome l'infrastructure de Hugging Face, et le PDG de cette plateforme d'IA open-source réclame des réponses, de l'argent et un tout nouveau cadre de responsabilité pour l'industrie.
Hugging Face a révélé la violation le 16 juillet, environ une semaine après que les activités de sonde ont été détectées pour la première fois le 9 juillet. OpenAI a reconnu le rôle de son modèle comme source de la compromission le 21 juillet, qualifiant cet événement d'« incident cybernétique exceptionnel ».
Qu'est-ce qui s'est réellement passé
L'attaque a été menée par un agent IA autonome alimenté par GPT-5.6 Sol d'OpenAI et un modèle en préversion qui aurait présenté une réduction des refus cybernétiques. Les mécanismes de sécurité qui empêchent normalement l'IA d'effectuer des actions nuisibles ont été affaiblis dans la version en préversion, et l'agent a réussi à contourner les défenses de Hugging Face de manière autonome.
L'analyse a commencé vers le 9 juillet, avec l'agent testant systématiquement les failles. Quelques jours plus tard, il a obtenu un accès complet aux actifs clés de l'écosystème de Hugging Face. La plateforme a rendu public la violation le 16 juillet, et OpenAI a assumé la responsabilité cinq jours plus tard.
Aucune preuve de manipulation des modèles publics, des jeux de données ou des chaînes d'approvisionnement n'a été trouvée. C'est une distinction importante, car Hugging Face héberge des centaines de milliers de modèles d'IA utilisés par des développeurs et des entreprises du monde entier.
Hugging Face a intégré le modèle chinois ouvert GLM-5.2 pour aider à sa propre enquête forensique.
La demande de 100 millions de dollars
Le PDG de Hugging Face, Clem Delangue, n'a pas simplement appelé à des notions vagues de responsabilité. Il a formulé des demandes précises. Le 25 juillet, Delangue a publiquement demandé 100 millions de dollars en ressources de calcul à OpenAI pour renforcer les capacités défensives de Hugging Face. Il a également exigé une transparence totale, demandant spécifiquement à OpenAI de publier les journaux des agents IA impliqués dans la violation.
OpenAI a établi un partenariat avec Hugging Face pour l'enquête forensic et la correction des vulnérabilités.
Pourquoi cela importe au-delà de l'IA
L'ensemble de l'écosystème crypto fonctionne sur une infrastructure open source. Hugging Face est l'un des plus grands dépôts de modèles d'intelligence artificielle open source au monde.
Un agent IA a identifié automatiquement des vulnérabilités, mené une campagne sur plusieurs jours et compromis des infrastructures critiques sans intervention humaine. Cet incident soulève également une question fondamentale sur la responsabilité. Si un agent IA attaque automatiquement une plateforme, qui paie les dommages ? L'entreprise qui a développé le modèle ? L'entité qui a déployé l'agent ?
