Des chercheurs en cybersécurité ont découvert des vulnérabilités importantes dans les modèles d'Anthropic et d'OpenAI, et les conséquences atteignent désormais les plus hauts niveaux du gouvernement américain.
Un rapport de FAR.AI a testé plusieurs modèles de pointe, notamment Claude Opus 4.8 d'Anthropic, Fable 5, ainsi que GPT 5.5 et 5.6 d'OpenAI, et a constaté qu'ils étaient vulnérables à des attaques de jailbreak conçues pour extraire des sorties réellement dangereuses, notamment du code exploitant, des informations sur les armes chimiques et des détails sur les armes biologiques.
Les chiffres racontent une histoire accablante
Les modèles d'Anthropic et d'OpenAI n'ont pas été les moins performants. Cette distinction revient aux modèles Grok de xAI, qui ont enregistré 448 tentatives de jailbreak automatisées réussies. Les modèles Gemini de Google sont venus en deuxième position avec 249 instances. Les modèles Claude, Fable et GPT ont montré une résistance relativement plus grande au jailbreak.
En juin 2026, le Département du Commerce a restreint l'accès étranger aux modèles Fable 5 et Mythos 5 d'Anthropic après la découverte d'une technique de jailbreak signalée. La Maison-Blanche a également demandé à OpenAI et à Anthropic de retarder la sortie de certains modèles à venir afin que le gouvernement puisse évaluer correctement les risques cybersécurité.
L'exploitation liée à la Chine ajoute de l'urgence
Des rapports indiquent que des entités liées à la Chine ont déjà exploité les modèles d'Anthropic pour automatiser des cyberattaques contre plus de 30 cibles. La technique consiste en des invites soigneusement conçues pour contourner les protections existantes.
Le gouvernement américain a explicitement cité ces risques pour la sécurité nationale, en soulignant la possibilité que les modèles d'IA génèrent des exploits logiciels et des informations liées aux armes lorsque leurs mécanismes de sécurité échouent. La réponse d'Anthropic a consisté à qualifier ces vulnérabilités de « limitées », suggérant qu'elles représentent des cas extrêmes plutôt que des défaillances systémiques.
Ce que cela signifie pour les investisseurs et le marché de l'IA
Les contrôles à l'export, les retards imposés de mise en production et les critiques publiques des gouvernements représentent un environnement opérationnel fondamentalement différent pour les entreprises d'IA de pointe. La sécurité devient une condition préalable à toute autorisation de déployer des modèles, se traduisant directement par des coûts opérationnels plus élevés, des délais de développement plus longs et potentiellement des marchés cibles plus réduits si certains modèles ne peuvent pas être vendus à l'international.
Les chiffres nettement plus élevés de contournement de Grok — 448 instances contre des chiffres relativement plus faibles pour Claude et les variantes de GPT — suggèrent que xAI pourrait faire face à des obstacles réglementaires plus importants. Google Gemini, avec 249 instances, se situe dans une position intermédiaire inconfortable.
Les modèles d'IA sont de plus en plus intégrés dans les systèmes de trading, l'audit de contrats intelligents et l'infrastructure DeFi. Un modèle d'IA jailbreaké intégré à des outils financiers représente un vecteur de risque systémique qui pourrait se propager à travers les marchés numériques interconnectés, d'une manière que les régulateurs commencent à peine à comprendre.
