Le test cybernétique américain montre que Kimi K3 est en retard par rapport aux principaux modèles d'IA américains

iconBeInCrypto
Partager
AI summary iconRésumé
Une évaluation du gouvernement américain a révélé que Kimi K3, développé par Moonshot AI, est en retard par rapport aux principaux modèles d'IA américains en matière de capacités cybernétiques. Le test mené par le Center for AI Standards and Innovation (CAISI) avec un partenaire britannique a montré que Kimi K3 a obtenu 32 % au test ExploitBench, contre 76 % pour les modèles américains leaders. Il n'a pas réussi à contrôler complètement une machine cible dans les 41 tests, tandis que les meilleurs modèles américains y sont parvenus dans 20 cas. Ces résultats interviennent après que des responsables américains ont accusé Moonshot d'avoir utilisé des technologies américaines volées pour Kimi K3. Les résultats pourraient avoir un impact sur les efforts CFT et s'aligner sur l'accent mis par MiCA sur la transparence technologique.

Le gouvernement américain a soumis le plus récent modèle d'IA de Chine à un test de piratage. Il a constaté que le Kimi K3 de Moonshot AI est bien inférieur aux meilleurs modèles américains.

Le Center for AI Standards and Innovation (CAISI), une agence américaine, a mené les tests avec un partenaire britannique. Les résultats sont arrivés un jour seulement après que Washington ait accusé Moonshot d'avoir construit Kimi K3 avec des technologies américaines volées.

Sponsorisé
Sponsorisé

Kimi K3 ne répond pas aux critères américains en matière de cybersécurité

Le Département du Commerce a partagé les résultats jeudi. Il a indiqué que Kimi K3 se classait bien en dessous des principaux modèles américains, en citant un test conjoint avec des experts britanniques.

Moonshot a lancé Kimi K3 le 16 juillet. La demande était si élevée qu'elle a dû mettre en pause les nouvelles inscriptions en deux jours.

Le lancement a également secoué les actions américaines de semi-conducteurs et soulevé de nouvelles doutes sur la suprématie américaine en matière d'IA.

Un test, appelé ExploitBench, utilise des vulnérabilités réelles du navigateur Chrome développées par l'Université Carnegie Mellon. Kimi K3 a obtenu 32 %. Cela dépasse GLM-5.2 de la Chine, qui a obtenu 24 %. Toutefois, il est en retard par rapport aux meilleurs modèles américains, qui ont atteint environ 76 %.

Capacité de développement d'exploits
Test sur les métriques de capacité de développement d'exploits. Source : NIST
Sponsorisé
Sponsorisé

L'étape la plus difficile consiste à prendre le contrôle total d'une machine cible. Kimi K3 a échoué à cette étape lors des 41 tests. Les meilleurs modèles américains y sont parvenus à 20 reprises.

Un autre test, appelé The Last Ones, est une attaque simulée sur un réseau d'entreprise comprenant 32 étapes. Un expert humain nécessite environ 20 heures pour le terminer. Kimi K3 a atteint en moyenne l'étape 17. Les meilleurs modèles américains ont atteint l'étape 28,5. Kimi K3 a terminé l'ensemble du test uniquement une fois sur 10 essais.

Les meilleurs systèmes américains l'auraient fait six ou sept fois.

Mais l'écart peut sembler plus grand qu'il ne l'est

Mais les chiffres ne racontent pas toute l'histoire. Les petites impressions du rapport contiennent plusieurs pièges.

Tout d'abord, les modèles américains ont été testés avec leurs filtres de sécurité désactivés. Ce paramètre révèle leur pleine puissance. Les versions publiques gardent ces filtres activés. Les scores américains représentent donc un scénario optimal, pas la réalité.

L'équipe a également interrompu prématurément les tests et les a limités. Elle a évalué Kimi K3 sur un seul test et n'a exécuté qu'une partie de l'ensemble complet. Son évaluation est donc peu fiable. Certains tests sont également privés, ce qui empêche les externes de vérifier le travail.

Il existe également un décalage de base. Kimi K3 est un modèle ouvert que quiconque peut télécharger. Les modèles américains sont des systèmes verrouillés et privés. L'institut britannique avait constaté que les modèles ouverts sont généralement en retard de quatre à sept mois par rapport aux meilleurs modèles fermés. Il ne soumettra Kimi K3 à un test complet qu'après sa mise à disposition publique par Moonshot.

Ces tests ne sont pas non plus de véritables attaques. Le réseau factice n'avait aucun défenseur humain ni alarmes à déclencher. Malgré tout, Kimi K3 a surpassé le dernier meilleur modèle ouvert. Et il a bien mené une attaque complète une fois.

Le timing et la source soulèvent également des questions. CAISI était autrefois l'Institut américain pour la sécurité de l'IA. L'administration Trump l'a rebaptisé en juin 2025. Il se trouve dans le même département qui limite les ventes de puces américaines à la Chine. Et son rapport sur un concurrent chinois est paru un jour seulement après la revendication de vol.

Mesures de protection faibles augmentent toujours les enjeux

Pourtant, de faibles notes ne signifient pas que Kimi K3 est sûr. Le test a révélé que ses mécanismes de protection n'ont pas empêché l'IA d'essayer de créer des piratages ou d'attaquer des systèmes.

Cela importe en raison de ce qui suit. Moonshot prévoit de publier le modèle complet le 27 juillet. Une fois publié, il ne pourra pas être retiré. N'importe qui peut le télécharger et supprimer les filtres de sécurité.

Le test intervient également après une allégation de vol. Washington affirme que Moonshot a développé Kimi K3 sur la base de technologies américaines d'intelligence artificielle volées. Le chef de la technologie de la Maison Blanche, Michael Kratsios, a déclaré que l'entreprise avait secrètement copié Claude Fable 5 d'Anthropic. La technique, appelée distillation, consiste à former un nouveau modèle sur les réponses d'un modèle plus puissant.

Anthropic soutient cette affirmation. En février, il a tracé plus de 3,4 millions de conversations Claude vers Moonshot à travers des centaines de comptes fictifs. Il a averti que les modèles copiés perdent les contrôles de sécurité de l'original. C'est le même point faible que ce test vient de découvrir.

Les États-Unis dépensent toujours 23 fois plus en IA que la Chine. Pourtant, les laboratoires chinois continuent de réduire l'écart. Le véritable test surviendra lorsque Kimi K3 sera publié et que des experts externes pourront vérifier les affirmations eux-mêmes.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.