Le code Muse de Meta perd face à Claude Opus 5 d'Anthropic dans le benchmark de programmation IA

iconBeInCrypto
Partager
AI summary iconRésumé
Actualités IA + crypto : Muse Code de Meta, lancé en bêta le 5 août 2026, a été battu par Claude Opus 5 d'Anthropic dans les quatre benchmarks de codage publiés par Meta. Des données indépendantes révèlent un écart plus important que celui rapporté. Meta a omis GPT-5.6 Sol d'OpenAI, qui mène les tests. Les données sur l'inflation restent un facteur macroéconomique clé pour les marchés crypto.

Mark Zuckerberg a lancé Muse Code en bêta mercredi, le premier agent de codage par intelligence artificielle (IA) de Meta. Claude Opus 5 d'Anthropic le dépasse dans les quatre comparaisons publiées par Meta au lancement.

Meta a quand même publié ces graphiques. L'entreprise vend un outil moins cher plutôt qu'un outil meilleur. Les données de tests indépendants suggèrent que l'écart est plus large que ce que Meta a montré.

Sponsorisé
Sponsorisé

Nous suivre sur X pour recevoir les dernières actualités dès leur publication

Les propres graphiques de Meta offrent à Anthropic chaque tour

Muse Spark 1.2 est le modèle intégré à Muse Code. Il a obtenu 82,9 % sur Terminal-Bench 2.1.

Claude Opus 5 a obtenu 86,7 % au même test. Terminal-Bench provient des chercheurs de l'Institut Laude et de Stanford. Il propose 89 emplois réels couvrant la réparation de systèmes, le travail sur les données et la sécurité.

La deuxième place est respectable. Muse Code a battu Codex d'OpenAI à 81,8 % et Grok Build à 81,6 %.

Graphique de comparaison des performances pour Muse Spark 1.2
Graphique de comparaison de référence pour Muse Spark 1.2, source : Zuckerberg

Le prochain graphique était plus sévère. DeepSWE 1.1 propose 113 tâches de codage avec l'accès à Internet désactivé pendant la notation. Muse Spark 1.2 est tombé à la troisième place avec 59,3 %.

Meta a ensuite publié un test qu'elle a développé lui-même, basé sur 440 demandes d'intégration réelles de ses propres ingénieurs. Muse Spark 1.2 a obtenu 70,6 %, soit environ neuf points de moins qu'Opus 5.

Sponsorisé
Sponsorisé
Muse Spark 1.2 a exécuté une tâche d'optimisation du noyau pendant 24 heures sur NVIDIA Hopper — plus de 1 000 appels d'outils — et a continué à découvrir des gains de vitesse réels bien après la phase initiale d'exploration.
Muse Spark 1.2 a exécuté une tâche d'optimisation du noyau pendant 24 heures sur NVIDIA Hopper — plus de 1 000 appels d'outils — et a continué à découvrir des gains de vitesse réels bien après la phase initiale d'exploration.

Ce score est seulement à 2,3 points au-dessus de Muse Spark 1.1, le modèle que Meta a lancé en juillet.

Le modèle Meta a omis ses graphiques de codage

Meta s'est mesuré à GPT-5.6 Terra. OpenAI vend un modèle plus puissant appelé Sol, et Meta l'a exclu de tous les trois graphiques de codage.

Sol occupe la première place du classement indépendant Terminal-Bench 2.1 avec 89,5 %. Opus 5 suit avec 89,1 %.

Les deux chiffres dépassent les 86,7 % rapportés par Meta pour Opus 5. Meta a choisi un paramètre plus faible de son plus fort concurrent et a quand même terminé derrière.

Contre Sol, le véritable leader, Muse Spark 1.2 est en retard de 6,6 points plutôt que de 3,8.

Meta a bien inclus Sol à un endroit. Sur une tâche de noyau d'unité de traitement graphique (GPU) s'exécutant au-delà de 1 000 appels d'outils, Sol a surpassé la référence de 71,2 %. Muse Spark 1.2 a atteint 68,7 % et s'est classée quatrième sur six.

Une restriction contrecarre l'autre. Muse Spark 1.2 n'apparaît pas encore sur ce classement public, où seulement 26 des 183 modèles suivis ont été testés. Ses 82,9 % restent une donnée de Meta.

« Muse Spark 1.2 est notre prochaine étape alors que nous avançons vers la frontière, avec des modèles plus grands et plus performants à venir », a déclaré Zuckerberg said dans un post.

Zuckerberg pourrait bientôt accueillir le modèle qui le battra lui-même

Meta serait en pourparlers pour louer de la puissance de calcul à Anthropic. L'accord pourrait atteindre 10 milliards de dollars sur deux ans. Les centres de données de Meta aideraient ensuite à faire fonctionner les modèles Claude que Muse Code était conçu pour détrôner.

Le leadership derrière Muse Code a été coûteux. Zuckerberg a payé 14,3 milliards de dollars en juin 2025 pour Scale AI et son fondateur Alexandr Wang, qui dirige désormais les Meta Superintelligence Labs.

Le prix est le levier qu'il reste à Wang. Les tarifs correspondent au lancement de juillet de la première API payante de Meta à 1,25 $ par million de jetons d'entrée et 4,25 $ par million de jetons de sortie.

Un niveau de contributeur coûte plus de 10 fois moins cher. Les développeurs éligibles permettent à Meta de s'entraîner sur leur travail. Wang a refusé de fournir des chiffres d'adoption pour la ligne Muse Spark.

Les comptes de Meta expliquent la réduction. Les revenus ont augmenté de 28 % pour atteindre 60,8 milliards de dollars au dernier trimestre, mais le bénéfice d'exploitation a diminué de 8 % pour s'établir à 18,8 milliards de dollars.

La marge opérationnelle est passée à 31 % contre 43 % un an plus tôt. Meta a dépensé 31,08 milliards de dollars uniquement au cours du trimestre, et prévoit jusqu'à 145 milliards de dollars pour l'année.

Muse Code offre des fonctionnalités d'ingénierie que Claude Code ne possède pas. Les agents d'arrière-plan conservent le contexte sur toute une session. Les sous-agents travaillent dans des copies isolées d'un dépôt.

Meta a développé un second meilleur programmeur solide et l'a tarifé comme une option économique. La bêta montrera si les développeurs sacrifient quelques points de précision pour une facture environ dix fois plus petite.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.