Anthropic réduit de 80 % les invites Claude Code, Opus 5 augmente de 72 %

icon MarsBit
Partager
AI summary iconRésumé
Anthropic a récemment supprimé plus de 80 % des prompts système de ses modèles Claude Code, notamment Opus 5 et Fable 5. Le développeur Chen Cheng a noté que les prompts d'Opus 5 ont augmenté de 72 % par rapport à Opus 4.8. L'entreprise a expliqué que la baisse s'est principalement produite entre Opus 4.7 et 4.8, tandis qu'Opus 5 a introduit de nouvelles contraintes pour gérer son comportement. Ces modifications visent à simplifier les instructions et à réduire les conflits entre les modèles. Par ailleurs, la preuve de travail (PoW) et la preuve d'enjeu (PoS) restent des mécanismes de consensus clés dans le développement de la blockchain.

Claude Code vient d'annoncer une réduction importante des invites, et voilà qu'Opus 5 est pris en flagrant délit de « rebond » !?

Et ce rebond, il n'est pas si petit : 72 %. (Rire)

Ces chiffres apparemment contradictoires proviennent des tests officiels d'Anthropic et d'un internaute.

Il y a deux jours, Anthropic a annoncé avoir supprimé plus de 80 % du contenu des invites système des modèles Opus 5, Fable 5, etc.

Immédiatement après le résultat, l'internaute Chen Cheng (@chenchengpro) a « capturé un paquet » —

Le gars a extrait et compté les instructions système réellement reçues par différents modèles, et a constaté que Opus 5 était 72 % plus long que Opus 4.8 ???

Opus 5

Un a chuté de 80 %, l'autre a augmenté de 72 %.

Entreprise A, vos instructions sont-elles vraiment pour maigrir, ou bien cachez-vous en secret des collations supplémentaires...

Claude Code subit une refonte complète des prompts, l'officiel supprime 80 %

Commençons par examiner exactement ce qu'Anthropic a supprimé cette fois-ci.

Selon l'article officiel, Claude Code, dans ses versions initiales, intégrait de nombreuses règles explicites, voire absolues, dans les instructions système pour éviter les erreurs du modèle.

Par exemple, ne pas écrire de commentaires par défaut, ne pas écrire de chaînes de documentation multilignes, et ne pas créer de documents de planification ou d'analyse à moins que l'utilisateur ne le demande.

Autrement dit, là où le modèle a tendance à échouer, les humains ajoutent une règle préventive !

Au fil du temps, les instructions système derrière Claude Code sont devenues de plus en plus semblables à un vaste manuel des comportements des employés.

Cette méthode était certainement efficace sur les modèles plus anciens, mais à mesure que les capacités de Claude s'améliorent, des problèmes commencent à apparaître…

Le plus direct, c'est que les instructions provenant de différents endroits se contredisent facilement.

Face à ces informations chevauchantes voire contradictoires, Claude doit déjà dépenser de l'énergie pour déterminer à qui écouter avant même de commencer à travailler !!

Opus 5

Ainsi, Anthropic a effectué une « grande opération » sur les invites de Claude Code.

L'une des modifications les plus intuitives concerne les commentaires et les règles de documentation.

Les anciennes règles exigeant de ne pas écrire de commentaires, de ne jamais utiliser de chaînes de documentation multilignes, etc., sont désormais résumées en une seule phrase —

Écrivez du code qui s'harmonise avec le style du code environnant, en respectant sa densité de commentaires, ses conventions de nommage et ses pratiques usuelles.

Traduisez pour vos amis : jetez d’abord un coup d’œil à la manière dont ce projet était initialement rédigé, puis évaluez-vous-même en fonction de la situation réelle ~

Bien sûr, de nombreux autres changements similaires existent.

Le résultat final est que A a supprimé plus de 80 % du contenu des instructions système dans les nouveaux modèles tels qu'Opus 5 et Fable 5…

Il est à noter que, selon les évaluations de programmation d'Anthropic, cette réduction à grande échelle n'a pas entraîné de baisse de performance mesurable, donc vous n'avez pas besoin de vous inquiéter excessivement.

(Mais je voudrais quand même demander… les prompts ont été réduits de 80 %, et le modèle ne s’est pas du tout dégradé, c’est vraiment possible ???)

Opus 5

Avec ce grand nettoyage, les règles d'ingénierie du contexte de Claude Code ont presque été entièrement révisées.

Pour les développeurs utilisant Claude Code ou développant des agents basés sur Claude, Anthropic a également fourni quelques recommandations plus spécifiques d'ajustement.

J'ai aussi légèrement organisé pour mes amis —

Simplifiez CLAUDE.md : conservez uniquement les règles spécifiques au projet ; les informations que Claude peut déduire du code peuvent être supprimées.

Divisez les commandes longues en compétences : enregistrez séparément les processus tels que la revue de code, les tests et le déploiement, puis rechargez-les au besoin.

Supprimez les instructions dupliquées : une règle ne doit être écrite qu'une seule fois ; les contenus déjà mentionnés dans les instructions de l'outil n'ont pas besoin d'être répétés dans le message système ou dans CLAUDE.md.

Exemples de réduction des appels d'outils : clarifiez le sens des paramètres, les options disponibles et les résultats retournés, réduisez les exemples d'appels fixes.

Fournissez directement des références exécutables : les développeurs peuvent transmettre à Claude des cas de test, du code existant, des prototypes HTML ou d'autres fichiers de projet pour réduire les descriptions textuelles longues.

En résumé, la nouvelle approche d'Anthropic peut être résumée en une phrase —

Donnez à Claude moins de manuel d'employé détaillé, et concentrez-vous plutôt sur la définition claire des outils, de l'environnement et des limites des tâches !

Quel grand licenciement massif de prompts...

Un utilisateur a analysé le paquet : Opus 5 a encore augmenté de 72 % ???

À ce stade, le grand licenciement de prompts de Claude Code semble avoir été assez réussi.

Mais un développeur sur les réseaux a regardé le « plus de 80 % » fourni par Anthropic et a soudain posé une question très simple —

A-t-il vraiment supprimé autant ? (Bonne question.jpg)

C'est exactement ce que l'internaute Chen Cheng (@chenchengpro) a fait : il a pointé le CLI de Claude Code vers un serveur local et a récupéré tous les messages système réels reçus par les différents modèles.

Ensuite, un ensemble de données assez dramatiques est apparu :

Opus 4.7 : 15225 caractères

Opus 4.8 : 4467 caractères

Opus 5 : 7694 caractères

Opus 5

Oui, lors de la mise à niveau d'Opus 4.7 à Opus 4.8, les instructions système de Claude Code ont effectivement subi une « grande coupe ».

Le message d'origine de 15 225 caractères a été réduit à 4 467 caractères, perdant directement une grande partie de sa longueur.

Cependant, avec le dernier Opus 5, l'intrigue prend soudainement un retournement inattendu —

Le nombre de tokens de la consigne système reçue est passé de 4467 à 7694, soit une augmentation d'environ 72 % par rapport à Opus 4.8 !!!

Ainsi, le grand nettoyage des invites de Claude Code existe bien, mais cette réduction à grande échelle a principalement eu lieu lors de la phase Opus 4.8.

Après la sortie d'Opus 5, Anthropic a réintégré de nombreux éléments dans le prompt simplifié...

Réexaminez ! Encore plus de découvertes !

En continuant de défiler la mise en œuvre de Claude Code, les internautes attentifs ont encore découvert un détail clé —

Chaque version contient en réalité deux jeux de prompts simultanément, et une fonction détermine, en fonction de l'ID du modèle, lequel des deux jeux sera envoyé au modèle.

Sonnet, Haiku, Claude 3 et certaines anciennes versions du modèle Opus utilisent l'ancien prompt plus détaillé ; les nouveaux modèles comme Opus 5 et Fable 5 utilisent un nouveau prompt fortement simplifié.

Opus 5

En d'autres termes, Claude Code a effectivement supprimé de nombreuses anciennes règles du nouveau modèle.

Au niveau d'Opus 5, le modèle a à nouveau développé de nouvelles habitudes, obligeant Anthropic à ajouter de nouvelles contraintes plus ciblées.

Dans ce cas, il est possible que les déclarations officielles selon lesquelles « plus de 80 % ont été supprimés » et les résultats des développeurs indiquant une augmentation de 72 % pour Opus 5 soient tous deux valides.

Le premier chiffre décrit le changement global de Claude Code passant de l'ancien système de prompts au nouveau ; le second chiffre compare Opus 5 avec Opus 4.8 immédiatement précédent.

Même après une partie de reprise, les 7694 caractères d'Opus 5 ne représentent qu'environ la moitié d'Opus 4.7.

Alors la question revient :

Qu'est-ce que Anthropic a ajouté aux quelques milliers de caractères supplémentaires d'Opus 5 ?

Après analyse plus approfondie, les internautes attentifs ont remarqué que deux contenus exclusifs Opus 5 avaient principalement été ajoutés :

Livraison du travail : définit comment contrôler la portée des tâches, rendre compte de l'avancement et livrer les résultats.

Corrections : Limiter le modèle à répéter des explications et à corriger ses erreurs précédentes.

Les deux parties additionnées représentent environ 3755 caractères, couvrant essentiellement la différence entre Opus 5 et Opus 4.8~

Quant à la raison pour laquelle Opus 5 a réintégré ces contenus, c’est principalement lié au fait que le modèle est devenu plus proactif —

Selon les directives de prompt publiées par Anthropic, Opus 5 préfère rapporter sa progression lors de l'exécution des tâches ; les réponses et documents générés sont généralement plus longs, et il est plus enclin à appeler des sous-agents, à élargir la portée de la tâche et à vérifier à plusieurs reprises les résultats.

Ces habitudes s'avèrent utiles face à des tâches longues et complexes.

Mais si l'utilisateur ne souhaite modifier que quelques lignes de code, Opus 5 déclenche toujours une équipe d'agents secondaires et effectue plusieurs vérifications supplémentaires, ce qui fait augmenter la consommation de jetons et le temps d'attente...

Ainsi, le nouveau prompt a ajouté des exigences plus ciblées : quand il est approprié d'appeler l'agent secondaire, à quelle fréquence il faut faire un rapport d'avancement, jusqu'à quel point le projet doit être mené avant de s'arrêter, et comment contrôler la longueur finale de la sortie.

À ce stade, les données apparemment contradictoires précédentes deviennent compréhensibles.

Ce que Claude Code a supprimé, c'est principalement les détails opérationnels excessifs laissés pour les anciens modèles, tandis que les 72 % rétablis dans Opus 5 sont principalement destinés à encadrer les comportements actifs des nouveaux modèles après leur renforcement.

Plus le modèle est capable de travailler seul, moins les humains ont besoin de le guider pas à pas ; mais dès que le modèle devient de plus en plus indépendant, il faut fixer à l'avance des limites claires sur ce qu'il peut entreprendre automatiquement et à quel moment il doit s'arrêter.

En regardant cela, les invites de Claude Code sont effectivement devenues plus légères, mais Opus 5 a simplement déplacé sa graisse.

C’est bien ce que je disais : même l’IA ne peut échapper à cette règle : les anciens problèmes diminuent, mais de nouveaux surgissent précisément ailleurs. (doge)

Lien de référence :

[1]https://x.com/chenchengpro/status/2081339012632215684

[2]https://claude.com/blog/the-new-rules-of-context-engineering-for-claude-5-generation-models

Cet article provient du compte officiel WeChat « Quantum Bit », auteur : Suivre les technologies de pointe

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.