ChainThink : le 25 juillet, selon des ingénieurs d'Anthropic, l'équipe a réduit de 80 % les instructions système du modèle Claude Code, sans dégradation des performances lors des évaluations de codage.
Les versions antérieures, limitées par les capacités du modèle, contenaient de nombreuses règles strictes dans les instructions, comme l'interdiction des commentaires multilignes ; après que le nouveau modèle a acquis une capacité décisionnelle plus autonome, ces règles risquent plutôt de provoquer des conflits d'instructions et une dérive de la pensée.
Anthropic a désormais pour objectif de décrire les cibles, par exemple « écrire du code correspondant au code environnant », et répartit les instructions dans la description des outils et les modules de compétences activés au besoin.
L'équipe considère le bloat des prompts comme une dette technique et estime que, une fois les capacités du modèle améliorées, il faut simplifier les instructions au lieu d'en accumuler davantage.
