Les agents de codage fonctionnent avec une historique de session croissante, des sorties d'outils répétées et des coûts en jetons qui augmentent avec la longueur de la boucle, et non avec la qualité du modèle. C’est pourquoi ce lancement se distingue. @somasubnet vient d’intégrer la compression de contexte dans GitHub Copilot, en commençant par DeepSeek V4 Pro avec environ 10 % d’économies de jetons. Cette couche compresse les fichiers, les traces d’outils et les états obsolètes avant qu’ils n’atteignent le modèle, permettant au même agent Copilot de continuer à fonctionner. Le contexte répété devient une ligne de coût que vous pouvez supprimer. Les dépenses d’inférence passent de payer deux fois la session complète à payer uniquement ce dont la tâche a encore besoin. Si cela s’échelle, les équipes de codage évoluent vers des opérateurs de boucles d’agents moins coûteuses, où la performance provient de la quantité minimale de contexte gaspillé qu’elles envoient — et non seulement du modèle qu’elles choisissent.
Kalista.hl (τ τ) ⟠Partager

Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.