Кодирующие агенты работают с растущей историей сессий, повторяющимися результатами инструментов и счетами за токены, которые растут с длиной цикла, а не с качеством модели. Вот почему этот запуск выделяется. @somasubnet просто внедрил сжатие контекста внутрь GitHub Copilot, начав с DeepSeek V4 Pro при примерно 10% экономии токенов. Этот слой сжимает файлы, следы инструментов и устаревшее состояние до того, как они попадают в модель, позволяя тому же агенту Copilot продолжать работу. Повторяющийся контекст становится статьей расходов, которую можно исключить. Затраты на вывод смещаются с оплаты всей сессии дважды на оплату только того, что необходимо для задачи. Если это масштабируется, команды по кодированию превратятся в операторов более дешевых агентных циклов, где производительность будет определяться не только выбором модели, но и тем, насколько мало они отправляют лишнего контекста.
Kalista.hl (τ τ) ⟠Поделиться

Источник:Показать оригинал
Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации.
Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.