En los últimos 45 días, Anthropic casi no ha dejado de trabajar.
Fable 5 y Mythos 5 se lanzan simultáneamente, Sonnet 5 reduce precios para ganar cuota de mercado, y Claude Code casi se actualiza diariamente.
Ayer Cowork acaba de iterar, y hoy Anthropic lanzó seis actualizaciones de golpe en la plataforma de agentes alojados (CMA):
- El límite de habilidad se aumenta de 20 a 500: una sesión que contiene toda la base de conocimiento de la empresa
- Cinco niveles de ajuste de intensidad de pensamiento: enrutamiento simple para ahorrar token, razonamiento profundo al máximo
- Creación de sesión semilla en un paso: con 50 eventos iniciales directamente, arranque en frío a cero
- Los subagentes en flujo en tiempo real llegan al nivel de hilo: en qué punto llega cada subagente y qué piensa, visible en tiempo real
- 7 nuevos webhooks cubren todo el ciclo de vida del entorno y el almacenamiento de memoria: ya puedes retirar el polling
- El campo de actualización del agente se vuelve opcional: se elimina el costo de gestión de versiones en flujos individuales
Una sesión puede ejecutar 500 habilidades y recorrer toda una base de conocimientos empresarial; ¡Anthropic está tratando de instalar un sistema operativo en los agentes!


El límite de habilidad aumenta a 500, lo suficiente para contener a todo el departamento de operaciones en una sola sesión.
Las habilidades (Skills) de CMA son paquetes de conocimiento que inyectan instrucciones profesionales en el agente, anteriormente con un límite de 20.
Sin embargo, un agente de servicio financiero solo para apertura de cuentas, KYC, prevención de lavado de dinero, manejo de quejas, exención de responsabilidad legal y cambio de idioma ya suma siete u ocho funciones. Sumado a las diferencias regulatorias y las versiones de pruebas A/B, se choca directamente con un techo.
Ahora este número se elevó directamente a 500.
Estas 500 posiciones de habilidades son compartidas por todos los agentes dentro de una sesión, ejecutándose en un entorno de sandbox alojado de forma unificada; los agentes comparten memoria y variables de entorno, y son coordinados por un coordinador: suficiente para representar una unidad de negocio completa.
Incluso, se puede introducir directamente toda la norma del repositorio de código, la configuración de la tubería CI y los objetivos de despliegue en una sola sesión, para que el agente conozca completamente el proceso desde la escritura del código hasta el lanzamiento.

Ajuste de intensidad de pensamiento en cinco niveles; no gastes todo el token en preguntas sencillas
El parámetro de esfuerzo (effort) ya existía a nivel de API, pero los agentes en CMA anteriormente no podían configurarse por separado.
Es decir, durante toda la sesión se utiliza uniformemente el nivel predeterminado; preguntar «¿Qué día es hoy?» y «Auditar un informe financiero de 500 páginas» utilizan la misma profundidad. La sobreinferencia en preguntas sencillas solo consume tokens innecesariamente.
Ahora, la intensidad del pensamiento puede escribirse directamente en la configuración del modelo de cada agente, con cinco niveles: low / medium / high / xhigh / max.
Estás ejecutando un sistema de atención al cliente multiagente: el coordinador de redirección usa low, las consultas sobre productos usan medium, la escalación de quejas usa high, y el cumplimiento legal usa max.
En la misma sesión, diferentes agentes pueden ejecutarse en distintos niveles según la dificultad de la tarea. Por fin, existe un control continuo entre costo y calidad.

Arranque en frío reiniciado a cero, también se desmontó el subagente caja negra
Antes de crear una sesión CMA, se deben realizar dos pasos: primero, hacer un POST de un contenedor vacío, luego insertar eventos iniciales uno por uno. En escenarios de alta concurrencia, la latencia de ida y vuelta se acumula capa tras capa, ralentizando significativamente el arranque en frío.
Ahora todo en un solo paso. POST /v1/sessions con initial_events directamente, hasta 50 eventos iniciales, la sesión nace sabiendo qué hacer.
En la misma actualización, el campo version de la interfaz de actualización del agente también se volvió opcional.
Antes, cada actualización requería enviar un número de versión para el control de concurrencia; si la versión no coincidía, se devolvía un error 409. Ahora, en escenarios de flujo único, este paso se puede omitir directamente.
La observabilidad del subagente también ha dado un gran paso adelante.
A finales de junio, CMA acaba de lanzar event_deltas a nivel de sesión, que permiten previsualizar en tiempo real la salida de texto del agente principal. Sin embargo, los agentes secundarios siguen siendo una caja negra: ya sea que se desvíen o se queden atascados, solo se puede saber al agotarse el tiempo de espera.
Esta vez se desciende directamente al nivel de hilo. Suscríbete al flujo de hilos independientes del subagente, piensa donde quieras, escribe donde quieras, y vélo en tiempo real.


7 nuevos webhooks adicionales; ha llegado el fin de la era de polling
CMA ya ha implementado webhooks para el agente y el ciclo de vida de la implementación a finales de junio.
Se completaron los dos últimos bloques: 4 eventos de entorno + 3 eventos de almacenamiento de memoria.
Hasta ahora, todo el ciclo de vida de CMA: configuración del entorno, despliegue del agente, estado de funcionamiento y gestión de la memoria, puede integrarse completamente con sistemas externos mediante eventos.
Al pausar el entorno, se activa automáticamente una alerta; al actualizar el almacenamiento de memoria, se sincroniza con su base de datos local; al crear un nuevo entorno, se adjunta automáticamente el monitoreo.
De "producto API" a "plataforma operativa", esta es la última pieza del rompecabezas.
Anthropic apuesta por la profundidad a nivel de sistema operativo
Al llegar a julio de 2026, la competencia en infraestructura de agentes de IA ya ha entrado en aguas profundas, con frecuencias de actualización que casi se calculan por día.
Entrada de apuesta de OpenAI. Mete chat, programación y trabajo autónomo en una superaplicación de ChatGPT y utiliza la base de usuarios más grande para retener a los desarrolladores.
Google apuesta en la infraestructura. GCP + TPU + estándares de protocolo, construyendo un foso defensivo en la capa subyacente.
Anthropic apuesta por la profundidad del sistema operativo. Sandbox alojado + control de agente full-stack + ajuste de intensidad de pensamiento, enfocándose en la densidad de capacidad del agente único.
De 20 a 500, Anthropic calcula cuándo podrá convertir el agente en algo tan básico como un sistema operativo.
The speed has already answered: fast.
Referencias: https://x.com/ClaudeDevs/status/2080009523952263295?s=20
Este artículo proviene del canal de WeChat "Neozhiyuan", autor: Apocalipsis ASI; editor: Moisés
