Nos últimos 45 dias, a Anthropic quase não parou.
Fable 5 e Mythos 5 são lançados simultaneamente, Sonnet 5 reduz preços para conquistar mercado, Claude Code quase atualizado diariamente.
Ontem, o Cowork acabou de ser atualizado, e hoje a Anthropic lançou seis atualizações de uma só vez na plataforma de agentes hospedados (CMA):
- Limite de habilidade aumentado de 20 para 500: uma sessão capaz de armazenar toda a base de conhecimento da empresa
- Cinco níveis de intensidade de pensamento: roteamento simples economiza token, raciocínio profundo ao máximo
- Criação de sessão semente em um passo: com 50 eventos iniciais diretamente, reiniciando o aquecimento a zero
- Subagent em fluxo em tempo real até o nível de thread: onde cada subagent está e o que está pensando, visível em tempo real
- 7 novos webhooks cobrem todo o ciclo de vida do ambiente e armazenamento de memória: a sondagem pode ser desativada
- Campo de versão do agente atualizado como opcional: elimina o custo de gerenciamento de versão em fluxos únicos
Uma sessão pode executar 500 habilidades e rodar toda uma base de conhecimento corporativa — a Anthropic está quase criando um sistema operacional para agentes!


O limite de habilidade aumentou para 500, permitindo que uma única conversa abranja todo o departamento de negócios.
As habilidades do CMA são pacotes de conhecimento que injetam instruções profissionais no agente, anteriormente com limite de 20.
No entanto, um agente de atendimento financeiro, ao cobrir apenas abertura de conta, KYC, combate à lavagem de dinheiro, tratamento de reclamações, isenção de responsabilidade regulatória e mudança de idioma, já chega a sete ou oito. Somando as diferenças regulatórias e as versões de teste A/B, ele atinge diretamente o teto.
Agora esse número subiu diretamente para 500.
Essas 500 posições de habilidade são compartilhadas por todos os agentes em uma única sessão, executadas em um sandbox de hospedagem unificado; os agentes compartilham memória e variáveis de ambiente, coordenadas por um coordenador — suficiente para corresponder a uma unidade de negócio completa.
Além disso, é possível incluir diretamente todo o conjunto de normas do repositório de código, a configuração da pipeline CI e os objetivos de implantação em uma única sessão, permitindo que o agente saiba tudo, desde a escrita do código até a implantação.

Ajuste de cinco níveis de intensidade do pensamento; questões simples não consomem token completo
O parâmetro de esforço (effort) já existia no nível da API, mas os agentes no CMA anteriormente não podiam ser definidos separadamente.
Ou seja, toda a sessão usa uniformemente o nível padrão; perguntar “Que dia é hoje?” e “Auditar um relatório financeiro de 500 páginas” usam a mesma profundidade. Raciocínio excessivo para perguntas simples é apenas um desperdício de tokens.
A intensidade do pensamento agora pode ser diretamente definida na configuração do modelo de cada agente, com cinco níveis: low / medium / high / xhigh / max.
Você executa um sistema de atendimento ao cliente com múltiplos agentes: encaminhamento usando low, dúvidas sobre produtos usando medium, reclamações e escalonamento usando high, conformidade legal e jurídica usando max.
Dentro da mesma sessão, diferentes agentes podem operar em níveis distintos conforme a complexidade da tarefa. Finalmente, existe um controle contínuo entre custo e qualidade.

Inicialização a frio zerada, o subagente caixa-preta também foi desmontado
Antes de criar uma sessão CMA, são necessárias duas etapas: primeiro, fazer um POST de um contêiner vazio, depois inserir os eventos iniciais um por um. Em cenários de alta concorrência, a latência de ida e volta se acumula, tornando o arranque a frio muito lento.
Agora, faça tudo de uma vez. POST /v1/sessions com initial_events diretamente, até 50 eventos iniciais, e a sessão nasce sabendo exatamente o que precisa fazer.
Na mesma atualização, o campo version da interface do agente também se tornou opcional.
Antes, cada atualização exigia o envio do número da versão para controle de concorrência; se a versão não correspondesse, retornava-se um erro 409. Agora, em cenários de fluxo único, esse passo pode ser ignorado diretamente.
A observabilidade do subagente também deu um grande passo.
No final de junho, a CMA lançou os event_deltas por sessão, permitindo visualizar em tempo real a saída de texto do agente principal. No entanto, os agentes filhos ainda são caixas pretas: seja quando desviam ou travam, só se descobre ao expirar o tempo limite.
Esta vez, desce diretamente ao nível de thread. Inscreva-se no fluxo de thread independente do subagente, pense onde quiser, escreva onde quiser, veja em tempo real.


7 novos webhooks disponíveis; a era de polling acabou
CMA já implementou webhooks para agentes e ciclo de vida de implantação até o final de junho.
Agora foram adicionados os dois últimos grandes blocos: 4 tipos de eventos de ambiente + 3 tipos de eventos de armazenamento de memória.
Até agora, todo o ciclo de vida da CMA — configuração do ambiente, implantação do agente, estado de execução e gerenciamento de memória — pode ser integrado a sistemas externos de forma acionada por eventos.
Alerts are automatically triggered when the environment is paused, memory storage updates are synchronized to your own database, and monitoring is automatically attached when a new environment is created.
Da "produto de API" ao "plataforma operacional", esta é a última peça do quebra-cabeça.
Anthropic está apostando na profundidade do nível do sistema operacional
Até julho de 2026, a corrida por infraestrutura de agentes de IA já entrou na fase avançada, com atualizações quase diárias.
Entrada da OpenAI. Empacote conversa, programação e trabalho autônomo em um superaplicativo ChatGPT, prendendo desenvolvedores com a maior base de usuários.
O Google aposta na infraestrutura. GCP + TPU + padrões de protocolo, construindo uma muralha subjacente.
Anthropic aposta na profundidade do nível do sistema operacional. Sandbox hospedado + controle de agente full-stack + ajuste da intensidade do pensamento, focando na densidade de capacidade de um único agente.
De 20 a 500, a Anthropic está calculando quando poderá tornar o agente algo tão básico quanto um sistema operacional.
The speed has already answered: fast.
Referência: https://x.com/ClaudeDevs/status/2080009523952263295?s=20
Este artigo é do número oficial do WeChat "Nova Inteligência", autor: Apocalipse da ASI; editor: Moisés
