A plataforma CMA da Anthropic apresenta limite de 500 habilidades e importantes aprimoramentos de agentes

icon MarsBit
Compartilhar
AI summary iconResumo
A plataforma CMA da Anthropic lançou seis atualizações principais, incluindo um limite de 500 habilidades por sessão e cinco níveis de esforço de raciocínio. A visibilidade em tempo real da execução de subagentes e 50 eventos iniciais melhoram a velocidade de inicialização. A observabilidade em nível de thread e sete novos webhooks aprimoram a integração. Essas atualizações de criptomoedas visam aumentar a eficiência dos agentes e reduzir os custos de tokens. As atualizações da KuCoin podem refletir tendências mais amplas da indústria em otimização de IA e blockchain.

Nos últimos 45 dias, a Anthropic quase não parou.

Fable 5 e Mythos 5 são lançados simultaneamente, Sonnet 5 reduz preços para conquistar mercado, Claude Code quase atualizado diariamente.

Ontem, o Cowork acabou de ser atualizado, e hoje a Anthropic lançou seis atualizações de uma só vez na plataforma de agentes hospedados (CMA):

  • Limite de habilidade aumentado de 20 para 500: uma sessão capaz de armazenar toda a base de conhecimento da empresa
  • Cinco níveis de intensidade de pensamento: roteamento simples economiza token, raciocínio profundo ao máximo
  • Criação de sessão semente em um passo: com 50 eventos iniciais diretamente, reiniciando o aquecimento a zero
  • Subagent em fluxo em tempo real até o nível de thread: onde cada subagent está e o que está pensando, visível em tempo real
  • 7 novos webhooks cobrem todo o ciclo de vida do ambiente e armazenamento de memória: a sondagem pode ser desativada
  • Campo de versão do agente atualizado como opcional: elimina o custo de gerenciamento de versão em fluxos únicos

Uma sessão pode executar 500 habilidades e rodar toda uma base de conhecimento corporativa — a Anthropic está quase criando um sistema operacional para agentes!

Plataforma de agentes

Plataforma de agentes

O limite de habilidade aumentou para 500, permitindo que uma única conversa abranja todo o departamento de negócios.

As habilidades do CMA são pacotes de conhecimento que injetam instruções profissionais no agente, anteriormente com limite de 20.

No entanto, um agente de atendimento financeiro, ao cobrir apenas abertura de conta, KYC, combate à lavagem de dinheiro, tratamento de reclamações, isenção de responsabilidade regulatória e mudança de idioma, já chega a sete ou oito. Somando as diferenças regulatórias e as versões de teste A/B, ele atinge diretamente o teto.

Agora esse número subiu diretamente para 500.

Essas 500 posições de habilidade são compartilhadas por todos os agentes em uma única sessão, executadas em um sandbox de hospedagem unificado; os agentes compartilham memória e variáveis de ambiente, coordenadas por um coordenador — suficiente para corresponder a uma unidade de negócio completa.

Além disso, é possível incluir diretamente todo o conjunto de normas do repositório de código, a configuração da pipeline CI e os objetivos de implantação em uma única sessão, permitindo que o agente saiba tudo, desde a escrita do código até a implantação.

Plataforma de agentes

Ajuste de cinco níveis de intensidade do pensamento; questões simples não consomem token completo

O parâmetro de esforço (effort) já existia no nível da API, mas os agentes no CMA anteriormente não podiam ser definidos separadamente.

Ou seja, toda a sessão usa uniformemente o nível padrão; perguntar “Que dia é hoje?” e “Auditar um relatório financeiro de 500 páginas” usam a mesma profundidade. Raciocínio excessivo para perguntas simples é apenas um desperdício de tokens.

A intensidade do pensamento agora pode ser diretamente definida na configuração do modelo de cada agente, com cinco níveis: low / medium / high / xhigh / max.

Você executa um sistema de atendimento ao cliente com múltiplos agentes: encaminhamento usando low, dúvidas sobre produtos usando medium, reclamações e escalonamento usando high, conformidade legal e jurídica usando max.

Dentro da mesma sessão, diferentes agentes podem operar em níveis distintos conforme a complexidade da tarefa. Finalmente, existe um controle contínuo entre custo e qualidade.

Plataforma de agentes

Inicialização a frio zerada, o subagente caixa-preta também foi desmontado

Antes de criar uma sessão CMA, são necessárias duas etapas: primeiro, fazer um POST de um contêiner vazio, depois inserir os eventos iniciais um por um. Em cenários de alta concorrência, a latência de ida e volta se acumula, tornando o arranque a frio muito lento.

Agora, faça tudo de uma vez. POST /v1/sessions com initial_events diretamente, até 50 eventos iniciais, e a sessão nasce sabendo exatamente o que precisa fazer.

Na mesma atualização, o campo version da interface do agente também se tornou opcional.

Antes, cada atualização exigia o envio do número da versão para controle de concorrência; se a versão não correspondesse, retornava-se um erro 409. Agora, em cenários de fluxo único, esse passo pode ser ignorado diretamente.

A observabilidade do subagente também deu um grande passo.

No final de junho, a CMA lançou os event_deltas por sessão, permitindo visualizar em tempo real a saída de texto do agente principal. No entanto, os agentes filhos ainda são caixas pretas: seja quando desviam ou travam, só se descobre ao expirar o tempo limite.

Esta vez, desce diretamente ao nível de thread. Inscreva-se no fluxo de thread independente do subagente, pense onde quiser, escreva onde quiser, veja em tempo real.

Plataforma de agentes

Plataforma de agentes

7 novos webhooks disponíveis; a era de polling acabou

CMA já implementou webhooks para agentes e ciclo de vida de implantação até o final de junho.

Agora foram adicionados os dois últimos grandes blocos: 4 tipos de eventos de ambiente + 3 tipos de eventos de armazenamento de memória.

Até agora, todo o ciclo de vida da CMA — configuração do ambiente, implantação do agente, estado de execução e gerenciamento de memória — pode ser integrado a sistemas externos de forma acionada por eventos.

Alerts are automatically triggered when the environment is paused, memory storage updates are synchronized to your own database, and monitoring is automatically attached when a new environment is created.

Da "produto de API" ao "plataforma operacional", esta é a última peça do quebra-cabeça.

Anthropic está apostando na profundidade do nível do sistema operacional

Até julho de 2026, a corrida por infraestrutura de agentes de IA já entrou na fase avançada, com atualizações quase diárias.

Entrada da OpenAI. Empacote conversa, programação e trabalho autônomo em um superaplicativo ChatGPT, prendendo desenvolvedores com a maior base de usuários.

O Google aposta na infraestrutura. GCP + TPU + padrões de protocolo, construindo uma muralha subjacente.

Anthropic aposta na profundidade do nível do sistema operacional. Sandbox hospedado + controle de agente full-stack + ajuste da intensidade do pensamento, focando na densidade de capacidade de um único agente.

De 20 a 500, a Anthropic está calculando quando poderá tornar o agente algo tão básico quanto um sistema operacional.

The speed has already answered: fast.

Referência: https://x.com/ClaudeDevs/status/2080009523952263295?s=20

Este artigo é do número oficial do WeChat "Nova Inteligência", autor: Apocalipse da ASI; editor: Moisés

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.