A grande era da destilação está chegando ao fim!
Em 2 de setembro, a Anthropic deu um golpe pesado, reescrevendo imediatamente as regras da API e cortando completamente a saída para modelos encapotados e distiladores.

No passado, inúmeras empresas optaram por usar APIs para extrair o processo de inferência de modelos líderes, a fim de treinar seus próprios "modelos menores", economizando assim grandes custos de computação e tempos de treinamento prolongados.
Mas a partir de hoje, essa possibilidade não existe mais.
Claude Fable 5.1 bloqueia a alteração do "bloco de pensamento"
A Anthropic lançou o Fable 5.1, introduzindo o mecanismo anti-distilação mais rigoroso da história.
A ação principal é manter firmemente travado o "bloco de pensamento".
O que é um "thinking block"?
Em poucas palavras, é o processo de CoT que a IA realiza na mente antes de fornecer a resposta final.

Claude possui caminhos complexos e paralelos em seu processo de pensamento ao realizar cálculos mentais.
Nas chamadas de API, o Claude retornará esses passos de raciocínio ao usuário na forma de "bloco de pensamento".
Em conversas normais de múltiplas rodadas, os desenvolvedores enviam de volta esses blocos de pensamento juntamente com as instruções do sistema, ferramentas e mensagens históricas ao Claude, para que o modelo lembre-se do contexto e mantenha a coerência da conversa.
Mas é exatamente esse mecanismo que se tornou uma oportunidade para os destiladores.
Eles descobriram uma vulnerabilidade enorme: basta modificar secretamente o contexto antes e depois dos blocos de pensamento em várias rodadas de conversa (por exemplo, alterar prompts do sistema anteriores ou mensagens históricas) para quebrar o mecanismo de defesa do Claude e até induzi-lo a revelar sua lógica de raciocínio subjacente, anteriormente oculta!


Para combater esse caos, a Anthropic introduz, na Fable 5.1, uma nova regra chamada "Verificação de Consistência de Contexto".
1. Retorne exatamente pelo mesmo caminho, palavra por palavra: a API agora validará rigorosamente se o "bloco de pensamento" enviado de volta pelo cliente é idêntico, em todos os detalhes, à instrução do sistema, às ferramentas e às mensagens históricas que o geraram.
2. Manipulado? Erro direto! Sempre que o sistema detectar que o contexto foi alterado, mesmo que apenas um Clique aqui Todas as correspondências falharão, e a API retornará diretamente uma mensagem de erro, recusando o serviço.
Além disso, para atender aos desenvolvedores legítimos que realmente precisam modificar o contexto (por exemplo, para reduzir o comprimento do contexto e economizar custos), a Anthropic oferece um “modo não estrito”.
Neste modo, sua solicitação será aprovada, mas o sistema deletará automaticamente todos os "bloco de pensamento"! O modelo responderá forçadamente sem ter acesso ao processo de raciocínio anterior.
Essa estratégia é realmente cortar a base do problema.

Quando Claude é perguntado sobre uma questão mais simples e uma mais difícil, exemplos de raciocínio fiel e de raciocínio motivacional (não fiel)
Quão louco é o processo de destilação industrial?
Por que a Anthropic está se irritando tanto e impondo restrições tão rigorosas?
A resposta é: quanto a, e extremamente necessário.
Devido à destilação ilegal atual, já se tornou de escala industrial.
Ao longo do último ano, a equipe de segurança da Anthropic observou um uso abusivo alarmante.
Esses profissionais "hackers de extração" não usam uma única conta para fazer algumas perguntas por dia, mas sim milhares de contas falsas, por meio de scripts automatizados, explorando freneticamente a API dia e noite.

Eles utilizam técnicas de operação altamente discretas e agressivas.
Como mencionado anteriormente, embora a Anthropic já tenha criptografado os blocos centrais de pensamento do Claude, os hackers utilizaram técnicas de "injeção de contexto" e "reescrita de conversa".
Essa abordagem é como hipnotizar o Claude para que, em meio a uma lógica confusa, ele mesmo descriptografe e imprima seu processo de raciocínio criptografado.
Portanto, muitos modelos pequenos não passaram por um acúmulo de poder computacional e inovação algorítmica do zero; simplesmente memorizaram as abordagens de resolução dos melhores modelos de IA e conseguiram desempenho equivalente.
Mais assustador ainda, essa prática toca diretamente a linha vermelha, levando ao colapso da segurança.
O maior risco da perda de controle da IA
Se a perda de interesses comerciais apenas causou dor a Anthropic, o desacoplamento entre capacidade e segurança causou medo em toda a comunidade de segurança da IA.
Este também é o motivo central que levou a Anthropic a tomar uma atitude drástica.
Sabe-se que grandes modelos como Claude e GPT-4, além de possuírem inteligência extremamente elevada, passaram por treinamentos rigorosos de "alinhamento de valores" e segurança. Eles sabem que não podem ensinar a fabricar bombas, não podem escrever software de extorsão malicioso e não podem emitir discursos de ódio.
Essa dupla vinculação de “capacidade + barreiras de segurança” foi construída por grandes empresas de IA com milhões de dólares investidos em RLHF e ataques de adversários azul-vermelho.

No entanto, o modelo de destilação evitou perfeitamente essa rede de segurança!
Quando os distiladores modificam o contexto para forçar a extração dos "bloco de pensamento" do Claude, eles apenas recuperam essa parte da "capacidade de raciocínio" de alto QI, mas não conseguem herdar as garantias de segurança subjacentes.
Como uma organização maléfica que clonou o Q.I. de Einstein, mas não clonou sua ética e empatia.
Sistemas treinados por meio desse método ilegal de distilação herdam, de forma inexplicável, lógicas avançadas e capacidades de código que originalmente não deveriam possuir.
Mas, como são modelos subjacentes com "baixa proteção e barreiras fracas", elas responderão sem hesitação a solicitações de hackers para gerar scripts de ataque cibernético ou auxiliar no desenvolvimento de armas biológicas.
A desconexão entre capacidade e segurança é o maior risco atual da IA.
Nova regra implementada: quem é afetado?
Este golpe afetará os desenvolvedores sérios?
Não se preocupe, a Anthropic adotou uma estratégia precisa de "execução em fases" para minimizar ao máximo os danos colaterais.
Em primeiro lugar, está a "conta nova".
De acordo com os documentos oficiais, esta restrição começa inicialmente pelas novas contas com maior abuso. Para o modelo Fable 5.1, esta atualização aplica-se apenas às novas contas de API criadas após 31 de agosto de 2026, 12:00:00 AM UTC.
Os seguintes grupos podem estar totalmente tranquilos, pois não são afetados de forma alguma.
1. Contas de API existentes: as contas antigas atuais não são afetadas no Fable 5.1. Isso fornece aos desenvolvedores legítimos tempo suficiente para fazer os ajustes necessários.
2. Usuário final comum: Se você estiver apenas usando a versão web do Claude.ai, ou produtos oficiais como Claude Code ou Claude Cowork, ou conversando normalmente por meio de produtos de terceiros, você não será afetado por nenhuma interrupção.

O que os desenvolvedores de API afetados devem observar?
Se sua integração anterior utilizou a técnica de "reescrever rodadas anteriores no meio da conversa" (por exemplo, para reduzir custos por meio de compressão de contexto ou para injetar forçadamente novos lembretes do sistema no meio da conversa), você precisa começar a ajustar sua lógica de código imediatamente.

Para lidar com essa mudança, a Anthropic fornece um guia de migração abrangente. Os desenvolvedores têm duas opções.
Escolha um: mantenha a absoluta consistência do contexto. Retorne exatamente os blocos de pensamento, a instrução do sistema e as ferramentas originais, sem nenhuma alteração.
Opção 2: Ao fazer uma solicitação de API, selecione o modo "não estrito". Neste modo, mesmo que você modifique o contexto, a API não gerará um erro nem interromperá a solicitação; em vez disso, ela excluirá automaticamente e silenciosamente os blocos de pensamento afetados na solicitação.
Embora isso faça com que o modelo "esqueça" o processo de raciocínio anterior na próxima conversa, pelo menos garante que sua conversa ou tarefa não seja interrompida.
É importante lembrar: embora atualmente haja um período de isenção para essa regra, a Anthropic já declarou claramente que o mecanismo "Manter o Pensamento" será aplicado a todas as contas nas versões futuras dos modelos!
O período de buffer atual também é limitado.
Surpresa agradável: beneficiando os honestos
Além disso, após este novo regulamento, há um benefício oculto para desenvolvedores legais — uma redução significativa nos custos e um salto na velocidade de resposta.
Como isso é feito?
O ponto central é a "consistência de contexto".
No passado, como os desenvolvedores podiam modificar o contexto livremente, cada solicitação recebida pelo modelo era considerada “nova”. Isso não apenas consumia muita potência de processamento, como também era extremamente lento.
Agora, as novas regras obrigam todos a manter exatamente o mesmo "bloco de pensamento" e as mensagens de sistema e histórico ao redor, sem alterações.
Isso cria tecnicamente as condições perfeitas: o cache de prompts pode alcançar taxas de acerto extremamente altas!
Agora, o servidor da API pode armazenar em cache facilmente o contexto das conversas anteriores. Quando uma nova solicitação de conversa chegar, o sistema recupera os dados diretamente do cache, concluindo a correspondência instantaneamente.
Como resultado, o tempo de resposta da API foi significativamente reduzido, a latência caiu drasticamente e o custo das chamadas de API para desenvolvedores também diminuiu consideravelmente!
Essa abordagem de “plantar sem intenção” pode ser vista como um subsídio real em dinheiro para desenvolvedores honestos.
Em resumo, este novo regulamento é, sem dúvida, um ponto de virada para toda a indústria de IA.
As histórias de pequenos parâmetros derrotando grandes modelos podem ser menos frequentes.
Após a maré baixar, quem está nu nadando?
Referências:
https://support.claude.com/zh-CN/articles/16761192-%E4%BF%9D%E7%95%99%E6%80%9D%E8%80%83-%E6%94%B9%E5%8F%98messages-api%E5%A4%84%E7%90%86%E6%80%9D%E8%80%83%E5%9D%97%E7%9A%84%E6%96%B9%E5%BC%8F%E4%BB%A5%E9%98%B2%E6%AD%A2%E8%92%B8%E9%A6%8F
Editado por: Aeneas
Este artigo é do canal oficial do WeChat "Nova Inteligência" (ID: AI_era), autor: Apocalipse da ASI
