Anthropic, a empresa de inteligência artificial que desenvolveu o chatbot Claude,annunciou na sexta-feirauma série de novas medidas de integridade eleitoral destinadas a impedir que sua inteligência artificial seja weaponizada para espalhar desinformação ou manipular eleitores antes das eleições legislativas dos Estados Unidos em 2026 e outras grandes eleições em todo o mundo este ano.
A empresa com sede em São Francisco detalhou uma abordagem multifacetada, incluindo sistemas de detecção automática, testes de pressão para ações impactantes e parcerias com organizações de recursos de eleitores não partidárias — medidas que refletem a pressão crescente sobre desenvolvedores de IA para regular o uso de suas ferramentas durante a temporada eleitoral.
As políticas de uso da Anthropic proíbem o uso do Claude para atividades políticas enganosas, a geração de conteúdo digital falso destinado a influenciar a opinião política, a prática de fraude eleitoral, a interferência na infraestrutura de votação ou a disseminação de informações enganosas sobre o processo de votação.
Para garantir que essas regras sejam aplicadas, a empresa afirmou que realizou uma série de testes em seus modelos mais recentes de robôs. A Anthropic utilizou 600 prompts — 300 solicitações prejudiciais emparelhadas com 300 solicitações legítimas — para medir a taxa de precisão do Claude em responder a solicitações razoáveis e a taxa de precisão em recusar solicitações inadequadas. As taxas de resposta correta do Claude Opus 4.7 e do Claude Sonnet 4.6 foram de 100% e 99,8%, respectivamente.
A empresa também testou a capacidade de seus modelos de lidar com estratégias de manipulação mais complexas. Ao simular diálogos em várias rodadas, representando a abordagem progressiva que agentes maliciosos poderiam adotar, o Sonnet 4.6 e o Opus 4.7 apresentaram taxas de precisão de 90% e 94%, respectivamente, ao responder adequadamente a cenários de manipulação de influência.
A empresa Anthropic também testou se seus modelos podiam executar ações de influência de forma autônoma — planejar e executar ações de múltiplos passos do início ao fim sem intervenção humana. A empresa afirmou que, após implementar medidas de segurança, seu modelo mais recente recusou quase todas as tarefas.
Em relação à questão da neutralidade política, a empresa realiza uma avaliação antes do lançamento de cada modelo para medir a consistência e imparcialidade do Claude ao responder a prompts que apresentam visões de diferentes espectros políticos. Os scores para Opus 4.7 e Sonnet 4.6 foram de 95% e 96%, respectivamente.
Para usuários que buscam informações sobre votação, o Claude exibirá uma faixa eleitoral direcionando-os ao TurboVote. O TurboVote é uma plataforma de recursos não partidária operada pela Democracy Works, que fornece informações confiáveis e em tempo real sobre registro de eleitores, locais de votação, datas das eleições e detalhes das cédulas. Faixas semelhantes também estão planejadas para as eleições gerais brasileiras no final deste ano.
Anthropic said it plans to continue monitoring its systems and refining its defenses as the election cycle progresses.DecryptWe have reached out to Anthropic for comment on the findings but have not yet received a response.
