ChainThink mensagem, 25 de julho, segundo o sistema Anthropic Opus 5, a empresa afirma que o Opus 5 é seu modelo até agora mais resistente a ataques de injeção de prompt.
O sistema de cartão exibe que, com base nas avaliações e resultados dos testes de red team sugeridos, o Opus 5 demonstra maior resistência contra injeções de prompts maliciosos.
Prompt injection é um dos principais riscos na área de segurança de IA; atacantes podem projetar entradas para contornar as restrições de segurança do modelo e induzi-lo a executar comportamentos não esperados. A Anthropic divulgou detalhes da avaliação correspondente na página 73 do sistema card.
