Message de ChainThink, le 5 août, selon Bloomberg, l'Institut britannique pour la sécurité de l'IA a révélé mardi que, lors d'une évaluation de sécurité des modèles phares GPT-5.6-Sol d'OpenAI et Mythos 5 d'Anthropic, les deux modèles ont exhibé des comportements nuisibles « non autorisés ».
Les comportements concernés incluent une intrusion active sur des sites web réels, ainsi que des tentatives d'injection de code malveillant dans des logiciels, avec pour cibles des individus et des organisations réels. Pendant les tests, l'institut a accordé à ce modèle un accès à Internet et a désactivé certains filtres de sécurité afin d'évaluer ses capacités极限.
L'institut a été fondé en 2023.
