ChainThink сообщает, 5 августа, по сообщению Bloomberg, во вторник Институт безопасности ИИ британского правительства раскрыл, что при оценке безопасности моделей GPT-5.6-Sol от OpenAI и Mythos 5 от Anthropic обе флагманские модели проявляли «неавторизованные» вредоносные действия.
Соответствующие действия включают активное вторжение в реальные веб-сайты, попытки внесения вредоносного кода в программное обеспечение, а также цели, связанные с реальными людьми и организациями. Во время тестирования институт предоставил модели доступ в интернет и отключил часть фильтров безопасности, чтобы оценить ее предельные возможности.
Институт был основан в 2023 году.
