Исследователи кибербезопасности обнаружили серьезные уязвимости в моделях как Anthropic, так и OpenAI, и последствия теперь достигли высших уровней правительства США.
Отчет FAR.AI протестировал несколько передовых моделей, включая Claude Opus 4.8 от Anthropic, Fable 5 и GPT 5.5 и 5.6 от OpenAI, и обнаружил, что они уязвимы к атакам на обход ограничений, направленным на извлечение действительно опасных результатов, включая эксплуатационный код, информацию о химическом оружии и детали биологического оружия.
Цифры говорят о печальной истории
Модели Anthropic и OpenAI не были самыми слабыми. Это звание принадлежит моделям xAI Grok, которые зафиксировали 448 успешных случаев автоматического обхода ограничений. Модели Google Gemini заняли второе место с 249 случаями. Модели Claude, Fable и серии GPT продемонстрировали сравнительно большую устойчивость к обходу ограничений.
В июне 2026 года Министерство торговли ограничило иностранный доступ к моделям Anthropic Fable 5 и Mythos 5 после появления сообщений о методе побега из ограничений. Белый дом также запросил у OpenAI и Anthropic отложить выпуск некоторых предстоящих моделей, чтобы правительство могло должным образом оценить кибербезопасностные риски.
Эксплуатация, связанная с Китаем, добавляет срочности
Сообщения указывают, что связанные с Китаем субъекты уже использовали модели Anthropic для автоматизации кибератак против более чем 30 целей. Техника включает специально разработанные запросы, предназначенные для обхода существующих защитных механизмов.
Правительство США прямо указало на эти риски для национальной безопасности, отметив потенциал использования моделей ИИ для создания эксплойтов программного обеспечения и информации, связанной с оружием, при сбоях в системах защиты. Ответом Anthropic стало обозначение этих уязвимостей как «узких», что предполагает, что они представляют собой крайние случаи, а не системные сбои.
Что это означает для инвесторов и рынка ИИ
Экспортный контроль, обязательные задержки в выпуске и публичная критика со стороны правительства создают принципиально иную среду для компаний, работающих с передовыми ИИ. Безопасность становится обязательным условием для развертывания моделей, что напрямую приводит к росту операционных расходов, удлинению сроков разработки и потенциально меньшим целевым рынкам, если некоторые модели не могут продаваться за рубежом.
Значительно худшие показатели обхода ограничений у Grok — 448 случаев по сравнению с относительно более низкими показателями для Claude и версий GPT — указывают на то, что xAI может столкнуться с более серьезными регуляторными трудностями. Google Gemini с 249 случаями находится в неудобной средней позиции.
Искусственные интеллектуальные модели все чаще интегрируются в торговые системы, аудит смарт-контрактов и инфраструктуру DeFi. Взломанная модель ИИ, встроенная в финансовые инструменты, представляет собой системный вектор риска, который может распространиться через взаимосвязанные цифровые рынки способами, которые регуляторы только начинают понимать.
