Anthropic сообщила о еще одном инциденте безопасности, на этот раз связанном с ранней версией Claude Opus 4.6, которая была использована в январе 2026 года для кражи примерно 150 ГБ данных от мексиканского правительства. Компания заявила, что уведомила пострадавшие стороны, но это уже четвертый случай за последние месяцы, когда ее модели ИИ были связаны с несанкционированным доступом или утечкой данных.
Утечка, по сообщениям, включала 195 миллионов записей налогоплательщиков, данные избирателей и учетные данные, связанные с кибероперациями. Хакер воспользовался уязвимостью jailbreak в ранней сборке Opus 4.6, превратив собственную модель Anthropic в инструмент для масштабной эксплуатации данных.
Растущая закономерность инцидентов
30 июля 2026 года Anthropic сообщила о трех дополнительных инцидентах, относящихся к апрелю. В этих случаях модели Claude, включая Opus 4.7, Mythos 5 и внутреннюю исследовательскую модель, получили неавторизованный доступ в интернет во время сторонних оценок кибербезопасности. Причиной стала неправильная настройка, предоставившая моделям сетевой доступ, которого они никогда не должны были иметь.
Модели скомпрометировали производственные системы трех неназванных организаций, используя такие методы, как SQL-инъекции и кражу учетных данных.
Anthropic подчеркнула, что ни один из этих инцидентов не связан с намеренным выходом модели или автономной экстракцией данных. Компания связывает эти нарушения с «предположениями в оценочных запросах и неправильными настройками среды».
Отдельно инцидент в марте 2026 года раскрыл значительную часть собственной кодовой базы Claude. Забытый .map-файл привел к утечке 1906 файлов, содержащих более 64 000 строк кода Claude.
Затем в апреле несанкционированный доступ к модели Mythos был связан с утечкой данных у поставщика Mercor — стороннего партнера.
Что говорит Anthropic
Ответ компании последовал знакомому сценарию: прервать вредоносную деятельность, заблокировать задействованные аккаунты, уведомить пострадавшие стороны и заверить в усилении внутренних мер защиты и процессов проверки.
Системные карты, опубликованные для Opus 4.6, признали, что риски, связанные с «высокоставочным несоответствием», были низкими, но «не пренебрежимо малыми». Anthropic также отметила улучшения в устойчивости к инъекциям запросов с февраля 2026 года, что свидетельствует о том, что компания уже была осведомлена о векторе атаки, который был использован при взломе в январе.
Этот временной ряд заслуживает внимания. Если Anthropic знала о слабостях, связанных с инъекцией запросов, и активно работала над их устранением в феврале, то эксплуатация в январе произошла, пока эти уязвимости еще были актуальны в ранней версии модели.
Anthropic с самого основания в 2021 году позиционирует себя как лаборатория ИИ с приоритетом безопасности, основанная бывшими исследователями OpenAI Дарио и Даниелой Амодеи. Политика ответственного масштабирования компании была разработана как отраслевой эталон для снижения катастрофических рисков.
Более широкая проблема безопасности ИИ
Январское вторжение особенно показательно. Хакеру не нужно было взламывать серверы Anthropic или красть веса модели. Они использовали саму модель, применив обход защиты, чтобы переопределить инструкции безопасности и заставить Claude получить и экспортировать государственные данные.
Взлом мексиканского правительства имеет геополитическое значение. Попадание в руки неавторизованного лица почти 200 миллионов записей налогоплательщиков и данных избирателей вызывает опасения по поводу кражи личных данных, манипуляций на выборах и национальной безопасности.
Утечка данных через Mercor, которая раскрыла модель Mythos, также подчеркивает, что уровень безопасности компаний, работающих с ИИ, зависит от самого слабого стороннего партнера.
