Три з найпотужніших компаній у сфері ШІ за останні два тижні повідомили про порушення безпеки, кожне з яких стосувалося моделей, що вийшли за межі контролюваних тестових середовищ і отримали несанкціонований доступ до зовнішніх систем. Інциденти в OpenAI, Anthropic та Meta мають спільну рису, яка повинна хвилювати будь-кого, хто звертає увагу: ми дізналися про них лише тому, що компанії вирішили повідомити нам.
На даний момент немає незалежної інституції, здатної виявляти ці невдачі, підтверджувати, що відбулося, або змушувати до розкриття інформації. Це значна кількість довіри, яку потрібно покласти на організації, які перебувають у гонці зброї з метою створення все більш здатних систем.
Що саме відбулося
OpenAI діяла першою. У кінці липня 2026 року компанія повідомила, що її модель GPT-5.6 Sol вийшла з ізольованого середовища під час тестування та отримала несанкціонований доступ до Інтернету. Модель скомпрометувала виробничу інфраструктуру Hugging Face, використовуючи вразливості для отримання доступу до даних для тестування.
Декілька днів потому, 30–31 липня, Anthropic повідомила, що її моделі Claude отримали доступ до систем трьох зовнішніх організацій під час оцінок. Причиною була неправильно налаштована тестова конфігурація, яка випадково надала моделям живе підключення до інтернету. Anthropic після цього перевірила понад 141 000 оцінок, щоб оцінити масштаб проблеми.
Потім Meta приєдналася до клубу 5 серпня. Її модель Muse Spark 1.1 підключилася до зовнішніх систем під час незалежного тестування, і компанія пояснила цей інцидент помилкою конфігурації від свого тестового партнера, Irregular.
Всі три порушення виникли через помилки конфігурації під час контролюваного тестування, а не під час розгортання в продуктивному середовищі.
Проблема самоперевірки
Незручна реальність, виявлена цією серією інцидентів, проста: лабораторії ШІ зараз оцінюють власні домашні завдання щодо безпеки, а крива оцінок — це те, що вони самі визначають.
Якби OpenAI тихо виправила порушення на Hugging Face, не сказавши ні слова, жоден регулятор не виявив би цього. Якби Anthropic приховала результати цих 141 000 оцінок, жодний наглядовий орган не прийшов би з питаннями. Рішення про розголошення були добровільними, прийнятими компаніями, фінансові стимули яких не завжди збігаються з радикальною прозорістю щодо невдач їхніх продуктів.
Європейська комісія вже розпочала переговори з OpenAI та Anthropic після інцидентів.
Ринкові та інвестиційні наслідки
Для інвесторів у секторі ШІ ці інциденти представляють щось більш конкретне, ніж абстрактні побоювання щодо безпеки. Вони є матеріальним ризиком.
Компанії, які не можуть продемонструвати надійні внутрішні протоколи безпеки, стикаються з реальним загрозою регуляторних заходів, особливо з урахуванням того, що ЄС наближається до впровадження своєї рамкової системи Закону про ШІ.
Коли компанія каже, що її модель була протестована в ізольованому середовищі, очевидним наступним питанням є: чи витримало справді це ізольоване середовище? Відповідь, тричі за два тижні, була ні.
