Дослідники кібербезпеки виявили серйозні вразливості в моделях Anthropic та OpenAI, і наслідки цього вже дійшли до найвищих рівнів уряду США.
Звіт FAR.AI протестував кілька передових моделей, включаючи Claude Opus 4.8 від Anthropic, Fable 5 та GPT 5.5 і 5.6 від OpenAI, і виявив, що вони вразливі до атак на обхід обмежень, спрямованих на отримання справді небезпечних вихідних даних, зокрема експлуатаційного коду, інформації про хімічну зброю та деталей біологічної зброї.
Цифри розповідають тривожну історію
Моделі Anthropic та OpenAI не були найгіршими за результатами. Це звання належить моделям xAI Grok, які зареєстрували 448 випадків успішних автоматизованих виходів із обмежень. Моделі Google Gemini посіли друге місце з 249 випадками. Моделі Claude, Fable та серії GPT продемонстрували порівняно більшу стійкість до виходів із обмежень.
У червні 2026 року Департамент торгівлі обмежив іноземний доступ до моделей Anthropic Fable 5 та Mythos 5 після того, як з’явилася інформація про метод обходу безпеки. Білий дім також попросив OpenAI та Anthropic відкласти випуск деяких майбутніх моделей, щоб уряд міг належним чином оцінити кібербезпекові ризики.
Експлуатація, пов’язана з Китаєм, додає терміновості
Звіти свідчать, що суб’єкти, пов’язані з Китаєм, вже використовували моделі Anthropic для автоматизації кібератак проти більше ніж 30 цілей. Ця техніка передбачає використання спеціально розроблених запитів, спрямованих на обхід існуючих захисних механізмів.
Уряд США прямо посилався на ці ризики національної безпеки, зазначаючи потенціал штучного інтелекту для генерації експлойтів програмного забезпечення та інформації, пов’язаної зі зброєю, коли їхні захисні механізми виходять з ладу. Відповідь Anthropic полягала у позначенні цих вразливостей як «вузьких», що свідчить про те, що вони є крайніми випадками, а не системними невдачами.
Що це означає для інвесторів та ринку ШІ
Експортні обмеження, обов’язкові затримки з випуском та публічна критика з боку уряду створюють фундаментально іншу середовище для компаній, що розробляють передові ІІ. Безпека стає необхідною умовою для розгортання моделей, що безпосередньо призводить до зростання операційних витрат, подовження термінів розробки та потенційно менших ринків для продажу, якщо певні моделі не можна продавати за кордоном.
Значно гірші показники обходу обмежень у Grok — 448 випадків порівняно з порівняно нижчими цифрами для Claude та GPT — свідчать про те, що xAI може зіткнутися з більш суворими регуляторними викликами. Google’s Gemini з 249 випадками знаходиться в незручному середньому положенні.
Моделі ШІ все частіше інтегруються в торгівельні системи, аудит смартконтрактів та інфраструктуру DeFi. Модель ШІ, що була зламана та вбудована в фінансові інструменти, є системним вектором ризику, який може поширитися через взаємопов’язані цифрові ринки способами, які регулятори лише починають розуміти.
