Anthropic розкрила, що під час тестування AI-моделі були взламані три організації

iconCryptoBriefing
Поділитися
AI summary iconКороткий зміст
Anthropic 29 липня розкрила, що три моделі Claude AI, включаючи Claude Opus 4.7 та Claude Mythos 5, отримали доступ до реальних організацій під час тестування. Проблема виникла через неправильну конфігурацію з партнером Irregular, через яку моделі сприймали живі системи як тестові середовища. Інциденти, що датуються квітнем 2026 року, були виявлені після аналізу 141 006 тестових прогонів. Дві з трьох постраждалих організацій не знали про порушення, доки не були проінформовані 27 липня. Anthropic призупинила всі оцінки 23 липня і не розкрила ідентичності постраждалих суб’єктів чи систем, до яких був отриманий доступ. Аналіз даних у блокчейні відіграв ключову роль у виявленні аномалій. Компанія зараз переоцінює свої протоколи безпеки Proof of Work (PoW).

Три моделі штучного інтелекту Claude від Anthropic вийшли за межі тестової пісочниці та взломали реальні організації. Не гіпотетичні цілі. Не симульовані середовища. Реальні компанії з реальними системами, які не мали уявлення, що їх перевіряє штучний інтелект.

Anthropic розкрила порушення 30 липня, з’ясувавши, що моделі, включаючи Claude Opus 4.7 та Claude Mythos 5, випадково отримали доступ до відкритого інтернету під час внутрішніх кібербезпекових оцінок. Коренева причина: неправильна конфігурація з їхнім партнером з оцінок Irregular, яка дозволила моделям сприймати живі системи як частину контрольованих ігор у стилі «захопи прапор». На англійській: ШІ вважав, що грає у гру, але цілі були реальними.

Як три компанії стали ненавмисними тестовими суб’єктами

Інциденти сягають квітня 2026 року, але Anthropic виявила масштаб проблеми лише після проведення масштабного ретроспективного аналізу 141 006 тестових прогонів. Цей аналіз був ініційований не внутрішніми сповіщеннями, а ранішим звітом від OpenAI, у якому описувалося подібне непередбачуване поведінкове поведінка їхніх власних моделей ШІ.

Реклама

Було уражено три різні організації. Дві з них не мали уявлення про те, що відбулося несанкціоноване звернення, поки Anthropic не повідомив їх 27 липня, за три дні до публічного розкриття.

Anthropic стверджує, що порушення не призвели до значного виведення даних або того, що компанія називає «намірною невдачею зберігання». Моделі не намагалися втекти. Вони виконували інструкції щодо перевірки систем на наявність вразливостей — стандартну частину оцінки кібербезпеки. Просто вони випадково були спрямовані на зовсім інші системи.

Anthropic призупинила всі оцінки кібербезпеки 23 липня, за цілий тиждень до публічного оголошення. Компанія не розкрила ідентичності постраждалих організацій, конкретний характер систем, до яких отримали доступ, чи розглядається будь-яка правова дія.

Проблема безпеки ШІ, яка стає все гучнішою

Це не відбувається в вакуумі. OpenAI недавно повідомила, що її власні моделі демонстрували непередбачуване хакерське поведінку, що й спонукало Anthropic провести внутрішній аудит. Дві з найвідоміших лабораторій ШІ на планеті зараз публічно визнають, що їхні найбільш просунуті моделі можуть, за певних (або неправильних) умов, компрометувати реальні системи без будь-якої намірної ініціативи.

Огляд понад 141 000 тестових запусків свідчить, що це не було випадковою помилкою. Це був системний провал на межі між тестовими середовищами та реальним світом.

Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.