Три найпотужніші безпекові агентства США вказали дуже великий палець на шість китайських компаній у сфері ШІ, звинувачуючи їх у систематичному вивезенні знань з найсучасніших моделей ШІ країни. Спільна рекомендація CISA, NSA та FBI описує те, що чиновники називають кампанією з вилучення в промислових масштабах, яка триває з кінця 2024 року.
Цілі: Claude від Anthropic, серія GPT від OpenAI, Google’s Gemini та Grok від xAI. Обвинувачені: DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun та Z.AI. Метод: дистиляція знань — техніка машинного навчання, яка сама по собі є абсолютно легальною, але, як стверджують, тут використовується для масштабного копіювання виводів передових систем ШІ.
Як дистиляція стає шпигунством
Дистиляція знань — це добре відома техніка в машинному навчанні. Менша «учень» модель вчиться імітувати поведінку більшої «вчителя» моделі, вивчаючи її вихідні дані. Сама техніка не є суперечливою. Дослідники використовують її постійно для створення більш легких і швидких моделей.
Згідно з американськими чиновниками, що робить цей випадок іншим, — це масштаб та припустима координація за ним. У рекомендації зазначено, що було зроблено мільйони запитів проти американських AI-систем, що призвело до вилучення вихідних даних на мільярди токенів.
Заявлені компанії, як стверджується, використовували проксі, спільні акаунти та різні тактики уникнення, щоб обійти умови служби, що регулюють доступ до цих моделей.
Офіційні особи США пішли ще далі, запропонувавши, що це не були самовільні корпоративні операції. У консультації зазначається, що зусилля з видобутку, ймовірно, проводилися з відома китайського уряду, представляючи цю діяльність як частину ширшої стратегії Пекіна щодо закриття розриву в галузі ШІ з США.
Ескалація від раніше виражених попереджень
Ця рекомендація не з’явилася звідкись. Вона базується на звинуваченнях, висловлених Білим домом у квітні 2026 року, які вказували на подібні промислові кампанії з відстоювання та зазначали використання просунутих методів обходу для уникнення виявлення. Вереснева рекомендація суттєво піднімає ці попередження з рівня «ми помітили щось» на рівень «ось імена».
Міністр фінансів США Скотт Бессент вже зазначив, що санкції або включення до Переліку суб’єктів можуть бути на столі. Включення до Переліку суб’єктів обмежить американські компанії від ведення бізнесу з названими фірмами, перекриваючи доступ до американських технологій, хмарних сервісів і, можливо, навіть апаратного забезпечення.
Реакція Китаю була передбачуваною. Офіційні особи в Пекіні відкинули ці звинувачення як безпідставні.
Що саме під загрозою
Американські компанії з штучним інтелектом, моделі яких були ціллю, зокрема Anthropic, OpenAI, Google та xAI, зіткнуться з тиском, щоб продемонструвати, що їхні системи можуть виявляти та запобігати масштабним спробам вилучення. Рекомендація прямо закликає американських постачальників ШІ впроваджувати заходи з виявлення та зменшення ризиків.
Рекомендація також піднімає складне технічне питання: як насправді запобігти дистиляції в масштабі? На відміну від крадіжки вихідного коду або проектів апаратного забезпечення, дистиляція працює шляхом взаємодії з моделлю через її нормальний інтерфейс. Кожен виклик API повертає корисні дані. Провести межу між легітимним інтенсивним використанням та систематичним вилученням не просто, і будь-яка система виявлення ризикує позначати як легітимних дослідників, так і зловмисників.
Американські компанії зі штучним інтелектом частково побудували свої бізнеси на основі широкого доступу до API. Надмірно обмежувати цей доступ може підірвати адаптацію та дохід. З іншого боку, недостатньо обмежувати його, за думкою трьох федеральних агентств, означає передати свої найцінніші інтелектуальні активи конкурентам, яких підтримує суперницький уряд.
