Правительство США подвергло новейшую китайскую ИИ-модель тестированию на взлом. Выяснилось, что Moonshot AI’s Kimi K3 значительно уступает лучшим американским моделям.
Центр по стандартам и инновациям в области ИИ (CAISI), американское агентство, провел тесты с британским партнером. Результаты появились всего через один день после того, как Вашингтон обвинил Moonshot в создании Kimi K3 с использованием украденных американских технологий.
Kimi K3 не соответствует американским кибербезопасностным стандартам
Департамент торговли опубликовал результаты в четверг. Он сообщил, что Kimi K3 показал значительно более низкие результаты по сравнению с ведущими американскими моделями, сославшись на совместный тест с британскими экспертами.
Moonshot запустила Kimi K3 16 июля. Спрос был настолько высоким, что пришлось приостановить новые регистрации уже через два дня.
Запуск также повлиял на акции чипов США и вызвал новые сомнения относительно лидерства Америки в области ИИ.
Один тест, называемый ExploitBench, использует реальные уязвимости браузера Chrome, разработанные Университетом Карнеги-Меллон. Kimi K3 показал результат 32%. Это превзошло китайскую модель GLM-5.2 с результатом 24%. Однако она отстала от ведущих американских моделей, которые показали около 76%.

Самый сложный шаг — полный контроль целевой машины. Kimi K3 не справился с этим шагом во всех 41 тестах. Лучшие американские модели справились с этим в 20 случаях.
Еще один тест, называемый The Last Ones, представляет собой фиктивную атаку на корпоративную сеть, состоящую из 32 шагов. Человеку-эксперту требуется около 20 часов для его завершения. Kimi K3 в среднем достиг 17-го шага. Лучшие модели из США достигли 28,5-го шага. Kimi K3 полностью завершил тест всего один раз из десяти попыток.
Лучшие американские системы, как сообщается, сделали это шесть или семь раз.
Но разрыв может выглядеть больше, чем есть на самом деле
Но цифры не раскрывают всей истории. Мелкий шрифт самого отчета содержит несколько подвохов.
Сначала американские модели протестировали с отключенными фильтрами безопасности. Этот режим демонстрирует их полную мощность. Публичные версии сохраняют эти фильтры включёнными. Поэтому результаты США — это оптимистичный сценарий, а не реальная ситуация.
Команда также рано завершила работу и провела её в ограниченном объёме. Оценка Kimi K3 была проведена только на одном тесте, и была запущена лишь часть полного набора. Поэтому её рейтинг нестабилен. Некоторые тесты являются закрытыми, поэтому посторонние не могут проверить работу.
Также существует фундаментальное несоответствие. Kimi K3 — это открытая модель, которую может скачать любой желающий. Модели США — это закрытые, приватные системы. Британский институт обнаружил, что открытые модели, как правило, отстают на четыре-семь месяцев от лучших закрытых. Полное тестирование Kimi K3 будет проведено только после того, как Moonshot выпустит её в общественный доступ.
Эти тесты также не являются реальными атаками. Фальшивая сеть не имела человеческих защитников и не имела сигнализации, которую можно было бы сработать. Тем не менее, Kimi K3 превзошла последнюю лучшую открытую модель. И ей удалось завершить полную атаку один раз.
Время и источник также вызывают вопросы. CAISI ранее был Институтом безопасности ИИ США. Администрация Трампа переименовала его в июне 2025 года. Он находится в том же ведомстве, которое ограничивает продажи чипов США Китаю. И его отчет о китайском конкуренте появился всего через день после утверждения о краже.
Слабые меры защиты всё ещё повышают риски
Тем не менее низкие баллы не означают, что Kimi K3 безопасен. Тест показал, что его защитные механизмы не помешали ему попытаться создать взломы или атаковать системы.
Это важно из-за того, что последует дальше. Moonshot планирует выпустить полную версию модели 27 июля. Как только она будет выпущена, её нельзя будет отозвать. Любой может скачать её и удалить фильтры безопасности.
Тест также проходит после заявления о краже. Вашингтон утверждает, что Moonshot создал Kimi K3 на основе украденных американских ИИ-технологий. глава технологического подразделения Белого дома Майкл Кратсиос заявил, что компания тайно скопировала Claude Fable 5 от Anthropic. Техника, называемая дистилляцией, обучает новую модель на ответах более мощной модели.
Anthropic подтверждает это утверждение. В феврале она отследила более 3,4 миллиона чатов Claude через сотни фиктивных аккаунтов. Она предупредила, что скопированные модели теряют системы безопасности оригинала. Это именно та же слабая сторона, которую обнаружил этот тест.
США всё ещё тратят в 23 раза больше на ИИ, чем Китай. Однако китайские лаборатории продолжают сокращать разрыв. Настоящий тест наступит, когда Kimi K3 выйдет на публичный рынок, и внешние эксперты смогут проверить утверждения самостоятельно.
