Самое главное — не оценка модели, а стратегия, на которую поставил Ян Чжилинь: открытые веса + длинный контекст + кластер агентов — путь, радикально отличающийся от пути OpenAI.Автор статьи, источник: 0x9999in1, ME News

Коротко
- 16 июля 2026 года Moonshot выпустила Kimi K3 с 2,8 триллиона параметров и контекстом из 1 млн токенов; независимая оценка Artificial Analysis дала ей общий балл 57,1, заняв 4-е место в мире, обойдя Claude Opus 4.8.
- Основатель Ян Чжилинь, 34 года, бакалавр Циньхуа, доктор CMU, первый автор Transformer-XL и XLNet, относится к крайне немногим, кто превращает свои собственные научные статьи в продукты.
- Луна в тени завершила новый раунд финансирования на сумму около 2 миллиардов долларов США в мае 2026 года, оценив компанию выше 20 миллиардов долларов США — стоимость выросла примерно в четыре раза за три месяца.
- В день выхода K3 индекс NASDAQ упал более чем на 1,4%, а NVIDIA также ослаб — презентация китайской стартап-компании впервые реально повлияла на настроения на американском рынке акций.
- Но K3 больше не «крайне дешевый»: $3/$15 за миллион токенов — примерно в три раза дороже предыдущей версии K2.6, что знаменует поворотный момент эпохи «китайского AI по цене капусты».
- Уровень галлюцинаций K3 был независимо оценен в高达 51%, выводы излишне длинные, открытые веса отложены до 27 июля, история не идеальна.
- Самое главное — не оценка модели, а стратегия, на которую поставил Ян Чжилинь: открытые веса + длинный контекст + кластер агентов — путь, радикально отличающийся от пути OpenAI.
Ударник, почему он смог создать четвертую по величине модель в мире?
Сначала скажу вывод. Ян Чжилин не просто повезло.
Он один из немногих, кто реализовал замкнутый цикл от теории до продукта.
Transformer-XL, XLNet — две статьи, первые авторы. Эти статьи не обычные. Они являются одной из основ для обработки длинных последовательностей всеми современными крупными моделями.
Много людей пишут диссертации. Мало кто превращает диссертации в компании. Меньше пяти компаний в мире попали в топ-4 по глобальным масштабам.
Родился в 1992 году, из Шаньтоу, провинция Гуандун. Получил степень бакалавра в компьютерном отделении Циньхуа, одновременно играя на ударных и сочиняя песни в кампусной рок-группе Splay. За четыре года получил докторскую степень в Карнеги-Меллонском университете. Работал в Google Brain и Meta AI, сотрудничал с Бенджио и Лекуном.
В 24 года стал сооснователем первой AI-компании. В марте 2023 года основал Moonshot AI.
Это резюме редко встречается даже в Силиконовой долине. В Китае оно единственно в своем роде.
Почему это подчеркивается?
На пути к большим моделям «я прочитал все соответствующие статьи» и «эти статьи написал я» — это два совершенно разных уровня потенциальной энергии. Первое — это кривая обучения, второе — первоначальная интуиция. Ян Чжилинь относится ко второму.
Transformer-XL решает проблему «слишком длинная последовательность, которую невозможно запомнить». XLNet предлагает превосходящуюBERT предобучающую парадигму. На продолжении этих двух направлений находится самая яркая продуктовая метка Kimi сегодня: длинный контекст.
От ранних 200 000 символов, на которых делался акцент в Kimi AI-ассистенте, до последующих 2 000 000 символов, а затем на K3 сразу предоставляется 1M токенов (около 1 000 000 токенов).
Это не маркетинговая тема. Это естественное продолжение его академической карьеры.
В чем сильные и слабые стороны Kimi K3?
Сначала посмотрим на конкретные данные.
Kimi K3 выпущен 16 июля 2026 года. Общее количество параметров — 2,8 триллиона, разреженная архитектура MoE, при этом для каждого токена активируются 16 из 896 экспертов. Окно контекста — 1 048 576 токенов. Нативная поддержка визуальных данных.
Независимый сторонний рейтинг Intelligence Index v4.1 от Artificial Analysis: 57,1, 4-е место в мире.
Первые три места заняли Claude Fable 5 (59,9), GPT-5.6 Sol (58,9) и Kimi K3, за которым следует Claude Opus 4.8 (55,7). Далее идут Grok 4.5 с результатом 53,8, GLM-5.2 с 51,1 и DeepSeek V4 с 44,3.
Это первый настоящий прорыв китайской модели в мировую первую пятерку.
Рассмотрим конкретные подпункты. GPQA Diamond: 93,5%. Terminal-Bench 2.1: 88,3%, почти совпадает с 88,8% у GPT-5.6 Sol. BrowseComp: 91,2%. На арене Frontend Code на Arena.ai K3 занял первое место, обойдя Claude Fable 5. Также первое место на AutomationBench-AA: 53%.
На независимой оценке GDPval-AA v2, измеряющей «реальную экономическую ценность знаний», Elo K3 поднялся с 1190 у предыдущей версии K2.6 до 1668, превысив показатели Claude Opus 4.8 (1600), GLM-5.2 (1514) и GPT-5.5 (1494).
Прыжок составил 478 Elo. Довольно жестко.
А где слабость?
Высокий уровень иллюзий. Artificial Analysis показал, что уровень иллюзий K3 составляет 51%, что выше, чем у предыдущего поколения. Точность повысилась, но и «вероятность бессмыслицы» тоже выросла.
Слишком много слов. K3 выдал 130 миллионов токенов в полном наборе оценок AA, в то время как средний показатель отрасли — 63 миллиона. Удвоение. Саймон Виллисон протестировал простую задачу «нарисуй гуся» в SVG и потратил около 0,25 доллара.
Открытие весов отложено. В день выпуска отсутствуют checkpoint, лицензия, model card и технический отчет. Moonshot обещает выпустить их до 27 июля — то есть через шесть дней после написания этой статьи. До этого K3 можно использовать только через API и приложение, что делает его по сути «хостинговой моделью».
Нет оценок SWE-bench Pro/Verified. Оценочные наборы, выбранные Moonshot, такие как DeepSWE и FrontierSWE, пока не могут быть воспроизведены третьими сторонами.
Таким образом, K3 — это модель «по-настоящему хорошая, но еще не идеальная». Это важно сказать честно, не преувеличивая ее возможности.
Более значимый сигнал: китайский ИИ больше не «по цене капусты»
Это то, что чаще всего игнорируют в K3, но может быть самым важным.
Цены API K3: $3 за миллион входящих токенов, $15 за миллион исходящих токенов, кэширование входящих — $0,30.
Сколько стоила предыдущая версия Kimi K2.6? $0,95 / $4,00.
Вырос примерно в три раза.
Что означает эта цена? Она в основном соответствует уровню Claude Sonnet. То есть Moonshot сознательно отказалась от самой яркой карты китайских крупных моделей за последние годы — экстремально низкой цены.
Почему?
Из-за 2,8 триллиона параметров, постоянного режима глубокого мышления и контекста в 1 МБ стоимость не может быть снижена. Кроме того, позиционирование K3 больше не «помощник, который вы можете использовать недорого», а «агентская базовая модель, напрямую конкурирующая с Claude Opus и GPT-5.6».
Интересно, что даже при увеличении цены в три раза стоимость одной задачи K3 по расчетам Artificial Analysis составляет около 0,94 доллара США — примерно вдвое меньше, чем у Claude Opus 4.8 (1,80 доллара США), и практически совпадает с 1,04 доллара США у GPT-5.6 Sol.
Половина цены, та же группа.
Вот почему американские акции дрогнули 17 июля.
В тот день NASDAQ упал более чем на 1,4%. NVIDIA также подвергся продажам. Презентация китайской стартап-компании реально повлияла на настроения на американских рынках.
Это было немыслимо два года назад. Два года назад передача влияния от китайских моделей на американские акции практически отсутствовала.
Существует сейчас. Потому что изменился нарратив.
Рассказ сместился с «США создают передовые технологии, Китай следует за ними» на «Китай также создает передовые технологии, причем с большей долей веса и вдвое дешевле». Этот рассказ оказывает прямое, долгосрочное и структурное давление на способность закрытых передовых лабораторий, таких как Anthropic и OpenAI, устанавливать цены.
За оценкой в 20 миллиардов долларов: ставка, утроившаяся за три месяца
Темпы финансирования также рассказывают ту же историю.
В конце 2024 года оценка Moonshot составляла около 3,3 миллиарда долларов США. К маю 2026 года была завершена новая серия финансирования на сумму около 2 миллиардов долларов США, и оценка превысила 20 миллиардов долларов США.
Утроение за три месяца.
Ян Чжилинь сам сказал на форуме Чжунцяньцзянь в марте 2026 года: «В ближайшие годы все больше исследовательских работ будет осуществляться под руководством ИИ». На GTC в 2026 году он также раскрыл три технические дорожные карты: эффективность токенов, длинный контекст и масштабируемое расширение кластеров агентов.
Поняв эти три пункта, вы сможете понять ставку Moonshot.
Эффективность токена соответствует двум новым механизмам K3: Kimi Delta Attention и Attention Residuals, которые, как утверждается, увеличивают скорость декодирования до 6,3 раза.
Длинный контекст — это скачок от 200 000 символов до 1 миллиона токенов.
Агентский кластер соответствует K3, который четко определен как «агентная модель рассуждений» — создан для длинных цепочек задач, навигации по кодовым базам и вызова инструментов, а не для чатов.
Эти три направления — ставка Ян Чжилина на «форму ИИ следующего поколения».
Он ставит на то, что отдельная крупная модель — это не конец, а кластер интеллектуальных агентов с динамической генерацией и координацией — это действительно цель.
Правильность этого суждения будет ясна через два года.
Открытая наука — настоящая защитная стена китайского ИИ
Здесь необходимо упомянуть более широкий контекст.
В это время в крипто-сообществе широко распространено наблюдение зарубежного исследователя ИИ: китайские лаборатории могут постоянно выпускать такие модели, как GLM-5.2 и Kimi K3, не потому, что у них больше вычислительных мощностей, а потому, что они открыты — не только открывают веса, но и всю экосистему.
Здесь есть одно очень тревожное наблюдение: значительная часть работы по обучению моделей в ведущих китайских лабораториях выполняется стажёрами. При этом эти студенты и аспиранты глубоко понимают детали обучения и готовы делиться знаниями в 100 раз охотнее, чем их американские коллеги.
Напротив, передовые лаборатории США почти не принимают стажеров. Докторанты Стэнфорда и Беркли должны усердно трудиться, чтобы получить возможность вычислительных ресурсов для обучения модели «подходящего размера». Большинство секретов заперты у небольшой группы привилегированных исследователей.
Это не конфликт между Китаем и США. Это конфликт между открытой и закрытой наукой.
Само существование Kimi K3 является лучшим подтверждением этого аргумента.
34-летний основатель-ударник, использующий свою собственную диссертацию в качестве основы, вместе с группой студентов или свежих выпускников создал четвертую по величине модель в мире.
Это вряд ли произойдет внутри OpenAI. Не потому, что люди не способны, а потому, что механизмы этого не допускают.
Конечно, откладывание открытия весов K3 до 27 июля само по себе является сигналом — сторонники открытости тоже колеблются, рассчитывают и под давлением коммерциализации отступают на полшага. Это действие заслуживает внимания, но не опровергает общего направления.
DeepSeek V4 по-прежнему открыт под лицензией MIT. GLM-5.2 также открыт. Китайский лагерь с открытыми весами не распался.
How far can a drummer go?
Вернемся к человеку по имени Ян Чжилин.
Предприниматель в сфере технологий, начинавший как рок-ударник, почти исключение в китайском мире ИИ. Он не похож на типичного «научного гения из Тсингхуа» и не следует классическому пути «возвращенца из Силиконовой долины».
Он редко выступает публично, но его выступления насыщены содержанием. На GTC 2026 он четко изложил техническую дорожную карту: перестройка оптимизатора, перестройка механизма внимания, перестройка остаточных соединений. Это не PR-терминология, а техническое суждение.
Он также признал слабые стороны Moonshot. В собственном блоге K3 открыто указано: по сравнению с Claude Fable 5 и GPT-5.6 Sol, UX все еще уступает; чувствителен к сохраненной истории мышления; чрезмерно активен при выполнении нечетких задач.
Честный генеральный директор, исследователь, внедривший свою диссертацию в продукт, молодая команда, связанная с Tsinghua, и четкая техническая дорожная карта. Это основа Moonshot сегодня.
Оно не идеально. Оно допускает ошибки. Его коммерческий путь еще не полностью реализован — сможет ли рост сохраниться при увеличении цены в три раза, удастся ли снизить вычислительные затраты при 1M контекста, когда агентная форма действительно будет внедрена — все это остается под вопросом.
Но это правда. Это не компания с презентацией, не оценочный пузырь и не временная шумиха.
Заключение: дрожащий Насдах — это только начало
17 июля 2026 года Nasdaq упал на 1,4%.
Некоторые скажут, что падение на 1,4% — это ничего, рынок постоянно колеблется.
Но вам нужно смотреть на цепочку причин и следствий: китайская стартап-компания выпускает модель, которую в тот же день серьезно анализируют такие независимые оценщики, как Reuters, CNBC и Simon Willison, вызывает одновременную продажу акций NVIDIA и заставляет Artificial Analysis сразу включить ее в топ-4 мировых.
Это никогда раньше не происходило.
Это означает одно: контроль над ценами и влиянием в области ИИ тихо смещается из залива Сан-Франциско. Не полностью, а начинает смещаться.
Ян Чжилинь — не единственный движущий силой. Команда DeepSeek, Zhipu и Alibaba Tongyi — тоже. Но он действительно самый острый и типичный символ этой волны — 34-летний молодой человек, который понимает теорию, продукт, открытость и коммерциализацию, а еще играет на барабанах.
Следующее поколение моделей появится. K4, K5 обязательно придут. Очки всегда будут догоняться и снова обгоняться.
То, что действительно останется, — это сможем ли мы сохранить этот открытый путь.
Если удержаться, то ИИ не будет ИИ трех компаний.
Если не удержим, мы просто перейдем от старого замкнутого состояния к новому.
Что касается самого Ян Чжилина — он, вероятно, не слишком заботится о таких масштабных нарративах. 34 года, оценка компании — 20 миллиардов долларов, в руках — одна из четырех лучших моделей в мире, команда состоит исключительно из молодых людей, с которыми он может общаться. Этого уже достаточно, чтобы он продолжал играть на барабанах, писать статьи и оставаться одним из немногих, кто превращает свои научные работы в продукты.
А когда именно произошло второе колебание на Насдахе?
Вероятно, ждать придется недолго.
Справочные материалы
- Reuters, «Китайский Moonshot представил самую крупную в мире открытую ИИ-модель, сокращая разрыв с американскими конкурентами», 2026-07-17
- CNBC, «Китайская Moonshot AI представляет Kimi K3, конкурирующего с OpenAI и Anthropic», 2026-07-17
- Рейтинги ИИ, «Kimi K3: Тесты, ценообразование и обзор — передовая модель Moonshot с 2,8 трлн параметров», 2026-07
- The Decoder, «Открытая модель Kimi K3 приближается к GPT-5.6 Sol и Fable 5, сигнализируя о конце сверхдешевого китайского ИИ», 2026-07
- Искусственный анализ, «Карточка модели Kimi K3 и индекс интеллекта v4.1», 2026-07
- Wall Street Journal, «Основатель Kimi Ян Чжилинь: Будущее разработки ИИ войдет в эпоху, управляемую ИИ, оценка компании достигла 18 миллиардов долларов США», 2026-03-25
- Эра интеллектуального мозга: выступление Ян Чжилин на GTC 2026 — «Впервые полностью раскрыта дорожная карта технологии модели Kimi», 2026-03-18
- Китайская ИИ-атлас, профиль Ян Чжилинь (杨植麟)
