Языковая модель → Цепочка рассуждений → Агент → Постоянное обучение → Точка самоподобия → Воплощенный интеллект.Автор статьи, источник: 0x9999in1, ME News

Коротко
- DeepSeek завершила первое внешнее финансирование со дня основания на сумму более 50 млрд юаней, предварительная оценка составила около 367,5 млрд юаней (около 54,3 млрд долларов США). Лян Вэньфэн вложил личные 20 млрд юаней в качестве лидирующего инвестора, Tencent вложил 10 млрд, CATL — 5 млрд. Принцип «не привлекать финансирование» был нарушен.
- Это не компромисс, а решение проблемы. Лян Вэньфэн называет «стабильность команды» единственным неприкосновенным ключевым интересом: суть привлечения финансирования заключается в блокировке людей с помощью опционов, что позволяет однократно устранить наибольший риск.
- Он представил редкую и четкую дорожную карту: языковые модели → цепочки рассуждений → агенты → непрерывное обучение → точка самоподдерживающейся итерации → овеществленный интеллект. Сейчас мы застряли на уровне «непрерывного обучения».
- Вычислительные мощности остаются узким местом. DeepSeek позиционирует себя как «отстающий от США на 6–18 месяцев, используя всего одну двадцатую часть вычислительных мощностей», следующей целью является сокращение этого разрыва до 3–6 месяцев.
- Отечественные чипы — это наибольший фактор неопределенности. V4 уже явно адаптирован под Huawei Ascend 950. Лян Вэньфэн делает ставку на то, что «в течение года докажет, что отечественная экосистема не имеет проблем»; единственным ограничением является производственная мощность.
- Открытый исходный код — непоколебимый принцип, даже самые мощные модели открываются и полностью совпадают с версиями, используемыми внутри компании. В бизнесе мы получаем лишь разумную прибыль — окупаемость за десять месяцев. Эта сдержанность и есть наша конкурентная защита.
DeepSeek сдался.
Три года без привлечения финансирования, без выхода на биржу, без коммерциализации. Это правило, которое лично установил Лян Вэньфэн. Сейчас половина правил нарушена: первый раунд внешнего финансирования завершен, более 500 млрд юаней, дооценочная стоимость — 3675 млрд юаней. Лян Вэньфэн вложил собственные 200 млрд юаней.
Какова была первая реакция внешнего мира? «Он наконец сдался капиталу».
Really?
Прочитав эту запись беседы с Лян Вэньфэном, длившуюся почти 4 часа и насчитывающую 118 сообщений, я пришел к противоположному выводу. Это не покорность — это человек с чрезвычайной самоконтролем, который самым нежелательным для него способом пытается сохранить то, что для него единственно важно.
Финансирование — это не поворот, а однократное устранение наибольшего риска
Сначала посмотрим на состав участников. Лян Вэньфэн вложил личные средства в размере 20 млрд юаней и является абсолютным крупнейшим инвестором, полностью контролируя компанию. Tencent — 10 млрд юаней, система CATL — 5 млрд юаней, NetEase, JD.com и IDG — по 3 млрд юаней каждый, Национальный инвестиционный фонд по развитию индустрии искусственного интеллекта — 1 млрд юаней.
Этот список не составлен случайно. Лян Вэньфэн сам сказал, что инвесторы были «тщательно отобраны», и единственный критерий — это наибольшая согласованность интересов, наименьшая враждебность и наибольшее желание добиться нашего успеха.
Тенсент предоставляет облачные технологии и трафик, CATL — энергию и промышленные сценарии, государственные структуры дают гарантии. Ни одного чисто финансового спекулянта. Это «список стратегических партнеров», а не «список привлечения капитала».
Тогда зачем занимать?
Ответ скрыт в его постоянно повторяемой фразе: «Наш главный интерес — сохранить стабильность команды, можно даже сказать, что это единственный главный интерес».
Он открыто признал это. Стабильность команды — это, по его мнению, наибольший риск и самая большая слабость. В эпоху, когда крупные компании из Кремниевой долины предлагают зарплату в сто миллионов долларов в год, на чем может основываться привлекательность компании, которая не котируется на бирже и у которой сотрудники не могут реализовать свои опционные акции, чтобы удержать самых опытных и ключевых исследователей?
После финансирования он сам дал ответ: «Этот риск значительно снизился благодаря недавнему раунду финансирования, поскольку сумма опционов, полученных участниками, достаточно велика».
Поняли? Первая цель этого раунда финансирования — не покупка карт и не расширение, а реальная выплата核心 команде. Это раз и навсегда устраняет вопрос: «Не уйдут ли люди?»
Деньги — не проблема, карта — проблема, самые ценные ресурсы — это люди. Лян Вэньфэн всё хорошо продумал.
Эта дорожная карта — настоящая изюминка этого мероприятия
Если финансирование — это новость, то дорожная карта — это суть.
Лян Вэньфэн описал эволюцию AGI как лестницу, на каждой ступени которой ничего не теряется:
Прошлогодняя ступень — цепочка рассуждений. Этогодняя ступень — агент. А после агента он неоднократно возвращается к одному слову — непрерывное обучение.
Его логическая цепочка остра, как хирургический скальпель. Может ли ИИ сейчас заменить сотрудников? Нет. Почему? Потому что он не может, как новый сотрудник, «прийти в компанию и освоиться за два месяца». Но что, если он обретет способность к непрерывному обучению? Он говорит: «Тогда он сможет заменить всех людей».
Выше — сингулярность. Когда модель сможет постоянно учиться, она сможет самостоятельно разрабатывать следующую версию себя. ИИ ускоряет ИИ. Тогда рост перестанет быть линейным.
И последним является эмбоди-интеллект — выход в реальный мир, выполнение домашних дел, уход за пожилыми.
Этот порядок заслуживает внимания. Лян Вэньфэн прямо заявил, что самые популярные на рынке генераторы видео и мировые модели «не относятся к основной линии». Он сказал это откровенно: генерация видео — это выгодный бизнес в коммерческом плане, но «не имеет никакого отношения к интеллекту; мы не будем заниматься этим только потому, что это выгодный бизнес».
Какая это стойкость?
Когда вся отрасль гонится за мультимодальными демонстрациями, которые сразу приносят прибыль и привлекают внимание, DeepSeek говорит: я занимаюсь только тем, что относится к основной линии разработки интеллекта. Это не высокомерие, это фокус — фокус на том, что нужно сделать немного, поэтому не нужно работать сверхурочно.
Интересно, что рынок уже проголосовал за эту оценку. В июле этого года была выпущена официальная версия DeepSeek V4. V4-Pro использует разреженную архитектуру экспертов с 1,6 триллиона параметров, активируя около 49 миллиардов параметров на токен; V4-Flash еще легче — 284 миллиарда общих параметров, активируя 13 миллиардов. Обе версии поддерживают сверхдлинный контекст в 1 миллион токенов и полностью открыты по лицензии MIT. На программном бенчмарке SWE-bench Verified V4 установила рекорд для открытых моделей — 80,6%.
С фокусом на основной линии, плоды, конечно, появились.
«Отстал на два года, используя всего одну двадцатую вычислительной мощности» — в этом самоироничном заявлении скрыта вся амбициозность
Оценка Ли Вэньфэна разрыва была откровенной и удивительной.
Он сказал, что основное различие между DeepSeek и США заключается в ресурсах, а в людях разница почти отсутствует — «это те же самые люди, возможно, китайцы». Некоторые остались в стране, некоторые уехали за границу — не все умные люди уехали.
В чем же разница? Он дал почти формулированное заявление: отстают от США на 6–18 месяцев, используя всего одну двадцатую мощности вычислений США, но всё равно добиваются результата.
Это выглядит как признание поражения, но на самом деле — гордость. Двадцать часть вычислительной мощности, достигшая результата, отстающего всего на год — это сама по себе ужасающая эффективность.
А его настоящая цель — следующая фраза: «В будущем мы перепишем эту историю, сократив временной разрыв до 6 месяцев, 3 месяцев, используя лишь долю вычислительной мощности».
От «одной двадцатой вычислительной мощности, отставание на два года» к «части вычислительной мощности, всего на три месяца отстаёт». Именно это — настоящая ориентир для дальнейшего развития DeepSeek.
Почему вычислительная мощность так важна? Он говорит это однозначно: «Все различия, которые мы наблюдаем — в талантах, возможностях моделей и приложениях — можно считать результатом различий в вычислительных ресурсах». Он верит в масштабирование и признает, что единственным препятствием для масштабирования является недостаток видеокарт.
Так в чем вопрос — откуда взять карту?
Ставка на китайские чипы — это самый смелый ход на этой встрече.
Это то, что я считаю самым значимым и требующим времени для проверки суждением во всей расшифровке.
Лян Вэньфэн «оптимистично» относится к отечественным вычислительным мощностям. Он даже произнес очень серьезную фразу: «В вопросе отечественных вычислительных мощностей NVIDIA копает себе могилу.»
Его аргументы состоят из трех уровней.
На первом уровне защитный барьер CUDA быстро разрушается. Причина — сама ИИ: с появлением ИИ, способного писать код, воссоздание экосистемы стало намного проще, чем раньше.
На втором уровне DeepSeek уже практически вышел из экосистемы NVIDIA в практическом применении. Он сообщил, что при обучении V3 хотя и использовались карты NVIDIA, экосистема NVIDIA практически не применялась — решение заключалось в создании высокого уровня компилятора под названием TileLang, на основе которого были выполнены все остальные задачи.
Третий уровень, самый ключевой пункт: Huawei. Он считает, что суперузлы Huawei 950 по производительности и цене могут «полностью заменить NVIDIA GB200 и GB300», и приводит уже широко известную фразу: «Четыре карты Huawei равны одной карте NVIDIA».
Это не пустые слова. С момента выпуска V4 в апреле этого года уже было четко указано совместимость с Huawei Ascend 950. DeepSeek открыто заявила: ожидается, что после массового выхода на рынок суперузлов Ascend 950 во второй половине 2026 года стоимость единицы токена V4-Pro сможет значительно снизиться. Лян Вэньфэн свел единственную проблему к «недостаточной производственной мощности», подчеркнув, что «проблем с оборудованием и экосистемой нет».
Он даже предоставил проверяемый график: «В течение следующего года мы сможем подтвердить, что экосистема отечественных чипов не имеет никаких проблем».
Это утверждение может быть опровергнуто временем, а может быть и вознесено им. Я склоняюсь ко второму — ведь при реальных ограничениях, когда невозможно купить топовые карты NVIDIA, «все вынуждены будут перейти на отечественные решения», и спрос насильно ускорит созревание экосистемы. Ограничения порождают инновации — это уже произошло с DeepSeek.
Открытый исходный код, разумное ценообразование, заработок на разумную прибыль: сдержанность — это сама по себе стратегия
Вернёмся к первоначальному вопросу: нарушив правило «не привлекать финансирование», не перейдёт ли DeepSeek и границу «не коммерциализации»?
Смотря на данные, ответ — нет.
Открытый исходный код, Лян Вэньфэн твердо заявил: мы откроем исходный код, даже самые мощные модели будут открыты, и версии с открытым исходным кодом будут полностью совпадать с версиями, развернутыми нами сами, мы не будем ничего скрывать. Он задал вопрос: в чем преимущество закрытого исходного кода? «Модели ByteDance закрыты, в чем их преимущество? Я не вижу его.»
Более важно его суждение о связи между открытым исходным кодом и доходами — «Открытый исходный код не оказывает никакого влияния на нашу бизнес-модель». Даже если предоставить вам всё, другим всё равно будет крайне сложно использовать это и снизить затраты до достаточного уровня — барьеры остаются очень высокими.
В ценовой политике он проявил такую же сдержанность, что почти противоречит коммерческой интуиции. Ценовая стратегия API DeepSeek направлена лишь на достижение разумной прибыли — достаточно, чтобы окупить закупку оборудования за десять месяцев. Он честно признает, что для максимизации прибыли цены следовало бы установить выше, поскольку спрос в этом сегменте практически неэластичен — даже при удвоении цены потребление токенов останется примерно на том же уровне. Однако он отказывается это делать. Ранее, когда цена одной из моделей была завышена и команда была недовольна, он сразу снизил цену до четверти.
Эта сдержанность на сегодняшнем рынке выглядит какая? V4 в официальной версии использует «пиковую и низовую ценовую модель»: в часы пик цены удваиваются, а в периоды спада — крайне низкие; в лагере открытых моделей он создал разрыв в цене с закрытыми флагманскими продуктами, измеряемый в разах. По оценкам, эта ценовая разница составляет один-два порядка величины.
Лян Вэньфэн дал следующее резюме, которое, по моему мнению, является ключевым моментом всего общения:
Тот, кто хочет получить больше, проиграет тому, кто хочет получить меньше. Если ваша цель — получить больше, вы уже проиграли.
Это не моральное представление. Это стратегия, которую он многократно проверил: сдержанность повышает вероятность создания AGI; чем более сдержан, тем легче добиться успеха.
Заключение: Куда пойти компании, которая не хочет стать «следующим байтом»
Так куда же ведет дальнейший путь DeepSeek?
Соединив эти 118 пунктов, картина становится ясной.
Он не стремится стать суперприложением и не конкурирует с Tencent и ByteDance за рынок. Его цель — коммерциализация: «Правительство не даст мне ни копейки», и в худшем случае «полный фокус на продаже API хватит, чтобы поддержать публичную компанию». Сейчас основной коммерческий приоритет — универсальные агенты, особенно Coding Agent; другие вертикальные агенты имеют более низкий приоритет. Компания уже заявила, что если в этом году доход от B2B-сегмента достигнет нескольких сотен миллионов долларов США при добавлении пользователей C2C, «компания уже близка к получению чистой прибыли».
Рынок также предоставляет ему еще более широкие перспективы. Едва завершилось финансирование, как появились слухи о том, что DeepSeek может списаться на материковом Китае уже в следующем году, а ее оценка продолжит расти. Тот, кто раньше говорил «не будем списываться», теперь неустанно преследуется капиталом, который предлагает «оплатить».
Но ты спрашиваешь, заботится ли Лян Вэньфэн об этом?
Я думаю, ему это не особо важно. Он жестко заявил: настоящая цель — заставить AGI итерировать следующую версию модели, а после того как появится эмбодимент, пусть роботы строят следующие версии роботов. Что касается долей, сверхприбылей и капитализации — «AI — это слишком масштабная вещь, ты просто возьми хоть немного, и прибыль будет огромной».
Человек, готовый взять меньше, группа людей, называющих себя «очень обычными», используя двадцатую часть вычислительной мощности, догоняют самую передовую технологию, отставая всего на год с небольшим.
Сейчас они получили 50 миллиардов, закрепили сердца людей, поставили на карту отечественные чипы и выложили график на стол.
В следующем году наступит период проверки. Сможет ли отечественная экосистема оправдать ожидания, сможет ли непрерывное обучение достичь прорыва — сможет ли нарратив «три месяца» удержаться? Ответа нет в презентациях, он находится в росте производственных мощностей Ascend и в логах обучения V5.
Сдержанные люди часто побеждают в конце. На этот раз я готов подождать и посмотреть.
Источник:
- Sina Finance: «Запись встречи по привлечению инвестиций DeepSeek: Лян Вэньфэн разбирает технологии и бизнес-логику крупных моделей», 23 июля 2026 года
- East Money: «Первый раунд финансирования DeepSeek завершен, общая сумма составила около 51 млрд юаней, инвесторами выступили Tencent, CATL и другие», июль 2026 года
- Да Хэ Бао · Да Хэ Цай Фань Ли: «Утечка речи Лян Вэньфэна на инвестиционной встрече за 4 часа: Почему DeepSeek не занимается „более прибыльными“ делами?», июль 2026 г.
- Sina Finance (Caijing): «DeepSeek-V4 поддерживает чип Ascend 950 от Huawei», 24 апреля 2026 года
- Caixin: «DeepSeek: Ожидается, что после массового выхода на рынок суперузлов Ascend 950 во второй половине года стоимость использования V4-Pro значительно снизится», 23 июля 2026 года
- EET-China: «DeepSeek V4 вызвал безумие на рынке китайских вычислительных мощностей: Huawei Ascend 950 раскупают крупные компании», апрель 2026 г.
- meshlaunch: «DeepSeek V4 Full Release (July 2026): Pricing, Benchmarks & Migration», 20 июня 2026 г.
- n1n.ai Explore:《DeepSeek V4 GA и открытый исходный код: анализ разрыва в ценах на ИЯП》, 21 июля 2026 года
