Nvidia раздаёт модели ИИ, как бесплатные образцы в Costco. Логика та же: как только вы попробуете продукт, вы вернётесь, чтобы купить аппаратное обеспечение, на котором он работает лучше всего.
Последний выпуск компании, Nemotron 3.5 Lightning, — это модель с 30 миллиардами параметров, запущенная 11 августа 2026 года. Она использует архитектуру Mixture of Experts (MoE) с примерно 3 миллиардами активных параметров, что позволяет ей работать на одном GPU при поддержке контекстных окон до 1 миллиона токенов. Это серьезный объем возможностей для модели, которую можно скачать с Hugging Face совершенно бесплатно.
План «бритвы и лезвий», усиленный
Nvidia теперь предоставляет бесплатную хостинговую инференцию для более чем 100 моделей ИИ через свои API на build.nvidia.com. Разработчики могут получить доступ к этим моделям без использования кредитной карты, протестировать их на своих задачах и создавать приложения на их основе.
В начале 2026 года Nvidia представила Nemotron 3 Ultra — монстр с 550 миллиардами параметров — вместе с программным обеспечением Dynamo 1.0, которое, по сообщениям, повышает производительность GPU до 7 раз.
Почему открытые модели важны для бизнеса на базе GPU
Индустрия ИИ в значительной степени разделилась на два лагеря. С одной стороны, компании, такие как OpenAI и Anthropic, создают закрытые, проприетарные модели за платными API-ограничениями. С другой — Meta со своей серией Llama и теперь Nvidia, продвигающие альтернативы с открытыми весами, которые может загрузить, изменить и развернуть кто угодно.
Модели выпущены под разрешительными лицензиями, охватывающими целые семейства, такие как Nemotron и Cosmos. Они оптимизированы для специфических аппаратных форматов Nvidia, таких как NVFP4 — формат квантизации, разработанный для чипов Nvidia.
В августе 2026 года Nvidia также представила NeMo Switchyard — инструмент, который умно распределяет задачи между различными моделями для снижения затрат на вывод.
