Nvidia lance un modèle IA gratuit de 30 milliards de paramètres pour stimuler les ventes de GPU

iconCryptoBriefing
Partager
AI summary iconRésumé
Nvidia a lancé un modèle IA de 30 milliards de paramètres, Nemotron 3.5 Lightning, le 11 août 2026. Ce modèle utilise une architecture MoE et est optimisé pour les performances sur une seule GPU. Il prend en charge 1 million de jetons et est disponible gratuitement sur Hugging Face. L'entreprise propose également une inférence hébergée gratuite pour plus de 100 modèles via les API de build.nvidia.com. Cette actualité IA + crypto met en lumière la stratégie de Nvidia pour stimuler la demande de GPU. Les informations sur la blockchain révèlent un intérêt croissant pour les outils blockchain alimentés par l'IA. Les développeurs peuvent désormais tester des modèles sans frais initiaux.

Nvidia distribue des modèles d'IA comme des échantillons gratuits chez Costco. La logique est la même : une fois que vous avez essayé le produit, vous reviendrez acheter le matériel qui le fait fonctionner au mieux.

La dernière version de l'entreprise, Nemotron 3.5 Lightning, est un modèle de 30 milliards de paramètres lancé le 11 août 2026. Il utilise une architecture Mixture of Experts (MoE) avec environ 3 milliards de paramètres actifs, ce qui permet de l'exécuter sur une seule GPU tout en prenant en charge des fenêtres de contexte allant jusqu'à 1 million de jetons. C'est une capacité considérable pour un modèle que vous pouvez télécharger gratuitement sur Hugging Face.

Publicité

Le modèle de la lame et du rasoir, suralimenté

Nvidia propose désormais une inférence hébergée gratuite pour plus de 100 modèles d'IA via ses API build.nvidia.com. Les développeurs peuvent accéder à ces modèles sans saisir de carte de crédit, les tester avec leurs propres charges de travail et construire des applications dessus.

Plus tôt en 2026, Nvidia a lancé le Nemotron 3 Ultra, un modèle de 550 milliards de paramètres, ainsi que Dynamo 1.0, un logiciel qui améliorerait selon les rapports les performances GPU jusqu'à 7 fois.

Pourquoi les modèles ouverts sont importants pour le secteur des GPU

L'industrie de l'IA s'est largement divisée en deux camps. D'un côté, vous avez des entreprises comme OpenAI et Anthropic qui développent des modèles fermés et propriétaires derrière des barrières payantes d'API. De l'autre, vous avez Meta avec sa série Llama et désormais Nvidia qui promeuvent des alternatives à poids ouvert que n'importe qui peut télécharger, modifier et déployer.

Les modèles sont publiés sous des licences permissives, couvrant des familles entières telles que Nemotron et Cosmos. Ils sont optimisés pour les formats matériels spécifiques Nvidia, comme NVFP4, un format de quantisation conçu pour les puces Nvidia.

En août 2026, Nvidia a également introduit NeMo Switchyard, un outil qui achemine intelligemment les tâches entre différents modèles pour réduire les coûts d'inférence.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.