Nvidia vient de transformer un accord de licence de 20 milliards de dollars en matériel opérationnel. L'entreprise a confirmé que son système d'inférence IA Groq 3 LPX à faible latence est entré en production complète et sera opérationnel avant la fin de l'année, marquant l'une des plus courtes délais de mise en œuvre depuis la conception dans l'histoire récente de l'infrastructure IA.
Le système, qui intègre 256 unités de traitement linguistique dans une conception refroidie par liquide, est le premier produit tangible de l'accord de licence à succès de Nvidia avec la startup de puces d'inférence Groq, signé la veille de Noël 2025. Nebius sera la première entreprise à le déployer via sa plateforme Token Factory.
Comment un accord de licence est devenu un rack de production en huit mois
L'accord qui a produit ce matériel était inhabituel selon les normes de l'industrie des semi-conducteurs. Plutôt que d'acquérir Groq intégralement, Nvidia a payé 20 milliards de dollars pour une licence non exclusive des conceptions LPU (language processing unit) de Groq, a recruté sélectivement du personnel clé, y compris le fondateur et PDG de Groq, Jonathan Ross, et a laissé Groq en tant qu'entreprise indépendante. Simon Edwards dirige désormais Groq, qui exploite 13 centres de données dans le monde.
Le Groq 3 LPX s'intègre dans la plateforme Vera Rubin de Nvidia, la pile d'infrastructure IA de prochaine génération de l'entreprise. Les chiffres d'efficacité que Nvidia met en avant sont frappants : jusqu'à 35 fois plus de débit par mégawatt par rapport aux configurations classiques.
La dynamique de collecte de fonds de Groq et la position stratégique de Nvidia
Groq a levé 650 millions de dollars en juin 2026, suivis d'un additional de 350 millions de dollars en août 2026, portant sa valorisation à 3,5 milliards de dollars. Nvidia a participé à la levée d'août, renforçant ses liens financiers avec une entreprise à laquelle elle paie déjà des milliards pour obtenir une licence.
Groq agit en tant que partenaire cloud Nvidia, permettant d'intégrer les systèmes Nvidia aux offres propriétaires.
Nebius et le premier déploiement dans le monde réel
Le choix de Nebius comme partenaire de déploiement inaugural est remarquable. La plateforme Token Factory de l'entreprise est conçue pour des charges de travail d'inférence à grande échelle, ce qui en fait un terrain d'essai naturel pour du matériel qui prétend améliorer considérablement l'efficacité de l'inférence.
Nvidia a confirmé son statut de production complète le 24 août 2026, avec un déploiement prévu avant la fin de l'année.
