ChainCatcher rapporte que Dion Harris, directeur général senior de NVIDIA, a annoncé lundi, heure locale, que les racks Groq 3 LPX sont entrés en production de masse et seront déployés dans les centres de données du nouveau fournisseur de services cloud Nebius, avec une mise en ligne prévue à la fin de cette année. Cela marque la commercialisation officielle des technologies acquises par NVIDIA suite à l'accord d'octroi de licences d'environ 20 milliards de dollars conclu avec Groq en décembre dernier. Plusieurs employés clés de Groq ont rejoint NVIDIA, et son fondateur, Jonathan Ross, occupe désormais le poste d'architecte principal du logiciel chez NVIDIA. NVIDIA accélère la production des puces Groq et les propose à ses clients, soulignant l'importance de l'inférence à faible latence. Le Groq 3 LPX, lancé en mars de cette année, est un accélérateur d'inférence pour la plateforme Vera Rubin ; son architecture intègre 500 mégaoctets de SRAM haute vitesse directement sur le die pour réduire les goulots d'étranglement mémoire. Chaque rack LPX peut intégrer 256 puces Groq 3, et NVIDIA cite des tests de référence indiquant une capacité de traitement de 3 400 tokens par seconde ; ces puces sont fabriquées par Samsung. Harris a déclaré que les puces à faible latence ne remplacent pas les GPU, mais sont conçues pour être utilisées selon les besoins spécifiques des charges de travail ; les fournisseurs de services cloud peuvent proposer des forfaits premium aux clients sensibles à la latence. Le PDG de NVIDIA, Jensen Huang, prévoit d'allouer environ un quart de l'espace des centres de données dédiés aux applications de programmation aux puces Groq, le reste étant dédié aux systèmes Vera Rubin, avec une prévision de ventes cumulées de 1 000 milliards de dollars pour les systèmes Blackwell et Vera Rubin d'ici 2027.
NVIDIA annonce la production complète des baies Groq 3 LPX pour le déploiement Nebius
ChaincatcherPartager
Le directeur senior de NVIDIA, Dion Harris, a confirmé lundi que les racks Groq 3 LPX sont désormais en production complète pour Nebius, un nouveau fournisseur de cloud. Ce déploiement suit l'accord de licence de 20 milliards de dollars conclu par NVIDIA avec Groq en décembre 2025. De nouvelles listings de jetons provenant de fournisseurs de cloud pourraient refléter une infrastructure améliorée. Le Groq 3 LPX, lancé en mars, dispose de 500 Mo de SRAM par puce et traite 3 400 jetons par seconde. Les puces à faible latence permettent aux fournisseurs de cloud de cibler les utilisateurs sensibles à la latence. Les données sur l'inflation pourraient influencer les tendances d'investissement dans les centres de données. Jonathan Ross, fondateur de Groq, dirige désormais l'architecture logicielle chez NVIDIA. L'entreprise prévoit d'allouer un quart de son espace data center aux puces Groq.
Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.