Découverte Beating AI : NVIDIA Groq 3 LPX entre en production de masse. En décembre dernier, NVIDIA a acquis la licence des technologies de Groq pour environ 20 milliards de dollars et recruté l'équipe clé, dont le fondateur Jonathan Ross. Huit mois plus tard, le premier matériel issu de cette transaction est enfin disponible. Le Groq 3 LPX est un système dédié à l'accélération de l'inférence des grands modèles, composé de 256 puces Groq 3 LPU. Lors des tests d'Artificial Analysis, avec une entrée de 100 000 tokens pour Gemma 4 31B, le Groq 3 LPX a atteint une vitesse de 3 431 tokens sortants par seconde. Dans les mêmes conditions, le plus rapide API publiquement disponible à l'époque ne dépassait pas environ 870 tokens par seconde — soit près de quatre fois moins. En déploiement réel, les GPU Rubin gèrent les calculs les plus intensifs, tandis que le Groq 3 LPX optimise spécifiquement la vitesse de génération des tokens. Pour un agent de codage effectuant des appels modèles consécutifs, plusieurs dizaines ou centaines de fois, cela réduit considérablement le temps d'attente pendant la génération des tokens. Nebius deviendra le premier fournisseur de cloud AI à adopter le Groq 3 LPX. Plus intéressant encore : Groq lui-même figure parmi les premiers utilisateurs et déployera le système en collaboration avec Dell. L'année dernière, Groq a accordé sa licence à NVIDIA ; cette année, il utilise à son tour une version « Groq » conçue par NVIDIA.
L'accord de 2 milliards de dollars de NVIDIA avec Groq porte ses fruits alors que les puces Groq 3 LPX entrent en production de masse
MarsBitPartager
Actualités sur les cryptomonnaies : les puces Groq 3 LPX de NVIDIA ont entré en production de masse complète. En décembre dernier, l'entreprise a acquis la technologie de Groq pour 2 milliards de dollars et a recruté du personnel clé, y compris le fondateur Jonathan Ross. Huit mois plus tard, le premier produit a été lancé. Le système Groq 3 LPX, conçu pour l'inférence de grands modèles, utilise 256 puces Groq 3 LPU. Lors des tests, il a atteint 3 431 tokens de sortie par seconde pour Gemma 2 31B après 100 000 tokens d'entrée — près de quatre fois plus rapide que la meilleure API publique. Nebius sera le premier fournisseur de cloud IA à utiliser Groq 3 LPX, avec Groq et Dell qui le déployeront également. Cette actualité sur les cryptomonnaies marque une étape majeure dans l'accélération de l'IA.
Source:Afficher l'original
Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations.
Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.