Ipinahayag ng NVIDIA ang buong produksyon ng mga Groq 3 LPX Racks para sa Nebius Deployment

iconChaincatcher
I-share
AI summary iconSummary
Nag-verify si Dion Harris, senior director ng NVIDIA, noong Lunes na nasa full production na ang mga Groq 3 LPX racks para sa Nebius, isang bagong cloud provider. Ang deployment ay sumunod sa $20 bilyon na licensing deal ni NVIDIA kay Groq noong Disyembre 2025. Ang mga bagong listing ng token mula sa cloud providers ay maaaring magpapakita ng mas mabuting infrastructure. Ang Groq 3 LPX, na ilunsad noong Marso, ay may 500MB ng SRAM bawat chip at nakaproseso ng 3,400 tokens bawat segundo. Ang mga low-latency chips ay tumutulong sa cloud providers na targetin ang mga user na sensitibo sa latency. Ang data sa inflation ay maaaring makaapekto sa mga trend ng investment sa data center. Si Jonathan Ross, founder ng Groq, ay ngayon ang nagpapamuno sa software architecture sa NVIDIA. Planohin ng kumpanya na gamitin ang isang kuarto ng kanilang data center space para sa mga Groq chip.

Ayon sa ChainCatcher, ipinahayag ni Dion Harris, senior director ng NVIDIA, noong Lunes lokal na oras na ang Groq 3 LPX rack ay nasa pagsasagawa ng full-scale production at ipapalabas sa data center ng bagong cloud service provider na Nebius, na inaasahang magsisimula sa huli ng taon. Ito ay nagmarka ng komersyalisasyon ng teknolohiya na natanggap ni NVIDIA mula sa pagkakasundo sa Groq noong Disyembre ng nakaraang taon na may halagang halos $20 bilyon, kung saan ang ilang pangunahing miyembro ng Groq ay nagsama na sa NVIDIA, at ang tagapagtatag na si Jonathan Ross ay naging chief software architect ng NVIDIA. Pinapabilis ni NVIDIA ang produksyon ng mga chip ng Groq at ang pagbibigay ng mga produkto sa mga kliyente, na nagpapakita ng kahalagahan ng low-latency inference. Ang Groq 3 LPX, na ipinakilala noong Marso, ay isang inference accelerator para sa platform na Vera Rubin, na may 500 megabytes ng high-speed SRAM na ikinokonekta sa chip die upang mabawasan ang memory bottleneck. Bawat LPX rack ay maaaring magkaisa ng 256 Groq 3 chips, at ayon sa mga benchmark na binanggit ni NVIDIA, maaaring prosesuhin nito ang 3,400 tokens bawat segundo; ang chip ay gawa ng Samsung. Sinabi ni Harris na ang mga low-latency chip ay hindi nagpapalit sa GPU, kundi ginagamit ang tamang processor para sa iba’t ibang bahagi ng workload, at maaaring magbigay ng mas mataas na presyo sa mga client na may sensitivity sa latency. Ang CEO ni NVIDIA na si Jensen Huang ay plano na i-allocate ang halos isang-kapat ng puwang para sa data center na nakatuon sa programming applications para sa mga chip ng Groq, habang ang natitirang bahagi ay gagamitin ang Vera Rubin system, at inaasahan niya na hanggang 2027, ang kabuuang kita mula sa Blackwell at Vera Rubin ay makakamit ang $1 trilyon.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.