Nag-enter sa mass production ang NVIDIA Vera Rubin CPU, nakatarget sa AI infrastructure

iconMetaEra
I-share
AI summary iconSummary
Ang NVIDIA Vera Rubin NVL72 CPU ay nagsimula na sa mass production, kasama ang higit sa 300 na mga kakilala at 350+ na pabrika sa 30 bansa. Ang chip ay may 88 Olympus cores at naipadala na sa mga kliyente tulad ng OpenAI at SpaceX. Habang ipinapakita ng fear and greed index ang paglalago ng tiwala sa merkado, hinahamon ng NVIDIA ang Intel at AMD sa pamamagitan ng pagpapalaganap ng buong rack systems na may custom CPU nito. Maaaring makakita ng galaw ang mga altcoin na dapat bisitahin habang tumataas ang pangangailangan sa AI infrastructure.
Ang NVIDIA Vera Rubin NVL72 ay nasa fase ng pagtaas ng produksyon, na may suplay na nakakapalibot sa higit sa 350 na pabrika at 30 bansa, kasali ang higit sa 300 na mga kakilala. Ang mga Vera chip ay nai-deliver na sa mga kliyente tulad ng OpenAI, Anthropic, at SpaceX, at inaasahang maipapadala ang 1.3 milyon na unit sa taong ito, na may average na presyo ng humigit-kumulang $5,000 bawat unit. Ang NVIDIA ay nagpapalawak ng kanilang laban mula sa GPU market patungo sa CPU market, na nagtataya na ang AI agents ay maglilikha ng isang bagong “CPU moment,” kung saan ang pangmatagalang laki ng server CPU market ay maaaring umabot sa $200 bilyon. Ang Vera ay gumagamit ng 88 Olympus cores, na nagbibigay-diin sa single-threaded performance kaysa sa bilang ng cores, at maaaring makamit ang 1.8 beses na bilis ng isang x86 CPU sa mga partikular na gawain. Ang NVIDIA ay hindi na lamang bumebenta ng mga chip, kundi bumebenta ng buong server rack systems na may kanilang sariling disenyo na chip, na direktang nag-uugnay sa pangunahing interes ng AMD at Intel sa server CPU market.

May-akda ng artikulo, pinagkunan: Tencent News

NVIDIA ay naglalagay ng apoy mula sa GPU market patungo sa CPU.

Sa harap ng isang aktibidad tungkol sa AI na isinasagawa ng AMD, inilabas ng NVIDIA noong Martes, ika-21, sa Eastern Time, ang pinakabagong pag-unlad sa susunod na henerasyon ng Vera Rubin platform: ang Vera Rubin NVL72 ay nasa fase ng pagtaas ng produksyon, at sinabi ng NVIDIA na ang supply chain ng platform ay sumasakop sa higit sa 350 na pabrika at 30 bansa, na may higit sa 300 na mga kasosyo na nakikilahok.

Sambil thereof, ipinakita ng NVIDIA ang mga performance data ng Vera CPU at Vera Rubin platform sa mga AI agent workload, upang patunayan na habang ang AI ay lumilipat mula sa “pagsagot sa mga tanong” patungo sa pagpaplano, pagpapagana ng mga tool, at pagpapatupad ng mga gawain, ang CPU ay naging bagong battlefield sa AI infrastructure.

Ang mga kompletong spesipikasyon, mga resulta ng benchmark, at impormasyon sa arkitektura ng CPU na Vera para sa data center na inilabas ni NVIDIA ay mga kritikal na datos na kailangan ng mga potensyal na customer para sa komprehensibong pag-evaluate sa chip. Sinabi ng kumpanya na natapos na ang pagpapadala ng Vera chip sa mga customer tulad ng OpenAI, Anthropic, at SpaceX noong Hunyo.

Ang paglunsad ng Vera ay ang pinakabagong hakbang sa pagsasama-sama ng patakarang pambisig ni NVIDIA. Layunin ng kumpanya na ibenta ang buong sistema ng server na may sariling disenyo na chip, hindi lamang ang mga hiwalay na chip. Ayon sa pagtataya ng Wolfe Research, ang average price ng bawat chip na Vera ay humigit-kumulang $5,000, at inaasahang magkakaroon ng halos 1.3 milyong unit na ipapadala sa taong ito. Para sa AMD at Intel, direktang banta ng aksyon ni NVIDIA ang kanilang pangunahing interes sa merkado ng server CPU.

Hindi ito ang unang pagkakataon na inihayag ng NVIDIA ang pagpapalabas ng Vera CPU sa mass production. Noong huling bahagi ng Mayo, inihayag ng NVIDIA na nasa full production na ang Vera, at sinabi na ang chip na ito ay maaaring makumpleto ang mga partikular na gawain nang 1.8 beses na mas mabilis kaysa sa tradisyonal na x86 CPU. Noong gitna ng Mayo, ipinadala rin ng NVIDIA ang mga unang sistema ng Vera CPU sa mga customer tulad ng Anthropic, OpenAI, at SpaceX AI. Ang bigat ng paunawa na ito ay mas nakatuon sa pagtaas ng production ng buong platform na Vera Rubin, ang deployment ng mga customer, at ang performance nito sa tunay na production environment.

Ang pag-angat ng mga AI agent, ang CPU ay muli naging "pangunahing bottleneck"

Ang pangunahang lohika ng NVIDIA sa pagtaya sa CPU ay ang pagbabago ng mga AI application.

Ang pangunahing gawain ng tradisyonal na generatibong AI ay ang pagbuo ng sagot batay sa input ng user, kung saan ang GPU ang nagdedeclare ng malalaking model computation, habang ang CPU ay mas nakatuon sa mas pangalawang pagpaplano. Ngunit habang mabilis na umuunlad ang AI agents, nagsisimula nang mag-isa ang AI system na hatiin ang mga gawain, gamitin ang mga panlabas na kasangkapan, jalurin ang code, ma-access ang data, at paulit-ulit na isasagawa ang pagtataya sa mga resulta.

Sa proseso na ito, kailangang prozesuhin ng CPU ang maraming mga gawain na may mababang latency at real-time. Naniniwala ang NVIDIA na ang AI agents ay hindi lamang nag-iisa sa mga workload na nakasalalay sa GPU: ang bawat environment ng agent, pagtawag sa mga kasangkapan, pag-ayos ng mga gawain, at paghahanap ng mga data na may mahabang konteksto, ay nangangailangan ng pakikilahok ng CPU.

Noong ipinakilala ni NVIDIA ang Vera, sinabi nito na ang agent-based AI ay nagbuo ng isang bagong “CPU moment.” Ang kanilang pagtataya ay na habang ang mga AI system ay lumilipat mula sa “pagsagot sa mga tanong” patungo sa “paggawa ng aksyon,” ang papel ng CPU sa buong AI factory ay magiging mas malinaw na mas mataas.

Inaasahan ng NVIDIA na ang matagalang sukat ng merkado ng server CPU ay maaaring makamit ang $200 bilyon. Ang bilang na ito ay napakalaking pagtaas kumpara sa tradisyonal na merkado ng server CPU, ngunit ang lohika ng NVIDIA ay batay sa ideya na ang hangganan ng merkado ng CPU sa hinaharap ay hindi na magiging limitado sa tradisyonal na enterprise server, kundi magkakaroon ng paglalawak patungo sa AI inference, AI agents, reinforcement learning, data processing, at iba’t ibang gawain sa kontrol at pag-organisa ng AI infrastructure.

Ito rin ang dahilan kung bakit sinusubukang muli pang-ugnayin ng NVIDIA ang mga patakaran sa kompetisyon ng CPU.

Hindi sumasalo sa bilang ng core, pinagsisikap ng NVIDIA ang "single-core speed"

Ang desenyong ruta ni Vera ay may malaking pagkakaiba sa tradisyonal na CPU ng server.

Sinabi ng NVIDIA na ang Vera ay kanilang unang CPU na espesyal na disenyo para sa agent-based AI, na may 88 na Olympus core na disenyo ng NVIDIA at 1.2TB/s na memory bandwidth. Bago ito, sinabi ng NVIDIA na ang Vera ay nagtataglay ng 50% na pagtaas sa single-core performance kumpara sa tradisyonal na CPU; sa mga pagsubok na ipinahayag noong huling bahagi ng Mayo, ang Vera ay nakamit ang 1.8 beses na bilis sa pagkumpleto ng mga partikular na gawain kumpara sa x86 CPU.

Sa pinakabagong paglalathala, pinahusay ng NVIDIA ang pangunahing disenyong direksyon ng Vera: kaysa sa pagdadagdag ng mas maraming core, mas binibigyang-pansin ng Vera ang single-threaded performance, ang bandwidth ng komunikasyon sa pagitan ng mga core, at ang latency ng pag-access sa memorya.

Sinabi ng NVIDIA na ang custom na Olympus core ng Vera ay nagpapahintulot sa 2x na single-threaded performance, 3x na bandwidth sa pagitan ng cores, at 40% na pagbawas sa memory latency kumpara sa competitive chiplet designs. Ang layunin nito ay gawing mas mabilis ang pagkumpleto ng mga gawain ng AI agents at ibalik agad ang computing resources sa GPU upang pataasin ang paggamit ng buong AI factory.

Ang negosyong lohika sa likod nito ay diretso: ang GPU ay isa sa pinakamahal at pinakakakulang na computing resource sa mga data center ng AI. Kung masyadong mabagal ang pagproseso ng CPU, maaaring maghintay ang GPU. Nais ng NVIDIA na mapabawas ang oras na “walang gawain” na ito sa pamamagitan ng espesyal na pag-optimize ng CPU.

Sa production testing ng DeepInfra sa Vera CPU, sinabi ng NVIDIA na ang Vera ay maaaring suportahan ang pinakamaraming 1.6 beses ang bilang ng concurrent AI agents at makamit ang pinakamataas na 2.2 beses ang bilis ng task orchestration. Mahalagang tandaan na ang mga datos na ito ay galing sa partikular na testing environment ng customer at hindi nangangahulugan na ang Vera ay lubos na mas mabuti sa lahat ng pangkalahatang CPU workloads.

Ang pagkakalaban ay umabot mula sa isang chip patungo sa buong "AI factory"

Ang Vera CPU ay bahagi lamang ng mas malawak na istratehiya ng NVIDIA.

Sa platform na Vera Rubin, kinabibilangan ng NVIDIA ang Vera CPU kasama ang Rubin GPU, Groq 3 LPX, Spectrum-6 network chip, ConnectX-9 SuperNIC, at BlueField-4 sa isang co-designed system.

Sinabi ng NVIDIA na ang Vera Rubin NVL72 ay nagsisimula na sa buong mundo sa pagpapalawak ng produksyon, at ang mga kasosyo tulad ng CoreWeave, Google Cloud, Microsoft Azure, at Oracle Cloud Infrastructure ay nagsisimula na sa pag-deploy ng mga rack. Sinabi rin ng NVIDIA na ang kanilang supply chain ay sumasakop sa higit sa 350 na pabrika at 30 bansa, kasama ang higit sa 300 na mga kasosyo.

Sa pagsubok ng mga customer, ginamit ni CoreWeave ang Vera Rubin NVL72 upang i-run ang DeepSeek-R1 test at sinabi na mas mataas ng 10 beses ang bilang ng Token na ginagawa bawat megawatt bawat segundo kumpara sa nakaraang henerasyon ng Grace Blackwell NVL72. Ang Google Cloud ay naglunsad na ng A5X instance na batay sa Vera Rubin NVL72, at sinabi ng NVIDIA na sa ilang partikular na scenaryo, ito ay maaaring magbigay ng mas mababang gastos sa inference at mas mataas na Token throughput bawat megawatt.

Ibig sabihin nito na ang mga kalaban ni NVIDIA ay hindi na lamang ang AMD Instinct GPU o Intel Gaudi at iba pang magkakahiwalay na acceleration chips.

Sinusubaybayan ng NVIDIA ang buong infrastruktura: ang CPU para sa pag-schedule, ang GPU para sa pag-compute, ang network chip para sa high-speed connectivity, at ang software para sa pag-schedule at pag-optimize, na ibinibigay sa mga customer bilang isang sistema sa antas ng rack o data center.

Ang banta sa AMD at Intel ay ang pagkakaroon ng posibilidad na hindi kailangan ng NVIDIA na magkompete nang ganap na symmetrical sa tradisyonal na CPU market. Ang layunin ng NVIDIA ay magsimula sa pinakamalaking potensyal na bahagi ng AI server—una ay humawak sa mga workloads tulad ng agent-based AI, reinforcement learning, at high-performance AI inference—at pagkatapos ay palawakin ang aplikasyon ng CPU.

Ang tradisyonal na kahusayan ng AMD at Intel ay nakakatanggap ng bagong hamon

Matagal nang pinamumunuan ng Intel at AMD ang thị trường ng server CPU.

Ngayon, ang pananaw ng NVIDIA ay ang AI infrastructure ay nagbabago sa pagkakasunod-sunod ng halaga ng CPU. Noong nakaraan, ang kompetisyon sa server CPU ay mas nakatuon sa bilang ng cores, pangkalahatang computing power, at kabuuang throughput; ngunit sa panahon ng agent-based AI, ang kahalagahan ng low latency, single-threaded performance, memory bandwidth, at efficiency sa task orchestration ay tumataas.

Ito ang eksaktong puwang sa merkado na naniniwala ang NVIDIA na kayang nilang sagutin.

Sa pananaw ng produkto, maaaring gamitin ang Vera bilang sariling CPU o kasama ang NVIDIA GPU upang bumuo ng Vera Rubin system. Ipinapakilala rin ng NVIDIA ito bilang mahalagang komponente na nag-uugnay sa mga AI agent at mga mapagkukunan ng GPU computing.

Kasama na ni NVIDIA sa kanilang naunang ipinahayag na listahan ng mga kliyente ang mga AI company tulad ng Anthropic, OpenAI, at SpaceXAI, pati na rin ang mga cloud service provider tulad ng ByteDance, CoreWeave, at Oracle Cloud Infrastructure; ang mga manufacturer ng server tulad ng Dell, Hewlett Packard Enterprise, Lenovo, at AMD ay nagpapabilis din sa pagbuo ng mga sistema batay sa Vera.

Ito ay nagbibigay sa NVIDIA ng isang kapakinabangan na iba sa mga tradisyonal na tagagawa ng CPU: maaari nito ipagkaloob sa mga kliyente ang buong solusyon sa pamamagitan ng kombinasyon ng GPU, CPU, network, at software.

Ngunit hindi ito nangangahulugan na kayang madaling palitan ng NVIDIA ang AMD at Intel.

Ang kompetisyon sa merkado ng CPU ay hindi lamang tungkol sa pagkakaroon ng performance ng chip, kundi pati na rin ang software ecosystem, sertipikasyon ng customer, compatibility ng server, at matagalang ugnayan sa pagbibigay. Lalo na ang mga malalaking cloud service provider at corporate customers, karaniwang kailangan ng maraming taon upang matapos ang paglipat sa hardware platform.

Kaya ang Vera ay makakalawak talaga mula sa mga espesipikong aplikasyon ng AI patungo sa mas malawak na merkado ng server ay nakadepende kung makakakuha ba ang mga customer ng sapat na malinaw na pang-Performance at kahusayan sa gastos.

NVIDIA ay buksan ang bagong kurba ng kita labas sa GPU

Ang pagpapalabas ng impormasyon tungkol sa produksyon at performance ng Vera Rubin ni NVIDIA sa harap ng AMD AI event ay may malinaw na kahulugan sa kompetisyon ng merkado.

Sa mga nakalipas na taon, halos nag-isa ang NVIDIA sa pinakamalaking kita sa infrastruktura ng AI sa pamamagitan ng kanilang GPU. Ngunit habang patuloy na pinalalawak ng AMD ang kanilang pagpapalawak sa AI accelerators at sinubukan ng Intel na makahanap ng pagbubukas sa merkado ng AI chips, ang merkado ay nagsisimulang magbigay ng mas maraming pansin sa kaya ba ng NVIDIA na panatilihin ang kanilang mabilis na paglago.

Samantala, ang CPU business ng AMD at Intel ay bumalik sa atensyon ng merkado dahil sa bagong pag-asa sa pangangailangan mula sa agent-based AI.

Ang tugon ni NVIDIA ay: Kung ang halaga ng AI data center ay umuunlad mula sa isang GPU hanggang sa isang buong AI factory, hindi kailangang ipagbigay-alam ni NVIDIA ang CPU market sa mga kalaban.

Sa pananaw na ito, ang Vera ay hindi simpleng isang server CPU na inilabas ng NVIDIA, kundi karagdagang pagpapalawig ng kanilang patakaran sa vertical integration.

Nais ng NVIDIA na ang mga customer ay huwag na bumili ng magkahiwalay na GPU, CPU, o network chip, kundi isang buong imprastruktura na kayang patakbuhin ang AI models at AI agents nang direkta.

Kung ang agent-based AI ay totoo nang magiging pangunahing drivert ng paglago sa pangangailangan sa computing, ang mga ipinaglalaban ni NVIDIA ay maaaring hindi lamang ang bahagi ng merkado ng GPU, kundi ang buong halaga ng chain sa AI server computing.

At ang ibig sabihin nito ay ang susunod na kalaban ni AMD at Intel ay hindi na lamang isa’t isa, kundi ang NVIDIA, na mayroon nang kakayahan sa GPU, CPU, network, software, at buong system.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.