Sa harap ng taunang pagpapakilala ng produkto ng AMD, ipinakilala nang malakas ng NVIDIA ang mga resulta ng pagsusuri ng bagong platform na Vera Rubin, at ipinahayag nang buo ang mga spesipikasyon ng kanilang sariling CPU na Vera. Ang Vera CPU ay nagtataglay ng pagtaas ng performance na halos dalawang beses sa mga x86 chip sa mga代理式AI task, at nagpapababa ng latency ng anim na beses. Habang tumatakbo ang DeepSeek R1 model sa platform na Vera Rubin NVL72, ang token throughput bawat megawatt ng computing power ay lumago ng sampung beses kumpara sa nakaraang henerasyon na GB200 NVL72. Ang OpenAI, Anthropic, at SpaceX ay natanggap na ang unang mga pagpapadala. Bilang unang server CPU na disenyo ng NVIDIA, ang Vera ay may power consumption na 250-450 watts, sumusuporta sa 1.5TB ng memory, at inaasahang i-ship ang 1.3 milyong piraso sa taong ito. Ito ay nagtuturo na ang NVIDIA ay pumasok nang pormal sa merkado ng server CPU, at direktang tumatalikod sa AMD at Intel. Ang merkado ng server CPU na hinahamon ng代理式AI ay maaaring makamit ang halagang $200 bilyon.May-akda ng artikulo, pinagkunan: Wall Street Journal
Sa harap ng pagkakataon ng taunang pagpapakilala ng produkto ng kanilang kalaban, AMD, inilabas ni NVIDIA ang isang malakas na hakbang sa pamamagitan ng pagpapakita ng mga detalyadong data sa pagsusuri ng bagong Vera Rubin platform, at pormal na ipinahayag ang buong mga spesipikasyon ng kanilang sariling CPU chip, Vera.
Martes, inilabas ni NVIDIA na ang Vera CPU ay may performance na halos dalawang beses na mas mataas sa mga x86 chip sa mga proxy-based AI task, kasama ang pagpapababa ng latency ng anim na beses. Samantala, ang mga maagang production test ng kanilang cloud computing partner na CoreWeave ay nagpakita na ang Vera Rubin NVL72 platform ay nagkakaroon ng 10 beses na mas mataas na token throughput per megawatt kapag tinatakbuan ang DeepSeek R1 model kumpara sa nakaraang sistema na batay sa Blackwell architecture na GB200 NVL72.
Ang pagpapalabas ng mga datos na ito ay may malalim na kahulugan. Ang AMD ay magpapalabas ng kanilang taunang produkto na "Advancing AI" sa San Francisco sa Huwebes ng linggong ito, at ang pagpapalabas ng mga datos sa performance ng NVIDIA sa panahong ito ay karaniwang itinuturing bilang isang sadyang pagpapalakas ng merkado. Para sa mga cloud provider at corporate clients na nagsusuri ng pag-invest sa susunod na henerasyon ng AI infrastructure, ang mga datos na ito ay direktang magdudulot ng epekto sa kanilang desisyon sa pagbili.
Samantala, ipinahayag ng NVIDIA na natapos na ang unang pagpapadala ng Vera CPU noong Hunyo, na may mga kliyente kabilang ang OpenAI, Anthropic, at SpaceX. Ito ang nagmarka ng pagsisimula ng NVIDIA sa merkado ng CPU, na direktang nagtatama sa tradisyonal na teritoryo ng AMD at Intel.
Ipinakilala ni Vera CPU: Pormal na pumasok ang NVIDIA sa merkado ng server CPU Ipinahayag ng NVIDIA noong Martes ang buong mga spesipikasyon, mga resulta ng benchmark, at impormasyon sa arkitektura ng produkto ng CPU para sa data center na Vera, na kailangang data para sa mga potensyal na customer upang masuri nang buo ang chip. Sinabi ng kumpanya na natapos na ang pagpapadala ng Vera chip sa mga customer tulad ng OpenAI, Anthropic, at SpaceX noong Hunyo.
Ang Vera ay ang unang server CPU na disenyo nang buong pagsasakatuparan ni NVIDIA, na gumagamit ng kustomisadong mikroarkitekturang may code name na "Olympus core", at hindi ng umiiral na disenyo mula sa Arm.
Ipinakilala ni Hannah Coutand, head of product marketing ng NVIDIA Vera, na ang pangunahing pagtutuon ng disenyo ng chip ay ang single-core speed, mataas na memory bandwidth, at mababang latency, na layunin ay "pagsisilbing muling ibalik ang agent sa GPU sa pinakamabilis na paraan at panatilihin ang GPU sa mataas na paggamit." Sa antas ng mga teknikal na spesipikasyon, ang power consumption ng Vera ay nasa pagitan ng 250 hanggang 450 watts, at pinakamataas na suporta ng bawat chip ay 1.5TB ng low-power memory.
Sa pinakabagong ipinakita na benchmark, ipinakita ng NVIDIA ang 1.9x na pagtaas sa performance ng Vera kumpara sa x86 chip sa mga task na may agent na AI, at 6x na pagbaba sa latency. Sinabi rin ng NVIDIA na lalong lumampas ng halos 100% ang Vera sa ilang industry-standard na benchmark kumpara sa AMD’s flagship EPYC Turin CPU. Bago ito, sinabi rin ng NVIDIA na mas mataas ang kabuuang performance ng Vera sa mga AI agent task ng 50% kumpara sa x86 chip.
Ang paglunsad ng Vera ay ang pinakabagong hakbang sa patakaran ng NVIDIA sa vertical integration. Ayon sa Wolfe Research, ang average selling price ng bawat chip na Vera ay humigit-kumulang $5,000, at inaasahang makakamit ang halos 1.3 milyong unit sa taong ito. Sinabi ni Ian Buck, Vice President for Hyperscale Computing ng NVIDIA, na ang agent-based AI ay naggagawang "higit na kritikal" ang CPU, at hinuhulaan na ang kabuuang thị market ng server CPU ay maaaring makamit ang $200 bilyon sa huli.
Real-world test ni Vera Rubin: 10-fold efficiency improvement—Nakumpleto ni CoreWeave noong unang bahagi ng Hunyo ang unang deployment at pag-verify ng Vera Rubin NVL72 sa industriya, kasama ang buong stack na pagpapatotoo sa kuryente, pagpapalamig, network, at computation. Ang mga data na inilabas ay ang unang publikong real-world test result ng performance ng Vera Rubin NVL72 silicon.
Isang pagsubok na batay sa DeepSeek R1 model, ang Vera Rubin NVL72 ay nakakagawa ng 10 beses na higit sa bilang ng token bawat megawatt bawat segundo kumpara sa GB200 NVL72. Dagdag pa ni CoreWeave, ang mga optimisasyon para sa Vera Rubin ay maaaring ma-applying din pabalik sa GB200 NVL72 system, na nagdudulot ng pagtaas ng higit sa apat na beses sa throughput bawat megawatt sa loob ng tatlong buwan. Sinabi ng NVIDIA na ang mga resultang ito ay nasubok at binigyang-katotohanan sa pamamagitan ng higit sa 250,000 magkakahiwalay na konfigurasyon at higit sa 1.4 milyong GPU-hours.
Sa antas ng arkitektura, ang Vera Rubin NVL72 rack ay nagtatampok ng 72 Rubin GPUs at 36 Vera CPUs na konektado sa pamamagitan ng 260 TB/s fully interconnected NVLink 6 architecture, at may native suporta para sa NVFP4 precision. Sinasabi ni CoreWeave na ang pagtaas ng efficiency na ito ay nangangahulugan na ang mga customer ay maaaring tratuhin ang mas maraming inference traffic sa parehong budget ng power, o panaig ang parehong load gamit ang mas kaunting kuryente, na nagpapababa sa bawat token cost.
Inilathawa rin ni CoreWeave ang mga partikular na aplikasyon: isang pandaigdigang kumpanya sa网络安全 na umaasang magpapatakbo ng threat detection inference sa 10 beses na mas mataas na performance per watt; isang kumpanya sa autonomous programming agent na umaasang magpalawak ng mga gawain ng agent sa mas mababang gastos sa token; at isang AI-native search engine na umaasang magpalawak ng real-time search service sa mas maraming user nang hindi lalampas sa mga limitasyon sa response time.
Optimisasyon ng infrastraktura: Ang integrasyon ng software at hardware ay naglalabas ng mas malaking epekto. Pinapahalagahan ni NVIDIA na ang pagtaas ng performance ay hindi lamang batay sa chip mismo, kundi isang komprehensibong resulta ng estratehiya ng co-design ng hardware at software. Sa pamamagitan ng dinamikong optimisasyon ng buong infrastraktura at enerhiya stack, sinasabi ni NVIDIA na maaaring i-deploy ang 40% higit pang GPU sa parehong saklaw ng paggamit ng enerhiya.
Sa pag-cool, ginagamit ng NVIDIA ang 45°C closed-loop liquid cooling system, na nakakatipid ng halos 4 milyong galon ng tubig bawat megawatt bawat taon kumpara sa karaniwang paraan ng pag-cool. Sa antas ng network, ang ikapitong henerasyon ng NVLink 6 interconnect architecture ay 2.3 beses na mas mabilis sa pag-decode ng throughput para sa malalaking language model simulation kaysa sa Ethernet architecture; ang Spectrum-X platform naman ay nagtataglay ng 1.6 beses na mas mabilis na remote direct memory access bandwidth, habang binabawasan ang bilang ng switch ng 1.7 beses, pinapataas ang光功率效率 ng limang beses, at pinapataas ang reliability ng sampung beses.
Ang pinakabagong Spectrum-6 platform ni NVIDIA ay nagsimula nang mag-deliver sa mga customer na AI factory tulad ng CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp., at Tesla. Kasalukuyang pinapabilis ni NVIDIA ang pagpapadala sa mga customer at partner tulad ng Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI, at CoreWeave.
Bagaman ang mga data sa performance ng Vera ay nakakaakit, nananatiling nakakatagpo ang NVIDIA sa paghahamon sa merkado ng CPU. Sinabi ni Kevin Knox, analyst ng Gartner, na ang AMD ay kasalukuyang pangunahing kalaban sa larangan ng enterprise AI server CPU. Ayon sa mga ulat, mayroon ang Intel sa halos 66.8% ng bahagi sa merkado ng server CPU, habang ang AMD ay may 33%, at patuloy itong kumukuha ng bahagi sa merkado at nagtataguyod ng malalim na ugnayan sa mga malalaking cloud service provider.
Dahil sa pagtaas ng hiling sa CPU na dulot ng paglago ng agent-based AI, tumataas ang presyo ng mga bahagi ng AMD at Intel sa taong ito ng 128% at 149% ayon sa pagkakasunod-sunod, na mas mataas kaysa sa halos 8% na pagtaas ng NVIDIA sa parehong panahon, gawing pinakamalakas na mga chip stock sa taong 2026.
Sa kasalukuyan, ang tanging pangunahing kalahati ng cloud na listahan ni NVIDIA ay ang Oracle, at hindi pa kasama ang iba pang pangunahing cloud provider. Acknowledges ni Hannah Coutand na ang Vera ay kasalukuyang nasa "mga unang paggamit" na yugto, ngunit plano ng OpenAI na magsimula sa pinakamabilis na ikalawang kuartal sa malawakang pag-deploy ng Vera chip.
Ang founder ng Cambrian AI Research, Karl Freund, ay isinummary ang estratehiya ng NVIDIA: "Ang kanilang layunin ay tulungan ang mga customer na mawalan ng pagkakadepende sa mga CPU ng Intel o AMD, at sila ay naghahanap ng kumita sa bahaging ito ng kita. Pumili sila na mag-focus sa pagbuo ng isang CPU na walang iba sa merkado ang nag-aalok ngayon."
