NVIDIA Vera Rubin NVL72 telah memasuki fasa peningkatan produksi massal, dengan rantaian bekalan yang merangkumi lebih daripada 350 pabrik dan 30 negara, serta melibatkan lebih 300 rakan kongsi. Cip Vera telah dihantar kepada pelanggan seperti OpenAI, Anthropic, dan SpaceX, dengan jangkaan penghantaran 1.3 juta unit pada tahun ini, dengan harga purata seunit sekitar USD5,000. NVIDIA sedang memperluaskan pertarungan dari pasaran GPU ke pasaran CPU, dengan mempertaruhkan bahawa agen AI akan mencipta "masa CPU" baru, dengan ukuran pasaran CPU server jangka panjang diperkirakan mencapai USD200 bilion. Vera menggunakan 88 inti Olympus, menekankan prestasi satu benang berbanding jumlah inti, dan mampu mencapai kelajuan 1.8 kali ganda CPU x86 pada tugas tertentu. NVIDIA tidak lagi menjual cip secara semata-mata, tetapi menjual sistem rak komputer lengkap yang mengandungi cip buatan sendiri, secara langsung mengancam kepentingan utama AMD dan Intel di pasaran CPU server.Penulis artikel, sumber: Tencent News
NVIDIA sedang membawa perang dari pasaran GPU ke CPU.
Menjelang acara AMD yang berkaitan dengan AI, NVIDIA pada hari Selasa, 21, waktu Timur AS, mengumumkan kemajuan terkini untuk platform generasi berikutnya Vera Rubin: Vera Rubin NVL72 kini memasuki tahap peningkatan produksi massal. NVIDIA menyatakan bahawa rangkaian bekalan platform ini merangkumi lebih daripada 350 pabrik di 30 negara, dengan lebih daripada 300 rakan kongsi yang terlibat.
Sementara itu, NVIDIA mengumumkan lebih lanjut data prestasi Vera CPU dan platform Vera Rubin dalam beban kerja agen AI, cuba membuktikan bahawa seiring AI berpindah dari “menjawab soalan” kepada perancangan autonomi, pemanggilan alat, dan pelaksanaan tugas, CPU sedang menjadi medan pertempuran baharu dalam infrastruktur AI.
Data spesifikasi penuh, hasil ujian prestasi, dan maklumat arsitektur untuk produk CPU pusat data NVIDIA, Vera, adalah data penting yang diperlukan oleh pelanggan potensial untuk menilai cip tersebut secara menyeluruh. Syarikat tersebut menyatakan bahawa cip Vera telah dihantar kepada pelanggan seperti OpenAI, Anthropic, dan SpaceX pada Jun.
Vera dilancarkan sebagai langkah terbaru dalam strategi integrasi tegak英伟达. Syarikat bercadang untuk menjual sistem rak komputer lengkap yang mengandungi cip buatan sendiri, bukan sekadar menjual cip tunggal. Menurut anggaran Wolfe Research, harga purata seunit cip Vera adalah sekitar US$5,000, dengan jumlah penghantaran yang dijangka mencapai sekitar 1.3 juta unit pada tahun ini. Bagi AMD dan Intel, tindakan英伟达 ini secara langsung mengancam kepentingan inti kedua-dua syarikat tersebut dalam pasaran CPU pelayan.
Ini bukan pertama kalinya NVIDIA mengumumkan bahawa CPU Vera memasuki pengeluaran berskala besar. Pada akhir Mei tahun ini, NVIDIA telah mengumumkan bahawa Vera telah memasuki fasa pengeluaran penuh, dan menyatakan bahawa cip ini mampu menyelesaikan tugas tertentu secepat 1.8 kali lebih pantas berbanding CPU x86 tradisional. Pada pertengahan Mei, NVIDIA juga telah menghantar sistem CPU Vera pertama kepada pelanggan seperti Anthropic, OpenAI, dan SpaceXAI. Fokus pengumuman kali ini pula semakin beralih kepada peningkatan pengeluaran keseluruhan platform Vera Rubin, pelaksanaan oleh pelanggan, serta prestasi dalam persekitaran pengeluaran sebenar.
Kebangkitan agen AI, CPU kembali menjadi “longkang utama”
Logik utama NVIDIA menumpukan pada CPU ialah aplikasi AI sedang berubah.
Tugas utama AI generatif tradisional adalah menghasilkan jawapan berdasarkan input pengguna, di mana GPU menangani pengiraan model berskala besar, manakala CPU lebih banyak bertanggungjawab atas tugas pengurusan yang lebih periferal. Namun, dengan perkembangan pesat agen AI, sistem AI kini mula memecahkan tugas secara autonomi, memanggil alat luaran, menjalankan kod, mengakses data, dan menilai hasil secara berulang-ulang.
Dalam proses ini, CPU perlu sering menangani banyak tugas dengan latensi rendah dan secara masa nyata. NVIDIA percaya bahawa agen AI bukan hanya beban kerja yang bergantung sepenuhnya pada GPU: setiap persekitaran agen, pemanggilan alat, pengaturan tugas, dan pencarian data konteks panjang semuanya memerlukan penyertaan CPU.
NVIDIA telah menunjukkan semasa melancarkan Vera bahawa AI agen sedang mencipta "masa CPU" yang baharu. Penilaian mereka ialah, seiring sistem AI berpindah dari "menjawab soalan" kepada "mengambil tindakan", peranan CPU dalam pabrik AI akan meningkat dengan jelas.
NVIDIA bahkan menganggarkan bahawa pasaran CPU pelayan jangka panjang mungkin mencapai US$200 bilion. Angka ini kelihatan sangat agresif berbanding pasaran CPU pelayan tradisional, tetapi logik NVIDIA ialah sempadan pasaran CPU masa depan mungkin tidak lagi terhad kepada pelayan perniagaan tradisional, tetapi akan meluas kepada inferens AI, agen AI, pembelajaran diperkuat, pemprosesan data, serta pelbagai tugas kawalan dan pengaturan infrastruktur AI.
Ini juga merupakan sebab mengapa NVIDIA cuba menentukan semula peraturan persaingan CPU.
Tidak memperjuangkan jumlah inti, NVIDIA bertaruh pada "kelajuan satu inti"
Jalur rekaan Vera berbeza ketara daripada CPU server tradisional.
NVIDIA menyatakan bahawa Vera adalah CPU pertama mereka yang direka khas untuk AI agen, menggunakan 88 inti Olympus yang direka sendiri oleh NVIDIA, dengan lebar pita memori 1.2TB/s. Sebelum ini, NVIDIA menyatakan bahawa Vera mampu mencapai peningkatan prestasi inti tunggal sebanyak 50% berbanding CPU tradisional; dalam ujian yang diumumkan pada akhir Mei, Vera mencapai 1.8 kali kelajuan CPU x86 dalam menyelesaikan tugas tertentu.
Dalam pengungkapan terbaru, NVIDIA menekankan lagi arah reka bentuk utama Vera: berbanding sekadar menambahkan lebih banyak inti, Vera lebih mengutamakan prestasi satu benang, lebar pita komunikasi antara inti, dan latensi akses memori.
NVIDIA menyatakan bahawa teras Olympus khusus Vera mampu mencapai prestasi satu thread dua kali ganda, lebar pita antara teras tiga kali ganda, serta pengurangan latensi memori sebanyak 40% berbanding reka bentuk chiplet pesaing. Matlamatnya adalah membolehkan agen AI menyelesaikan tugas lebih pantas dan mengembalikan sumber pengiraan ke GPU secepat mungkin, dengan demikian meningkatkan penggunaan keseluruhan pabrik AI.
Logik perniagaan di sebalik ini sangat jelas: GPU adalah salah satu sumber daya pengiraan paling mahal dan paling jarang di pusat data AI. Jika tugas yang diproses oleh CPU terlalu perlahan, GPU mungkin berada dalam keadaan menunggu. NVIDIA berharap untuk mengurangkan masa "menganggur" ini dengan mengoptimumkan CPU secara khusus.
Dalam ujian persekitaran pengeluaran terhadap Vera CPU oleh DeepInfra, NVIDIA menyatakan bahawa Vera boleh menyokong sehingga 1.6 kali bilangan agen AI serentak dan mencapai kelajuan pengaturan tugas sehingga 2.2 kali lebih pantas. Perlu diperhatikan bahawa data ini berasal daripada persekitaran ujian khusus pelanggan dan tidak bermakna Vera unggul sepenuhnya dalam semua beban kerja CPU am.
Fokus persaingan meningkat dari satu cip kepada seluruh "pabrik AI"
Vera CPU hanyalah sebahagian daripada strategi sistem yang lebih besar NVIDIA.
Di platform Vera Rubin, NVIDIA menggabungkan Vera CPU, Rubin GPU, Groq 3 LPX, chip rangkaian Spectrum-6, ConnectX-9 SuperNIC, dan BlueField-4 ke dalam satu sistem yang direka secara kolaboratif.
NVIDIA menyatakan bahawa Vera Rubin NVL72 sedang memasuki tahap peningkatan produksi secara global, dengan rakan kongsi seperti CoreWeave, Google Cloud, Microsoft Azure, dan Oracle Cloud Infrastructure telah mula melaksanakan rak-rak berkaitan. NVIDIA juga menyatakan bahawa rantaian bekalannya merangkumi lebih daripada 350 pabrik dan 30 negara, dengan lebih daripada 300 rakan kongsi yang terlibat.
Dalam pengujian pelanggan, CoreWeave menggunakan Vera Rubin NVL72 untuk menjalankan ujian DeepSeek-R1 dan melaporkan peningkatan 10 kali ganda dalam jumlah Token yang dihasilkan per megawatt per saat berbanding dengan NVL72 Grace Blackwell generasi sebelumnya. Google Cloud telah melancarkan contoh A5X berdasarkan Vera Rubin NVL72, dengan NVIDIA menyatakan bahawa ia mampu mencapai kos inferens yang lebih rendah dan throughput Token per megawatt yang lebih tinggi dalam skenario tertentu.

Ini bermakna pesaing NVIDIA kini bukan lagi hanya GPU Instinct dari AMD atau Gaudi dari Intel, yang merupakan chip akselerator tunggal.
NVIDIA berusaha mengawasi keseluruhan infrastruktur: CPU bertanggung jawab atas pengurusan, GPU bertanggung jawab atas pengiraan, chip rangkaian bertanggung jawab atas sambungan berkelajuan tinggi, dan perisian bertanggung jawab atas pengurusan dan pengoptimuman, akhirnya menghantar sistem pada tahap rak atau pusat data kepada pelanggan.
Ancaman bagi AMD dan Intel daripada cara persaingan ini ialah bahawa NVIDIA mungkin tidak perlu bersaing secara sepenuhnya seimbang di pasaran CPU tradisional. Matlamat NVIDIA ialah memasuki bahagian paling berpotensi pertumbuhan dalam pelayan AI, bermula dengan mengejar beban kerja seperti AI agen, pembelajaran penguatan, dan inferens AI berprestasi tinggi, sebelum secara beransur-ansur memperluaskan penggunaan CPU.
AMD dan Intel menghadapi cabaran baharu terhadap kelebihan tradisional mereka
Selama ini, Intel dan AMD menguasai pasaran CPU pelayan.
Namun, pandangan NVIDIA kini ialah, infrastruktur AI sedang mengubah urutan nilai CPU. Dahulu, persaingan CPU pelayan lebih banyak berfokus pada bilangan inti, keupayaan pengiraan am, dan throughput keseluruhan; manakala di era AI agen, kepentingan latensi rendah, prestasi satu benang, lebar pita memori, dan kecekapan pengaturan tugas semakin meningkat.
Ini adalah ruang pasaran yang tepat yang dianggap oleh NVIDIA mampu dimasuki.
Dari segi bentuk produk, Vera boleh digunakan sebagai CPU berdiri sendiri atau digabungkan dengan GPU NVIDIA untuk membentuk sistem Vera Rubin. NVIDIA juga menempatkannya sebagai komponen kunci yang menghubungkan agen AI dengan sumber komputasi GPU.
NVIDIA sebelum ini telah menyenaraikan pelanggan seperti perusahaan AI Anthropic, OpenAI, dan SpaceXAI, serta penyedia awan seperti ByteDance, CoreWeave, dan Oracle Cloud Infrastructure; pembuat pelayan seperti Dell, Hewlett Packard Enterprise, Lenovo, dan AMD juga sedang memajukan sistem berdasarkan Vera.
Ini memberikan NVIDIA keunggulan berbeza daripada pengilang CPU tradisional: ia boleh memberikan penyelesaian lengkap kepada pelanggan melalui kombinasi GPU, CPU, rangkaian, dan perisian.
Namun, ini tidak bermakna bahawa NVIDIA boleh dengan mudah menggoyahkan AMD dan Intel.
Persaingan di pasaran CPU bukan hanya tentang prestasi cip, tetapi juga merangkumi ekosistem perisian, pengesahan pelanggan, kesesuaian pelayan, dan hubungan penghantaran jangka panjang. Terutamanya penyedia awan besar dan pelanggan korporat biasanya memerlukan bertahun-tahun untuk menukar platform peranti keras.
Oleh itu, sama ada Vera benar-benar boleh diperluaskan daripada skenario khas AI ke pasaran pelayan yang lebih luas, masih bergantung kepada sama ada pelanggan boleh memperoleh kelebihan prestasi dan kos yang jelas.
NVIDIA sedang membuka kurva pendapatan baru di luar GPU
Pengumuman terkini oleh NVIDIA mengenai pengeluaran dan prestasi Vera Rubin menjelang aktiviti AI AMD juga mempunyai maksud persaingan pasaran yang jelas.
Dalam beberapa tahun terakhir, NVIDIA hampir secara eksklusif menguasai kolam keuntungan paling penting dalam infrastruktur AI melalui GPU. Namun, seiring AMD terus memperluas penempatan akselerator AI dan Intel berusaha mencari terobosan di pasaran cip AI, pasaran semakin memperhatikan sama ada NVIDIA mampu mempertahankan pertumbuhan pesatnya.
Sementara itu, bisnes CPU AMD dan Intel juga mendapat semula perhatian pasaran akibat jangkaan permintaan baru yang dibawa oleh AI berjenis agen.
Tanggapan NVIDIA adalah: jika nilai pusat data AI sedang berkembang dari pengiraan GPU tunggal kepada pabrik AI yang lengkap, maka NVIDIA tidak perlu menyerahkan pasaran CPU kepada pesaing.
Dari sudut pandang ini, Vera bukan sekadar CPU server yang diperkenalkan oleh NVIDIA, tetapi merupakan lanjutan daripada strategi integrasi tegaknya.
NVIDIA berharap pelanggan membeli bukan lagi GPU, CPU, atau cip rangkaian tunggal, tetapi infrastruktur lengkap yang boleh menjalankan model AI dan agen AI secara langsung.
Jika AI berjenis agen benar-benar menjadi penggerak utama pertumbuhan permintaan komputasi seterusnya, maka NVIDIA mungkin akan bersaing bukan sahaja untuk kawasan pasaran GPU, tetapi seluruh nilai rantai komputasi server AI.
Ini juga bermakna bahawa pesaing masa depan AMD dan Intel mungkin bukan lagi hanya antara satu sama lain, tetapi sebuah NVIDIA yang telah memiliki kemampuan GPU, CPU, rangkaian, perisian, dan sistem keseluruhan.
