NVIDIA, Vera CPU performansını açıkladı, AMD ve Intel'i hedefliyor

iconMetaEra
Paylaş
AI summary iconÖzet
NVIDIA, Vera Rubin platformu için yeni token listelemelerini duyurdu ve AMD'nin etkinliğinden önce güçlü performans metriklerini ortaya koydu. Vera CPU, NVIDIA'nın ilk sunucu CPU'su olup, AI ajan görevlerinde x86 çiplerine göre neredeyse iki kat daha yüksek performans ve altı kat daha düşük gecikme sunuyor. NVL72 platformu, GB200 NVL72'den megawatt başına 10 kat daha yüksek token verimliliği sağlıyor. İlk birimler OpenAI, Anthropic ve SpaceX'e verildi. 1,5 TB bellek desteğiyle bu yıl 1,3 milyon birim üretimi beklenen NVIDIA, sunucu CPU pazarına girmektedir. Token fırlatma haberi, şirketin GPU dışına genişleme çabalarını vurgulamaktadır.
NVIDIA, AMD'nin yıllık ürün tanıtım etkinliğinden hemen önce, yeni Vera Rubin platformunun gerçek dünya performans verilerini yoğun bir şekilde paylaştı ve kendi geliştirdiği Vera CPU çipinin tam specifikasyonlarını resmen duyurdu. Vera CPU, agens tabanlı AI görevlerinde x86 çiplerine kıyasla performansı neredeyse iki kat arttı ve gecikme süresi altı kat iyileşti. Vera Rubin NVL72 platformu, DeepSeek R1 modelini çalıştırırken, bir megawatt güç başına ürettiği token verimliliğini önceki nesil GB200 NVL72'e göre on kat artırdı. OpenAI, Anthropic ve SpaceX ilk teslimatları aldı. Vera, NVIDIA'nın ilk kendi tasarımı sunucu CPU'su olup, 250-450 watt güç tüketiyor, 1,5 TB belleği destekliyor ve bu yıl 1,3 milyon adet satışı planlanıyor. Bu, NVIDIA'nın sunucu CPU pazarına resmen girdiğini ve AMD ile Intel'e doğrudan bir tehdit oluşturduğunu gösteriyor. Agens tabanlı AI, sunucu CPU pazarının 200 milyar dolar büyüklüğe ulaşma potansiyeline sahip olduğunu gösteriyor.

Yazan, Kaynak: Wall Street Journal

NVIDIA, rakibi AMD'nin yıllık ürün tanıtım etkinliğinden hemen önce, yeni nesil Vera Rubin platformunun gerçek dünya performans verilerini yoğun bir şekilde açıkladı ve kendi geliştirdiği Vera CPU çipinin tam specifikasyonlarını resmen duyurdu.

Salı günü NVIDIA, Vera CPU'nun temsilci AI görevlerinde x86 çiplerine kıyasla performansının neredeyse iki kat daha yüksek olduğunu ve gecikmenin altı kat daha iyi olduğunu açıkladı. Aynı zamanda, bulut hesaplama ortağı CoreWeave'in erken üretim testleri, Vera Rubin NVL72 platformunun DeepSeek R1 modelini çalıştırırken, önceki nesil Blackwell mimarisine dayalı GB200 NVL72 sistemlerine kıyasla her megawatt hesaplama gücü başına token verimliliğinin 10 kat arttığını gösterdi.

Yukarıdaki verilerin açıklanma zamanlaması oldukça anlamlıdır. AMD, bu hafta Perşembe günü San Francisco'da yıllık ürün etkinliği olan "Advancing AI"i gerçekleştirecek; NVIDIA'nın bu sırada performans verilerini yoğun bir şekilde yayınlaması, dış dünyada kasıtlı bir pazarlama çabası olarak yorumlanmaktadır. Gelecek nesil AI altyapısı yatırımlarını değerlendiriyor olan bulut sağlayıcılar ve kurumsal müşteriler için bu veriler, satın alma kararlarını doğrudan etkileyecektir.

Aynı zamanda, NVIDIA, Vera CPU'nun Haziran'da ilk teslimatlarını tamamladığını ve müşterilerinin OpenAI, Anthropic ve SpaceX'i kapsadığını resmen duyurdu. Bu, NVIDIA'nın CPU pazarına yöneldiğini ve AMD ile Intel'in geleneksel alanlarına doğrudan bir çaba başlattığını gösteriyor.

Vera CPU tanıtıldı: NVIDIA sunucu CPU pazarına resmen girdi NVIDIA, Salı günü veri merkezi CPU ürünü Vera'nın tam specifikasyonlarını, performans testi sonuçlarını ve mimari bilgilerini açıkladı; bu, potansiyel müşterilerin bu çipi tam olarak değerlendirmesi için gerekli kritik verilerdir. Şirket, Vera çipinin 6 ayda OpenAI, Anthropic ve SpaceX gibi müşterilere teslim edildiğini belirtti.

Vera, NVIDIA'nın Olympic core kod adlı özelleştirilmiş mikro mimarisiyle tamamen kendi iç tasarımını yaptığı ilk sunucu CPU'sudur ve Arm tarafından sağlanan mevcut tasarımları kullanmaz.

NVIDIA Vera ürün pazar müdürü Hannah Coutand, bu çipin tasarım odak noktasının tek çekirdek hızı, yüksek bellek bant genişliği ve düşük gecikme olduğunu, hedefinin "ajentlerin GPU'ya en kısa sürede geri dönmesini ve GPU'nun sürekli yüksek kullanım durumunda kalmasını sağlamaktır" şeklinde açıkladı. Donanım spec'leri açısından, Vera'nın güç tüketimi 250 watt ile 450 watt arasındadır ve her çip en fazla 1,5 TB düşük güç tüketimli bellek destekler.

Yeni açıklanan performans testlerinde NVIDIA, Vera'nın x86 çiplerine kıyasla temsilci AI görevlerinde %190 daha yüksek performans sağladığını ve gecikmeyi 6 kat azalttığını gösterdi. NVIDIA ayrıca Vera'nın bazı endüstri standardı performans testlerinde AMD'nin üst düzey EPYC Turin CPU'sunu yaklaşık %100 geride bıraktığını belirtti. Daha önce NVIDIA, Vera'nın AI temsilci görevlerindeki toplam performansın x86 çiplerine göre %50 daha yüksek olduğunu da ifade etmişti.

Vera'nın piyasaya sürülmesi, NVIDIA'nın dikey entegrasyon stratejisinin en son adımıdır. Wolfe Research, Vera çipinin ortalama birim fiyatının yaklaşık 5.000 dolar olduğunu tahmin ediyor ve bu yıl yaklaşık 1,3 milyon adet satışı bekleniyor. NVIDIA'nın süper ölçekli hesaplama danışmanı Ian Buck, ajan tabanlı yapay zekânın CPU'yu "daha da vazgeçilmez" hale getirdiğini belirtti ve sunucu CPU pazarının toplam boyutunun nihayetinde 200 milyar dolaara ulaşabileceğini tahmin etti.

Vera Rubin Gerçek Testi: 10 Kat Verim Artışı CoreWeave, bu yılın başlarında endüstride ilk kez Vera Rubin NVL72'nin kurulumunu ve doğrulamasını tamamladı ve enerji, soğutma, ağ ve hesaplama alanlarında tam yığın doğrulaması gerçekleştirdi. Bu açıklamada yer alan veriler, Vera Rubin NVL72 çipinin ilk açık gerçek test sonuçlarıdır.

DeepSeek R1 model referans alınarak, aynı etkileşim yanıtı hedefi altında, Vera Rubin NVL72, her megawatt-saniyede GB200 NVL72'nin 10 katı token üretiyor. CoreWeave aynı zamanda, Vera Rubin için yapılan optimizasyonların GB200 NVL72 sistemine de geriye dönük uygulanabileceğini ve bunun sonucunda bu sistemin üç ay içinde her megawatt başına verimliliğinin dört katından fazla artacağını belirtiyor. NVIDIA, bu sonuçların 250.000'den fazla bağımsız yapılandırma ve 1.4 milyondan fazla GPU saatlik testle doğrulandığını ifade ediyor.

Mimari düzeyde, Vera Rubin NVL72 rafı, 72 adet Rubin GPU ve 36 adet Vera CPU'yu 260 TB/s tam bağlantı NVLink 6 mimarisiyle birleştiriyor ve NVFP4 doğruluğunu doğrudan destekliyor. CoreWeave, bu verimlilik artışı sayesinde müşterilerin aynı güç bütçesi içinde daha fazla çıkarım trafiğini işleyebileceğini veya aynı yükü daha az elektrikle çalıştırabileceğini, böylece her token maliyetini düşürebileceğini belirtiyor.

CoreWeave, uygulama senaryolarını da açıkladı: Bir global siber güvenlik şirketi, tehdit tespiti çıkarımını watt başına 10 kat daha yüksek performansla çalıştırmayı bekliyor; bir otonom programlama ajan şirketi, ajan görevlerini token maliyetlerinde büyük oranda düşüşle genişletmeyi planlıyor; bir AI-native arama motoru ise yanıt süresi sınırlarını aşmadan daha fazla kullanıcıya gerçek zamanlı arama hizmeti sunmayı bekliyor.

Altyapı koordinasyonu optimizasyonu: Yazılım ve donanım entegrasyonu daha büyük verimlilik sağlıyor NVIDIA, yukarıdaki performans artışı yalnızca çipin kendisine değil, tam altyapı ve enerji yığını üzerindeki dinamik optimizasyonlara dayalı yazılım ve donanımın ortak tasarım stratejisinin bir sonucu olduğunu vurguluyor. Bu sayede NVIDIA, aynı güç tüketimi aralığında %40 daha fazla GPU kurabilme imkanına sahip oluyor.

Soğutma açısından, NVIDIA, 45°C kapalı döngü sıvı soğutma sistemini kullanarak, standart soğutma yöntemlerine kıyasla her megawatt başına yıllık yaklaşık 4 milyon galon su tasarrufu sağlıyor. Ağ düzeyinde, Altıncı nesil NVLink 6 bağlantı mimarisi, büyük dil modelleri simülasyonu çözme verimliliğinde Ethernet mimarisine kıyasla 2,3 kat daha yüksek; Spectrum-X platformu ise 1,6 kat daha hızlı uzaktan doğrudan bellek erişimi bant genişliği sağlıyor, aynı zamanda anahtar sayısı 1,7 kat azalıyor, ışık gücü verimliliği beş kat artırılıyor ve güvenilirlik on kat yükseltiliyor.

NVIDIA'nın en son Spectrum-6 platformu, CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. ve Tesla gibi AI fabrika müşterilerine teslimata başlamıştır. Şu anda NVIDIA, Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI ve CoreWeave gibi müşterilere ve ortaklara gönderimi hızlandırmaktadır.

NVIDIA, Vera'nın performans verileri dikkat çekmesine rağmen, CPU alanında hâlâ önemli bir pazar payı mücadelesiyle karşı karşıya. Gartner analisti Kevin Knox, AMD'nin şu anda kurumsal AI sunucu CPU alanında ana rakip olduğunu belirtti. Intel'in sunucu CPU pazarında yaklaşık %66,8, AMD'nin ise yaklaşık %33 paya sahip olduğu rapor ediliyor ve AMD, pazar payını sürekli artırıyor ve büyük ölçekli bulut sağlayıcılarla derin iş birlikleri kuruyor.

Ajans tabanlı AI'nın yükselişiyle birlikte CPU talebi beklentileri artınca, AMD ve Intel'in bu yılki hisse senedi artışları sırasıyla %128 ve %149 olup, NVIDIA'nın aynı dönemdeki yaklaşık %8'lik artışını ciddi ölçüde geride bırakarak 2026 yılının en iyi performans gösteren çip hisseleri haline geldi.

Şu anda, NVIDIA'nın ana bulut hizmeti ortakları listesinde yalnızca Oracle yer alıyor; diğer ana bulut sağlayıcıları henüz dahil edilmemiş durumda. Hannah Coutand, Vera'nın hâlâ "erken benimseme aşamasında" olduğunu kabul ediyor, ancak OpenAI, Vera çipini en erken bu çeyrekte büyük ölçekli olarak dağıtma planlıyor.

Cambrian AI Research kurucusu Karl Freund, NVIDIA'nın stratejik niyetini şu şekilde özetliyor: "Hedefleri, müşterileri Intel veya AMD CPU'larından uzaklaştırmak ve bu gelir kısmını tamamen elde etmek. Şu anda piyasada başka kimse sağlamadığı benzersiz bir CPU oluşturmak üzerine odaklanıyorlar."

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.