निविडा ने AMD की वार्षिक उत्पाद लॉन्च के तुरंत पहले अपने नवीनतम Vera Rubin प्लेटफॉर्म के वास्तविक परीक्षण प्रदर्शन डेटा को साझा किया और अपने स्वयं डिज़ाइन किए गए CPU चिप Vera की पूर्ण विनिर्देशिका को आधिकारिक रूप से प्रकाशित किया। Vera CPU एजेंट-आधारित AI कार्यों में x86 चिप की तुलना में प्रदर्शन में लगभग दोगुनी वृद्धि और लेटेंसी में 6 गुना सुधार प्रदान करता है। Vera Rubin NVL72 प्लेटफॉर्म पर DeepSeek R1 मॉडल चलाने पर, प्रति मेगावाट कैलकुलेशन से उत्पन्न token थ्रूपुट, पिछली पीढ़ी के GB200 NVL72 की तुलना में 10 गुना अधिक है। OpenAI, Anthropic और SpaceX को पहले डिलीवरी मिल चुकी हैं। Vera, निविडा का पहला स्वयं डिज़ाइन किया गया सर्वर CPU है, जिसकी शक्ति 250-450 वाट है, 1.5TB मेमोरी समर्थित है, और इसकी 130 लाख इकाइयों की आपूर्ति इस वर्ष की उम्मीद है। यह निविडा के सर्वर CPU बाजार में प्रवेश को दर्शाता है, जो AMD और Intel के प्रति सीधा प्रतिस्पर्धा है। एजेंट-आधारित AI के कारण सर्वर CPU बाजार का आकार 2000 अरब डॉलर तक पहुँचने की संभावना है।लेखक, स्रोत: वॉल स्ट्रीट विजन
एनविडिया ने अपने प्रमुख प्रतिद्वंद्वी एएमडी की वार्षिक उत्पाद लॉन्च के ठीक पहले एक भारी प्रहार किया, जिसमें नवीनतम वेरा रुबिन प्लेटफॉर्म के प्रायोगिक प्रदर्शन डेटा को घोषित किया और अपने स्वयं डिज़ाइन किए गए सीपीयू चिप वेरा की पूर्ण विनिर्देशों को सार्वजनिक किया।
मंगलवार को, निवेडिया ने खुलासा किया कि Vera CPU, x86 चिप की तुलना में एजेंट-आधारित AI कार्यों पर लगभग दोगुना बेहतर प्रदर्शन देती है और लेटेंसी में छह गुना सुधार होता है। इसी बीच, क्लाउड कंप्यूटिंग साझेदार CoreWeave के प्रारंभिक उत्पादन परीक्षणों में, Vera Rubin NVL72 प्लेटफॉर्म ने DeepSeek R1 मॉडल चलाते समय, पिछली पीढ़ी के Blackwell आधारित GB200 NVL72 सिस्टम की तुलना में प्रति मेगावॉट कैलकुलेशन पर token थ्रूपुट में 10 गुना की वृद्धि दर्ज की।
ऊपर दिए गए डेटा के प्रकाशन का समय बहुत महत्वपूर्ण है। AMD इस सप्ताह के गुरुवार को सैन फ्रांसिस्को में अपनी वार्षिक उत्पाद लॉन्च इवेंट "Advancing AI" आयोजित करेगी, और इस समय NVIDIA द्वारा प्रदर्शन डेटा का केंद्रित रूप से प्रकाशन बाहरी दुनिया द्वारा एक जानबूझकर किए गए मार्केटिंग प्रयास के रूप में देखा जा रहा है। अगली पीढ़ी के AI बुनियादी ढांचे में निवेश का मूल्यांकन कर रहे क्लाउड प्रदाताओं और उद्योग ग्राहकों के लिए, यह डेटा उनके खरीद निर्णयों को प्रत्यक्ष रूप से प्रभावित करेगा।
इसी बीच, निविडा ने आधिकारिक रूप से घोषणा की है कि वेरा CPU के पहले बैच की आपूर्ति जून में पूरी हो चुकी है, जिनके ग्राहकों में OpenAI, Anthropic और SpaceX शामिल हैं। यह निविडा के CPU बाजार में प्रवेश का प्रतीक है, जो AMD और इंटेल के पारंपरिक बाजार पर सीधा प्रभाव डालता है।
Vera CPU लॉन्च: निविडा ने सर्वर CPU बाजार में प्रवेश किया। निविडा ने मंगलवार को डेटासेंटर CPU उत्पाद Vera की पूर्ण विनिर्देश, बेंचमार्क परिणाम और आर्किटेक्चर जानकारी जारी की, जो संभावित ग्राहकों के लिए इस चिप का समग्र मूल्यांकन करने के लिए आवश्यक महत्वपूर्ण डेटा है। कंपनी ने बताया कि Vera चिप की आपूर्ति 6 में OpenAI, Anthropic और SpaceX जैसे ग्राहकों को पूरी कर दी गई है।
Vera, NVIDIA का पहला सर्वर CPU, जिसे "Olympus core" कोडनेम वाले कस्टम माइक्रोआर्किटेक्चर का उपयोग करके मूल रूप से डिज़ाइन किया गया है, और जो Arm द्वारा प्रदान किए गए तैयार डिज़ाइन का उपयोग नहीं करता है।
निविडा के वेरा उत्पाद के मार्केटिंग प्रमुख हैना काउटैंड ने बताया कि इस चिप के डिज़ाइन का केंद्र एकल कोर की गति, उच्च मेमोरी बैंडविड्थ और कम लेटेंसी पर है, जिसका लक्ष्य "एजेंट को जल्द से जल्द GPU पर वापस भेजना और GPU को सदैव उच्च स्तर पर उपयोग में रखना" है। हार्डवेयर स्पेसिफिकेशन के स्तर पर, वेरा की बिजली खपत 250 वाट से 450 वाट के बीच है, और प्रति चिप अधिकतम 1.5TB लो-पावर मेमोरी समर्थित है।
नवीनतम प्रकाशित बेंचमार्क में, न्वीडिया ने दर्शाया कि Vera, x86 चिप की तुलना में एजेंट-आधारित AI कार्यों पर 1.9 गुना बेहतर प्रदर्शन प्रदान करता है और लेटेंसी 6 गुना कम करता है। न्वीडिया ने यह भी कहा कि Vera कुछ उद्योग-मानक बेंचमार्क में AMD के शीर्ष EPYC Turin CPU से लगभग 100% अधिक प्रदर्शन करता है। पहले, न्वीडिया ने भी कहा था कि Vera, x86 चिप की तुलना में AI एजेंट कार्यों के समग्र प्रदर्शन में 50% अधिक है।
वेरा का लॉन्च निविडा की ऊर्ध्वाधर एकीकरण रणनीति का नवीनतम कदम है। वोल्फ रिसर्च के अनुसार, वेरा चिप की औसत कीमत लगभग 5000 डॉलर है और इस वर्ष इसकी लगभग 13 लाख इकाइयाँ बेची जाने की उम्मीद है। निविडा के सुपरस्केल कंप्यूटिंग के उपाध्यक्ष आइन बक के अनुसार, एजेंट-आधारित AI ने CPU को "अधिक अनिवार्य" बना दिया है, और उन्होंने अनुमान लगाया है कि सर्वर CPU के समग्र बाजार का आकार अंततः 2000 अरब डॉलर तक पहुंच सकता है।
वेरा रुबिन का वास्तविक परीक्षण: 10 गुना क्षमता में वृद्धि कोरवीव ने इस वर्ष जून की शुरुआत में उद्योग का पहला वेरा रुबिन NVL72 डिप्लॉयमेंट और प्रमाणीकरण पूरा किया, जिसमें बिजली, शीतलन, नेटवर्क और कंप्यूटिंग की पूरी स्टैक की पुष्टि शामिल है। इस अपडेट में प्रकाशित डेटा, वेरा रुबिन NVL72 सिलिकॉन के प्रदर्शन के पहले वास्तविक परीक्षण परिणाम हैं।
DeepSeek R1 मॉडल के संदर्भ में परीक्षण किए गए, समान इंटरैक्टिव रिस्पॉन्स लक्ष्य के तहत, Vera Rubin NVL72 प्रति मेगावाट प्रति सेकंड GB200 NVL72 की तुलना में 10 गुना अधिक टोकन उत्पन्न करता है। CoreWeave ने एक साथ यह भी बताया कि Vera Rubin के लिए किए गए अनुकूलन को GB200 NVL72 सिस्टम पर भी पिछले अनुप्रयोग किया जा सकता है, जिससे इसकी प्रति मेगावाट थ्रूपुट तीन महीनों में चार गुना से अधिक बढ़ गई। NVIDIA ने कहा कि उपरोक्त परिणामों की पुष्टि 2.5 लाख से अधिक स्वतंत्र कॉन्फ़िगरेशन और 140 लाख GPU-घंटे के परीक्षण के माध्यम से की गई है।
आर्किटेक्चरल स्तर पर, Vera Rubin NVL72 रैक में 72 Rubin GPU और 36 Vera CPU एकीकृत हैं, जो 260 TB/s पूर्ण-संबंधित NVLink 6 आर्किटेक्चर के माध्यम से जुड़े हुए हैं और नेटिव रूप से NVFP4 प्रेसिजन को सपोर्ट करते हैं। CoreWeave का कहना है कि इस कुशलता में वृद्धि का अर्थ है कि ग्राहक समान बिजली बजट के भीतर अधिक इन्फरेंस ट्रैफ़िक को संभाल सकते हैं, या समान लोड को कम बिजली में चला सकते हैं, जिससे प्रति token लागत कम होती है।
कोरवेव ने विशिष्ट उपयोग के मामलों को भी उजागर किया: एक वैश्विक साइबर सुरक्षा कंपनी धमकी पता लगाने के लिए प्रति वाट प्रदर्शन के 10 गुना के साथ निष्कर्षण चलाने की उम्मीद करती है; एक स्वयं-प्रोग्रामिंग एजेंट कंपनी एजेंट कार्यों को टोकन लागत में भारी कमी के साथ विस्तारित करने की उम्मीद करती है; और एक एआई-नेटिव सर्च इंजन उत्तर समय सीमा को पार न करते हुए अधिक उपयोगकर्ताओं के लिए वास्तविक समय सर्च सेवा का विस्तार करने की उम्मीद करता है।
बुनियादी ढांचे का सहसमन्वयित अनुकूलन: सॉफ्टवेयर और हार्डवेयर एकीकरण द्वारा बड़ी क्षमता प्राप्त करना निविडा ने जोर देकर कहा कि उपरोक्त प्रदर्शन में वृद्धि केवल चिप पर निर्भर नहीं है, बल्कि हार्डवेयर और सॉफ्टवेयर के सह-डिज़ाइन रणनीति का समग्र परिणाम है। पूरे बुनियादी ढांचे और ऊर्जा स्टैक के गतिशील अनुकूलन के माध्यम से, निविडा ने कहा कि समान शक्ति उपभोग सीमा के भीतर 40% अधिक GPU स्थापित किए जा सकते हैं।
ऊष्मा नियंत्रण के संदर्भ में, न्विडिया 45°C बंद लूप तरल शीतलन प्रणाली का उपयोग करती है, जिससे मानक शीतलन विधि की तुलना में प्रति मेगावाट प्रति वर्ष लगभग 40 लाख गैलन पानी की बचत होती है। नेटवर्क स्तर पर, छठी पीढ़ी का NVLink 6 इंटरकनेक्ट आर्किटेक्चर, एथरनेट आर्किटेक्चर की तुलना में बड़े भाषा मॉडल सिमुलेशन डिकोडिंग थ्रूपुट में 2.3 गुना बेहतर है; Spectrum-X प्लेटफॉर्म 1.6 गुना तेज़ रिमोट डायरेक्ट मेमोरी एक्सेस बैंडविड्थ प्रदान करता है, साथ ही स्विच की संख्या 1.7 गुना कम करता है, प्रकाशिक शक्ति कुशलता में पाँच गुना की वृद्धि होती है, और विश्वसनीयता में दस गुना की वृद्धि होती है।
नवीनतम निवेडा Spectrum-6 प्लेटफॉर्म का वितरण CoreWeave, माइक्रोसॉफ्ट, Nebius B.V., SpaceXAI Corp. और टेस्ला जैसे AI फैक्ट्री ग्राहकों को शुरू हो चुका है। वर्तमान में, निवेडा गूगल क्लाउड, माइक्रोसॉफ्ट एज़्यूर, मेटा, ओरेकल क्लाउड इन्फ्रास्ट्रक्चर, डेल टेक्नोलॉजीज, OpenAI और CoreWeave जैसे ग्राहकों और साझेदारों को भेजने में त्वरित हो रहा है।
हालांकि वेरा के प्रदर्शन डेटा आकर्षक हैं, निविडा अभी भी CPU क्षेत्र में चुनौतीकर्ता है। गार्टनर के विश्लेषक केविन नॉक्स के अनुसार, AMD वर्तमान में उद्योग-स्तरीय AI सर्वर CPU क्षेत्र में मुख्य प्रतिद्वंद्वी है। रिपोर्ट के अनुसार, इंटेल के पास सर्वर CPU बाजार में लगभग 66.8% हिस्सा है, AMD के पास लगभग 33% है, और AMD लगातार बाजार हिस्सा प्राप्त कर रहा है और सुपरस्केल क्लाउड सेवा प्रदाताओं के साथ गहरे सहयोग स्थापित कर रहा है।
एजेंट-आधारित AI के उदय के कारण CPU की मांग की उम्मीद में वृद्धि के साथ, AMD और इंटेल के स्टॉक में इस साल अब तक क्रमशः 128% और 149% की वृद्धि हुई है, जो निवेशकों के बीच निवेश के लिए एक आकर्षक विकल्प बन गया है, जबकि NVIDIA का समान अवधि में लगभग 8% का प्रदर्शन हुआ है, जिससे 2026 में AMD और Intel सबसे अच्छा प्रदर्शन करने वाली चिप कंपनियां बन गई हैं।
अभी के लिए, निविडा की मुख्य बादल सेवा आपूर्तिकर्ता साझेदार सूची में केवल Oracle शामिल है, अन्य प्रमुख बादल फर्म अभी शामिल नहीं हैं। हैना काउटैंड ने स्वीकार किया कि वेरा अभी भी "प्रारंभिक उपयोगकर्ता चरण" में है, हालांकि OpenAI इस तिमाही के शुरुआती समय से वेरा चिप्स के बड़े पैमाने पर तैनाती की योजना बना रहा है।
कैम्ब्रियन एआई रिसर्च के संस्थापक कार्ल फ्रेंड ने निवेडिया के रणनीतिक इरादे को इस प्रकार सारांशित किया है: "उनका उद्देश्य ग्राहकों को इंटेल या एएमडी सीपीयू पर निर्भरता से मुक्त करना है, और वे इस आय को अपने अधिग्रहण में लाने के लिए समर्पित हैं। वे एक ऐसा अनोखा सीपीयू बनाने पर केंद्रित हैं, जो वर्तमान में बाजार में किसी और के पास उपलब्ध नहीं है।"
