Напередодні щорічного заходу AMD з презентацією продуктів, NVIDIA інтенсивно оприлюднила реальні дані щодо продуктивності нової платформи Vera Rubin, а також повні специфікації власного CPU-чіпа Vera. У завданнях агентного штучного інтелекту продуктивність Vera CPU вища майже вдвічі порівняно з x86-чіпами, а затримка зменшена в шість разів. Платформа Vera Rubin NVL72 під час виконання моделі DeepSeek R1 забезпечує в 10 разів більшу пропускну здатність токенів на мегаватт потужності порівняно з попередньою генерацією GB200 NVL72. Перші партії вже доставлено OpenAI, Anthropic та SpaceX. Як перший серверний CPU, розроблений NVIDIA, Vera споживає 250–450 Вт потужності, підтримує до 1,5 ТБ пам’яті і очікується, що протягом цього року буде випущено 1,3 мільйона одиниць. Це означає, що NVIDIA офіційно вступає на ринок серверних CPU, прямо конкуруючи з AMD та Intel. Ринок серверних CPU, спричинений агентним штучним інтелектом, може досягти 200 мільярдів доларів США.Автор статті, джерело: Wall Street Journal
Напередодні щорічного заходу з презентації продуктів конкурента AMD, NVIDIA нанесла потужний удар, оприлюднивши результати реальних тестів нової платформи Vera Rubin та офіційно розкривши повні специфікації власного CPU-чіпа Vera.
У вівторок NVIDIA повідомила, що Vera CPU демонструє майже подвійну продуктивність порівняно з x86-чіпами при виконанні агентних завдань штучного інтелекту, а також покращує затримку в шість разів. В той же час ранні тести виробництва від партнерів з хмарних обчислень CoreWeave показали, що платформа Vera Rubin NVL72 під час виконання моделі DeepSeek R1 забезпечує в 10 разів більшу пропускну здатність токенів на мегаватт потужності порівняно з попередніми системами GB200 NVL72 на базі архітектури Blackwell.
Термін публікації цих даних має глибокий зміст. AMD проведе щорічну продуктова презентацію "Advancing AI" у Сан-Франциско в четвер цього тижня, і в цей момент NVIDIA активно публікує дані щодо продуктивності, що сприймається зовнішнім середовищем як свідомий маркетинговий хід. Для хмарних провайдерів та корпоративних клієнтів, які оцінюють інвестиції в інфраструктуру наступного покоління для ШІ, ці дані безпосередньо вплинуть на їхні рішення щодо закупівель.
В той же час NVIDIA офіційно оголосила, що перші партії Vera CPU були доставлені у червні, а клієнтами є OpenAI, Anthropic та SpaceX. Це означає, що NVIDIA офіційно розширює свою присутність на ринку CPU, прямо конкуруючи з AMD та Intel.
Vera CPU дебютує: NVIDIA офіційно входить на ринок серверних CPU У вівторок NVIDIA оприлюднила повні специфікації, результати тестування та інформацію про архітектуру серверного процесора Vera — ключові дані, необхідні для всебічної оцінки чіпа потенційними клієнтами. Компанія повідомила, що чіпи Vera були доставлені клієнтам, таким як OpenAI, Anthropic і SpaceX, у червні.
Vera — це перший серверний CPU NVIDIA, розроблений з нуля на рівні ядра, з використанням кастомної мікроархітектури під кодовою назвою «Olympus core», а не готових рішень від Arm.
Ханна Кутан, керівник ринку продуктів NVIDIA Vera, зазначила, що дизайн чіпа зосереджений на швидкості одного ядра, високій пропускній здатності пам’яті та низькій затримці, з метою «дозволити агентам якомога швидше повертатися до GPU та підтримувати високе навантаження GPU». Щодо технічних характеристик, споживання потужності Vera становить від 250 до 450 ват, а кожен чіп підтримує до 1,5 ТБ низькопотужної пам’яті.
У найновіших тестах продуктивності NVIDIA продемонструвала, що Vera забезпечує на 1,9 раза вищу продуктивність порівняно з x86-чіпами при виконанні завдань агентного ШІ та зменшує затримку в 6 разів. NVIDIA також повідомила, що Vera перевершує флагманський процесор AMD EPYC Turin майже на 100% у деяких галузевих стандартизованих тестах. Раніше NVIDIA також заявляла, що Vera має на 50% вищу загальну продуктивність у завданнях агентного ШІ порівняно з x86-чіпами.
Запуск Vera — це останній крок у стратегії вертикальної інтеграції NVIDIA. За оцінками Wolfe Research, середня ціна однієї чіпсету Vera становить близько 5000 доларів США, і очікується, що в цьому році буде відправлено приблизно 1,3 мільйона одиниць. Ієн Бак, віце-президент NVIDIA зі сверхвеликих обчислень, зазначив, що агентне ШІ робить CPU «ще більш незамінними» і передбачив, що загальний ринковий розмір серверних CPU в кінцевому підсумку може досягти 200 мільярдів доларів США.
Vera Rubin: реальні випробування — 10-кратне збільшення ефективності. CoreWeave у першій половині червня цього року вперше в галузі розгорнула та підтвердила Vera Rubin NVL72, здійснивши повну перевірку електроживлення, охолодження, мережі та обчислень. Опубліковані дані — це перші відкриті результати реальних випробувань продуктивності чіпа Vera Rubin NVL72.
Тестування з використанням моделі DeepSeek R1 як бази показало, що Vera Rubin NVL72 генерує в 10 разів більше токенів на мегаватт за секунду порівняно з GB200 NVL72. CoreWeave також зазначила, що оптимізації, внесені до Vera Rubin, можна застосувати назад до систем GB200 NVL72, що дозволило збільшити пропускну здатність останніх на більше ніж у 4 рази протягом трьох місяців. NVIDIA підтвердила, що ці результати були перевірені за допомогою понад 250 000 окремих конфігурацій та понад 1,4 мільйона годин роботи GPU.
З архітектурної точки зору, стелаж Vera Rubin NVL72 інтегрує 72 GPU Rubin і 36 CPU Vera, з’єднаних через повністю зв’язану архітектуру NVLink 6 з пропускною здатністю 260 ТБ/с, і нативно підтримує точність NVFP4. CoreWeave зазначає, що це підвищення ефективності дозволяє клієнтам обробляти більший обсяг інференс-трафіку при тій самій потужності або запускати той самий навантаження з меншою споживаною електроенергією, що знижує вартість кожного токена.
CoreWeave також розкрила конкретні сценарії використання: глобальна компанія з кібербезпеки очікує запуску виявлення загроз з продуктивністю у 10 разів вищою на ват; компанія з автономними програмними агентами очікує масштабування завдань агентів за значно нижчою вартістю токенів; а AI-незалежний пошуковий сервіс очікує розширення сервісу реального пошуку для більшої кількості користувачів без перевищення лімітів часу відповіді.
Синергія інфраструктури: інтеграція програмного та апаратного забезпечення для максимальної ефективності. NVIDIA підкреслює, що зазначене підвищення продуктивності не є результатом лише самотнього чіпа, а є загальним досягненням стратегії спільного проектування апаратного та програмного забезпечення. Шляхом динамічної оптимізації повної інфраструктури та енергетичного стеку NVIDIA повідомляє, що можна розгорнути на 40% більше GPU в межах того ж діапазону споживання енергії.
Щодо охолодження, NVIDIA використовує замкнену рідинну систему охолодження при 45°C, що дозволяє заощаджувати приблизно 4 мільйони галонів води на мегаватт на рік порівняно зі стандартними методами охолодження. На рівні мережі, архітектура NVLink 6 шостого покоління забезпечує в 2,3 рази більшу пропускну здатність симуляції декодування великих мовних моделей порівняно з архітектурою Ethernet; платформа Spectrum-X досягає в 1,6 рази більшої пропускної здатності Remote Direct Memory Access (RDMA) та зменшує кількість комутаторів у 1,7 рази, підвищуючи ефективність оптичної потужності в п’ять разів та надійність — у десять разів.
Найновіша платформа Spectrum-6 від NVIDIA вже почала поставки клієнтам-фабрикам ШІ, таким як CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. та Tesla. Зараз NVIDIA прискорює відправки клієнтам і партнерам, таким як Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI та CoreWeave.
Навіть із захоплюючими даними щодо продуктивності Vera, NVIDIA зберігає значні виклики на ринку CPU. Аналітик Gartner Кевін Кнокс зазначив, що AMD зараз є основним конкурентом на ринку серверних CPU для корпоративного штучного інтелекту. За даними, Intel займає приблизно 66,8% ринку серверних CPU, AMD — близько 33%, причому AMD постійно збільшує свою частку ринку та встановила міцні партнерські зв’язки з величезними хмарними провайдерами.
Зростання попиту на процесори, спричинене виникненням AI з моделями на основі агентів, підтримало акції AMD та Intel, які за цей рік зросли на 128% і 149% відповідно, значно перевищивши приблизно 8%-ий зростання NVIDIA за той самий період, ставши найкращими чіпсетами 2026 року.
На даний момент у списку основних партнерів-хмарних провайдерів NVIDIA зазначено лише Oracle, а інші провайдери хмарних сервісів ще не включені. Ханна Кутан підтвердила, що Vera наразі перебуває на етапі «ранніх користувачів», однак OpenAI планує почати масове розгортання чіпів Vera ще в цьому кварталі.
Засновник Cambrian AI Research Карл Фройнд звел до такого: «Їхня мета — звільнити клієнтів від залежності від CPU Intel або AMD, і вони прагнуть отримати цей дохід. Вони вирішили зосередитися на створенні унікального CPU, якого зараз немає на ринку».
