NVIDIA Vera Rubin NVL72 вже перейшла до етапу масового виробництва; ланцюжок постачання охоплює більше 350 заводів у 30 країнах, участь брали понад 300 партнерів. Чіпи Vera вже доставлені клієнтам, таким як OpenAI, Anthropic і SpaceX; очікується, що у цьому році буде відправлено 1,3 мільйона чіпів, середня ціна за одиницю — близько 5000 доларів США. NVIDIA зараз розширює свою діяльність з ринку GPU на ринок CPU, роблячи ставку на те, що AI-агенти створять новий «момент CPU», і очікується, що довгостроковий розмір ринку серверних CPU може досягти 200 мільярдів доларів США. Vera використовує 88 ядер Olympus, з акцентом на продуктивність одного потоку, а не кількість ядер, і може досягати швидкості у 1,8 рази вищої, ніж x86 CPU, у певних завданнях. NVIDIA більше не просто продає чіпи, а пропонує клієнтам повні системи серверних стелажів із власними чіпами, що безпосередньо загрожує основним інтересам AMD та Intel на ринку серверних CPU.Автор статті, джерело: Tencent News
NVIDIA переносить вогонь із ринку GPU на ринок CPU.
Незадовго до заходу AMD, пов’язаного з ШІ, NVIDIA у вівторок, 21-го числа, за східним часом США, оприлюднила останні досягнення щодо наступної платформи Vera Rubin: Vera Rubin NVL72 вже перейшла на етап масового виробництва. NVIDIA зазначила, що ланцюжок постачання цієї платформи охоплює понад 350 заводів у 30 країнах світу, а більше 300 партнерів вже приєдналися до проекту.
Також NVIDIA оприлюднила дані щодо продуктивності Vera CPU та платформи Vera Rubin у завданнях AI-агентів, намагаючись довести, що зі зміною AI від «відповіді на запитання» до автономного планування, виклику інструментів та виконання завдань, CPU стає новою ареною для інфраструктури AI.
Дані, оприлюднені NVIDIA, що стосуються повних специфікацій, результатів тестування та архітектури процесора Vera для центрів обробки даних, є ключовими для всебічної оцінки цього чіпу потенційними клієнтами. Компанія повідомила, що чіпи Vera були доставлені клієнтам, таким як OpenAI, Anthropic і SpaceX, у червні.
Vera — це останній крок у стратегії вертикальної інтеграції NVIDIA. Компанія планує продавати клієнтам повні системи серверних стелажів із власними чіпами, а не окремі чіпи. За оцінками Wolfe Research, середня ціна одного чіпа Vera становить близько 5000 доларів США, а очікувана кількість відправлених чіпів цього року — близько 1,3 мільйона. Для AMD та Intel цей крок NVIDIA безпосередньо загрожує їхнім ключовим інтересам на ринку серверних CPU.
Це не перший раз, коли NVIDIA оголосила про запуск Vera CPU у масове виробництво. Наприкінці травня цього року NVIDIA повідомила, що Vera вже перейшла на повномасштабне виробництво, і зазначила, що цей чіп може виконувати певні завдання в 1,8 раза швидше, ніж традиційні x86 CPU. У середині травня NVIDIA також доставила перші системи Vera CPU клієнтам, таким як Anthropic, OpenAI та SpaceX AI. У цьому оголошенні акцент зроблено на масштабуванні виробництва всієї платформи Vera Rubin, розгортанні у клієнтів та продуктивності в реальних умовах експлуатації.
Піднесення AI-агентів, CPU знову стає «ключовим обмеженням»
Основна логіка NVIDIA, що робить ставку на CPU, полягає в тому, що застосунки ІШ змінюються.
Основна задача традиційного генеративного ІІ — генерувати відповіді на основі вхідних даних користувача, GPU виконує обчислення великих моделей, а CPU більше займається відносно периферійними завданнями планування. Але зі швидким розвитком AI-агентів AI-системи починають самостійно розкладати завдання, викликати зовнішні інструменти, виконувати код, отримувати доступ до даних та повторно оцінювати результати.
У цьому процесі CPU повинен часто обробляти велику кількість завдань з низькою затримкою та в реальному часі. NVIDIA вважає, що AI-агенти — це не лише завантаження, що залежить від GPU: середовище виконання кожного агента, виклик інструментів, оркестрація завдань та пошук даних з довгим контекстом вимагають участі CPU.
Ще при запуску Vera NVIDIA зазначила, що агентний штучний інтелект створює новий «момент CPU». Її висновок полягає в тому, що зі зміною AI-систем від «відповіді на запитання» до «прийняття дій» роль CPU в цілій AI-фабриці значно зросте.
NVIDIA навіть очікує, що довгостроковий розмір ринку серверних CPU може досягти 200 мільярдів доларів США. Ця цифра виглядає надзвичайно амбіційно порівняно з традиційним ринком серверних CPU, але логіка NVIDIA полягає в тому, що межі ринку CPU майбутнього можуть вийти за межі традиційних корпоративних серверів і розширитися до AI-виведення, AI-агентів, підсиленого навчання, обробки даних та різних завдань контролю та оркестрування AI-інфраструктури.
Це також причина, чому NVIDIA намагається перетворити правила конкуренції на ринку CPU.
Не граєте в кількість ядер, NVIDIA робить ставку на «швидкість одного ядра»
Дизайн Vera істотно відрізняється від традиційних серверних CPU.
NVIDIA повідомила, що Vera — це її перший CPU, розроблений спеціально для агентного ШІ, з 88 ядрами Olympus власної розробки та пропускною здатністю пам’яті 1,2 ТБ/с. Раніше NVIDIA заявляла, що Vera забезпечує підвищення продуктивності одного ядра на 50% порівняно з традиційними CPU; у тестах, опублікованих наприкінці травня, Vera досягла швидкості виконання певних завдань у 1,8 рази вищої, ніж x86 CPU.
У найновішому розкритті NVIDIA ще більше підкреслила основні напрямки дизайну Vera: замість простого додавання більшої кількості ядер, Vera зосереджена на продуктивності одного потоку, пропускній здатності зв’язку між ядрами та затримці доступу до пам’яті.
NVIDIA повідомила, що налаштований ядро Olympus для Vera забезпечує подвоєння продуктивності в однопотоковому режимі, потроєння пропускної здатності між ядрами та зменшення затримки пам’яті на 40% порівняно з конкурентними дизайнами чіпів. Їхня мета — дозволити AI-агентам швидше виконувати завдання та якомога швидше повернути обчислювальні ресурси GPU, щоб підвищити загальну ефективність AI-фабрики.
Бізнес-логіка за цим дуже проста: GPU є одним із найдорожчих і найрідкісніших обчислювальних ресурсів у центрах обробки даних ІІ. Якщо CPU обробляє завдання занадто повільно, GPU може перебувати у стані очікування. NVIDIA прагне за допомогою спеціально оптимізованого CPU зменшити цей час "простою".
У виробничих тестах Vera CPU від DeepInfra NVIDIA зазначила, що Vera підтримує до 1,6 разів більше паралельних AI-агентів і досягає швидкості оркестрування завдань до 2,2 разів вищої. Варто зауважити, що ці дані отримані у спеціфічному тестовому середовищі клієнта і не означають, що Vera має загальний перевагу над усіма загальними завантаженнями CPU.
Конкуренція зосереджується не на одному чіпі, а на цілій «AI-фабриці»
Vera CPU — це лише частина більшої стратегії NVIDIA.
На платформі Vera Rubin NVIDIA об’єднала Vera CPU, Rubin GPU, Groq 3 LPX, мережевий чіп Spectrum-6, SuperNIC ConnectX-9 та BlueField-4 у спільно спроектовану систему.
NVIDIA повідомила, що Vera Rubin NVL72 зараз входить у фазу масового виробництва по всьому світу, а такі партнери, як CoreWeave, Google Cloud, Microsoft Azure та Oracle Cloud Infrastructure, вже розпочали розгортання відповідних стелажів. NVIDIA також зазначила, що її ланцюг поставок охоплює більше 350 заводів у 30 країнах, а кількість учасників-партнерів перевищує 300.
У тестуванні клієнтів CoreWeave, використовуючи Vera Rubin NVL72 для тестування DeepSeek-R1, заявила, що кількість токенів, що генеруються за секунду на мегаватт, зросла в 10 разів порівняно з попереднім поколінням Grace Blackwell NVL72. Google Cloud вже запустив інстанси A5X на базі Vera Rubin NVL72, а NVIDIA заявляє, що вони забезпечують нижчі витрати на висновок та вищу пропускну здатність токенів на мегаватт у певних сценаріях.

Це означає, що конкуренти NVIDIA більше не обмежуються окремими прискорювачами, такими як AMD Instinct GPU або Intel Gaudi.
NVIDIA намагається контролювати всю інфраструктуру: CPU відповідає за планування, GPU — за обчислення, мережеві чіпи — за високоскоростне з’єднання, а програмне забезпечення — за планування та оптимізацію, нарешті, надаючи клієнтам системи на рівні стелажу або центру обробки даних.
Для AMD та Intel ця стратегія конкуренції є загрозою, оскільки NVIDIA може не потребувати повної симетричної конкуренції на традиційному ринку CPU. Мета NVIDIA — почати з найбільш перспективної частини AI-серверів, захопивши спочатку робочі навантаження, такі як агентний AI, підсилювальне навчання та високопродуктивний AI-вивід, а потім поступово розширити застосування CPU.
Традиційні переваги AMD та Intel зустрічають нові виклики
Протягом тривалого часу Intel та AMD мали домінуючу позицію на ринку серверних CPU.
Але зараз NVIDIA вважає, що інфраструктура ШІ змінює ієрархію цінностей CPU. Раніше конкуренція між серверними CPU здебільшого зводилася до кількості ядер, загальної обчислювальної потужності та загальної пропускної здатності; а в епоху агентного ШІ важливість низької затримки, продуктивності в однопотоковому режимі, пропускної здатності пам’яті та ефективності організації завдань зростає.
Це саме та ринкова ниша, яку NVIDIA вважає можливою для входу.
З точки зору продуктової форми, Vera може використовуватися як самостійний CPU, а також у складі системи Vera Rubin разом із GPU від NVIDIA. NVIDIA також позиціонує її як ключовий компонент для з’єднання AI-агентів із обчислювальними ресурсами GPU.
Раніше опублікований список клієнтів NVIDIA включав такі компанії з області ШІ, як Anthropic, OpenAI та SpaceX AI, а також хмарні сервіси, як ByteDance, CoreWeave та Oracle Cloud Infrastructure; виробники серверів, такі як Dell, Hewlett Packard Enterprise, Lenovo та AMD, також розробляють системи на основі Vera.
Це надає NVIDIA перевагу перед традиційними виробниками CPU: вона може пропонувати клієнтам повні рішення за допомогою комбінації GPU, CPU, мережі та програмного забезпечення.
Але це не означає, що NVIDIA може легко підірвати AMD та Intel.
Конкуренція на ринку CPU — це не лише боротьба за продуктивність чіпів, а й конкуренція за програмне забезпечення, сертифікацію клієнтів, сумісність із серверами та довгострокові поставки. Зокрема, великі хмарні провайдери та корпоративні клієнти зазвичай витрачають кілька років на перехід на нову апаратну платформу.
Отже, чи зможе Vera справді розширитися зі спеціалізованих сценаріїв AI на більш широкий ринок серверів, залежить від того, чи отримають клієнти достатньо помітну перевагу в продуктивності та витратах.
NVIDIA розкриває нові криві доходів за межами GPU
Нівідія в цей момент, перед заходом AMD з теми ШІ, концентрує розголошення інформації про серійне виробництво та продуктивність Vera Rubin, що має виражений конкурентний характер.
Протягом останніх кількох років NVIDIA майже повністю контролювала найприбутковіший сегмент інфраструктури ШІ завдяки своїм GPU. Але зі збільшенням присутності AMD у сфері AI-акселераторів та спробами Intel знайти пробій на ринку AI-чіпів, ринок все більше звертає увагу на те, чи зможе NVIDIA зберегти свій високий темп зростання.
Тим часом бізнес CPU AMD та Intel знову привернув увагу ринку через очікування нових потреб, пов’язаних з агентним штучним інтелектом.
Відповідь NVIDIA: якщо вартість AI-центру обробки даних розширюється від одиночного обчислення GPU до повної AI-фабрики, то NVIDIA не повинна залишати ринок CPU конкурентам.
З цієї точки зору Vera — це не просто ще один серверний CPU від NVIDIA, а подальше розширення її стратегії вертикальної інтеграції.
NVIDIA хоче, щоб клієнти замовляли не окремі GPU, CPU чи мережеві чіпи, а цілу інфраструктуру, здатну безпосередньо запускати AI-моделі та AI-агенти.
Якщо агентні штучні інтелекти справді стануть основним драйвером зростання потреби у обчислювальних ресурсах на наступному етапі, то NVIDIA може боротися не лише за частку ринку GPU, але й за всю ланцюжок цінності обчислень AI-серверів.
Це також означає, що майбутніми конкурентами AMD та Intel можуть стати не лише одна одна, а NVIDIA, яка вже володіє потужністю у сфері GPU, CPU, мереж, програмного забезпечення та цілих систем.
