NVIDIA представила производительность Vera CPU, нацелившись на AMD и Intel

iconMetaEra
Поделиться
AI summary iconСводка
NVIDIA объявила о новых листингах токенов для своей платформы Vera Rubin, раскрыв впечатляющие показатели производительности перед событием AMD. Процессор Vera, первый серверный процессор NVIDIA, обеспечивает почти вдвое более высокую производительность и в шесть раз меньшую задержку по сравнению с чипами x86 при задачах, связанных с ИИ-агентами. Платформа NVL72 обеспечивает в 10 раз более высокую пропускную способность токенов на мегаватт по сравнению с GB200 NVL72. Первые единицы были переданы OpenAI, Anthropic и SpaceX. С поддержкой памяти объемом 1,5 ТБ и ожидаемым выпуском 1,3 миллиона единиц в этом году NVIDIA выходит на рынок серверных процессоров. Новость о запуске токенов подчеркивает расширение компании за пределы GPU.
Накануне ежегодного мероприятия по запуску продуктов AMD NVIDIA активно опубликовала данные о реальной производительности новой платформы Vera Rubin и официально раскрыла полные спецификации собственного процессора Vera. Процессор Vera демонстрирует производительность, почти вдвое превышающую показатели x86-чипов при выполнении агентных задач ИИ, а задержка снижается в шесть раз. При запуске модели DeepSeek R1 на платформе Vera Rubin NVL72 производительность по пропускной способности токенов на мегаватт энергопотребления увеличилась в 10 раз по сравнению с предыдущим поколением GB200 NVL72. Первые поставки уже получены OpenAI, Anthropic и SpaceX. Vera — первый серверный процессор, разработанный NVIDIA собственными силами, с энергопотреблением 250–450 Вт и поддержкой до 1,5 ТБ памяти; ожидается, что в этом году будет выпущено 1,3 миллиона единиц. Это означает официальный вход NVIDIA на рынок серверных процессоров и прямое соперничество с AMD и Intel. Рынок серверных процессоров, стимулируемый агентным ИИ, потенциально может достичь 200 миллиардов долларов.

Автор статьи, источник: Wall Street Journal

Накануне ежегодного мероприятия по запуску продуктов своего главного конкурента AMD, NVIDIA нанесла мощный удар, опубликовав результаты реальных тестов новой платформы Vera Rubin и официально раскрыв полные спецификации собственного процессора Vera.

Во вторник NVIDIA сообщила, что производительность Vera CPU при выполнении агентских задач ИИ почти вдвое превышает показатели x86-чипов, а задержка снижается в шесть раз. В то же время ранние тесты производства партнером по облачным вычислениям CoreWeave показали, что платформа Vera Rubin NVL72 при запуске модели DeepSeek R1 обеспечивает в 10 раз более высокую пропускную способность токенов на мегаватт вычислительной мощности по сравнению с предыдущей системой GB200 NVL72 на базе архитектуры Blackwell.

Выпуск этих данных имеет глубокий смысл. AMD проведет ежегодную презентацию продуктов «Advancing AI» в Сан-Франциско в четверг этой недели, и в этот момент NVIDIA активно публикует данные о производительности, что внешние наблюдатели в целом интерпретируют как сознательную маркетинговую кампанию. Для облачных провайдеров и корпоративных клиентов, оценивающих инвестиции в следующее поколение инфраструктуры ИИ, эти данные напрямую повлияют на их решения о закупках.

В то же время NVIDIA официально объявила, что первые партии процессоров Vera были доставлены в июне, а клиентами стали OpenAI, Anthropic и SpaceX. Это означает, что NVIDIA официально вышла на рынок CPU, напрямую конкурируя с AMD и Intel.

Представлен процессор Vera: NVIDIA официально выходит на рынок серверных CPU. Во вторник NVIDIA опубликовала полные спецификации, результаты тестирования и информацию об архитектуре процессора Vera для центров обработки данных — ключевые данные, необходимые потенциальным клиентам для всесторонней оценки чипа. Компания сообщила, что процессоры Vera уже были доставлены клиентам, таким как OpenAI, Anthropic и SpaceX, в июне.

Vera — это первый серверный CPU NVIDIA, спроектированный с нуля на уровне ядра, с использованием настраиваемой микропроцессорной архитектуры под кодовым названием "Olympus core", а не готовых решений от Arm.

Ханна Кутан, руководитель рынка продуктов Vera от NVIDIA, отметила, что дизайн чипа сосредоточен на скорости однокристальной обработки, высокой пропускной способности памяти и низкой задержке, с целью «обеспечить как можно более быстрый возврат агентов на GPU и поддерживать высокую загрузку GPU постоянно». На уровне аппаратных характеристик потребление энергии Vera составляет от 250 до 450 ватт, а каждый чип поддерживает до 1,5 ТБ энергоэффективной памяти.

В последних опубликованных тестах NVIDIA продемонстрировала, что Vera обеспечивает на 1,9 раза более высокую производительность по сравнению с x86-чипами при выполнении задач агентного ИИ и снижает задержку в 6 раз. NVIDIA также заявила, что Vera превосходит флагманский процессор AMD EPYC Turin почти на 100% в некоторых отраслевых стандартах тестирования. Ранее NVIDIA сообщала, что Vera обеспечивает на 50% более высокую общую производительность по сравнению с x86-чипами при выполнении задач агентного ИИ.

Выпуск Vera — это последний шаг в стратегии вертикальной интеграции NVIDIA. По оценкам Wolfe Research, средняя цена за одну чипу Vera составляет около 5000 долларов США, и ожидается, что объем поставок в этом году достигнет примерно 1,3 миллиона единиц. Иэн Бак, вице-президент NVIDIA по суперкомпьютерным вычислениям, заявил, что агентное ИИ делает CPU «еще более незаменимыми» и прогнозирует, что общий рынок серверных CPU в конечном итоге может достичь 200 миллиардов долларов.

Vera Rubin в реальных условиях: 10-кратный рост энергоэффективности. CoreWeave в начале июня этого года осуществила первую в отрасли развертку и верификацию Vera Rubin NVL72, включая полную проверку по всем стекам: электропитание, охлаждение, сеть и вычисления. Раскрытые данные представляют собой первые публичные результаты реальных тестов производительности чипа Vera Rubin NVL72.

Тестирование с использованием модели DeepSeek R1 в качестве эталона показало, что Vera Rubin NVL72 генерирует в 10 раз больше токенов на мегаватт в секунду по сравнению с GB200 NVL72. CoreWeave также отметила, что оптимизации, примененные к Vera Rubin, могут быть применены обратно к системе GB200 NVL72, что позволило увеличить пропускную способность на мегаватт более чем в четыре раза за три месяца. NVIDIA заявила, что эти результаты были подтверждены более чем 250 000 независимыми конфигурациями и более чем 1,4 миллиона часов работы GPU.

С архитектурной точки зрения, стойка Vera Rubin NVL72 интегрирует 72 GPU Rubin и 36 CPU Vera, соединенных через полностью связанную архитектуру NVLink 6 с пропускной способностью 260 ТБ/с и нативно поддерживающую точность NVFP4. CoreWeave отмечает, что это повышение эффективности позволяет клиентам обрабатывать больший объем трафика инференса при том же бюджете на энергопотребление или запускать ту же нагрузку с меньшим потреблением электроэнергии, снижая стоимость на каждый токен.

CoreWeave также раскрыла конкретные сценарии применения: глобальная компания по кибербезопасности ожидает запуска обнаружения угроз с производительностью в 10 раз выше на ватт; компания, занимающаяся автономными программными агентами, планирует масштабировать задачи агентов при значительном снижении стоимости токенов; а AI-натуральный поисковик ожидает расширения сервиса реального поиска для большего числа пользователей без превышения лимитов времени отклика.

Координационная оптимизация инфраструктуры: интеграция программного и аппаратного обеспечения для повышения эффективности NVIDIA подчеркивает, что указанное повышение производительности достигается не только за счет самого чипа, а является результатом комплексной стратегии совместной разработки аппаратного и программного обеспечения. Благодаря динамической оптимизации всей инфраструктуры и энергетического стека, NVIDIA сообщает, что можно развернуть на 40% больше GPU в том же диапазоне энергопотребления.

В области охлаждения NVIDIA использует замкнутую жидкостную систему охлаждения при температуре 45°C, что позволяет экономить около 4 миллионов галлонов воды на мегаватт в год по сравнению со стандартными методами охлаждения. На сетевом уровне шестое поколение архитектуры NVLink 6 обеспечивает в 2,3 раза более высокую пропускную способность при моделировании декодирования больших языковых моделей по сравнению с архитектурой Ethernet; платформа Spectrum-X обеспечивает в 1,6 раза более высокую пропускную способность удаленного прямого доступа к памяти, одновременно сокращая количество коммутаторов в 1,7 раза, повышая эффективность оптической мощности в пять раз и надежность в десять раз.

Новейшая платформа Spectrum-6 от NVIDIA уже начала поставки клиентам-производителям ИИ, таким как CoreWeave, Microsoft, Nebius B.V., SpaceXAI Corp. и Tesla. В настоящее время NVIDIA ускоряет отгрузки клиентам и партнерам, включая Google Cloud, Microsoft Azure, Meta, Oracle Cloud Infrastructure, Dell Technologies, OpenAI и CoreWeave.

NVIDIA по-прежнему остается конкурентом на рынке CPU, несмотря на впечатляющие данные по производительности Vera. На рынке CPU для корпоративных AI-серверов NVIDIA сталкивается со значительными вызовами с точки зрения доли рынка. Аналитик Gartner Кевин Кнокс отметил, что AMD в настоящее время является основным конкурентом в этой области. Согласно отчетам, Intel занимает около 66,8% рынка серверных CPU, AMD — около 33%, причем AMD продолжает захватывать долю рынка и укрепляет партнерские отношения с крупнейшими облачными провайдерами.

Благодаря росту спроса на ЦП, обусловленному появлением агентных ИИ, акции AMD и Intel в этом году выросли на 128% и 149% соответственно, значительно превзойдя примерно 8%-й рост NVIDIA за тот же период, и стали лучшими акциями чипов 2026 года.

На текущем этапе в списке основных партнеров-облачных провайдеров NVIDIA указан только Oracle, другие ведущие облачные компании еще не включены. Ханна Кутан признает, что Vera пока находится на стадии «раннего внедрения», однако OpenAI планирует начать масштабное развертывание чипов Vera уже в этом квартале.

Основатель Cambrian AI Research Карл Фройнд свел стратегические намерения NVIDIA к следующему: «Их цель — освободить клиентов от зависимости от CPU Intel или AMD, и они намерены захватить эту долю дохода. Они сосредоточились на создании уникального CPU, которого пока нет ни у кого на рынке».

Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации. Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.