Skip to content
Nvidia объявила о полномасштабном производстве платформы Vera Rubin и внедрении у ключевых клиентов
22 июля 12:55 3 Просмотров Новости

Nvidia объявила о полномасштабном производстве платформы Vera Rubin и внедрении у ключевых клиентов

Новая эра ИИ-инфраструктуры

Компания Nvidia на этой неделе провела серию мероприятий для прессы, клиентов и партнёров, продемонстрировав готовность поставлять новейшие серверные компоненты и готовые системы на базе архитектуры Vera Rubin. По словам вице-президента Nvidia по направлению центров обработки данных Иэна Бака, компания «абсолютно находится на стадии полномасштабного производства», а оборудование «уже установлено у всех наших крупнейших потребителей». стеллажи серверов Nvidia Vera Rubin NVL72 в дата-центре

Статус поставок и ключевые клиенты

Инвесторы и клиенты с некоторым опасением следили за этапом масштабирования производства систем поколения Vera Rubin, однако представители Nvidia заявляют, что переживать не о чем. По информации компании, серверы нового поколения уже используются Google, CoreWeave, Microsoft, Meta Platforms и Dell Technologies. Американский стартап OpenAI, один из лидеров рынка ИИ, собирается начать масштабную эксплуатацию систем семейства Vera Rubin в текущем квартале. Уже сейчас OpenAI проводит испытания оборудования на специально построенной экспериментальной площадке в окрестностях штаб-квартиры Nvidia в Калифорнии.

Более широкое развёртывание системы ожидается в третьем квартале 2026 года. Тайваньские производители серверов и глобальные лидеры цепочки поставок производят системы Vera Rubin в масштабе и поставляют их ИИ-лабораториям, облачным провайдерам и гипермасштабируемым заказчикам.

Архитектура платформы: семь новых чипов

Платформа Nvidia Vera Rubin включает семь новых чипов в полномасштабном производстве для масштабирования крупнейших в мире ИИ-фабрик. Платформа представляет собой многостеллажную систему масштаба POD, объединяющую пять целевых стеллажных систем в один массивный согласованный ИИ-суперкомпьютер. Устраняя критические узкие места в коммуникации и перемещении памяти, платформа ускоряет инференс, выдавая больше токенов на ватт и более низкую стоимость токена по сравнению с архитектурой Nvidia Blackwell.

  • Nvidia Vera Rubin NVL72 — объединяет 72 GPU Rubin, 36 CPU Vera, ConnectX-9 SuperNIC, BlueField-4 DPU. Третье поколение стеллажной платформы с коммутатором NVLink 6 для масштабирования вверх и Quantum-X800 InfiniBand / Spectrum-X Ethernet для масштабирования вовне.
  • Nvidia Vera CPU — стеллаж с 256 процессорами Vera, жидкостное охлаждение, поддержка более 22 500 одновременных песочничных сред для обучения с подкреплением и агентного ИИ.
  • Nvidia Groq 3 LPX — инференс-ускоритель, объединяющий GPU Rubin (HBM) и LPU (SRAM) для триллионных параметров и контекста в миллион токенов.
  • Nvidia Vera BlueField-4 STX — модульная основа для стеллажных решений AI-native хранилища.
  • Nvidia Spectrum-6 SPX Ethernet — сетевое ускорение для ИИ-фабрик, низкая задержка и высокая пропускная способность стеллаж-стеллаж.
схема архитектуры Nvidia Vera Rubin NVL72 с 72 GPU и 36 CPU

Инновации в инференсе и безопасности

Vera Rubin NVL72 оснащена новым Transformer Engine с адаптивным сжатием для повышения производительности инференса в формате NVFP4. Третье поколение Nvidia Confidential Computing расширяет безопасность на всю стеллажную платформу, а второе поколение RAS-движка обеспечивает стойкость на уровне стойки. Система жидкостного охлаждения сокращает потребность в свободном пространстве и количестве вентиляторов, а компоновка с минимизированным кабельным подключением рассчитана на роботизированную сборку.

Линейка готовых систем

На базе платформы представлены четыре коммерческих продукта для разных сценариев развёртывания:

  • Nvidia DGX Vera Rubin NVL72 — готовое к развёртыванию корпоративное решение ИИ-инфраструктуры для самых сложных моделей.
  • Nvidia DGX Rubin NVL8 — жидкостно охлаждаемая система с 8 GPU Rubin и NVLink шестого поколения для обучения, инференса и пост-обучения.
  • Nvidia HGX Rubin NVL8 — интеграция 8 GPU Rubin с NVLink шестого поколения, совместима с CPU Vera или x86-базовыми платами.
  • Nvidia Vera Rubin NVL4 — мост NVLink-C2C между 4 GPU Rubin и 2 CPU Vera, совместим с жидкостно охлаждаемыми серверами MGX. Обеспечивает до 4× производительности в научных симуляциях, 6× в обучении AI-for-Science и 8× в инференсе по сравнению с Hopper.
сервер Nvidia DGX Vera Rubin NVL72 и HGX Rubin NVL8 рядом

Производительность и сравнения

По данным CoreWeave, системы поколения Vera Rubin способны выдавать в десять раз больше токенов по сравнению с предшественниками при работе с моделью DeepSeek-R1. Представители Nvidia также заявляют, что центральные процессоры Vera оказываются в 1,8 раза быстрее в программировании на Python по сравнению с конкурирующими процессорами AMD Turin. В AMD возразили, что сравнение с более новыми процессорами Venice не демонстрирует подобного разрыва. Платформа ориентирована на работу автономных ИИ-агентов, где критически важны скорость и способность удерживать длинный контекст.

Поделиться

Похожие публикации