NVIDIA Vera Rubin POD: семь чипов, пять стоек, один ИИ-суперкомпьютер
ИИ-платформа NVIDIA Vera Rubin POD на архитектуре MGX третьего поколения, созданная для эры агентного ИИ, объединяет сразу пять стоечных систем в единую высокоинтегрированную систему, самую сложную и крупную в истории компании — одна только стойка NVL72 теперь весит 1,8 т NVIDIA представила NVIDIA Vera Rubin POD — кластер из пяти специализированных стоечных систем, построенных на архитектуре NVIDIA MGX третьего поколения для эры агентного ИИ. Компания отметила, что созданная в рамках совместного проектирования семи чипов, охватывающих вычислительные ресурсы, сети и хранилище данных, NVIDIA Vera Rubin представляет собой самую сложную ИИ-платформу. Готовый кластер Vera Rubin POD включает 40 стоек, 1,2 квадрлн транзисторов, почти 20 тыс. кристаллов NVIDIA, 1152 GPU NVIDIA Rubin. Он обеспечивает ИИ-производительность на уровне 60 Эфлопс и агрегированную скорость интерконнекта для вертикального масштабирования около 10 Пбайт/с. Входящие в состав NVIDIA Vera Rubin POD пять различных стоечных платформы образуют единую, высокоинтегрированную систему. Кластер POD базируется на 19″ стойках стандарта NVIDIA MGX (OCP) третьего поколения, поддерживаемых экосистемой из более чем 80 партнёров с глобальной цепочкой поставок. При этом каждая стойка NVIDIA MGX с точки зрения ЦОД имеет одинаковые параметры питания, охлаждения и механические характеристики, что упрощает развёртывание. Существует два типа стоек MGX с медными интерконнектами. MGX NVL использует NVIDIA NVLink, в частности, Vera Rubin NVL72 объединяет 72 ускорителя Rubin и 36 процессоров Vera , а восемь суперускорителей NVL72 объединяются в единый домен NVL576 посредством двухуровневой сети NVLink 6 (3,6 Тбайт/с на чип) с дальнейшим горизонтальным масштабированием с помощью Ethernet/InfiniBand (в том числе на уровне нескольких ЦОД ). Новая стойка MGX ETL совместима со сторонними чипами, а в качестве интерконнекта использует Ethernet на базе Spectrum-X , либо, как в случае Groq 3 LPU, проприетарный интерконнект RealScale, но для горизонтального масштабирования опять-таки применяется Ethernet. Vera Rubin NVL72 , по словам NVIDIA, разработана для масштабирования четырёх ключевых ИИ-нагрузок: предварительного обучения, постобучения, ресурсоёмкого инференса (TTS) и работы агентов масштабирования. Суперускоритель может быть оптимизирован для сложных многомодальных задач с использованием MoE и ресурсоёмкой фазы работы с контекстом в процессе ИИ-инференса. Новая платформа обеспечивает до 4 раз лучшую производительность обучения и до 10 раз лучшую производительность инференса на Ватт, а также в десять раз меньшую стоимость токена по сравнению с NVIDIA Blackwell. NVIDIA Vera Rubin NVL72 содержит почти в два раза больше транзисторов, чем GB200 NVL72 . Стойка включает 18 вычислительных узлов, которые помимо 72 ускорителей NVIDIA и 36 процессоров Vera, включают восемь адаптеров ConnectX-9 SuperNIC и один DPU BlueField-4 . Также стойка включает девять узлов-коммутаторов NVLink 6 — по 3,6 Тбайт/с (1,8 Тбайт/с в каждую сторону) на каждый ускоритель с агрегированной пропускной способностью почти 260 Тбайт/c. Как и прежде, в задней части находится основная магистраль NVLink в виде картриджей, имеющих по 5 тыс. медных соединений общей длиной более 3 км. В общей сложности стойка вмещает 1,3 млн компонентов, почти 1300 микросхем и весит около 1800 кг ( не каждый ЦОД выдержит такую нагрузку). Высокоинтегрированная стойка не требует возни с кабелями и шлангами, что до 20 раз ускоряет развёртывание и обслуживание кластера — на подготовку одного узла теперь уходит пять минут вместо двух часов. А сами узлы теперь гораздо ближе к блейд-серверам. 💡 Где захостить и как запустить: рассчитать точные требования к объёму VRAM под разные типы квантования этой модели (4-bit Q4, FP8, FP16), оценить скорость генерации токенов в секунду и подобрать совместимый сервер с GPU можно на ServerSales в интерактивном подборщике AI-моделей или каталоге GPU-серверов.
Планируете развернуть эту нейросеть?
На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.
Надежные облачные платформы и серверы в РФ
Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.
Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.
Hostkey
GPU RTX 3090 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 3090 (24 ГБ GDDR6X)
24 999 ₽/мес
Timeweb Cloud
GPU RTX A5000 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX A5000 (24 ГБ GDDR6X)
24 999 ₽/мес
Hostkey
GPU RTX 4090 24GB
CPU
16 ядер
RAM
128 ГБ
Диск
1000 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 4090 (24 ГБ GDDR6X)
32 999 ₽/мес
Ищете точную конфигурацию под ваш бюджет?
Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.