Nvidia Vera Rubin NVL72 запустили в облаке CoreWeave

CoreWeave запустил систему Nvidia Vera Rubin NVL72 в своей облачной инфраструктуре. Первым клиентом с производственными нагрузками стала Cognition, разрабатывающая ИИ-агента Devin.

Главное
  • В выводе SWE-2 Vera Rubin NVL72 показала до 4,8 раза большую пропускную способность токенов, чем GB200 NVL72.
  • В обучении с подкреплением пропускная способность на один GPU выросла в 3,8 раза.
  • В тесте DeepSeek-R1 энергоэффективность оказалась в 10 раз выше по токенам на мегаватт.
Стойка Nvidia Vera Rubin NVL72 с жидкостным охлаждением в дата-центре CoreWeave
Фото: iXBT

Облачный провайдер CoreWeave запустил в своей инфраструктуре систему Nvidia Vera Rubin NVL72. Первым клиентом, разместившим на ней производственные ИИ-нагрузки, стала компания Cognition — разработчик ИИ-агента Devin.

В задаче вывода SWE-2 платформа обеспечила до 4,8 раза большую общую пропускную способность токенов по сравнению с GB200 NVL72. В сценариях обучения с подкреплением пропускная способность на один GPU оказалась выше в 3,8 раза. Это позволяет Devin одновременно обрабатывать больше сессий и ускорять многошаговый вывод.

Ещё заметнее разница в энергоэффективности. В тесте DeepSeek-R1 система Vera Rubin NVL72 продемонстрировала в 10 раз большую пропускную способность токенов на мегаватт по сравнению с GB200 NVL72.

Аппаратная конфигурация включает 36 процессоров Vera и 72 GPU Rubin, объединённых полностью жидкостной системой охлаждения. Модульная конструкция стоек сокращает заявленное время установки отдельных лотков примерно с двух часов до пяти минут.

CoreWeave также предлагает процессоры Vera отдельно от GPU. В одной стойке можно разместить до 128 таких процессоров, суммарно получая 11 264 ядра и возможность одновременно запускать более 11 000 изолированных сред. По данным компании, запуск агентских песочниц происходит более чем в 3 раза быстрее, чем на процессорах с архитектурой x86.

Для профиТехнические детали: архитектура, цифры, ссылки

Конфигурация Nvidia Vera Rubin NVL72: 36 процессоров Vera и 72 GPU Rubin, полностью жидкостное охлаждение. Модульная конструкция стоек сокращает время установки лотков с ~2 часов до ~5 минут.

CoreWeave предлагает процессоры Vera отдельно: до 128 штук в стойке, суммарно 11 264 ядра, более 11 000 изолированных сред. Запуск агентских песочниц более чем в 3 раза быстрее, чем на x86.

Бенчмарки: вывод SWE-2 — до 4,8× пропускной способности токенов против GB200 NVL72; RL — 3,8× на GPU; DeepSeek-R1 — 10× токенов на мегаватт.

Вопросы и ответы

Какие бенчмарки у Vera Rubin NVL72?
В выводе SWE-2 — до 4,8 раза выше пропускная способность токенов, чем у GB200 NVL72; в RL — в 3,8 раза на GPU; в DeepSeek-R1 — в 10 раз больше токенов на мегаватт.
Кто первый клиент CoreWeave на Vera Rubin NVL72?
Cognition, разместившая производственные нагрузки Devin.
Что входит в конфигурацию Vera Rubin NVL72?
36 процессоров Vera и 72 GPU Rubin с полностью жидкостным охлаждением.

Источники

Материал подготовлен редакцией на основе указанных источников. Как мы работаем