Nvidia Vera Rubin NVL72 запустили в облаке CoreWeave
CoreWeave запустил систему Nvidia Vera Rubin NVL72 в своей облачной инфраструктуре. Первым клиентом с производственными нагрузками стала Cognition, разрабатывающая ИИ-агента Devin.
- В выводе SWE-2 Vera Rubin NVL72 показала до 4,8 раза большую пропускную способность токенов, чем GB200 NVL72.
- В обучении с подкреплением пропускная способность на один GPU выросла в 3,8 раза.
- В тесте DeepSeek-R1 энергоэффективность оказалась в 10 раз выше по токенам на мегаватт.

Облачный провайдер CoreWeave запустил в своей инфраструктуре систему Nvidia Vera Rubin NVL72. Первым клиентом, разместившим на ней производственные ИИ-нагрузки, стала компания Cognition — разработчик ИИ-агента Devin.
В задаче вывода SWE-2 платформа обеспечила до 4,8 раза большую общую пропускную способность токенов по сравнению с GB200 NVL72. В сценариях обучения с подкреплением пропускная способность на один GPU оказалась выше в 3,8 раза. Это позволяет Devin одновременно обрабатывать больше сессий и ускорять многошаговый вывод.
Ещё заметнее разница в энергоэффективности. В тесте DeepSeek-R1 система Vera Rubin NVL72 продемонстрировала в 10 раз большую пропускную способность токенов на мегаватт по сравнению с GB200 NVL72.
Аппаратная конфигурация включает 36 процессоров Vera и 72 GPU Rubin, объединённых полностью жидкостной системой охлаждения. Модульная конструкция стоек сокращает заявленное время установки отдельных лотков примерно с двух часов до пяти минут.
CoreWeave также предлагает процессоры Vera отдельно от GPU. В одной стойке можно разместить до 128 таких процессоров, суммарно получая 11 264 ядра и возможность одновременно запускать более 11 000 изолированных сред. По данным компании, запуск агентских песочниц происходит более чем в 3 раза быстрее, чем на процессорах с архитектурой x86.
Для профиТехнические детали: архитектура, цифры, ссылки
Конфигурация Nvidia Vera Rubin NVL72: 36 процессоров Vera и 72 GPU Rubin, полностью жидкостное охлаждение. Модульная конструкция стоек сокращает время установки лотков с ~2 часов до ~5 минут.
CoreWeave предлагает процессоры Vera отдельно: до 128 штук в стойке, суммарно 11 264 ядра, более 11 000 изолированных сред. Запуск агентских песочниц более чем в 3 раза быстрее, чем на x86.
Бенчмарки: вывод SWE-2 — до 4,8× пропускной способности токенов против GB200 NVL72; RL — 3,8× на GPU; DeepSeek-R1 — 10× токенов на мегаватт.
Вопросы и ответы
- Какие бенчмарки у Vera Rubin NVL72?
- В выводе SWE-2 — до 4,8 раза выше пропускная способность токенов, чем у GB200 NVL72; в RL — в 3,8 раза на GPU; в DeepSeek-R1 — в 10 раз больше токенов на мегаватт.
- Кто первый клиент CoreWeave на Vera Rubin NVL72?
- Cognition, разместившая производственные нагрузки Devin.
- Что входит в конфигурацию Vera Rubin NVL72?
- 36 процессоров Vera и 72 GPU Rubin с полностью жидкостным охлаждением.



