«Рег.облако» запустило инференс ИИ-моделей на Nvidia B300

Облачный провайдер «Рег.облако» добавил в свою инфраструктуру ускорители Nvidia B200 и B300. Часть B300 уже работает в контуре инференса моделей, остальные мощности доступны клиентам.

Главное
  • «Рег.облако» расширило GPU-инфраструктуру ускорителями Nvidia B200 и B300
  • Часть B300 уже используется для инференса моделей внутри инфраструктуры провайдера
  • Сервисом «Рег.облака» воспользовались более тысячи клиентов

Облачный и Bare metal провайдер «Рег.облако» расширил GPU-инфраструктуру ускорителями Nvidia B200 и B300. Новые мощности предназначены как для клиентских нагрузок, так и для развития собственной ИИ-платформы провайдера. Об этом CNews сообщили представители «Рунити».

Для «Рег.облака» B300 стали частью локального контура ИИ-платформы. Модели, работающие на собственной инфраструктуре провайдера, доступны российским пользователям без виртуальной частной сети компании, оплачиваются в рублях и данные запросов не передаются зарубежным поставщикам моделей.

Nvidia B300 относится к поколению Blackwell Ultra, которое производитель изначально ориентировал в том числе на inference reasoning- и agentic-моделей. В системе HGX B300 восемь ускорителей объединяют более 2 ТБ HBM3E-памяти, что позволяет размещать крупные модели и обслуживать более тяжелые inference-нагрузки.

«Сейчас новые GPU сложно быстро получить: сроки поставок растут, оборудование дорожает, а доступность последних поколений остается ограниченной. Мы получили партию B200 и B300, которой хватает не только для расширения предложения клиентам, но и для развития собственной ИИ-платформы. Часть B300 мы уже ввели в рабочий контур: на них идет инференс моделей непосредственно внутри инфраструктуры „Рег.облака“», — сказал Евгений Мартынов, директор по информационным технологиям «Рег.облака».

В августе 2026 г. провайдер внедрил оплату по токенам в собственную ИИ-платформу, где пользователям доступны более 35 моделей через единый интерфейс и API. Теперь компания расширила собственный вычислительный контур ускорителями Nvidia B200 и B300. Новые мощности доступны клиентам, а часть B300 используется для собственных моделей. «Рег.облако» планирует расширять каталог моделей, работающих непосредственно на его инфраструктуре.

Для профиТехнические детали: архитектура, цифры, ссылки

Nvidia B300 — ускоритель поколения Blackwell Ultra, ориентированный на inference reasoning- и agentic-моделей. В конфигурации HGX B300 восемь ускорителей объединяют более 2 ТБ памяти HBM3E.

«Рег.облако» в августе 2026 года внедрило оплату по токенам в свою ИИ-платформу, где через единый интерфейс и API доступны более 35 моделей. Часть B300 уже задействована в рабочем контуре для инференса моделей внутри инфраструктуры провайдера.

Что это значит для России

Модели на инфраструктуре «Рег.облака» доступны российским пользователям без виртуальной частной сети компании, оплата идет в рублях, а данные запросов не передаются зарубежным поставщикам моделей. Это снижает зависимость от внешних сервисов при работе с ИИ.

Провайдер планирует расширять каталог моделей, работающих непосредственно на его инфраструктуре.

Вопросы и ответы

Какие ускорители добавило «Рег.облако»?
Nvidia B200 и B300 — провайдер расширил ими GPU-инфраструктуру.
Можно ли оплатить сервис в рублях?
Да, модели на инфраструктуре «Рег.облака» оплачиваются в рублях.
Сколько моделей доступно на платформе?
Более 35 моделей через единый интерфейс и API.

Источники

Материал подготовлен редакцией на основе указанных источников. Как мы работаем