Cisco Secure AI Factory: стойки Supermicro под кластеры до 100 000 GPU

Cisco расширяет платформу Secure AI Factory with NVIDIA на стоечные системы Supermicro с жидкостным и воздушным охлаждением. Продажи начнутся в октябре через корпоративные каналы и партнёрскую сеть Cisco, с поддержкой и сервисами жизненного цикла от вендора. Дизайн опирается на эталонную архитектуру NVIDIA Cloud Partner (NCP) и сервисы Cisco Validated Infrastructure Services (CVIS).

Архитектура сети: два семейства коммутаторов

Эталонный дизайн Cisco разделяет сеть кластера между двумя семействами коммутаторов. Фронтенд-фабрика строится на коммутаторах Cisco N9300 Series с кремнием Cisco Silicon One, бэкенд-фабрика — на Cisco N9100 Series на базе NVIDIA Spectrum-X. Такая связка рассчитана на кластеры примерно от 1000 до более чем 100 000 GPU и ложится на NVL72 для Vera Rubin и Grace Blackwell, HGX NVL8 для Rubin и B300, а также платформы MGX PCIe GPU.

Cisco разделяет валидированные дизайны по масштабу. Enterprise Reference Architecture нацелена на серверные ИИ-кластеры менее примерно 1000 GPU (1024?) на коммутации Cisco Silicon One N9300. Cloud Reference Architecture охватывает диапазон примерно от 1000 до более чем 100 000 GPU с фронтендом N9300 и бэкендом N9100 Series на NVIDIA Spectrum-X.

Роль CVIS и управление

CVIS — это зона ответственности Cisco за сборку. Инструментарий CVIS Toolkit отвечает за повторяемое provisioning и автоматическую валидацию, специализированная доставка передаёт заказчику проверенный кластер с отчётом о производительности и соответствии требованиям, а выделенные CVIS performance-кластеры поддерживают тестирование ПО и разработку инструментов.

Управление сходится в Cisco Cloud Control, запланированном на четвёртый календарный квартал 2026 года. Консоль добавляет единый вход, инвентаризацию и топологию, управление серверами, питанием и охлаждением инфраструктуры, а также сетевое управление, объединяя Intersight и Nexus One в единую модель эксплуатации Day 0-2.

Стоечные системы Supermicro

Линейка Supermicro покрывает большую часть ускорительного портфеля NVIDIA. Cisco перечисляет системы Supermicro MGX, NVIDIA HGX B300 NVL8 в воздушном и жидкостном охлаждении, NVIDIA HGX Rubin NVL8, а также стоечные Vera Rubin NVL72 и GB300 NVL72 рядом с модульными серверами UCS X-Series.

Сетевая инфраструктура на уровне стойки затрагивает каждую фабрику кластера. Cisco сопоставляет management-фабрику с коммутатором N9364E-SG2-O на Cisco Silicon One, а фронтенд и бэкенд — с N9164E-NS4-O на NVIDIA Spectrum-X. Та же фабрика масштабируется за пределы 100 000 GPU на модели, которую сетевые команды уже знают.

Системы Supermicro ориентированы на ИИ-кластеры за пределами Cisco Unified Edge и Cisco AI POD. Кластеры Supermicro нацелены на обучение моделей и рабочие нагрузки с триллионами параметров, а не на edge-инференс или оптимизацию.

Поддержка и сервис

На вопрос о физическом обслуживании стоек Cisco ответила: если в сервере Supermicro потребуется заменить SSD или GPU, физический сервис будет выполнять Supermicro. Cisco добавит свой Ethernet-кремний, оптику, безопасность и observability-портфель.

Как отметил главный редактор Patrick Kennedy, у Supermicro есть высокообъёмный бизнес ИИ-кластеров со всеми мощностями по интеграции, тестированию и развёртыванию, а также гораздо более быстрый цикл разработки новых серверов, чем у Cisco UCS. Внестоечные компоненты вроде чиллеров и внутрирядных CDU будут доступны по реселлерскому соглашению, но потребуют дополнительной инженерии.

Ранее мы рассказывали, как Cisco добавит жидкостное охлаждение Supermicro в Secure AI Factory с Nvidia, а также о том, как Cisco объединяет управление сетевой инфраструктурой в Cloud Control.

Что это значит для операторов

Для предприятий, которые уже стандартизировались на Cisco в сетях и хотят одного вендора, ответственного за развёртывание ИИ-кластера, это сотрудничество убирает необходимость отдельно интегрировать системы Supermicro, коммутаторы Cisco и сторонние инструменты управления. Оператор получает весь ИИ-кластер в едином представлении: Cloud Control отрисовывает фабрику и топологию, фронтенд, бэкенд, хранилище, management-коммутаторы, серверы и СХД с AI Canvas для диагностики и непрерывной видимости.

Частые вопросы

Когда начнутся продажи стоек Supermicro в составе Secure AI Factory?

Cisco начнёт предлагать системы Supermicro в октябре через корпоративные продажи и партнёрскую экосистему, с поддержкой Cisco и сервисами жизненного цикла.

Какие GPU-платформы покрывает линейка?

Линейка включает Supermicro MGX, NVIDIA HGX B300 NVL8, HGX Rubin NVL8, а также стоечные Vera Rubin NVL72 и GB300 NVL72.

Кто будет обслуживать физические серверы?

Физический сервис, включая замену SSD и GPU, будет выполнять Supermicro. Cisco отвечает за сеть, валидацию, поддержку и управление.

Чем Enterprise Reference Architecture отличается от Cloud Reference Architecture?

Enterprise рассчитана на кластеры менее примерно 1000 GPU на коммутации Cisco Silicon One N9300. Cloud — от примерно 1000 до более чем 100 000 GPU с фронтендом N9300 и бэкендом N9100 на NVIDIA Spectrum-X.

Что такое CVIS Toolkit?

Это инструментарий Cisco Validated Infrastructure Services для повторяемого provisioning и автоматической валидации кластера, с передачей заказчику отчёта о производительности и соответствии.

Когда появится Cisco Cloud Control?

Консоль управления запланирована на четвёртый календарный квартал 2026 года.

Подходит ли это для edge-инференса?

Нет, системы Supermicro в Secure AI Factory ориентированы на обучение моделей и рабочие нагрузки с триллионами параметров, а не на edge-инференс или оптимизацию.

Источник: servethehome.com