ОБСУДИТЬ ПРОЕКТ
Cisco UCS GPU-серверы в Казахстане
NVIDIA GPU под проект

Серверные платформы
Cisco UCS

GPU-серверы Cisco UCS C480 ML M5, C240 M7, X-Fabric с NVIDIA H100, A100, L40S. Платформы UCS интегрируются с Cisco Intersight и UCS Manager.

Характеристики
модели
C480 MLM5
+ C240 M7, X-Fabric
GPU
до 8на узел
H100, A100, L40S
управление
Intersightcloud
+ UCS Manager
наличие
14-21день
сборка из Алматы
Платформа и компоненты

Платформа Cisco

Базовые конфигурации серверов Cisco под NVIDIA H100, H200, A100, L40S и B200. Под конкретную задачу состав CPU, RAM и хранилища подбираем индивидуально.

Шасси

Модельный ряд

  • Модели: UCS C480 ML M5, C240 M7, X-Series Fabric
  • Форм-фактор: 2U-4U rack или X-Fabric chassis
  • GPU: до 8x H100/H200/A100 SXM или PCIe
  • Питание: Platinum redundant
  • Охлаждение: воздух или жидкость (по запросу)
CPU и память

Вычислительная база

  • CPU: Intel Xeon Scalable Gen3-Gen4
  • RAM: до 6 TB DDR4/DDR5 ECC
  • Сокеты: 2-сокетная архитектура
  • DDR каналов: 8-12 на сокет
  • PCIe Gen5: для GPU и NIC
Хранилище и сеть

I/O подсистема

  • Хранилище: NVMe SSD до 24 устройств
  • Сеть: 2x 100GbE базовая
  • InfiniBand: NDR 400Gb опционально
  • RAID: аппаратный с BBU кэшем
  • USB/VGA: на передней панели для сервиса
Управление и поддержка

Что включено

  • Out-of-band: CIMC + Cisco Intersight cloud
  • ОС: Ubuntu 22.04, RHEL 9, Rocky Linux 9
  • Драйверы NVIDIA: CUDA 12.4+, cuDNN, NCCL
  • Стресс-тест:
  • Гарантия:

GPU-ускорители для сервера

Профессиональные GPU-ускорители NVIDIA для AI, инференса, рендеринга и научных вычислений. Сравните объём VRAM, bandwidth, TFLOPS и подберите GPU под вашу задачу.

Сравнение GPU-ускорителей NVIDIA в Казахстане по объёму VRAM, bandwidth, производительности FP16 для AI, обучения нейросетей, инференса LLM, рендеринга и HPC
МодельПамятьBandwidth, GB/sFP16, TFLOPS
dense
TDP, WОбласть применения
NVIDIA B200Blackwell192 GB HBM3e8.0 TB/s11251000WОбучение LLM, суперкомпьютерные кластеры
NVIDIA H200 NVLHopper141 GB HBM3e4.8 TB/s835600WPCIe-серверы, обучение и инференс LLM
NVIDIA H100 NVLHopper94 GB HBM33.94 TB/s835400WИнференс больших LLM, продакшн-сервинг
NVIDIA H200 SXMHopper141 GB HBM3e4.8 TB/s494700WГенеративный AI, большие языковые модели
NVIDIA H100 SXMHopper80 GB HBM33.35 TB/s494700WFine-tuning моделей, дата-центры
NVIDIA H100 PCIeHopper80 GB HBM32.0 TB/s378350WВысокопроизводительные вычисления, HPC
NVIDIA L40SAda48 GB GDDR6864 GB/s181350WГенерация изображений, мультимодальный AI
NVIDIA A100 PCIeAmpere80 GB HBM2e1.94 TB/s156300WРаспознавание образов, автоматизация
NVIDIA Tesla V100Volta32 GB HBM2900 GB/s125300WИнференс классических моделей, легаси-задачи
NVIDIA L40Ada48 GB GDDR6864 GB/s90.5300WОблачные вычисления, виртуальные десктопы
NVIDIA A40Ampere48 GB GDDR6696 GB/s74.8300WМедицина, фармацевтика, 3D-графика
NVIDIA L4Ada24 GB GDDR6300 GB/s6072WВидеонаблюдение, потоковая аналитика

Как мы работаем над проектом

Проектирование системы начинается с задачи, а не с перечня доступного оборудования. Заказчик не обязан заранее знать, какой именно GPU, процессор, объём памяти или тип сети ему нужен - это работа технического подбора.

Шаг 1
Задача или техническое задание

Вы описываете задачу или присылаете готовое техническое задание. Что планируется считать: обучение или дообучение модели, инференс, генеративные модели, RAG, компьютерное зрение, инженерные расчёты. Какой объём данных, какой режим работы, есть ли ограничения по размещению оборудования.

Задача заказчикаТехническое заданиеСпецификация
Шаг 2
Анализ нагрузки и архитектура решения

Разбираем профиль нагрузки и определяем архитектуру: требуется ли один узел или многоузловая система, какой класс GPU и сколько памяти GPU нужно под задачу, какая роль отводится процессору и системной памяти, как устроена топология PCIe и межGPU-соединение.

WorkloadGPU memoryPCIe / NVLinkSingle-node / multi-node
Шаг 3
Подбор платформы и компонентов

Под выбранную архитектуру подбирается серверная платформа и её наполнение: GPU, процессоры, оперативная память, подсистема хранения и сетевая часть. Отдельно учитываются требования платформы к электропитанию и охлаждению.

ComputeStorageNetworkingPower / Cooling
Шаг 4
Конфигурация, поставка и ввод в работу

Формируется итоговая конфигурация и коммерческое предложение. Далее - комплектация, сборка, тестирование и поставка оборудования. Условия и срок гарантии определяются производителем, конфигурацией оборудования и условиями конкретной поставки; срок поставки указывается в коммерческом предложении.

КонфигурацияКоммерческое предложениеПоставка
Применение

Когда выбирать Cisco

🏭

AI/ML enterprise

UCS C480 ML M5 8x V100/A100 - спецплатформа Cisco для ML. Интеграция с Cisco HyperFlex, vCenter и Intersight для мультиклаудного управления.

Inference и edge

UCS C240 M7 c 2-4x L40S или A100 PCIe. Подходит для production-инференса в существующей UCS-инфраструктуре клиента.

🔬

X-Series Fabric

X-Fabric композируемая инфраструктура - GPU как ресурс, выделяемый разным узлам по запросу. Уникальный для Cisco подход.

Почему Cisco

Cisco - один из топовых поставщиков серверной инфраструктуры в мире. Мы являемся официальным партнёром и собираем серверы из оригинальных компонентов с прямой гарантией от вендора. Все платформы проходят сертификацию NVIDIA для совместимости с последними поколениями GPU: H100, H200, B200, A100, L40S.

«Cisco - выбор крупного бизнеса и государственного сектора. Сертифицированная платформа, понятная гарантия и прогнозируемое поведение в production - то что нужно для долгосрочных проектов.» Технический директор GPUServer Kazakhstan

Под какие GPU собираем

  • NVIDIA H100 80GB SXM5/PCIe: топовое решение для обучения LLM
  • NVIDIA H200 141GB SXM5: увеличенная память для inference больших моделей
  • NVIDIA B200 192GB SXM: Blackwell - флагман для frontier-моделей (по запросу)
  • NVIDIA A100 80GB SXM4/PCIe: проверенная платформа для production
  • NVIDIA L40S 48GB: универсальная карта для inference и графики
  • NVIDIA L4 24GB: low-power для edge и видео

Сборка под задачу

Заказ начинается с интервью: обсуждаем модель которую планируете обучать или запускать в инференс, объёмы данных, требования к latency и доступности. Согласовываем спецификацию, фиксируем цену в KZT и начинаем сборку. Все компоненты заказываются у проверенных поставщиков Cisco. Цены: Цена по запросу за базовую конфигурацию Цена по запросу за топовый 8-GPU узел.

Кластеризация

Платформы Cisco проектируются для кластерной работы с InfiniBand NDR 400Gb fabric. Типичный проект кластера на 32 узла реализуется за 4-6 недель.

FAQ

Частые вопросы по Cisco

Чем Cisco отличается от других вендоров+
Cisco - один из топовых поставщиков серверов в мире. Сертифицированная платформа, прямая гарантия от вендора, доступ к глобальной системе поддержки. Под конкретную задачу мы сравниваем Cisco с другими брендами по TCO (стоимость владения), срокам поставки и характеристикам, чтобы подобрать оптимальное решение.
Какие GPU поддерживаются+
Платформы Cisco сертифицированы для NVIDIA H100, H200 (Hopper), B200 (Blackwell), A100 (Ampere), L40S и L4 (Ada Lovelace). По форм-факторам: SXM5 для топового NVLink-fabric, PCIe Gen5 для гибких конфигураций. Под конкретный workload подбираем количество GPU и форм-фактор.
Как происходит сборка и тестирование+
Все компоненты заказываются у проверенных поставщиков Cisco.
Какая гарантия и поддержка+
Для критичных production-нагрузок рекомендуем расширенный сервис.
Можно ли масштабировать до кластера+
Да. Платформы Cisco проектируются для кластерной работы с InfiniBand NDR 400Gb fabric. Мы строим кластеры от 2 до 64 узлов. Типичный проект кластера на 32 узла реализуется за 4-6 недель: согласование, сборка, монтаж в дата-центре, пуско-наладка с MLPerf-бенчмарками.
Сроки поставки серверов Cisco+
Одиночные узлы 1-4 GPU: 14-21 рабочий день. Серверы 8 GPU SXM: 21-28 дней включая сборку и стресс-тест. Кластерные решения 10+ узлов: 4-6 недель. Сроки зависят от наличия конкретных моделей шасси у дистрибьюторов.
СВЯЗАТЬСЯ

Обсудить проект

Расскажите о задаче - инженер подготовит оптимальную конфигурацию и расчёт окупаемости

Бесплатная консультация и подбор конфигурации
Ответ в течение 2 часов в рабочее время
NDA по запросу

Получить предложение

Заполните форму - мы свяжемся с вами

Или свяжитесь напрямую: +7 (701) 466-22-22 · WhatsApp