Собираем инфраструктуру для искусственного интеллекта любого масштаба — от настольной станции для одного разработчика до GPU-кластера на сотни ускорителей. В каталоге: эталонные системы NVIDIA DGX (Spark, Station, B200, B300, H200), HGX-платформы Supermicro, Dell, HPE и Lenovo на 4–8 GPU, ускорители NVIDIA Blackwell и Hopper (B200, H200 NVL, H100, L40S, RTX PRO 6000/5000 Blackwell), AMD Instinct MI300X/MI325X/MI355X и Radeon AI PRO, настольные AI-станции на GB10 (DGX Spark, ASUS Ascent GX10, HP ZGX Nano, Dell Pro Max GB10, Lenovo PGX) и мини-ПК на AMD Ryzen AI Max+ 395 со 128 ГБ памяти, а также сеть InfiniBand/Spectrum-X, NVLink-мосты, СХД NVMe и охлаждение. Считаем требования под вашу модель — размер, квантизацию, число пользователей — и даём конфигурацию с ценой, сроком и энергопотреблением.
По теме: Гайд по выбору → · GPU NVIDIA · GPU-платформы Supermicro · Серверы Dell · Серверы HPE · Весь каталог →
Настольный уровень — DGX Spark и GB10-станции (128 ГБ, 1 PFLOPS, до 200 млрд параметров), DGX Station GB300 (784 ГБ) и AMD Ryzen AI Max+ 395 (128 ГБ, x86): разработка, прототипы, локальные ассистенты для отдела. Серверный уровень — 2U/4U-серверы с 2–8 PCIe-ускорителями (H200 NVL, RTX PRO 6000, L40S, MI210): инференс в продакшене, дообучение, VDI. Кластерный уровень — HGX/DGX B200, B300, H200 с NVLink и InfiniBand NDR: обучение больших моделей, AI-фабрика.
NVIDIA DGX Spark и партнёрские версии (ASUS Ascent GX10, HP ZGX Nano G1n, Dell Pro Max GB10, Lenovo ThinkStation PGX, MSI EdgeXpert, Gigabyte AI TOP Atom) — суперчип GB10 Grace Blackwell, 128 ГБ единой памяти, 1 PFLOPS FP4, DGX OS с CUDA/NIM/NeMo; два устройства объединяются по ConnectX-7 в узел на 256 ГБ. AMD-альтернатива — HP Z2 Mini G1a, Beelink GTR9 Pro, GMKtec EVO-X2, Framework Desktop на Ryzen AI Max+ 395 с Radeon 8060S и 128 ГБ памяти под Windows/Linux с ROCm. Обе платформы запускают Llama 3.x 70B, Qwen, DeepSeek-дистилляты в 4-bit, RAG и агентов локально.
NVIDIA DGX B200 (8× B200, 1,4 ТБ HBM3e, 72 PFLOPS FP8), DGX B300 (2,3 ТБ), DGX H200 (1,1 ТБ) — эталон с ПО NVIDIA AI Enterprise. HGX-платформы партнёров: Supermicro SYS-421GE-NBRT-LCC (жидкостное охлаждение), SYS-A21GE-NBRT (10U воздушное), SYS-821GE-TNHR (HGX H100/H200), Dell PowerEdge XE9680, HPE ProLiant XD685, Lenovo ThinkSystem SR780a — тот же GPU-модуль с выбором CPU, дисков, сети и охлаждения. PCIe-серверы на 4–10 карт: Supermicro SYS-521GE-TNRT, SYS-421GE-TNRT, AS-4125GS-TNRT, Dell R760xa, HPE DL380a.
Blackwell: B200 и B300 SXM (в HGX/DGX), RTX PRO 6000 Blackwell (96 ГБ GDDR7, 600 Вт, Workstation/Max-Q/Server Edition), RTX PRO 5000/4500. Hopper: H200 NVL (141 ГБ HBM3e, PCIe, мосты NVLink до 4 карт), H100 SXM/PCIe, H100 NVL. Ada: L40S (48 ГБ, универсальный инференс и графика), L4 (компактный инференс). Ampere: A100 40/80 ГБ, A30, A10, A2 — проверенные б/у по выгодной цене. Подбираем форм-фактор под сервер, мосты NVLink, кабели питания и обдув.
AMD Instinct MI300X (192 ГБ HBM3), MI325X (256 ГБ HBM3E), MI355X/MI350X (288 ГБ HBM3E, CDNA 4, FP4) в 8-GPU OAM-платформах Supermicro AS-8125GS-TNMR2, AS-8126GS, Dell XE9680, HPE XD675 с Infinity Fabric; MI210 в PCIe. Для рабочих станций — Radeon AI PRO R9700 (32 ГБ, до 4 карт), для настольного ИИ — Ryzen AI Max+ 395. Стек ROCm 6/7 поддерживает PyTorch, vLLM, TensorFlow, Hugging Face, Triton.
Обучение на нескольких узлах требует InfiniBand NDR 400G (Quantum-2 QM9700) или Ethernet 400G с RoCE (NVIDIA Spectrum-X SN5600, Arista 7060X5, Cisco Nexus 9332D) — по 400G-порту на GPU и неблокирующую фабрику; DAC/AOC/трансиверы OSFP/QSFP-DD. Хранилище — NVMe-полки и параллельные ФС (WEKA, Lustre, GPFS) на 100–400G. Питание: 10–15 кВт на узел DGX B200, PDU 32–63 А, ИБП, жидкостное охлаждение (DLC) для плотных стоек. Проектируем стойку целиком.
Инференс LLM: память GPU ≥ размер модели в выбранной точности + 20–30 % на KV-кэш; для 70B в FP8 — 96–141 ГБ (RTX PRO 6000, H200 NVL), для 400B+ — 8× H200/B200. Дообучение LoRA: 1–2 карты по 80–96 ГБ. Обучение с нуля: кластер HGX с InfiniBand, размер по числу токенов и бюджету времени. RAG и агенты: CPU-память для векторной БД, GPU 24–48 ГБ для эмбеддингов и генерации. Генерация изображений/видео: RTX PRO 6000/5000, L40S. Пришлите задачу — посчитаем.
Новые DGX, HGX-серверы и станции поставляем под заказ из EU/US/CN за 3–8 недель с фиксацией цены в КП; ускорители H100/A100/L40S и платформы HGX A100/H100 доступны и с вторичного рынка после нагрузочных тестов (gpu-burn, тесты памяти, NVLink) с гарантией магазина. Помогаем с лицензиями NVIDIA AI Enterprise, развёртыванием NIM/vLLM/Ollama, обучением команды. Счёт с НДС и без, поставка под тендеры и в реестры.
Открыть каталог с фильтрами и ценами →