Настольные AI-станции — новый класс устройств для локального искусственного интеллекта: NVIDIA DGX Spark и его партнёрские версии на суперчипе GB10 Grace Blackwell (ASUS Ascent GX10, HP ZGX Nano, Dell Pro Max GB10, Lenovo ThinkStation PGX, MSI EdgeXpert, Gigabyte AI TOP Atom) со 128 ГБ единой памяти и 1 PFLOPS FP4, NVIDIA DGX Station на GB300 с 784 ГБ памяти, а также мини-ПК и рабочие станции на AMD Ryzen AI Max+ 395 (HP Z2 Mini G1a, Beelink GTR9 Pro, GMKtec EVO-X2, Framework Desktop) со 128 ГБ памяти под Windows/Linux. Они запускают LLM до 70–200 млрд параметров, RAG, агентов и генерацию изображений прямо в офисе — без стойки, ЦОД и передачи данных в облако. Поставляем со склада в Москве и под заказ, помогаем с выбором под модель и число пользователей, настраиваем Ollama/vLLM/NIM. Наличие и цены обновляются ежедневно.
Вопросы по теме
Какую станцию выбрать для локальных LLM?
Для CUDA-экосистемы и максимальной скорости — NVIDIA DGX Spark или партнёрские GB10-станции (модели до 200 млрд параметров, дообучение до 70 млрд). Для x86 и Windows с обычными приложениями плюс ИИ — HP Z2 Mini G1a или мини-ПК на Ryzen AI Max+ 395 (128 ГБ, модели до 70–120 млрд в 4-bit). Для команды и обучения крупных моделей — DGX Station GB300 (784 ГБ).
Что значит «единая память 128 ГБ»?
CPU и GPU используют один пул LPDDR5x, и почти весь объём доступен модели — в отличие от видеокарт с 24–48 ГБ. Это позволяет загрузить модель 70B в FP8/4-bit целиком; пропускная способность ниже, чем у HBM, поэтому скорость генерации умеренная, но модели помещаются.
Можно ли объединить две станции?
GB10-станции соединяются напрямую через ConnectX-7 (200 Гбит/с) в узел на 256 ГБ — до 405 млрд параметров. Ryzen-станции объединяют по сети (llama.cpp RPC, распределённый vLLM) с меньшей эффективностью.
Сколько потребляет и шумит ли настольная AI-станция?
DGX Spark и GB10-аналоги — до 240 Вт от обычной розетки, тихие; DGX Station GB300 — уровень мощной рабочей станции; мини-ПК Ryzen AI Max+ — 120–140 Вт.
Какое ПО идёт в комплекте?
NVIDIA-станции — DGX OS (Ubuntu) с CUDA, NIM, NeMo, TensorRT-LLM, готовыми контейнерами NGC; AMD-станции — Windows 11 или Linux с ROCm, Ollama, LM Studio, vLLM устанавливаются за минуты. Поможем с развёртыванием и подбором моделей.
Есть ли гарантия и сервис в России?
Да — гарантия магазина и расширенная до 5 лет, замена и ремонт через наш сервис; для корпоративных партнёрских версий (HP, Dell, Lenovo) — вендорская поддержка по договору.