ИИ-суперкомпьютер, который стоит на столе

NVIDIA DGX Spark даёт команде 128 ГБ памяти под языковые модели и работает от обычной розетки. Данные при этом не покидают вашу сеть.

Поставляем в Казахстан. Ближайшая партия в пути
128 ГБединой памяти CPU и GPU
200 млрдпараметров — инференс локально
1 ПФЛОПСпроизводительности в FP4
1,2 кгкорпус 150 × 150 × 50,5 мм

Знакомая история

Команда решает запустить ИИ-проект — и упирается в инфраструктуру раньше, чем в задачу.

  • Нужная модель не помещается в память видеокарты.
  • Облако подходит не всем: служба безопасности против выгрузки данных наружу, а счёт за GPU растёт каждый месяц, пока идут эксперименты.
  • Закупка сервера — это стойка, питание, охлаждение, тендер и месяцы ожидания.

В итоге проект не стартует вообще. DGX Spark закрывает этот разрыв: устройство ставится на стол, включается в розетку и сразу даёт инженерам среду, в которой можно работать всерьёз.

128 ГБ, которые меняют арифметику

Главный аргумент — не петафлопс, а память. При работе с языковыми моделями потолок задаёт объём: модель либо помещается целиком, либо нет.

Игровая видеокарта24–32 ГБ VRAM
крупные модели не помещаются
NVIDIA DGX Spark128 ГБ единой памяти
до 200 млрд
инференс до 200 млрд параметров, дообучение — до 70 млрд
Два DGX Spark256 ГБ, ConnectX-7
инференс до 405 млрд параметров

Память общая для процессора и графического ядра — копировать данные между ними не нужно. Пропускная способность — 273 ГБ/с.

Данные никуда не уходят

Всё, с чем работает модель, остаётся на устройстве: 4 ТБ NVMe с аппаратным самошифрованием, никаких обращений к внешним API.

Для банков, госсектора, телекома и нефтегазовых компаний это часто не преимущество, а условие, без которого проект не согласуют вовсе.

Пилот сегодня — продакшен без переписывания кода

Предустановлены DGX OS и полный стек NVIDIA AI: фреймворки, библиотеки, SDK и предобученные модели. Это то же окружение, что в серверных системах DGX и в облаке.

Команда проверяет гипотезу на столе, показывает работающий результат бизнесу — и только после этого компания вкладывается в инфраструктуру.

Где это работает

Банки и финтех

Ассистент по внутренним регламентам и договорам, который не выносит документы за периметр.

Промышленность и нефтегаз

Компьютерное зрение: разметка, обучение на собственных снимках, тесты до вывода в цех. Работает и там, где интернет нестабилен.

Телеком и ритейл

Дообучение открытых моделей на своих данных — обращения, каталоги, логи — на казахском и русском.

Университеты и лаборатории

Рабочее место для курсов и исследований по ИИ вместо очереди к общему кластеру.

Интерфейсы

ConnectX-7 Smart NICДо 100 GbE. Связка двух устройств для моделей до 405 млрд параметров
10 GbE RJ-45Подключение к корпоративной сети обычным патч-кордом
4 × USB Type-CОдин порт занят питанием, три свободны для периферии
HDMI 2.1aПрямое подключение монитора, до 8K при 120 Гц с HDR
Wi-Fi 7 и Bluetooth 5.3Беспроводная работа без дополнительных адаптеров
4 ТБ NVMe M.2Аппаратное самошифрование: данные не покидают устройство

Характеристики

АрхитектураNVIDIA Grace Blackwell, суперчип GB10
GPUBlackwell: тензорные ядра 5-го поколения, RT-ядра 4-го поколения
CPU20 ядер Arm: 10 × Cortex-X925 и 10 × Cortex-A725
Производительность1 петафлопс (FP4, теоретическое значение с разрежённостью)
Память128 ГБ LPDDR5X, единая для CPU и GPU, шина 256 бит, 273 ГБ/с
Накопитель4 ТБ NVMe M.2 с аппаратным самошифрованием
СетьConnectX-7 Smart NIC до 100 GbE, 10 GbE RJ-45, Wi-Fi 7, Bluetooth 5.3
Интерфейсы4 × USB Type-C (один занят питанием), HDMI 2.1a — до 8K при 120 Гц с HDR
ОСDGX OS с полным стеком NVIDIA AI
Габариты и вес150 × 150 × 50,5 мм, 1,2 кг
КомплектСистема, блок питания, карта быстрого старта, карта поддержки
АксессуарыКабели DGX Spark Connect: NJAAK-N911, NJAAK-0006
Гарантия1 год

Технические характеристики носят предварительный характер и могут быть изменены производителем.

Частые вопросы

А не дешевле арендовать облако?

На коротком эксперименте — да. На длительной работе счета накапливаются, и в какой-то момент собственное устройство выходит выгоднее. Плюс облако не решает вопрос с данными. Поможем посчитать вашу точку окупаемости.

Может, хватит мощной видеокарты?

Если модель помещается в 24–32 ГБ — вполне. Если нет, никакая частота ядра не поможет: упор идёт в объём памяти.

Это замена серверу?

Нет, и мы говорим об этом прямо. DGX Spark не предназначен для обучения моделей с нуля и не заменяет обучающий кластер. Его работа — прототип, дообучение и инференс. Для промышленной нагрузки нужен сервер, и его мы тоже поставляем.

Сколько ждать поставку?

Мы уже возили DGX Spark в Казахстан, ближайшая партия в пути. Точные сроки под вашу заявку подтвердим в ответ на запрос.

Обсудим вашу задачу

Расскажите, что планируете запускать, — подберём конфигурацию, подтвердим сроки поставки и рассчитаем стоимость. Можем организовать демонстрацию устройства в работе.