ИИ-серверы и комплектующие

Свой ИИ внутри компании, а не в чужом облаке

Поставляем оборудование для локального запуска языковых моделей: от настольного NVIDIA DGX Spark до стоечных GPU-серверов и сетей на 200 Гбит/с. Подбираем конфигурацию под конкретную модель и нагрузку, а не продаём коробку.

200 млрд
параметров модели локально
1 PFLOP
производительность FP4
0
данных за пределами контура
NVIDIA · в наличии и под заказ

NVIDIA DGX Spark

699 000 ₽
С НДС 22%. Партномер 940-54242-0006-000. Ниже среднерыночной цены в РФ.
  • Суперчип GB10 Grace Blackwell: 20 ядер Arm + GPU Blackwell
  • 128 ГБ унифицированной памяти LPDDR5x, 273 ГБ/с
  • 4 ТБ NVMe с аппаратным шифрованием
  • ConnectX-7 200 Гбит/с — две системы дают до 405 млрд параметров
  • Размер книги: 150 × 150 × 50,5 мм, 1,2 кг

Три уровня ИИ-инфраструктуры

Начинают обычно с настольной системы, а к стойке переходят, когда модель и нагрузка выросли. Мы поставляем весь путь целиком.

Рабочее место

Настольные ИИ-системы

NVIDIA DGX Spark на суперчипе GB10. Инференс моделей до 200 млрд параметров и дообучение до 70 млрд прямо на столе инженера. Полный стек NVIDIA AI из коробки.

NVIDIA DGX Spark — 699 000 ₽ →
GIGABYTE AI TOP ATOM — под заказ →

Стойка

GPU-серверы GIGABYTE и ASUS

Стоечные платформы под 4–8 ускорителей для обучения и продуктивной эксплуатации моделей. Подбираем под задачу: число GPU, объём видеопамяти, охлаждение и питание.

Связность

Сеть NVIDIA ConnectX и Mellanox

Адаптеры 200/400 Гбит/с InfiniBand и Ethernet, трансиверы и кабели QSFP. Без быстрой сети кластер из ускорителей упирается не в вычисления, а в обмен данными.

Зачем держать ИИ у себя

Четыре причины, по которым компании переносят языковые модели из облака в собственный контур.

1

Данные не покидают периметр

Договоры, переписка, база клиентов, медицинские и юридические документы обрабатываются внутри компании. Снимается главное возражение службы безопасности.

2

Предсказуемая стоимость

Разовая покупка вместо помесячной оплаты за токены. При постоянной нагрузке собственное оборудование окупается, и дальше нагрузка ничего не стоит.

3

Независимость от доступности сервисов

Локальная модель работает вне зависимости от того, что происходит с зарубежными облаками, платежами и лимитами доступа.

4

Своя модель под свою отрасль

Дообучение на собственных данных даёт результат, которого универсальная модель не покажет: отраслевая терминология, внутренние регламенты, специфика продукта.

Мы инженерная компания, а не коробочный магазин

Поставляем оборудование, проектируем и монтируем серверные, запускаем и настраиваем инфраструктуру. Работаем с юридическими лицами по счёту, с НДС, возможен лизинг.

Частые вопросы

Какую модель потянет DGX Spark

Инференс языковых моделей до 200 миллиардов параметров и дообучение моделей до 70 миллиардов. Две системы, соединённые через порты ConnectX-7 на 200 Гбит/с, поднимают потолок до 405 миллиардов параметров. Помогаем сопоставить вашу задачу с конфигурацией — напишите, какие модели планируете запускать.

Чем это отличается от обычной рабочей станции с видеокартой

В DGX Spark процессор и графический ускоритель работают с общей когерентной памятью на 128 ГБ. Модель не нужно дробить между оперативной и видеопамятью, поэтому помещаются модели, которые на обычной станции с дискретной видеокартой просто не запустятся. Плюс — тот же программный стек, что на серверах NVIDIA DGX, так что отлаженное решение переносится без переписывания.

Как оформляется покупка

Работаем с юридическими лицами и ИП по счёту, с НДС. Оставляете заявку — присылаем счёт и подтверждаем сроки поставки. Доступен лизинг. Онлайн-оплаты на сайте нет.

Поставляете по всей России

Да, доставка по всей территории РФ. Офис в Москве, Кутузовский проспект, 36, строение 4.

Помогаете с запуском и настройкой

Да. Помимо поставки выполняем проектирование и монтаж серверных, пусконаладку и настройку инфраструктуры. Объём работ обсуждаем под конкретный проект.

Что ещё нужно кроме самого устройства

Для одиночной системы — ничего, она работает от адаптера 240 Вт и подключается к обычной сети. Для связки двух систем или подключения к быстрой СХД нужны кабели или трансиверы QSFP56, а при переходе к кластеру — адаптеры ConnectX и коммутатор. Подберём комплект под ваш сценарий.

Расчёт конфигурации и счёт

Опишите задачу — подберём оборудование и пришлём коммерческое предложение. Отвечаем в рабочее время, обычно в течение часа.