Поставляем оборудование для локального запуска языковых моделей: от настольного NVIDIA DGX Spark до стоечных GPU-серверов и сетей на 200 Гбит/с. Подбираем конфигурацию под конкретную модель и нагрузку, а не продаём коробку.
Начинают обычно с настольной системы, а к стойке переходят, когда модель и нагрузка выросли. Мы поставляем весь путь целиком.
NVIDIA DGX Spark на суперчипе GB10. Инференс моделей до 200 млрд параметров и дообучение до 70 млрд прямо на столе инженера. Полный стек NVIDIA AI из коробки.
NVIDIA DGX Spark — 699 000 ₽ →
GIGABYTE AI TOP ATOM — под заказ →
Стоечные платформы под 4–8 ускорителей для обучения и продуктивной эксплуатации моделей. Подбираем под задачу: число GPU, объём видеопамяти, охлаждение и питание.
Адаптеры 200/400 Гбит/с InfiniBand и Ethernet, трансиверы и кабели QSFP. Без быстрой сети кластер из ускорителей упирается не в вычисления, а в обмен данными.
Четыре причины, по которым компании переносят языковые модели из облака в собственный контур.
Договоры, переписка, база клиентов, медицинские и юридические документы обрабатываются внутри компании. Снимается главное возражение службы безопасности.
Разовая покупка вместо помесячной оплаты за токены. При постоянной нагрузке собственное оборудование окупается, и дальше нагрузка ничего не стоит.
Локальная модель работает вне зависимости от того, что происходит с зарубежными облаками, платежами и лимитами доступа.
Дообучение на собственных данных даёт результат, которого универсальная модель не покажет: отраслевая терминология, внутренние регламенты, специфика продукта.
Поставляем оборудование, проектируем и монтируем серверные, запускаем и настраиваем инфраструктуру. Работаем с юридическими лицами по счёту, с НДС, возможен лизинг.
Инференс языковых моделей до 200 миллиардов параметров и дообучение моделей до 70 миллиардов. Две системы, соединённые через порты ConnectX-7 на 200 Гбит/с, поднимают потолок до 405 миллиардов параметров. Помогаем сопоставить вашу задачу с конфигурацией — напишите, какие модели планируете запускать.
В DGX Spark процессор и графический ускоритель работают с общей когерентной памятью на 128 ГБ. Модель не нужно дробить между оперативной и видеопамятью, поэтому помещаются модели, которые на обычной станции с дискретной видеокартой просто не запустятся. Плюс — тот же программный стек, что на серверах NVIDIA DGX, так что отлаженное решение переносится без переписывания.
Работаем с юридическими лицами и ИП по счёту, с НДС. Оставляете заявку — присылаем счёт и подтверждаем сроки поставки. Доступен лизинг. Онлайн-оплаты на сайте нет.
Да, доставка по всей территории РФ. Офис в Москве, Кутузовский проспект, 36, строение 4.
Да. Помимо поставки выполняем проектирование и монтаж серверных, пусконаладку и настройку инфраструктуры. Объём работ обсуждаем под конкретный проект.
Для одиночной системы — ничего, она работает от адаптера 240 Вт и подключается к обычной сети. Для связки двух систем или подключения к быстрой СХД нужны кабели или трансиверы QSFP56, а при переходе к кластеру — адаптеры ConnectX и коммутатор. Подберём комплект под ваш сценарий.