Суверенное GPU-облако в России

8× A100 80GB SXM4
1 000 000 ₽/мес, выделенный сервер

NVLink + NVSwitch между 8 картами, 640 GB VRAM, root SSH. Полный контроль над железом. Оплата в рублях, документы для бухгалтерии.

152-ФЗSLA 99.9%ЦОД в России (Tier III)Данные в РФОплата в рубляхДоговор и закрывающие документы

Спецификация сервера

FLAGSHIP

8x A100 80GB SXM4

Полный выделенный сервер

Помесячно
1 000 000
Почасовая
4 200₽/ч
GPU8x NVIDIA A100 80GB SXM4
VRAM640 GB HBM2e
InterconnectNVLink 3.0 + NVSwitch (600 GB/s)
CPU2x Intel Xeon Gold 6338 (64 ядра)
RAM1 TB DDR4-3200 ECC
Storage2x 3.84 TB NVMe SSD
Network25 GbE
ДоступRoot SSH

1x A100 80GB

Одна карта для inference и fine-tuning

Помесячно
320 000
Почасовая
1 350₽/ч
GPUNVIDIA A100 80GB SXM4
VRAM80 GB HBM2e
FP16312 TFLOPS
ДоступRoot SSH
СофтUbuntu + CUDA 12 + PyTorch + vLLM
IPСтатический
Минимальная аренда — 1 деньОплата до предоставления доступа

Сравнение провайдеров

Почему компании переходят на 42gpu

42gpuYandex CloudSelectelЗарубеж (AWS/GCP)
8x A100 80GB / мес1 000 000 ₽~2 000 000+ ₽~1 500 000+ ₽Недоступно из РФ
1x A100 80GB / мес320 000 ₽~600 000+ ₽~400 000+ ₽Недоступно из РФ
Root-доступ
NVLink (SXM4)
Данные в РФ
Оплата в рублях
Риск отключения
Vendor lock-in

Преимущества

01

Суверенность

Сервер в российском ДЦ и оборудование под нашим управлением. Это снижает зависимость от зарубежных облачных провайдеров и упрощает локализацию данных.

02

Фиксированная цена в рублях

1 000 000 ₽ за 8x A100 в месяц — без наценок за конвертацию валюты, без скрытых платежей. Закрывающие документы для юрлиц.

03

Root-доступ

Полный SSH-доступ к серверу. Устанавливайте любой софт: vLLM, TensorRT, Docker, собственные пайплайны.

04

NVLink

8x A100 SXM4 с NVSwitch — 600 GB/s между GPU. Критично для обучения LLM, multi-GPU inference и tensor parallelism.

Калькулятор стоимости

Посчитайте стоимость и сравните с конкурентами

Период аренды30 дней
1 день30 дней90 дней
42gpu
320 000
помесячный тариф
Yandex Cloud
640 000
+320 000 ₽ переплата
Selectel
480 000
+160 000 ₽ переплата
Ваша экономия с 42gpu
до 320 000
по сравнению с Yandex Cloud за 30 дней

Производительность

Проверка производительности под вашу нагрузку

Throughput и задержка зависят от модели, точности весов, длины контекста, размера batch и параметров serving. Поэтому конфигурацию проверяем на воспроизводимом сценарии клиента.

Фиксируем конфигурацию

Модель, precision, tensor parallelism, runtime и лимиты памяти.

Повторяем workload

Одинаковые входные длины, output tokens, concurrency и параметры генерации.

Сохраняем результат

TTFT, inter-token latency, throughput, ошибки и использование памяти.

Совместимо сPyTorchvLLMCUDA 12TensorRTDockerSGLangDeepSpeedJAX

Модели

Подберите модель под доступную память и нагрузку

Собственный GPU-контур даёт контроль над моделью, runtime и данными. Требуемая конфигурация зависит от размера весов, precision, KV cache и профиля запросов.

DeepSeek V3.2

OPEN
685B MoE → 37B active

Сильная reasoning-модель. MIT-лицензия. Свободная коммерческая лицензия.

Нужна квантизация или более крупный контур

GLM-5

MOE
744B MoE → 40B active

MoE-модель от Zhipu AI. Обучена на Huawei Ascend — без NVIDIA-зависимости.

Нужна квантизация или более крупный контур

Qwen 3.5 397B

FLAGSHIP
397B MoE → 17B active

До 262K токенов нативного контекста. Apache 2.0. Сильна на длинных документах и reasoning.

8x A100 — FP8 deployment

Kimi K2.5

AGENTS
1T MoE → 32B active

Мультимодальная. Agent Swarm — 100 параллельных агентов.

Конфигурация рассчитывается отдельно

Mistral Large 3

OPEN
675B MoE → 41B active

Сильный универсал. Apache 2.0.

Нужна квантизация или более крупный контур

Llama 4 Maverick

META
400B+ MoE, 128 экспертов

Мультимодальная. 10M контекст (Scout).

Precision и контур проверяются отдельно
640 GB VRAM — расчёт, а не обещание «любой модели»

При подборе учитываем размер весов в выбранной точности, служебную память runtime, KV cache, tensor parallelism и требуемую длину контекста. Перед заказом подтверждаем конфигурацию тестовым запуском.

Подобрать модель

Частые вопросы

Начать работу

Обсудите проект с нами

Расскажите о задаче — подберём конфигурацию, подтвердим срок доступности и подготовим коммерческое предложение.

Написать в Telegram

@zakievbulat — ответим за 15 минут

24 часа
Подготовка КП
1 день
Минимальная аренда
Рубли
Оплата + документы
24/7
Поддержка
Готовы заказать?

Калькулятор и заявка на сервер за 30 секунд

Зарегистрируйтесь — попадёте сразу в калькулятор bare-metal-конфигураций (A100 80GB SXM4). Доступ предоставляется после согласования конфигурации, срока и оплаты.

  • Договор и УПД
  • 152-ФЗ, данные в РФ
  • Расчёт за 24 часа