8× A100 80GB SXM4
1 000 000 ₽/мес, выделенный сервер
NVLink + NVSwitch между 8 картами, 640 GB VRAM, root SSH. Полный контроль над железом. Оплата в рублях, документы для бухгалтерии.
Спецификация сервера
8x A100 80GB SXM4
Полный выделенный сервер
1x A100 80GB
Одна карта для inference и fine-tuning
Сравнение провайдеров
Почему компании переходят на 42gpu
| 42gpu | Yandex Cloud | Selectel | Зарубеж (AWS/GCP) | |
|---|---|---|---|---|
| 8x A100 80GB / мес | 1 000 000 ₽ | ~2 000 000+ ₽ | ~1 500 000+ ₽ | Недоступно из РФ |
| 1x A100 80GB / мес | 320 000 ₽ | ~600 000+ ₽ | ~400 000+ ₽ | Недоступно из РФ |
| Root-доступ | ||||
| NVLink (SXM4) | ||||
| Данные в РФ | ||||
| Оплата в рублях | ||||
| Риск отключения | ||||
| Vendor lock-in |
Преимущества
Суверенность
Сервер в российском ДЦ и оборудование под нашим управлением. Это снижает зависимость от зарубежных облачных провайдеров и упрощает локализацию данных.
Фиксированная цена в рублях
1 000 000 ₽ за 8x A100 в месяц — без наценок за конвертацию валюты, без скрытых платежей. Закрывающие документы для юрлиц.
Root-доступ
Полный SSH-доступ к серверу. Устанавливайте любой софт: vLLM, TensorRT, Docker, собственные пайплайны.
NVLink
8x A100 SXM4 с NVSwitch — 600 GB/s между GPU. Критично для обучения LLM, multi-GPU inference и tensor parallelism.
Калькулятор стоимости
Посчитайте стоимость и сравните с конкурентами
Производительность
Проверка производительности под вашу нагрузку
Throughput и задержка зависят от модели, точности весов, длины контекста, размера batch и параметров serving. Поэтому конфигурацию проверяем на воспроизводимом сценарии клиента.
Фиксируем конфигурацию
Модель, precision, tensor parallelism, runtime и лимиты памяти.
Повторяем workload
Одинаковые входные длины, output tokens, concurrency и параметры генерации.
Сохраняем результат
TTFT, inter-token latency, throughput, ошибки и использование памяти.
Модели
Подберите модель под доступную память и нагрузку
Собственный GPU-контур даёт контроль над моделью, runtime и данными. Требуемая конфигурация зависит от размера весов, precision, KV cache и профиля запросов.
DeepSeek V3.2
OPENСильная reasoning-модель. MIT-лицензия. Свободная коммерческая лицензия.
GLM-5
MOEMoE-модель от Zhipu AI. Обучена на Huawei Ascend — без NVIDIA-зависимости.
Qwen 3.5 397B
FLAGSHIPДо 262K токенов нативного контекста. Apache 2.0. Сильна на длинных документах и reasoning.
Kimi K2.5
AGENTSМультимодальная. Agent Swarm — 100 параллельных агентов.
Mistral Large 3
OPENСильный универсал. Apache 2.0.
Llama 4 Maverick
METAМультимодальная. 10M контекст (Scout).
При подборе учитываем размер весов в выбранной точности, служебную память runtime, KV cache, tensor parallelism и требуемую длину контекста. Перед заказом подтверждаем конфигурацию тестовым запуском.
Частые вопросы
Обсудите проект с нами
Расскажите о задаче — подберём конфигурацию, подтвердим срок доступности и подготовим коммерческое предложение.
Написать в Telegram@zakievbulat — ответим за 15 минут
Калькулятор и заявка на сервер за 30 секунд
Зарегистрируйтесь — попадёте сразу в калькулятор bare-metal-конфигураций (A100 80GB SXM4). Доступ предоставляется после согласования конфигурации, срока и оплаты.
- Договор и УПД
- 152-ФЗ, данные в РФ
- Расчёт за 24 часа