Продукт №1 — AI Inference API

Qwen 3.5 397B через API
в России

OpenAI-style Chat Completions API к Qwen 3.5 397B с общим контекстом 262144 токена. Меняешь base_url — твой код работает. Данные в РФ, оплата в рублях, 152-ФЗ.

OpenAI-style schema152-ФЗStreaming (SSE)Python SDKОплата в рублях

Модель

Qwen 3.5 397B — единственная публичная модель через canonical Chat Completions API

Qwen 3.5 397B

397B MoE (17B active) · контекст 262K · vision (текст + картинки + видео)

VisionFLAGSHIP

Welcome-кредит 1 000 ₽ при регистрации. Тарифы — на странице Цены.

Как начать

Три шага до первого запроса

01

Зарегистрируйтесь

Email + пароль. Сохраните выданный API-ключ.

02

Отправьте запрос

Используйте OpenAI SDK или любой HTTP-клиент.

python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.42gpu.ru/vllm/v1",
    api_key=os.environ["GPU42_API_KEY"]
)

response = client.chat.completions.create(
    model="Qwen/Qwen3.5-397B-A17B-FP8",
    messages=[{"role": "user", "content": "Привет!"}]
)
print(response.choices[0].message.content)
03

Масштабируйтесь

Пополняйте баланс и смотрите фактический token usage в дашборде.

Что внутри

Технические характеристики API

Модель
Qwen 3.5 397B (MoE, 17B активных)
Контекст
до 262 144 токенов
Модальности
Текст · изображения · видео
API
/vllm/v1/chat/completions
Streaming
Server-Sent Events (SSE)
Function calling
Поддержка в формате OpenAI
Лицензия
Apache 2.0 / Tongyi Qianwen
Размещение
Российский ЦОД Tier III
Compliance
152-ФЗ из коробки
Биллинг
Pay-as-you-go в рублях
Продукт №2

Нужен свой GPU-сервер?

8x A100 80GB SXM4 с NVLink — для обучения моделей, fine-tuning и production с полным контролем. Root SSH, любой софт. Тарифы — на странице GPU-серверов.

GPU-серверы →

Частые вопросы об API

Начните за 2 минуты

Зарегистрируйтесь, сохраните API-ключ и выполните первый запрос по Quickstart.

Вопросы? @zakievbulat в Telegram