Логотип Alibaba Qwen

Аренда Qwen2.5 72B в закрытом контуре

Флагманская универсальная модель
От Alibaba Qwenqwen2.5:72b72B параметров16K токенов контекстаQwen License

Старшая Qwen: лучший на сегодня открытый универсал по совокупности задач и один из немногих, кто уверенно держит русский на уровне закрытых API. Требует карту от 80 ГБ и терпения к скорости.

Конфигурации GPU для Qwen2.5 72B

1x A100

Оптимально
~22 ток/сдо 3 потоков
121,08 ₽в час

1x H100

~35 ток/сдо 6 потоков
274,29 ₽в час
Выберите карту
VRAM
RAM
Storage
vCPU
CPU

Списание идёт по часам работы сервера.

Бенчмарки Qwen2.5 72B

по данным разработчика модели
Результаты Qwen2.5 72B в публичных бенчмарках
MMLU86,1
GSM8K95,8
HumanEval86,6

Другие модели в закрытом контуре

FAQ

Частые вопросы про аренду Qwen2.5 72B

Какая видеокарта нужна для Qwen2.5 72B?

Минимальная конфигурация — 1x A100: этого хватает примерно на 22 токенов в секунду. Для большего числа параллельных запросов и запаса по скорости берите 1x H100.

Сколько стоит аренда Qwen2.5 72B?

Час работы Qwen2.5 72B стоит от 121,08 ₽ до 274,29 ₽ в зависимости от выбранной конфигурации GPU. Оплата почасовая: вы платите за время работы сервера, а не за количество токенов.

Как обращаться к Qwen2.5 72B из своего кода?

После запуска вы получаете OpenAI-совместимый эндпоинт: подставьте выданный base_url в любой клиент OpenAI и указывайте модель qwen2.5:72b. Менять код, написанный под OpenAI API, не нужно.

Данные остаются приватными?

Да. Qwen2.5 72B работает на выделенном GPU-сервере в закрытом контуре: запросы и ответы не уходят к вендору модели и не используются для обучения.

Какой контекст и лицензия у Qwen2.5 72B?

Qwen2.5 72B держит 16K токенов контекста за один запрос и распространяется под лицензией Qwen License — модель можно использовать в коммерческих проектах на своих условиях хостинга.