Логотип Alibaba Qwen

Запуск

Флагманская универсальная модель
От Alibaba Qwenqwen2.5:72b72B параметров16K токенов контекстаQwen License

Старшая Qwen: лучший на сегодня открытый универсал по совокупности задач и один из немногих, кто уверенно держит русский на уровне закрытых API. Требует карту от 80 ГБ и терпения к скорости.

Конфигурации GPU для Qwen2.5 72B

Бенчмарки Qwen2.5 72B

по данным разработчика модели
Результаты Qwen2.5 72B в публичных бенчмарках
MMLU86,1
GSM8K95,8
HumanEval86,6

Другие модели в закрытом контуре

FAQ

Частые вопросы про аренду Qwen2.5 72B

Какая видеокарта нужна для Qwen2.5 72B?

Минимальная конфигурация — 1x A100: этого хватает примерно на 22 токенов в секунду. Для большего числа параллельных запросов и запаса по скорости берите 1x H200.

Сколько стоит аренда Qwen2.5 72B?

Час работы Qwen2.5 72B стоит от 186,75 ₽ до 754,84 ₽ в зависимости от выбранной конфигурации GPU. Оплата почасовая: вы платите за время работы сервера, а не за количество токенов.

Как обращаться к Qwen2.5 72B из своего кода?

После запуска вы получаете OpenAI-совместимый эндпоинт: подставьте выданный base_url в любой клиент OpenAI и указывайте модель qwen2.5:72b. Менять код, написанный под OpenAI API, не нужно.

Данные остаются приватными?

Да. Qwen2.5 72B работает на выделенном GPU-сервере в закрытом контуре: запросы и ответы не уходят к вендору модели и не используются для обучения.

Какой контекст и лицензия у Qwen2.5 72B?

Qwen2.5 72B держит 16K токенов контекста за один запрос и распространяется под лицензией Qwen License — модель можно использовать в коммерческих проектах на своих условиях хостинга.