Логотип Alibaba Qwen

Запуск

Модель для сложного кода
От Alibaba Qwenqwen2.5-coder:32b32B параметров32K токенов контекстаApache 2.0

Открытая модель, которая по коду подбирается к закрытым: понимает контекст проекта, а не отдельный сниппет, и доводит задачу до рабочего диффа. Разумный потолок, если команда не хочет отдавать репозиторий наружу.

Конфигурации GPU для Qwen2.5 Coder 32B

Бенчмарки Qwen2.5 Coder 32B

по данным разработчика модели
Результаты Qwen2.5 Coder 32B в публичных бенчмарках
HumanEval92,7
MBPP90,2
LiveCodeBench31,4

Другие модели в закрытом контуре

FAQ

Частые вопросы про аренду Qwen2.5 Coder 32B

Какая видеокарта нужна для Qwen2.5 Coder 32B?

Минимальная конфигурация — 1x RTX5090: этого хватает примерно на 38 токенов в секунду. Для большего числа параллельных запросов и запаса по скорости берите 1x H200.

Сколько стоит аренда Qwen2.5 Coder 32B?

Час работы Qwen2.5 Coder 32B стоит от 110,18 ₽ до 754,84 ₽ в зависимости от выбранной конфигурации GPU. Оплата почасовая: вы платите за время работы сервера, а не за количество токенов.

Как обращаться к Qwen2.5 Coder 32B из своего кода?

После запуска вы получаете OpenAI-совместимый эндпоинт: подставьте выданный base_url в любой клиент OpenAI и указывайте модель qwen2.5-coder:32b. Менять код, написанный под OpenAI API, не нужно.

Данные остаются приватными?

Да. Qwen2.5 Coder 32B работает на выделенном GPU-сервере в закрытом контуре: запросы и ответы не уходят к вендору модели и не используются для обучения.

Какой контекст и лицензия у Qwen2.5 Coder 32B?

Qwen2.5 Coder 32B держит 32K токенов контекста за один запрос и распространяется под лицензией Apache 2.0 — модель можно использовать в коммерческих проектах на своих условиях хостинга.