Аренда LLM в закрытом контуре

Открытые нейросети на GPU Qudata: плоская ставка за час вместо оплаты за токены.

Выберите модель — мы поднимем её на подходящей видеокарте с OpenAI-совместимым API. Данные и промпты не покидают арендованный сервер, лимитов на количество запросов нет, платите только за часы работы GPU.

Alibaba Qwen

Qwen2.5 7B

От Alibaba Qwen

Быстрая универсальная модель

Запуск на 1x V100~28 ток/с
Alibaba Qwen

Qwen2.5 32B

От Alibaba Qwen

Универсал для сложных задач

Запуск на 1x RTX5090~38 ток/с
Alibaba Qwen

Qwen2.5 72B

От Alibaba Qwen

Флагманская универсальная модель

Запуск на 1x A100~22 ток/с
Meta

Llama 3.1 8B

От Meta

Надёжная диалоговая модель

Запуск на 1x V100~28 ток/с
Meta

Llama 3.3 70B

От Meta

Флагман для сложных задач

Запуск на 1x A100~22 ток/с
Alibaba Qwen

Qwen2.5 Coder 7B

От Alibaba Qwen

Быстрый помощник для кода

Запуск на 1x V100~28 ток/с
Alibaba Qwen

Qwen2.5 Coder 32B

От Alibaba Qwen

Модель для сложного кода

Запуск на 1x RTX5090~38 ток/с
DeepSeek

DeepSeek-R1 7B

От DeepSeek

Компактная модель для рассуждений

Запуск на 1x V100~28 ток/с
DeepSeek

DeepSeek-R1 32B

От DeepSeek

Сильная модель для рассуждений

Запуск на 1x RTX5090~32 ток/с
DeepSeek

DeepSeek-R1 70B

От DeepSeek

Флагман для рассуждений

Запуск на 1x A100~22 ток/с
Mistral AI

Mistral 7B

От Mistral AI

Быстрая базовая модель

Запуск на 1x V100~28 ток/с
Mistral AI

Mixtral 8x7B

От Mistral AI

Быстрая MoE-модель

Запуск на 1x A100~55 ток/с
Google

Gemma 2 9B

От Google

Компактная модель для текстов

Запуск на 1x V100~28 ток/с
Google

Gemma 2 27B

От Google

Диалог и редактура

Запуск на 1x RTX5090~42 ток/с
Microsoft

Phi-4 14B

От Microsoft

Математика и рассуждения

Запуск на 1x RTX4090~55 ток/с