Аренда LLM с почасовой оплатой за GPU

Открытые нейросети на выделенных GPU Qudata вместо оплаты за токены.

Выберите модель — мы поднимем её на подходящей видеокарте с OpenAI-совместимым API. Данные и промпты не покидают арендованный сервер, лимитов на количество запросов нет, платите только за часы работы GPU.

Alibaba Qwen

Qwen

От Alibaba Qwen

Основной мультимодальный универсал

Запуск на 1x RTX4060TI~34 ток/с
OpenAI

GPT-OSS

От OpenAI

Открытая reasoning-модель для агентов

Запуск на 1x RTX3090~27 ток/с
Z.ai

GLM

От Z.ai

Быстрый GLM для кода и агентов

Запуск на 1x RTX5090~52 ток/с
DeepSeek

DeepSeek

От DeepSeek

Сильная модель для рассуждений

Запуск на 1x RTX5090~32 ток/с
Google

Gemma

От Google

Компактная Gemma с vision

Запуск на 1x RTX3080TI~70 ток/с
Moonshot AI

Kimi

От Moonshot AI

Флагманский MoE для агентного кода

Запуск на 3x H200~19 ток/с
Meta

Llama

От Meta

Мультимодальный MoE с длинным контекстом

Запуск на 1x A100~28 ток/с
Mistral AI

Mistral

От Mistral AI

Точный мультимодальный универсал

Запуск на 1x RTX3090~24 ток/с
Microsoft

Phi

От Microsoft

Усиленная модель для рассуждений

Запуск на 1x RTX3090~36 ток/с
Agentica & Together AI

DeepCoder

От Agentica & Together AI

Reasoning-модель для программирования

Запуск на 1x RTX3090~36 ток/с