GPU Cloud for AI

GPU для ИИ без покупки собственного сервера

Аренда NVIDIA H100, H200 и других GPU для обучения моделей, fine-tuning и inference. Подберём конфигурацию под задачу и срок проекта.

Рассчитать конфигурациюВыбрать GPU
A100 → B300линейка NVIDIA
По часам и на срок1 / 3 / 6 / 12 месяцев
SSH + APICUDA, драйверы, Docker
Договор с юрлицомНДС где применимо

Каталог

Выберите GPU под задачу

Модель GPU выбираете вы, число GPU, срок и цену подтверждаем при заявке в коммерческом предложении.

H10080 GB HBM3
LLMTrainingFine-tuning
По запросу
Конфигурация и срок запуска — по запросу.
Подробнее
H200141 GB HBM3e
Large LLMLong contextTraining
По запросу
Конфигурация и срок запуска — по запросу.
Подробнее
B200180 GB HBM3e
Frontier LLMTrainingHigh-throughput inference
По запросу
Конфигурация и срок запуска — по запросу.
Подробнее
B300288 GB HBM3e
Frontier LLMReasoning models
По запросу
Конфигурация и срок запуска — по запросу.
Подробнее
A10080 GB HBM2e
InferenceFine-tuningComputer Vision
По запросу
Конфигурация и срок запуска — по запросу.
Подробнее

Калькулятор

Сколько это будет стоить

Выберите модель, количество GPU и срок: подготовим расчёт под вашу задачу.

1× H100 · 80 GB HBM3 на GPU

Конфигурация и срок запуска — по запросу.

Стоимость
По запросу

Стоимость зависит от срока, количества GPU и доступности мощностей. Подготовим расчёт под вашу задачу и назовём цену и срок запуска.

Точная цена и условия — в коммерческом предложении.

Почему мы

Вычислительная мощность как сервис

Без CAPEX

Не нужно покупать GPU-сервер за миллионы рублей.

Быстрый запуск

Инфраструктура готова к работе: CUDA, драйверы, Docker.

Российский договор

Оплата от юридического лица, документы, НДС где применимо.

Масштабирование

Объём GPU подбираем под задачу: от одной GPU до выделенных серверов.

Один поставщик

GPU, storage, network и поддержка через одну компанию.

Можно перейти на своё железо

Когда аренда перестаёт быть выгодной, QBS поставит собственный сервер.

Задачи

Для чего берут GPU

Fine-tuning LLM

Дообучение моделей на ваших данных: LoRA, QLoRA, полный fine-tuning.

Inference

Продакшен-инференс LLM и мультимодальных моделей: vLLM, TGI, Triton.

LLM / Training

Предобучение и обучение больших моделей на многоGPU-серверах.

Computer Vision

Обучение и инференс моделей компьютерного зрения, видеоаналитика.

RAG

Эмбеддинги, реранкеры и генерация для корпоративного поиска.

Training

Обучение моделей с нуля и эксперименты с архитектурами.

AI Agents

Локальные модели для агентов: приватно и без лимитов API.

Stable Diffusion / Video

Генерация изображений и видео на собственных мощностях.

Research

Исследовательские проекты и бенчмарки на разных GPU.

Аренда или покупка

Что выгоднее для вашей нагрузки

Начните с аренды, проверьте задачу, а при постоянной высокой загрузке перейдите на собственный сервер.

Аренда

  • быстрый запуск: часы, а не месяцы поставки
  • нет CAPEX: платите только за использование
  • удобно для тестов и гипотез
  • удобно при переменной нагрузке

Покупка

  • постоянная высокая загрузка GPU
  • собственная инфраструктура и данные внутри периметра
  • долгий горизонт использования
  • сервер поставляет и настраивает QBS

Что выгоднее, зависит от загрузки GPU и горизонта использования.

Посчитаем аренду и покупку под вашу нагрузку: точку безубыточности, стоимость эксплуатации и сроки поставки сервера.

Dedicated GPU

Нужен целый сервер?

Выделенный сервер целиком под вашу задачу: без соседей по узлу. Конфигурация и срок запуска — по запросу.

Dedicated bare metal

H100 / H200 / B200

Число GPU под задачу

Регион и межсоединение под задачу

FAQ

Частые вопросы

Как быстро запускается GPU?

Срок запуска зависит от модели GPU, их количества и наличия мощностей. Мы называем его при заявке вместе с ценой и конфигурацией.

Что входит в инстанс?

Готовая вычислительная инфраструктура: NVIDIA GPU, CUDA, драйверы, Docker, хранилище, сеть, SSH/API-доступ и техническая поддержка.

Как проходит оплата?

Безналичная оплата от юридического лица по договору: счёт, закрывающие документы, НДС где применимо. Порядок расчётов и стоимость фиксируем в коммерческом предложении.

Можно ли потом перейти на собственный сервер?

Да. Когда аренда перестаёт быть экономически выгодной при постоянной загрузке, QBS поставит и настроит собственный GPU-сервер.

Заявка

Скоро открываем приём заявок

Публикуем юридическую информацию об обработке персональных данных — форма появится сразу после этого.

Приём заявок скоро откроется

Мы готовим юридическую информацию об обработке персональных данных, поэтому форма пока недоступна. Загляните чуть позже.