Inference-сервис генерации изображений

Продукту нужен собственный API генерации изображений по тексту с предсказуемой стоимостью запроса, без привязки к внешнему провайдеру.

Как обычно решают такую задачу

Модель разворачивают за очередью запросов (например, через Triton или собственный FastAPI-сервис) на выделенной GPU.

Под стабильную нагрузку выбирают GPU с запасом памяти под батчинг нескольких запросов одновременно.

Масштабируют числом GPU по мере роста трафика — без предоплаты за железо, которое не используется в низкий сезон.

Частые вопросы

Как быстро запускается GPU?

Срок запуска зависит от модели GPU, их количества и наличия мощностей. Мы называем его при заявке вместе с ценой и конфигурацией.

Что входит в инстанс?

Готовая вычислительная инфраструктура: NVIDIA GPU, CUDA, драйверы, Docker, хранилище, сеть, SSH/API-доступ и техническая поддержка.

Как проходит оплата?

Безналичная оплата от юридического лица по договору: счёт, закрывающие документы, НДС где применимо. Порядок расчётов и стоимость фиксируем в коммерческом предложении.

Можно ли потом перейти на собственный сервер?

Да. Когда аренда перестаёт быть экономически выгодной при постоянной загрузке, QBS поставит и настроит собственный GPU-сервер.

Заявка

Скоро открываем приём заявок

Публикуем юридическую информацию об обработке персональных данных — форма появится сразу после этого.

Приём заявок скоро откроется

Мы готовим юридическую информацию об обработке персональных данных, поэтому форма пока недоступна. Загляните чуть позже.