Inference-сервис генерации изображений
Продукту нужен собственный API генерации изображений по тексту с предсказуемой стоимостью запроса, без привязки к внешнему провайдеру.
Как обычно решают такую задачу
Модель разворачивают за очередью запросов (например, через Triton или собственный FastAPI-сервис) на выделенной GPU.
Под стабильную нагрузку выбирают GPU с запасом памяти под батчинг нескольких запросов одновременно.
Масштабируют числом GPU по мере роста трафика — без предоплаты за железо, которое не используется в низкий сезон.
Частые вопросы
Как быстро запускается GPU?
Срок запуска зависит от модели GPU, их количества и наличия мощностей. Мы называем его при заявке вместе с ценой и конфигурацией.
Что входит в инстанс?
Готовая вычислительная инфраструктура: NVIDIA GPU, CUDA, драйверы, Docker, хранилище, сеть, SSH/API-доступ и техническая поддержка.
Как проходит оплата?
Безналичная оплата от юридического лица по договору: счёт, закрывающие документы, НДС где применимо. Порядок расчётов и стоимость фиксируем в коммерческом предложении.
Можно ли потом перейти на собственный сервер?
Да. Когда аренда перестаёт быть экономически выгодной при постоянной загрузке, QBS поставит и настроит собственный GPU-сервер.
Заявка
Скоро открываем приём заявок
Публикуем юридическую информацию об обработке персональных данных — форма появится сразу после этого.
Приём заявок скоро откроется
Мы готовим юридическую информацию об обработке персональных данных, поэтому форма пока недоступна. Загляните чуть позже.