GPU для fine-tuning LLM

Дообучайте языковые модели на своих данных без покупки сервера: арендуйте H100 или H200 на нужный срок.

Fine-tuning — типичная задача с пиковой нагрузкой: несколько дней интенсивных вычислений, затем простой. Покупать под это сервер за миллионы рублей невыгодно.

Для LoRA/QLoRA моделей 7–34B обычно хватает одной GPU с 80 ГБ памяти. Для полного fine-tuning и моделей 70B+ понадобится больше памяти на GPU (H200, 141 ГБ) или несколько GPU.

Инфраструктура приходит с CUDA, драйверами NVIDIA и Docker. Можно запускать привычные стеки: PyTorch, Transformers, Axolotl, Unsloth, DeepSpeed. Конфигурацию под вашу модель и объём данных подбираем по запросу.

Частые вопросы

Как быстро запускается GPU?

Срок запуска зависит от модели GPU, их количества и наличия мощностей. Мы называем его при заявке вместе с ценой и конфигурацией.

Что входит в инстанс?

Готовая вычислительная инфраструктура: NVIDIA GPU, CUDA, драйверы, Docker, хранилище, сеть, SSH/API-доступ и техническая поддержка.

Как проходит оплата?

Безналичная оплата от юридического лица по договору: счёт, закрывающие документы, НДС где применимо. Порядок расчётов и стоимость фиксируем в коммерческом предложении.

Можно ли потом перейти на собственный сервер?

Да. Когда аренда перестаёт быть экономически выгодной при постоянной загрузке, QBS поставит и настроит собственный GPU-сервер.

Заявка

Скоро открываем приём заявок

Публикуем юридическую информацию об обработке персональных данных — форма появится сразу после этого.

Приём заявок скоро откроется

Мы готовим юридическую информацию об обработке персональных данных, поэтому форма пока недоступна. Загляните чуть позже.