GPU для fine-tuning LLM
Дообучайте языковые модели на своих данных без покупки сервера: арендуйте H100 или H200 на нужный срок.
Fine-tuning — типичная задача с пиковой нагрузкой: несколько дней интенсивных вычислений, затем простой. Покупать под это сервер за миллионы рублей невыгодно.
Для LoRA/QLoRA моделей 7–34B обычно хватает одной GPU с 80 ГБ памяти. Для полного fine-tuning и моделей 70B+ понадобится больше памяти на GPU (H200, 141 ГБ) или несколько GPU.
Инфраструктура приходит с CUDA, драйверами NVIDIA и Docker. Можно запускать привычные стеки: PyTorch, Transformers, Axolotl, Unsloth, DeepSpeed. Конфигурацию под вашу модель и объём данных подбираем по запросу.
Частые вопросы
Как быстро запускается GPU?
Срок запуска зависит от модели GPU, их количества и наличия мощностей. Мы называем его при заявке вместе с ценой и конфигурацией.
Что входит в инстанс?
Готовая вычислительная инфраструктура: NVIDIA GPU, CUDA, драйверы, Docker, хранилище, сеть, SSH/API-доступ и техническая поддержка.
Как проходит оплата?
Безналичная оплата от юридического лица по договору: счёт, закрывающие документы, НДС где применимо. Порядок расчётов и стоимость фиксируем в коммерческом предложении.
Можно ли потом перейти на собственный сервер?
Да. Когда аренда перестаёт быть экономически выгодной при постоянной загрузке, QBS поставит и настроит собственный GPU-сервер.
Заявка
Скоро открываем приём заявок
Публикуем юридическую информацию об обработке персональных данных — форма появится сразу после этого.
Приём заявок скоро откроется
Мы готовим юридическую информацию об обработке персональных данных, поэтому форма пока недоступна. Загляните чуть позже.