GPUnex
GPU Rental 7 мин чтения

Аренда и развёртывание GPU

Как подать заявку на аренду, выбрать модель GPU, развернуть инстанс и подключиться по SSH на маркетплейсе GPUnex.

Аренда и развёртывание GPU

GPUnex — это не только платформа для держателей GPU-пакетов, но и полнофункциональный маркетплейс GPU-вычислений для ИИ-инженеров, исследователей и компаний, которым нужен доступ к оборудованию корпоративного класса по требованию. Это руководство проведёт вас через весь процесс: подачу заявки на доступ к аренде, выбор модели GPU, выбор тарифного плана, развёртывание инстанса и подключение к нему.

1

Подайте заявку на доступ

Отправьте заявку арендатора с описанием варианта использования

2

Получите одобрение

Заявка рассматривается в течение 24-48 часов

3

Выберите GPU и разверните

Выберите оборудование, фреймворк и запустите инстанс

4

Подключитесь по SSH

Получите доступ к GPU-инстансу с полными правами root


Подача заявки на аренду

Доступ к аренде GPU требует одобренной заявки. Этот шаг верификации обеспечивает качество обслуживания для всех участников маркетплейса и помогает GPUnex подобрать подходящее оборудование для вашей нагрузки.

Пошаговые инструкции

  1. Перейдите в раздел Аренды, нажав «Rent GPUs» в боковом меню, или перейдите на страницу Roles и выберите роль арендатора.

  2. Нажмите «Apply to Rent GPUs», чтобы открыть форму заявки.

  3. Заполните заявку с указанием следующих данных:

    Личная / корпоративная информация:

    • Полное имя (обязательно)
    • Email-адрес (обязательно)
    • Название компании (необязательно — индивидуальные заявители приветствуются)

    Описание варианта использования:

    • Описание задачи — опишите, для чего вы планируете использовать GPU-вычисления (например, обучение большой языковой модели, инференс, рендеринг, научное моделирование)

    Требования к GPU:

    • Предпочтительная модель GPU — выберите из доступных моделей (H100, A100, L40S, L4)
    • Количество — сколько GPU вам нужно (одиночный GPU или конфигурации с несколькими GPU)
    • Требования к VRAM — минимальный объём VRAM для вашей нагрузки
    • Характер использования — непрерывное, пиковое или периодическое
    • Предпочтительный регион — выберите предпочтительный регион дата-центра ЕС для минимальной задержки

    Бюджет и сроки:

    • Ориентировочный ежемесячный бюджет в USDC
    • Сроки — когда вам нужно начать (немедленно, в течение недели, в течение месяца)
app.gpunex.com/roles/renter

GPU Renter Application

Jane Smith
AI Research Lab
Training a 7B parameter LLM for domain-specific NLP tasks…
A100 80GB
4
$5,000
  1. Проверьте заявку на точность и полноту.

  2. Нажмите «Submit», чтобы отправить заявку на рассмотрение.

Рассмотрение заявки

  • Заявки рассматриваются в течение 24-48 часов в рабочие дни.
  • Вы получите уведомление по email, когда заявка будет одобрена.
  • После одобрения вы получаете полный доступ к маркетплейсу аренды GPU и можете немедленно разворачивать инстансы.

Доступные модели GPU

GPUnex предлагает линейку GPU NVIDIA для дата-центров, соответствующих различным требованиям к нагрузке и бюджетам.

Высокий спрос

NVIDIA H100 80GB

Самый мощный GPU для дата-центров для крупномасштабного обучения и исследований.

  • 80 ГБ памяти HBM3
  • Обучение и высокопроизводительный инференс
  • До 8x multi-GPU с NVLink
Высокий спрос

NVIDIA A100 40/80GB

Отраслевой стандарт для обучения и файнтюнинга ИИ.

  • 40-80 ГБ памяти HBM2e
  • Обучение, инференс и файнтюнинг
  • Конфигурации multi-GPU

NVIDIA L40S 48GB

Отлично подходит для рендеринга, инференса и обучения среднего масштаба.

  • 48 ГБ памяти GDDR6
  • Рендеринг и инференс
  • Графика + вычисления

NVIDIA L4 24GB

Экономически эффективный для инференса, пакетной обработки и лёгкого обучения.

  • 24 ГБ памяти GDDR6
  • Инференс и пакетная обработка
  • Лучшая стоимость за инференс

Конфигурации multi-GPU

Для нагрузок, требующих больше вычислительных ресурсов, чем может обеспечить один GPU, GPUnex поддерживает конфигурации multi-GPU:

  • До 8x NVIDIA H100 GPU в одном узле
  • Интерконнект NVLink для высокоскоростной связи между GPU внутри узла
  • Сеть InfiniBand для многоузловых кластеров
  • Идеально для распределённого обучения крупных моделей, крупномасштабного обслуживания инференса и исследований, требующих массивного параллелизма

Выбор подходящего GPU

Используйте следующие рекомендации для выбора подходящего оборудования:

  • Обучение больших языковых моделей (>7B параметров): H100 80GB или A100 80GB, рекомендуется multi-GPU
  • Файнтюнинг предобученных моделей: A100 40GB или A100 80GB в зависимости от размера модели
  • Продакшен-инференс: L40S 48GB или L4 24GB для экономичного инференса; H100 для приложений, критичных к задержке
  • Рендеринг и визуализация: L40S 48GB обеспечивает отличную графическую и вычислительную производительность
  • Пакетная обработка и лёгкий инференс: L4 24GB обеспечивает лучшую стоимость за инференс для небольших моделей

Модели ценообразования

GPUnex предлагает три модели ценообразования для различных схем использования и бюджетных требований.

On-Demand

  • Тарификация: посекундная, оплата только за использование
  • Обязательства: отсутствуют — запуск и остановка в любое время
  • Гибкость: полная гибкость мгновенного масштабирования вверх и вниз
  • Лучше для: экспериментов, переменных нагрузок, краткосрочных проектов

Reserved

  • Обязательство: дни, недели или месяцы
  • Скидка: до 40% от цены On-Demand
  • Мощности: гарантированы — ваш зарезервированный GPU всегда доступен в период обязательства
  • Лучше для: длительных обучений, продакшен-инференса, предсказуемых нагрузок

Spot

  • Скидка: до 70% от цены On-Demand
  • Вытеснение: инстансы могут быть отозваны с 30-секундным предупреждением при пиковом спросе
  • Авто-чекпоинт: система автоматически инициирует сохранение чекпоинта при уведомлении о вытеснении, минимизируя потери
  • Лучше для: отказоустойчивых нагрузок, пакетной обработки, некритичных по времени задач обучения, экономных экспериментов

On-Demand

Посекундная оплата без обязательств. Запуск и остановка в любое время.

  • Посекундная тарификация
  • Без обязательств
  • Полная гибкость масштабирования
  • Лучше для экспериментов
Рекомендуется

Reserved

Обязательство на дни, недели или месяцы с существенной экономией.

  • Скидка до 40%
  • Гарантированные мощности
  • Предсказуемые цены
  • Лучше для продакшен-нагрузок

Spot

Глубоко дисконтированные инстансы, которые могут быть вытеснены при пиковом спросе.

  • Скидка до 70%
  • 30-секундное предупреждение о вытеснении
  • Авто-чекпоинт при вытеснении
  • Лучше для отказоустойчивых задач

Развёртывание инстанса

После одобрения заявки вы можете разворачивать GPU-инстансы из маркетплейса.

Пошаговые инструкции

  1. Перейдите на GPU-маркетплейс из вашего дашборда.

  2. Найдите и отфильтруйте доступный инвентарь по следующим критериям:

    • Модель GPU (H100, A100, L40S, L4)
    • VRAM (24 ГБ, 40 ГБ, 48 ГБ, 80 ГБ)
    • Регион (выберите предпочтительный регион дата-центра ЕС)
    • Ценовой диапазон (фильтр по почасовой ставке)
    • Модель ценообразования (On-Demand, Reserved или Spot)
  3. Выберите GPU из результатов поиска. Нажмите на объявление для просмотра полных деталей, включая спецификации, цены, доступность и расположение дата-центра.

  4. Выберите программную среду. Выберите из предустановленных фреймворков или предоставьте свой:

    Предустановленные фреймворки:

    • PyTorch — последний стабильный релиз с поддержкой CUDA
    • TensorFlow — последний стабильный релиз с GPU-ускорением
    • JAX — высокопроизводительный ML-фреймворк
    • Jupyter — среда JupyterLab с предустановленными распространёнными ML-библиотеками

    Пользовательская среда:

    • Предоставьте собственный Docker-образ из любого публичного или приватного реестра контейнеров
    • Укажите URL образа и необходимые переменные окружения

Совет

Все инстансы поставляются с предустановленными PyTorch, TensorFlow, JAX или Jupyter. Вы также можете использовать собственный Docker-образ из любого публичного или приватного реестра контейнеров.

  1. Настройте параметры инстанса:

    • Имя инстанса (для вашего удобства)
    • Публичный SSH-ключ (для безопасного доступа)
    • Стартовый скрипт (необязательно — запускается автоматически при старте инстанса)
    • Переменные окружения (необязательно)
  2. Проверьте и разверните. Подтвердите выбор GPU, модель ценообразования, программную среду и конфигурацию. Нажмите «Deploy» для запуска инстанса.

  3. Дождитесь подготовки. Ваш контейнер будет развёрнут, и SSH-подключение станет доступным в течение нескольких секунд после нажатия Deploy.

Подключение по SSH

После запуска инстанса вы получите данные для подключения на странице управления инстансом:

Терминал
$
  • IP-адрес, порт и имя пользователя указаны в панели деталей инстанса.
  • Используйте приватный ключ, соответствующий публичному SSH-ключу, который вы указали при развёртывании.
  • Вы получите root-доступ внутри контейнера.

Управление инстансом

Со страницы управления инстансом вы можете:

  • Запустить / Остановить инстанс для приостановки тарификации (только On-Demand)
  • Мониторить загрузку GPU, использование памяти и вычислительные метрики в реальном времени
  • Просматривать логи работающих процессов
  • Завершить инстанс, когда закончите работу

Постоянное хранилище

GPUnex предоставляет сетевое постоянное хранилище, независимое от жизненного цикла GPU-инстанса.

Ключевые особенности

  • Сохраняется при перезапусках. Ваши данные остаются нетронутыми при остановке и перезапуске инстанса.
  • Подключается к новым инстансам. Если вы завершите один инстанс и развернёте новый, вы можете подключить существующий том хранилища к новому инстансу. Все ваши данные, чекпоинты моделей, датасеты и код сохранены.
  • Постоянство данных. Том хранилища существует до тех пор, пока вы явно не удалите его, независимо от того, что происходит с вычислительными инстансами.

Варианты использования постоянного хранилища

  • Хранение обучающих датасетов, используемых в нескольких циклах обучения
  • Сохранение чекпоинтов моделей для возобновления обучения после прерываний (особенно важно для Spot-инстансов)
  • Поддержание репозиториев кода и сред разработки при смене инстансов
  • Хранение логов экспериментов и результатов для долгосрочных исследовательских проектов

Получение помощи

Стандартная поддержка

Все арендаторы имеют доступ к системе поддержки GPUnex для решения технических вопросов, вопросов тарификации и общей помощи. Обратитесь через раздел поддержки в вашем дашборде.

Корпоративная поддержка

Корпоративные клиенты и команды с крупными развёртываниями получают дополнительную поддержку:

  • Выделенный менеджер аккаунта с именным контактным лицом
  • Приоритетная поддержка с ускоренным временем ответа
  • Индивидуальные конфигурации кластеров, адаптированные под ваши конкретные требования к нагрузке
  • Объёмные скидки для крупномасштабных развёртываний
  • Гарантии SLA по аптайму и производительности

Нужно индивидуальное решение?

Для индивидуальных конфигураций кластеров, многоузловых развёртываний, соглашений о зарезервированных мощностях или корпоративного ценообразования наша команда продаж готова помочь. Будь то выделенный кластер H100 или индивидуальная настройка инфраструктуры — мы можем создать правильное решение для вашей нагрузки.

Связаться с отделом продаж для обсуждения ваших требований и получения персонального предложения.


Дальнейшие шаги