Аренда и развёртывание GPU
GPUnex — это не только платформа для держателей GPU-пакетов, но и полнофункциональный маркетплейс GPU-вычислений для ИИ-инженеров, исследователей и компаний, которым нужен доступ к оборудованию корпоративного класса по требованию. Это руководство проведёт вас через весь процесс: подачу заявки на доступ к аренде, выбор модели GPU, выбор тарифного плана, развёртывание инстанса и подключение к нему.
Подайте заявку на доступ
Отправьте заявку арендатора с описанием варианта использования
Получите одобрение
Заявка рассматривается в течение 24-48 часов
Выберите GPU и разверните
Выберите оборудование, фреймворк и запустите инстанс
Подключитесь по SSH
Получите доступ к GPU-инстансу с полными правами root
Подайте заявку на доступ
Отправьте заявку арендатора с описанием варианта использования
Получите одобрение
Заявка рассматривается в течение 24-48 часов
Выберите GPU и разверните
Выберите оборудование, фреймворк и запустите инстанс
Подключитесь по SSH
Получите доступ к GPU-инстансу с полными правами root
Подача заявки на аренду
Доступ к аренде GPU требует одобренной заявки. Этот шаг верификации обеспечивает качество обслуживания для всех участников маркетплейса и помогает GPUnex подобрать подходящее оборудование для вашей нагрузки.
Пошаговые инструкции
-
Перейдите в раздел Аренды, нажав «Rent GPUs» в боковом меню, или перейдите на страницу Roles и выберите роль арендатора.
-
Нажмите «Apply to Rent GPUs», чтобы открыть форму заявки.
-
Заполните заявку с указанием следующих данных:
Личная / корпоративная информация:
- Полное имя (обязательно)
- Email-адрес (обязательно)
- Название компании (необязательно — индивидуальные заявители приветствуются)
Описание варианта использования:
- Описание задачи — опишите, для чего вы планируете использовать GPU-вычисления (например, обучение большой языковой модели, инференс, рендеринг, научное моделирование)
Требования к GPU:
- Предпочтительная модель GPU — выберите из доступных моделей (H100, A100, L40S, L4)
- Количество — сколько GPU вам нужно (одиночный GPU или конфигурации с несколькими GPU)
- Требования к VRAM — минимальный объём VRAM для вашей нагрузки
- Характер использования — непрерывное, пиковое или периодическое
- Предпочтительный регион — выберите предпочтительный регион дата-центра ЕС для минимальной задержки
Бюджет и сроки:
- Ориентировочный ежемесячный бюджет в USDC
- Сроки — когда вам нужно начать (немедленно, в течение недели, в течение месяца)
GPU Renter Application
-
Проверьте заявку на точность и полноту.
-
Нажмите «Submit», чтобы отправить заявку на рассмотрение.
Рассмотрение заявки
- Заявки рассматриваются в течение 24-48 часов в рабочие дни.
- Вы получите уведомление по email, когда заявка будет одобрена.
- После одобрения вы получаете полный доступ к маркетплейсу аренды GPU и можете немедленно разворачивать инстансы.
Доступные модели GPU
GPUnex предлагает линейку GPU NVIDIA для дата-центров, соответствующих различным требованиям к нагрузке и бюджетам.
NVIDIA H100 80GB
Самый мощный GPU для дата-центров для крупномасштабного обучения и исследований.
- 80 ГБ памяти HBM3
- Обучение и высокопроизводительный инференс
- До 8x multi-GPU с NVLink
NVIDIA A100 40/80GB
Отраслевой стандарт для обучения и файнтюнинга ИИ.
- 40-80 ГБ памяти HBM2e
- Обучение, инференс и файнтюнинг
- Конфигурации multi-GPU
NVIDIA L40S 48GB
Отлично подходит для рендеринга, инференса и обучения среднего масштаба.
- 48 ГБ памяти GDDR6
- Рендеринг и инференс
- Графика + вычисления
NVIDIA L4 24GB
Экономически эффективный для инференса, пакетной обработки и лёгкого обучения.
- 24 ГБ памяти GDDR6
- Инференс и пакетная обработка
- Лучшая стоимость за инференс
Конфигурации multi-GPU
Для нагрузок, требующих больше вычислительных ресурсов, чем может обеспечить один GPU, GPUnex поддерживает конфигурации multi-GPU:
- До 8x NVIDIA H100 GPU в одном узле
- Интерконнект NVLink для высокоскоростной связи между GPU внутри узла
- Сеть InfiniBand для многоузловых кластеров
- Идеально для распределённого обучения крупных моделей, крупномасштабного обслуживания инференса и исследований, требующих массивного параллелизма
Выбор подходящего GPU
Используйте следующие рекомендации для выбора подходящего оборудования:
- Обучение больших языковых моделей (>7B параметров): H100 80GB или A100 80GB, рекомендуется multi-GPU
- Файнтюнинг предобученных моделей: A100 40GB или A100 80GB в зависимости от размера модели
- Продакшен-инференс: L40S 48GB или L4 24GB для экономичного инференса; H100 для приложений, критичных к задержке
- Рендеринг и визуализация: L40S 48GB обеспечивает отличную графическую и вычислительную производительность
- Пакетная обработка и лёгкий инференс: L4 24GB обеспечивает лучшую стоимость за инференс для небольших моделей
Модели ценообразования
GPUnex предлагает три модели ценообразования для различных схем использования и бюджетных требований.
On-Demand
- Тарификация: посекундная, оплата только за использование
- Обязательства: отсутствуют — запуск и остановка в любое время
- Гибкость: полная гибкость мгновенного масштабирования вверх и вниз
- Лучше для: экспериментов, переменных нагрузок, краткосрочных проектов
Reserved
- Обязательство: дни, недели или месяцы
- Скидка: до 40% от цены On-Demand
- Мощности: гарантированы — ваш зарезервированный GPU всегда доступен в период обязательства
- Лучше для: длительных обучений, продакшен-инференса, предсказуемых нагрузок
Spot
- Скидка: до 70% от цены On-Demand
- Вытеснение: инстансы могут быть отозваны с 30-секундным предупреждением при пиковом спросе
- Авто-чекпоинт: система автоматически инициирует сохранение чекпоинта при уведомлении о вытеснении, минимизируя потери
- Лучше для: отказоустойчивых нагрузок, пакетной обработки, некритичных по времени задач обучения, экономных экспериментов
On-Demand
Посекундная оплата без обязательств. Запуск и остановка в любое время.
- Посекундная тарификация
- Без обязательств
- Полная гибкость масштабирования
- Лучше для экспериментов
Reserved
Обязательство на дни, недели или месяцы с существенной экономией.
- Скидка до 40%
- Гарантированные мощности
- Предсказуемые цены
- Лучше для продакшен-нагрузок
Spot
Глубоко дисконтированные инстансы, которые могут быть вытеснены при пиковом спросе.
- Скидка до 70%
- 30-секундное предупреждение о вытеснении
- Авто-чекпоинт при вытеснении
- Лучше для отказоустойчивых задач
Развёртывание инстанса
После одобрения заявки вы можете разворачивать GPU-инстансы из маркетплейса.
Пошаговые инструкции
-
Перейдите на GPU-маркетплейс из вашего дашборда.
-
Найдите и отфильтруйте доступный инвентарь по следующим критериям:
- Модель GPU (H100, A100, L40S, L4)
- VRAM (24 ГБ, 40 ГБ, 48 ГБ, 80 ГБ)
- Регион (выберите предпочтительный регион дата-центра ЕС)
- Ценовой диапазон (фильтр по почасовой ставке)
- Модель ценообразования (On-Demand, Reserved или Spot)
-
Выберите GPU из результатов поиска. Нажмите на объявление для просмотра полных деталей, включая спецификации, цены, доступность и расположение дата-центра.
-
Выберите программную среду. Выберите из предустановленных фреймворков или предоставьте свой:
Предустановленные фреймворки:
- PyTorch — последний стабильный релиз с поддержкой CUDA
- TensorFlow — последний стабильный релиз с GPU-ускорением
- JAX — высокопроизводительный ML-фреймворк
- Jupyter — среда JupyterLab с предустановленными распространёнными ML-библиотеками
Пользовательская среда:
- Предоставьте собственный Docker-образ из любого публичного или приватного реестра контейнеров
- Укажите URL образа и необходимые переменные окружения
Совет
Все инстансы поставляются с предустановленными PyTorch, TensorFlow, JAX или Jupyter. Вы также можете использовать собственный Docker-образ из любого публичного или приватного реестра контейнеров.
-
Настройте параметры инстанса:
- Имя инстанса (для вашего удобства)
- Публичный SSH-ключ (для безопасного доступа)
- Стартовый скрипт (необязательно — запускается автоматически при старте инстанса)
- Переменные окружения (необязательно)
-
Проверьте и разверните. Подтвердите выбор GPU, модель ценообразования, программную среду и конфигурацию. Нажмите «Deploy» для запуска инстанса.
-
Дождитесь подготовки. Ваш контейнер будет развёрнут, и SSH-подключение станет доступным в течение нескольких секунд после нажатия Deploy.
Подключение по SSH
После запуска инстанса вы получите данные для подключения на странице управления инстансом:
- IP-адрес, порт и имя пользователя указаны в панели деталей инстанса.
- Используйте приватный ключ, соответствующий публичному SSH-ключу, который вы указали при развёртывании.
- Вы получите root-доступ внутри контейнера.
Управление инстансом
Со страницы управления инстансом вы можете:
- Запустить / Остановить инстанс для приостановки тарификации (только On-Demand)
- Мониторить загрузку GPU, использование памяти и вычислительные метрики в реальном времени
- Просматривать логи работающих процессов
- Завершить инстанс, когда закончите работу
Постоянное хранилище
GPUnex предоставляет сетевое постоянное хранилище, независимое от жизненного цикла GPU-инстанса.
Ключевые особенности
- Сохраняется при перезапусках. Ваши данные остаются нетронутыми при остановке и перезапуске инстанса.
- Подключается к новым инстансам. Если вы завершите один инстанс и развернёте новый, вы можете подключить существующий том хранилища к новому инстансу. Все ваши данные, чекпоинты моделей, датасеты и код сохранены.
- Постоянство данных. Том хранилища существует до тех пор, пока вы явно не удалите его, независимо от того, что происходит с вычислительными инстансами.
Варианты использования постоянного хранилища
- Хранение обучающих датасетов, используемых в нескольких циклах обучения
- Сохранение чекпоинтов моделей для возобновления обучения после прерываний (особенно важно для Spot-инстансов)
- Поддержание репозиториев кода и сред разработки при смене инстансов
- Хранение логов экспериментов и результатов для долгосрочных исследовательских проектов
Получение помощи
Стандартная поддержка
Все арендаторы имеют доступ к системе поддержки GPUnex для решения технических вопросов, вопросов тарификации и общей помощи. Обратитесь через раздел поддержки в вашем дашборде.
Корпоративная поддержка
Корпоративные клиенты и команды с крупными развёртываниями получают дополнительную поддержку:
- Выделенный менеджер аккаунта с именным контактным лицом
- Приоритетная поддержка с ускоренным временем ответа
- Индивидуальные конфигурации кластеров, адаптированные под ваши конкретные требования к нагрузке
- Объёмные скидки для крупномасштабных развёртываний
- Гарантии SLA по аптайму и производительности
Нужно индивидуальное решение?
Для индивидуальных конфигураций кластеров, многоузловых развёртываний, соглашений о зарезервированных мощностях или корпоративного ценообразования наша команда продаж готова помочь. Будь то выделенный кластер H100 или индивидуальная настройка инфраструктуры — мы можем создать правильное решение для вашей нагрузки.
Связаться с отделом продаж для обсуждения ваших требований и получения персонального предложения.
Дальнейшие шаги
- Справочник по API — интегрируйте управление GPU GPUnex в свои скрипты и конвейеры автоматизации
- Как работают GPU-пакеты — узнайте об инвесторской стороне маркетплейса GPUnex
- Связаться с отделом продаж — свяжитесь с нами для корпоративных решений, индивидуальных конфигураций и объёмных скидок