GPUnex
GPU Rental 7 分钟阅读

租用与部署 GPU

如何申请成为租户、选择 GPU 型号、部署实例并通过 SSH 连接到 GPUnex 市场。

租用与部署 GPU

GPUnex 不仅仅是一个面向 GPU 套餐持有者的平台——它还是一个功能完善的 GPU 计算市场,面向需要按需访问企业级硬件的 AI 工程师、研究人员和公司。本指南将引导您完成整个流程:申请租户访问权限、选择 GPU 型号、选择定价方案、部署实例并连接到实例。

1

申请访问权限

提交包含用例详情的租户申请

2

获得批准

申请将在 24-48 小时内审核

3

选择 GPU 并部署

选择硬件、框架并启动您的实例

4

通过 SSH 连接

使用完整 root 权限访问您的 GPU 实例


申请租户访问权限

GPU 租用访问需要经过批准的申请。此验证步骤确保所有市场参与者的服务质量,并帮助 GPUnex 为您的工作负载匹配合适的硬件。

分步说明

  1. 导航到租户部分,点击侧边栏中的**“Rent GPUs”,或前往角色页面**选择租户角色。

  2. 点击”Apply to Rent GPUs” 打开申请表。

  3. 填写申请表,提供以下详情:

    个人/公司信息:

    • 全名(必填)
    • 电子邮箱(必填)
    • 公司名称(可选——欢迎个人申请)

    用例详情:

    • 用例描述 — 描述您计划将 GPU 计算用于何处(例如训练大语言模型、运行推理工作负载、渲染、科学模拟)

    GPU 需求:

    • 首选 GPU 型号 — 从可用型号中选择(H100、A100、L40S、L4)
    • 数量 — 您需要多少块 GPU(单 GPU 或多 GPU 配置)
    • 显存需求 — 您的工作负载所需的最低显存
    • 使用模式 — 持续、突发或周期性使用
    • 首选区域 — 选择您首选的欧盟数据中心区域以获得最低延迟

    预算和时间线:

    • 预计每月预算(以 USDC 计)
    • 时间线 — 何时需要开始(立即、一周内、一个月内)
app.gpunex.com/roles/renter

GPU Renter Application

Jane Smith
AI Research Lab
Training a 7B parameter LLM for domain-specific NLP tasks…
A100 80GB
4
$5,000
  1. 检查申请的准确性和完整性。

  2. 点击”Submit” 提交申请进行审核。

申请审核

  • 申请将在工作日内 24-48 小时内审核。
  • 申请获批后,您将收到电子邮件通知。
  • 获批后,您将获得 GPU 租赁市场的完整访问权限,可以立即部署实例。

可用的 GPU 型号

GPUnex 提供多种 NVIDIA 数据中心 GPU,以匹配不同的工作负载需求和预算。

高需求

NVIDIA H100 80GB

用于大规模训练和研究的最强大数据中心 GPU。

  • 80GB HBM3 显存
  • 训练和高吞吐量推理
  • 支持最多 8 块 NVLink 多 GPU
高需求

NVIDIA A100 40/80GB

AI 训练和微调的行业标准。

  • 40-80GB HBM2e 显存
  • 训练、推理和微调
  • 支持多 GPU 配置

NVIDIA L40S 48GB

非常适合渲染、推理和中等规模训练。

  • 48GB GDDR6 显存
  • 渲染和推理
  • 图形 + 计算

NVIDIA L4 24GB

适合推理、批处理和轻量训练的高性价比选择。

  • 24GB GDDR6 显存
  • 推理和批处理
  • 最佳推理性价比

多 GPU 配置

对于单块 GPU 无法满足的计算需求,GPUnex 支持多 GPU 配置:

  • 单节点最多 8 块 NVIDIA H100 GPU
  • NVLink 互连,实现节点内 GPU 间的高带宽通信
  • InfiniBand 网络,用于多节点集群
  • 适用于大模型分布式训练、大规模推理服务和需要大规模并行处理的研究

选择合适的 GPU

使用以下指南选择合适的硬件:

  • 大语言模型训练(>7B 参数): H100 80GB 或 A100 80GB,建议多 GPU 配置
  • 微调预训练模型: A100 40GB 或 A100 80GB,取决于模型大小
  • 生产推理服务: L40S 48GB 或 L4 24GB 实现高性价比推理;H100 用于延迟敏感型应用
  • 渲染和可视化: L40S 48GB 提供优秀的图形和计算性能
  • 批处理和轻量推理: L4 24GB 为较小模型提供最佳推理性价比

定价模式

GPUnex 提供三种定价模式,以适应不同的使用模式和预算需求。

按需

  • 计费: 按秒计费,仅为使用量付费
  • 承诺: 无——随时启动和停止
  • 灵活性: 完全灵活,可即时扩容或缩容
  • 最适合: 实验、可变工作负载、短期项目

预留

  • 承诺: 数天、数周或数月
  • 折扣: 按需定价最高可享 40% 折扣
  • 容量: 有保障——在承诺期内您的预留 GPU 始终可用
  • 最适合: 持续训练任务、生产推理、可预测的工作负载

竞价

  • 折扣: 按需定价最高可享 70% 折扣
  • 抢占: 当需求激增时,实例可能会在 30 秒预警后被回收
  • 自动检查点: 系统在收到抢占通知时自动触发检查点保存,最大限度减少工作损失
  • 最适合: 容错工作负载、批处理、非时间敏感的训练任务、注重预算的实验

按需

按秒付费,零承诺。随时启动和停止。

  • 按秒计费
  • 无需承诺
  • 完全灵活扩缩
  • 最适合实验
推荐

预留

承诺数天、数周或数月,享受显著折扣。

  • 最高 40% 折扣
  • 保障容量
  • 可预测定价
  • 最适合生产工作负载

竞价

深度折扣实例,需求激增时可能被抢占。

  • 最高 70% 折扣
  • 30 秒抢占预警
  • 抢占时自动检查点
  • 最适合容错任务

部署实例

租户申请获批后,您可以从市场部署 GPU 实例。

分步说明

  1. 从仪表板导航到 GPU 市场。

  2. 搜索和筛选可用库存,使用以下条件:

    • GPU 型号(H100、A100、L40S、L4)
    • 显存(24GB、40GB、48GB、80GB)
    • 区域(选择您首选的欧盟数据中心位置)
    • 价格范围(按每小时费率筛选)
    • 定价模式(按需、预留或竞价)
  3. 从搜索结果中选择一块 GPU。 点击列表查看完整详情,包括规格、定价、可用性和数据中心位置。

  4. 选择您的软件环境。 从预配置的框架中选择或提供您自己的:

    预装框架:

    • PyTorch — 最新稳定版本,支持 CUDA
    • TensorFlow — 最新稳定版本,支持 GPU 加速
    • JAX — 高性能 ML 框架
    • Jupyter — 预配置常用 ML 库的 JupyterLab 环境

    自定义环境:

    • 提供来自任何公共或私有容器注册表的自定义 Docker 镜像
    • 指定镜像 URL 和任何所需的环境变量

提示

所有实例都预装了 PyTorch、TensorFlow、JAX 或 Jupyter。您也可以从任何公共或私有容器注册表带入您自己的 Docker 镜像。

  1. 配置实例设置:

    • 实例名称(供您参考)
    • SSH 公钥(用于安全访问)
    • 启动脚本(可选——实例启动时自动运行)
    • 环境变量(可选)
  2. 检查并部署。 确认 GPU 选择、定价模式、软件环境和配置。点击**“Deploy”**启动您的实例。

  3. 等待配置。 您的容器将被部署,点击 Deploy 后几秒钟内即可获得 SSH 连接。

通过 SSH 连接

实例运行后,您将在实例管理页面上收到连接详情:

终端
$
  • 实例详情面板中提供了 IP 地址、端口和用户名。
  • 使用与您部署时提供的 SSH 公钥对应的私钥。
  • 您将在容器内拥有 root 访问权限。

管理您的实例

从实例管理页面,您可以:

  • 启动/停止实例以暂停计费(仅限按需模式)
  • 监控 GPU 利用率、内存使用和计算指标的实时数据
  • 查看日志,了解您正在运行的进程
  • 终止实例(使用完毕后)

持久化存储

GPUnex 提供网络附加持久化存储,独立于 GPU 实例的生命周期。

主要特点

  • 重启后数据保留。 停止和重启实例时,您的数据保持完好。
  • 可挂载到新实例。 如果您终止一个实例并部署新实例,可以将现有存储卷挂载到新实例。您的所有数据、模型检查点、数据集和代码都会保留。
  • 数据持久性。 存储卷会一直存在,直到您明确删除它,与计算实例的状态无关。

持久化存储的使用场景

  • 存储跨多次训练运行使用的训练数据集
  • 保存模型检查点,以便在中断后恢复训练(对竞价实例尤其重要)
  • 在实例切换之间维护代码仓库和开发环境
  • 保留长期研究项目的实验日志和结果

获取帮助

标准支持

所有租户都可以访问 GPUnex 支持系统,解决技术问题、计费问题和一般咨询。通过仪表板中的支持部分联系我们。

企业支持

企业客户和拥有更大部署规模的团队可获得额外支持:

  • 专属客户经理,提供指定联系人
  • 优先支持,响应时间更快
  • 自定义集群配置,根据您的特定工作负载需求定制
  • 批量定价,适用于大规模部署
  • SLA 保障,确保正常运行时间和性能

需要定制方案?

对于自定义集群配置、多节点部署、预留容量协议或企业定价,我们的销售团队随时准备为您提供帮助。无论您需要专用 H100 集群还是定制化基础设施方案,我们都可以为您的工作负载打造合适的解决方案。

联系销售 讨论您的需求并获取个性化报价。


下一步