租用与部署 GPU
GPUnex 不仅仅是一个面向 GPU 套餐持有者的平台——它还是一个功能完善的 GPU 计算市场,面向需要按需访问企业级硬件的 AI 工程师、研究人员和公司。本指南将引导您完成整个流程:申请租户访问权限、选择 GPU 型号、选择定价方案、部署实例并连接到实例。
申请访问权限
提交包含用例详情的租户申请
获得批准
申请将在 24-48 小时内审核
选择 GPU 并部署
选择硬件、框架并启动您的实例
通过 SSH 连接
使用完整 root 权限访问您的 GPU 实例
申请访问权限
提交包含用例详情的租户申请
获得批准
申请将在 24-48 小时内审核
选择 GPU 并部署
选择硬件、框架并启动您的实例
通过 SSH 连接
使用完整 root 权限访问您的 GPU 实例
申请租户访问权限
GPU 租用访问需要经过批准的申请。此验证步骤确保所有市场参与者的服务质量,并帮助 GPUnex 为您的工作负载匹配合适的硬件。
分步说明
-
导航到租户部分,点击侧边栏中的**“Rent GPUs”,或前往角色页面**选择租户角色。
-
点击”Apply to Rent GPUs” 打开申请表。
-
填写申请表,提供以下详情:
个人/公司信息:
- 全名(必填)
- 电子邮箱(必填)
- 公司名称(可选——欢迎个人申请)
用例详情:
- 用例描述 — 描述您计划将 GPU 计算用于何处(例如训练大语言模型、运行推理工作负载、渲染、科学模拟)
GPU 需求:
- 首选 GPU 型号 — 从可用型号中选择(H100、A100、L40S、L4)
- 数量 — 您需要多少块 GPU(单 GPU 或多 GPU 配置)
- 显存需求 — 您的工作负载所需的最低显存
- 使用模式 — 持续、突发或周期性使用
- 首选区域 — 选择您首选的欧盟数据中心区域以获得最低延迟
预算和时间线:
- 预计每月预算(以 USDC 计)
- 时间线 — 何时需要开始(立即、一周内、一个月内)
GPU Renter Application
-
检查申请的准确性和完整性。
-
点击”Submit” 提交申请进行审核。
申请审核
- 申请将在工作日内 24-48 小时内审核。
- 申请获批后,您将收到电子邮件通知。
- 获批后,您将获得 GPU 租赁市场的完整访问权限,可以立即部署实例。
可用的 GPU 型号
GPUnex 提供多种 NVIDIA 数据中心 GPU,以匹配不同的工作负载需求和预算。
NVIDIA H100 80GB
用于大规模训练和研究的最强大数据中心 GPU。
- 80GB HBM3 显存
- 训练和高吞吐量推理
- 支持最多 8 块 NVLink 多 GPU
NVIDIA A100 40/80GB
AI 训练和微调的行业标准。
- 40-80GB HBM2e 显存
- 训练、推理和微调
- 支持多 GPU 配置
NVIDIA L40S 48GB
非常适合渲染、推理和中等规模训练。
- 48GB GDDR6 显存
- 渲染和推理
- 图形 + 计算
NVIDIA L4 24GB
适合推理、批处理和轻量训练的高性价比选择。
- 24GB GDDR6 显存
- 推理和批处理
- 最佳推理性价比
多 GPU 配置
对于单块 GPU 无法满足的计算需求,GPUnex 支持多 GPU 配置:
- 单节点最多 8 块 NVIDIA H100 GPU
- NVLink 互连,实现节点内 GPU 间的高带宽通信
- InfiniBand 网络,用于多节点集群
- 适用于大模型分布式训练、大规模推理服务和需要大规模并行处理的研究
选择合适的 GPU
使用以下指南选择合适的硬件:
- 大语言模型训练(>7B 参数): H100 80GB 或 A100 80GB,建议多 GPU 配置
- 微调预训练模型: A100 40GB 或 A100 80GB,取决于模型大小
- 生产推理服务: L40S 48GB 或 L4 24GB 实现高性价比推理;H100 用于延迟敏感型应用
- 渲染和可视化: L40S 48GB 提供优秀的图形和计算性能
- 批处理和轻量推理: L4 24GB 为较小模型提供最佳推理性价比
定价模式
GPUnex 提供三种定价模式,以适应不同的使用模式和预算需求。
按需
- 计费: 按秒计费,仅为使用量付费
- 承诺: 无——随时启动和停止
- 灵活性: 完全灵活,可即时扩容或缩容
- 最适合: 实验、可变工作负载、短期项目
预留
- 承诺: 数天、数周或数月
- 折扣: 按需定价最高可享 40% 折扣
- 容量: 有保障——在承诺期内您的预留 GPU 始终可用
- 最适合: 持续训练任务、生产推理、可预测的工作负载
竞价
- 折扣: 按需定价最高可享 70% 折扣
- 抢占: 当需求激增时,实例可能会在 30 秒预警后被回收
- 自动检查点: 系统在收到抢占通知时自动触发检查点保存,最大限度减少工作损失
- 最适合: 容错工作负载、批处理、非时间敏感的训练任务、注重预算的实验
按需
按秒付费,零承诺。随时启动和停止。
- 按秒计费
- 无需承诺
- 完全灵活扩缩
- 最适合实验
预留
承诺数天、数周或数月,享受显著折扣。
- 最高 40% 折扣
- 保障容量
- 可预测定价
- 最适合生产工作负载
竞价
深度折扣实例,需求激增时可能被抢占。
- 最高 70% 折扣
- 30 秒抢占预警
- 抢占时自动检查点
- 最适合容错任务
部署实例
租户申请获批后,您可以从市场部署 GPU 实例。
分步说明
-
从仪表板导航到 GPU 市场。
-
搜索和筛选可用库存,使用以下条件:
- GPU 型号(H100、A100、L40S、L4)
- 显存(24GB、40GB、48GB、80GB)
- 区域(选择您首选的欧盟数据中心位置)
- 价格范围(按每小时费率筛选)
- 定价模式(按需、预留或竞价)
-
从搜索结果中选择一块 GPU。 点击列表查看完整详情,包括规格、定价、可用性和数据中心位置。
-
选择您的软件环境。 从预配置的框架中选择或提供您自己的:
预装框架:
- PyTorch — 最新稳定版本,支持 CUDA
- TensorFlow — 最新稳定版本,支持 GPU 加速
- JAX — 高性能 ML 框架
- Jupyter — 预配置常用 ML 库的 JupyterLab 环境
自定义环境:
- 提供来自任何公共或私有容器注册表的自定义 Docker 镜像
- 指定镜像 URL 和任何所需的环境变量
提示
所有实例都预装了 PyTorch、TensorFlow、JAX 或 Jupyter。您也可以从任何公共或私有容器注册表带入您自己的 Docker 镜像。
-
配置实例设置:
- 实例名称(供您参考)
- SSH 公钥(用于安全访问)
- 启动脚本(可选——实例启动时自动运行)
- 环境变量(可选)
-
检查并部署。 确认 GPU 选择、定价模式、软件环境和配置。点击**“Deploy”**启动您的实例。
-
等待配置。 您的容器将被部署,点击 Deploy 后几秒钟内即可获得 SSH 连接。
通过 SSH 连接
实例运行后,您将在实例管理页面上收到连接详情:
- 实例详情面板中提供了 IP 地址、端口和用户名。
- 使用与您部署时提供的 SSH 公钥对应的私钥。
- 您将在容器内拥有 root 访问权限。
管理您的实例
从实例管理页面,您可以:
- 启动/停止实例以暂停计费(仅限按需模式)
- 监控 GPU 利用率、内存使用和计算指标的实时数据
- 查看日志,了解您正在运行的进程
- 终止实例(使用完毕后)
持久化存储
GPUnex 提供网络附加持久化存储,独立于 GPU 实例的生命周期。
主要特点
- 重启后数据保留。 停止和重启实例时,您的数据保持完好。
- 可挂载到新实例。 如果您终止一个实例并部署新实例,可以将现有存储卷挂载到新实例。您的所有数据、模型检查点、数据集和代码都会保留。
- 数据持久性。 存储卷会一直存在,直到您明确删除它,与计算实例的状态无关。
持久化存储的使用场景
- 存储跨多次训练运行使用的训练数据集
- 保存模型检查点,以便在中断后恢复训练(对竞价实例尤其重要)
- 在实例切换之间维护代码仓库和开发环境
- 保留长期研究项目的实验日志和结果
获取帮助
标准支持
所有租户都可以访问 GPUnex 支持系统,解决技术问题、计费问题和一般咨询。通过仪表板中的支持部分联系我们。
企业支持
企业客户和拥有更大部署规模的团队可获得额外支持:
- 专属客户经理,提供指定联系人
- 优先支持,响应时间更快
- 自定义集群配置,根据您的特定工作负载需求定制
- 批量定价,适用于大规模部署
- SLA 保障,确保正常运行时间和性能
需要定制方案?
对于自定义集群配置、多节点部署、预留容量协议或企业定价,我们的销售团队随时准备为您提供帮助。无论您需要专用 H100 集群还是定制化基础设施方案,我们都可以为您的工作负载打造合适的解决方案。
联系销售 讨论您的需求并获取个性化报价。
下一步
- API 参考文档 — 将 GPUnex GPU 管理集成到您的脚本和自动化流程中
- GPU 套餐运作方式 — 了解 GPUnex 市场的投资者端
- 联系销售 — 获取企业解决方案、自定义配置和批量定价