面向 AI 工作负载的企业级 NVIDIA GPU
几分钟内部署 H100、A100、L40S 和 L4 实例。按秒计费,无需承诺。预装 PyTorch、TensorFlow、JAX 和 Jupyter。SSH 访问秒级可用。
专为 AI 团队打造
无论您是在训练大型语言模型、运行实时推理,还是渲染 3D 内容——GPUnex 提供您所需的 GPU 算力,无需自行管理基础设施。我们的市场汇聚了 150+ 经验证数据中心的 GPU 供应,让您获得原本被大型云厂商多年合同锁定的算力资源。
可用 GPU 型号
经过自动化基准测试验证并部署在可信数据中心的企业级 NVIDIA GPU。
NVIDIA H100 80GB SXM
NVIDIA A100 80GB
NVIDIA A100 40GB
NVIDIA L40S 48GB
NVIDIA L4 24GB
GPU 性能对比
基于 FP16/BF16 吞吐量的相对性能。实际性能因工作负载类型而异。
适用于各类工作负载的 GPU 算力
从训练数十亿参数模型到渲染逼真场景——我们为您的任务提供合适的 GPU。
AI 模型训练
在多 GPU 集群上训练大型语言模型、计算机视觉模型和基础模型。我们的 H100 和 A100 GPU 配备 NVLink 和 InfiniBand 互联,提供分布式训练所需的大规模带宽。
AI 推理
部署模型进行低延迟、自动扩缩的生产推理。我们的 L40S 和 A100 GPU 专为高吞吐量推理工作负载优化。支持批量推理和实时服务。
3D 渲染
加速 Blender、OctaneRender、V-Ray 和其他 GPU 渲染工作流。我们的 L40S GPU 配备 48GB VRAM,可处理复杂场景和高分辨率输出,提供专用 GPU 访问。
科研与学术
Jupyter notebooks、SSH 访问和持久存储,适用于科研工作流。灵活的环境支持实验、原型设计和学术计算,按秒计费价格实惠。
批处理
使用容错 GPU 算力运行 ETL 管道、数据处理和批量计算工作负载。竞价实例为可中断工作负载提供大幅节省,支持自动检查点。
模型微调
使用 LoRA、QLoRA 和全量微调方法微调基础模型。预构建模板和环境让您几分钟内即可开始。持久存储确保您的模型检查点安全。
灵活定价
选择适合您工作负载的定价模式。无隐藏费用,没有意外。
按需
按秒付费,无最低承诺。保证可用性。非常适合可变工作负载和实验。随时启停。
- ✓ 无最低租用时长
- ✓ 按秒计费
- ✓ 保证可用性
- ✓ 完整 SSH 访问
预留
按天、周或月承诺使用,享受大幅折扣。保证算力和优先调度。适合生产工作负载。
- ✓ 最高 40% 折扣
- ✓ 保证算力
- ✓ 优先调度
- ✓ 灵活的承诺期限
竞价
以大幅折扣使用闲置 GPU 算力。30 秒抢占预警,支持自动检查点。非常适合批处理和容错工作负载。
- ✓ 最高节省 70%
- ✓ 30 秒抢占预警
- ✓ 自动检查点支持
- ✓ 自动重启
通过 3 个步骤开始
搜索与筛选
按型号、VRAM、区域和价格浏览可用 GPU。为您的工作负载找到最佳配置。
部署容器
使用预装框架或自定义 Docker 镜像启动实例。SSH 访问秒级可用。
按秒付费
透明的按秒计费,只为您使用的算力付费。无隐藏费用,无长期承诺。
多 GPU 集群
扩展至最多 8 个 H100 GPU 的集群,配备 NVLink 和 InfiniBand 互联,适用于分布式训练工作负载。我们的集群提供高效训练大型基础模型所需的带宽和低延迟通信。
- ✓ 每节点最多 8x H100 80GB SXM
- ✓ NVLink 节点内通信
- ✓ InfiniBand 节点间网络
- ✓ 专属集群管理