GPUnex
面向 AI 开发者与团队

面向 AI 工作负载的企业级 NVIDIA GPU

几分钟内部署 H100、A100、L40S 和 L4 实例。按秒计费,无需承诺。预装 PyTorch、TensorFlow、JAX 和 Jupyter。SSH 访问秒级可用。

2400+ GPUs Active
150+ Data Centers
99.9% Uptime
24/7 Live Support

专为 AI 团队打造

无论您是在训练大型语言模型、运行实时推理,还是渲染 3D 内容——GPUnex 提供您所需的 GPU 算力,无需自行管理基础设施。我们的市场汇聚了 150+ 经验证数据中心的 GPU 供应,让您获得原本被大型云厂商多年合同锁定的算力资源。

可用 GPU 型号

经过自动化基准测试验证并部署在可信数据中心的企业级 NVIDIA GPU。

高需求

NVIDIA H100 80GB SXM

80 GB HBM3
互联方式: NVLink + InfiniBand
大语言模型训练基础模型多GPU集群
有限

NVIDIA A100 80GB

80 GB HBM2e
互联方式: NVLink
AI训练推理科学计算
可用

NVIDIA A100 40GB

40 GB HBM2e
互联方式: NVLink
AI训练微调批处理
可用

NVIDIA L40S 48GB

48 GB GDDR6X
互联方式: PCIe Gen4
AI推理3D渲染视频处理
可用

NVIDIA L4 24GB

24 GB GDDR6
互联方式: PCIe Gen4
AI推理轻量训练边缘工作负载

GPU 性能对比

H100 80GB SXM
80 GB HBM3 高需求
A100 80GB
80 GB HBM2e 有限
L40S 48GB
48 GB GDDR6X 可用
A100 40GB
40 GB HBM2e 可用
L4 24GB
24 GB GDDR6 可用

基于 FP16/BF16 吞吐量的相对性能。实际性能因工作负载类型而异。

适用于各类工作负载的 GPU 算力

从训练数十亿参数模型到渲染逼真场景——我们为您的任务提供合适的 GPU。

AI 模型训练

在多 GPU 集群上训练大型语言模型、计算机视觉模型和基础模型。我们的 H100 和 A100 GPU 配备 NVLink 和 InfiniBand 互联,提供分布式训练所需的大规模带宽。

推荐: H100、A100

AI 推理

部署模型进行低延迟、自动扩缩的生产推理。我们的 L40S 和 A100 GPU 专为高吞吐量推理工作负载优化。支持批量推理和实时服务。

推荐: L40S、A100、H100

3D 渲染

加速 Blender、OctaneRender、V-Ray 和其他 GPU 渲染工作流。我们的 L40S GPU 配备 48GB VRAM,可处理复杂场景和高分辨率输出,提供专用 GPU 访问。

推荐: L40S、L4

科研与学术

Jupyter notebooks、SSH 访问和持久存储,适用于科研工作流。灵活的环境支持实验、原型设计和学术计算,按秒计费价格实惠。

推荐: 所有型号

批处理

使用容错 GPU 算力运行 ETL 管道、数据处理和批量计算工作负载。竞价实例为可中断工作负载提供大幅节省,支持自动检查点。

推荐: A100、L4

模型微调

使用 LoRA、QLoRA 和全量微调方法微调基础模型。预构建模板和环境让您几分钟内即可开始。持久存储确保您的模型检查点安全。

推荐: A100、H100

灵活定价

选择适合您工作负载的定价模式。无隐藏费用,没有意外。

最灵活

按需

按秒付费,无最低承诺。保证可用性。非常适合可变工作负载和实验。随时启停。

  • ✓ 无最低租用时长
  • ✓ 按秒计费
  • ✓ 保证可用性
  • ✓ 完整 SSH 访问
最高性价比

预留

按天、周或月承诺使用,享受大幅折扣。保证算力和优先调度。适合生产工作负载。

  • ✓ 最高 40% 折扣
  • ✓ 保证算力
  • ✓ 优先调度
  • ✓ 灵活的承诺期限
最大节省

竞价

以大幅折扣使用闲置 GPU 算力。30 秒抢占预警,支持自动检查点。非常适合批处理和容错工作负载。

  • ✓ 最高节省 70%
  • ✓ 30 秒抢占预警
  • ✓ 自动检查点支持
  • ✓ 自动重启

通过 3 个步骤开始

搜索与筛选

按型号、VRAM、区域和价格浏览可用 GPU。为您的工作负载找到最佳配置。

部署容器

使用预装框架或自定义 Docker 镜像启动实例。SSH 访问秒级可用。

按秒付费

透明的按秒计费,只为您使用的算力付费。无隐藏费用,无长期承诺。

企业级

多 GPU 集群

扩展至最多 8 个 H100 GPU 的集群,配备 NVLink 和 InfiniBand 互联,适用于分布式训练工作负载。我们的集群提供高效训练大型基础模型所需的带宽和低延迟通信。

  • ✓ 每节点最多 8x H100 80GB SXM
  • ✓ NVLink 节点内通信
  • ✓ InfiniBand 节点间网络
  • ✓ 专属集群管理
联系我们获取定制集群

常见问题

我多快可以获得GPU访问权限?
申请通常在24-48小时内审核。获批后,您可以在几分钟内通过我们的仪表板部署GPU实例。部署后几秒钟内即可使用SSH访问。
有最低租赁期限吗?
没有。按需实例没有最低承诺——您可以使用几分钟或几个月。按秒计费,因此您只需为使用的部分付费。预留实例需要承诺一段时间以获得折扣价格。
预装了哪些软件?
我们的容器预装了流行的机器学习框架,包括PyTorch、TensorFlow、JAX和Jupyter。如果您需要特定的环境,我们还支持自定义Docker镜像。
有持久存储吗?
有。我们提供持久的网络附加存储,在实例重启后仍然保留,并可以挂载到新的部署中。您的数据始终可以访问。
如果我的竞价实例被抢占会怎样?
竞价实例在被抢占前会收到30秒的预警。我们支持自动检查点保存,因此您的工作会被保存。您还可以设置在新实例上自动重启。
你们接受哪些支付方式?
我们接受信用卡/借记卡、USDC稳定币,以及企业客户的月度发票。所有账单透明,无隐藏费用。
我可以扩展到多GPU集群吗?
可以。我们支持最多8块H100 GPU的集群,配备NVLink和InfiniBand互连,用于分布式训练工作负载。如需更大的自定义集群配置,请联系我们。
提供哪些支持?
所有客户均可使用24/7在线聊天支持、电子邮件支持和文档。企业客户享有专属客户经理和优先支持。

准备好部署了吗?

申请 GPU 访问权限,几分钟内部署您的第一个实例。我们的团队通常在 24-48 小时内审核申请。