GPUnex
AI開発者・チーム向け

AIワークロード向けエンタープライズグレードNVIDIA GPU

H100、A100、L40S、L4インスタンスを数分でデプロイ。秒単位課金で契約不要。PyTorch、TensorFlow、JAX、Jupyterプリインストール済み。SSHアクセスは数秒で利用可能。

2400+ GPUs Active
150+ Data Centers
99.9% Uptime
24/7 Live Support

AIチームのために設計

大規模言語モデルのトレーニング、リアルタイム推論、3Dコンテンツのレンダリングなど、GPUnexは自社インフラの管理負担なくGPUコンピュートを提供します。当社マーケットプレイスは150以上の認証済みデータセンターからGPU供給を集約し、通常は長期ハイパースケーラー契約に縛られている容量へのアクセスを可能にします。

利用可能なGPU モデル

自動ベンチマークで検証され、信頼できるデータセンターにデプロイされたエンタープライズNVIDIA GPU。

需要高

NVIDIA H100 80GB SXM

80 GB HBM3
インターコネクト: NVLink + InfiniBand
LLMトレーニング基盤モデルマルチGPUクラスター
残りわずか

NVIDIA A100 80GB

80 GB HBM2e
インターコネクト: NVLink
AIトレーニング推論科学計算
利用可能

NVIDIA A100 40GB

40 GB HBM2e
インターコネクト: NVLink
AIトレーニングファインチューニングバッチ処理
利用可能

NVIDIA L40S 48GB

48 GB GDDR6X
インターコネクト: PCIe Gen4
AI推論3Dレンダリング動画処理
利用可能

NVIDIA L4 24GB

24 GB GDDR6
インターコネクト: PCIe Gen4
AI推論軽量トレーニングエッジワークロード

GPUパフォーマンス比較

H100 80GB SXM
80 GB HBM3 高需要
A100 80GB
80 GB HBM2e 限定
L40S 48GB
48 GB GDDR6X 利用可能
A100 40GB
40 GB HBM2e 利用可能
L4 24GB
24 GB GDDR6 利用可能

FP16/BF16スループットに基づく相対的なパフォーマンスです。実際のパフォーマンスはワークロードの種類により異なります。

あらゆるワークロードに対応するGPUコンピュート

数十億パラメータモデルのトレーニングからフォトリアリスティックなシーンのレンダリングまで、タスクに最適なGPUをご用意しています。

AIモデルトレーニング

マルチGPUクラスターで大規模言語モデル、コンピュータビジョンモデル、基盤モデルをトレーニングできます。NVLinkとInfiniBandインターコネクトを搭載したH100およびA100 GPUが、大規模な分散トレーニングに必要な帯域幅を提供します。

おすすめ: H100, A100

AI推論

低レイテンシとオートスケーリングで本番環境の推論にモデルをデプロイできます。L40SおよびA100 GPUは高スループット推論ワークロードに最適化されています。バッチ推論とリアルタイムサービングに対応。

おすすめ: L40S, A100, H100

3Dレンダリング

Blender、OctaneRender、V-Rayなど、GPUレンダリングワークフローを高速化します。48GB VRAMを搭載したL40S GPUが、専用GPUアクセスで複雑なシーンと高解像度出力に対応します。

おすすめ: L40S, L4

研究 & アカデミア

研究ワークフロー向けのJupyterノートブック、SSHアクセス、永続ストレージ。手頃な秒単位課金で、実験、プロトタイピング、学術研究向けの柔軟な環境を提供します。

おすすめ: 全モデル対応

バッチ処理

フォールトトレラントなGPUコンピュートでETLパイプライン、データ処理、バッチ計算ワークロードを実行できます。スポットインスタンスは、オートチェックポイント付きの中断可能なワークロードに大幅な節約を提供します。

おすすめ: A100, L4

ファインチューニング

LoRA、QLoRA、フルファインチューニングアプローチで基盤モデルをファインチューニングできます。プリビルトテンプレートと環境で数分で開始可能。永続ストレージでモデルチェックポイントを安全に保管します。

おすすめ: A100, H100

柔軟な料金プラン

ワークロードに合った料金モデルをお選びください。隠れた手数料やサプライズはありません。

最も柔軟

オンデマンド

最低利用期間なしの秒単位課金。可用性保証付き。可変ワークロードや実験に最適。いつでも開始・停止可能。

  • ✓ 最低レンタル期間なし
  • ✓ 秒単位課金
  • ✓ 可用性保証
  • ✓ フルSSHアクセス
お得

リザーブド

日、週、月単位のコミットメントで大幅な割引。優先スケジューリング付きの容量保証。本番ワークロードに最適。

  • ✓ 最大40%割引
  • ✓ 容量保証
  • ✓ 優先スケジューリング
  • ✓ 柔軟なコミットメント期間
最大の節約

スポット

未使用GPU容量を大幅割引で利用可能。30秒のプリエンプション通知とオートチェックポイント対応。バッチ処理やフォールトトレラントなワークロードに最適。

  • ✓ 最大70%の節約
  • ✓ 30秒のプリエンプション通知
  • ✓ オートチェックポイント対応
  • ✓ 自動再起動

3ステップで開始

検索 & フィルター

モデル、VRAM、リージョン、価格で利用可能なGPUを検索できます。ワークロードに最適な構成を見つけましょう。

コンテナをデプロイ

プリインストール済みフレームワークまたはカスタムDockerイメージでインスタンスを起動できます。SSHアクセスは数秒で利用可能です。

秒単位で支払い

透明な秒単位課金で、使用した分だけお支払い。隠れた手数料や長期契約はありません。

エンタープライズ

マルチGPUクラスター

分散トレーニングワークロード向けに、NVLinkとInfiniBandインターコネクトを備えた最大8x H100 GPUのクラスターにスケール可能です。当社のクラスターは、大規模基盤モデルの効率的なトレーニングに必要な帯域幅と低レイテンシ通信を提供します。

  • ✓ ノードあたり最大8x H100 80GB SXM
  • ✓ ノード内通信にNVLink
  • ✓ ノード間ネットワーキングにInfiniBand
  • ✓ 専用クラスター管理
カスタムクラスターのお問い合わせ

よくある質問

GPUアクセスはどのくらい早く得られますか?
申請は通常24〜48時間以内に審査されます。承認後、ダッシュボードから数分でGPUインスタンスをデプロイできます。デプロイ後数秒でSSHアクセスが可能になります。
最低レンタル期間はありますか?
いいえ。オンデマンドインスタンスには最低利用期間はありません。数分から数か月までご利用いただけます。課金は秒単位なので、使用した分だけお支払いいただきます。リザーブドインスタンスは割引料金のためにコミットメント期間が必要です。
どのようなソフトウェアがプリインストールされていますか?
当社のコンテナには、PyTorch、TensorFlow、JAX、Jupyterなどの人気MLフレームワークがプリインストールされています。特定の環境が必要な場合は、カスタムDockerイメージもサポートしています。
永続ストレージは利用できますか?
はい。インスタンスの再起動後も保持され、新しいデプロイメントにアタッチできる永続ネットワーク接続ストレージを提供しています。データにはいつでもアクセス可能です。
スポットインスタンスがプリエンプトされた場合はどうなりますか?
スポットインスタンスはプリエンプション前に30秒の警告を受けます。自動チェックポイント機能をサポートしているため、作業は保存されます。新しいインスタンスでの自動再起動を設定することもできます。
どのような支払い方法に対応していますか?
クレジット/デビットカード、USDCステーブルコイン、エンタープライズ顧客向けの月次請求に対応しています。すべての請求は透明で、隠れた手数料はありません。
マルチGPUクラスターにスケールできますか?
はい。NVLinkおよびInfiniBandインターコネクトを備えた最大8基のH100 GPUクラスターをサポートしており、分散トレーニングワークロードに対応しています。より大規模なカスタムクラスター構成についてはお問い合わせください。
どのようなサポートが利用できますか?
すべてのお客様が24時間年中無休のライブチャットサポート、メールサポート、ドキュメントをご利用いただけます。エンタープライズのお客様には専任のアカウントマネージャーと優先サポートをご提供します。

デプロイの準備はできましたか?

GPUアクセスを申請して、数分で最初のインスタンスをデプロイしましょう。当社チームが24〜48時間以内に申請を審査します。