AIワークロード向けエンタープライズグレードNVIDIA GPU
H100、A100、L40S、L4インスタンスを数分でデプロイ。秒単位課金で契約不要。PyTorch、TensorFlow、JAX、Jupyterプリインストール済み。SSHアクセスは数秒で利用可能。
AIチームのために設計
大規模言語モデルのトレーニング、リアルタイム推論、3Dコンテンツのレンダリングなど、GPUnexは自社インフラの管理負担なくGPUコンピュートを提供します。当社マーケットプレイスは150以上の認証済みデータセンターからGPU供給を集約し、通常は長期ハイパースケーラー契約に縛られている容量へのアクセスを可能にします。
利用可能なGPU モデル
自動ベンチマークで検証され、信頼できるデータセンターにデプロイされたエンタープライズNVIDIA GPU。
NVIDIA H100 80GB SXM
NVIDIA A100 80GB
NVIDIA A100 40GB
NVIDIA L40S 48GB
NVIDIA L4 24GB
GPUパフォーマンス比較
FP16/BF16スループットに基づく相対的なパフォーマンスです。実際のパフォーマンスはワークロードの種類により異なります。
あらゆるワークロードに対応するGPUコンピュート
数十億パラメータモデルのトレーニングからフォトリアリスティックなシーンのレンダリングまで、タスクに最適なGPUをご用意しています。
AIモデルトレーニング
マルチGPUクラスターで大規模言語モデル、コンピュータビジョンモデル、基盤モデルをトレーニングできます。NVLinkとInfiniBandインターコネクトを搭載したH100およびA100 GPUが、大規模な分散トレーニングに必要な帯域幅を提供します。
AI推論
低レイテンシとオートスケーリングで本番環境の推論にモデルをデプロイできます。L40SおよびA100 GPUは高スループット推論ワークロードに最適化されています。バッチ推論とリアルタイムサービングに対応。
3Dレンダリング
Blender、OctaneRender、V-Rayなど、GPUレンダリングワークフローを高速化します。48GB VRAMを搭載したL40S GPUが、専用GPUアクセスで複雑なシーンと高解像度出力に対応します。
研究 & アカデミア
研究ワークフロー向けのJupyterノートブック、SSHアクセス、永続ストレージ。手頃な秒単位課金で、実験、プロトタイピング、学術研究向けの柔軟な環境を提供します。
バッチ処理
フォールトトレラントなGPUコンピュートでETLパイプライン、データ処理、バッチ計算ワークロードを実行できます。スポットインスタンスは、オートチェックポイント付きの中断可能なワークロードに大幅な節約を提供します。
ファインチューニング
LoRA、QLoRA、フルファインチューニングアプローチで基盤モデルをファインチューニングできます。プリビルトテンプレートと環境で数分で開始可能。永続ストレージでモデルチェックポイントを安全に保管します。
柔軟な料金プラン
ワークロードに合った料金モデルをお選びください。隠れた手数料やサプライズはありません。
オンデマンド
最低利用期間なしの秒単位課金。可用性保証付き。可変ワークロードや実験に最適。いつでも開始・停止可能。
- ✓ 最低レンタル期間なし
- ✓ 秒単位課金
- ✓ 可用性保証
- ✓ フルSSHアクセス
リザーブド
日、週、月単位のコミットメントで大幅な割引。優先スケジューリング付きの容量保証。本番ワークロードに最適。
- ✓ 最大40%割引
- ✓ 容量保証
- ✓ 優先スケジューリング
- ✓ 柔軟なコミットメント期間
スポット
未使用GPU容量を大幅割引で利用可能。30秒のプリエンプション通知とオートチェックポイント対応。バッチ処理やフォールトトレラントなワークロードに最適。
- ✓ 最大70%の節約
- ✓ 30秒のプリエンプション通知
- ✓ オートチェックポイント対応
- ✓ 自動再起動
3ステップで開始
検索 & フィルター
モデル、VRAM、リージョン、価格で利用可能なGPUを検索できます。ワークロードに最適な構成を見つけましょう。
コンテナをデプロイ
プリインストール済みフレームワークまたはカスタムDockerイメージでインスタンスを起動できます。SSHアクセスは数秒で利用可能です。
秒単位で支払い
透明な秒単位課金で、使用した分だけお支払い。隠れた手数料や長期契約はありません。
マルチGPUクラスター
分散トレーニングワークロード向けに、NVLinkとInfiniBandインターコネクトを備えた最大8x H100 GPUのクラスターにスケール可能です。当社のクラスターは、大規模基盤モデルの効率的なトレーニングに必要な帯域幅と低レイテンシ通信を提供します。
- ✓ ノードあたり最大8x H100 80GB SXM
- ✓ ノード内通信にNVLink
- ✓ ノード間ネットワーキングにInfiniBand
- ✓ 専用クラスター管理
よくある質問
GPUアクセスはどのくらい早く得られますか?
最低レンタル期間はありますか?
どのようなソフトウェアがプリインストールされていますか?
永続ストレージは利用できますか?
スポットインスタンスがプリエンプトされた場合はどうなりますか?
どのような支払い方法に対応していますか?
マルチGPUクラスターにスケールできますか?
どのようなサポートが利用できますか?
デプロイの準備はできましたか?
GPUアクセスを申請して、数分で最初のインスタンスをデプロイしましょう。当社チームが24〜48時間以内に申請を審査します。