1時間
$3.59
1 GPU × 1h · コンピュートのみ
大容量メモリHopper GPU
NVIDIA H200は、Hopperコンピュートと141 GBのHBM3eを組み合わせており、モデルの重み、KVキャッシュ、または科学データが80 GBデバイスを超える場合に役立ちます。GPURentoは、パリとフランクフルトでセルフサービス作成が可能なオンデマンドレートをGPU時間あたり$3.59で掲載しています。
GPURentoインフラストラクチャチームによるレビュー · 2026年9月1日
コストシナリオ
1時間
$3.59
1 GPU × 1h · コンピュートのみ
1日
$86.16
1 GPU × 24h · コンピュートのみ
7日間
$603.12
1 GPU × 168h · コンピュートのみ
平均月 · 730時間
$2620.70
1 GPU × 730h · コンピュートのみ
| メモリ | 141 GB HBM3e | H100 SXMよりも多くのシングルGPUメモリ。 |
|---|---|---|
| メモリ帯域幅 | 4.8 TB/s | H200のメーカー仕様。 |
| オンデマンドレート | $3.59 / GPU時間 | ストレージまたはオプションサービス前のコンピュートのみ。 |
| 利用可能なリージョン | パリ · フランクフルト | 資金提供後に両方のリージョンを選択できます。 |
決定方法
以下のコンテンツは、公開された仕様、GPURentoカタログ参照、およびワークロードベンチマークをまだ必要とする決定を分離しています。
H200は単に「より高速なH100」ではありません。その実用的な利点は、より大きく、より高い帯域幅のメモリサブシステムです。これにより、量子化とランタイムに応じて、モデルがより少ないGPUを使用したり、より長いコンテキストを保持したり、より多くの同時シーケンスを処理したりできます。
推論では、固定品質レベルで、最初のトークンまでの時間、1秒あたりの出力トークン数、p95レイテンシ、100万トークンあたりのコストを記録します。高メモリGPUは、ランタイムがそのメモリと帯域幅を効率的に使用できる場合にのみ価値があります。
カタログは、EU West ParisとEU Central FrankfurtでH200を公開しています。GPURentoはアカウントの資金を確認し、構成を保存し、セールスフォームなしでセルフサービスのプロビジョニングワークフローを開始します。
質問
ここで説明するH200構成は、141 GBのHBM3eメモリとメーカー指定の4.8 TB/sメモリ帯域幅を備えています。
80 GBが不要なシャーディングを強制し、コンテキストを制限し、または並行性を制約する場合にH200を選択します。ワークロードがすでに適合し、計算バウンドの場合は、高い参照レートを支払う前に両方をベンチマークしてください。
現在のGPURentoカタログは、EU West ParisとEU Central FrankfurtでセルフサービスのH200作成を公開しています。
最終確認日: 2026年9月1日。GPURentoレートは現在のカタログ参照です。プロビジョニング状態はワークスペースで表示されたままです。メーカー仕様はワークロードベンチマークの代わりにはなりません。
調査を続ける
デプロイ計画
ワークスペースを作成し、モデルサイズ、ランタイム、ターゲット並行性に合わせてパリまたはフランクフルトを選択します。