NVIDIAデータセンター比較

H100 vs H200 vs B200: ボトルネックと可用性で選択。

直接回答

H100は80 GB HBM3と確立されたHopperパスを提供します。H200はHopperを維持しつつメモリを141 GB HBM3eに拡張します。B200はBlackwellに移行し、180 GB HBM3eを搭載します。3つすべてに公開されたGPURento計画レートとリクエストパスがあります。トークン、チェックポイント、または完了ジョブあたりのコストを比較する前に、同じワークロードをベンチマークしてください。

GPURentoインフラストラクチャチームによるレビュー · 2026年9月1日

の主要な事実 H100 vs H200 vs B200: ボトルネックと可用性で選択。
H100 SXM80 GB · $2.69/時間24時間のコンピュートシナリオで$64.56。
H200 SXM141 GB · $3.59/時間24時間のコンピュートシナリオで$86.16。
B200180 GB · $5.98/時間24時間のコンピュートシナリオで$143.52。
決定ルールメモリ、次に時間/ジョブ互換性のあるソフトウェアと同一の入力を使用します。
最適な用途
  • データセンターGPUショートリスト
  • 大規模モデルのメモリ計画
  • HopperからBlackwellへの評価
  • 明示的なトレードオフを含むキャパシティブリーフ
最適ではない場合
  • ピーク仕様をベンチマークとして扱う
  • エンドツーエンドのシステムコストを無視
  • 異なるモデル品質またはソフトウェアバージョンの比較

決定方法

キャパシティをデプロイする前に確認すべきこと。

以下のコンテンツは、公開された仕様、GPURentoカタログ参照、およびワークロードベンチマークをまだ必要とする決定を分離しています。

01

H100: 確立されたHopperパフォーマンス

80 GBで十分であり、ソフトウェアスタックがHopperトランスフォーマーアクセラレーションの恩恵を受ける場合はH100を選択します。これは3つの中で最も広いGPURentoリクエスト地域と、H200よりも低い公開参照レートを持っています。

02

H200: メモリバウンドのワークロードを解決

141 GBとより高いメモリ帯域幅がシャーディングを減らし、コンテキストを増やし、または並行性を高めて、高い時間あたり参照を相殺する場合にH200を選択します。ワークロードが計算バウンドのままで80 GBに収まる場合は、利点を検証してください。

  • 同じモデルに必要なGPUを測定
  • コンテキストと同時実行数を固定
  • 受け入れられたトークンまたはチェックポイントあたりのコストを比較する
03

B200: 効果のある場所でBlackwellを使用

B200は3つの中で最大のメモリと新しいアーキテクチャを$5.98/GPU時間で提供します。Blackwellのスループット、180 GBメモリ、FP4サポートが高い時間あたりレートを相殺する場合に使用してください。

04

同じシステム境界をベンチマーク

モデルとデータセットのリビジョン、コンテナダイジェスト、精度、コンテキストまたはバッチ、品質ターゲット、チェックポイントポリシーを固定します。ウォームアップを別途記録し、p50およびp95のエンドツーエンドランタイム、ピークメモリ、総コンピュートコストを比較します。メーカーのピークは仕様であり、GPURentoインフラストラクチャの結果ではありません。

  • リクエストに示されている正確なGPUフォームファクタを使用
  • データロード、前処理、チェックポイントI/Oを含める
  • 受け入れられたトークン、チェックポイント、または完了したジョブあたりのコストを報告

質問

限界を含む明確な回答。

H200はH100よりVRAMが多いですか?+

はい。リストされているH200は、H100 SXMの80GB HBM3と比較して141GB HBM3eを搭載しています。

B200はGPURentoでレンタルできますか?+

B200は、パリとフランクフルトでGPU時間あたり$5.98のリクエスト可能な構成としてリストされています。カタログは即時の在庫を保証するものではありません。キャパシティはリクエスト時に確認されます。

1時間あたりのコストが最も安いのはどれですか?+

H100は$2.69/時間から、H200は$3.59/時間から、B200は$5.98/時間からです。ジョブあたりのコストはベンチマークが必要です。

デプロイ計画

解消する必要のあるボトルネックを選択します。

カタログと価格計算機を使用して、すべての前提を可視化したH100、H200、またはB200の容量リクエストを準備します。