Eine Stunde
$3.59
1 GPU × 1h · nur Compute
Hopper-GPU mit hohem Speicher
NVIDIA H200 kombiniert Hopper-Compute mit 141 GB HBM3e und ist nützlich, wenn Modellgewichte, KV-Cache oder wissenschaftliche Daten ein 80-GB-Gerät überschreiten. GPURento listet einen On-Demand-Satz von 3,59 $ pro GPU-Stunde mit Self-Service-Erstellung in Paris und Frankfurt.
Überprüft vom GPURento-Infrastrukturteam · 1. September 2026
Kostenszenarien
Eine Stunde
$3.59
1 GPU × 1h · nur Compute
Ein Tag
$86.16
1 GPU × 24h · nur Compute
Sieben Tage
$603.12
1 GPU × 168h · nur Compute
Durchschnittlicher Monat · 730 Std.
$2620.70
1 GPU × 730h · nur Compute
| Speicher | 141 GB HBM3e | Mehr Single-GPU-Speicher als H100 SXM. |
|---|---|---|
| Speicherbandbreite | 4,8 TB/s | Herstellerspezifikation für H200. |
| On-demand-Rate | $3,59 / GPU-Stunde | Nur Compute, vor Speicher oder optionalen Diensten. |
| Verfügbare Regionen | Paris · Frankfurt | Beide Regionen sind nach der Finanzierung auswählbar. |
Entscheidungsmethode
Der folgende Inhalt trennt veröffentlichte Spezifikationen, GPURento-Katalogreferenzen und Entscheidungen, die noch einen Workload-Benchmark erfordern.
Die H200 ist nicht einfach „eine schnellere H100“. Ihr praktischer Vorteil ist das größere Speichersubsystem mit höherer Bandbreite. Dadurch kann ein Modell weniger GPUs benötigen, einen längeren Kontext halten oder mehr gleichzeitige Sequenzen bedienen, abhängig von Quantisierung und Laufzeit.
Erfassen Sie für Inferenz Zeit bis zum ersten Token, Ausgabetokens pro Sekunde, p95-Latenz und Kosten pro Million Tokens bei einem festen Qualitätsniveau. Eine GPU mit viel Speicher ist nur wertvoll, wenn die Laufzeit diesen Speicher und die Bandbreite effizient nutzen kann.
Der Katalog zeigt H200 in EU West Paris und EU Zentral Frankfurt. GPURento prüft die Kontofinanzierung, speichert die Konfiguration und startet den Self-Service-Bereitstellungsworkflow ohne Vertriebsformular.
Katalog-Shortlist
141 GB HBM3e · $3,59/Std.
Inferenz großer Modelle und HPC
80 GB HBM3 · $2,69/Std.
Intensives Training und FP8-Inferenz
180 GB HBM3e · $5,98/Std.
Spitzen-Training und Inferenz
Fragen
Die hier beschriebene H200-Konfiguration verfügt über 141 GB HBM3e-Speicher und eine vom Hersteller angegebene Speicherbandbreite von 4,8 TB/s.
Wählen Sie H200, wenn 80 GB unerwünschtes Sharding erzwingt, den Kontext begrenzt oder die Parallelität einschränkt. Wenn Ihr Workload bereits passt und rechengebunden ist, benchmarken Sie beide, bevor Sie den höheren Referenztarif zahlen.
Der aktuelle GPURento-Katalog bietet Self-Service-H200-Erstellung in EU West Paris und EU Zentral Frankfurt.
Zuletzt überprüft am 1. September 2026. GPURento-Tarife sind aktuelle Katalogreferenzen; der Bereitstellungsstatus bleibt im Workspace sichtbar, und Herstellerspezifikationen ersetzen keine Workload-Benchmarks.
Recherche fortsetzen
Bereitstellungsplan
Erstellen Sie einen Workspace und wählen Sie Paris oder Frankfurt mit Ihrer Modellgröße, Laufzeit und Ziel-Konkurrenz.