Eén uur
$3.59
1 GPU × 1u · alleen compute
Hopper-GPU met veel geheugen
NVIDIA H200 combineert Hopper-compute met 141 GB HBM3e, waardoor het nuttig is wanneer modelgewichten, KV-cache of wetenschappelijke gegevens een 80 GB-apparaat overschrijden. GPURento vermeldt een $3,59 per GPU-uur on-demand tarief met self-service creatie in Parijs en Frankfurt.
Beoordeeld door het GPURento-infrastructuream · 1 september 2026
Kostenscenario's
Eén uur
$3.59
1 GPU × 1u · alleen compute
Eén dag
$86.16
1 GPU × 24u · alleen compute
Zeven dagen
$603.12
1 GPU × 168u · alleen compute
Gemiddelde maand · 730u
$2620.70
1 GPU × 730u · alleen compute
| Geheugen | 141 GB HBM3e | Meer single-GPU geheugen dan H100 SXM. |
|---|---|---|
| Geheugenbandbreedte | 4,8 TB/s | Fabrikantspecificatie voor H200. |
| On-demand-tarief | $3,59 / GPU-uur | Alleen compute, vóór opslag of optionele diensten. |
| Beschikbare regio's | Parijs · Frankfurt | Beide regio's zijn selecteerbaar na financiering. |
Beslissingsmethode
De inhoud hieronder scheidt gepubliceerde specificaties, GPURento-catalogusreferenties en beslissingen die nog steeds een workloadbenchmark vereisen.
H200 is niet simpelweg 'een snellere H100.' Het praktische voordeel is het grotere geheugensubsysteem met hogere bandbreedte. Dat kan een model minder GPU's laten gebruiken, een langere context vasthouden of meer gelijktijdige sequenties bedienen, afhankelijk van kwantisering en runtime.
Voor inferentie noteert u tijd tot eerste token, outputtokens per seconde, p95-latentie en kosten per miljoen tokens bij een vast kwaliteitsniveau. Een GPU met veel geheugen is alleen waardevol als de runtime dat geheugen en die bandbreedte efficiënt kan gebruiken.
De catalogus toont H200 in EU West Parijs en EU Centraal Frankfurt. GPURento controleert accountfinanciering, slaat de configuratie op en start de selfservice-provisioningworkflow zonder verkoopformulier.
Catalogus-shortlist
141 GB HBM3e · $3,59/uur
Grootschalige modelinferentie en HPC
80 GB HBM3 · $2,69/uur
Intensieve training en FP8-inferentie
180 GB HBM3e · $5,98/uur
Frontier-training en -inferentie
Vragen
De hier beschreven H200-configuratie heeft 141 GB HBM3e-geheugen en een door de fabrikant gespecificeerde geheugenbandbreedte van 4,8 TB/s.
Kies H200 wanneer 80 GB ongewenste sharding forceert, context beperkt of concurrency beperkt. Als uw workload al past en compute-gebonden is, benchmark dan beide voordat u het hogere referentietarief betaalt.
De huidige GPURento-catalogus biedt selfservice H200-creatie in EU West Parijs en EU Centraal Frankfurt.
Laatst beoordeeld op 1 september 2026. GPURento-tarieven zijn huidige catalogusreferenties; provisioningstatus blijft zichtbaar in de workspace, en fabrikantspecificaties vervangen geen workload-benchmarks.
Ga verder met het onderzoek
Implementatieplan
Maak een workspace en kies Parijs of Frankfurt met je modelgrootte, runtime en beoogde gelijktijdigheid.