O oră
$3.59
1 GPU × 1h · doar calcul
GPU Hopper cu memorie mare
NVIDIA H200 împerechează calculul Hopper cu 141 GB de HBM3e, fiind util când greutățile modelului, cache-ul KV sau datele științifice depășesc un dispozitiv de 80 GB. GPURento listează un tarif on-demand de $3.59 per GPU-oră cu creare self-service în Paris și Frankfurt.
Revizuit de echipa de infrastructură GPURento · 1 septembrie 2026
Scenarii de cost
O oră
$3.59
1 GPU × 1h · doar calcul
O zi
$86.16
1 GPU × 24h · doar calcul
Șapte zile
$603.12
1 GPU × 168h · doar calcul
Lună medie · 730h
$2620.70
1 GPU × 730h · doar calcul
| Memorie | 141 GB HBM3e | Mai multă memorie pe un singur GPU decât H100 SXM. |
|---|---|---|
| Lățime de bandă a memoriei | 4.8 TB/s | Specificație producător pentru H200. |
| Tarif la cerere | $3.59 / GPU-oră | Doar calcul, înainte de stocare sau servicii opționale. |
| Regiuni disponibile | Paris · Frankfurt | Ambele regiuni sunt selectabile după finanțare. |
Metodă de decizie
Conținutul de mai jos separă specificațiile publicate, referințele din catalogul GPURento și deciziile care necesită încă un benchmark al volumului de lucru.
H200 nu este pur și simplu „un H100 mai rapid.” Avantajul său practic este subsistemul de memorie mai mare și cu lățime de bandă mai mare. Acest lucru poate permite unui model să folosească mai puține GPU-uri, să păstreze un context mai lung sau să servească mai multe secvențe concurente, în funcție de cuantizare și runtime.
Pentru inferență, înregistrează timpul până la primul token, tokenii de ieșire pe secundă, latența p95 și costul per milion de tokeni la un nivel fix de calitate. Un GPU cu memorie mare este valoros doar dacă runtime-ul poate folosi eficient acea memorie și lățime de bandă.
Catalogul expune H200 în UE Vest Paris și UE Central Frankfurt. GPURento verifică finanțarea contului, stochează configurația și pornește fluxul de lucru de provisioning cu autoservire fără un formular de vânzări.
Listă scurtă din catalog
141 GB HBM3e · $3.59/oră
Inferență pentru modele mari și HPC
80 GB HBM3 · $2.69/oră
Antrenament intensiv și inferență FP8
180 GB HBM3e · $5.98/oră
Antrenare și inferență de frontieră
Întrebări
Configurația H200 descrisă aici are 141 GB de memorie HBM3e și o lățime de bandă a memoriei specificată de producător de 4,8 TB/s.
Alegeți H200 când 80 GB forțează sharding nedorit, limitează contextul sau constrânge concurența. Dacă sarcina dvs. încape deja și este limitată de calcul, benchmark-uiți ambele înainte de a plăti referința orară mai mare.
Catalogul GPURento actual expune crearea H200 cu autoservire în UE Vest Paris și UE Central Frankfurt.
Ultima verificare: 1 septembrie 2026. Tarifele GPURento sunt referințe curente de catalog; starea de provisioning rămâne vizibilă în workspace, iar specificațiile producătorului nu înlocuiesc benchmark-urile sarcinii de lucru.
Continuă cercetarea
Plan de implementare
Creează un spațiu de lucru și alege Paris sau Frankfurt cu dimensiunea modelului, runtime-ul și concurența țintă.