Jedna hodina
$3.59
1 GPU × 1h · pouze výpočet
Hopper GPU s velkou pamětí
NVIDIA H200 kombinuje výpočetní výkon Hopper s 141 GB HBM3e, což je užitečné, když váhy modelu, KV cache nebo vědecká data překročí 80 GB zařízení. GPURento uvádí sazbu $3.59 za GPU-hodinu se samoobslužným vytvořením v Paříži a Frankfurtu.
Zkontrolováno týmem infrastruktury GPURento · 1. září 2026
Nákladové scénáře
Jedna hodina
$3.59
1 GPU × 1h · pouze výpočet
Jeden den
$86.16
1 GPU × 24h · pouze výpočet
Sedm dní
$603.12
1 GPU × 168h · pouze výpočet
Průměrný měsíc · 730h
$2620.70
1 GPU × 730h · pouze výpočet
| Paměť | 141 GB HBM3e | Více paměti na jedno GPU než H100 SXM. |
|---|---|---|
| Propustnost paměti | 4.8 TB/s | Specifikace výrobce pro H200. |
| Sazba on-demand | $3.59 / GPU-hodina | Pouze výpočet, před úložištěm nebo volitelnými službami. |
| Dostupné regiony | Paříž · Frankfurt | Oba regiony jsou po financování vybratelné. |
Metoda rozhodování
Obsah níže odděluje publikované specifikace, odkazy na katalog GPURento a rozhodnutí, která stále vyžadují benchmark pracovního zatížení.
H200 není jen „rychlejší H100“. Jeho praktickou výhodou je větší paměťový subsystém s vyšší propustností. To může modelu umožnit použít méně GPU, udržet delší kontext nebo obsloužit více souběžných sekvencí, v závislosti na kvantizaci a běhovém prostředí.
Pro inferenci zaznamenejte čas do prvního tokenu, výstupní tokeny za sekundu, p95 latenci a náklady na milion tokenů při pevné úrovni kvality. GPU s vysokou pamětí je cenné pouze tehdy, pokud běhové prostředí dokáže tuto paměť a šířku pásma efektivně využít.
Katalog zobrazuje H200 v EU West Paris a EU Central Frankfurt. GPURento kontroluje financování účtu, ukládá konfiguraci a spouští samoobslužný pracovní postup zřizování bez prodejního formuláře.
Užší výběr z katalogu
141 GB HBM3e · $3.59/hod
Inference velkých modelů a HPC
80 GB HBM3 · $2.69/hod
Intenzivní trénování a inference FP8
180 GB HBM3e · $5.98/hod
Špičkové školení a inference
Otázky
Konfigurace H200 popsaná zde má 141 GB paměti HBM3e a výrobcem specifikovanou šířku pásma paměti 4,8 TB/s.
Vyberte H200, když 80 GB vynucuje nežádoucí sharding, omezuje kontext nebo omezuje souběžnost. Pokud se vaše pracovní zátěž již vejde a je výpočetně vázaná, benchmarkujte oba před zaplacením vyšší referenční sazby.
Aktuální katalog GPURento zobrazuje samoobslužné vytváření H200 v EU West Paris a EU Central Frankfurt.
Naposledy zkontrolováno 1. září 2026. Sazby GPURento jsou aktuální katalogové reference; stav zřizování zůstává viditelný v pracovním prostoru a specifikace výrobce nenahrazují benchmarky pracovní zátěže.
Pokračovat ve výzkumu
Plán nasazení
Vytvořte pracovní prostor a vyberte Paříž nebo Frankfurt s velikostí modelu, běhovým prostředím a cílovou souběžností.