Un'ora
$3.59
1 GPU × 1h · solo calcolo
GPU Hopper ad alta memoria
NVIDIA H200 abbina il calcolo Hopper a 141 GB di HBM3e, rendendolo utile quando pesi del modello, cache KV o dati scientifici superano un dispositivo da 80 GB. GPURento elenca una tariffa on-demand di $3,59 per GPU-ora con creazione self-service a Parigi e Francoforte.
Revisionato dal team infrastruttura GPURento · 1 settembre 2026
Scenari di costo
Un'ora
$3.59
1 GPU × 1h · solo calcolo
Un giorno
$86.16
1 GPU × 24h · solo calcolo
Sette giorni
$603.12
1 GPU × 168h · solo calcolo
Mese medio · 730h
$2620.70
1 GPU × 730h · solo calcolo
| Memoria | 141 GB HBM3e | Più memoria su singola GPU rispetto a H100 SXM. |
|---|---|---|
| Larghezza di banda memoria | 4,8 TB/s | Specifica del produttore per H200. |
| Tariffa on-demand | $3,59 / GPU-ora | Solo calcolo, prima di storage o servizi opzionali. |
| Regioni disponibili | Parigi · Francoforte | Entrambe le regioni sono selezionabili dopo il finanziamento. |
Metodo decisionale
Il contenuto seguente separa specifiche pubblicate, riferimenti di catalogo GPURento e decisioni che richiedono ancora un benchmark del carico di lavoro.
H200 non è semplicemente "un H100 più veloce". Il suo vantaggio pratico è il sottosistema di memoria più grande e con maggiore larghezza di banda. Ciò può consentire a un modello di utilizzare meno GPU, mantenere un contesto più lungo o servire più sequenze concorrenti, a seconda della quantizzazione e del runtime.
Per l'inferenza, registra tempo al primo token, token di output al secondo, latenza p95 e costo per milione di token a un livello di qualità fisso. Una GPU ad alta memoria è preziosa solo se il runtime può usare quella memoria e larghezza di banda in modo efficiente.
Il catalogo espone H200 in EU West Paris e EU Central Frankfurt. GPURento verifica il finanziamento dell'account, archivia la configurazione e avvia il flusso di provisioning self-service senza modulo di vendita.
Shortlist catalogo
141 GB HBM3e · $3,59/ora
Inferenza di modelli grandi e HPC
80 GB HBM3 · $2,69/ora
Training intensivo e inferenza FP8
180 GB HBM3e · $5,98/ora
Addestramento e inferenza all'avanguardia
Domande
La configurazione H200 descritta qui ha 141 GB di memoria HBM3e e una larghezza di banda memoria specificata dal produttore di 4,8 TB/s.
Scegli H200 quando 80 GB forza uno sharding indesiderato, limita il contesto o vincola la concorrenza. Se il tuo carico di lavoro già sta ed è compute-bound, fai benchmark di entrambi prima di pagare la tariffa di riferimento più alta.
Il catalogo GPURento attuale espone la creazione self-service H200 in EU West Paris e EU Central Frankfurt.
Ultima revisione: 1 settembre 2026. Le tariffe GPURento sono riferimenti di catalogo correnti; lo stato di provisioning rimane visibile nel workspace e le specifiche del produttore non sostituiscono i benchmark del carico di lavoro.
Continua la ricerca
Piano di distribuzione
Crea un workspace e scegli Parigi o Francoforte con la dimensione del modello, il runtime e la concorrenza target.