Uma hora
$3.59
1 GPU × 1h · apenas computação
GPU Hopper de alta memória
A NVIDIA H200 combina compute Hopper com 141 GB de HBM3e, tornando-a útil quando pesos de modelo, cache KV ou dados científicos excedem um dispositivo de 80 GB. A GPURento lista uma taxa on-demand de $3,59 por GPU-hora com criação self-service em Paris e Frankfurt.
Revisto pela equipa de infraestrutura GPURento · 1 de setembro de 2026
Cenários de custo
Uma hora
$3.59
1 GPU × 1h · apenas computação
Um dia
$86.16
1 GPU × 24h · apenas computação
Sete dias
$603.12
1 GPU × 168h · apenas computação
Mês médio · 730h
$2620.70
1 GPU × 730h · apenas computação
| Memória | 141 GB HBM3e | Mais memória de GPU única do que H100 SXM. |
|---|---|---|
| Largura de banda de memória | 4.8 TB/s | Especificação do fabricante para H200. |
| Taxa on-demand | $3.59 / GPU-hora | Apenas computação, antes de armazenamento ou serviços opcionais. |
| Regiões disponíveis | Paris · Frankfurt | Ambas as regiões são selecionáveis após o financiamento. |
Método de decisão
O conteúdo abaixo separa especificações publicadas, referências de catálogo GPURento e decisões que ainda requerem um benchmark de carga de trabalho.
O H200 não é simplesmente “um H100 mais rápido”. A sua vantagem prática é o subsistema de memória maior e com maior largura de banda. Isso pode permitir que um modelo utilize menos GPUs, mantenha um contexto mais longo ou sirva mais sequências concorrentes, dependendo da quantização e do runtime.
Para inferência, registe o tempo até ao primeiro token, tokens de saída por segundo, latência p95 e custo por milhão de tokens num nível de qualidade fixo. Uma GPU de alta memória é valiosa apenas se o runtime puder usar essa memória e largura de banda de forma eficiente.
O catálogo expõe H200 na UE Oeste Paris e UE Central Frankfurt. A GPURento verifica o financiamento da conta, armazena a configuração e inicia o fluxo de provisionamento self-service sem um formulário de vendas.
Lista curta do catálogo
141 GB HBM3e · $3.59/h
Inferência de modelos grandes e HPC
80 GB HBM3 · $2.69/h
Treino intensivo e inferência FP8
180 GB HBM3e · $5.98/h
Treino e inferência de fronteira
Perguntas
A configuração H200 descrita aqui tem 141 GB de memória HBM3e e uma largura de banda de memória especificada pelo fabricante de 4,8 TB/s.
Escolha H200 quando 80 GB força sharding indesejado, limita contexto ou restringe concorrência. Se a sua carga de trabalho já cabe e é limitada por computação, faça benchmark de ambos antes de pagar a taxa de referência mais alta.
O catálogo GPURento atual expõe criação self-service de H200 na UE Oeste Paris e UE Central Frankfurt.
Última revisão em 1 de setembro de 2026. As taxas da GPURento são referências atuais do catálogo; o estado de provisionamento permanece visível no espaço de trabalho, e as especificações do fabricante não substituem benchmarks de carga de trabalho.
Continuar a pesquisa
Plano de implementação
Crie um espaço de trabalho e escolha Paris ou Frankfurt com o tamanho do seu modelo, runtime e concorrência alvo.