Una hora
$3.59
1 GPU × 1h · solo computación
GPU Hopper de alta memoria
NVIDIA H200 combina cómputo Hopper con 141 GB de HBM3e, lo que lo hace útil cuando los pesos del modelo, la caché KV o los datos científicos superan un dispositivo de 80 GB. GPURento lista una tarifa bajo demanda de $3,59 por hora de GPU con creación de autoservicio en París y Fráncfort.
Revisado por el equipo de infraestructura de GPURento · 1 de septiembre de 2026
Escenarios de coste
Una hora
$3.59
1 GPU × 1h · solo computación
Un día
$86.16
1 GPU × 24h · solo computación
Siete días
$603.12
1 GPU × 168h · solo computación
Mes promedio · 730h
$2620.70
1 GPU × 730h · solo computación
| Memoria | 141 GB HBM3e | Más memoria de una sola GPU que H100 SXM. |
|---|---|---|
| Ancho de banda de memoria | 4.8 TB/s | Especificación del fabricante para H200. |
| Tarifa bajo demanda | $3.59 / GPU-hora | Solo computación, antes de almacenamiento o servicios opcionales. |
| Regiones disponibles | París · Fráncfort | Ambas regiones son seleccionables después del financiamiento. |
Método de decisión
El contenido a continuación separa las especificaciones publicadas, las referencias del catálogo de GPURento y las decisiones que aún requieren un benchmark de carga de trabajo.
H200 no es simplemente «un H100 más rápido». Su ventaja práctica es el subsistema de memoria de mayor capacidad y ancho de banda. Eso puede permitir que un modelo use menos GPU, mantenga un contexto más largo o atienda más secuencias concurrentes, según la cuantización y el runtime.
Para inferencia, registra tiempo hasta el primer token, tokens de salida por segundo, latencia p95 y coste por millón de tokens a un nivel de calidad fijo. Una GPU de alta memoria es valiosa solo si el runtime puede usar esa memoria y ancho de banda de manera eficiente.
El catálogo expone H200 en EU West París y EU Central Frankfurt. GPURento verifica la financiación de la cuenta, almacena la configuración e inicia el flujo de aprovisionamiento de autoservicio sin un formulario de ventas.
Lista corta de catálogo
141 GB HBM3e · $3.59/h
Inferencia de modelos grandes y HPC
80 GB HBM3 · $2.69/h
Entrenamiento intensivo e inferencia FP8
180 GB HBM3e · $5.98/h
Entrenamiento e inferencia de frontera
Preguntas
La configuración H200 descrita aquí tiene 141 GB de memoria HBM3e y un ancho de banda de memoria de 4.8 TB/s especificado por el fabricante.
Elija H200 cuando 80 GB fuerce sharding no deseado, limite el contexto o restrinja la concurrencia. Si su carga de trabajo ya cabe y está limitada por cómputo, compare ambos antes de pagar la tarifa de referencia más alta.
El catálogo actual de GPURento expone la creación de H200 de autoservicio en EU West París y EU Central Frankfurt.
Última revisión el 1 de septiembre de 2026. Las tarifas de GPURento son referencias de catálogo actuales; el estado de aprovisionamiento sigue siendo visible en el espacio de trabajo, y las especificaciones del fabricante no sustituyen a los benchmarks de carga de trabajo.
Continúa la investigación
Plan de despliegue
Cree un espacio de trabajo y elija París o Fráncfort con el tamaño de su modelo, el tiempo de ejecución y la concurrencia objetivo.