Une heure
$3.59
1 GPU × 1h · calcul uniquement
GPU Hopper à mémoire élevée
Le NVIDIA H200 associe le calcul Hopper à 141 Go de HBM3e, ce qui le rend utile lorsque les poids du modèle, le cache KV ou les données scientifiques dépassent un appareil de 80 Go. GPURento répertorie un tarif à la demande de 3,59 $ par GPU-heure avec création en libre-service à Paris et Francfort.
Examiné par l'équipe d'infrastructure GPURento · 1er septembre 2026
Scénarios de coûts
Une heure
$3.59
1 GPU × 1h · calcul uniquement
Un jour
$86.16
1 GPU × 24h · calcul uniquement
Sept jours
$603.12
1 GPU × 168h · calcul uniquement
Mois moyen · 730h
$2620.70
1 GPU × 730h · calcul uniquement
| Mémoire | 141 Go HBM3e | Plus de mémoire sur GPU unique que H100 SXM. |
|---|---|---|
| Bande passante mémoire | 4,8 To/s | Spécification fabricant pour H200. |
| Tarif à la demande | $3,59 / GPU-heure | Calcul uniquement, avant le stockage ou les services optionnels. |
| Régions disponibles | Paris · Francfort | Les deux régions sont sélectionnables après financement. |
Méthode de décision
Le contenu ci-dessous sépare les spécifications publiées, les références du catalogue GPURento et les décisions qui nécessitent encore un benchmark de charge de travail.
Le H200 n'est pas simplement « un H100 plus rapide ». Son avantage pratique réside dans son sous-système mémoire plus vaste et à plus grande bande passante. Cela peut permettre à un modèle d'utiliser moins de GPU, de conserver un contexte plus long ou de servir plus de séquences concurrentes, selon la quantification et l'exécution.
Pour l'inférence, enregistrez le temps jusqu'au premier jeton, les jetons de sortie par seconde, la latence p95 et le coût par million de jetons à un niveau de qualité fixe. Un GPU à mémoire élevée n'a de valeur que si l'exécution peut utiliser efficacement cette mémoire et cette bande passante.
Le catalogue expose H200 dans l'UE Ouest Paris et l'UE Centre Francfort. GPURento vérifie le financement du compte, stocke la configuration et lance le flux de provisionnement en libre-service sans formulaire de vente.
Liste restreinte du catalogue
141 Go HBM3e · $3,59/h
Inférence de grands modèles et HPC
80 Go HBM3 · $2,69/h
Entraînement intensif et inférence FP8
180 Go HBM3e · $5,98/h
Entraînement et inférence de pointe
Questions
La configuration H200 décrite ici dispose de 141 Go de mémoire HBM3e et d'une bande passante mémoire spécifiée par le fabricant de 4,8 To/s.
Choisissez le H200 lorsque 80 Go force un sharding indésirable, limite le contexte ou contraint la concurrence. Si votre charge de travail tient déjà et est liée au calcul, comparez les deux avant de payer le taux de référence plus élevé.
Le catalogue GPURento actuel expose la création en libre-service de H200 dans l'UE Ouest Paris et l'UE Centre Francfort.
Dernière révision le 1er septembre 2026. Les tarifs GPURento sont des références de catalogue actuelles ; l'état de provisionnement reste visible dans l'espace de travail, et les spécifications du fabricant ne remplacent pas les benchmarks de charge de travail.
Continuer la recherche
Plan de déploiement
Créez un espace de travail et choisissez Paris ou Francfort avec la taille de votre modèle, l'environnement d'exécution et la concurrence cible.