Une session de travail
$9.52
1 GPU × 8h · calcul uniquement
Infrastructure d'entraînement IA
Planifiez l'entraînement LLM à partir du nombre de paramètres, de la précision, de l'état de l'optimiseur, des activations, de la longueur de séquence, de la stratégie de parallélisme, du débit de checkpoint et du temps mesuré jusqu'au checkpoint. Comparez A100, H100, H200 et B200 par coût total de run, pas par spécifications de pointe théoriques.
Examiné par l'équipe d'infrastructure GPURento · 1er septembre 2026
Fenêtres de planification transparentes
Ce sont des fenêtres de location de calcul, pas des prédictions de durée de travail ou de performance. Remplacez les heures par un pilote mesuré et ajoutez le stockage dans le calculateur.
Une session de travail
$9.52
1 GPU × 8h · calcul uniquement
Fenêtre de quarante heures
$47.60
1 GPU × 40h · calcul uniquement
Cent vingt heures
$142.80
1 GPU × 120h · calcul uniquement
| Commencer avec | VRAM de pointe | Les poids seuls sous-estiment la mémoire d'entraînement. |
|---|---|---|
| Mesurer | Temps jusqu'au checkpoint | Utilisez un modèle, un ensemble de données et une cible de qualité fixes. |
| Inclure | Stockage + temps de redémarrage | Ils affectent le coût total d'exécution et la fiabilité. |
| Chemin disponible | A100 · H100 · H200 · B200 | Chaque modèle a un prix horaire public. |
Méthode de décision
Le contenu ci-dessous sépare les spécifications publiées, les références du catalogue GPURento et les décisions qui nécessitent encore un benchmark de charge de travail.
Tenez compte des poids, des gradients, des états de l'optimiseur, des activations, des tampons de communication et des frais généraux du framework. La précision mixte, le checkpointing d'activation et le sharding modifient le résultat, donc chaque estimation nécessite une marge de sécurité et une courte exécution de validation.
L'unité utile est souvent le coût par checkpoint accepté. Enregistrez les échantillons par seconde, la durée du checkpoint, le débit de stockage, le temps de redémarrage et la politique d'échec. Des GPU plus rapides ne peuvent pas réparer un pipeline bloqué par les données d'entrée ou un stockage de checkpoint lent.
FSDP ou ZeRO, les parallélismes de données, de tenseurs, de pipelines et d'experts sollicitent différents liens. Enregistrez les jetons par seconde, la part de communication et l'efficacité de mise à l'échelle, puis comparez le coût par checkpoint au nombre de GPU prévu.
Liste restreinte du catalogue
80 Go HBM2e · $1,19/h
Entraînement, fine-tuning et HPC
80 Go HBM3 · $2,69/h
Entraînement intensif et inférence FP8
141 Go HBM3e · $3,59/h
Inférence de grands modèles et HPC
180 Go HBM3e · $5,98/h
Entraînement et inférence de pointe
Questions
Il n'y a pas de gagnant universel. A100 peut minimiser le coût horaire, H100 peut raccourcir les exécutions de transformeurs, H200 aide les travaux limités par la mémoire, et B200 est un choix de planification de capacité. Comparez la même étape d'entraînement.
Multipliez les heures de bout en bout mesurées par le nombre de GPU et le tarif, puis ajoutez le stockage persistant, les frais de point de contrôle et les nouvelles tentatives attendues. Utilisez un essai pilote plutôt que des FLOPS théoriques.
Les versements sur le portefeuille commencent à $50. Choisissez le montant à ajouter. Il s’agit de crédit prépayé, pas de frais d’accès. Les locations mensuelles de GPU se règlent dans un parcours de paiement distinct.
Dernière révision le 1er septembre 2026. Les tarifs GPURento sont des références de catalogue actuelles ; l'état de provisionnement reste visible dans l'espace de travail, et les spécifications du fabricant ne remplacent pas les benchmarks de charge de travail.
Continuer la recherche
Plan de déploiement
Créez un espace de travail, ajoutez le crédit de portefeuille requis et enregistrez le nombre de GPU, l'image, la région et la configuration de stockage.