- 数据中心GPU候选列表
- 大型模型内存规划
- Hopper到Blackwell评估
- 具有明确权衡的容量简报
NVIDIA 数据中心对比
H100 vs H200 vs B200:根据瓶颈和可用性选择。
H100提供80 GB HBM3和成熟的Hopper路径;H200保持Hopper但将内存扩展到141 GB HBM3e;B200转向Blackwell,配备180 GB HBM3e。三者都有公开的GPURento规划费率和请求路径。在比较每token、检查点或完成作业的成本之前,请对相同工作负载进行基准测试。
由 GPURento 基础设施团队审核 · 2026 年 9 月 1 日
| H100 SXM | 80 GB · $2.69/小时 | 24小时计算场景为$64.56。 |
|---|---|---|
| H200 SXM | 141 GB · $3.59/小时 | 24小时计算场景为$86.16。 |
| B200 | 180 GB · $5.98/小时 | 24小时计算场景为$143.52。 |
| 决策规则 | 内存,然后时间/作业 | 使用兼容的软件和相同的输入。 |
- 将峰值规格视为基准
- 忽略端到端系统成本
- 比较不同的模型质量或软件版本
决策方法
部署容量前需验证的事项。
以下内容区分了已发布的规格、GPURento 目录参考和仍需工作负载基准测试的决策。
H100:成熟的Hopper性能
当80 GB足够且软件栈受益于Hopper transformer加速时,选择H100。它在三者中具有最广泛的GPURento请求地理覆盖,并且公共参考费率低于H200。
H200:解决内存密集型工作负载
当141 GB和更高的内存带宽减少分片、增加上下文或提高并发以抵消较高的每小时参考时,选择H200。如果工作负载仍然是计算密集且适配80 GB,验证增益。
- 测量相同模型所需的GPU
- 保持上下文和并发固定
- 比较每个可接受token或检查点的成本
B200:在Blackwell有回报的地方使用
B200提供三者中最大的内存和更新的架构,每GPU小时$5.98。当Blackwell吞吐量、180 GB内存或FP4支持抵消较高的每小时费率时使用它。
基准相同的系统边界
固定模型和数据集修订版、容器摘要、精度、上下文或批次、质量目标和检查点策略。单独记录预热,然后比较 p50 和 p95 端到端运行时间、峰值内存和总计算成本。制造商峰值是规格,不是 GPURento 基础设施的结果。
- 使用请求中显示的确切 GPU 外形规格
- 包括数据加载、预处理和检查点I/O
- 报告每个接受令牌、检查点或完成作业的成本
问题
清晰的答案,包括限制。
H200的VRAM比H100多吗?+
是的。列出的H200具有141 GB HBM3e,而H100 SXM为80 GB HBM3。
B200是否可在GPURento上租用?+
B200列为可请求配置,巴黎和法兰克福每GPU小时$5.98。目录不保证即时库存;请求时检查容量。
哪种每小时最便宜?+
H100起价$2.69/小时,H200起价$3.59/小时,B200起价$5.98/小时。每作业成本仍需基准测试。
- NVIDIA H100 产品页面制造商的架构和内存规格。
- NVIDIA H200 产品页面制造商提供的H200内存容量和带宽。
- NVIDIA HGX 参考架构H100、H200和B200内存配置的制造商参考。
最后审核于2026年9月1日。GPURento费率是当前目录参考;预配状态在工作区中保持可见,制造商规格不能替代工作负载基准测试。
继续研究