一小时
$3.59
1 GPU × 1小时 · 仅计算
高内存Hopper GPU
NVIDIA H200 将 Hopper 计算与 141 GB HBM3e 相结合,当模型权重、KV 缓存或科学数据超过 80 GB 设备时非常有用。GPURento 列出按需价格为每 GPU 小时 $3.59,在巴黎和法兰克福提供自助服务创建。
由 GPURento 基础设施团队审核 · 2026 年 9 月 1 日
成本场景
一小时
$3.59
1 GPU × 1小时 · 仅计算
一天
$86.16
1 GPU × 24小时 · 仅计算
七天
$603.12
1 GPU × 168小时 · 仅计算
平均月 · 730小时
$2620.70
1 GPU × 730小时 · 仅计算
| 内存 | 141 GB HBM3e | 比H100 SXM更多的单GPU内存。 |
|---|---|---|
| 内存带宽 | 4.8 TB/s | H200的制造商规格。 |
| 按需费率 | $3.59 / GPU-小时 | 仅计算,不含存储或可选服务。 |
| 可用区域 | 巴黎 · 法兰克福 | 两个区域在资金后都可选择。 |
决策方法
以下内容区分了已发布的规格、GPURento 目录参考和仍需工作负载基准测试的决策。
H200不仅仅是“更快的H100”。其实际优势在于更大、更高带宽的内存子系统。这可以让模型使用更少的GPU、保持更长的上下文或服务更多并发序列,具体取决于量化和运行时。
对于推理,在固定质量水平下记录首个token时间、每秒输出token、p95延迟和每百万token成本。高内存GPU仅在运行时能有效利用该内存和带宽时才有价值。
目录在欧盟西部巴黎和欧盟中部法兰克福提供 H200。GPURento 检查账户资金,存储配置,并启动自助服务配置工作流,无需销售表格。
问题
此处描述的 H200 配置具有 141 GB 的 HBM3e 内存和制造商指定的 4.8 TB/s 内存带宽。
当80 GB强制不必要的分片、限制上下文或约束并发时,选择H200。如果您的工作负载已经适配且计算密集,在支付较高的参考费率之前基准两者。
当前 GPURento 目录在欧盟西部巴黎和欧盟中部法兰克福提供自助 H200 创建。
最后审核于2026年9月1日。GPURento费率是当前目录参考;预配状态在工作区中保持可见,制造商规格不能替代工作负载基准测试。
继续研究