一小时
$2.39
1 GPU × 1小时 · 仅计算
AMD ROCm云GPU
AMD Instinct MI300X结合了CDNA 3、192 GB HBM3和高达5.3 TB/s的峰值内存带宽,适用于高内存AI和HPC工作负载。GPURento在巴黎和法兰克福列出MI300X,价格为每GPU小时$2.39,适用于具有已验证ROCm软件路径的团队。
由 GPURento 基础设施团队审核 · 2026 年 9 月 1 日
成本场景
一小时
$2.39
1 GPU × 1小时 · 仅计算
一天
$57.36
1 GPU × 24小时 · 仅计算
七天
$401.52
1 GPU × 168小时 · 仅计算
平均月 · 730小时
$1744.70
1 GPU × 730小时 · 仅计算
| 内存 | 192 GB HBM3 | AMD文档记录的高容量ECC内存。 |
|---|---|---|
| 内存带宽 | 最高 5.3 TB/s | 制造商提供的峰值理论带宽。 |
| 软件生态系统 | AMD ROCm | 部署前验证框架、内核和镜像兼容性。 |
| 按需费率 | $2.39 / GPU-小时 | 存储和可选服务之前的当前GPURento计算费率。 |
决策方法
以下内容区分了已发布的规格、GPURento 目录参考和仍需工作负载基准测试的决策。
MI300X不是每个CUDA环境的即插即用替代品。在比较性能或成本之前,确认框架版本、模型运行时、注意力内核、通信库和容器镜像在预期的ROCm版本下。
更大的单GPU内存池可以简化模型放置、容纳更多KV缓存或减少并行开销。好处取决于精度、运行时和流量形状,因此比较每个候选所需的GPU数量和总成本。
使用与NVIDIA比较相同的数据和服务目标测量端到端时间、利用率、内存压力和输出质量。峰值带宽和FLOPS不能替代应用程序结果。
目录候选清单
192 GB HBM3 · $2.39/小时
ROCm下的LLM训练、推理和HPC
141 GB HBM3e · $3.59/小时
大型模型推理和HPC
180 GB HBM3e · $5.98/小时
前沿训练和推理
80 GB HBM2e · $1.19/小时
训练、微调和 HPC
问题
AMD指定192 GB HBM3内存,全芯片ECC和高达5.3 TB/s的峰值理论内存带宽。
当前 GPURento 目录费率为每 MI300X GPU 小时 $2.39。存储和可选服务是分开的。
MI300X使用AMD ROCm生态系统而非NVIDIA CUDA。框架和模型可能支持两者,但仅CUDA的镜像和扩展需要兼容的ROCm实现或另一个GPU。
当192 GB内存和经过验证的ROCm堆栈适合工作负载时,MI300X可能具有吸引力。对于CUDA优先的软件,H200可能更简单。在实际模型上比较端到端结果。
最后审核于2026年9月1日。GPURento费率是当前目录参考;预配状态在工作区中保持可见,制造商规格不能替代工作负载基准测试。
继续研究