一个工作会话
$2.72
1 GPU × 8小时 · 仅计算
生成式媒体计算
AI视频生成可能内存和存储密集,成本由模型、帧数、分辨率、步骤和拒绝的输出驱动。GPURento列出RTX 4090、RTX 5090和L40S请求路径,参考价格为每GPU小时$0.34至$0.79。在确切的流水线上基准每个接受片段的美元成本。
由 GPURento 基础设施团队审核 · 2026 年 9 月 1 日
透明规划窗口
这些是计算租赁窗口,不是作业持续时间或性能的预测。用测量的试点替换小时数,并在计算器中添加存储。
一个工作会话
$2.72
1 GPU × 8小时 · 仅计算
四十小时窗口
$13.60
1 GPU × 40小时 · 仅计算
一百二十小时
$40.80
1 GPU × 120小时 · 仅计算
| 主要约束 | 峰值 VRAM | 时间和辅助模型可能会增加内存使用。 |
|---|---|---|
| 存储约束 | 模型 + 输出 | 大型检查点和片段在计算之外持久存在。 |
| 经济指标 | $ / 接受的片段 | 拒绝的生成是实际成本的一部分。 |
| 候选GPU | 4090 · 5090 · L40S | 24、32和48 GB选项。 |
决策方法
以下内容区分了已发布的规格、GPURento 目录参考和仍需工作负载基准测试的决策。
小预览不能预测长片段。运行生产计划中的模型、帧数、分辨率、精度、注意力模式和后期处理,然后记录峰值内存和墙钟时间。
视频检查点和输出可能很大。持久卷减少重复下载,但计算停止后仍会计费。设置保留规则并在移除临时资源前导出可接受的片段。
当额外显存避免卸载或实现预期分辨率时,RTX 5090 或 L40S 每个片段可能更便宜。如果计算图在 24 GB 内无妥协地适配,RTX 4090 可能保持总成本更低。
问题
从适合完整工作流的最低成本卡开始。RTX 4090 有 24 GB,RTX 5090 有 32 GB,L40S 在 GPURento 目录中有 48 GB。
在目标设置下测量多个输出的总GPU时间,包括被拒绝的片段,然后添加模型和输出存储。
持久存储旨在比计算更持久,但它仍然是单独的成本。在停止资源之前,请确认输出和模型数据已保存。
最后审核于2026年9月1日。GPURento费率是当前目录参考;预配状态在工作区中保持可见,制造商规格不能替代工作负载基准测试。
继续研究