图像生成工作流

租用云 GPU 用于 Stable Diffusion 和 ComfyUI。

直接回答

Stable Diffusion 和 ComfyUI 工作负载通常最好由确切的图、检查点、分辨率、批次和辅助模型匹配。RTX 4090 提供 GPURento 参考价 $0.34/小时,24 GB;RTX 5090 提供 32 GB,$0.69/小时;L40S 提供 48 GB,$0.79/小时,当工作流需要更多余量时。

由 GPURento 基础设施团队审核 · 2026 年 9 月 1 日

透明规划窗口

一个上的示例租赁成本 RTX 4090.

这些是计算租赁窗口,不是作业持续时间或性能的预测。用测量的试点替换小时数,并在计算器中添加存储。

调整每个假设

一个工作会话

$2.72

1 GPU × 8小时 · 仅计算

四十小时窗口

$13.60

1 GPU × 40小时 · 仅计算

一百二十小时

$40.80

1 GPU × 120小时 · 仅计算

关键事实 租用云 GPU 用于 Stable Diffusion 和 ComfyUI。
价值选项RTX 4090 · 24 GB$0.34/小时参考。
更多余量RTX 5090 · 32 GB$0.69/小时参考。
大型图L40S · 48 GB$0.79/小时参考。
按以下条件比较$ / 接受的输出保持分辨率、步骤和模型固定。
最适合
  • ComfyUI节点图
  • Stable Diffusion 和 FLUX 风格图像工作流
  • LoRA测试和批生成
  • 具有重复使用模式的持久模型库
不适合当
  • 具有未知自定义节点来源的图
  • 超出所选VRAM的工作流
  • 敏感输入没有审查的存储和保留计划

决策方法

部署容量前需验证的事项。

以下内容区分了已发布的规格、GPURento 目录参考和仍需工作负载基准测试的决策。

01

打包工作流以便可重复

固定容器、ComfyUI 版本、自定义节点提交、检查点哈希和输入设置。没有版本化依赖的视觉图不是可重现的工作负载。

02

为峰值图内存调整大小

检查点只是一个内存消费者。VAE、ControlNet、放大器、文本编码器和视频节点可能重叠。在选择最便宜的卡之前,运行代表性的高分辨率作业并记录峰值分配。

  • 从最大预期分辨率开始
  • 测试完整的辅助模型图
  • 保持输出和模型存储与计算分离
03

比较每个可接受图像或片段的成本

记录热运行时间、拒绝的输出和总计量 GPU 时间。模型下载和节点安装使冷运行更慢,这就是持久存储对重复会话有价值的原因。

问题

清晰的答案,包括限制。

我应该为ComfyUI租用哪种GPU?+

RTX 4090 是适合 24 GB 图的强大起点。当实际工作流需要更多内存时,选择 RTX 5090(32 GB)或 L40S(48 GB)。

GPURento是否提供一键ComfyUI模板?+

此页面不声称一键模板。GPU 云接受容器配置;在工作区中确认镜像和工作流要求。

如何降低成本?+

持久化可复用模型,保存输出后停止计算,并比较每个接受输出的成本,而不是峰值每秒图像数。

部署计划

请求适合完整图的 GPU。

创建工作区,使用确切的镜像、存储和区域设置,然后在请求容量之前为其充值。