Uma sessão de trabalho
$2.72
1 GPU × 8h · apenas computação
Computação de mídia generativa
A geração de vídeo de IA pode ser pesada em memória e armazenamento, com custo impulsionado por modelo, contagem de frames, resolução, passos e saídas rejeitadas. A GPURento lista caminhos de pedido RTX 4090, RTX 5090 e L40S de $0.34 a $0.79 por GPU-hora de referência. Faça benchmark de dólares por clipe aceite no pipeline exato.
Revisto pela equipa de infraestrutura GPURento · 1 de setembro de 2026
Janelas de planeamento transparentes
Estas são janelas de aluguer de computação, não previsões de duração ou desempenho do trabalho. Substitua as horas por um piloto medido e adicione armazenamento na calculadora.
Uma sessão de trabalho
$2.72
1 GPU × 8h · apenas computação
Janela de quarenta horas
$13.60
1 GPU × 40h · apenas computação
Cento e vinte horas
$40.80
1 GPU × 120h · apenas computação
| Restrição primária | VRAM de pico | Modelos temporais e auxiliares podem aumentar o uso de memória. |
|---|---|---|
| Restrição de armazenamento | Modelos + saídas | Checkpoints e clipes grandes persistem além do compute. |
| Métrica económica | $ / clip aceite | Gerações rejeitadas fazem parte do custo real. |
| GPUs candidatas | 4090 · 5090 · L40S | Opções de 24, 32 e 48 GB. |
Método de decisão
O conteúdo abaixo separa especificações publicadas, referências de catálogo GPURento e decisões que ainda requerem um benchmark de carga de trabalho.
Uma pequena pré-visualização não prevê um clipe longo. Execute o modelo, contagem de frames, resolução, precisão, modo de atenção e pós-processamento planeados para produção e registe o pico de memória e o tempo de parede.
Checkpoints e saídas de vídeo podem ser grandes. Os volumes persistentes reduzem descarregamentos repetidos, mas mantêm a faturação depois de a computação parar. Defina uma regra de retenção e exporte os clipes aceites antes de remover recursos temporários.
A RTX 5090 ou L40S podem ser mais baratas por clip quando memória extra evita offload ou permite a resolução pretendida. Se o grafo couber em 24 GB sem compromisso, a RTX 4090 pode manter o total mais baixo.
Lista curta do catálogo
24 GB GDDR6X · $0.34/h
Imagem, vídeo e inferência de tamanho médio
32 GB GDDR7 · $0.69/h
Inferência e mídia rápidas de GPU única
48 GB GDDR6 ECC · $0.79/h
Inferência de produção, fine-tuning e vídeo
Perguntas
Comece com a placa de menor custo que caiba no fluxo de trabalho completo. A RTX 4090 tem 24 GB, a RTX 5090 tem 32 GB e a L40S tem 48 GB no catálogo GPURento.
Meça o tempo total de GPU para várias saídas nas configurações alvo, inclua clipes rejeitados e, em seguida, adicione armazenamento de modelo e saída.
O armazenamento persistente é concebido para sobreviver à computação, mas continua a ser um custo separado. Confirme que os resultados e dados do modelo são guardados antes de parar um recurso.
Última revisão em 1 de setembro de 2026. As taxas da GPURento são referências atuais do catálogo; o estado de provisionamento permanece visível no espaço de trabalho, e as especificações do fabricante não substituem benchmarks de carga de trabalho.
Continuar a pesquisa
Plano de implementação
Guarde o modelo exato, resolução, duração e configuração de armazenamento num pedido de capacidade financiado.