한 시간
$3.59
GPU 1개 × 1h · 컴퓨팅 전용
고메모리 Hopper GPU
NVIDIA H200은 Hopper 컴퓨팅과 141GB HBM3e를 결합하여 모델 가중치, KV 캐시 또는 과학 데이터가 80GB 장치를 초과할 때 유용합니다. GPURento는 파리와 프랑크푸르트에서 셀프 서비스 생성을 통해 GPU 시간당 $3.59의 온디맨드 요금을 제공합니다.
GPURento 인프라 팀 검토 · 2026년 9월 1일
비용 시나리오
한 시간
$3.59
GPU 1개 × 1h · 컴퓨팅 전용
하루
$86.16
GPU 1개 × 24h · 컴퓨팅 전용
7일
$603.12
GPU 1개 × 168h · 컴퓨팅 전용
평균 월 · 730시간
$2620.70
GPU 1개 × 730h · 컴퓨팅 전용
| 메모리 | 141 GB HBM3e | H100 SXM보다 더 많은 단일 GPU 메모리. |
|---|---|---|
| 메모리 대역폭 | 4.8 TB/s | H200에 대한 제조업체 사양. |
| 온디맨드 요금 | $3.59 / GPU-시간 | 스토리지 또는 선택적 서비스 전 컴퓨팅만. |
| 사용 가능한 리전 | 파리 · 프랑크푸르트 | 자금 조달 후 두 리전 모두 선택할 수 있습니다. |
결정 방법
아래 콘텐츠는 게시된 사양, GPURento 카탈로그 참조 및 여전히 워크로드 벤치마크가 필요한 결정을 분리합니다.
H200은 단순히 "더 빠른 H100"이 아닙니다. 실질적인 이점은 더 크고 대역폭이 높은 메모리 하위 시스템입니다. 이로 인해 모델이 더 적은 GPU를 사용하거나, 더 긴 컨텍스트를 유지하거나, 양자화 및 런타임에 따라 더 많은 동시 시퀀스를 제공할 수 있습니다.
추론의 경우 고정 품질 수준에서 첫 번째 토큰까지의 시간, 초당 출력 토큰, p95 지연 시간 및 백만 토큰당 비용을 기록하십시오. 고메모리 GPU는 런타임이 해당 메모리와 대역폭을 효율적으로 사용할 수 있는 경우에만 가치가 있습니다.
카탈로그는 EU West Paris 및 EU Central Frankfurt에서 H200을 노출합니다. GPURento는 계정 자금을 확인하고 구성을 저장하며 영업 양식 없이 셀프 서비스 프로비저닝 워크플로를 시작합니다.
질문
여기에 설명된 H200 구성은 141GB의 HBM3e 메모리와 제조업체 지정 4.8TB/s 메모리 대역폭을 갖습니다.
80 GB가 원치 않는 샤딩을 강요하거나, 컨텍스트를 제한하거나, 동시성을 제약할 때 H200을 선택하세요. 워크로드가 이미 맞고 컴퓨팅 바운드라면 더 높은 참조 요금을 지불하기 전에 둘 다 벤치마킹하세요.
현재 GPURento 카탈로그는 EU West Paris 및 EU Central Frankfurt에서 셀프 서비스 H200 생성을 노출합니다.
2026년 9월 1일 마지막 검토. GPURento 요금은 현재 카탈로그 참조입니다. 프로비저닝 상태는 워크스페이스에 계속 표시되며 제조업체 사양은 워크로드 벤치마크를 대체하지 않습니다.
연구 계속