
NVIDIA GB300
VESSL Cloud에서 NVIDIA GB300 NVL72 물량을 예약하세요. 랙 하나에 Blackwell Ultra GPU 72장과 Grace CPU 36개가 130 TB/s NVLink로 묶여 있어, 클러스터급 학습과 동시 요청이 많은 추론 서빙까지 감당해요.
- GPU 메모리
- up to 288GB HBM3e
- 메모리 대역폭
- 8 TB/s
기술 사양
- 아키텍처
- Blackwell
- GPU 메모리
- up to 288GB HBM3e
- 메모리 대역폭
- 8 TB/s
- NVLink
- 1.8 TB/s
- FP8 (텐서)
- 10 PFLOPS
- FP4 (텐서)
- 20 PFLOPS
- 최대 TDP
- 1,400W
- 노드당 GPU
- 72 + 36 Grace CPUs (NVL72 rack)
*희소성(sparsity) 적용 시 이론상 최대 성능이며 NVIDIA 공식 사양 기준이에요. 노드 구성에 따라 달라질 수 있어요.
요금 및 이용 안내
GB300은 어디에 쓰면 좋을까요?
클러스터급 학습
NVL72 랙 하나가 거대한 가속기 한 대처럼 움직여요. 약 20TB HBM3e와 130 TB/s NVLink 덕분에 조 단위 파라미터 모델도 느린 네트워크를 거치지 않고 메모리에 올린 채 학습해요.
랙 스케일 추론 서빙
하나로 묶인 NVLink 도메인에 큰 KV 캐시를 GPU 72장에 나눠 올려, reasoning과 agentic 워크로드의 동시 요청을 더 낮은 토큰당 비용으로 서빙해요.
CPU 비중이 큰 AI 파이프라인
Grace CPU 36개가 GPU와 같은 NVLink 위에 있어요. 데이터 전처리와 추론 오케스트레이션이 PCIe 병목 없이 가속기로 바로 이어져요.
어떤 NVIDIA GPU가 맞을까요?
| A100 Ampere | H100 Hopper | H200 Hopper | B200 Blackwell | B300 Blackwell | GB300 현재 보고 있는 모델 | |
|---|---|---|---|---|---|---|
| 아키텍처 | Ampere | Hopper | Hopper | Blackwell | Blackwell | Blackwell |
| GPU 메모리 | 80GB HBM2e | 80GB HBM3 | 141GB HBM3e | 192GB HBM3e | up to 288GB HBM3e | up to 288GB HBM3e |
| 메모리 대역폭 | 2.0 TB/s | 3.35 TB/s | 4.8 TB/s | 8 TB/s | 8 TB/s | 8 TB/s |
| FP8 (텐서) | — | 3,958 TFLOPS | 3,958 TFLOPS | 9 PFLOPS | 10 PFLOPS | 10 PFLOPS |
| 이용 방식 | 최저 $1.39/시간 | 최저 $3.19/시간 | 최저 $4.29/시간 | 최저 $5.79/시간 | 최저 $7.29/시간 | 예약 전용 |
| 추천 용도 | 가성비 파인튜닝과 추론 | 가성비 학습과 추론 | 긴 문맥과 대형 모델 추론 | FP4 최신 대형 모델 학습 | 초대형 모델과 동시 요청이 많은 추론 | 클러스터급 학습과 추론 |
앞서가는 팀들이 VESSL Cloud를 선택한 이유
기다림 없이 바로 시작
여러 클라우드의 GPU를 한곳에 모아둬서, 할당량이나 복잡한 절차 없이 바로 시작할 수 있어요.
한 대부터 클러스터 규모까지
고속 InfiniBand로 묶은 HGX 노드로, GPU 한 대부터 대규모 멀티 노드 클러스터까지 필요한 만큼 늘릴 수 있어요.
쓴 만큼만 투명하게
온디맨드부터 예약형까지, 쓴 만큼만 내는 종량제예요.
엔터프라이즈 보안도 문제없어요
SOC 2 Type II 인증에 상용 AI 전담 지원까지 갖춰서, 엔터프라이즈 규모에서도 안심하고 쓸 수 있어요.
자주 묻는 질문
NVIDIA GB300은 어떻게 이용하나요?
GB300 물량은 예약제로, 문의 후 배정해 드려요. NVL72 구성과 도입 일정은 팀과 상의해 미리 예약할 수 있어요.
GB300 NVL72는 무엇인가요?
Blackwell Ultra GPU 72장과 Grace CPU 36개를 130 TB/s NVLink 하나로 묶은 랙 스케일(rack-scale) 시스템이에요. 랙 전체가 큰 가속기 한 대처럼 움직여요.
B300과 GB300은 뭐가 다른가요?
GPU는 같은 Blackwell Ultra예요. B300은 8장 단위 HGX 노드로 제공되고, GB300은 GPU 72장과 Grace CPU 36개를 NVL72 랙으로 묶어 130 TB/s NVLink 도메인 위에서 클러스터급 워크로드를 실행하도록 만들어졌어요.
GB300 메모리는 얼마인가요?
GPU당 최대 288GB HBM3e, 랙 하나 기준 약 20TB예요. Grace CPU 쪽에도 LPDDR5X 17TB가 있어요.
GB300 클러스터 전체를 예약할 수 있나요?
네. GB300은 NVL72 랙 단위로 제공되고, 랙 하나부터 여러 랙 구성까지 확장할 수 있어요. 물량과 일정은 팀에 문의해 주세요.
다른 GPU도 살펴보기
워크로드가 다르다면, 메모리, 처리량, 예산에 맞는 GPU를 골라보세요.
최대 288GB HBM3e를 갖춘 Blackwell Ultra예요. 가장 큰 모델과 동시 요청이 많은 추론 서빙을 위한 GPU예요.
자세히 보기192GB HBM3e와 FP4 가속을 갖춘 Blackwell이에요. 최신 대형 모델 학습과 높은 처리량 추론에 맞아요.
자세히 보기H100과 같은 Hopper 연산에 141GB HBM3e를 더해, 여러 GPU로 쪼개지 않고 긴 문맥 LLM과 더 큰 모델을 실행할 수 있어요.
자세히 보기