VESSL CloudVM Cluster

전용 멀티노드 GPU 클러스터

InfiniBand로 묶인 전용 GPU 클러스터를 주 단위로 빌려보세요. H100부터 최신 Blackwell까지, 모든 노드에 root 권한이 주어져요.

VM Cluster가 필요한 순간

대규모 분산 학습에 맞춰 만든 전용 클러스터예요.

멀티노드 분산 학습

InfiniBand가 기본으로 깔려 있어 노드 사이를 대역폭 높고 지연 없는 RDMA로 연결해요. 데이터 병렬이나 모델 병렬 처리 모두 막힘없이 확장할 수 있어요.

완전한 root 제어

GPU 드라이버를 바꾸거나 커널 모듈을 올리고, OS도 원하는 대로 구성해 보세요. 모든 노드를 root 권한으로 자유롭게 다룰 수 있어요.

베어메탈급 성능, 전용 하드웨어

GPU passthrough 방식이라 각 VM이 GPU를 직접 점유해 오버헤드가 거의 없어요. 하드웨어는 다른 고객과 공유하지 않는 전용 구성이고, sudo로 완전한 root 권한도 그대로 써요.

쓰던 스택 그대로

Slurm, Kubernetes, 보안 에이전트, 자체 배포 스크립트까지 직접 설치해서 쓰세요.

제공 사양

주문하면 이대로 받아요.

형태GPU를 직접 점유하는(passthrough) 전용 VM
GPU노드당 8장 (NVIDIA H100, H200, B200, B300)
클러스터 크기InfiniBand로 묶인 멀티노드, 세일즈팀과 구성
OS 이미지Ubuntu 24.04, CUDA 사전 설치
네트워킹노드 간 InfiniBand, 노드당 전용 공인 IP
부팅 디스크노드당 2 TiB
공유 스토리지선택형 NFS, 1~200 TiB
접속모든 노드 root 권한
계약 기간4~52주 선불 예약

H100부터 최신 Blackwell(H200, B200, B300, GB300)까지, 노드 한 대부터 수백~1,000장 이상 규모까지 제공해요. 세일즈팀에 문의하면 워크로드에 맞춰 클러스터를 구성해 드려요.

가격

H100 SXM 기준가$3.19GPU/시간
NFS 공유 스토리지$0.20GiB/월

VM Cluster는 4~52주 선불 예약 계약이에요. 노드 1개에 GPU 8장이 들어가요. 예약 계약 단가는 기간과 규모에 따라 달라져서 세일즈팀과 견적으로 확정해요.

곧 만나요, 더 다양한 클러스터

VM Cluster로는 지금 바로 인프라를 직접 제어할 수 있어요. 운영 부담을 덜고 싶은 팀을 위한 관리형 옵션도 준비하고 있어요.

곧 출시

Managed Kubernetes

GPU에 맞춰 구성한 Kubernetes를 초기 셋업부터 운영까지 관리형으로 준비하고 있어요. 드라이버, 디바이스 플러그인, CUDA, NCCL을 검증된 조합으로 올리고, 컨트롤 플레인 고가용성과 노드 자동 복구까지 함께요.

세일즈팀에 문의
곧 출시

Managed Slurm

연구실에서 쓰던 Slurm 환경을 클라우드 GPU에서 그대로 이어가도록 준비하고 있어요. sbatch, srun, 작업 사용량 기록 같은 익숙한 흐름은 그대로 두고, 관리형 컨트롤 플레인과 공유 파일시스템 위에서 동작해요. 문제가 생긴 노드는 자동으로 감지해서 교체해요.

세일즈팀에 문의

자주 묻는 질문

쓸 수 있는 GPU와 클러스터 크기는요?

H100부터 최신 Blackwell(H200, B200, B300, GB300)까지, 노드 한 대부터 1,000장 이상 규모까지 제공해요. 세일즈팀에 문의하면 워크로드에 맞춰 구성해 드리고, 한 번 설정되면 대시보드에 나타나요.

베어메탈이 아니라 VM인 이유가 뭔가요?

GPU passthrough로 베어메탈에 가까운 성능과 sudo 기반 완전한 root 권한은 그대로예요. VM이라 준비도 빨라서 대부분 주문 후 영업일 며칠 안에 클러스터를 받아요. 베어메탈이 꼭 필요하다면 세일즈팀에 문의하세요.

계약은 어떻게 되나요?

4~52주 선불 예약이에요. 노드 수와 사양은 계약 기간 동안 고정되고, 바꾸려면 새로 주문해야 해요. 자동 확장은 없고, 더 긴 기간은 세일즈팀과 진행해요.

VESSL Cloud 크레딧으로 결제할 수 있나요?

아니요. VM Cluster는 별도의 선불 인보이스로 청구되며, VESSL Cloud 크레딧으로는 결제할 수 없어요.

계약이 끝나면 데이터는 어떻게 되나요?

만료 즉시 모든 데이터가 삭제되고, 유예 기간은 없어요. 만료일 전에 꼭 백업하세요.

노드를 얼마나 제어할 수 있나요?

완전한 root 권한이에요. GPU 드라이버와 커널 모듈을 바꾸고, SSH 키를 직접 관리하고, 권한 있는 컨테이너(Docker --privileged, 커스텀 capability, raw 디바이스 마운트)도 실행할 수 있어요. 원하는 오케스트레이터를 직접 설치해도 돼요.

InfiniBand를 제공하나요?

네. 멀티노드 통신을 위해 모든 노드에 InfiniBand가 기본으로 제공돼요.

관리형 Kubernetes나 Slurm을 제공하나요?

아직은 아니고 로드맵에 있어요. 그때까지는 root 권한이 있으니 Kubernetes, Slurm을 비롯한 어떤 오케스트레이터든 직접 설치해 쓸 수 있어요.

Workspace나 Job과는 뭐가 다른가요?

Workspace와 Job은 노드 한 대에서 GPU를 최대 8장까지 쓰는 싱글노드 환경이에요. VM Cluster는 노드 한 대로 부족할 때 InfiniBand로 묶인 여러 노드에서 분산 학습을 실행하도록 만들어졌어요. 셋 다 VESSL Cloud 안에 있어요. VESSL Cloud는 싱글노드 Workspace와 Job부터 전용 멀티노드 클러스터까지 아우르는 더 큰 개념이에요. Workspace나 Job으로 시작하고, 노드 한 대로 부족해지면 VM Cluster로 올라오세요.

AI 모델이
GPU를 만나는 곳

  • 몇 분 만에 개발 환경 세팅
  • 멀티노드 클러스터까지 확장
  • 필요한 시점에 맞춘 물량 확보
  • 전담 기술 지원