NVIDIA GPU 서버, 몇 분이면 CUDA 사용 가능.
NVIDIA A16 및 A40 하드웨어를 쓰는 월 단위 GPU 서버입니다. 추론과 인코딩용 $90 분할 GPU부터 GPU 메모리 64 GB의 2x, 4x A16 서버까지 제공합니다. 7개 도시, 전체 root 권한, 첫 부팅부터 드라이버 제공, PayPal 또는 암호화폐로 결제할 수 있습니다.
판매 중인 모든 GPU 플랜
오늘 바로 주문할 수 있으며, 각 크기의 용량이 있는 도시를 함께 표시합니다. 구성기에서 해당 도시의 실시간 가격을 확인하세요.
A16, 1/8 GPU 입문
추론, 인코딩, CUDA 개발 서버
A40, 1/24 GPU
Ampere 카드, 더 큰 NVMe와 전송량
A16, 1/4 GPU
이미지 생성, 중형 모델
A16, 1/2 GPU
카드 절반, GPU 메모리 8 GB
2x A16 멀티 GPU
풀 카드 2장, 병렬 추론 워커
4x A16 멀티 GPU
카드 4장, 한 서버에 GPU 메모리 64 GB
가장 저렴한 지역 기준의 USD 판매가입니다. 일부 대도시는 할증이 붙고, 모든 플랜이 모든 지역에 제공되지는 않습니다. 선택한 도시의 실시간 가격과 재고는 구성기에서 확인할 수 있습니다. 풀 A16 한 장(16 GB)과 상위 A40 등급은 해당 도시에 용량이 있을 때만 구성기에 표시됩니다.
카드의 일부 또는 여러 장을 빌리세요
분할 GPU 작동 방식: 대기열에 들어가는 시간 분할이 아니라, 칩과 메모리의 고정된 몫입니다.
GPU의 1/8에서 1/2까지
카드의 전용 몫과 자체 GPU 메모리(2~8 GB)를 받습니다. CUDA는 풀 카드와 똑같이 동작하며, 모델이나 작업량에 맞춰 메모리 크기만 고르면 됩니다.
2x 및 4x A16 서버
여러 장의 카드를 묶어 총 32 GB 또는 64 GB GPU 메모리로 확장해 병렬 추론 워커나 배치 파이프라인을 돌릴 수 있습니다.
첫 부팅부터 CUDA 사용 가능
GPU 플랜은 플랜 계열에 맞는 NVIDIA 드라이버가 포함된 CUDA 지원 Linux 이미지로 배포되므로 nvidia-smi가 첫 부팅부터 동작합니다. 전체 root 권한, 패널에서 재설치, 사용자 키 사용.
GPU 용량을 갖춘 7개 도시
오늘 기준 도시별 플랜 수입니다. 용량은 변동되며, 결제 시점의 기준은 구성기입니다.
- 01/BangaloreIndia플랜 5개 · 최대 4x A16
- 02/Silicon ValleyUnited States플랜 4개 · 최대 2x A16
- 03/ChicagoUnited States플랜 3개 · 최대 1/2 A16
- 04/FrankfurtGermany플랜 3개 · 최대 1/2 A16
- 05/SingaporeSingapore플랜 3개 · 최대 1/2 A16
- 06/TokyoJapan플랜 3개 · 최대 1/2 A16
- 07/New YorkUnited States플랜 2개 · A16 1/8, A40 1/24
- 네트워크Vultr, 10 Gbps 포트
- ipv4전용, 포함
- 이미지Ubuntu, Debian + 드라이버
- 배포 시간결제 후 수 분
- 지원직접 운영하는 엔지니어
솔직한 사양 안내: H100이 아닌 A16과 A40
이 카드의 용도, and what they are not.
여기서 잘 돌아갑니다
소형과 중형 모델 추론, 8~16 GB 등급에서의 이미지 생성, 영상 인코딩과 트랜스코딩, 가상 데스크톱과 클라우드 게이밍, CUDA 개발과 CI 러너.
적합하지 않은 용도
최전선급 LLM의 학습이나 서빙에는 맞지 않습니다. A16은 H100이 아니며, 배포한 뒤가 아니라 지금 말씀드리는 편이 낫다고 봅니다. 80 GB HBM이 필요한 작업이라면 그 등급의 카드는 다른 곳에서 빌리고, 주변 인프라는 저희에게 맡기세요.
월 단위 GPU를 권하는 이유
시간당 종량 청구 대신 선불 잔액에서 나가는 고정 월 요금입니다. PayPal이나 암호화폐로 충전하고 배포하면, 그달 비용을 시작 전에 알 수 있습니다.
01/어떤 GPU 모델을 제공하나요?
NVIDIA A16(분할부터 풀 카드 4장까지)과 입문용 NVIDIA A40 분할을 제공합니다. A100이나 H100 인스턴스는 판매하지 않으며, A16이 그 자리를 대신한다고 말하지도 않습니다.
02/여기서 대규모 언어 모델을 실행하거나 학습할 수 있나요?
소형과 중형 모델 추론은 8~64 GB 등급에 잘 맞습니다. 소형 모델의 파인튜닝은 멀티 GPU 서버에서 가능합니다. 대규모 학습은 이 등급보다 메모리 대역폭이 큰 데이터센터급 카드의 영역입니다.
03/이미지에 드라이버와 CUDA가 포함되나요?
네. GPU 플랜은 플랜 계열에 맞는 NVIDIA 드라이버가 포함된 CUDA 지원 Linux 이미지로 배포되므로 nvidia-smi가 첫 부팅부터 동작합니다.
04/결제는 어떻게 이루어지나요?
플랜은 월 단위이며 선불 계정 잔액에서 결제됩니다. PayPal이나 Bitcoin, Monero를 포함한 18종 암호화폐로 충전할 수 있고, 카드나 신분증은 필요 없습니다.
05/모든 플랜이 모든 지역에서 제공되나요?
아니요. GPU 용량은 이를 제공하는 7개 지역의 도시마다 다르며, 일부 대도시는 가격이 조금 더 높습니다. 주문 양식에서 선택한 지역의 실시간 가용성과 정확한 가격을 확인할 수 있습니다.