NVIDIA-GPU-Server, CUDA-bereit in Minuten.
Monatlich abgerechnete GPU-Server auf NVIDIA-A16- und -A40-Hardware: vom $90-Anteil für Inferenz und Encoding bis zu 2x- und 4x-A16-Servern mit 64 GB GPU-Speicher. Sieben Städte, voller Root-Zugriff, Treiber beim ersten Start, zahlbar per PayPal oder Krypto.
Alle GPU-Pläne, die wir anbieten
Heute bestellbar, mit den Städten, die Kapazität für die jeweilige Größe haben. Der Konfigurator zeigt den aktuellen Preis für Ihre Stadt.
A16, 1/8 GPU einstieg
Inferenz, Encoding, CUDA-Entwicklungsserver
A40, 1/24 GPU
Ampere-Karte, mehr NVMe und Traffic
A16, 1/4 GPU
Bildgenerierung, mittelgroße Modelle
A16, 1/2 GPU
Halbe Karte, 8 GB GPU-Speicher
2x A16 multi-gpu
Zwei volle Karten, parallele Inferenz-Worker
4x A16 multi-gpu
Vier Karten, 64 GB GPU-Speicher in einem Server
Unsere Endkundenpreise in USD am günstigsten Standort; in einigen Metropolen kommt ein Aufschlag dazu, und nicht jeder Plan ist an jedem Standort verfügbar. Der Konfigurator zeigt aktuelle Preise und Verfügbarkeit für die gewählte Stadt. Eine einzelne volle A16 (16 GB) und die größeren A40-Stufen erscheinen im Konfigurator nur, solange eine Stadt Kapazität dafür hat.
Mieten Sie einen Teil der Karte oder gleich mehrere Karten
So funktioniert fraktionale GPU: ein fester Anteil am Chip und seinem Speicher, kein Zeitfenster, auf das Sie warten müssen.
1/8 bis 1/2 einer GPU
Ein fester Anteil an der Karte mit eigenem GPU-Speicher (2 bis 8 GB). CUDA funktioniert genau wie auf einer vollen Karte; Sie wählen nur den Speicher passend zu Modell oder Workload.
2x- und 4x-A16-Server
Skalieren Sie auf 32 oder 64 GB GPU-Speicher über mehrere Karten, für parallele Inferenz-Worker oder Batch-Pipelines.
CUDA-bereit beim ersten Start
GPU-Pläne starten CUDA-fertige Linux-Images mit NVIDIA-Treibern passend zur Plan-Familie, sodass nvidia-smi schon beim ersten Start funktioniert. Voller Root-Zugriff, Neuinstallation im Panel, Ihre Schlüssel.
Sieben Städte mit GPU-Kapazität
Anzahl der Pläne pro Stadt, Stand heute. Kapazität ändert sich; maßgeblich ist der Konfigurator beim Checkout.
- 01/BangaloreIndia5 Pläne · bis zu 4x A16
- 02/Silicon ValleyUnited States4 Pläne · bis zu 2x A16
- 03/ChicagoUnited States3 Pläne · bis zu 1/2 A16
- 04/FrankfurtGermany3 Pläne · bis zu 1/2 A16
- 05/SingaporeSingapore3 Pläne · bis zu 1/2 A16
- 06/TokyoJapan3 Pläne · bis zu 1/2 A16
- 07/New YorkUnited States2 Pläne · A16 1/8, A40 1/24
- netzwerkVultr, 10-Gbps-Ports
- ipv4dediziert, inklusive
- imagesUbuntu, Debian + Treiber
- bereitstellungMinuten nach Zahlung
- supportder Ingenieur, der es betreibt
Ehrliche Einordnung: A16 und A40, nicht H100
Wofür diese Karten gedacht sind, and what they are not.
Läuft hier gut
Inferenz auf kleinen und mittelgroßen Modellen, Bildgenerierung auf den 8- bis 16-GB-Stufen, Video-Encoding und Transcoding, virtuelle Desktops und Cloud-Gaming, CUDA-Entwicklung und CI-Runner.
Das falsche Werkzeug
Training oder Betrieb von LLMs auf Frontier-Niveau. Eine A16 ist keine H100, und das sagen wir lieber hier als nach der Bereitstellung. Wenn Ihr Job 80 GB HBM braucht, mieten Sie diese Kartenklasse woanders und nutzen Sie uns für alles drumherum.
Warum GPU im Monatstarif
Ein fester Monatspreis aus Ihrem Prepaid-Guthaben statt einer stundengenauen Abrechnung. Per PayPal oder Krypto aufladen, bereitstellen und schon vor Monatsbeginn wissen, was der Monat kostet.
Fragen zu GPU-VPS
Klare Antworten. Alles Weitere fragen Sie vor der Bestellung.
01/Welche GPU-Modelle bieten Sie an?
NVIDIA A16 (von Bruchteilen bis zu 4x vollen Karten) und ein Einstiegsanteil einer NVIDIA A40. A100- oder H100-Instanzen verkaufen wir nicht, und wir tun auch nicht so, als könnte eine A16 sie ersetzen.
02/Kann ich darauf große Sprachmodelle betreiben oder trainieren?
Inferenz kleiner und mittelgroßer Modelle passt gut auf die Stufen von 8 bis 64 GB. Fine-Tuning kleiner Modelle ist auf den Multi-GPU-Servern möglich. Großes Training gehört auf Rechenzentrumskarten mit mehr Speicherbandbreite, als diese Klasse bietet.
03/Sind Treiber und CUDA in den Images enthalten?
Ja. GPU-Pläne starten CUDA-fertige Linux-Images mit NVIDIA-Treibern passend zur Plan-Familie, sodass nvidia-smi schon beim ersten Start funktioniert.
04/Wie funktioniert die Abrechnung?
Die Pläne laufen monatlich und werden von Ihrem Prepaid-Kontoguthaben bezahlt. Aufladen per PayPal oder mit einer von 18 Kryptowährungen, darunter Bitcoin und Monero; ohne Karte und ohne Ausweis.
05/Ist jeder Plan an jedem Standort verfügbar?
Nein. Die GPU-Kapazität unterscheidet sich je nach Stadt in den sieben Standorten, die sie führen, und einige Metros sind etwas teurer. Das Bestellformular zeigt die aktuelle Verfügbarkeit und den genauen Preis für den gewählten Standort.
CUDA-fertigen GPU-Server bereitstellen
Vom $90-Anteil bis zum 4x-A16-Server. Sieben Städte, monatliche Preise, Krypto willkommen.