Initech
Cloud GPU · NVIDIA A16 / A40

NVIDIA-GPU-Server, CUDA-bereit in Minuten.

Monatlich abgerechnete GPU-Server auf NVIDIA-A16- und -A40-Hardware: vom $90-Anteil für Inferenz und Encoding bis zu 2x- und 4x-A16-Servern mit 64 GB GPU-Speicher. Sieben Städte, voller Root-Zugriff, Treiber beim ersten Start, zahlbar per PayPal oder Krypto.

hardwareNVIDIA A16 / A40
ab$90/mo
Städte mit GPU-Kapazität7
abrechnungmonatlich, PayPal oder Krypto
01/

Alle GPU-Pläne, die wir anbieten

Heute bestellbar, mit den Städten, die Kapazität für die jeweilige Größe haben. Der Konfigurator zeigt den aktuellen Preis für Ihre Stadt.

Plan
Spezifikation
Städte
Preis

A16, 1/8 GPU einstieg

Inferenz, Encoding, CUDA-Entwicklungsserver

2 GB VRAM2 vCPU8 GB RAM50 GB NVMe1 TB transfervcg-a16-2c-8g-2vram
7Bangalore, Chicago, Frankfurt, New York, Silicon Valley, Singapore, Tokyo

A40, 1/24 GPU

Ampere-Karte, mehr NVMe und Traffic

2 GB VRAM1 vCPU5 GB RAM90 GB NVMe3 TB transfervcg-a40-1c-5g-2vram
1New York

A16, 1/4 GPU

Bildgenerierung, mittelgroße Modelle

4 GB VRAM2 vCPU16 GB RAM80 GB NVMe2 TB transfervcg-a16-2c-16g-4vram
6Bangalore, Chicago, Frankfurt, Silicon Valley, Singapore, Tokyo

A16, 1/2 GPU

Halbe Karte, 8 GB GPU-Speicher

8 GB VRAM3 vCPU32 GB RAM170 GB NVMe3 TB transfervcg-a16-3c-32g-8vram
6Bangalore, Chicago, Frankfurt, Silicon Valley, Singapore, Tokyo

2x A16 multi-gpu

Zwei volle Karten, parallele Inferenz-Worker

32 GB VRAM12 vCPU128 GB RAM700 GB NVMe10 TB transfervcg-a16-12c-128g-32vram
2Bangalore, Silicon Valley

4x A16 multi-gpu

Vier Karten, 64 GB GPU-Speicher in einem Server

64 GB VRAM24 vCPU256 GB RAM1.2 TB NVMevcg-a16-24c-256g-64vram
1Bangalore
$2,873.75/moBereitstellen →

Unsere Endkundenpreise in USD am günstigsten Standort; in einigen Metropolen kommt ein Aufschlag dazu, und nicht jeder Plan ist an jedem Standort verfügbar. Der Konfigurator zeigt aktuelle Preise und Verfügbarkeit für die gewählte Stadt. Eine einzelne volle A16 (16 GB) und die größeren A40-Stufen erscheinen im Konfigurator nur, solange eine Stadt Kapazität dafür hat.

02/

Mieten Sie einen Teil der Karte oder gleich mehrere Karten

So funktioniert fraktionale GPU: ein fester Anteil am Chip und seinem Speicher, kein Zeitfenster, auf das Sie warten müssen.

a/

1/8 bis 1/2 einer GPU

Ein fester Anteil an der Karte mit eigenem GPU-Speicher (2 bis 8 GB). CUDA funktioniert genau wie auf einer vollen Karte; Sie wählen nur den Speicher passend zu Modell oder Workload.

2 bis 8 GB VRAMab $90/mo
b/

2x- und 4x-A16-Server

Skalieren Sie auf 32 oder 64 GB GPU-Speicher über mehrere Karten, für parallele Inferenz-Worker oder Batch-Pipelines.

32 oder 64 GB VRAMBangalore, Silicon Valley
c/

CUDA-bereit beim ersten Start

GPU-Pläne starten CUDA-fertige Linux-Images mit NVIDIA-Treibern passend zur Plan-Familie, sodass nvidia-smi schon beim ersten Start funktioniert. Voller Root-Zugriff, Neuinstallation im Panel, Ihre Schlüssel.

nvidia-treibercuda toolkitroot-zugriff
03/

Sieben Städte mit GPU-Kapazität

Anzahl der Pläne pro Stadt, Stand heute. Kapazität ändert sich; maßgeblich ist der Konfigurator beim Checkout.

  • 01/BangaloreIndia5 Pläne · bis zu 4x A16
  • 02/Silicon ValleyUnited States4 Pläne · bis zu 2x A16
  • 03/ChicagoUnited States3 Pläne · bis zu 1/2 A16
  • 04/FrankfurtGermany3 Pläne · bis zu 1/2 A16
  • 05/SingaporeSingapore3 Pläne · bis zu 1/2 A16
  • 06/TokyoJapan3 Pläne · bis zu 1/2 A16
  • 07/New YorkUnited States2 Pläne · A16 1/8, A40 1/24
  • netzwerkVultr, 10-Gbps-Ports
  • ipv4dediziert, inklusive
  • imagesUbuntu, Debian + Treiber
  • bereitstellungMinuten nach Zahlung
  • supportder Ingenieur, der es betreibt
04/

Ehrliche Einordnung: A16 und A40, nicht H100

Wofür diese Karten gedacht sind, and what they are not.

Läuft hier gut

Inferenz auf kleinen und mittelgroßen Modellen, Bildgenerierung auf den 8- bis 16-GB-Stufen, Video-Encoding und Transcoding, virtuelle Desktops und Cloud-Gaming, CUDA-Entwicklung und CI-Runner.

Das falsche Werkzeug

Training oder Betrieb von LLMs auf Frontier-Niveau. Eine A16 ist keine H100, und das sagen wir lieber hier als nach der Bereitstellung. Wenn Ihr Job 80 GB HBM braucht, mieten Sie diese Kartenklasse woanders und nutzen Sie uns für alles drumherum.

Warum GPU im Monatstarif

Ein fester Monatspreis aus Ihrem Prepaid-Guthaben statt einer stundengenauen Abrechnung. Per PayPal oder Krypto aufladen, bereitstellen und schon vor Monatsbeginn wissen, was der Monat kostet.

05/

Fragen zu GPU-VPS

Klare Antworten. Alles Weitere fragen Sie vor der Bestellung.

Stellen Sie uns vorher eine Frage →

01/Welche GPU-Modelle bieten Sie an?

NVIDIA A16 (von Bruchteilen bis zu 4x vollen Karten) und ein Einstiegsanteil einer NVIDIA A40. A100- oder H100-Instanzen verkaufen wir nicht, und wir tun auch nicht so, als könnte eine A16 sie ersetzen.

02/Kann ich darauf große Sprachmodelle betreiben oder trainieren?

Inferenz kleiner und mittelgroßer Modelle passt gut auf die Stufen von 8 bis 64 GB. Fine-Tuning kleiner Modelle ist auf den Multi-GPU-Servern möglich. Großes Training gehört auf Rechenzentrumskarten mit mehr Speicherbandbreite, als diese Klasse bietet.

03/Sind Treiber und CUDA in den Images enthalten?

Ja. GPU-Pläne starten CUDA-fertige Linux-Images mit NVIDIA-Treibern passend zur Plan-Familie, sodass nvidia-smi schon beim ersten Start funktioniert.

04/Wie funktioniert die Abrechnung?

Die Pläne laufen monatlich und werden von Ihrem Prepaid-Kontoguthaben bezahlt. Aufladen per PayPal oder mit einer von 18 Kryptowährungen, darunter Bitcoin und Monero; ohne Karte und ohne Ausweis.

05/Ist jeder Plan an jedem Standort verfügbar?

Nein. Die GPU-Kapazität unterscheidet sich je nach Stadt in den sieben Standorten, die sie führen, und einige Metros sind etwas teurer. Das Bestellformular zeigt die aktuelle Verfügbarkeit und den genauen Preis für den gewählten Standort.

CUDA-fertigen GPU-Server bereitstellen

Vom $90-Anteil bis zum 4x-A16-Server. Sieben Städte, monatliche Preise, Krypto willkommen.