Des serveurs GPU NVIDIA, prêts pour CUDA en quelques minutes.
Des serveurs GPU au mois sur matériel NVIDIA A16 et A40 : d'une fraction à $90 pour l'inférence et l'encodage jusqu'aux serveurs 2x et 4x A16 avec 64 GB de mémoire GPU. Sept villes, accès root complet, pilotes au premier démarrage, payables par PayPal ou crypto.
Toutes nos offres GPU
Commandables aujourd’hui, avec les villes disposant de capacité pour chaque taille. Le configurateur affiche le prix réel pour votre ville.
A16, 1/8 GPU entrée
Inférence, encodage, machines de dev CUDA
A40, 1/24 GPU
Carte Ampere, plus de NVMe et de trafic
A16, 1/4 GPU
Génération d’images, modèles de taille moyenne
A16, 1/2 GPU
Une demi-carte, 8 GB de mémoire GPU
2x A16 multi-gpu
Deux cartes complètes, workers d’inférence en parallèle
4x A16 multi-gpu
Quatre cartes, 64 GB de mémoire GPU dans un seul serveur
Nos tarifs publics en USD sur le site le moins cher ; certaines métropoles appliquent un supplément et toutes les offres ne sont pas proposées partout. Le configurateur affiche le prix et la disponibilité en temps réel pour la ville choisie. Une A16 complète (16 GB) et les paliers A40 supérieurs n’apparaissent dans le configurateur que tant qu’une ville dispose de capacité.
Louez une fraction de carte, ou plusieurs cartes
Comment fonctionne le GPU fractionné: une part fixe du silicium et de sa mémoire, pas un créneau de temps qu’il faut attendre.
De 1/8 à 1/2 de GPU
Une part dédiée de la carte avec sa propre mémoire GPU (2 à 8 GB). CUDA fonctionne exactement comme sur une carte complète ; il suffit d'ajuster la mémoire à votre modèle ou à votre charge de travail.
Serveurs 2x et 4x A16
Montez à 32 ou 64 GB de mémoire GPU au total sur plusieurs cartes, pour des workers d'inférence en parallèle ou des pipelines par lots.
CUDA prêt au premier démarrage
Les offres GPU sont déployées avec des images Linux prêtes pour CUDA et les pilotes NVIDIA correspondant à la famille de l'offre : nvidia-smi fonctionne dès le premier démarrage. Root complet, réinstallation depuis le panneau, vos clés.
Sept villes avec de la capacité GPU
Nombre d’offres par ville à ce jour. La capacité évolue ; le configurateur fait foi au moment du paiement.
- 01/BangaloreIndia5 offres · jusqu’à 4x A16
- 02/Silicon ValleyUnited States4 offres · jusqu’à 2x A16
- 03/ChicagoUnited States3 offres · jusqu’à 1/2 A16
- 04/FrankfurtGermany3 offres · jusqu’à 1/2 A16
- 05/SingaporeSingapore3 offres · jusqu’à 1/2 A16
- 06/TokyoJapan3 offres · jusqu’à 1/2 A16
- 07/New YorkUnited States2 offres · A16 1/8, A40 1/24
- réseauVultr, ports 10 Gbps
- ipv4dédiée, incluse
- imagesUbuntu, Debian + pilotes
- délai de déploiementquelques minutes après paiement
- supportl’ingénieur qui gère la plateforme
Un dimensionnement honnête : A16 et A40, pas H100
À quoi servent ces cartes, and what they are not.
Tourne bien ici
Inférence sur des modèles petits et moyens, génération d'images sur les paliers 8 à 16 GB, encodage et transcodage vidéo, bureaux virtuels et cloud gaming, développement CUDA et runners CI.
Pas le bon outil
Entraîner ou servir des LLM de tout premier plan. Une A16 n'est pas une H100, et nous préférons le dire ici plutôt qu'après votre déploiement. Si votre charge réclame 80 GB de HBM, louez cette classe de carte ailleurs et gardez-nous pour tout le reste.
Pourquoi un GPU au mois
Un prix mensuel fixe prélevé sur votre solde prépayé plutôt qu'une facture horaire. Rechargez par PayPal ou crypto, déployez, et sachez ce que coûte le mois avant qu'il commence.
Questions sur les VPS GPU
Des réponses claires. Pour le reste, demandez avant de commander.
01/Quels modèles de GPU proposez-vous ?
NVIDIA A16 (fractions jusqu'à 4 cartes complètes) et une fraction d'entrée de NVIDIA A40. Nous ne vendons pas d'instances A100 ou H100, et nous ne prétendrons pas qu'une A16 les remplace.
02/Puis-je exécuter ou entraîner de grands modèles de langage dessus ?
L'inférence sur des modèles petits et moyens convient bien aux paliers de 8 à 64 GB. Le fine-tuning de petits modèles est possible sur les serveurs multi-GPU. L'entraînement à grande échelle relève de cartes de centre de données offrant plus de bande passante mémoire que cette classe.
03/Les images incluent-elles les pilotes et CUDA ?
Oui. Les offres GPU sont déployées avec des images Linux prêtes pour CUDA et les pilotes NVIDIA correspondant à la famille de l'offre : nvidia-smi fonctionne dès le premier démarrage.
04/Comment fonctionne la facturation ?
Les offres sont mensuelles et réglées depuis le solde prépayé de votre compte. Rechargez par PayPal ou avec l'une des 18 cryptomonnaies, dont Bitcoin et Monero ; sans carte ni pièce d'identité.
05/Toutes les offres sont-elles disponibles sur tous les sites ?
Non. La capacité GPU varie selon la ville parmi les sept sites qui en disposent, et certaines métropoles sont un peu plus chères. Le formulaire de commande affiche la disponibilité en temps réel et le prix exact du site choisi.
Déployez un serveur GPU prêt pour CUDA
D’une fraction à $90 jusqu’à un serveur 4x A16. Sept villes, tarif mensuel, crypto acceptée.