
Serveurs GPU offshoreCartes entières, à la seconde. Personne ne les partage.
RTX 4090, L40S, A100, H100 et H200 sur hôtes EPYC avec scratch NVMe local, dans n'importe laquelle des huit juridictions. Jamais une fraction de carte partagée dans le temps, et rien de ce que vous entraînez n'est jamais consulté.
- G1 · 4090GPURTX 409024 Go GDDR6XvCPU8 vCPUEPYC 9004Mémoire48 GoDDR5 ECCScratch500 GoNVMe scratch0,27$/h
$0,34ailleurs - G2 · 4090GPU2 × RTX 409048 Go GDDR6XvCPU16 vCPUEPYC 9004Mémoire96 GoDDR5 ECCScratch1 ToNVMe scratch0,53$/h
$0,68ailleurs - G1 · L40SMeilleur rapportGPUL40S48 Go GDDR6vCPU12 vCPUEPYC 9004Mémoire96 GoDDR5 ECCScratch1 ToNVMe scratch0,57$/h
$0,72ailleurs - G1 · A100GPUA10080 Go HBM2evCPU16 vCPUEPYC 9004Mémoire128 GoDDR5 ECCScratch1,5 ToNVMe scratch0,85$/h
$1,07ailleurs - G1 · H100GPUH100 SXM80 Go HBM3vCPU20 vCPUEPYC 9004Mémoire192 GoDDR5 ECCScratch2 ToNVMe scratch1,59$/h
$2,01ailleurs - G4 · L40SGPU4 × L40S192 Go GDDR6vCPU48 vCPUEPYC 9004Mémoire384 GoDDR5 ECCScratch4 ToNVMe scratch2,27$/h
$2,88ailleursÉpuisé - G1 · H200GPUH200 SXM141 Go HBM3evCPU24 vCPUEPYC 9004Mémoire256 GoDDR5 ECCScratch3 ToNVMe scratch3,49$/h
$4,39ailleurs - G8 · H100GPU8 × H100 SXM640 Go · NVLinkvCPU128 vCPUEPYC 9004Mémoire1,5 ToDDR5 ECCScratch8 ToNVMe scratch12,69$/h
$16,08ailleursÉpuisé
Facturé à la seconde on-chain, de la mise en service jusqu’à la destruction — les nœuds arrêtés ne coûtent rien, et il n’y a pas de durée minimale. Réservez au mois pour environ 30 % de moins. Ailleurs est le tarif à la demande publié le plus bas pour la même carte chez un cloud GPU nommé ; les places de marché interruptibles de matériel grand public ne sont pas comptées, car une carte qui peut disparaître en plein calcul n’est pas le même produit.
Inclus sur chaque nœud
- Facturé à la seconde, sans durée minimale
- Root sur bare metal ou dans un conteneur
- CUDA 12, PyTorch et TensorFlow préinstallés
- NVLink sur les nœuds multi-cartes
- IPv4 + IPv6 dédiées
- Aucun frais de sortie sur les poids de modèle
- Réservez au mois pour 30 % de réduction supplémentaire
- Règlement en crypto, sans vérification d'identité
Quelle carte convient au travail ?
RTX 4090
Inférence, génération d’images et de vidéos, affinage de modèles tenant dans 24 GB. Le moyen le moins cher de garder quelque chose au chaud.
L40S
48 Go avec de vrais encodeurs : rendu, transcodage et inférence qui ont dépassé une 4090.
A100 · H100
Entraînements et inférence à grand contexte, où la bande passante HBM, pas le nombre de cœurs, est le mur.
H200 · 8 × H100
Des modèles qui ne tiennent nulle part ailleurs, et des exécutions de plusieurs jours qui ne doivent pas être interrompues.
Vous cherchez une carte non répertoriée, ou un hébergeur construit autour de plusieurs d'entre elles ? Précisez-le dans le configurateur personnalisé
La plateforme
La carte entière, ou nous ne la vendons pas.
Une grande partie de la capacité GPU bon marché du marché est une tranche de carte, une machine grand public dans l'appartement de quelqu'un, ou une instance qui disparaît dès qu'un enchérisseur plus offrant se présente. Rien de tout cela n'est proposé ici.
- Accélérateurs
- NVIDIA Ada et Hopper RTX 4090, L40S, A100, H100 et H200. Cartes entières en passthrough — jamais une fraction découpée dans le temps ou virtualisée.
- Hôte
- AMD EPYC 9004 · DDR5 ECC Dimensionné pour que le GPU soit le goulot d'étranglement, pas le chargeur. PCIe 5.0 de bout en bout, NVLink entre les cartes sur les nœuds multi-GPU.
- Scratch
- NVMe local, 0,5 – 8 To Sur le nœud lui-même, pas un volume réseau. Les jeux de données se chargent à pleine vitesse disque au lieu de ramper sur un réseau.
- Facturation
- À la seconde Arrêtez le nœud et la facturation s'arrête avec lui. Réservez au mois pour environ 30 % de moins si le travail est continu.
- Runtime
- Bare metal ou conteneur Prenez la machine entière, ou un conteneur avec CUDA 12, PyTorch et TensorFlow déjà en place. Images personnalisées bienvenues.
- Confidentialité
- Rien d'inspecté Nous n'analysons ni les poids, ni les jeux de données, ni la sortie, et rien n'est conservé après la destruction du nœud.
Préinstallé, ou apportez un conteneur depuis n'importe quel registre
- Ubuntu 24.04 LTS
- CUDA 12.4
- PyTorch 2.5
- TensorFlow 2.18
- JupyterLab
- Hugging Face TGI
- ONNX Runtime
- Images NVIDIA NGC
- N'importe quel registre OCI
- Image personnalisée
Disponible dans chacun des huit
Le tarif ne change jamais selon la région. Choisissez la juridiction, pas le prix.
- ReykjavíkIslande
- BucarestRoumanie
- SofiaBulgarie
- ChișinăuMoldavie
- ZurichSuisse
- AmsterdamPays-Bas
- PanamaPanama
- SingapourSingapour
Inclus à chaque taille
Quatre choses que la plupart du secteur facture, dont une deux fois.
-
Atténuation
Protection DDoS de 1.2 Tbit/s
Toujours actif à chaque bordure, sur le forfait le moins cher comme sur le plus grand. Pas de frais par attaque, pas de nettoyage facturé au volume, pas d’option payante pour une IP protégée.
-
Disponibilité
SLA de disponibilité de 99.99 %
Les avoirs sont calculés à partir du registre public des incidents et appliqués automatiquement à votre solde. Il n'y a pas de formulaire de réclamation, parce qu'il n'y a rien à réclamer.
-
Règlement
Paiement crypto, aucune identité
Huit actifs dont Monero. Ni carte, ni coordonnées bancaires, ni document — ni à l’inscription, ni au renouvellement, quel que soit le montant.
-
Emménagement
Migration gratuite
Serveurs entiers, panneaux de contrôle, bases de données et messagerie, déplacés par un ingénieur sans frais. Vous testez la copie avant toute bascule, et vous conservez l'ancien hébergeur jusqu'à ce que vous soyez satisfait.
Avant de lancer.
La carte est-elle partagée avec quelqu'un d'autre ?
Non. Les cartes entieres sont passees directement a votre noeud — jamais une partition MIG decoupee dans le temps ni une fraction virtualisee. Ce que dit la specification est ce que vous obtenez pour toute la duree, et personne d'autre n'y est planifie.
Comment est-ce facturé exactement ?
À la seconde, depuis le moment où le nœud est prêt jusqu'à celui où vous le détruisez. Il n'y a pas de durée minimale ni de facturation à l'arrêt. Un travail continu revient moins cher réservé au mois — environ 30 % sous le tarif horaire.
Puis-je apporter ma propre image ?
Oui. Démarrez un conteneur depuis n’importe quel registre, ou prenez le nœud en bare metal et installez ce que vous voulez. Nos images embarquent CUDA 12 avec PyTorch et TensorFlow déjà compilés, ce qui économise la première heure habituelle.
Comment mettre un grand jeu de données sur le nœud ?
Un espace de travail NVMe local, de un demi a huit teraoctets, reside sur la machine elle-meme, si bien que le staging tourne a la vitesse du disque plutot que sur un volume reseau. L'ingress n'est jamais facture, ni l'egress sur les poids de modeles.
Regardez-vous ce que j'entraîne ?
Non. Les poids, les jeux de données et les sorties ne sont ni scannés, ni indexés, ni conservés, et détruire le nœud détruit le scratch avec lui. La même politique de contenu s'applique ici que partout ailleurs sur le parc.
Et si la carte que je veux est épuisée ?
L'approvisionnement en accélérateurs se fait par lots, et les configurations recherchées partent. Indiquez à un ingénieur ce qu'il vous faut et à peu près quand ; la capacité réservée est allouée avant la demande à l'heure, donc un engagement mensuel trouve généralement du matériel plus vite.
