Serveurs GPU offshoreCartes entières, à la seconde. Personne ne les partage.

RTX 4090, L40S, A100, H100 et H200 sur hôtes EPYC avec scratch NVMe local, dans n'importe laquelle des huit juridictions. Jamais une fraction de carte partagée dans le temps, et rien de ce que vous entraînez n'est jamais consulté.

à partir de0,27$/h

Voir les huit nœuds

Facturé à la seconde · Aucune durée minimale · −30 % en réservation mensuelle

  • G1 · 4090
    GPURTX 409024 Go GDDR6X
    vCPU8 vCPUEPYC 9004
    Mémoire48 GoDDR5 ECC
    Scratch500 GoNVMe scratch
    0,27$/h$0,34 ailleurs
  • G2 · 4090
    GPU2 × RTX 409048 Go GDDR6X
    vCPU16 vCPUEPYC 9004
    Mémoire96 GoDDR5 ECC
    Scratch1 ToNVMe scratch
    0,53$/h$0,68 ailleurs
  • G1 · L40SMeilleur rapport
    GPUL40S48 Go GDDR6
    vCPU12 vCPUEPYC 9004
    Mémoire96 GoDDR5 ECC
    Scratch1 ToNVMe scratch
    0,57$/h$0,72 ailleurs
  • G1 · A100
    GPUA10080 Go HBM2e
    vCPU16 vCPUEPYC 9004
    Mémoire128 GoDDR5 ECC
    Scratch1,5 ToNVMe scratch
    0,85$/h$1,07 ailleurs
  • G1 · H100
    GPUH100 SXM80 Go HBM3
    vCPU20 vCPUEPYC 9004
    Mémoire192 GoDDR5 ECC
    Scratch2 ToNVMe scratch
    1,59$/h$2,01 ailleurs
  • G4 · L40S
    GPU4 × L40S192 Go GDDR6
    vCPU48 vCPUEPYC 9004
    Mémoire384 GoDDR5 ECC
    Scratch4 ToNVMe scratch
    2,27$/h$2,88 ailleurs
    Épuisé
  • G1 · H200
    GPUH200 SXM141 Go HBM3e
    vCPU24 vCPUEPYC 9004
    Mémoire256 GoDDR5 ECC
    Scratch3 ToNVMe scratch
    3,49$/h$4,39 ailleurs
  • G8 · H100
    GPU8 × H100 SXM640 Go · NVLink
    vCPU128 vCPUEPYC 9004
    Mémoire1,5 ToDDR5 ECC
    Scratch8 ToNVMe scratch
    12,69$/h$16,08 ailleurs
    Épuisé

Facturé à la seconde on-chain, de la mise en service jusqu’à la destruction — les nœuds arrêtés ne coûtent rien, et il n’y a pas de durée minimale. Réservez au mois pour environ 30 % de moins. Ailleurs est le tarif à la demande publié le plus bas pour la même carte chez un cloud GPU nommé ; les places de marché interruptibles de matériel grand public ne sont pas comptées, car une carte qui peut disparaître en plein calcul n’est pas le même produit.

Inclus sur chaque nœud

  • Facturé à la seconde, sans durée minimale
  • Root sur bare metal ou dans un conteneur
  • CUDA 12, PyTorch et TensorFlow préinstallés
  • NVLink sur les nœuds multi-cartes
  • IPv4 + IPv6 dédiées
  • Aucun frais de sortie sur les poids de modèle
  • Réservez au mois pour 30 % de réduction supplémentaire
  • Règlement en crypto, sans vérification d'identité

Quelle carte convient au travail ?

RTX 4090

Inférence, génération d’images et de vidéos, affinage de modèles tenant dans 24 GB. Le moyen le moins cher de garder quelque chose au chaud.

L40S

48 Go avec de vrais encodeurs : rendu, transcodage et inférence qui ont dépassé une 4090.

A100 · H100

Entraînements et inférence à grand contexte, où la bande passante HBM, pas le nombre de cœurs, est le mur.

H200 · 8 × H100

Des modèles qui ne tiennent nulle part ailleurs, et des exécutions de plusieurs jours qui ne doivent pas être interrompues.

Vous cherchez une carte non répertoriée, ou un hébergeur construit autour de plusieurs d'entre elles ? Précisez-le dans le configurateur personnalisé

La plateforme

La carte entière, ou nous ne la vendons pas.

Une grande partie de la capacité GPU bon marché du marché est une tranche de carte, une machine grand public dans l'appartement de quelqu'un, ou une instance qui disparaît dès qu'un enchérisseur plus offrant se présente. Rien de tout cela n'est proposé ici.

Accélérateurs
NVIDIA Ada et Hopper RTX 4090, L40S, A100, H100 et H200. Cartes entières en passthrough — jamais une fraction découpée dans le temps ou virtualisée.
Hôte
AMD EPYC 9004 · DDR5 ECC Dimensionné pour que le GPU soit le goulot d'étranglement, pas le chargeur. PCIe 5.0 de bout en bout, NVLink entre les cartes sur les nœuds multi-GPU.
Scratch
NVMe local, 0,5 – 8 To Sur le nœud lui-même, pas un volume réseau. Les jeux de données se chargent à pleine vitesse disque au lieu de ramper sur un réseau.
Facturation
À la seconde Arrêtez le nœud et la facturation s'arrête avec lui. Réservez au mois pour environ 30 % de moins si le travail est continu.
Runtime
Bare metal ou conteneur Prenez la machine entière, ou un conteneur avec CUDA 12, PyTorch et TensorFlow déjà en place. Images personnalisées bienvenues.
Confidentialité
Rien d'inspecté Nous n'analysons ni les poids, ni les jeux de données, ni la sortie, et rien n'est conservé après la destruction du nœud.

Préinstallé, ou apportez un conteneur depuis n'importe quel registre

Disponible dans chacun des huit

Le tarif ne change jamais selon la région. Choisissez la juridiction, pas le prix.

  • ReykjavíkIslande
  • BucarestRoumanie
  • SofiaBulgarie
  • ChișinăuMoldavie
  • ZurichSuisse
  • AmsterdamPays-Bas
  • PanamaPanama
  • SingapourSingapour

Inclus à chaque taille

Quatre choses que la plupart du secteur facture, dont une deux fois.

  • Atténuation

    Protection DDoS de 1.2 Tbit/s

    Toujours actif à chaque bordure, sur le forfait le moins cher comme sur le plus grand. Pas de frais par attaque, pas de nettoyage facturé au volume, pas d’option payante pour une IP protégée.

  • Disponibilité

    SLA de disponibilité de 99.99 %

    Les avoirs sont calculés à partir du registre public des incidents et appliqués automatiquement à votre solde. Il n'y a pas de formulaire de réclamation, parce qu'il n'y a rien à réclamer.

  • Règlement

    Paiement crypto, aucune identité

    Huit actifs dont Monero. Ni carte, ni coordonnées bancaires, ni document — ni à l’inscription, ni au renouvellement, quel que soit le montant.

  • Emménagement

    Migration gratuite

    Serveurs entiers, panneaux de contrôle, bases de données et messagerie, déplacés par un ingénieur sans frais. Vous testez la copie avant toute bascule, et vous conservez l'ancien hébergeur jusqu'à ce que vous soyez satisfait.

Avant de lancer.

La carte est-elle partagée avec quelqu'un d'autre ?

Non. Les cartes entieres sont passees directement a votre noeud — jamais une partition MIG decoupee dans le temps ni une fraction virtualisee. Ce que dit la specification est ce que vous obtenez pour toute la duree, et personne d'autre n'y est planifie.

Comment est-ce facturé exactement ?

À la seconde, depuis le moment où le nœud est prêt jusqu'à celui où vous le détruisez. Il n'y a pas de durée minimale ni de facturation à l'arrêt. Un travail continu revient moins cher réservé au mois — environ 30 % sous le tarif horaire.

Puis-je apporter ma propre image ?

Oui. Démarrez un conteneur depuis n’importe quel registre, ou prenez le nœud en bare metal et installez ce que vous voulez. Nos images embarquent CUDA 12 avec PyTorch et TensorFlow déjà compilés, ce qui économise la première heure habituelle.

Comment mettre un grand jeu de données sur le nœud ?

Un espace de travail NVMe local, de un demi a huit teraoctets, reside sur la machine elle-meme, si bien que le staging tourne a la vitesse du disque plutot que sur un volume reseau. L'ingress n'est jamais facture, ni l'egress sur les poids de modeles.

Regardez-vous ce que j'entraîne ?

Non. Les poids, les jeux de données et les sorties ne sont ni scannés, ni indexés, ni conservés, et détruire le nœud détruit le scratch avec lui. La même politique de contenu s'applique ici que partout ailleurs sur le parc.

Et si la carte que je veux est épuisée ?

L'approvisionnement en accélérateurs se fait par lots, et les configurations recherchées partent. Indiquez à un ingénieur ce qu'il vous faut et à peu près quand ; la capacité réservée est allouée avant la demande à l'heure, donc un engagement mensuel trouve généralement du matériel plus vite.