Offshore-GPU-ServerGanze Karten, pro Sekunde abgerechnet. Niemand teilt sie.

RTX 4090, L40S, A100, H100 und H200 auf EPYC-Hosts mit lokalem NVMe-Scratch, in jeder der acht Jurisdiktionen. Nie ein zeitlich geteilter Bruchteil einer Karte, und niemand sieht sich an, was Sie trainieren.

ab0,27$/Std.

Die acht Knoten ansehen

Sekundengenau abgerechnet · Keine Mindestlaufzeit · −30 % bei monatlicher Reservierung

  • G1 · 4090
    GPURTX 409024 GB GDDR6X
    vCPU8 vCPUEPYC 9004
    Arbeitsspeicher48 GBDDR5 ECC
    Scratch500 GBNVMe-Scratch
    0,27$/Std.$0,34 anderswo
  • G2 · 4090
    GPU2 × RTX 409048 GB GDDR6X
    vCPU16 vCPUEPYC 9004
    Arbeitsspeicher96 GBDDR5 ECC
    Scratch1 TBNVMe-Scratch
    0,53$/Std.$0,68 anderswo
  • G1 · L40SBestes Preis-Leistungs-Verhältnis
    GPUL40S48 GB GDDR6
    vCPU12 vCPUEPYC 9004
    Arbeitsspeicher96 GBDDR5 ECC
    Scratch1 TBNVMe-Scratch
    0,57$/Std.$0,72 anderswo
  • G1 · A100
    GPUA10080 GB HBM2e
    vCPU16 vCPUEPYC 9004
    Arbeitsspeicher128 GBDDR5 ECC
    Scratch1,5 TBNVMe-Scratch
    0,85$/Std.$1,07 anderswo
  • G1 · H100
    GPUH100 SXM80 GB HBM3
    vCPU20 vCPUEPYC 9004
    Arbeitsspeicher192 GBDDR5 ECC
    Scratch2 TBNVMe-Scratch
    1,59$/Std.$2,01 anderswo
  • G4 · L40S
    GPU4 × L40S192 GB GDDR6
    vCPU48 vCPUEPYC 9004
    Arbeitsspeicher384 GBDDR5 ECC
    Scratch4 TBNVMe-Scratch
    2,27$/Std.$2,88 anderswo
    Ausverkauft
  • G1 · H200
    GPUH200 SXM141 GB HBM3e
    vCPU24 vCPUEPYC 9004
    Arbeitsspeicher256 GBDDR5 ECC
    Scratch3 TBNVMe-Scratch
    3,49$/Std.$4,39 anderswo
  • G8 · H100
    GPU8 × H100 SXM640 GB · NVLink
    vCPU128 vCPUEPYC 9004
    Arbeitsspeicher1,5 TBDDR5 ECC
    Scratch8 TBNVMe-Scratch
    12,69$/Std.$16,08 anderswo
    Ausverkauft

Sekundengenau on-chain abgerechnet, von bereit bis gelöscht — gestoppte Knoten kosten nichts, und es gibt keine Mindestlaufzeit. Monatliche Reservierung kostet rund 30 % weniger. Anderswo ist der günstigste veröffentlichte On-Demand-Preis für dieselbe Karte bei einer benannten GPU-Cloud; unterbrechbare Marktplätze für Consumer-Hardware zählen nicht mit, denn eine Karte, die mitten im Lauf verschwinden kann, ist nicht dasselbe Produkt.

Bei jedem Knoten enthalten

  • Sekundengenau abgerechnet, keine Mindestlaufzeit
  • Root auf Bare Metal oder in einem Container
  • CUDA 12, PyTorch und TensorFlow vorinstalliert
  • NVLink bei Multi-Card-Nodes
  • Dediziertes IPv4 + IPv6
  • Keine Egress-Gebühr auf Modellgewichte
  • Monatlich reservieren für weitere 30 % Rabatt
  • Abwicklung per Krypto, keine Identitätsprüfung

Welche Karte passt zur Aufgabe?

RTX 4090

Inferenz, Bild- und Videogenerierung, Fine-Tuning von Modellen, die in 24 GB passen. Der günstigste Weg, etwas warmzuhalten.

L40S

48 GB mit echten Encodern: Rendering, Transcoding und Inferenz, die einer 4090 entwachsen sind.

A100 · H100

Trainingsläufe und Inferenz mit großem Kontext, bei denen die HBM-Bandbreite die Grenze bildet, nicht die Kernzahl.

H200 · 8 × H100

Modelle, die nirgends kleiner passen, und mehrtägige Durchläufe, die nicht unterbrochen werden dürfen.

Suchen Sie eine Karte, die nicht gelistet ist, oder einen Host, der um mehrere davon herum gebaut ist? Im individuellen Konfigurator angeben

Die Plattform

Die ganze Karte, oder wir verkaufen sie nicht.

Ein Großteil der billigen GPU-Kapazität am Markt ist ein Kartenausschnitt, eine Consumer-Maschine in jemandes Wohnung oder eine Instanz, die verschwindet, sobald ein höheres Gebot eintrifft. Nichts davon wird hier angeboten.

Beschleuniger
NVIDIA Ada und Hopper RTX 4090, L40S, A100, H100 und H200. Ganze Karten durchgereicht — nie ein zeitgeschnittener oder virtualisierter Bruchteil davon.
Host
AMD EPYC 9004 · DDR5 ECC So dimensioniert, dass die GPU der Engpass ist, nicht der Loader. Durchgehend PCIe 5.0, NVLink zwischen den Karten bei Multi-GPU-Knoten.
Scratch
Lokales NVMe, 0,5 – 8 TB Direkt auf dem Node, nicht auf einem Netzwerkvolume. Datensätze werden mit voller Festplattengeschwindigkeit gestaged, statt über ein Fabric zu kriechen.
Abrechnung
Sekündlich Stoppen Sie den Node, und die Abrechnung stoppt mit ihm. Monatlich reservieren spart etwa 30 % bei durchgehender Auslastung.
Laufzeit
Bare Metal oder Container Nehmen Sie die ganze Maschine oder einen Container mit bereits eingerichtetem CUDA 12, PyTorch und TensorFlow. Eigene Images sind willkommen.
Datenschutz
Nichts eingesehen Wir scannen weder Gewichte, Datensätze noch Ausgaben, und nach dem Zerstören des Knotens bleibt nichts erhalten.

Vorinstalliert, oder bringen Sie einen Container aus jeder Registry mit

Verfügbar in jedem der Acht

Der Preis ändert sich nie mit der Region. Wählen Sie die Jurisdiktion, nicht den Preis.

  • ReykjavíkIsland
  • BukarestRumänien
  • SofiaBulgarien
  • ChișinăuMoldau
  • ZürichDie Schweiz
  • AmsterdamDie Niederlande
  • Panama-StadtPanama
  • SingapurSingapur

Bei jeder Größe enthalten

Vier Dinge, für die die meisten der Branche Gebühren verlangen, eines davon zweimal.

  • Abwehr

    1.2 Tbit/s DDoS-Schutz

    Immer aktiv an jedem Edge, beim günstigsten Plan ebenso wie beim größten. Keine Gebühr pro Angriff, keine gemessene Scrubbing-Abrechnung und kein Upsell für geschützte IPs.

  • Verfügbarkeit

    99.99 % Verfügbarkeits-SLA

    Gutschriften werden aus der öffentlichen Störungshistorie berechnet und automatisch Ihrem Guthaben gutgeschrieben. Es gibt kein Antragsformular, weil es nichts zu beantragen gibt.

  • Abwicklung

    Krypto-Zahlung, keine Identität

    Acht Assets, darunter Monero. Keine Karte, keine Bankdaten, kein Dokument — weder bei der Anmeldung noch bei der Verlängerung, bei keinem Betrag.

  • Einzug

    Kostenlose Migration

    Ganze Server, Kontrollpanels, Datenbanken und Mail, kostenlos von einem Techniker umgezogen. Sie testen die Kopie, bevor umgeschaltet wird, und behalten den alten Hoster, bis Sie zufrieden sind.

Bevor Sie starten.

Wird die Karte mit jemand anderem geteilt?

Nein. Ganze Karten werden an Ihren Knoten durchgereicht — nie eine zeitgeteilte MIG-Partition oder ein virtualisierter Bruchteil. Was die Spezifikation sagt, bekommen Sie für die gesamte Dauer, und niemand sonst wird darauf eingeplant.

Wie genau wird abgerechnet?

Sekundengenau, vom Moment, in dem der Node bereit ist, bis zum Moment, in dem Sie ihn zerstören. Es gibt keine Mindestlaufzeit und keine Kosten, solange er gestoppt ist. Durchgehende Arbeit wird als Monatsreservierung günstiger — rund 30 % unter dem Stundensatz.

Kann ich mein eigenes Image mitbringen?

Ja. Starten Sie einen Container aus einer beliebigen Registry, oder nehmen Sie den Knoten als Bare Metal und installieren Sie, was Sie möchten. Unsere Images liefern CUDA 12 mit bereits eingebautem PyTorch und TensorFlow, was die übliche erste Stunde spart.

Wie bekomme ich einen großen Datensatz auf den Knoten?

Lokaler NVMe-Scratch von einem halben bis acht Terabyte liegt auf der Maschine selbst, sodass das Staging mit Plattengeschwindigkeit läuft statt über ein Netzwerkvolume. Ingress wird nie berechnet, ebenso wenig Egress auf Modellgewichte.

Schauen Sie sich an, was ich trainiere?

Nein. Gewichte, Datensätze und Ausgaben werden nicht gescannt, indexiert oder gespeichert, und das Löschen des Knotens löscht den Scratch mit. Es gilt dieselbe Inhaltsrichtlinie wie überall sonst im Bestand.

Was, wenn die gewünschte Karte ausverkauft ist?

Der Nachschub an Beschleunigern kommt in Chargen, und die beliebten Konfigurationen gehen weg. Sagen Sie einem Techniker, was Sie brauchen und ungefähr wann; reservierte Kapazität wird vor stündlicher Nachfrage zugeteilt, sodass eine monatliche Bindung meist schneller Hardware findet.