
Offshore-GPU-ServerGanze Karten, pro Sekunde abgerechnet. Niemand teilt sie.
RTX 4090, L40S, A100, H100 und H200 auf EPYC-Hosts mit lokalem NVMe-Scratch, in jeder der acht Jurisdiktionen. Nie ein zeitlich geteilter Bruchteil einer Karte, und niemand sieht sich an, was Sie trainieren.
- G1 · 4090GPURTX 409024 GB GDDR6XvCPU8 vCPUEPYC 9004Arbeitsspeicher48 GBDDR5 ECCScratch500 GBNVMe-Scratch0,27$/Std.
$0,34anderswo - G2 · 4090GPU2 × RTX 409048 GB GDDR6XvCPU16 vCPUEPYC 9004Arbeitsspeicher96 GBDDR5 ECCScratch1 TBNVMe-Scratch0,53$/Std.
$0,68anderswo - G1 · L40SBestes Preis-Leistungs-VerhältnisGPUL40S48 GB GDDR6vCPU12 vCPUEPYC 9004Arbeitsspeicher96 GBDDR5 ECCScratch1 TBNVMe-Scratch0,57$/Std.
$0,72anderswo - G1 · A100GPUA10080 GB HBM2evCPU16 vCPUEPYC 9004Arbeitsspeicher128 GBDDR5 ECCScratch1,5 TBNVMe-Scratch0,85$/Std.
$1,07anderswo - G1 · H100GPUH100 SXM80 GB HBM3vCPU20 vCPUEPYC 9004Arbeitsspeicher192 GBDDR5 ECCScratch2 TBNVMe-Scratch1,59$/Std.
$2,01anderswo - G4 · L40SGPU4 × L40S192 GB GDDR6vCPU48 vCPUEPYC 9004Arbeitsspeicher384 GBDDR5 ECCScratch4 TBNVMe-Scratch2,27$/Std.
$2,88anderswoAusverkauft - G1 · H200GPUH200 SXM141 GB HBM3evCPU24 vCPUEPYC 9004Arbeitsspeicher256 GBDDR5 ECCScratch3 TBNVMe-Scratch3,49$/Std.
$4,39anderswo - G8 · H100GPU8 × H100 SXM640 GB · NVLinkvCPU128 vCPUEPYC 9004Arbeitsspeicher1,5 TBDDR5 ECCScratch8 TBNVMe-Scratch12,69$/Std.
$16,08anderswoAusverkauft
Sekundengenau on-chain abgerechnet, von bereit bis gelöscht — gestoppte Knoten kosten nichts, und es gibt keine Mindestlaufzeit. Monatliche Reservierung kostet rund 30 % weniger. Anderswo ist der günstigste veröffentlichte On-Demand-Preis für dieselbe Karte bei einer benannten GPU-Cloud; unterbrechbare Marktplätze für Consumer-Hardware zählen nicht mit, denn eine Karte, die mitten im Lauf verschwinden kann, ist nicht dasselbe Produkt.
Bei jedem Knoten enthalten
- Sekundengenau abgerechnet, keine Mindestlaufzeit
- Root auf Bare Metal oder in einem Container
- CUDA 12, PyTorch und TensorFlow vorinstalliert
- NVLink bei Multi-Card-Nodes
- Dediziertes IPv4 + IPv6
- Keine Egress-Gebühr auf Modellgewichte
- Monatlich reservieren für weitere 30 % Rabatt
- Abwicklung per Krypto, keine Identitätsprüfung
Welche Karte passt zur Aufgabe?
RTX 4090
Inferenz, Bild- und Videogenerierung, Fine-Tuning von Modellen, die in 24 GB passen. Der günstigste Weg, etwas warmzuhalten.
L40S
48 GB mit echten Encodern: Rendering, Transcoding und Inferenz, die einer 4090 entwachsen sind.
A100 · H100
Trainingsläufe und Inferenz mit großem Kontext, bei denen die HBM-Bandbreite die Grenze bildet, nicht die Kernzahl.
H200 · 8 × H100
Modelle, die nirgends kleiner passen, und mehrtägige Durchläufe, die nicht unterbrochen werden dürfen.
Suchen Sie eine Karte, die nicht gelistet ist, oder einen Host, der um mehrere davon herum gebaut ist? Im individuellen Konfigurator angeben
Die Plattform
Die ganze Karte, oder wir verkaufen sie nicht.
Ein Großteil der billigen GPU-Kapazität am Markt ist ein Kartenausschnitt, eine Consumer-Maschine in jemandes Wohnung oder eine Instanz, die verschwindet, sobald ein höheres Gebot eintrifft. Nichts davon wird hier angeboten.
- Beschleuniger
- NVIDIA Ada und Hopper RTX 4090, L40S, A100, H100 und H200. Ganze Karten durchgereicht — nie ein zeitgeschnittener oder virtualisierter Bruchteil davon.
- Host
- AMD EPYC 9004 · DDR5 ECC So dimensioniert, dass die GPU der Engpass ist, nicht der Loader. Durchgehend PCIe 5.0, NVLink zwischen den Karten bei Multi-GPU-Knoten.
- Scratch
- Lokales NVMe, 0,5 – 8 TB Direkt auf dem Node, nicht auf einem Netzwerkvolume. Datensätze werden mit voller Festplattengeschwindigkeit gestaged, statt über ein Fabric zu kriechen.
- Abrechnung
- Sekündlich Stoppen Sie den Node, und die Abrechnung stoppt mit ihm. Monatlich reservieren spart etwa 30 % bei durchgehender Auslastung.
- Laufzeit
- Bare Metal oder Container Nehmen Sie die ganze Maschine oder einen Container mit bereits eingerichtetem CUDA 12, PyTorch und TensorFlow. Eigene Images sind willkommen.
- Datenschutz
- Nichts eingesehen Wir scannen weder Gewichte, Datensätze noch Ausgaben, und nach dem Zerstören des Knotens bleibt nichts erhalten.
Vorinstalliert, oder bringen Sie einen Container aus jeder Registry mit
- Ubuntu 24.04 LTS
- CUDA 12.4
- PyTorch 2.5
- TensorFlow 2.18
- JupyterLab
- Hugging Face TGI
- ONNX Runtime
- NVIDIA NGC images
- Jede OCI-Registry
- Eigenes Image
Verfügbar in jedem der Acht
Der Preis ändert sich nie mit der Region. Wählen Sie die Jurisdiktion, nicht den Preis.
- ReykjavíkIsland
- BukarestRumänien
- SofiaBulgarien
- ChișinăuMoldau
- ZürichDie Schweiz
- AmsterdamDie Niederlande
- Panama-StadtPanama
- SingapurSingapur
Bei jeder Größe enthalten
Vier Dinge, für die die meisten der Branche Gebühren verlangen, eines davon zweimal.
-
Abwehr
1.2 Tbit/s DDoS-Schutz
Immer aktiv an jedem Edge, beim günstigsten Plan ebenso wie beim größten. Keine Gebühr pro Angriff, keine gemessene Scrubbing-Abrechnung und kein Upsell für geschützte IPs.
-
Verfügbarkeit
99.99 % Verfügbarkeits-SLA
Gutschriften werden aus der öffentlichen Störungshistorie berechnet und automatisch Ihrem Guthaben gutgeschrieben. Es gibt kein Antragsformular, weil es nichts zu beantragen gibt.
-
Abwicklung
Krypto-Zahlung, keine Identität
Acht Assets, darunter Monero. Keine Karte, keine Bankdaten, kein Dokument — weder bei der Anmeldung noch bei der Verlängerung, bei keinem Betrag.
-
Einzug
Kostenlose Migration
Ganze Server, Kontrollpanels, Datenbanken und Mail, kostenlos von einem Techniker umgezogen. Sie testen die Kopie, bevor umgeschaltet wird, und behalten den alten Hoster, bis Sie zufrieden sind.
Bevor Sie starten.
Wird die Karte mit jemand anderem geteilt?
Nein. Ganze Karten werden an Ihren Knoten durchgereicht — nie eine zeitgeteilte MIG-Partition oder ein virtualisierter Bruchteil. Was die Spezifikation sagt, bekommen Sie für die gesamte Dauer, und niemand sonst wird darauf eingeplant.
Wie genau wird abgerechnet?
Sekundengenau, vom Moment, in dem der Node bereit ist, bis zum Moment, in dem Sie ihn zerstören. Es gibt keine Mindestlaufzeit und keine Kosten, solange er gestoppt ist. Durchgehende Arbeit wird als Monatsreservierung günstiger — rund 30 % unter dem Stundensatz.
Kann ich mein eigenes Image mitbringen?
Ja. Starten Sie einen Container aus einer beliebigen Registry, oder nehmen Sie den Knoten als Bare Metal und installieren Sie, was Sie möchten. Unsere Images liefern CUDA 12 mit bereits eingebautem PyTorch und TensorFlow, was die übliche erste Stunde spart.
Wie bekomme ich einen großen Datensatz auf den Knoten?
Lokaler NVMe-Scratch von einem halben bis acht Terabyte liegt auf der Maschine selbst, sodass das Staging mit Plattengeschwindigkeit läuft statt über ein Netzwerkvolume. Ingress wird nie berechnet, ebenso wenig Egress auf Modellgewichte.
Schauen Sie sich an, was ich trainiere?
Nein. Gewichte, Datensätze und Ausgaben werden nicht gescannt, indexiert oder gespeichert, und das Löschen des Knotens löscht den Scratch mit. Es gilt dieselbe Inhaltsrichtlinie wie überall sonst im Bestand.
Was, wenn die gewünschte Karte ausverkauft ist?
Der Nachschub an Beschleunigern kommt in Chargen, und die beliebten Konfigurationen gehen weg. Sagen Sie einem Techniker, was Sie brauchen und ungefähr wann; reservierte Kapazität wird vor stündlicher Nachfrage zugeteilt, sodass eine monatliche Bindung meist schneller Hardware findet.
