Die On-Demand-Preise für Cloud-GPUs der neuesten Generation (B200, B300, MI300X, RTX 5090) haben sich im vergangenen Jahr etwa verdoppelt, während Mainstream-Karten (H100, H200, A100) in einem engen Band blieben. Wir erstellen den GPU-Index monatlich aus 63 Anbietern und 17 GPU-Modellen und decken dabei On-Demand-, Spot- und 1-Jahres-Reservierungsstufen ab.
Preistrends nach GPU-Generation
Das Diagramm zeigt den monatlichen Median-Preis über drei Veröffentlichungszeiträume hinweg. Wir teilen 17 GPU-Modelle nach Markteinführungsdatum in drei Kategorien ein:
Der größte Teil des Anstiegs kam von B200- und B300-Listings, die von Neocloud-Anbietern auf Hyperscaler-Preislisten ausgeweitet wurden. Diese Hyperscaler-Listings sind in der Regel 2x-3x höher und erhöhen den Kategorien-Median, sobald sie in den Datensatz aufgenommen werden.
Moderne GPUs stiegen um ~25 %, aber die Bewegung ist weitgehend statistisch bedingt. Google Cloud hat seine A3z Mega H100-Variante zum Standard-A3-Listing hinzugefügt, wodurch der H100-Kohorten-Median von ~2 $ auf ~3 $ angehoben wurde. Darunter tendierten Neocloud-H100 nach unten. Wir weisen im nächsten Abschnitt darauf hin.
Legacy-GPUs fielen im Beobachtungszeitraum von 1,78 $ auf 0,99 $, was darauf zurückzuführen ist, dass die V100-Kohorte ihre hochpreisigen Hyperscaler-Anker verlor, da Unternehmen die SKU ausmustern. Ein oder zwei Anbieter pro Legacy-Karte verbleiben in unserem Datensatz: AWS listet K80 zu 0,90 $, P40 steht bei Vast.ai bei 0,11 $, und der Rest sind ähnliche Einzel-Listing-Randfälle.
Der Vertragsmarkt bewegte sich anders: 1-Jahres-H100-Verpflichtungen tendierten im gleichen Zeitraum nach oben, während unser On-Demand-H100-Median etwa flach war. Dies zeigt eine sich vergrößernde Differenz zwischen monatlicher und 1-Jahres-Vertragspreisen.
Siehe unsere GPU-Index-Methodik für die Berechnungsweise.
Preistrends nach GPU-Modell
Das folgende Diagramm deckt 10 GPUs ab: 5 Moderne, 4 zuletzt veröffentlichte und die V100 als Legacy-Referenz.
Moderne GPUs (H100, H200, A100, L40S, RTX 4090)
IONOS deckt diese Stufe aus der EU ab: On-Demand T4, A10 und RTX PRO 6000 Blackwell, plus dedizierte H100- und H200-Server zu pauschal 3.990 $/Monat mit EU-Datenresidenz.
H100 wird von 46 Anbietern gelistet, die breiteste Abdeckung aller aktuellen Beschleuniger. Der Kohorten-Median liegt jetzt bei etwa 2,99 $/GPU-Stunde, gegenüber über 7 $ Anfang 2024. Thunder Compute, Vast.ai und RunPod sitzen am unteren Ende der Spanne; Microsoft Azure und Google Cloud tragen das obere Ende über 10 $. Die Google Cloud-Zeile ist selbst eine Mischung aus drei SKUs (a3-highgpu, a3-megagpu, a3-edgegpu), die unter einem nvidia-h100-Label zusammengefasst sind, was ihren Kohorten-Median anhebt.
Die Spanne von H200 reicht von 2,30 $ (FluidStack) bis 13,78 $ (Microsoft Azure), mit einem Kohorten-Median um 4,00 $. Die Untergrenze hängt davon ab, ob man Community-Tier- oder Instance-Share-Listings als vergleichbar mit dedizierter Kapazität betrachtet. Lässt man diese beiseite, liegt der funktionierende Median im 3-4 $-Band.
A100 hält ein enges Neocloud-Band um 1,79 $, mit ein oder zwei Serverless-Inference-Ausreißern (Replicate bei 5,04 $), die das obere Ende nach oben ziehen. Behandeln Sie Serverless-Preise beim Vergleich von IaaS-Anbietern separat.
L40S hat sich bei einem Median von etwa 1,56 $ eingependelt, wobei AWS mit 7,58 $ die Obergrenze setzt. RTX 4090 ist mit einem Median von 0,52 $ die günstigste Training-fähige Karte im Index, wobei Salad bei 0,18 $ und Beam bei 1,61 $ die Spanne begrenzen. Beide zielen auf Sub-100B-Inference und Batch-Fine-Tuning ab, wo sie oft A100 zu einem Bruchteil des Preises ersetzen.
Zuletzt veröffentlichte GPUs (B200, B300, MI300X, RTX 5090)
B200 Median 6,11 $, Spanne 3,44 $ (Vast.ai) bis 16,11 $ (Google Cloud). B300 Median 7,92 $, Spanne 5,44 $ (Vast.ai) bis 18,00 $ (Oracle Cloud). MI300X Median 2,72 $, Spanne 1,99 $ (DigitalOcean) bis 7,86 $ (Microsoft Azure). RTX 5090 Median 0,66 $, Spanne 0,27 $ (Salad) bis 2,00 $ (Vast.ai).
Das Muster wiederholt sich aus der früheren Kurve von H100: Hyperscaler führen neue Beschleuniger im ersten Jahr mit dem 3-5x der Neocloud-Untergrenzen. B300 tendiert im Diagramm noch nach oben, da weitere Hyperscaler-Listings den Median weiter anheben. MI300X ist der Angebotsausreißer; es wird unter der H100-Untergrenze bei DigitalOcean und TensorWave gelistet, läuft aber auf ROCm und nicht jede CUDA-Workload portiert sauber.
Legacy-Referenz (V100)
V100, die Legacy-Karte im Diagramm, ist als Referenzlinie der 2017er-Generation enthalten. Der Kohorten-Median fiel von 1,84 $ Mitte 2024 auf heute etwa 0,99 $ bei 17 Anbietern. Hyperscaler halten V100-SKUs für Compliance-Kunden mit unveränderlichen Workloads aufrecht; Neoclouds haben sie größtenteils fallengelassen.
Preistrends nach Anbieter
Für dieselbe GPU sind die Listenpreise der Hyperscaler typischerweise 3x-6x höher als die niedrigsten Neocloud-Listings im Datensatz. Die Katalogtiefe variiert je nach Anbieter, GPU, Region und Abrechnungstyp.
Angebot und Verfügbarkeit
Das Angebot variiert stärker als die Listenpreise. Das folgende Diagramm zeigt den Anteil der Listings jeder GPU, die heute bestätigten Bestand melden, sortiert von der knappsten zur am meisten verfügbaren.
MI300X und L40S sind mit 44 % am knappsten, B200 und B300 folgen mit 52-54 %. H100, A100 und H200 gruppieren sich bei 63-70 %, wo etwa zwei Drittel des Katalogs bestätigter Bestand sind und der Rest bereitstellungsabhängig ist. RTX 4090 und RTX 5090 erreichen 93-97 %, was das tiefere Consumer-Karten-Angebot und die geringere unternehmerische Nachfrage pro Karte widerspiegelt.
Auswahl einer GPU und eines Anbieters
Die GPU-Wahl wird von drei Achsen bestimmt: Workload, Dauer und Region. Spot- vs. On-Demand-Preise legen sich über alle drei.
Nach Workload
Nach Dauer
Unter einer Woche: Neocloud On-Demand am unteren Ende der Spanne.
Mehrere Wochen: Fordern Sie ein Angebot an (Neoclouds gewähren typischerweise 15-30 % Rabatt für 4-12-wöchige Verpflichtungen; Hyperscaler bieten 1-Jahres-Reservierungsstufen).
Mehrjährig: Verhandeln Sie direkt mit den Anbietern, da veröffentlichte On-Demand-Preise keine langfristigen Vertragsrabatte abbilden.
Reservierungsersparnisse
Der 1-Jahres-Reservierungsrabatt beträgt typischerweise 16-39 % gegenüber dem veröffentlichten On-Demand-Preis, mit den stärksten Einsparungen bei B200, AMD MI300X und der Inference-Stufe L40S, wo Anbieter stärker um gebundene Kapazität konkurrieren.
H100 und H200 verzeichnen bescheidene einstellige bis niedrige Zehner-Rabatte; ihr On-Demand-Markt ist wettbewerbsfähig genug, dass Anbieter keine Marge für Verpflichtungen opfern. B200 reserviert mit -39 % Nachlass, MI300X mit -31 %, L40S mit -30 %. Das Diagramm zeigt den anbieterübergreifenden Median für beide Abrechnungsstufen; individuelle Anbieterangebote können für mehrjährige Laufzeiten, die hier nicht abgebildet sind, tiefer gehen.
Spot vs. On-Demand
Das Spot-Rabatt-Tracker-Diagramm zeigt den medianen Spot- vs. On-Demand-Rabatt nach Kategorie. In den letzten sechs Monaten spart Modern ~50 %, zuletzt veröffentlicht ~49 %, Legacy ~75 % (Legacy ist verrauschter als es aussieht; nur wenige Anbieter veröffentlichen noch Spot-Preise für diese Karten).
Wenn Ihre Workload 5-15-minütige Unterbrechungen toleriert, ist Spot der größte verfügbare Kostenhebel. Schalten Sie das Abrechnungs-Dropdown im Explorer-Diagramm oben um, um den Spot-Preis neben dem On-Demand-Preis für jeden Anbieter auf Ihrer Shortlist zu sehen.
GPU-Index-Methodik
Der Index deckt veröffentlichte stündliche Cloud-GPU-Mietpreise über On-Demand-, Spot- und 1-Jahres-Reservierungsstufen ab (sofern Anbieter diese öffentlich listen). Er deckt keine mehrjährigen Verträge, unternehmensverhandelte Preise, Spot-plus-Savings-Plan-Kombinationen oder Gesamtbetriebskosten ab.
Unsere Daten sind monatliche Momentaufnahmen über 24 Monate (Juli 2024 bis Juni 2026), gefiltert auf 17 kuratierte GPU-Modelle bei 63 Anbietern. Jede Momentaufnahme meldet für jede (Anbieter, GPU, Abrechnungstyp, Monat)-Zelle den minimalen, maximalen, durchschnittlichen und medianen Preis pro GPU-Stunde, plus die Angebotsanzahl hinter diesen Zahlen.
H100-, A100-, H200-, B200-, B300- und V100-Preise sind Mediane über mehrere physische Versionen der Karte (PCIe, SXM oder NVL-Interconnect; für A100 und V100 auch 40/80 GB oder 16/32 GB VRAM), die Anbieter unter einem Namen listen.
Wie jedes Diagramm berechnet wird
Wir verwenden durchgehend Median-der-Mediane: Anbieter und GPUs gehen jeweils mit gleichem Gewicht in die Hauptzahl ein, sodass ein Anbieter mit 38 Listings einen Neuling mit 5 Listings nicht übertönt.
Marktzusammenfassung (drei Kategorielinien):
Das Abrechnungs-Dropdown führt die Schritte 2-3 für die ausgewählte Stufe (On-Demand, Spot oder Reservierung) erneut aus. Eine vierte Option „Durchschnitt“ stellt das arithmetische Mittel der drei Stufen-Mediane pro Kategorie und Monat dar, beschränkt auf Monate, in denen alle drei Stufen Daten aufweisen.
Anbieter × Abrechnungs-Explorer:
Für den von Ihnen ausgewählten Anbieter und die Abrechnungsstufe zeichnet jede Linie den monatlichen Median einer GPU im Zeitverlauf nach. Es wird keine anbieterübergreifende Aggregation angewendet: Der Punkt jedes Monats ist der Medianpreis über die Listings dieses Anbieters für diese GPU und diese Abrechnungsstufe. Die Linie endet, wo das Angebot aus dem Katalog verschwindet.
Moderne GPUs nebeneinander:
Gleiche Schritte 1-2 wie bei der Marktzusammenfassung, beschränkt auf On-Demand-Preise. Jede Linie ist der anbieterübergreifende monatliche Median für eine GPU. Keine GPU-übergreifende Aggregation. Acht Serien.
Spot-Rabatt-Tracker:
Dies paart jeden Spot-Preis mit seinem Gegenstück beim gleichen Anbieter, der gleichen GPU und im gleichen Monat im On-Demand-Bereich, sodass der Rabatt die tatsächliche Spanne widerspiegelt, die ein Käufer bei diesem Anbieter sehen würde, und nicht eine marktübergreifende Rauschdifferenz.
Verfügbarkeits-Momentaufnahme:
Nur Momentaufnahme, keine zeitliche Aggregation. Listings, die als unbekannter Bestand, Warteliste oder nicht verfügbar gemeldet werden, werden trotzdem im Nenner gezählt, aber nicht separat im Diagramm dargestellt, da das für den Käufer handlungsrelevante Signal der bestätigt-verfügbare Anteil ist.
Reservierungsersparnisse:
FAQs
Wir veröffentlichen jeden Monat eine aktualisierte Median-Ansicht. Die Zahlen spiegeln die Daten bis zum Vormonat wider.
Die GPU ist dieselbe; das Paket ist es nicht. Hyperscaler preisen Compliance (HIPAA, SOC 2, FedRAMP), Unternehmens-SLAs, Identitäts- und Netzwerkintegration sowie 24/7-Support ein. Neoclouds preisen Bare-Metal- oder VM-Zugang mit optionaler verwalteter Orchestrierung. Wenn Sie das Paket nicht benötigen, ist der Neocloud-Preis der richtige Vergleich.
Ja, wenn Ihre Workload Checkpoints setzt und 5-15-minütige Unterbrechungen toleriert. Der Spot-Rabatt für moderne GPUs liegt in den letzten sechs Monaten bei nahezu 50 %, und die Einsparungen summieren sich über mehrtägiges Training. Spot ist die falsche Wahl für latenzempfindliche Inference, Single-Replica-Dienste ohne Failover oder Evaluierungsläufe, die einen sauberen Wanduhr-Vergleich benötigen.
Das Abrechnungs-Dropdown des Diagramms „Preistrends nach Anbieter“ wechselt zwischen On-Demand-, Spot- und 1-Jahres-Reservierungsstufen, wo Anbieter diese Preise veröffentlichen. Mehrjährige Verträge und unternehmensverhandelte Rabatte sind nicht enthalten. Fordern Sie dafür direkt ein Angebot beim Anbieter an.
Weiterführende Literatur
- Multi-GPU-Benchmark: B200 vs H200 vs H100 vs MI300X
- Top 30 Cloud-GPU-Anbieter & ihre GPUs
- GPU-Concurrency-Benchmark
- Top 25+ KI-Chip-Hersteller: NVIDIA & seine Konkurrenten
Diese Forschung zitieren
Wählen Sie das Format, das zu Ihrem Veröffentlichungsort passt. Wenn Sie die Link-Version in Ihr CMS einfügen, bleibt der Backlink erhalten.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Cloud GPU-Mietpreisindex}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Abgerufen am 16. Juli 2026}
}
Seien Sie der Erste, der kommentiert
Ihre E-Mail-Adresse wird nicht veröffentlicht. Alle Felder sind erforderlich. Kommentare werden in ihrer Originalsprache belassen.