Dienstleistungen
Kontaktieren

Cloud GPU Preise, Leistung & Anbietervergleich

Cem Dilmegani
Cem Dilmegani
aktualisiert am 17. Juni 2026

Cloud GPU Listenpreise für dasselbe Modell können sich von Anbieter zu Anbieter um ein Vielfaches unterscheiden. Wir haben den niedrigsten Preis, den Anbieter, die Marktspanne und den Median für 40+ GPU-Konfigurationen in allen drei Preismodellen sowie einen Durchsatz-pro-Dollar-Benchmark für 10 Modelle zusammengestellt.

Cloud GPU Preis pro Durchsatz

Sehen Sie die kosteneffektivste GPU für Ihre Workload über 13 Hyperscaler- und Neocloud-Anbieter, sortiert nach Durchsatz pro Dollar:

Cloud GPU Durchsatz & Preise

Aktualisiert am 26. Juli 2026

12 von 245 angezeigt

Vast KI

Code
2x-nvidia-v100-32gb
GPU
2 x NVIDIA V100 32 GB
Bilder/s
49
Preis/h
(On Demand)
$ 0.20
882,000Bilder / $

Vast KI

Code
8x-nvidia-a100-320gb
GPU
8 x NVIDIA A100 320 GB
Bilder/s
469
Preis/h
(On Demand)
$ 2.67
632,360Bilder / $

IONOS

Code
AP1-10 GPU T4
GPU
1 x NVIDIA T4 16 GB
Bilder/s
18
Preis/h
(On Demand)
$ 0.94
68,936Bilder / $
Visit Website

Vast KI

Code
1x-nvidia-v100-32gb
GPU
1 x NVIDIA V100 32 GB
Bilder/s
24
Preis/h
(On Demand)
$ 0.16
540,000Bilder / $

Verda

Code
2x-nvidia-v100-32gb
GPU
2 x NVIDIA V100 32 GB
Bilder/s
49
Preis/h
(On Demand)
$ 0.34
518,824Bilder / $

Verda

Code
4x-nvidia-v100-64gb
GPU
4 x NVIDIA V100 64 GB
Bilder/s
98
Preis/h
(On Demand)
$ 0.68
518,824Bilder / $

Verda

Code
8x-nvidia-v100-128gb
GPU
8 x NVIDIA V100 128 GB
Bilder/s
195
Preis/h
(On Demand)
$ 1.36
516,176Bilder / $

Verda

Code
1x-nvidia-v100-16gb
GPU
1 x NVIDIA V100 16 GB
Bilder/s
24
Preis/h
(On Demand)
$ 0.17
508,235Bilder / $

Vast KI

Code
1x-nvidia-t4-15gb
GPU
1 x NVIDIA T4 15 GB
Bilder/s
18
Preis/h
(On Demand)
$ 0.15
432,000Bilder / $

Vast KI

Code
2x-nvidia-t4-30gb
GPU
2 x NVIDIA T4 30 GB
Bilder/s
35
Preis/h
(On Demand)
$ 0.30
420,000Bilder / $

Vast KI

Code
1x-nvidia-a100-40gb
GPU
1 x NVIDIA A100 40 GB
Bilder/s
59
Preis/h
(On Demand)
$ 0.52
408,462Bilder / $

Vast KI

Code
2x-nvidia-a100-80gb
GPU
2 x NVIDIA A100 80 GB
Bilder/s
117
Preis/h
(On Demand)
$ 1.04
405,000Bilder / $
Filter
GPU Name
calculator.gpu_count
Wolke
calculator.pricing_model

Siehe Cloud-GPU-Benchmark-Methodik für Details.

On-Demand ist das einfachste Preismodell, bei dem Sie stunden- oder sekundengenau für die genutzte Rechenkapazität bezahlen, ohne langfristige Verpflichtungen oder Vorauszahlungen.

Diese Instanzen werden für Nutzer empfohlen, die Flexibilität einer Cloud-GPU-Plattform ohne Vorauszahlung oder langfristige Bindung bevorzugen. On-Demand-Instanzen sind in der Regel teurer als Spot-Instanzen, bieten aber garantierte unterbrechungsfreie Kapazität.

On-Demand-Cloud-GPU-Preise

Rangfolge: Sponsoren sind verlinkt und oben in der Tabelle hervorgehoben. Die übrigen Zeilen sind aufsteigend nach dem niedrigsten On-Demand-Preis sortiert. Die Spanne zeigt die Streuung zwischen dem niedrigsten und höchsten Listenpreis für dieselbe SKU über alle Anbieter hinweg. Der Median ist die Mitte der Preisverteilung über alle Listings dieser SKU und dient als fairer Marktanker. Die Preise spiegeln die letzte wöchentliche Katalogaktualisierung wider.

On-Demand ist das Standard-Mietmodell: stundenweise Bezahlung, keine Bindung, Kapazität garantiert, solange die Instanz läuft. Es ist die teuerste Stufe, aber die einzige ohne Kompromisse.

Spot-Cloud-GPU-Preise

Rangfolge: Zeilen sind aufsteigend nach dem niedrigsten Spot-Preis sortiert. Spot-Kapazität ist unterbrechbar. Der Median ist die Mitte der Spot-Preisverteilung für diese SKU.

Spot-Kapazität ist unterbrechbar; der Anbieter kann die Instanz mit kurzer oder ohne Vorwarnung zurückfordern, meist wenn die On-Demand-Nachfrage ansteigt. Spot-Preise liegen in der Regel 40-64% unter den On-Demand-Preisen desselben Anbieters. Nutzen Sie Spot für trainings mit Checkpoints, Batch-Inferenz und Evaluierungsjobs, die Neustarts vertragen. Vermeiden Sie es für latenzempfindliche Inferenz oder Einzelreplikadienste ohne Failover.

Reservierte Cloud-GPU-Preise (1 Jahr)

Rangfolge: Zeilen sind aufsteigend nach dem niedrigsten reservierten 1-Jahres-Preis sortiert. Reservierungen sichern die Kapazität für die Laufzeit. Der Median ist die Mitte der reservierten Preisverteilung für diese SKU.

Reservierungen sichern Kapazität für eine feste Laufzeit im Austausch für einen Rabatt gegenüber On-Demand. Einjahresverträge liegen in der Regel 19-57% unter der On-Demand-Liste desselben Anbieters. In einigen Fällen sinken Reservierungspreise unter Spot, da der reservierende Anbieter das Inventar vollständig vom Spot-Markt trennt.

Lassen Sie unser Team einen Ihrer Geschäftsprozesse kostenlos mit KI-Agenten automatisieren.
Einen Prozess automatisieren

Cloud-Anbieter Leistungsvergleich

Dasselbe GPU-Modell kann je nach Anbieter aufgrund der Auswahl der Host-CPU, der Netzwerkstruktur, der Treiberkonfiguration und des Virtualisierungs-Overheads leicht unterschiedliche Leistung zeigen. Um dies zu quantifizieren, haben wir identische Text- und Bildgenerierungs-Workloads auf AMD MI300X 192GB bei DigitalOcean und Runpod ausgeführt:

Wichtige Erkenntnisse:

  • Bei Textgenerierung zeigte Digital Ocean einen etwas höheren Durchsatz und verarbeitete etwa 0,4% mehr Tokens pro Sekunde.
  • Umgekehrt zeigte Runpod bei der Bildgenerierung einen leichten Vorteil und verarbeitete etwa 0,4% mehr Bilder pro Sekunde.

Der Unterschied ist für die meisten Workloads unerheblich. Bei latenzkritischer Inferenz oder großangelegtem Training, wo jeder Prozentpunkt sich über Millionen von Inferenzen aufsummiert, sollten Sie die spezifische Anbieterkonfiguration benchmarken, bevor Sie sich auf eine lange Reservierung festlegen.

On-Premise kaufen oder in der Cloud mieten

Eigentum lohnt sich, wenn die Arbeitslast vorhersehbar ist, das Team über das operative Know-how verfügt und die Hardware-Auslastung über die Nutzungsdauer der GPU bei über ~70% liegt. Bei schwankender Nachfrage, Trainingsspitzen oder Produktexperimenten punktet die Cloud-Miete mit Kapitaleffizienz und Skalierungsflexibilität. Die Gewinnschwelle liegt etwa bei einer 12-monatigen Auslastung: über 70%, Reservierung oder eigene Kapazität schlägt fast immer On-Demand; unter 50% gewinnt Spot oder On-Demand bei der Flexibilität; das Mittelfeld hängt davon ab, wie viel Kapazitätsunterbrechung Ihre Workload verträgt.

Ein praktisches Muster im großen Maßstab: ein Basiscluster in der Größe des stetigen Bedarfs besitzen, für Spitzen und Erkundungsarbeiten in der Cloud mieten. Meta kündigte im Februar 2026 eine mehrjährige Partnerschaft an, um bis zu 6 Gigawatt AMD Instinct GPUs bereitzustellen – ein Zeichen, dass selbst Hyperscaler-große Betreiber ihre eigene Kapazität weiter ausbauen und gleichzeitig Cloud-GPUs für variable Workloads nutzen.

Consumer-GPUs (RTX 4090, RTX 5090) bieten auf dem Papier den besten Preis pro FLOP, aber NVIDIAs EULA schränkt deren Nutzung in kommerziellen Rechenzentren ein. Sie bleiben nützlich für einzelne Workstations und Proof-of-Concept-Arbeiten, nicht für den Produktionseinsatz.

Entdecken Sie weitere unserer Benchmarks und datengestützten Erkenntnisse in der Google-Suche.
GoogleAls bevorzugte Quelle hinzufügen

Cloud-GPU-Benchmark-Methodik

Durchsatz-Benchmarks verwenden 4-Bit FP-Quantisierung über alle Tests. Die Pipeline umfasst:

  • Text-Feintuning: Llama 3.2 mit den ersten 5,000 Gesprächen aus FineTome, 5 Epochen, 1M Tokens insgesamt, Unsloth-Framework. Durchsatz = (Tokens × Epochen) / Gesamtzeit.
  • Text-Inferenz: 1M Tokens generiert mit llama-cpp-python.
  • Bild-Feintuning: YOLOv9 mit 100 Bildern aus SkyFusion, 4 Epochen, Unsloth.
  • Bild-Inferenz: Feinabgestimmtes YOLOv9 mit ~500 Bildern bei 640×640.

Die Durchsatz-pro-Dollar-Metrik teilt den Workload-Output durch die stündlichen Kosten der Instanz. Die Durchsatzwerte sind workloadspezifisch und dienen als relative Richtwerte; dieselbe Hardware wird bei Ihrem eigenen Modell einen wesentlich anderen Durchsatz liefern.

FAQs

Ein einzelner GPU-Modellname deckt oft mehrere physische SKUs ab. H100 wird in PCIe-, SXM-, SXM5- und NVL-Varianten zu unterschiedlichen Preisen und Interconnect-Bandbreiten angeboten. A100 gibt es mit 40GB und 80GB VRAM; V100 mit 16GB und 32GB. Innerhalb eines Anbieters variiert der Listenpreis auch je nach Host-CPU-Klasse, gebündeltem RAM und Speicher sowie Region. Die obigen Preistabellen teilen die SKUs nach Interconnect und VRAM auf, wo es die Quelldaten erlauben, sodass jede Zeile eine einzelne physische Karte und keine Modellnamen-Aggregation darstellt.

Die Komponente führt einen festen Workload (Bild- oder Textgenerierung, Feintuning oder Inferenz) auf jeder GPU-Instanz aus und teilt die Gesamtleistung durch die stündlichen Kosten der Instanz. Ein höherer Wert bedeutet günstiger pro Output für diesen Workload. Die Rangfolge ändert sich mit dem Workload: Eine für FP8-Inferenz optimierte Karte kann bei der Textgenerierung vor einer Karte mit mehr VRAM liegen, verliert aber bei einem umfangreichen Bildmodell-Feintuning. Wählen Sie den Workload-Tab, der zu Ihrer Aufgabe passt, bevor Sie die Bestenliste lesen.

Die Preistabellen werden monatlich durch einen Katalog-Crawl aktualisiert.

Weiterführende Literatur

Diese Forschung zitieren

Wählen Sie das Format, das zu Ihrem Veröffentlichungsort passt. Wenn Sie die Link-Version in Ihr CMS einfügen, bleibt der Backlink erhalten.

Cem Dilmegani and Ekrem Sarı (2026) - "Cloud GPU Preise, Leistung & Anbietervergleich". Online veröffentlicht auf AIMultiple.com. Abgerufen am 17. Juni 2026, von: https://aimultiple.com/cloud-gpu-pricing [Online-Ressource]

Dilmegani, C., & Sarı, E. (2026, 17. Juni). Cloud GPU Preise, Leistung & Anbietervergleich. AIMultiple. https://aimultiple.com/cloud-gpu-pricing

@misc{dilmegani2026,
  author = {Dilmegani, Cem and Sarı, Ekrem},
  title  = {{Cloud GPU Preise, Leistung & Anbietervergleich}},
  year   = {2026},
  month  = jun,
  howpublished    = {\url{https://aimultiple.com/cloud-gpu-pricing}},
  note   = {AIMultiple. Abgerufen am 17. Juni 2026}
}
Cem Dilmegani
Cem Dilmegani
Leitender Analyst
Cem ist seit 2017 leitender Analyst bei AIMultiple. AIMultiple informiert monatlich Hunderttausende von Unternehmen (laut similarWeb), darunter 55 % der Fortune 500. Cems Arbeit wurde von führenden globalen Publikationen wie Business Insider, Forbes und der Washington Post, von globalen Unternehmen wie Deloitte und HPE sowie von NGOs wie dem Weltwirtschaftsforum und supranationalen Organisationen wie der Europäischen Kommission zitiert. Weitere namhafte Unternehmen und Ressourcen, die AIMultiple referenziert haben, finden Sie hier. Im Laufe seiner Karriere war Cem als Technologieberater, Technologieeinkäufer und Technologieunternehmer tätig. Über ein Jahrzehnt lang beriet er Unternehmen bei McKinsey & Company und Altman Solon in ihren Technologieentscheidungen. Er veröffentlichte außerdem einen McKinsey-Bericht zur Digitalisierung. Bei einem Telekommunikationsunternehmen leitete er die Technologiestrategie und -beschaffung und berichtete direkt an den CEO. Darüber hinaus verantwortete er das kommerzielle Wachstum des Deep-Tech-Unternehmens Hypatos, das innerhalb von zwei Jahren von null auf einen siebenstelligen jährlichen wiederkehrenden Umsatz und eine neunstellige Unternehmensbewertung kam. Cems Arbeit bei Hypatos wurde von führenden Technologiepublikationen wie TechCrunch und Business Insider gewürdigt. Er ist ein gefragter Redner auf internationalen Technologiekonferenzen. Cem absolvierte sein Studium der Informatik an der Bogazici-Universität und besitzt einen MBA der Columbia Business School.
Vollständiges Profil anzeigen
Technisch geprüft von
Ekrem Sarı
Ekrem Sarı
KI-Forscher
Ekrem ist KI-Forscher bei AIMultiple und konzentriert sich auf intelligente Automatisierung, GPUs, KI-Agenten und RAG-Frameworks.
Vollständiges Profil anzeigen

Kommentare 2

Teilen Sie Ihre Gedanken

Ihre E-Mail-Adresse wird nicht veröffentlicht. Alle Felder sind erforderlich. Kommentare werden in ihrer Originalsprache belassen.

0/450
Ashley Jenkinson
Ashley Jenkinson
Oct 31, 2024 at 08:54

Cem - great article, I'd love to pick your brain on private networking or direct connects to these GPU instances.

Cem Dilmegani
Cem Dilmegani
Nov 10, 2024 at 06:58

Hi Ashley, thank you! Sure, happy to chat.

Harsh Sharma
Harsh Sharma
Oct 06, 2024 at 02:19

Hi there, fantastic article and very well-researched. Would you mind checking out Dataoorts at https://dataoorts.com

Cem Dilmegani
Cem Dilmegani
Oct 22, 2024 at 03:18

Sure, we'll review to see if we can include Dataoorts in the next edit.