Yeni nesil bulut GPU'ları için isteğe bağlı fiyatlar (B200, B300, MI300X, RTX 5090) geçen yıl kabaca iki katına çıkarken, ana akım kartlar (H100, H200, A100) dar bir bantta kaldı. GPU endeksini aylık olarak 69 sağlayıcı ve 17 GPU modelinden derliyoruz; isteğe bağlı, spot ve 1 yıllık rezervasyonlu katmanları kapsıyor.
Nesil bazında GPU fiyat eğilimleri
Grafik, üç çıkış tarihi grubunda aylık medyan yayınlanan fiyatı gösteriyor. 17 GPU modelini çıkış tarihine göre üç kategoriye ayırıyoruz:
Artışın büyük kısmı, neocloud sağlayıcılardan hiperskala fiyat listelerine genişleyen B200 ve B300 listelerinden geldi. Bu hiperskala listeleri genellikle 2x-3x daha yüksektir ve dataset'e girdikçe kategori medyanını yükseltmektedir.
Modern GPU'lar ~%25 yükseldi, ancak bu hareket büyük ölçüde istatistikseldir. Google Cloud, standart A3 listesine A3z Mega H100 varyantını ekleyerek H100 grup medyanını ~2 dolardan ~3 dolara çıkardı. Bunun altında, neocloud H100 fiyatları düşüş eğilimindeydi. Bunu sonraki bölümde işaretliyoruz.
Eski GPU'lar, pencerede 1.77 dolardan 1.14 dolara geriledi; bu durum, işletmeler SKU'yu kullanımdan kaldırırken V100 grubunun üst düzey hiperskala çıpalarını kaybetmesinden kaynaklandı. Eski kart başına dataset'imizde bir veya iki sağlayıcı kaldı: AWS K80'i 0.90 dolardan listeliyor, P40 Vast.ai'de 0.11 dolardan bulunuyor ve gerisi benzer tek listeli uç durumlardır.
Sözleşme piyasası farklı hareket etti: 1 yıllık H100 taahhütleri aynı pencerede yükselirken, isteğe bağlı H100 medyanımız kabaca sabit kaldı. Bu, aylık ve 1 yıllık taahhütlü fiyatlandırma arasındaki farkın açıldığını gösteriyor.
Bunun nasıl hesaplandığını GPU endeks metodolojisinde görebilirsiniz.
Model bazında GPU fiyat eğilimleri
Aşağıdaki grafik 10 GPU'yu kapsıyor: 5 Modern, 4 Son çıkanlar ve Eski referans olarak V100.
Modern GPU'lar (H100, H200, A100, L40S, RTX 4090)
Bu katmanı AB'den IONOS kapsıyor: isteğe bağlı T4, A10 ve RTX PRO 6000 Blackwell artı AB veri ikametiyle aylık sabit $3,990 olan özel H100 ve H200 sunucuları.
H100 mevcut herhangi bir hızlandırıcı arasında en geniş kapsamlı olarak 54 sağlayıcı tarafından listeleniyor. Grup medyanı şu anda GPU başına saat başına yaklaşık $3,38 düzeyinde; bu, 2024 başındaki 7 doların üzerindeki seviyeden düştü. Thunder Compute, Vast.ai ve RunPod dağılımın alt ucunda yer alıyor; Microsoft Azure ve Google Cloud üst kuyruğu $10'un üzerine taşıyor. Google Cloud satırı, tek bir nvidia-h100 etiketi altında toplanan üç SKU'nun (a3-highgpu, a3-megagpu, a3-edgegpu) karışımıdır ve bu, grup medyanını yükseltiyor.
H200'ün aralığı $2,30'dan (FluidStack) $13,78'e (Microsoft Azure) kadar uzanıyor; grup medyanı yaklaşık $4.47. Taban, topluluk düzeyindeki veya instance paylaşımlı listeleri özel kapasiteyle karşılaştırılabilir sayıp saymamanıza bağlıdır. Bunlar bir kenara bırakıldığında, çalışma medyanı 3-4 dolar bandında yer alır.
A100, $1,86 civarında dar bir neocloud bandını koruyor; bir veya iki serverless inference aykırı değeri (Replicate, $5,04) üst kuyruğu yukarı çekiyor. IaaS sağlayıcılarını karşılaştırırken serverless fiyatları ayrı değerlendirin.
L40S medyanı yaklaşık $1,54'e oturdu; AWS $7,58 ile tavanı belirliyor. RTX 4090, $0,43 medyan ile endeksteki en ucuz eğitim sınıfı karttır; Salad $0,18 ve Beam $1,61 ile dağılımın iki ucunu oluşturuyor. Her ikisi de 100B altı inference'ı ve toplu fine-tuning'i hedefliyor; çoğu zaman A100'ün yerine çok daha düşük fiyata kullanılırlar.
Son çıkan GPU'lar (B200, B300, MI300X, RTX 5090)
B200 medyanı $6,22, aralığı $3,75 (Packet.ai) ile $16,11 (Google Cloud) arasında. B300 medyanı $7,98, aralığı $6,90 (TheAI Cloud) ile $17,80 (AWS) arasında. MI300X medyanı $3,00, aralığı $2,39 (RunPod) ile $7,86 (Microsoft Azure) arasında. RTX 5090 medyanı $0,54, aralığı $0,29 (Salad) ile $3,63 (Vast.ai) arasında.
Bu desen H100'ün daha önceki eğrisinden tekrarlanıyor: hiperskalalar ilk yıl boyunca yeni hızlandırıcıları neocloud tabanlarının 3-5x üzerinde taşıyor. B300, ek hiperskala listeleri medyanı yükseltmeye devam ettikçe grafikte hâlâ yukarı yönlü. MI300X arz aykırı değeridir; DigitalOcean ve TensorWave'de H100 tabanının altında listeleniyor, ancak ROCm üzerinde çalışıyor ve her CUDA iş yükü temiz şekilde taşınmıyor.
Eski referans (V100)
Grafikteki Eski kart olan V100, 2017 nesli bir referans çizgisi olarak dahil edilmiştir. Grup medyanı, 21 sağlayıcı genelinde 2024 ortasındaki $1,84 seviyesinden bugün yaklaşık $1,57'ye düştü. Hiperskalalar değiştirilemez iş yüklerini çalıştıran uyumluluk müşterileri için V100 SKU'larını koruyor; Neocloud'lar çoğunlukla bunları bıraktı.
Sağlayıcı bazında fiyat eğilimleri
Aynı GPU için hiperskala tarafından yayınlanan fiyatlar genellikle dataset'teki en düşük neocloud listelerinden 3x-6x daha yüksektir. Katalog derinliği sağlayıcıya, GPU'ya, bölgeye ve faturalama türüne göre değişir.
Arz ve kullanılabilirlik
Arz, manşet fiyatlandırmadan daha geniş ölçüdeğişiyor. Aşağıdaki grafik, her GPU'nun bugün doğrulanmış stok bildiren listelerinin payını en dar olandan en kullanılabilir olana doğru sıralıyor.
MI300X ve B300, 5-%28 ile en sıkışık olanlardır; B200 ve L40S, 30-%40 ile hemen arkalarından geliyor. H200, H100 ve A100, 43-%51 civarında kümeleniyor; burada kataloğun yaklaşık yarısı doğrulanmış stok, geri kalanı ise provizyonlamaya bağlıdır. RTX 4090 ve RTX 5090, 53-%76'ya ulaşarak daha derin tüketici kartı arzını ve kart başına daha düşük kurumsal talebi yansıtıyor.
Bir GPU ve sağlayıcı seçme
GPU seçimi üç eksene göre şekillenir: iş yükü, süre ve bölge. Spot ile isteğe bağlı fiyatlandırma bu üçünün üzerine eklenir.
İş yüküne göre
Süreye göre
Bir haftadan kısa: Dağılımın tabanında Neocloud isteğe bağlı fiyatı.
Çok haftalı: Teklif isteyin (Neocloud'lar genellikle indirim 15-%30 4-12 haftalık taahhütler için uygular; hiperskalalar 1 yıllık rezervasyon katmanları sunar).
Çok yıllık: doğrudan sağlayıcılarla pazarlık edin; çünkü yayınlanan isteğe bağlı fiyatlar taahhütlü süre indirimlerini yansıtmaz.
Rezervasyon tasarrufları
1 yıllık rezervasyonlu indirim genellikle yayınlanan isteğe bağlı fiyat üzerinden 5-%38 arasında değişir; en dik tasarruflar, sağlayıcıların taahhütlü kapasite için daha sert rekabet ettiği B300, inference sınıfı L40S ve B200'de görülür.
H100 ve H200, tek haneli ile düşük onlu yüzdeler arasında mütevazı indirimler görüyor; isteğe bağlı piyasaları, sağlayıcıların taahhütler için marjdan fedakârlık etmeyeceği kadar rekabetçidir. B200 rezervasyonları -%15, MI300X -%8, L40S -%28 indirimli. Grafik her iki faturalama katmanı için sağlayıcılar arası medyanı gösteriyor; bireysel sağlayıcı teklifleri burada yansıtılmayan çok yıllık dönemler için daha derin olabilir.
Spot ve isteğe bağlı karşılaştırması
Spot indirim takip grafiği, kategoriye göre medyan spot ve isteğe bağlı indirimi gösterir. Son altı ayda modern yaklaşık %50, son çıkanlar yaklaşık %49, eski yaklaşık %61 tasarruf sağladı (Eski kartlar göründüğünden daha gürültülüdür; bu kartlar için hâlâ spot fiyat yayınlayan az sayıda sağlayıcı var).
İş yükünüz 5-15 dakikalık kesintileri tolere edebiliyorsa, spot mevcut en büyük maliyet kaldıracıdır. Kısa listenizdeki herhangi bir sağlayıcı için spot fiyatı isteğe bağlı fiyatla yan yana görmek üzere üstteki keşif grafiğindeki faturalama açılır menüsünü değiştirin.
GPU endeks metodolojisi
Endeks, isteğe bağlı, spot ve 1 yıllık rezervasyonlu katmanlarda (sağlayıcıların bunları kamuya açık listelediği yerlerde) yayınlanan saatlik bulut GPU kiralama fiyatlarını kapsar. Çok yıllık sözleşmeleri, kurumsal olarak müzakere edilmiş fiyatları, spot artı tasarruf planı kombinasyonlarını veya toplam sahip olma maliyetini kapsamaz.
Verilerimiz, 69 sağlayıcı genelinde seçilmiş 17 GPU modeline filtrelenmiş olarak 26 ay boyunca (Temmuz 2024 ile Ağustos 2026 arasında) alınan aylık anlık görüntülerdir. Her anlık görüntü, her (sağlayıcı, GPU, faturalama türü, ay) hücresi için minimum, maksimum, ortalama ve medyan GPU başına saatlik ücreti ve bu sayıların arkasındaki teklif sayısını raporlar.
H100, A100, H200, B200, B300 ve V100 fiyatları, kartın çeşitli fiziksel sürümleri (PCIe, SXM veya NVL ara bağlantısı; A100 ve V100 için ayrıca 40/80 GB veya 16/32 GB VRAM) genelinde alınan medyanlardır; sağlayıcılar bunları tek bir ad altında listeler.
Her grafik nasıl hesaplanıyor
Baştan sona medyanların medyanını kullanıyoruz: sağlayıcılar ve GPU'lar manşet sayıya eşit ağırlıkla girer; böylece 38 listeli bir sağlayıcı, 5 listeli yeni bir oyuncuyu bastırmaz.
Piyasa özeti (üç kategori çizgisi):
Faturalama açılır menüsü, seçilen katmana (isteğe bağlı, spot veya rezervasyon) göre Adım 2-3'ü yeniden çalıştırır. Dördüncü bir “Ortalama” seçeneği, her kategori için her ay üç katman medyanının aritmetik ortalamasını çizer; bu, her üç katmanın da verisinin bulunduğu aylarla sınırlıdır.
Sağlayıcı × faturalama keşif aracı:
Seçtiğiniz sağlayıcı ve faturalama katmanı için her çizgi, bir GPU'nun aylık medyanını zaman içinde izler. Sağlayıcılar arası toplama uygulanmaz: her ayki nokta, o sağlayıcının o GPU ve o faturalama katmanı için listelerindeki medyan fiyattır. Çizgi, teklif katalogdan kaybolduğu yerde sona erer.
Modern GPU'lar yan yana:
Piyasa özetindeki Adım 1-2 ile aynıdır; isteğe bağlı fiyatlandırmayla sınırlandırılmıştır. Her çizgi, bir GPU için sağlayıcılar arası aylık medyandır. GPU'lar arası toplama yapılmaz. Sekiz seri.
Spot indirim takibi:
Bu, her spot fiyatı aynı sağlayıcıdaki, aynı GPU'daki, aynı aydaki isteğe bağlı karşılığıyla eşleştirir; böylece indirim, bir alıcının o sağlayıcıda göreceği gerçek farkı yansıtır; piyasalar arası bir gürültü farkını değil.
Kullanılabilirlik anlık görüntüsü:
Yalnızca anlık görüntü; zaman toplamı yok. Stok durumu bilinmeyen, bekleme listesinde veya kullanılamaz olarak bildirilen listeler paydada sayılmaya devam eder ancak grafikte ayrıca çizilmez; çünkü alıcı için eyleme dönüştürülebilir sinyal, doğrulanmış kullanılabilir paydır.
Rezervasyon tasarrufları:
SSS'ler
Her ay yenilenmiş bir aylık medyan görünümü yayınlıyoruz. Rakamlar, bir önceki aya kadar olan verileri yansıtır.
GPU aynıdır; paket aynı değildir. Hiperskalalar fiyata uyumluluğu (HIPAA, SOC 2, FedRAMP), kurumsal SLA'ları, kimlik ve ağ entegrasyonunu ve 24/7 desteği dahil eder. Neocloud'lar, isteğe bağlı yönetilen orkestrasyonla bare metal veya VM erişimini fiyatlandırır. Pakete ihtiyacınız yoksa doğru karşılaştırma Neocloud fiyatıdır.
Evet, iş yükünüz kontrol noktaları oluşturuyorsa ve 5-15 dakikalık kesintileri tolere edebiliyorsa. Modern GPU spot indirimi son altı ayda %50 civarında seyrediyor ve tasarruflar çok günlü eğitimlerde bileşiyor. Spot; gecikmeye duyarlı inference, yük devri olmayan tek kopyalı hizmetler veya temiz bir duvar saati karşılaştırması gerektiren değerlendirme koşuları için yanlış bir seçimdir.
Sağlayıcı bazında fiyat eğilimleri grafiğindeki faturalama açılır menüsü, sağlayıcıların bu fiyatları yayınladığı yerlerde isteğe bağlı, spot ve 1 yıllık rezervasyonlu katmanlar arasında geçiş yapar. Çok yıllık sözleşmeler ve kurumsal olarak müzakere edilmiş indirimler dahil değildir. Bunlar için doğrudan sağlayıcıdan fiyat teklifi isteyin.
İleri okuma
- Çoklu GPU Benchmark: B200 vs H200 vs H100 vs MI300X
- En İyi 30 Bulut GPU Sağlayıcısı ve GPU'ları
- GPU Eşzamanlılık Benchmark
- En İyi 25+ Yapay Zekâ Çip Üreticisi: NVIDIA ve Rakipleri
Bu araştırmayı kaynak gösterin
Yayınlayacağınız yere uygun formatı seçin. Bağlantılı sürümü CMS'inize yapıştırmak, geri bağlantıyı korur.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Bulut GPU Kiralama Fiyat Endeksi}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Erişim tarihi: 25 Ağustos 2026}
}Değişiklik günlüğü
3 güncelleme- 2026
GPU endeksi 63 sağlayıcı genelinde yeni medyanlar, stok teyit oranları ve rezerve indirimleriyle güncellendi, IONOS eklendi.
Modern ve Son çıkan GPU bölümlerindeki medyanlar ve aralıklar yeni değerlerle değiştirildi.
Metodoloji bölümündeki piyasa özeti grafiğine "Ortalama" faturalandırma katmanı seçeneği eklendi.
Yorum yapan ilk kişi olun
E-posta adresiniz yayınlanmayacak. Tüm alanlar gereklidir. Yorumlar orijinal dilinde bırakılır.