Indice dei prezzi di noleggio delle GPU cloud
Le tariffe on-demand per le GPU cloud di ultima generazione (B200, B300, MI300X, RTX 5090) sono quasi raddoppiate nell'ultimo anno, mentre le schede mainstream (H100, H200, A100) sono rimaste in una fascia ristretta. Compiliamo l'indice delle GPU mensilmente da 69 fornitori e 17 modelli di GPU, coprendo i livelli on-demand, spot e riservati a 1 anno.
Andamenti dei prezzi per generazione di GPU
Il grafico mostra il prezzo mediano mensile pubblicato in tre fasce di data di rilascio. Suddividiamo 17 modelli di GPU in tre categorie per data di lancio:
La maggior parte dell'aumento è derivata dalle offerte di B200 e B300, che si sono estese dai provider neocloud ai listini prezzi degli hyperscaler. Queste offerte hyperscaler sono in genere da 2x a 3x più alte, alzando la mediana di categoria man mano che entrano nel dataset.
Le GPU moderne sono aumentate di circa il 25%, ma il movimento è in gran parte statistico. Google Cloud ha aggiunto la sua variante A3z Mega H100 all'offerta standard A3, sollevando la mediana della coorte H100 da circa $2 a circa $3. Sotto, le H100 neocloud sono scese. Lo segnaliamo nella prossima sezione.
Le GPU legacy sono scese da $1,77 a $1,14 nel periodo, spinte dalla coorte V100 che ha perso i suoi ancoraggi hyperscaler di fascia alta man mano che le aziende ritirano la SKU. Restano nel nostro dataset uno o due fornitori per scheda legacy: AWS elenca K80 a $0,90, P40 si trova su Vast.ai a $0,11 e il resto sono casi limite simili con una singola offerta.
Il mercato dei contratti si è mosso in modo diverso: gli impegni a 1 anno per H100 sono aumentati nello stesso periodo, mentre la nostra mediana on-demand per H100 è rimasta pressoché stabile. Questo mostra una crescente differenza tra i prezzi mensili e quelli impegnati a 1 anno.
Consulta la nostra metodologia dell'indice GPU per come viene calcolata.
Andamenti dei prezzi per modello di GPU
Il grafico seguente copre 10 GPU: 5 Moderne, 4 Ultime uscite e la V100 come riferimento Legacy.
Moderne GPU (H100, H200, A100, L40S, RTX 4090)
IONOS copre questa fascia dall'UE: T4, A10 e RTX PRO 6000 Blackwell on-demand, più server dedicati H100 e H200 a una tariffa fissa di $3,990/mese con residenza dei dati nell'UE.
H100 è elencata da 54 fornitori, la più ampia tra tutti gli acceleratori attuali. La mediana della coorte è ora intorno a $3,38/GPU-ora, in calo rispetto a oltre $7 all'inizio del 2024. Thunder Compute, Vast.ai e RunPod si collocano in fondo alla forbice; Microsoft Azure e Google Cloud rappresentano la coda superiore oltre $10. La riga di Google Cloud è di per sé un mix di tre SKU (a3-highgpu, a3-megagpu, a3-edgegpu) raggruppate sotto un'unica etichetta nvidia-h100, il che alza la mediana della coorte.
L'intervallo di H200 va da $2,30 (FluidStack) a $13,78 (Microsoft Azure), con una mediana di coorte intorno a $4.47. Il minimo dipende dal fatto che si considerino le offerte community-tier o in condivisione di istanze come paragonabili alla capacità dedicata. Messe da parte queste, la mediana effettiva si colloca nella fascia $3-4.
A100 mantiene una stretta fascia neocloud intorno a $1,86, con uno o due valori anomali di inferenza serverless (Replicate a $5,04) che tirano verso l'alto la coda alta. Considera le tariffe serverless separatamente quando confronti i fornitori IaaS.
L40S si è attestata su una mediana di $1,54, con AWS a $7,58 a fissare il tetto. RTX 4090 è la scheda di classe training più economica dell'indice con una mediana di $0,43, con Salad a $0,18 e Beam a $1,61 a delimitare la forbice. Entrambe puntano all'inferenza sotto i 100B e al fine-tuning batch, dove spesso sostituiscono A100 a una frazione del prezzo.
Ultime uscite GPU (B200, B300, MI300X, RTX 5090)
Mediana B200 $6,22, intervallo da $3,75 (Packet.ai) a $16,11 (Google Cloud). Mediana B300 $7,98, intervallo da $6,90 (TheAI Cloud) a $17,80 (AWS). Mediana MI300X $3,00, intervallo da $2,39 (RunPod) a $7,86 (Microsoft Azure). Mediana RTX 5090 $0,54, intervallo da $0,29 (Salad) a $3,63 (Vast.ai).
Il pattern si ripete dalla curva precedente di H100: gli hyperscaler offrono i nuovi acceleratori a 3-5x i minimi neocloud durante il primo anno. B300 è ancora in crescita nel grafico, poiché ulteriori offerte hyperscaler continuano ad alzare la mediana. MI300X è l'outlier dell'offerta; è elencato sotto il minimo di H100 su DigitalOcean e TensorWave, ma gira su ROCm e non tutti i carichi di lavoro CUDA si portano senza problemi.
Riferimento Legacy (V100)
V100, la scheda Legacy nel grafico, è inclusa come linea di riferimento della generazione 2017. La mediana della coorte è scesa da $1,84 a metà 2024 a circa $1,57 oggi su 21 fornitori. Gli hyperscaler mantengono le SKU V100 per i clienti con requisiti di conformità che eseguono carichi di lavoro immutabili; i neocloud le hanno per lo più abbandonate.
Andamenti dei prezzi per fornitore
Per la stessa GPU, i prezzi pubblicati dagli hyperscaler sono in genere da 3x a 6x più alti rispetto alle offerte neocloud più basse nel dataset. La profondità del catalogo varia per fornitore, GPU, regione e tipo di fatturazione.
Offerta e disponibilità
L'offerta varia più ampiamente dei prezzi di riferimento. Il grafico seguente mostra la quota di offerte di ciascuna GPU che segnalano scorte confermate oggi, ordinate dalla più scarsa alla più disponibile.
MI300X e B300 sono le più scarse con il 5-28%, con B200 e L40S subito dietro al 30-40%. H200, H100 e A100 si raggruppano intorno al 43-51%, dove circa metà del catalogo è scorta confermata e il resto dipende dal provisioning. RTX 4090 e RTX 5090 raggiungono il 53-76%, riflettendo una maggiore offerta di schede consumer e una minore domanda enterprise per scheda.
Scegliere una GPU e un fornitore
La scelta della GPU è determinata da tre assi: carico di lavoro, durata e regione. La tariffazione spot rispetto a quella on-demand si sovrappone a tutti e tre.
Per carico di lavoro
Per durata
Meno di una settimana: Neocloud on-demand al minimo della forbice.
Multi-settimana: Richiedi un preventivo (i Neocloud offrono in genere sconto del 15-30% per impegni di 4-12 settimane; gli hyperscaler offrono tariffe riservate a 1 anno).
Multi-anno: negozia direttamente con i fornitori, poiché le tariffe on-demand pubblicate non catturano gli sconti per termini impegnati.
Risparmi con la prenotazione
Lo sconto per prenotazione a 1 anno è in genere del 5-38% rispetto alla tariffa on-demand pubblicata, con i risparmi più elevati su B300, L40S di livello inference e B200, dove i fornitori competono più duramente per la capacità impegnata.
H100 e H200 registrano sconti modesti a una cifra o bassa doppia cifra; il loro mercato on-demand è abbastanza competitivo che i fornitori non sacrificano il margine per gli impegni. B200 si prenota a -15%, MI300X a -8%, L40S a -28%. Il grafico mostra la mediana tra fornitori per entrambi i livelli di fatturazione; i preventivi dei singoli fornitori possono essere più profondi per termini pluriennali non riflessi qui.
Spot vs on-demand
Il grafico del tracker dello sconto spot mostra lo sconto mediano spot rispetto a on-demand per categoria. Negli ultimi sei mesi, le moderne risparmiano circa il 50%, le ultime uscite circa il 49%, le legacy circa il 61% (le Legacy sono più rumorose di quanto sembri; pochi fornitori pubblicano ancora tariffe spot per queste schede).
Se il tuo carico di lavoro tollera interruzioni di 5-15 minuti, lo spot è la leva di costo più grande disponibile. Attiva il menu a discesa della fatturazione nel grafico explorer in alto per vedere la tariffa spot accanto a quella on-demand per qualsiasi provider nella tua shortlist.
Metodologia dell'indice GPU
L'indice copre i prezzi pubblicati di noleggio orario di GPU cloud nei livelli on-demand, spot e riservati a 1 anno (dove i fornitori li elencano pubblicamente). Non copre contratti pluriennali, tariffe negoziate a livello enterprise, combinazioni spot più piani di risparmio, o costo totale di proprietà.
I nostri dati sono istantanee mensili su 26 mesi (da luglio 2024 ad agosto 2026), filtrati su 17 modelli di GPU curati tra 69 fornitori. Ogni istantanea riporta, per ogni cella (fornitore, GPU, tipo di fatturazione, mese), il minimo, il massimo, la media e la mediana per tariffa oraria per GPU, più il numero di offerte dietro quei numeri.
I prezzi di H100, A100, H200, B200, B300 e V100 sono mediane calcolate su diverse versioni fisiche della scheda (interconnessione PCIe, SXM o NVL; per A100 e V100, anche 40/80 GB o 16/32 GB di VRAM) che i fornitori elencano sotto un unico nome.
Come viene calcolato ogni grafico
Utilizziamo la mediana delle mediane in tutto: fornitori e GPU entrano ciascuno nel numero principale con lo stesso peso, così un fornitore con 38 offerte non sovrasta un nuovo arrivato con 5 offerte.
Riepilogo di mercato (tre linee di categoria):
Il menu a discesa della fatturazione riesegue i passaggi 2-3 rispetto al livello selezionato (on-demand, spot o prenotazione). Una quarta opzione “Media” traccia la media aritmetica delle mediane dei tre livelli per categoria per mese, limitata ai mesi in cui tutti e tre i livelli hanno dati.
Esploratore provider × fatturazione:
Per il fornitore e il livello di fatturazione selezionati, ogni linea traccia la mediana mensile di una GPU nel tempo. Non viene applicata alcuna aggregazione tra fornitori: il punto di ogni mese è il prezzo mediano tra le offerte di quel fornitore per quella GPU e quel livello di fatturazione. La linea termina dove l'offerta scompare dal catalogo.
Moderne GPU affiancate:
Stessi passaggi 1-2 del riepilogo di mercato, limitati alla tariffazione on-demand. Ogni linea è la mediana mensile tra fornitori per una GPU. Nessuna aggregazione tra GPU. Otto serie.
Tracker dello sconto spot:
Questo abbina ogni prezzo spot alla sua controparte on-demand dello stesso fornitore, stessa GPU e stesso mese, così lo sconto riflette lo spread effettivo che un acquirente vedrebbe presso quel fornitore, non una differenza di rumore tra mercati.
Istantanea di disponibilità:
Solo istantanea, nessuna aggregazione temporale. Le offerte segnalate come scorta sconosciuta, lista d'attesa o non disponibili sono comunque conteggiate nel denominatore ma non disegnate separatamente nel grafico, poiché il segnale utile per l'acquirente è la quota confermata disponibile.
Risparmi con la prenotazione:
FAQ
Pubblichiamo ogni mese una vista mediana mensile aggiornata. I numeri riflettono i dati fino al mese precedente.
La GPU è la stessa; il pacchetto no. Gli hyperscaler includono nel prezzo la conformità (HIPAA, SOC 2, FedRAMP), SLA enterprise, integrazione di identità e rete e supporto 24/7. I neocloud prezzano l'accesso bare metal o VM con orchestrazione gestita opzionale. Se non ti serve il pacchetto, il prezzo Neocloud è il confronto giusto.
Sì, se il tuo carico di lavoro fa checkpoint e tollera interruzioni di 5-15 minuti. Lo sconto spot sulle GPU moderne si aggira intorno al 50% negli ultimi sei mesi, e i risparmi si accumulano su addestramenti di più giorni. Lo spot è la scelta sbagliata per inferenza sensibile alla latenza, servizi a replica singola senza failover, o esecuzioni di valutazione che richiedono un confronto pulito del tempo di esecuzione.
Il menu a discesa della fatturazione nel grafico degli andamenti dei prezzi per fornitore passa tra i livelli on-demand, spot e riservati a 1 anno dove i fornitori pubblicano tali tariffe. I contratti pluriennali e gli sconti negoziati a livello enterprise non sono inclusi. Richiedi un preventivo direttamente al fornitore per quelli.
Ulteriori letture
- Benchmark multi-GPU: B200 vs H200 vs H100 vs MI300X
- I migliori 30 fornitori di GPU cloud e le loro GPU
- Benchmark di concorrenza GPU
- I migliori 25+ produttori di chip IA: NVIDIA e i suoi concorrenti
Cita questa ricerca
Scegli il formato adatto a dove pubblicherai. Incollare la versione con link nel tuo CMS preserva il backlink.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Indice dei prezzi di noleggio delle GPU cloud}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Consultato il 25 Agosto 2026}
}Registro delle modifiche
3 aggiornamenti- 2026
Updated l'indice GPU su 63 provider, con nuove mediane, tassi di stock confermato e sconti riservati, e IONOS aggiunto.
Sostituite le mediane e gli intervalli nelle sezioni GPU moderne e GPU di ultima uscita con nuovi valori.
Aggiunta un'opzione di fatturazione "Media" al grafico di riepilogo del mercato nella sezione metodologia.
Sii il primo a commentare
Il tuo indirizzo email non verrà pubblicato. Tutti i campi sono obbligatori. I commenti vengono lasciati nella loro lingua originale.