I 70+ migliori provider cloud GPU
We track 71 cloud GPU providers and 14 curated GPU model families spanning more than 2,500 distinct instance configurations.
I provider di cloud GPU si dividono in tre livelli. Gli hyperscaler gestiscono piattaforme cloud ampie con il noleggio di GPU come uno dei tanti prodotti. I neocloud specializzati si concentrano sulle infrastrutture GPU e IA come prodotto principale. I marketplace comunitari aggregano l'inventario di molti piccoli operatori, spesso al livello più basso della forbice di prezzo pubblicata.
Tabella comparativa dei provider
Cloud | Modelli | Combinazioni | Livelli di fatturazione | Di punta |
|---|---|---|---|---|
4 | 4 | 1 (Su richiesta) | No | |
Vast.ai | 56 | 184 | 3 (Su richiesta/Spot/Riservato) | Sì |
RunPod | 33 | 72 | 3 (Su richiesta/Spot/Riservato) | Sì |
Sesterce | 17 | 42 | 1 (Su richiesta) | Sì |
Verda | 10 | 40 | 3 (Su richiesta/Spot/Riservato) | Sì |
AWS | 16 | 40 | 2 (Su richiesta/Riservato) | Sì |
Massed Compute | 10 | 39 | 1 (Su richiesta) | No |
Salad | 33 | 33 | 1 (Su richiesta) | Sì |
Theta EdgeCloud | 21 | 30 | 1 (Su richiesta) | No |
GCP | 10 | 30 | 3 (Su richiesta/Spot/Riservato) | Sì |
Definizioni delle colonne:
- Modelli: famiglie di modelli GPU distinte offerte da tutti i vendor (NVIDIA + AMD + Intel). H100 e H100 NVL contano come un'unica famiglia.
- Combinazioni: SKU di istanza distinti per (modello di GPU, numero di GPU) nel catalogo pubblico.
- Livelli di fatturazione: quanti tra Su richiesta, Spot e Riservato a 1 anno il provider espone (massimo 3).
- Di punta: Sì se il provider elenca una qualsiasi tra B200, B300, MI300X o RTX 5090.
Classifica: Gli abbonati sono collegati e messi in evidenza in cima alla tabella. I restanti provider sono ordinati per profondità del catalogo (colonna Combinazioni) in ordine decrescente.
IONOS
IONOS è una piattaforma cloud europea con sede in Germania. Il catalogo pubblico di GPU copre quattro SKU a singola GPU:
Lo SKU RTX PRO 6000 Blackwell è una delle poche schede della generazione Blackwell elencate pubblicamente a meno di 2 $/GPU/ora sul lato UE.
IONOS offre anche un livello di server GPU dedicato con NVIDIA H100/H200 a $3,990/mese e NVIDIA L40s o Intel Gaudi 2 & 3 su richiesta. I quattro SKU orari sopra elencati sono solo su richiesta, con un tetto massimo mensile pubblicato per ciascuno. L'hosting e i data center si trovano nell'UE/SEE, un aspetto importante per gli acquirenti con requisiti GDPR di residenza dei dati.
Provider hyperscaler
Gli hyperscaler gestiscono piattaforme cloud ampie con il noleggio di GPU come uno dei tanti prodotti, insieme a calcolo, storage, rete, identità e servizi gestiti. In genere applicano prezzi da 3 a 6x superiori rispetto ai neocloud specializzati per la stessa GPU, perché la capacità noleggiata è fornita con SLA aziendali, certificazioni di conformità e integrazione tra i servizi.
Amazon Web Services
AWS è il più grande hyperscaler. Il catalogo comprende 18 famiglie di modelli GPU e propone H100 attraverso la famiglia di istanze p5. Due livelli di fatturazione sono elencati pubblicamente (su richiesta e riservato a 1 anno); il pricing spot esiste ma passa attraverso un flusso di richiesta separato. EC2 G7e è stato aggiunto all'inizio del 2026 con NVIDIA RTX PRO 6000 Blackwell, inizialmente in us-east-1 e us-east-2.123
AWS offre anche i propri acceleratori IA (Trainium per l'addestramento, Inferentia per l'inferenza), che restano al di fuori dell'ambito di noleggio GPU di questa comparazione. SageMaker, Redshift e il più ampio catalogo di servizi gestiti sono motivi comuni per cui le aziende scelgono AWS nonostante il prezzo maggiorato delle GPU.
Per la maggior parte dei tipi di istanza GPU è richiesta l'approvazione della quota. Nella nostra prova abbiamo ricevuto una quota per tutti i tipi H100 e A100 entro un giorno dalla richiesta.
Microsoft Azure
Azure propone H100 tramite la serie ND H100 v5 (H100 SXM); configurazioni H100 PCIe più piccole sono disponibili tramite la serie NC. Il catalogo comprende 10 famiglie di modelli GPU e include B200 (ND B200) e AMD MI300X (ND MI300X v5).45
Tutti e tre i livelli di fatturazione sono elencati pubblicamente. Azure sta inoltre sviluppando un proprio programma di acceleratori IA (Maia) per carichi di addestramento interni; questi chip non sono noleggiabili tramite le GPU instance API standard.6
Google Cloud Platform
GCP propone la H100 più economica nella fascia degli hyperscaler, ma la voce accorpa tre SKU (a3-highgpu, a3-megagpu, a3-edgegpu) in un'unica riga nelle istantanee del catalogo pubblico. La variante A3 Mega è in genere indicata a circa $14,19/GPU/ora, mentre A3 Standard si attesta a circa $11,06; la mediana visibile si sposta quando una variante entra o esce dall'elenco pubblico. Il catalogo comprende 10 famiglie di modelli GPU e include B200 tramite la famiglia A3 Ultra.7
Tutti e tre i livelli di fatturazione sono elencati pubblicamente. GCP offre anche acceleratori TPU (v5p, v6e, Trillium) come linea di prodotti separata al di fuori dell'ambito di noleggio GPU di questa comparazione.
Oracle Cloud Infrastructure
OCI adotta un approccio bare metal di base: la maggior parte delle offerte GPU gira direttamente sull'hardware host senza un livello hypervisor. Il catalogo comprende 15 famiglie di modelli GPU, incluse AMD MI300X e MI355X. Tra gli hyperscaler, l'impostazione bare metal di default e la rete di cluster RoCE v2 di OCI sono elementi distintivi per i carichi di addestramento multi-nodo strettamente accoppiati. Cohere, cliente della prima ora, esegue l'addestramento di LLM su cluster OCI; Oracle ha inoltre investito in Cohere come sostenitore strategico.8
Altri cloud generalisti di livello hyperscaler
OVHcloud (con sede in Francia), Scaleway (Francia, con il supercomputer Nabu 2023 che dispone di 1.016 H100 GPU), DigitalOcean, Vultr e Linode/Akamai completano la fascia degli hyperscaler. Si tratta di piattaforme cloud general-purpose con il noleggio di GPU come una componente. Quelle con sede in Europa (OVHcloud, Scaleway, IONOS) sono posizionate per la residenza dei dati nell'UE e le dichiarazioni di sostenibilità; Scaleway opera interamente con energia rinnovabile in tre regioni dell'UE.91011121314
Alibaba Cloud è l'unico grande hyperscaler con disponibilità nella Cina continentale. Il catalogo è più ristretto (4 famiglie di modelli GPU) e le aziende di Stati Uniti/UE con carichi di lavoro regolamentati in genere lo escludono per motivi di giurisdizione.15
Provider neocloud
I neocloud si concentrano su infrastrutture GPU e IA come prodotto principale. In genere offrono prezzi inferiori dal 50 all'80% rispetto agli hyperscaler per la stessa GPU, perché evitano i costi generali di una piattaforma ampia. Il compromesso è un catalogo di servizi più ristretto: calcolo e storage di base sono ben coperti; identità, database gestiti e integrazione tra i servizi non lo sono.
Lambda Labs
Lambda Labs dichiara di servire oltre 10.000 team di ricerca. Il catalogo comprende 8 famiglie di modelli GPU ed è progettato esclusivamente per GPU. Lambda Cloud viene fornito con PyTorch, TensorFlow, driver CUDA e un notebook Jupyter per istanza, più vicino al "click-and-train" rispetto ad altri neocloud. Lambda vende inoltre direttamente hardware GPU (desktop, server), in linea con le radici storiche dell'azienda. Nel listino pubblico i prezzi sono solo su richiesta; gli impegni plurisettimanali e pluriennali sono basati su preventivo.16
CoreWeave
CoreWeave è il più grande neocloud specializzato ed è stato selezionato come primo provider Elite di servizi cloud di NVIDIA. L'azienda dichiara 45.000 GPU nei propri data center e annovera NVIDIA tra i suoi investitori. Sono esposti due livelli di fatturazione (su richiesta e spot). Il catalogo comprende 9 famiglie di modelli GPU, incluse B200 e B300.17
Il programma ARENA (IA-Ready Native Applications) di CoreWeave consente ai clienti di testare carichi di lavoro su scala produttiva su infrastruttura reale prima di impegnarsi per la capacità. I prezzi si collocano più vicino alla fascia degli hyperscaler rispetto ad altri neocloud, riflettendo il posizionamento enterprise di fascia più alta.
RunPod
RunPod gestisce due livelli: Secure Cloud (bare metal dedicato) e Community Cloud (bare metal condiviso a tariffe più basse senza SLA). Il catalogo comprende 34 famiglie di modelli GPU, inclusa AMD MI300X. Sono esposti pubblicamente tre livelli di fatturazione (su richiesta, spot e riservato). L'avvio dell'istanza richiede meno di un minuto, il più rapido nelle nostre misurazioni.18
Gli aggiornamenti recenti includono il rollback delle release GitHub per gli endpoint Serverless, endpoint di bilanciamento del carico in beta e l'integrazione con Vercel IA SDK tramite il pacchetto @runpod/ai-sdk-provider. Il catalogo Public Endpoints copre modelli di testo, immagini, video e audio con modelli di deploy predefiniti.
Crusoe
Crusoe gestisce data center alimentati da gas naturale che altrimenti verrebbe disperso o bruciato in torcia, un arbitraggio su costi ed emissioni che finanzia l'espansione della capacità H100 e B200. Il catalogo comprende 5 famiglie di modelli GPU, inclusa AMD MI300X.19
FluidStack, Hyperstack, Nebius
FluidStack aggrega capacità GPU da più operatori di data center. Hyperstack è una delle fonti di H100 a prezzo più basso nella fascia neocloud, con una presenza nel Regno Unito e tre livelli di fatturazione. Nebius ha sede in Europa (Paesi Bassi) e include B200 e B300 di punta nel suo catalogo.202122
Paperspace by DigitalOcean
Paperspace è stato acquisito da DigitalOcean e dichiara di servire oltre 650.000 utenti. Il catalogo comprende 12 famiglie di modelli GPU. L'interfaccia notebook Jupyter precaricata e la gestione visiva delle istanze sono i tratti distintivi storici; gli utenti avanzati in genere sostituiscono la GUI con flussi di lavoro Jupyter nativi o SSH.23
Altri neocloud specializzati
TensorDock, CUDO Compute, Hot Aisle (focus su AMD MI300X), Sesterce, Lyceum, Cirrascale (solo riservato, include opzioni Cerebras e Graphcore), Together (livello inferenza) e Replicate (serverless) completano la fascia specialistica. La maggior parte opera solo su richiesta e si rivolge a team di sviluppo IA di piccole e medie dimensioni.2425262728293031
Datacrunch e Seeweb (specialisti europei)
Datacrunch è un neocloud con sede in Finlandia alimentato al 100% da energia rinnovabile, con H100, A100, RTX 6000 e V100 in gruppi da 1, 2, 4 o 8. Seeweb è un neocloud italiano anch'esso alimentato al 100% da energia rinnovabile, con cinque famiglie di modelli GPU e supporto Terraform per flussi di lavoro infrastructure-as-code.3233
Marketplace comunitari
I marketplace comunitari aggregano capacità GPU da molti piccoli operatori, spesso al livello più basso della forbice di prezzi pubblicata. Il compromesso è la variabilità: bare metal condiviso, SLA di uptime meno costante e inventario che dipende da quanti operatori host sono online al momento della richiesta.
Vast.ai
Vast.ai aggrega 57 famiglie di modelli GPU e 196 configurazioni multi-GPU distinte, il catalogo più profondo tra tutti i provider che monitoriamo. Sono esposti tre livelli di fatturazione. Il marketplace fa offerte per l'inventario tra molti piccoli operatori host; una quotazione sulla dashboard riflette quindi la disponibilità attuale e potrebbe non essere più valida cinque minuti dopo. Il catalogo include anche hardware legacy (era GTX 1080, K80) che nessun altro provider monitorato elenca, utile per sperimentazioni orientate al contenimento dei costi e carichi di lavoro accademici.34
Salad
Salad gira su hardware consumer distribuito (PC da gioco che partecipano alla rete durante i tempi di inattività). H100 non è elencata pubblicamente; il catalogo è orientato verso RTX 4090, RTX 5090 e altre schede di fascia consumer al livello più basso di quelle classi di GPU tra tutti i provider.35
Theta EdgeCloud
Theta EdgeCloud comprende 23 famiglie di modelli GPU su un'impronta di rete edge. L'architettura distribuita ai margini è l'elemento distintivo per l'inferenza sensibile alla regione; il pricing è solo su richiesta e l'inventario varia in base al nodo edge.36
Domanda dei provider: adozione, spesa e ricerche
Adozione, quota di spesa e quota di ricerche misurano la domanda per ciascun provider.
- Adozione è la quota di acquirenti di cloud GPU che utilizza ciascun provider.
- Quota di spesa è la quota di ciascun provider sulla spesa totale in cloud GPU.
- Quota di ricerche è la porzione di ciascun provider del volume di ricerca mensile combinato dei sette provider per i loro nomi di marca.
L'adozione e la quota di spesa provengono dai dati aggregati di spesa con carta per cloud GPU di Ramp.37
CoreWeave guida tutti e tre i segnali nel primo trimestre 2026, con il 35.4% degli acquirenti, il 50.8% dei dollari e il 31.3% delle ricerche. La divergenza più ampia è tra Crusoe e RunPod. Crusoe detiene il 27.7% dei dollari con il 3.0% degli acquirenti e lo 0.9% delle ricerche. RunPod rappresenta il 27.7% degli acquirenti e il 25.7% delle ricerche, con lo 0.5% della spesa.
La quota di ricerche riflette più la notorietà che la domanda impegnata e può anticipare i flussi di denaro. Vultr è il caso più evidente. Ha il 18.5% delle ricerche a fronte del 3.0% della spesa perché è un marchio VPS generico e la maggior parte delle ricerche sul marchio riguarda l'interesse per l'hosting piuttosto che il noleggio di GPU.
Come vengono misurati i segnali di ricerca
La quota di ricerche somma al 100% all'interno dei provider mostrati, non sull'intero mercato, nella finestra dal terzo trimestre 2025 al primo trimestre 2026 in cui tutti e tre i segnali si sovrappongono. La ricerca di ciascun provider viene conteggiata sul relativo termine di marca:
Per le traiettorie dei prezzi dietro questi provider, consulta l'indice dei prezzi di noleggio di GPU cloud.
Modelli di deployment
I servizi di noleggio GPU si presentano in tre forme di deployment. Ogni forma bilancia controllo e convenienza.
Serverless GPU
I servizi serverless di GPU gestiscono provisioning, scalabilità e teardown per conto dell'acquirente. Il provider addebita in base ai secondi o millisecondi di utilizzo effettivo della GPU; il tempo di inattività è gratuito. La forma è adatta a carichi di lavoro sporadici, inferenza batch e applicazioni di IA generativa con picchi, dove l'utilizzo medio è basso.
Tra i provider serverless di GPU comuni figurano Replicate, RunPod Serverless, Modal, Fal.ai e Together. Il throughput per dollaro in genere supera quello delle GPU provisioned quando l'utilizzo è inferiore al 30-40%; sopra quella soglia, le istanze GPU su richiesta o riservate sono più economiche.3138394030
Virtual GPU (vGPU)
Le GPU virtuali sono la forma più comune. Un hypervisor partiziona una GPU fisica in una o più sezioni virtuali, ciascuna in esecuzione all'interno di una macchina virtuale. Tutti i principali hyperscaler e la maggior parte dei neocloud adottano questa forma per impostazione predefinita. I compromessi: costo prevedibile, ampia disponibilità tra i provider e un leggero overhead di latenza dovuto al livello di virtualizzazione.
Bare-metal GPU
I servizi bare-metal di GPU forniscono un server GPU fisico dedicato senza livello di virtualizzazione. L'acquirente ottiene accesso diretto all'hardware per prestazioni massime e latenza minima. La forma è adatta a grandi cicli di addestramento, carichi di lavoro HPC e a qualsiasi caso in cui l'overhead di virtualizzazione sia rilevante. OCI, CoreWeave e Lambda Labs offrono tutti opzioni bare-metal. AWS e Azure le espongono tramite famiglie di istanze specifiche (p5d su AWS, serie ND su Azure).
FAQ
Gli hyperscaler gestiscono piattaforme cloud ampie con il noleggio di GPU come una linea di prodotti fra tante. I neocloud specializzati si concentrano su infrastrutture GPU e IA come prodotto principale. Gli hyperscaler applicano prezzi da 3 a 6x superiori ai neocloud per la stessa GPU; il divario riflette i servizi aziendali inclusi piuttosto che il silicio grezzo. Per un confronto sostenuto delle tendenze di prezzo tra i livelli, consulta il Indice dei prezzi di noleggio di GPU cloud.
Usa il serverless quando l'utilizzo medio della GPU è inferiore al 30-40%, quando i carichi di lavoro sono a picchi oppure quando l'overhead operativo ha un costo superiore alla tariffa oraria. Una GPU provisioned su un neocloud è più economica se l'utilizzo elevato è costante.
Per carichi di lavoro con requisiti di residenza dei dati nell'UE o per acquirenti che servono clienti UE su percorsi sensibili alla latenza, sì. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch e Seeweb sono opzioni con sede nell'UE. I prezzi in genere eguagliano o superano leggermente quelli dei neocloud statunitensi; il sovrapprezzo è per residenza, giurisdizione e dichiarazioni di sostenibilità piuttosto che per pura capacità di calcolo.
Approfondimenti
- Benchmark multi-GPU: B200 vs H200 vs H100 vs MI300X
- Benchmark di concorrenza GPU
- I migliori 25+ produttori di chip IA: NVIDIA e i suoi concorrenti
- Indice dei prezzi di noleggio di GPU cloud
Cita questa ricerca
Scegli il formato adatto a dove pubblicherai. Incollare la versione con link nel tuo CMS preserva il backlink.
@misc{dogan2026,
author = {Dogan, Sedat and Sarı, Ekrem},
title = {{I 70+ migliori provider cloud GPU}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/cloud-gpu-providers}},
note = {AIMultiple. Consultato il 25 Agosto 2026}
}Risultati e timestamp di 82 punti dati. Scarica i dati di sintesi mostrati nei grafici e nelle tabelle di questo articolo come file ZIP contenente 3 file CSV.
Vuoi i dati granulari che ci stanno dietro? Passa a Premium
Registro delle modifiche
22 aggiornamenti- 2026
Rimossa la sezione Prezzi per livello di fornitore dal confronto dei provider GPU cloud.
Aggiunta una sezione sulla domanda dei provider su adozione, quota di spesa e quota di ricerca.
Sostituito l'elenco dei fornitori con una tabella comparativa a livelli su modelli, combinazioni e livelli di fatturazione di 64 fornitori.
Aggiunto AWS EC2 G7e con GPU NVIDIA Blackwell a Recent Updates.
- 2025
Aggiunto RunPod alla sezione dei fornitori di GPU virtuali.
Aggiunto RunPod all'elenco dei fornitori di GPU virtuali.
Espansa la sezione "Cosa sono i fornitori di GPU serverless?".
Aggiunto NVIDIA Confidential Computing alla sezione FAQ.
Espansa la sezione FAQ con informazioni sulla carenza di fornitura di GPU.
Aggiunto RunPod all'elenco dei fornitori di GPU cloud.
Aggiornata l'introduzione alla sezione del modello GPU.
- 2024
Aggiornata la metodologia di classificazione nell'introduzione.
Aggiunta una sezione sulle GPU cloud più convenienti.
Aggiunta una sezione, Come avviare l'istanza corretta per le tue esigenze di GPU cloud.
Espansi i Pro di NVIDIA DGX Cloud.
Sostituiti i dati di prezzo di AWS EC2 nella sezione AWS.
- 2023
L'introduzione è stata ampliata con dettagli sulla consegna di GPU serverless, virtuali e bare-metal.
Aggiunto Seeweb all'elenco dei fornitori europei di GPU cloud.
Aggiunte informazioni sui clienti Oracle alla sezione Oracle Cloud Infrastructure.
Aggiunto OVHcloud all'elenco dei prossimi fornitori di GPU cloud.
Aggiunta una sezione, Che cos'è una piattaforma GPU cloud?, alla sezione Collegamenti esterni.
Aggiunto Alibaba Cloud alla sezione Collegamenti esterni.
Collegamenti di riferimento
- Ha 20 anni di esperienza come hacker white-hat e guru dello sviluppo, con una vasta competenza nei linguaggi di programmazione e nelle architetture dei server.
- È consulente del consiglio di amministrazione presso una società di venture capital che investe in aziende tecnologiche in fase iniziale e presso Ödeal, una piattaforma di pagamento digitale regionale che serve 125.000 commercianti.
- Ha guidato l'infrastruttura tecnologica e la cybersecurity di sette elezioni nazionali ed è stato riconosciuto nella Hall of Fame della cybersecurity da leader tecnologici globali tra cui Twitter.
Commenti 4
Condividi i tuoi pensieri
Il tuo indirizzo email non verrà pubblicato. Tutti i campi sono obbligatori. I commenti vengono lasciati nella loro lingua originale.
Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?
Sure, thank you for the suggestion, we will consider it in the next edit.
Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.
Sure, we'll review to see if we can include Dataoorts in the next edit.
Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.
Sure, we'll be reaching out to understand what Atlascloud.ai is offering.
Where is Nebius.ai ???
Thank you! It is added now.