Top 70+ fournisseurs de GPU cloud
We track 71 cloud GPU providers and 14 curated GPU model families spanning more than 2,500 distinct instance configurations.
Les fournisseurs de GPU cloud se répartissent en trois catégories. Les hyperscalers exploitent de vastes plateformes cloud où la location de GPU n'est qu'un produit parmi beaucoup d'autres. Les neoclouds spécialisés se concentrent sur l'infrastructure GPU et IA comme produit principal. Les places de marché communautaires regroupent l'inventaire de nombreux petits opérateurs, souvent au plancher de la fourchette de prix publiée.
Tableau comparatif des fournisseurs
Cloud | Modèles | Combinaisons | Paliers de facturation | Dernière génération |
|---|---|---|---|---|
4 | 4 | 1 (À la demande) | Non | |
Vast.ai | 56 | 184 | 3 (À la demande/Spot/Réservé) | Oui |
RunPod | 33 | 72 | 3 (À la demande/Spot/Réservé) | Oui |
Sesterce | 17 | 42 | 1 (À la demande) | Oui |
Verda | 10 | 40 | 3 (À la demande/Spot/Réservé) | Oui |
AWS | 16 | 40 | 2 (À la demande/Réservé) | Oui |
Massed Compute | 10 | 39 | 1 (À la demande) | Non |
Salad | 33 | 33 | 1 (À la demande) | Oui |
Theta EdgeCloud | 21 | 30 | 1 (À la demande) | Non |
GCP | 10 | 30 | 3 (À la demande/Spot/Réservé) | Oui |
Définitions des colonnes :
- Modèles : familles de modèles de GPU distinctes proposées par l'ensemble des fournisseurs (NVIDIA + AMD + Intel). H100 et H100 NVL comptent comme une seule famille.
- Combinaisons : SKU d'instances distincts (modèle de GPU, nombre de GPU) dans le catalogue public.
- Paliers de facturation : nombre de paliers À la demande, Spot et Réservé 1 an exposés par le fournisseur (max 3).
- Dernière génération : Oui si le fournisseur répertorie l'un des modèles B200, B300, MI300X ou RTX 5090.
Classement : Les abonnés sont liés et mis en évidence en haut du tableau. Les autres fournisseurs sont classés par profondeur de catalogue (colonne Combinaisons) par ordre décroissant.
IONOS
IONOS est une plateforme cloud européenne dont le siège est en Allemagne. Le catalogue public de GPU couvre quatre SKU mono-GPU :
Le SKU RTX PRO 6000 Blackwell est l'une des rares cartes de génération Blackwell répertoriées publiquement à moins de 2 $/GPU/heure côté UE.
IONOS propose également une gamme de serveurs dédiés GPU avec NVIDIA H100/H200 à $3 990/mois et NVIDIA L40s ou Intel Gaudi 2 & 3 sur demande. Les quatre SKU horaires ci-dessus sont uniquement à la demande, avec un plafond mensuel maximum affiché pour chacun. L'hébergement et les centres de données sont situés dans l'UE/EEE, ce qui compte pour les acheteurs soumis aux exigences de résidence des données du RGPD.
Fournisseurs hyperscalers
Les hyperscalers exploitent de vastes plateformes cloud où la location de GPU n'est qu'un produit parmi beaucoup d'autres, aux côtés des services de calcul, de stockage, de réseau, d'identité et des services gérés. Ils facturent généralement 3 à 6x de plus que les neoclouds spécialisés pour le même GPU, car la capacité louée est fournie avec des SLA d'entreprise, des certifications de conformité et l'intégration entre services.
Amazon Web Services
AWS est le plus grand hyperscaler. Le catalogue couvre 18 familles de modèles de GPU et affiche le H100 via la famille d'instances p5. Deux paliers de facturation sont répertoriés publiquement (à la demande et réservé 1 an) ; la tarification spot existe mais passe par un flux de demande séparé. L'instance EC2 G7e a été ajoutée début 2026 avec le NVIDIA RTX PRO 6000 Blackwell, initialement dans les régions us-east-1 et us-east-2.123
AWS propose également ses propres accélérateurs d'IA (Trainium pour l'entraînement, Inferentia pour l'inférence), qui n'entrent pas dans le périmètre de location de GPU de cette comparaison. SageMaker, Redshift et le catalogue plus large de services gérés sont des raisons courantes pour lesquelles les entreprises choisissent AWS malgré le tarif GPU plus élevé.
Une approbation de quota est requise pour la plupart des types d'instances GPU. Dans notre essai, nous avons obtenu un quota pour tous les types H100 et A100 dans la journée suivant la demande.
Microsoft Azure
Azure propose le H100 via la série ND H100 v5 (H100 SXM) ; des configurations H100 PCIe plus petites sont disponibles via la série NC. Le catalogue couvre 10 familles de modèles de GPU et comprend le B200 (ND B200) et le AMD MI300X (ND MI300X v5).45
Les trois paliers de facturation sont répertoriés publiquement. Azure développe également son propre programme d'accélérateurs d'IA (Maia) pour les charges d'entraînement internes ; ces puces ne sont pas louables via l'API d'instances GPU standard.6
Google Cloud Platform
GCP affiche le H100 le moins cher de la catégorie hyperscaler, mais la liste regroupe trois SKU (a3-highgpu, a3-megagpu, a3-edgegpu) sur une seule ligne dans les instantanés du catalogue public. La variante A3 Mega est généralement listée à environ $14,19/GPU/h, tandis que l'A3 Standard se situe à environ $11,06, et la médiane visible évolue à mesure qu'une variante entre ou sort de la liste publique. Le catalogue couvre 10 familles de modèles de GPU et comprend le B200 via la famille A3 Ultra.7
Les trois paliers de facturation sont répertoriés publiquement. GCP propose également des accélérateurs TPU (v5p, v6e, Trillium) comme gamme de produits distincte, hors du périmètre de location de GPU de cette comparaison.
Oracle Cloud Infrastructure
OCI adopte une approche bare metal d'abord : la plupart des offres GPU s'exécutent directement sur le matériel hôte, sans couche d'hyperviseur. Le catalogue couvre 15 familles de modèles de GPU, dont l'AMD MI300X et le MI355X. Parmi les hyperscalers, le bare metal par défaut d'OCI et la mise en réseau de cluster RoCE v2 sont des différenciateurs pour les charges d'entraînement multi-nœuds étroitement couplées. Cohere, un client de la première heure, exécute des entraînements de LLM sur des clusters OCI ; Oracle a également investi dans Cohere en tant que soutien stratégique.8
Autres clouds généralistes de la catégorie hyperscaler
OVHcloud (basé en France), Scaleway (France, avec le supercalculateur Nabu 2023 doté de 1 016 H100 GPUs), DigitalOcean, Vultr et Linode/Akamai complètent la catégorie hyperscaler. Ce sont des plateformes cloud généralistes avec la location de GPU comme composante. Les acteurs dont le siège est en Europe (OVHcloud, Scaleway, IONOS) sont positionnés pour la résidence des données dans l'UE et les arguments de durabilité ; Scaleway fonctionne entièrement à l'énergie renouvelable dans trois régions européennes.91011121314
Alibaba Cloud est le seul grand hyperscaler disponible en Chine continentale. Le catalogue est plus étroit (4 familles de modèles de GPU) et les entreprises américaines/européennes ayant des charges réglementées l'excluent généralement pour des raisons de juridiction.15
Fournisseurs neoclouds
Les neoclouds se concentrent sur l'infrastructure GPU et IA comme produit principal. Ils proposent généralement des prix inférieurs de 50 à 80 % à ceux des hyperscalers pour le même GPU, car ils évitent les frais généraux d'une plateforme étendue. Le compromis est un catalogue de services plus étroit : le calcul et le stockage de base sont bien couverts ; l'identité, les bases de données gérées et l'intégration entre services ne le sont pas.
Lambda Labs
Lambda Labs affirme servir plus de 10 000 équipes de recherche. Le catalogue couvre 8 familles de modèles de GPU et est conçu exclusivement pour le GPU. Lambda Cloud est prééquipé de PyTorch, TensorFlow, de pilotes CUDA et d'un notebook Jupyter par instance, plus proche du « click-and-train » que les autres neoclouds. Lambda vend également du matériel GPU en direct (ordinateurs de bureau, serveurs), ce qui est l'origine historique de l'entreprise. La tarification est uniquement à la demande dans l'offre publique ; les engagements de plusieurs semaines ou années font l'objet d'un devis.16
CoreWeave
CoreWeave est le plus grand neocloud spécialisé et a été choisi comme premier fournisseur de services cloud Elite de NVIDIA. L'entreprise revendique 45 000 GPUs répartis dans ses centres de données et compte NVIDIA parmi ses investisseurs. Deux paliers de facturation sont exposés (à la demande et spot). Le catalogue couvre 9 familles de modèles de GPU, dont le B200 et le B300.17
Le programme ARENA de CoreWeave (IA-Ready Native Applications) permet aux clients d'évaluer des charges de travail à l'échelle de la production sur une infrastructure réelle avant de s'engager sur la capacité. La tarification se rapproche davantage de la catégorie hyperscaler que les autres neoclouds, reflétant un positionnement entreprise haut de gamme.
RunPod
RunPod propose deux offres : Secure Cloud (bare metal dédié) et Community Cloud (bare metal partagé à des tarifs inférieurs sans SLA). Le catalogue couvre 34 familles de modèles de GPU, dont l'AMD MI300X. Trois paliers de facturation sont exposés publiquement (à la demande, spot et réservé). Le démarrage des instances prend moins d'une minute, le plus rapide de nos mesures.18
Les mises à jour récentes incluent le retour en arrière sur version GitHub pour les endpoints Serverless, les endpoints d'équilibrage de charge en bêta et l'intégration du SDK Vercel IA via le package @runpod/ai-sdk-provider. Le catalogue Public Endpoints couvre des modèles de texte, d'image, de vidéo et d'audio avec des modèles de déploiement prêts à l'emploi.
Crusoe
Crusoe exploite des centres de données alimentés au gaz naturel torché ou piégé, un arbitrage de coût et d'émissions qui finance le déploiement de capacités H100 et B200. Le catalogue couvre 5 familles de modèles de GPU, dont l'AMD MI300X.19
FluidStack, Hyperstack, Nebius
FluidStack regroupe des capacités de GPU auprès de plusieurs opérateurs de centres de données. Hyperstack est l'une des sources de H100 les moins chères de la catégorie neocloud, avec une présence au Royaume-Uni et trois paliers de facturation. Nebius a son siège en Europe (Pays-Bas) et propose des B200 et B300 de pointe dans son catalogue.202122
Paperspace by DigitalOcean
Paperspace a été racheté par DigitalOcean et affirme servir plus de 650 000 utilisateurs. Le catalogue couvre 12 familles de modèles de GPU. L'interface de notebook Jupyter préchargée et la gestion visuelle des instances sont les différenciateurs historiques ; les utilisateurs avancés remplacent généralement l'interface graphique par des flux de travail Jupyter natifs ou SSH.23
Autres neoclouds spécialisés
TensorDock, CUDO Compute, Hot Aisle (axé sur l'AMD MI300X), Sesterce, Lyceum, Cirrascale (réservé uniquement, avec des options Cerebras et Graphcore), Together (niveau inférence) et Replicate (serverless) complètent la catégorie spécialisée. La plupart fonctionnent uniquement à la demande et visent les petites et moyennes équipes de développement en IA.2425262728293031
Datacrunch et Seeweb (spécialistes européens)
Datacrunch est un neocloud basé en Finlande fonctionnant à 100 % d'énergie renouvelable avec des H100, A100, RTX 6000 et V100 par groupes de 1, 2, 4 ou 8. Seeweb est un neocloud italien fonctionnant également à 100 % d'énergie renouvelable, avec cinq familles de modèles de GPU et le support de Terraform pour les flux de travail d'infrastructure as code.3233
Places de marché communautaires
Les places de marché communautaires regroupent des capacités de GPU auprès de nombreux petits opérateurs, souvent au plancher de la fourchette de prix publiée. Le compromis est la variabilité : bare metal partagé, SLA de disponibilité moins régulier et inventaire qui dépend du nombre d'opérateurs hôtes en ligne au moment de la demande.
Vast.ai
Vast.ai regroupe 57 familles de modèles de GPU et 196 configurations multi-GPU distinctes, le catalogue le plus profond parmi tous les fournisseurs suivis. Trois paliers de facturation sont exposés. La place de marché met en concurrence l'inventaire de nombreux petits opérateurs hôtes, ce qui signifie qu'un prix affiché sur le tableau de bord reflète la disponibilité actuelle et peut ne plus être valable cinq minutes plus tard. Le catalogue comprend également du matériel ancien (GTX 1080, époque K80) qu'aucun autre fournisseur suivi ne répertorie, utile pour l'expérimentation guidée par les coûts et les charges académiques.34
Salad
Salad fonctionne sur du matériel grand public distribué (des PC de jeu participant au réseau pendant les périodes d'inactivité). Le H100 n'est pas répertorié publiquement ; le catalogue s'oriente vers les RTX 4090, RTX 5090 et d'autres cartes grand public au plancher de ces classes de GPU sur l'ensemble des fournisseurs.35
Theta EdgeCloud
Theta EdgeCloud couvre 23 familles de modèles de GPU sur une empreinte réseau edge. L'architecture distribuée en périphérie est le différenciateur pour l'inférence sensible à la région ; la tarification est uniquement à la demande et l'inventaire varie selon le nœud edge.36
Demande des fournisseurs : adoption, dépenses et recherche
L'adoption, la part des dépenses et la part de recherche mesurent la demande pour chaque fournisseur.
- Adoption : part des acheteurs de cloud GPU utilisant chaque fournisseur.
- Part des dépenses : part de chaque fournisseur dans le total des dépenses de cloud GPU.
- Part de recherche : part de chaque fournisseur dans le volume de recherche mensuel combiné des sept fournisseurs sur leurs noms de marque.
L'adoption et la part des dépenses proviennent des données agrégées de dépenses par carte de cloud GPU de Ramp.37
CoreWeave domine les trois signaux au T1 2026, avec 35.4 % des acheteurs, 50.8 % des dépenses et 31.3 % de la recherche. La divergence la plus forte se situe entre Crusoe et RunPod. Crusoe détient 27.7 % des dépenses pour 3.0 % des acheteurs et 0.9 % des recherches. RunPod représente 27.7 % des acheteurs et 25.7 % des recherches, avec 0.5 % des dépenses.
La part de recherche mesure davantage la notoriété que la demande engagée, et elle peut devancer les dépenses. Vultr est le cas le plus clair. Il représente 18.5 % de la recherche contre 3.0 % des dépenses, car c'est une marque de VPS généraliste et la plupart de ces recherches de marque concernent l'hébergement plutôt que la location de GPU.
Comment les signaux de recherche sont mesurés
La part de recherche totalise 100 % au sein des fournisseurs présentés plutôt que sur l'ensemble du marché, sur la fenêtre allant du T3 2025 au T1 2026 où les trois signaux se chevauchent. La recherche de chaque fournisseur est comptabilisée sur son terme de marque :
Pour les trajectoires de prix de ces fournisseurs, consultez l'indice des prix de location de GPU cloud.
Modèles de déploiement
Les services de location de GPU se présentent sous trois formes de déploiement. Chaque forme échange du contrôle contre de la commodité.
Serverless GPU
Les services GPU serverless gèrent le provisionnement, la mise à l'échelle et la libération au nom de l'acheteur. Le fournisseur facture à la seconde ou à la milliseconde d'utilisation réelle du GPU ; le temps d'inactivité est gratuit. Cette forme convient aux charges sporadiques, à l'inférence par lots et aux applications d'IA générative ponctuelles où l'utilisation moyenne est faible.
Les fournisseurs courants de GPU serverless incluent Replicate, RunPod Serverless, Modal, Fal.ai et Together. Le débit par dollar dépasse généralement celui des GPU provisionnés lorsque l'utilisation est inférieure à 30-40 % ; au-delà de ce seuil, les instances GPU à la demande ou réservées sont moins chères.3138394030
GPU virtuel (vGPU)
Les GPU virtuels sont la forme la plus courante. Un hyperviseur partitionne un GPU physique en une ou plusieurs tranches virtuelles, chacune s'exécutant dans une machine virtuelle. Tous les grands hyperscalers et la plupart des neoclouds proposent cette forme par défaut. Les compromis : un coût prévisible, une large disponibilité entre fournisseurs et une légère latence due à la couche de virtualisation.
GPU bare metal
Les services de GPU bare metal fournissent un serveur GPU physique dédié sans couche de virtualisation. L'acheteur obtient un accès direct au matériel pour des performances maximales et une latence minimale. Cette forme convient aux grands entraînements, aux charges HPC et à tous les cas où les frais de virtualisation comptent. OCI, CoreWeave et Lambda Labs proposent tous des options bare metal. AWS et Azure les exposent via des familles d'instances spécifiques (p5d sur AWS, série ND sur Azure).
FAQ
Les hyperscalers exploitent de vastes plateformes cloud où la location de GPU n'est qu'une gamme de produits parmi beaucoup d'autres. Les neoclouds spécialisés se concentrent sur l'infrastructure GPU et IA comme produit principal. Les hyperscalers facturent de 3 à 6x plus que les neoclouds pour le même GPU ; l'écart reflète les services d'entreprise groupés plutôt que la matière première de calcul. Pour une comparaison soutenue des tendances de prix entre catégories, consultez l'indice des prix de location de GPU cloud.
Utilisez le serverless lorsque l'utilisation moyenne du GPU est inférieure à 30-40 %, lorsque les charges sont ponctuelles ou lorsque les frais d'exploitation représentent un coût plus élevé que le tarif horaire. Un GPU provisionné sur un neocloud est moins cher à forte utilisation soutenue.
Pour les charges soumises à des exigences de résidence des données dans l'UE, ou pour les acheteurs servant des clients européens sur des chemins sensibles à la latence, oui. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch et Seeweb sont des options dont le siège est dans l'UE. Les prix égalent généralement ou dépassent légèrement ceux des neoclouds basés aux États-Unis ; la prime rémunère la résidence, la juridiction et les arguments de durabilité plutôt que la puissance de calcul brute.
Pour aller plus loin
- Benchmark multi-GPU : B200 vs H200 vs H100 vs MI300X
- Benchmark de concurrence GPU
- Top 25+ fabricants de puces IA : NVIDIA et ses concurrents
- Indice des prix de location de GPU cloud
Citer cette recherche
Choisissez le format qui correspond à votre lieu de publication. Coller la version avec lien dans votre CMS préserve le lien retour.
@misc{dogan2026,
author = {Dogan, Sedat and Sarı, Ekrem},
title = {{Top 70+ fournisseurs de GPU cloud}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/cloud-gpu-providers}},
note = {AIMultiple. Consulté le 25 Août 2026}
}Résultats et horodatages de 82 points de données. Téléchargez les données utilisées dans cet article sous forme de fichier ZIP contenant 3 fichiers CSV.
Journal des modifications
22 mises à jour- 2026
Suppression de la section Tarification par niveau de fournisseur dans la comparaison des fournisseurs de GPU cloud.
Ajout d'une section sur la demande des fournisseurs couvrant adoption, part de dépenses et part de recherche.
Remplacée la liste des fournisseurs par un tableau comparatif par niveaux couvrant modèles, combinaisons et paliers de facturation de 64 fournisseurs.
Ajouté AWS EC2 G7e avec GPUs NVIDIA Blackwell aux Mises à jour récentes.
- 2025
Ajout de RunPod à la section des fournisseurs de GPU virtuels.
Ajout de RunPod à la liste des fournisseurs de GPU virtuels.
Développée la section « Que sont les fournisseurs de GPU sans serveur ? ».
Ajout de NVIDIA Confidential Computing à la section FAQ.
La section FAQ a été enrichie d'informations sur la pénurie d'approvisionnement en GPU.
RunPod a été ajouté à la liste des fournisseurs de GPU cloud.
Mise à jour de l'introduction de la section du modèle de GPU.
- 2024
Mise à jour de la méthodologie de classement dans l'introduction.
Ajout d'une section sur les GPU cloud les plus rentables.
Ajout d'une section, Comment démarrer la bonne instance pour vos besoins en GPU cloud.
Développé les avantages de NVIDIA DGX Cloud.
Remplacement des données de tarification AWS EC2 dans la section AWS.
- 2023
L'introduction a été enrichie de détails sur la livraison de GPU sans serveur, virtuels et bare-metal.
Ajout de Seeweb à la liste des fournisseurs européens de GPU cloud.
Ajout d'informations client Oracle à la section Oracle Cloud Infrastructure.
OVHcloud ajouté à la liste des futurs fournisseurs de GPU cloud.
Ajout d'une section, Qu'est-ce qu'une plateforme GPU cloud ?, à la section Liens externes.
Ajout de Alibaba Cloud à la section Liens externes.
Liens de référence
- A 20 ans d’expérience en tant que hacker white-hat et gourou du développement, avec une expertise approfondie des langages de programmation et des architectures de serveurs.
- Est conseiller d’administration auprès d’un VC qui investit dans des entreprises technologiques en phase de démarrage et chez Ödeal, une plateforme de paiement numérique régionale servant 125 000 commerçants.
- A dirigé l’infrastructure technologique et la cybersécurité de sept élections nationales, et a été reconnu au Hall of Fame de la cybersécurité par des leaders technologiques mondiaux dont Twitter.
Commentaires 4
Partagez vos idées
Votre adresse courriel ne sera pas publiée. Tous les champs sont obligatoires. Les commentaires sont laissés dans leur langue d'origine.
Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?
Sure, thank you for the suggestion, we will consider it in the next edit.
Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.
Sure, we'll review to see if we can include Dataoorts in the next edit.
Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.
Sure, we'll be reaching out to understand what Atlascloud.ai is offering.
Where is Nebius.ai ???
Thank you! It is added now.