Les tarifs à la demande pour les GPU cloud de dernière génération (B200, B300, MI300X, RTX 5090) ont environ doublé au cours de l'année écoulée, tandis que les cartes grand public (H100, H200, A100) sont restées dans une fourchette étroite. Nous compilons l'indice GPU chaque mois à partir de 63 fournisseurs et 17 GPU models, couvrant les niveaux à la demande, spot et réservés sur 1 an.
Tendances des prix par génération de GPU
Le graphique montre le prix médian mensuel affiché dans trois groupes de dates de sortie. Nous répartissons 17 GPU models en trois catégories par date de lancement :
La majeure partie de l'augmentation provient des annonces B200 et B300 qui sont passées des fournisseurs neocloud aux grilles tarifaires des hyperscalers. Ces annonces hyperscaler sont généralement 2x à 3x plus élevées, ce qui augmente la médiane de la catégorie à mesure qu'elles entrent dans le dataset.
Les GPU modernes ont augmenté d'environ 25 %, mais ce mouvement est en grande partie statistique. Google Cloud a ajouté sa variante A3z Mega H100 à l'annonce standard A3, faisant passer la médiane de la cohorte H100 d'environ 2 $ à environ 3 $. En dessous, les H100 neocloud ont baissé. Nous le signalons dans la section suivante.
Les GPU ancienne génération sont passés de 1,78 $ à 0,99 $ sur la période, sous l'effet de la perte par la cohorte V100 de ses ancrages hyperscaler haut de gamme à mesure que les entreprises retirent le SKU. Un ou deux fournisseurs par carte ancienne génération restent dans notre dataset : AWS répertorie K80 à 0,90 $, P40 se trouve chez Vast.ai à 0,11 $, et le reste sont des cas marginaux similaires avec une seule annonce.
Le marché contractuel a évolué différemment : les engagements H100 sur 1 an ont augmenté sur la même période, tandis que notre médiane H100 à la demande est restée à peu près stable. Cela montre une différence croissante entre les prix au mois et les prix engagés sur 1 an.
Consultez notre méthodologie de l'indice GPU pour savoir comment cela est calculé.
Tendances des prix par GPU model
Le graphique ci-dessous couvre 10 GPU : 5 modèles modernes, 4 modèles dernière sortie et le V100 comme référence ancienne génération.
GPU modernes (H100, H200, A100, L40S, RTX 4090)
IONOS couvre ce niveau depuis l'UE : T4, A10 et RTX PRO 6000 Blackwell à la demande, ainsi que des serveurs H100 et H200 dédiés à un tarif fixe de 3 990 $/mois avec résidence des données dans l'UE.
H100 est répertorié par 46 fournisseurs, la couverture la plus large de tous les accélérateurs actuels. La médiane de la cohorte est maintenant d'environ 2,99 $/GPU-heure, en baisse par rapport à plus de 7 $ au début de 2024. Thunder Compute, Vast.ai et RunPod se situent au bas de la fourchette ; Microsoft Azure et Google Cloud portent la queue supérieure au-delà de 10 $. La ligne Google Cloud est elle-même un mélange de trois SKU (a3-highgpu, a3-megagpu, a3-edgegpu) regroupés sous une seule étiquette nvidia-h100, ce qui élève la médiane de sa cohorte.
La fourchette du H200 va de 2,30 $ (FluidStack) à 13,78 $ (Microsoft Azure), avec une médiane de cohorte autour de 4,00 $. Le plancher dépend de si vous considérez les annonces de niveau communautaire ou de partage d'instance comme comparables à la capacité dédiée. Une fois celles-ci mises de côté, la médiane effective se situe dans la bande de 3 à 4 $.
L'A100 maintient une fourchette neocloud étroite autour de 1,79 $, avec une ou deux valeurs aberrantes d'inference serverless (Replicate à 5,04 $) tirant la queue supérieure vers le haut. Traitez les tarifs serverless séparément lorsque vous comparez les fournisseurs IaaS.
Le L40S s'est stabilisé autour d'une médiane de 1,56 $, avec AWS à 7,58 $ fixant le plafond. Le RTX 4090 est la carte de classe entraînement la moins chère de l'indice avec une médiane de 0,52 $, avec Salad à 0,18 $ et Beam à 1,61 $ encadrant la fourchette. Les deux ciblent l'inference sub-100B et le fine-tuning par lots, où ils remplacent souvent l'A100 à une fraction du prix.
GPU dernière sortie (B200, B300, MI300X, RTX 5090)
B200 médiane 6,11 $, fourchette de 3,44 $ (Vast.ai) à 16,11 $ (Google Cloud). B300 médiane 7,92 $, fourchette de 5,44 $ (Vast.ai) à 18,00 $ (Oracle Cloud). MI300X médiane 2,72 $, fourchette de 1,99 $ (DigitalOcean) à 7,86 $ (Microsoft Azure). RTX 5090 médiane 0,66 $, fourchette de 0,27 $ (Salad) à 2,00 $ (Vast.ai).
Le schéma se répète à partir de la courbe antérieure du H100 : les hyperscalers proposent les nouveaux accélérateurs à 3 à 5x les planchers neocloud pendant la première année. Le B300 est encore en hausse sur le graphique, car les annonces supplémentaires des hyperscalers continuent d'augmenter la médiane. Le MI300X est l'exception en termes d'offre ; il est répertorié en dessous du plancher H100 chez DigitalOcean et TensorWave, mais il fonctionne sur ROCm et toutes les charges de travail CUDA ne se portent pas facilement.
Référence ancienne génération (V100)
Le V100, la carte ancienne génération sur le graphique, est inclus comme ligne de référence de la génération 2017. La médiane de la cohorte est passée de 1,84 $ à la mi-2024 à environ 0,99 $ aujourd'hui chez 17 fournisseurs. Les hyperscalers maintiennent les SKU V100 pour les clients de conformité exécutant des charges de travail immuables ; les neoclouds les ont pour la plupart abandonnés.
Tendances des prix par fournisseur
Pour le même GPU, les prix affichés par les hyperscalers sont généralement 3x à 6x plus élevés que les annonces neocloud les plus basses du dataset. La profondeur du catalogue varie selon le fournisseur, le GPU, la région et le type de facturation.
Offre et disponibilité
L'offre varie plus largement que les prix affichés. Le graphique ci-dessous montre la part des annonces de chaque GPU signalant un stock confirmé aujourd'hui, triée du plus tendu au plus disponible.
Les MI300X et L40S sont les plus tendus à 44 %, avec les B200 et B300 derrière à 52-54 %. Les H100, A100 et H200 se regroupent près de 63-70 %, où environ deux tiers du catalogue est en stock confirmé et le reste dépend du provisionnement. Les RTX 4090 et RTX 5090 atteignent 93-97 %, reflétant une offre plus profonde de cartes grand public et une demande d'entreprise par carte plus faible.
Choisir un GPU et un fournisseur
Le choix du GPU est façonné par trois axes : la charge de travail, la durée et la région. La tarification spot vs à la demande se superpose aux trois.
Par charge de travail
Par durée
Moins d'une semaine : Neocloud à la demande au plancher de la fourchette.
Multi-semaine : Demandez un devis (les neoclouds proposent généralement des réductions de 15 à 30 % pour des engagements de 4 à 12 semaines ; les hyperscalers proposent des niveaux réservés sur 1 an).
Pluri-annuel : négociez directement avec les fournisseurs, car les tarifs à la demande affichés ne reflètent pas les remises sur engagements à terme.
Économies sur réservation
La remise sur réservation d'un an est généralement de 16 à 39 % par rapport au tarif à la demande affiché, les économies les plus importantes étant réalisées sur B200, AMD MI300X et le L40S de niveau inference, où les fournisseurs se livrent une concurrence plus forte pour la capacité engagée.
H100 et H200 bénéficient de remises modestes à un chiffre ou faibles à deux chiffres ; leur marché à la demande est suffisamment concurrentiel pour que les fournisseurs ne sacrifient pas leur marge pour des engagements. B200 se réserve à -39 %, MI300X à -31 %, L40S à -30 %. Le graphique montre la médiane inter-fournisseurs pour les deux niveaux de facturation ; les devis individuels des fournisseurs peuvent aller plus loin pour des termes pluriannuels non reflétés ici.
Spot vs à la demande
Le graphique de suivi des remises spot montre la remise médiane spot vs à la demande par catégorie. Au cours des six derniers mois, les modernes économisent environ 50 %, les dernières sorties environ 49 %, les anciennes générations environ 75 % (l'ancienne génération est plus bruyante qu'il n'y paraît ; peu de fournisseurs publient encore des tarifs spot pour ces cartes).
Si votre charge de travail tolère des interruptions de 5 à 15 minutes, le spot est le plus grand levier de coût disponible. Basculez le menu déroulant de facturation dans le graphique explorateur en haut pour voir le tarif spot côte à côte avec le tarif à la demande pour tout fournisseur de votre liste restreinte.
Méthodologie de l'indice GPU
L'indice couvre les prix de location horaires affichés des GPU cloud pour les niveaux à la demande, spot et réservés sur 1 an (lorsque les fournisseurs les répertorient publiquement). Il ne couvre pas les contrats pluriannuels, les tarifs négociés par les entreprises, les combinaisons spot-plus-plan d'économies ni le coût total de possession.
Nos données sont des instantanés mensuels sur 24 mois (juillet 2024 à juin 2026), filtrés sur 17 GPU models sélectionnés chez 63 fournisseurs. Chaque instantané rapporte, pour chaque cellule (fournisseur, GPU, type de facturation, mois), le taux horaire par GPU min, max, moyen et médian, plus le nombre d'offres derrière ces chiffres.
Les prix H100, A100, H200, B200, B300 et V100 sont des médianes prises sur plusieurs versions physiques de la carte (PCIe, SXM ou interconnexion NVL ; pour A100 et V100, également 40/80 Go ou 16/32 Go de VRAM) que les fournisseurs répertorient sous un seul nom.
Comment chaque graphique est calculé
Nous utilisons la médiane des médianes partout : les fournisseurs et les GPU entrent chacun dans le chiffre principal avec un poids égal, de sorte qu'un fournisseur avec 38 annonces ne noie pas un nouveau venu avec 5 annonces.
Résumé du marché (trois lignes de catégorie) :
Le menu déroulant de facturation réexécute les étapes 2-3 pour le niveau sélectionné (à la demande, spot ou réservation). Une quatrième option « Moyenne » trace la moyenne arithmétique des médianes des trois niveaux par catégorie et par mois, limitée aux mois où les trois niveaux ont des données.
Explorateur fournisseur × facturation :
Pour le fournisseur et le niveau de facturation que vous sélectionnez, chaque ligne trace la médiane mensuelle d'un GPU au fil du temps. Aucune agrégation inter-fournisseurs n'est appliquée : le point de chaque mois est le prix médian des annonces de ce fournisseur pour ce GPU et ce niveau de facturation. La ligne s'arrête là où l'offre disparaît du catalogue.
GPU modernes côte à côte :
Mêmes étapes 1-2 que le résumé du marché, limitées à la tarification à la demande. Chaque ligne est la médiane mensuelle inter-fournisseurs pour un GPU. Aucune agrégation inter-GPU. Huit séries.
Suivi des remises spot :
Cela associe chaque prix spot à son homologue à la demande du même fournisseur, même GPU, même mois, de sorte que la remise reflète l'écart réel qu'un acheteur chez ce fournisseur verrait, et non une différence de bruit inter-marchés.
Aperçu de la disponibilité :
Aperçu uniquement, pas d'agrégation temporelle. Les annonces signalées comme stock inconnu, liste d'attente ou indisponibles sont toujours comptées dans le dénominateur mais ne sont pas dessinées séparément sur le graphique, car le signal exploitable pour l'acheteur est la part confirmée disponible.
Économies sur réservation :
FAQ
Nous publions une vue médiane mensuelle actualisée chaque mois. Les chiffres reflètent les données jusqu'au mois précédent.
Le GPU est le même ; le bundle ne l'est pas. Les hyperscalers intègrent dans leurs prix la conformité (HIPAA, SOC 2, FedRAMP), les SLA d'entreprise, l'intégration d'identité et de réseau, et le support 24/7. Les neoclouds facturent l'accès bare metal ou VM avec une orchestration gérée en option. Si vous n'avez pas besoin du bundle, le prix neocloud est la bonne comparaison.
Oui, si votre charge de travail crée des points de reprise et tolère des interruptions de 5 à 15 minutes. La remise spot des GPU modernes se situe près de 50 % au cours des six derniers mois, et les économies s'accumulent sur plusieurs jours d'entraînement. Le spot est le mauvais choix pour l'inference sensible à la latence, les services à réplica unique sans basculement, ou les évaluations qui nécessitent une comparaison propre du temps réel.
Le menu déroulant de facturation du graphique des tendances de prix par fournisseur bascule entre les niveaux à la demande, spot et réservés sur 1 an lorsque les fournisseurs publient ces tarifs. Les contrats pluriannuels et les remises négociées par les entreprises ne sont pas inclus. Demandez un devis directement au fournisseur pour ceux-ci.
Pour en savoir plus
- Benchmark Multi-GPU : B200 vs H200 vs H100 vs MI300X
- Top 30 fournisseurs de GPU Cloud et leurs GPU
- Benchmark de simultanéité GPU
- Top 25+ fabricants de puces IA : NVIDIA et ses concurrents
Citer cette recherche
Choisissez le format qui correspond à votre lieu de publication. Coller la version avec lien dans votre CMS préserve le lien retour.
@misc{sar2026,
author = {Sarı, Ekrem},
title = {{Indice des prix de location Cloud GPU}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Consulté le 16 Juillet 2026}
}
Soyez le premier à commenter
Votre adresse courriel ne sera pas publiée. Tous les champs sont obligatoires. Les commentaires sont laissés dans leur langue d'origine.