Indice des prix de location de GPU cloud
Les tarifs à la demande des GPU cloud de dernière génération (B200, B300, MI300X, RTX 5090) ont à peu près doublé au cours de l'année écoulée, tandis que les cartes grand public (H100, H200, A100) sont restées dans une fourchette resserrée. Nous compilons l'indice GPU chaque mois à partir de 69 fournisseurs et 17 modèles de GPU, couvrant les niveaux à la demande, spot et avec réservation d'un an.
Tendances des prix par génération de GPU
Le graphique montre le prix médian mensuel affiché dans trois groupes de dates de sortie. Nous répartissons 17 modèles de GPU en trois catégories selon leur date de lancement :
L'essentiel de la hausse provient de l'expansion des offres B200 et B300 des fournisseurs néocloud vers les grilles tarifaires des hyperscalers. Ces offres hyperscalers sont généralement 2x-3x plus élevées, ce qui fait monter la médiane de la catégorie à mesure qu'elles entrent dans l'ensemble de données.
Les GPU modernes ont progressé d'environ 25 %, mais cette évolution est en grande partie statistique. Google Cloud a ajouté sa variante A3z Mega H100 à l'offre A3 standard, faisant passer la médiane de la cohorte H100 d'environ 2 $ à environ 3 $. En dessous, les H100 néocloud sont orientés à la baisse. Nous le signalons dans la section suivante.
Les GPU Legacy ont baissé de $1,77 à $1,14 sur la période, la cohorte V100 perdant ses points d'ancrage hyperscalers haut de gamme à mesure que les entreprises retirent la référence. Un ou deux fournisseurs par carte Legacy restent dans notre ensemble de données : AWS propose la K80 à $0,90, la P40 est chez Vast.ai à $0,11, et le reste sont des cas limites similaires à offre unique.
Le marché des contrats a évolué différemment : les engagements d'un an sur H100 ont progressé sur la même période, tandis que notre médiane des H100 à la demande est restée à peu près stable. Cela montre un écart croissant entre les tarifs au mois et les tarifs avec engagement d'un an.
Consultez notre GPU index methodology pour savoir comment ce calcul est effectué.
Tendances des prix par modèle de GPU
Le graphique ci-dessous couvre 10 GPU : 5 modernes, 4 de dernière génération et le V100 comme référence Legacy.
GPU modernes (H100, H200, A100, L40S, RTX 4090)
IONOS couvre ce segment depuis l'UE : T4, A10 et RTX PRO 6000 Blackwell à la demande, plus des serveurs H100 et H200 dédiés à un tarif fixe de $3 990/mois avec résidence des données dans l'UE.
H100 est proposée par 54 fournisseurs, soit la couverture la plus large de tous les accélérateurs actuels. La médiane de la cohorte se situe désormais autour de $3,38/GPU-heure, contre plus de 7 $ début 2024. Thunder Compute, Vast.ai et RunPod se situent en bas de la fourchette ; Microsoft Azure et Google Cloud portent la queue supérieure au-delà de 10 $. La ligne Google Cloud est elle-même un mélange de trois références (a3-highgpu, a3-megagpu, a3-edgegpu) regroupées sous une seule étiquette nvidia-h100, ce qui relève sa médiane de cohorte.
La fourchette du H200 s'étend de $2,30 (FluidStack) à $13,78 (Microsoft Azure), avec une médiane de cohorte autour de $4.47. Le plancher dépend de la prise en compte des offres de niveau communautaire ou de partage d'instance comme comparables à la capacité dédiée. Une fois celles-ci écartées, la médiane utile se situe dans la bande de 3 à 4 $.
L'A100 se maintient dans une bande néocloud étroite autour de $1,86, avec une ou deux valeurs aberrantes d'inférence serverless (Replicate à $5,04) qui tirent la queue haute vers le haut. Traitez les tarifs serverless séparément lorsque vous comparez des fournisseurs IaaS.
La L40S s'est stabilisée autour d'une médiane de $1,54, AWS fixant le plafond à $7.58. La RTX 4090 est la carte de classe entraînement la moins chère de l'indice, avec une médiane de $0,43, Salad à $0,18 et Beam à $1,61 qui encadrent la fourchette. Toutes deux ciblent l'inférence sub-100B et le fine-tuning par lots, où elles remplacent souvent l'A100 pour une fraction du prix.
GPU de dernière génération (B200, B300, MI300X, RTX 5090)
B200 : médiane de $6,22, fourchette de $3,75 (Packet.ai) à $16,11 (Google Cloud). B300 : médiane de $7,98, fourchette de $6,90 (TheAI Cloud) à $17,80 (AWS). MI300X : médiane de $3,00, fourchette de $2,39 (RunPod) à $7,86 (Microsoft Azure). RTX 5090 : médiane de $0,54, fourchette de $0,29 (Salad) à $3,63 (Vast.ai).
Le schéma reprend la courbe antérieure du H100 : les hyperscalers proposent les nouveaux accélérateurs à des prix 3 à 5x supérieurs aux planchers néocloud durant la première année. Le B300 continue de progresser sur le graphique, car les offres hyperscalers supplémentaires font monter la médiane. Le MI300X est l'exception côté offre ; il est proposé sous le plancher du H100 chez DigitalOcean et TensorWave, mais il fonctionne sur ROCm et toutes les charges CUDA ne se portent pas facilement.
Référence Legacy (V100)
La V100, carte Legacy du graphique, est incluse comme ligne de référence de la génération 2017. La médiane de la cohorte est passée de $1,84 mi-2024 à environ $1,57 aujourd'hui chez 21 fournisseurs. Les hyperscalers conservent des références V100 pour les clients ayant des obligations de conformité et des charges de travail immuables ; les néoclouds les ont pour la plupart abandonnées.
Tendances des prix par fournisseur
Pour un même GPU, les prix affichés par les hyperscalers sont généralement 3x-6x plus élevés que les offres néocloud les plus basses du jeu de données. La profondeur du catalogue varie selon le fournisseur, le GPU, la région et le type de facturation.
Offre et disponibilité
L'offre varie plus fortement que les prix affichés. Le graphique ci-dessous montre la part des offres de chaque GPU signalant un stock confirmé aujourd'hui, triée de la plus tendue à la plus disponible.
Le MI300X et le B300 sont les plus tendus, entre 5 et 28 %, suivis de près par le B200 et la L40S, entre 30 et 40 %. Les H200, H100 et A100 se regroupent autour de 43-51 %, où environ la moitié du catalogue est en stock confirmé et le reste dépend du provisionnement. Les RTX 4090 et RTX 5090 atteignent 53-76 %, ce qui reflète une offre de cartes grand public plus profonde et une demande d'entreprise plus faible par carte.
Choisir un GPU et un fournisseur
Le choix d'un GPU dépend de trois axes : la charge de travail, la durée et la région. La tarification spot par rapport à la tarification à la demande s'ajoute par-dessus ces trois axes.
Par charge de travail
Par durée
Moins d'une semaine : néocloud à la demande au plancher de la fourchette.
Plusieurs semaines : Demandez un devis (les néoclouds accordent généralement une remise 15-30 % pour des engagements de 4-12 semaines ; les hyperscalers proposent des niveaux avec réservation d'un an).
Plusieurs années : négociez directement avec les fournisseurs, car les tarifs à la demande affichés ne reflètent pas les remises sur engagements à long terme.
Économies liées à la réservation
La remise avec réservation d'un an se situe généralement entre 5 et 38 % par rapport au tarif à la demande affiché, les économies les plus importantes concernant le B300, la L40S de niveau inférence et le B200, où les fournisseurs se disputent davantage la capacité engagée.
Les H100 et H200 affichent des remises modestes, de quelques points à un peu plus de dix pour cent ; leur marché à la demande est suffisamment concurrentiel pour que les fournisseurs ne sacrifient pas leur marge pour des engagements. Le B200 est proposé en réservation à -15 %, le MI300X à -8 %, la L40S à -28 %. Le graphique montre la médiane entre fournisseurs pour les deux modes de facturation ; les devis individuels des fournisseurs peuvent être plus bas pour des durées pluriannuelles non reflétées ici.
Spot par rapport à la demande
Le graphique de suivi des remises spot montre la remise médiane spot par rapport à la demande par catégorie. Au cours des six derniers mois, les GPU modernes économisent environ 50 %, ceux de dernière génération environ 49 %, les Legacy environ 61 % (la catégorie Legacy est plus bruitée qu'il n'y paraît ; peu de fournisseurs publient encore des tarifs spot pour ces cartes).
Si votre charge de travail tolère des interruptions de 5 à 15 minutes, le spot est le plus grand levier de coût disponible. Utilisez le menu déroulant de facturation dans le graphique explorateur en haut pour voir le tarif spot côte à côte avec le tarif à la demande pour tout fournisseur de votre liste.
Méthodologie de l'indice GPU
L'indice couvre les prix horaires affichés de location de GPU cloud sur les niveaux à la demande, spot et avec réservation d'un an (lorsque les fournisseurs les publient). Il ne couvre pas les contrats pluriannuels, les tarifs négociés en entreprise, les combinaisons spot et plans d'économies, ni le coût total de possession.
Nos données sont des instantanés mensuels sur 26 mois (de juillet 2024 à août 2026), filtrés sur 17 modèles de GPU sélectionnés chez 69 fournisseurs. Chaque instantané indique, pour chaque cellule (fournisseur, GPU, type de facturation, mois), le minimum, le maximum, la moyenne et la médiane du tarif horaire par GPU, ainsi que le nombre d'offres derrière ces chiffres.
Les prix des H100, A100, H200, B200, B300 et V100 sont des médianes calculées sur plusieurs versions physiques de la carte (interconnexion PCIe, SXM ou NVL ; pour l'A100 et la V100, également 40/80 Go ou 16/32 Go de VRAM) que les fournisseurs regroupent sous un même nom.
Comment chaque graphique est calculé
Nous utilisons la médiane des médianes partout : les fournisseurs et les GPU entrent chacun dans le chiffre principal avec un poids égal, de sorte qu'un fournisseur avec 38 offres ne noie pas un nouvel entrant avec 5 offres.
Synthèse du marché (trois lignes de catégorie) :
Le menu déroulant de facturation réexécute les étapes 2 et 3 pour le niveau sélectionné (à la demande, spot ou réservation). Une quatrième option « Moyenne » trace la moyenne arithmétique des médianes des trois niveaux par catégorie et par mois, limitée aux mois où les trois niveaux ont des données.
Explorateur fournisseur × facturation :
Pour le fournisseur et le niveau de facturation que vous sélectionnez, chaque ligne suit la médiane mensuelle d'un GPU dans le temps. Aucune agrégation entre fournisseurs n'est appliquée : chaque point mensuel est le prix médian des offres de ce fournisseur pour ce GPU et ce niveau de facturation. La ligne s'arrête là où l'offre disparaît du catalogue.
GPU modernes côte à côte :
Étapes 1 et 2 identiques à celles de la synthèse du marché, limitées à la tarification à la demande. Chaque ligne est la médiane mensuelle entre fournisseurs pour un GPU. Aucune agrégation entre GPU. Huit séries.
Suivi des remises spot :
Cela associe chaque prix spot à son équivalent à la demande chez le même fournisseur, pour le même GPU et le même mois, afin que la remise reflète l'écart réel qu'un acheteur verrait chez ce fournisseur, et non une différence de bruit entre marchés.
Aperçu de la disponibilité :
Aperçu uniquement, sans agrégation temporelle. Les offres signalées comme stock inconnu, liste d'attente ou indisponibles sont toujours comptées dans le dénominateur, mais ne sont pas dessinées séparément sur le graphique, car le signal exploitable pour l'acheteur est la part confirmée disponible.
Économies liées à la réservation :
FAQ
Nous publions chaque mois une vue médiane mensuelle actualisée. Les chiffres reflètent les données jusqu'au mois précédent.
Le GPU est le même ; l'offre groupée ne l'est pas. Les hyperscalers intègrent dans le prix la conformité (HIPAA, SOC 2, FedRAMP), les SLA d'entreprise, l'intégration de l'identité et du réseau, ainsi que le support 24/7. Les néoclouds facturent l'accès au bare metal ou aux VM avec une orchestration managée en option. Si vous n'avez pas besoin de l'offre groupée, le prix Néocloud est la bonne comparaison.
Oui, si votre charge de travail peut être mise en checkpoint et tolère des interruptions de 5 à 15 minutes. La remise spot sur les GPU modernes se situe autour de 50 % au cours des six derniers mois, et les économies s'accumulent sur un entraînement de plusieurs jours. Le spot est un mauvais choix pour l'inférence sensible à la latence, les services à réplique unique sans basculement, ou les évaluations qui nécessitent une comparaison propre du temps réel.
Le menu déroulant de facturation du graphique des tendances de prix par fournisseur bascule entre les niveaux à la demande, spot et avec réservation d'un an lorsque les fournisseurs publient ces tarifs. Les contrats pluriannuels et les remises négociées en entreprise ne sont pas inclus. Demandez directement un devis au fournisseur pour ceux-ci.
Pour aller plus loin
- Benchmark multi-GPU : B200 vs H200 vs H100 vs MI300X
- Top 30 des fournisseurs de GPU cloud et leurs GPU
- Benchmark de concurrence des GPU
- Top 25+ fabricants de puces d'IA : NVIDIA et ses concurrents
Citer cette recherche
Choisissez le format qui correspond à votre lieu de publication. Coller la version avec lien dans votre CMS préserve le lien retour.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Indice des prix de location de GPU cloud}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Consulté le 25 Août 2026}
}Journal des modifications
3 mises à jour- 2026
Updated l'indice GPU sur 63 fournisseurs, avec nouvelles médianes, taux de stock confirmé et remises réservées, et IONOS ajouté.
Remplacement des médianes et des fourchettes des sections GPU modernes et derniers GPU sortis par de nouvelles valeurs.
Ajout d'une option de facturation "Moyenne" au graphique de synthèse du marché dans la section méthodologie.
Soyez le premier à commenter
Votre adresse courriel ne sera pas publiée. Tous les champs sont obligatoires. Les commentaires sont laissés dans leur langue d'origine.