As tarifas sob demanda para as GPUs de última geração em nuvem (B200, B300, MI300X, RTX 5090) aproximadamente dobraram no último ano, enquanto as placas convencionais (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente de 63 provedores e 17 modelos de GPU, abrangendo os níveis sob demanda, spot e reservado de 1 ano.
Tendências de preços por geração de GPU
O gráfico mostra o preço mediano mensal publicado em três faixas de data de lançamento. Dividimos 17 modelos de GPU em três categorias por data de lançamento:
A maior parte do aumento veio das listagens B200 e B300 que se expandiram de provedores neocloud para as tabelas de preços dos hyperscalers. Essas listagens de hyperscalers são tipicamente 2x-3x mais altas, elevando a mediana da categoria à medida que entram no dataset.
As GPUs modernas subiram aproximadamente 25%, mas o movimento é em grande parte estatístico. O Google Cloud adicionou sua variante A3z Mega H100 à listagem padrão A3, elevando a mediana da coorte H100 de ~$2 para ~$3. Por baixo, a H100 neocloud tendeu a cair. Destacamos isso na próxima seção.
As GPUs legadas caíram de $1.78 para $0.99 ao longo do período, impulsionadas pela coorte V100 que perdeu suas âncoras de hyperscaler de ponta à medida que as empresas descontinuam o SKU. Um ou dois provedores por placa Legada permanecem em nosso dataset: AWS lista K80 a $0.90, P40 está no Vast.ai a $0.11, e o restante são casos isolados de listagem única semelhantes.
O mercado de contratos se moveu de forma diferente: os compromissos de 1 ano da H100 tenderam a subir no mesmo período, enquanto nossa mediana sob demanda da H100 ficou praticamente estável. Isso mostra uma diferença crescente entre os preços mês a mês e os comprometidos de 1 ano.
Veja nossa metodologia do índice de GPU para saber como isso é calculado.
Tendências de preços por modelo de GPU
O gráfico abaixo abrange 10 GPUs: 5 Modernas, 4 Lançadas mais recentemente e a V100 como referência Legada.
GPUs modernas (H100, H200, A100, L40S, RTX 4090)
A IONOS cobre este nível a partir da UE: T4, A10 e RTX PRO 6000 Blackwell sob demanda, além de servidores dedicados H100 e H200 por uma taxa fixa de $3.990/mês com residência de dados na UE.
A H100 é listada por 46 provedores, a mais ampla de qualquer acelerador atual. A mediana da coorte está agora em torno de $2,99/GPU-hora, abaixo dos mais de $7 no início de 2024. Thunder Compute, Vast.ai e RunPod estão na base da dispersão; Microsoft Azure e Google Cloud carregam a cauda superior acima de $10. A linha do Google Cloud é ela própria uma mistura de três SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) colapsadas sob um rótulo nvidia-h100, o que eleva sua mediana de coorte.
A faixa da H200 vai de $2,30 (FluidStack) a $13,78 (Microsoft Azure), com uma mediana de coorte em torno de $4,00. O piso depende de você tratar as listagens de nível comunitário ou de compartilhamento de instância como comparáveis à capacidade dedicada. Deixando essas de lado, a mediana de trabalho fica na faixa de $3-4.
A A100 mantém uma faixa neocloud apertada em torno de $1,79, com um ou dois outliers de inferência serverless (Replicate a $5,04) puxando a cauda superior para cima. Trate as taxas serverless separadamente ao comparar provedores IaaS.
A L40S se estabilizou em torno de uma mediana de $1,56, com a AWS a $7,58 estabelecendo o teto. A RTX 4090 é a placa de classe de treinamento mais barata do índice, com mediana de $0,52, com Salad a $0,18 e Beam a $1,61 delimitando a dispersão. Ambas visam inferência abaixo de 100B e fine-tuning em lote, onde frequentemente substituem a A100 por uma fração do preço.
GPUs lançadas mais recentemente (B200, B300, MI300X, RTX 5090)
B200 mediana $6,11, faixa de $3,44 (Vast.ai) a $16,11 (Google Cloud). B300 mediana $7,92, faixa de $5,44 (Vast.ai) a $18,00 (Oracle Cloud). MI300X mediana $2,72, faixa de $1,99 (DigitalOcean) a $7,86 (Microsoft Azure). RTX 5090 mediana $0,66, faixa de $0,27 (Salad) a $2,00 (Vast.ai).
O padrão se repete a partir da curva anterior da H100: os hyperscalers carregam novos aceleradores com preços de 3 a 5x o piso dos neoclouds durante o primeiro ano. A B300 ainda está com tendência de alta no gráfico, à medida que listagens adicionais de hyperscalers continuam elevando a mediana. A MI300X é o outlier de oferta; ela é listada abaixo do piso da H100 na DigitalOcean e TensorWave, mas roda em ROCm e nem toda carga de trabalho CUDA é portada com facilidade.
Referência legada (V100)
A V100, a placa Legada no gráfico, está incluída como uma linha de referência da geração de 2017. A mediana da coorte caiu de $1,84 em meados de 2024 para cerca de $0,99 hoje, entre 17 provedores. Os hyperscalers mantêm SKUs V100 para clientes de conformidade que executam cargas de trabalho imutáveis; os Neoclouds, em sua maioria, as abandonaram.
Tendências de preços por provedor
Para a mesma GPU, os preços publicados pelos hyperscalers são tipicamente 3x-6x mais altos do que as listagens neocloud mais baixas no dataset. A profundidade do catálogo varia por provedor, GPU, região e tipo de cobrança.
Oferta e disponibilidade
A oferta varia mais amplamente do que os preços de tabela. O gráfico abaixo mostra a parcela de cada listagem de GPU que reporta estoque confirmado hoje, ordenada da mais escassa para a mais disponível.
MI300X e L40S são as mais escassas, com 44%, com B200 e B300 logo atrás, com 52-54%. H100, A100 e H200 se agrupam perto de 63-70%, onde aproximadamente dois terços do catálogo são estoque confirmado e o restante depende de provisionamento. RTX 4090 e RTX 5090 chegam a 93-97%, refletindo uma oferta de placas de consumo mais profunda e uma demanda empresarial menor por placa.
Escolhendo uma GPU e um provedor
A escolha da GPU é moldada por três eixos: carga de trabalho, duração e região. A precificação spot vs. sob demanda se sobrepõe a todos os três.
Por carga de trabalho
Por duração
Menos de uma semana: Neocloud sob demanda no piso da dispersão.
Várias semanas: Solicite uma cotação (os Neoclouds normalmente oferecem desconto de 15-30% para compromissos de 4-12 semanas; os hyperscalers oferecem níveis reservados de 1 ano).
Vários anos: negocie diretamente com os provedores, pois as tarifas publicadas sob demanda não capturam os descontos por prazo comprometido.
Economia com reserva
O desconto de 1 ano reservado normalmente fica entre 16-39% abaixo da tarifa publicada sob demanda, com as maiores economias em B200, AMD MI300X e na placa de inferência L40S, onde os provedores competem mais por capacidade comprometida.
H100 e H200 veem descontos modestos de um dígito a baixos dois dígitos; seu mercado sob demanda é competitivo o suficiente para que os provedores não sacrifiquem a margem por compromissos. B200 reserva a -39% de desconto, MI300X a -31%, L40S a -30%. O gráfico mostra a mediana entre provedores para ambos os níveis de cobrança; cotações de provedores individuais podem ser mais profundas para prazos plurianuais não refletidos aqui.
Spot vs sob demanda
O gráfico de rastreamento de desconto spot mostra o desconto mediano spot vs. sob demanda por categoria. Nos últimos seis meses, as modernas economizam ~50%, as lançadas mais recentemente ~49%, as legadas ~75% (Legadas são mais ruidosas do que parece; poucos provedores ainda publicam tarifas spot para essas placas).
Se sua carga de trabalho tolera interrupções de 5-15 minutos, o spot é a maior alavanca de custo disponível. Alterne o menu suspenso de cobrança no gráfico explorador no topo para ver a tarifa spot lado a lado com a sob demanda para qualquer provedor em sua lista.
Metodologia do índice de GPU
O índice cobre os preços publicados por hora de aluguel de GPU em nuvem em todos os níveis sob demanda, spot e reservado de 1 ano (onde os provedores os publicam publicamente). Ele não cobre contratos plurianuais, taxas negociadas por empresa, combinações de spot mais planos de economia ou custo total de propriedade.
Nossos dados são instantâneos mensais ao longo de 24 meses (julho de 2024 a junho de 2026), filtrados para 17 modelos de GPU curados em 63 provedores. Cada instantâneo relata, para cada célula (provedor, GPU, tipo de cobrança, mês), a taxa horária mínima, máxima, média e mediana por GPU, mais a contagem de ofertas por trás desses números.
Os preços da H100, A100, H200, B200, B300 e V100 são medianas tomadas entre várias versões físicas da placa (PCIe, SXM ou interconexão NVL; para A100 e V100, também 40/80 GB ou 16/32 GB VRAM) que os provedores listam sob um mesmo nome.
Como cada gráfico é calculado
Usamos mediana das medianas em toda parte: provedores e GPUs entram cada um no número principal com peso igual, de modo que um provedor com 38 listagens não abafe um recém-chegado com 5 listagens.
Resumo de mercado (três linhas de categoria):
O menu suspenso de cobrança executa novamente os Passos 2-3 para o nível selecionado (sob demanda, spot ou reserva). Uma quarta opção "Média" plota a média aritmética das medianas dos três níveis por categoria por mês, restrita aos meses em que todos os três níveis têm dados.
Explorador provedor × cobrança:
Para o provedor e nível de cobrança que você selecionar, cada linha traça a mediana mensal de uma GPU ao longo do tempo. Nenhuma agregação entre provedores é aplicada: o ponto de cada mês é o preço mediano entre as listagens daquele provedor para aquela GPU e aquele nível de cobrança. A linha termina onde a oferta desaparece do catálogo.
GPUs modernas lado a lado:
Mesmos Passos 1-2 do resumo de mercado, limitados à precificação sob demanda. Cada linha é a mediana mensal entre provedores para uma GPU. Sem agregação entre GPUs. Oito séries.
Rastreador de desconto spot:
Isso emparelha cada preço spot com sua contraparte sob demanda do mesmo provedor, mesma GPU, mesmo mês, de modo que o desconto reflita a diferença real que um comprador naquele provedor veria, não uma diferença de ruído entre mercados.
Instantâneo de disponibilidade:
Apenas instantâneo, sem agregação temporal. As listagens relatadas como estoque desconhecido, lista de espera ou indisponíveis ainda são contadas no denominador, mas não são desenhadas separadamente no gráfico, pois o sinal acionável para o comprador é a parcela confirmada como disponível.
Economia com reserva:
Perguntas frequentes
Publicamos uma visão mediana mensal atualizada a cada mês. Os números refletem dados até o mês anterior.
A GPU é a mesma; o pacote não. Os hyperscalers incluem no preço conformidade (HIPAA, SOC 2, FedRAMP), SLAs empresariais, integração de identidade e rede e suporte 24/7. Os neoclouds cobram pelo acesso bare metal ou VM com orquestração gerenciada opcional. Se você não precisa do pacote, o preço neocloud é a comparação correta.
Sim, se sua carga de trabalho faz checkpoint e tolera interrupções de 5-15 minutos. O desconto spot de GPUs modernas está perto de 50% nos últimos seis meses, e as economias se acumulam em treinamentos de vários dias. Spot é a escolha errada para inferência sensível à latência, serviços de réplica única sem failover ou execuções de avaliação que precisam de uma comparação limpa de tempo de relógio.
O menu suspenso de cobrança do gráfico de tendências de preços por provedor alterna entre os níveis sob demanda, spot e reservado de 1 ano, sempre que os provedores publicam essas tarifas. Contratos plurianuais e descontos negociados por empresa não estão incluídos. Solicite uma cotação diretamente ao provedor para esses.
Leitura adicional
- Benchmark Multi-GPU: B200 vs H200 vs H100 vs MI300X
- Top 30 Provedores de GPU em Nuvem e Suas GPUs
- Benchmark de Concorrência de GPU
- Top 25+ Fabricantes de Chips de IA: NVIDIA e Seus Concorrentes
Cite esta pesquisa
Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Índice de Preços de Locação de GPU na Nuvem}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Acessado em 16 Julho 2026}
}
Seja o primeiro a comentar
Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.