As tarifas sob demanda para as GPUs de nuvem de geração mais recente (B200, B300, MI300X, RTX 5090) praticamente dobraram no último ano, enquanto as placas mainstream (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente a partir de 69 provedores e 17 modelos de GPU, cobrindo os níveis sob demanda, spot e reservado de 1 ano.
Tendências de preços por geração de GPU
O gráfico mostra o preço mediano mensal publicado em três grupos por data de lançamento. Dividimos 17 modelos de GPU em três categorias por data de lançamento:
A maior parte do aumento veio das listagens de B200 e B300, que se expandiram de provedores neocloud para listas de preços de hyperscalers. Essas ofertas de hyperscalers são tipicamente 2x-3x mais altas, elevando a mediana da categoria à medida que entram no dataset.
As GPUs modernas subiram ~25%, mas o movimento é em grande parte estatístico. O Google Cloud adicionou sua variante A3z Mega H100 à oferta padrão A3, elevando a mediana da coorte H100 de ~$2 para ~$3. Por baixo, o H100 neocloud apresentou tendência de queda. Sinalizamos isso na próxima seção.
As GPUs legadas caíram de $1,77 para $1,14 ao longo do período, impulsionadas pela perda dos pontos de referência de alto padrão entre hyperscalers na coorte V100, à medida que as empresas aposentam o SKU. Um ou dois provedores por placa Legada permanecem em nosso dataset: a AWS lista a K80 a $0,90, a P40 está na Vast.ai a $0,11, e o restante são casos isolados semelhantes de listagem única.
O mercado de contratos se moveu de forma diferente: os compromissos de 1 ano com H100 subiram no mesmo período, enquanto nossa mediana sob demanda do H100 permaneceu praticamente estável. Isso mostra uma diferença crescente entre os preços mensais e os preços comprometidos de 1 ano.
Consulte nossa metodologia do índice de GPU para saber como isso é calculado.
Tendências de preços por modelo de GPU
O gráfico abaixo abrange 10 GPUs: 5 Modernas, 4 Últimas lançadas e a V100 como referência Legada.
Modernas GPUs (H100, H200, A100, L40S, RTX 4090)
IONOS cobre esse nível a partir da UE: T4 sob demanda, A10 e RTX PRO 6000 Blackwell, além de servidores dedicados H100 e H200 a uma taxa fixa de $3,990/mês com residência de dados na UE.
A H100 está listada por 54 provedores, a mais ampla de qualquer acelerador atual. A mediana da coorte agora é de cerca de $3,38/GPU-hora, abaixo dos mais de $7 no início de 2024. Thunder Compute, Vast.ai e RunPod ficam na parte inferior da faixa; Microsoft Azure e Google Cloud mantêm a cauda superior acima de $10. A linha do Google Cloud é, ela própria, uma mistura de três SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) reunidos sob um único rótulo nvidia-h100, o que eleva a mediana da coorte.
A faixa da H200 vai de $2,30 (FluidStack) a $13,78 (Microsoft Azure), com uma mediana de coorte em torno de $4.47. O piso depende de você tratar listagens de nível comunitário ou compartilhamento de instâncias como comparáveis à capacidade dedicada. Uma vez deixadas de lado, a mediana útil fica na faixa de $3 a $4.
A A100 mantém uma faixa neocloud estreita em torno de $1,86, com um ou dois outliers de inferência serverless (Replicate a $5,04) puxando a cauda alta para cima. Trate as tarifas serverless separadamente ao comparar provedores de IaaS.
A L40S se estabilizou em torno de uma mediana de $1,54, com a AWS a $7,58 definindo o teto. A RTX 4090 é a placa de classe de treinamento mais barata do índice, com mediana de $0,43, com Salad a $0,18 e Beam a $1,61 delimitando a faixa. Ambas visam inferência de menos de 100B e fine-tuning em lote, onde muitas vezes substituem a A100 por uma fração do preço.
Últimas GPUs lançadas (B200, B300, MI300X, RTX 5090)
Mediana da B200 $6,22, faixa de $3,75 (Packet.ai) a $16,11 (Google Cloud). Mediana da B300 $7,98, faixa de $6,90 (TheAI Cloud) a $17,80 (AWS). Mediana da MI300X $3,00, faixa de $2,39 (RunPod) a $7,86 (Microsoft Azure). Mediana da RTX 5090 $0,54, faixa de $0,29 (Salad) a $3,63 (Vast.ai).
O padrão se repete a partir da curva anterior da H100: os hyperscalers oferecem novos aceleradores a pisos de 3-5x sobre os neoclouds durante o primeiro ano. A B300 ainda está em tendência de alta no gráfico, à medida que novas listagens de hyperscalers continuam elevando a mediana. A MI300X é o ponto fora da curva em oferta; ela lista abaixo do piso da H100 na DigitalOcean e na TensorWave, mas roda em ROCm e nem toda carga de trabalho CUDA migra sem problemas.
Referência legada (V100)
A V100, a placa legada do gráfico, está incluída como uma linha de referência da geração de 2017. A mediana da coorte caiu de $1,84 em meados de 2024 para cerca de $1,57 hoje em 21 provedores. Os hyperscalers mantêm SKUs V100 para clientes de conformidade que executam cargas de trabalho imutáveis; os neoclouds, em sua maioria, as abandonaram.
Tendências de preços por provedor
Para a mesma GPU, os preços publicados pelos hyperscalers são tipicamente 3x-6x mais altos do que as listagens neocloud mais baratas no dataset. A profundidade do catálogo varia por provedor, GPU, região e tipo de cobrança.
Oferta e disponibilidade
A oferta varia mais do que o preço principal. O gráfico abaixo mostra a parcela das listagens de cada GPU que reportam estoque confirmado hoje, ordenadas da mais escassa para a mais disponível.
A MI300X e a B300 são as mais escassas, com 5-28%; B200 e L40S vêm logo atrás, com 30-40%. H200, H100 e A100 se agrupam perto de 43-51%, onde cerca de metade do catálogo é estoque confirmado e o restante depende de provisionamento. RTX 4090 e RTX 5090 atingem 53-76%, refletindo uma oferta mais profunda de placas de consumo e menor demanda empresarial por placa.
Como escolher uma GPU e um provedor
A escolha da GPU é moldada por três eixos: carga de trabalho, duração e região. A precificação spot versus sob demanda se sobrepõe a todos os três.
Por carga de trabalho
Por duração
Menos de uma semana: Neocloud sob demanda no piso da faixa.
Várias semanas: Solicite uma cotação (os neoclouds normalmente oferecem desconto de 15-30% para compromissos de 4 a 12 semanas; os hyperscalers oferecem níveis reservados de 1 ano).
Vários anos: negocie diretamente com os provedores, pois as tarifas sob demanda publicadas não capturam os descontos de prazos comprometidos.
Economia com reserva
O desconto reservado de 1 ano normalmente é de 5-38% sobre a tarifa sob demanda publicada, com as maiores economias na B300, na L40S de nível de inferência e na B200, onde os provedores competem mais pela capacidade comprometida.
A H100 e a H200 veem descontos modestos de um dígito a pouco mais de dez por cento; seu mercado sob demanda é competitivo o suficiente para que os provedores não sacrifiquem margem por compromissos. A B200 reserva com -15% de desconto, a MI300X com -8%, a L40S com -28%. O gráfico mostra a mediana entre provedores para os dois níveis de cobrança; cotações individuais de provedores podem ser mais profundas para prazos plurianuais não refletidos aqui.
Spot vs sob demanda
O gráfico do rastreador de descontos spot mostra o desconto mediano spot vs. sob demanda por categoria. Nos últimos seis meses, as modernas economizam ~50%, as últimas lançadas ~49%, as legadas ~61% (as legadas são mais ruidosas do que parecem; poucos provedores ainda publicam tarifas spot para essas placas).
Se sua carga de trabalho tolera interrupções de 5 a 15 minutos, o spot é a maior alavanca de custo disponível. Alterne o menu suspenso de cobrança no gráfico explorador no topo para ver a tarifa spot lado a lado com a sob demanda para qualquer provedor da sua lista.
Metodologia do índice de GPU
O índice cobre os preços horários publicados de aluguel de GPU em nuvem nos níveis sob demanda, spot e reservado de 1 ano (onde os provedores os listam publicamente). Não cobre contratos plurianuais, tarifas negociadas com empresas, combinações de spot com planos de economia ou custo total de propriedade.
Nossos dados são instantâneos mensais ao longo de 26 meses (julho de 2024 a agosto de 2026), filtrados para 17 modelos de GPU selecionados em 69 provedores. Cada instantâneo relata, para cada célula (provedor, GPU, tipo de cobrança, mês), a taxa horária por GPU mínima, máxima, média e mediana, além da contagem de ofertas por trás desses números.
Os preços de H100, A100, H200, B200, B300 e V100 são medianas calculadas entre várias versões físicas da placa (PCIe, SXM ou interconexão NVL; para A100 e V100, também VRAM de 40/80 GB ou 16/32 GB) que os provedores listam sob um único nome.
Como cada gráfico é calculado
Usamos mediana das medianas em todo o texto: provedores e GPUs entram no número principal com peso igual, para que um provedor com 38 listagens não abafe um recém-chegado com 5 listagens.
Resumo do mercado (três linhas de categoria):
O menu suspenso de cobrança executa novamente as etapas 2 a 3 para o nível selecionado (sob demanda, spot ou reserva). Uma quarta opção “Média” plota a média aritmética das medianas dos três níveis por categoria por mês, restrita aos meses em que todos os três níveis têm dados.
Explorador provedor × cobrança:
Para o provedor e o nível de cobrança que você selecionar, cada linha traça a mediana mensal de uma GPU ao longo do tempo. Nenhuma agregação entre provedores é aplicada: o ponto de cada mês é o preço mediano entre as listagens daquele provedor para aquela GPU e aquele nível de cobrança. A linha termina onde a oferta desaparece do catálogo.
Modernas GPUs lado a lado:
Mesmas etapas 1 a 2 do resumo do mercado, limitadas à precificação sob demanda. Cada linha é a mediana mensal entre provedores para uma GPU. Nenhuma agregação entre GPUs. Oito séries.
Rastreador de desconto spot:
Isso emparelha cada preço spot com sua contraparte sob demanda do mesmo provedor, mesma GPU e mesmo mês, de modo que o desconto reflita a diferença real que um comprador naquele provedor veria, não uma diferença de ruído entre mercados.
Instantâneo de disponibilidade:
Apenas instantâneo, sem agregação temporal. Listagens relatadas como estoque desconhecido, lista de espera ou indisponíveis ainda são contabilizadas no denominador, mas não são desenhadas separadamente no gráfico, pois o sinal acionável para o comprador é a parcela confirmada como disponível.
Economia com reserva:
Perguntas frequentes
Publicamos uma visão mediana mensal atualizada a cada mês. Os números refletem os dados até o mês anterior.
A GPU é a mesma; o pacote não. Os hyperscalers incluem no preço conformidade (HIPAA, SOC 2, FedRAMP), SLAs empresariais, integração de identidade e rede, e suporte 24/7. Os neoclouds precificam bare metal ou acesso a VM com orquestração gerenciada opcional. Se você não precisa do pacote, o preço do neocloud é a comparação certa.
Sim, se sua carga de trabalho faz checkpoints e tolera interrupções de 5 a 15 minutos. O desconto spot para GPUs modernas fica perto de 50% nos últimos seis meses, e a economia se acumula ao longo de treinamentos de vários dias. Spot é a escolha errada para inferência sensível à latência, serviços de réplica única sem failover ou execuções de avaliação que precisam de comparação limpa de tempo de relógio.
O menu suspenso de cobrança do gráfico de tendências de preços por provedor alterna entre os níveis sob demanda, spot e reservado de 1 ano, sempre que os provedores publicam essas tarifas. Contratos plurianuais e descontos negociados com empresas não estão incluídos. Solicite uma cotação diretamente ao provedor para esses casos.
Leitura adicional
- Benchmark Multi-GPU: B200 vs H200 vs H100 vs MI300X
- Top 30 provedores de GPU em nuvem e suas GPUs
- Benchmark de concorrência de GPU
- Top 25+ fabricantes de chips de IA: NVIDIA e seus concorrentes
Cite esta pesquisa
Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.
@misc{sari2026,
author = {Sarı, Ekrem},
title = {{Cloud GPU Rental Price Index}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/gpu-index}},
note = {AIMultiple. Acessado em 25 Agosto 2026}
}Registro de alterações
3 atualizações- 2026
Updated o índice de GPU em 63 fornecedores, com novas medianas, taxas de estoque confirmado e descontos reservados, e IONOS adicionado.
Substituídas as medianas e as faixas nas seções de GPUs modernas e de último lançamento por novos valores.
Adicionada uma opção de faturamento "Média" ao gráfico de resumo do mercado na seção de metodologia.
Seja o primeiro a comentar
Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.