Os provedores de cloud GPU se dividem em três níveis. Os hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos. Os neoclouds especializados focam em infraestrutura de GPU e IA como seu produto principal. Os marketplaces comunitários agregam inventário de muitos pequenos operadores, frequentemente no piso da faixa de preços publicada.
Acompanhamos 71 provedores de cloud GPU e 14 famílias de modelos GPU com curadoria, abrangendo mais de 2.500 configurações de instância distintas.
Preços por nível de provedor
Escolha um modelo de GPU e um nível de provedor para comparar as trajetórias de preços sob demanda dentro desse nível nos últimos 25 meses.
Tabela de comparação de provedores
Definições das colunas:
- Modelos: famílias distintas de modelos GPU oferecidas por todos os fornecedores (NVIDIA + AMD + Intel). H100 e H100 NVL contam como uma família.
- Combinações: SKUs de instância distintos (modelo GPU, quantidade GPU) no catálogo público.
- Níveis de faturamento: quantos entre Sob demanda, Spot e Reservado de 1 ano o provedor expõe (máx. 3).
- Ponta: Sim se o provedor lista qualquer um entre B200, B300, MI300X ou RTX 5090.
Classificação: os patrocinadores têm link e destaque no topo da tabela. Os demais provedores são classificados por profundidade de catálogo (a coluna Combinações) em ordem decrescente.
IONOS
IONOS é uma plataforma de nuvem europeia sediada na Alemanha. O catálogo público de GPU abrange quatro SKUs de GPU única:
O SKU RTX PRO 6000 Blackwell é uma das poucas placas da geração Blackwell listadas publicamente por menos de $2/GPU/hora no lado da UE.
IONOS também opera um nível de servidor GPU dedicado com NVIDIA H100/H200 a $3.990/mês e NVIDIA L40s ou Intel Gaudi 2 e 3 sob consulta. Os quatro SKUs por hora acima são apenas sob demanda, com um limite máximo mensal publicado para cada um. A hospedagem e os data centers estão na UE/EEE, o que é relevante para compradores com requisitos de residência de dados do GDPR.
Provedores hyperscaler
Os hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos, juntamente com computação, armazenamento, redes, identidade e serviços gerenciados. Eles normalmente cobram 3-6x acima dos neoclouds especializados pela mesma GPU porque a capacidade alugada vem com SLA empresarial, certificações de conformidade e integração entre serviços.
Amazon Web Services
AWS é o maior hyperscaler. O catálogo abrange 15 famílias de modelos GPU e oferece H100 através da família de instâncias p5. Dois níveis de faturamento são listados publicamente (sob demanda e reservado de 1 ano); o preço spot existe mas passa por um fluxo de solicitação separado. EC2 G7e foi adicionado no início de 2026 com NVIDIA RTX PRO 6000 Blackwell, inicialmente em us-east-1 e us-east-2.1 2 3
A AWS também oferece seus próprios aceleradores de IA (Trainium para treinamento, Inferentia para inferência), que ficam fora do escopo de aluguel de GPU desta comparação. SageMaker, Redshift e o catálogo mais amplo de serviços gerenciados são razões comuns pelas quais as empresas escolhem a AWS apesar do prêmio na taxa de GPU.
A aprovação de cota é necessária para a maioria dos tipos de instância GPU. Recebemos cota para todos os tipos H100 e A100 dentro de um dia após a solicitação em nosso teste.
Microsoft Azure
Azure oferece H100 através da série ND H100 v5 (H100 SXM); configurações menores H100 PCIe estão disponíveis através da série NC. O catálogo abrange 10 famílias de modelos GPU e inclui B200 (ND B200) e AMD MI300X (ND MI300X v5).4 5
Todos os três níveis de faturamento são listados publicamente. Azure também vem desenvolvendo seu próprio programa de acelerador de IA (Maia) para cargas de trabalho de treinamento internas; esses chips não são alugáveis através da API padrão de instância GPU.6
Google Cloud Platform
GCP oferece o H100 mais barato no nível hyperscaler, mas a listagem agrupa três SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) em uma linha nos snapshots públicos do catálogo. A variante A3 Mega normalmente lista a ~$14.19/GPU/hora enquanto A3 Standard fica a ~$11.06, e a mediana visível se move conforme uma variante entra ou sai da listagem pública. O catálogo abrange 10 famílias de modelos GPU e inclui B200 através da família A3 Ultra.7
Todos os três níveis de faturamento são listados publicamente. GCP também oferece aceleradores TPU (v5p, v6e, Trillium) como uma linha de produto separada fora do escopo de aluguel de GPU desta comparação.
Oracle Cloud Infrastructure
OCI usa uma abordagem bare-metal-first: a maioria das ofertas de GPU roda diretamente no hardware do host sem uma camada de hypervisor. O catálogo abrange 13 famílias de modelos GPU, incluindo AMD MI300X e MI355X. Entre os hyperscalers, o bare-metal por padrão e a rede de cluster RoCE v2 da OCI são diferenciais para cargas de trabalho de treinamento multi-nó fortemente acopladas. Cohere, um cliente inicial, executa treinamento de LLM em clusters OCI; Oracle também investiu na Cohere como apoiadora estratégica.8
Outras nuvens gerais de nível hyperscaler
OVHcloud (sediada na França), Scaleway (França, com o supercomputador Nabu 2023 contendo 1.016 H100 GPUs), DigitalOcean, Vultr e Linode/Akamai completam o nível hyperscaler. Estas são plataformas de nuvem de propósito geral com aluguel de GPU como um componente. As sediadas na Europa (OVHcloud, Scaleway, IONOS) estão posicionadas para residência de dados na UE e reivindicações de sustentabilidade; Scaleway opera inteiramente com energia renovável em três regiões da UE.9 10 11 12 13 14
Alibaba Cloud é o único grande hyperscaler com disponibilidade na China continental. O catálogo é mais restrito (4 famílias de modelos GPU) e empresas dos EUA/UE com cargas de trabalho regulamentadas normalmente o descartam por motivos de jurisdição.15
Provedores neocloud
Neoclouds focam em infraestrutura de GPU e IA como seu produto principal. Eles normalmente reduzem os preços dos hyperscalers em 50-80% para a mesma GPU porque eliminam a sobrecarga da plataforma ampla. O trade-off é um catálogo de serviços mais restrito: computação e armazenamento básico são bem cobertos; identidade, bancos de dados gerenciados e integração entre serviços não são.
Lambda Labs
Lambda Labs afirma atender mais de 10.000 equipes de pesquisa. O catálogo abrange 8 famílias de modelos GPU e é exclusivamente GPU por design. Lambda Cloud vem pré-equipado com PyTorch, TensorFlow, drivers CUDA e um notebook Jupyter por instância, mais próximo de "clicar e treinar" do que outros neoclouds. Lambda também vende hardware GPU diretamente (desktops, servidores), remontando às raízes históricas da empresa. O preço é apenas sob demanda na listagem pública; compromissos de várias semanas e vários anos são baseados em orçamento.16
CoreWeave
CoreWeave é o maior neocloud especializado e foi selecionado como o primeiro provedor Elite de serviços em nuvem da NVIDIA. A empresa afirma ter 45.000 GPUs em seus data centers e conta com NVIDIA entre seus investidores. Dois níveis de faturamento são expostos (sob demanda e spot). O catálogo abrange 10 famílias de modelos GPU, incluindo B200 e B300.17
O programa ARENA da CoreWeave (IA-Ready Native Applications) permite que os clientes façam benchmark de cargas de trabalho em escala de produção contra infraestrutura real antes de se comprometerem com a capacidade. O preço fica mais próximo do nível hyperscaler do que outros neoclouds, refletindo o posicionamento empresarial de alto nível.
RunPod
RunPod opera dois níveis: Secure Cloud (bare-metal dedicado) e Community Cloud (bare-metal compartilhado com taxas mais baixas sem SLA). O catálogo abrange 19 famílias de modelos GPU, incluindo AMD MI300X. Três níveis de faturamento são expostos publicamente (sob demanda, spot e reservado). A inicialização da instância é inferior a um minuto, a mais rápida em nossas medições.18
Atualizações recentes incluem rollback de GitHub-release para endpoints Serverless, endpoints de balanceamento de carga em beta e integração com Vercel IA SDK via o pacote @runpod/ai-sdk-provider. O catálogo Public Endpoints cobre modelos de texto, imagem, vídeo e áudio com modelos de implantação prontos.
Crusoe
Crusoe opera data centers com gás natural encalhado e queimado, uma arbitragem de custo e emissões que financia a expansão agressiva de capacidade H100 e B200. O catálogo abrange 9 famílias de modelos GPU, incluindo AMD MI300X.19
FluidStack, Hyperstack, Nebius
FluidStack agrega capacidade de GPU de vários operadores de data center. Hyperstack é uma das fontes H100 de menor preço no nível neocloud com presença no Reino Unido e três níveis de faturamento. Nebius é sediada na Europa (Países Baixos) com B200 e B300 de ponta em seu catálogo.20 21 22
Paperspace by DigitalOcean
Paperspace foi adquirida pela DigitalOcean e afirma atender mais de 650.000 usuários. O catálogo abrange 12 famílias de modelos GPU. A interface de notebook Jupyter pré-carregada e o gerenciamento visual de instâncias são os diferenciais históricos; usuários avançados normalmente substituem a GUI por fluxos de trabalho nativos Jupyter ou SSH.23
Outros neoclouds especializados
TensorDock, CUDO Compute, Hot Aisle (foco em AMD MI300X), Sesterce, Lyceum, Cirrascale (apenas reservado, inclui opções Cerebras e Graphcore), Together (nível de inferência) e Replicate (serverless) completam o nível especializado. A maioria opera apenas sob demanda e atende equipes de desenvolvimento de IA de pequeno a médio porte.24 25 26 27 28 29 30 31
Datacrunch e Seeweb (especialistas europeus)
Datacrunch é um neocloud sediado na Finlândia operando com 100% de energia renovável com H100, A100, RTX 6000 e V100 em grupos de 1, 2, 4 ou 8. Seeweb é um neocloud italiano também operando com 100% de energia renovável com cinco famílias de modelos GPU e suporte Terraform para fluxos de trabalho de infraestrutura como código.32 33
Marketplaces comunitários
Marketplaces comunitários agregam capacidade de GPU de muitos pequenos operadores, frequentemente no piso da faixa de preços listada publicamente. O trade-off é a variabilidade: bare metal compartilhado, SLA de uptime menos consistente e inventário que depende de quantos operadores host estão online no momento da solicitação.
Vast.ai
Vast.ai agrega 54 famílias de modelos GPU e 180 configurações multi-GPU distintas, o catálogo mais profundo entre todos os provedores que acompanhamos. Três níveis de faturamento são expostos. O marketplace faz lances de inventário entre muitos pequenos operadores host, o que significa que uma cotação de preço no dashboard reflete a disponibilidade atual e pode não se manter cinco minutos depois. O catálogo também inclui hardware legado (GTX 1080, era K80) que nenhum outro provedor rastreado lista, útil para experimentação orientada a custos e cargas de trabalho acadêmicas.34
Salad
Salad opera em hardware de consumo distribuído (PCs gamers participando da rede durante o tempo ocioso). H100 não é listado publicamente; o catálogo inclina-se para RTX 4090, RTX 5090 e outras placas de nível consumidor no piso dessas classes de GPU entre todos os provedores.35
Theta EdgeCloud
Theta EdgeCloud abrange 28 famílias de modelos GPU em uma presença de rede de borda. A arquitetura distribuída na borda é o diferencial para inferência com reconhecimento de região; o preço é apenas sob demanda e o inventário varia por nó de borda.36
Demanda por provedor: adoção, gastos e busca
Adoção, participação nos gastos e participação nas buscas medem a demanda por cada provedor.
- Adoção é a participação de compradores de GPU-cloud que usam cada provedor.
- Participação nos gastos é a parcela de cada provedor no total de dólares em GPU-cloud.
- Participação nas buscas é a porção de cada provedor no volume de busca mensal combinado dos sete provedores por seus nomes de marca.
Adoção e participação nos gastos vêm dos dados agregados de gastos com cartão em GPU-cloud da Ramp.37
CoreWeave lidera todos os três sinais no Q1 de 2026, com 35,4% dos compradores, 50,8% dos dólares e 31,3% das buscas. A maior divergência é entre Crusoe e RunPod. Crusoe detém 27,7% dos dólares com 3,0% dos compradores e 0,9% das buscas. RunPod responde por 27,7% dos compradores e 25,7% das buscas, com 0,5% dos gastos.
A participação nas buscas rastreia mais o conhecimento do que a demanda comprometida, e pode correr à frente do dinheiro. Vultr é o caso mais claro. Carrega 18,5% das buscas contra 3,0% dos gastos porque é uma marca de VPS de propósito geral, e a maior parte dessa busca de marca é interesse em hospedagem em vez de aluguel de GPU.
Como os sinais de busca são medidos
A participação nas buscas soma 100% dentro dos provedores mostrados em vez de em todo o mercado, na janela do Q3 de 2025 ao Q1 de 2026 onde todos os três sinais se sobrepõem. A busca de cada provedor é contada pelo seu termo de marca:
Para as trajetórias de preços por trás desses provedores, veja o Índice de preços de aluguel de Cloud GPU.
Modelos de implantação
Os serviços de aluguel de GPU chegam em três formatos de implantação. Cada formato troca controle por conveniência.
GPU Serverless
Serviços de GPU serverless gerenciam provisionamento, escalonamento e remoção em nome do comprador. O provedor cobra por segundo ou por milissegundo de uso real da GPU; o tempo ocioso é gratuito. O formato atende cargas de trabalho esporádicas, inferência em lote e aplicações de IA generativa com picos onde a utilização média é baixa.
Provedores comuns de GPU serverless incluem Replicate, RunPod Serverless, Modal, Fal.ai e Together. O throughput por dólar normalmente supera GPU provisionada quando a utilização está abaixo de 30-40%; acima desse limite, instâncias GPU sob demanda ou reservadas são mais baratas.38 39 40 41 42
GPU Virtual (vGPU)
GPUs virtuais são o formato mais comum. Um hypervisor particiona uma GPU física em uma ou mais fatias virtuais, cada uma rodando dentro de uma máquina virtual. Todos os grandes hyperscalers e a maioria dos neoclouds usam este formato por padrão. Os trade-offs: custo previsível, ampla disponibilidade entre provedores e leve sobrecarga de latência da camada de virtualização.
GPU Bare-metal
Serviços de GPU bare-metal entregam um servidor GPU físico dedicado sem camada de virtualização. O comprador obtém acesso direto ao hardware para desempenho máximo e latência mínima. O formato atende grandes execuções de treinamento, cargas de trabalho HPC e qualquer caso onde a sobrecarga de virtualização importa. OCI, CoreWeave e Lambda Labs oferecem opções bare-metal. AWS e Azure expõem isso através de famílias de instâncias específicas (p5d na AWS, série ND na Azure).
Perguntas frequentes
Hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como uma linha de produto entre muitas. Neoclouds especializados focam em infraestrutura de GPU e IA como seu produto principal. Hyperscalers cobram 3-6x acima dos neoclouds pela mesma GPU; a diferença reflete serviços empresariais agregados em vez de silício bruto. Para comparação sustentada de tendências de preços entre níveis, veja o Índice de Preços de Aluguel de Cloud GPU.
Use serverless quando a utilização média da GPU estiver abaixo de 30-40%, quando as cargas de trabalho forem intermitentes ou quando a sobrecarga operacional for um custo mais alto que a taxa por hora. GPU provisionada em um neocloud é mais barata em alta utilização sustentada.
Para cargas de trabalho com requisitos de residência de dados na UE ou compradores atendendo clientes da UE em caminhos sensíveis à latência, sim. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch e Seeweb são opções sediadas na UE. Os preços normalmente igualam ou excedem ligeiramente os neoclouds sediados nos EUA; o prêmio é pela residência, jurisdição e reivindicações de sustentabilidade em vez de computação bruta.
Leitura adicional
- Benchmark Multi-GPU: B200 vs H200 vs H100 vs MI300X
- Benchmark de Concorrência GPU
- Top 25+ Fabricantes de Chips de IA: NVIDIA e Seus Concorrentes
- Índice de Preços de Aluguel de Cloud GPU
Cite este benchmark
Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.
@misc{dogan2026,
author = {Dogan, Sedat and Sarı, Ekrem},
title = {{Top 60+ Provedores de Cloud GPU}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/cloud-gpu-providers}},
note = {AIMultiple. Acessado em 23 Julho 2026}
}Resultados e carimbos de data/hora de 318 pontos de dados. Baixe os dados utilizados neste artigo como um arquivo ZIP contendo 2 arquivos CSV e um README.
Comentários 4
Compartilhe suas ideias
Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.
Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?
Sure, thank you for the suggestion, we will consider it in the next edit.
Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.
Sure, we'll review to see if we can include Dataoorts in the next edit.
Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.
Sure, we'll be reaching out to understand what Atlascloud.ai is offering.
Where is Nebius.ai ???
Thank you! It is added now.