Top 70+ provedores de GPU em nuvem
We track 71 cloud GPU providers and 14 curated GPU model families spanning more than 2,500 distinct instance configurations.
Os provedores de GPU em nuvem se dividem em três níveis. Os hiperescaladores operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos. Os neoclouds especializados concentram-se em infraestrutura de GPU e IA como seu produto principal. Os marketplaces comunitários agregam inventário de muitos operadores pequenos, frequentemente no piso da variação de preços publicada.
Tabela de comparação de provedores
Nuvem | Modelos | Combinações | Níveis de cobrança | Na vanguarda |
|---|---|---|---|---|
4 | 4 | 1 (Sob demanda) | Não | |
Vast.ai | 56 | 184 | 3 (Sob demanda/Spot/Reservado) | Sim |
RunPod | 33 | 72 | 3 (Sob demanda/Spot/Reservado) | Sim |
Sesterce | 17 | 42 | 1 (Sob demanda) | Sim |
Verda | 10 | 40 | 3 (Sob demanda/Spot/Reservado) | Sim |
AWS | 16 | 40 | 2 (Sob demanda/Reservado) | Sim |
Massed Compute | 10 | 39 | 1 (Sob demanda) | Não |
Salad | 33 | 33 | 1 (Sob demanda) | Sim |
Theta EdgeCloud | 21 | 30 | 1 (Sob demanda) | Não |
GCP | 10 | 30 | 3 (Sob demanda/Spot/Reservado) | Sim |
Definições das colunas:
- Modelos: famílias de modelos de GPU distintas oferecidas em todos os fornecedores (NVIDIA + AMD + Intel). H100 e H100 NVL contam como uma família.
- Combinações: SKUs de instância distintos (modelo de GPU, contagem de GPU) no catálogo público.
- Níveis de cobrança: quantos dos níveis Sob demanda, Spot e Reservado de 1 ano o provedor expõe (máximo 3).
- Na vanguarda: Sim se o provedor listar qualquer um dos modelos B200, B300, MI300X ou RTX 5090.
Classificação: Os assinantes estão vinculados e destacados no topo da tabela. Os provedores restantes são classificados pela profundidade do catálogo (coluna Combinações) em ordem decrescente.
IONOS
IONOS é uma plataforma de nuvem europeia com sede na Alemanha. O catálogo público de GPU cobre quatro SKUs de GPU única:
O SKU RTX PRO 6000 Blackwell é uma das poucas placas da geração Blackwell listadas publicamente por menos de US$ 2/GPU/h no lado da UE.
IONOS também opera um nível de servidor GPU dedicado com NVIDIA H100/H200 por US$ 3.990/mês e NVIDIA L40s ou Intel Gaudi 2 & 3 sob solicitação. Os quatro SKUs por hora acima são apenas sob demanda, com um teto máximo mensal publicado para cada um. A hospedagem e os data centers estão na UE/EEE, o que é importante para compradores com requisitos de residência de dados do GDPR.
Provedores hiperescaladores
Os hiperescaladores operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos, ao lado de serviços de computação, armazenamento, rede, identidade e serviços gerenciados. Eles normalmente cobram de 3 a 6x acima dos neoclouds especializados pela mesma GPU, porque a capacidade alugada vem acompanhada de SLA empresarial, certificações de conformidade e integração entre serviços.
Amazon Web Services
A AWS é o maior hiperescalador. O catálogo abrange 18 famílias de modelos de GPU e publica a H100 por meio da família de instâncias p5. Dois níveis de cobrança são listados publicamente (sob demanda e reservado de 1 ano); o preço spot existe, mas passa por um fluxo de solicitação separado. A EC2 G7e foi adicionada no início de 2026 com NVIDIA RTX PRO 6000 Blackwell, inicialmente em us-east-1 e us-east-2.123
A AWS também oferece seus próprios aceleradores de IA (Trainium para treinamento, Inferentia para inferência), que ficam fora do escopo de aluguel de GPU desta comparação. SageMaker, Redshift e o catálogo mais amplo de serviços gerenciados são motivos comuns para as empresas escolherem a AWS apesar do prêmio na taxa de GPU.
A aprovação de cota é necessária para a maioria dos tipos de instância de GPU. Recebemos cota para todos os tipos H100 e A100 em até um dia após a solicitação em nosso teste.
Microsoft Azure
Azure publica a H100 por meio da série ND H100 v5 (H100 SXM); configurações menores de H100 PCIe estão disponíveis por meio da série NC. O catálogo abrange 10 famílias de modelos de GPU e inclui B200 (ND B200) e AMD MI300X (ND MI300X v5).45
Todos os três níveis de cobrança são listados publicamente. A Azure também vem construindo seu próprio programa de aceleradores de IA (Maia) para cargas de trabalho internas de treinamento; esses chips não podem ser alugados por meio da API padrão de instâncias de GPU.6
Google Cloud Platform
O GCP publica a H100 mais barata no nível dos hiperescaladores, mas a listagem agrupa três SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) em uma única linha nos instantâneos do catálogo público. A variante A3 Mega normalmente lista por volta de ~US$ 14.19/GPU/h, enquanto a A3 Standard fica em torno de ~US$ 11.06, e a mediana visível se move conforme uma variante entra ou sai da listagem pública. O catálogo abrange 10 famílias de modelos de GPU e inclui B200 por meio da família A3 Ultra.7
Todos os três níveis de cobrança são listados publicamente. O GCP também oferece os aceleradores TPU (v5p, v6e, Trillium) como uma linha de produtos separada, fora do escopo de aluguel de GPU desta comparação.
Oracle Cloud Infrastructure
A OCI usa uma abordagem bare-metal primeiro: a maioria das ofertas de GPU é executada diretamente no hardware do host, sem uma camada de hipervisor. O catálogo abrange 15 famílias de modelos de GPU, incluindo AMD MI300X e MI355X. Entre os hiperescaladores, o padrão bare-metal por padrão da OCI e a rede de cluster RoCE v2 são diferenciais para cargas de trabalho de treinamento multi-nó fortemente acopladas. A Cohere, uma das primeiras clientes, executa treinamento de LLM em clusters da OCI; a Oracle também investiu na Cohere como investidora estratégica.8
Outras nuvens gerais do nível hiperescalador
A OVHcloud (com sede na França), a Scaleway (França, com o supercomputador Nabu 2023 contendo 1.016 H100 GPUs), a DigitalOcean, a Vultr e a Linode/Akamai completam o nível de hiperescaladores. Essas são plataformas de nuvem de uso geral com aluguel de GPU como um componente. As com sede na Europa (OVHcloud, Scaleway, IONOS) estão posicionadas para residência de dados na UE e alegações de sustentabilidade; a Scaleway opera inteiramente com energia renovável em três regiões da UE.91011121314
A Alibaba Cloud é o único hiperescalador de grande porte com disponibilidade na China continental. O catálogo é mais restrito (4 famílias de modelos de GPU) e as empresas dos EUA/UE com cargas de trabalho regulamentadas normalmente a descartam por motivos de jurisdição.15
Provedores neocloud
Os neoclouds concentram-se em infraestrutura de GPU e IA como seu produto principal. Eles normalmente ficam abaixo dos preços dos hiperescaladores em 50-80% pela mesma GPU, pois evitam a sobrecarga de plataforma ampla. O trade-off é um catálogo de serviços mais restrito: computação e armazenamento básico são bem cobertos; identidade, bancos de dados gerenciados e integração entre serviços não são.
Lambda Labs
A Lambda Labs afirma atender mais de 10.000 equipes de pesquisa. O catálogo abrange 8 famílias de modelos de GPU e é exclusivamente de GPU por design. A Lambda Cloud vem pré-equipada com PyTorch, TensorFlow, drivers CUDA e um notebook Jupyter por instância, mais próxima de “clicar e treinar” do que outros neoclouds. A Lambda também vende hardware de GPU diretamente (desktops, servidores), com as raízes históricas da empresa. O preço é apenas sob demanda na listagem pública; compromissos de várias semanas e vários anos são baseados em cotação.16
CoreWeave
A CoreWeave é a maior neocloud especializada e foi selecionada como a primeira provedora Elite de serviços de nuvem da NVIDIA. A empresa afirma ter 45.000 GPUs em seus data centers e conta com a NVIDIA entre seus investidores. Dois níveis de cobrança são expostos (sob demanda e spot). O catálogo abrange 9 famílias de modelos de GPU, incluindo B200 e B300.17
O programa ARENA da CoreWeave (IA-Ready Native Applications) permite que os clientes avaliem cargas de trabalho em escala de produção em relação à infraestrutura real antes de se comprometerem com capacidade. O preço fica mais próximo do nível dos hiperescaladores do que de outros neoclouds, refletindo o posicionamento empresarial mais elevado.
RunPod
A RunPod opera dois níveis: Secure Cloud (bare-metal dedicado) e Community Cloud (bare-metal compartilhado com tarifas mais baixas e sem SLA). O catálogo abrange 34 famílias de modelos de GPU, incluindo AMD MI300X. Três níveis de cobrança são expostos publicamente (sob demanda, spot e reservado). A inicialização da instância é inferior a um minuto, a mais rápida em nossas medições.18
As atualizações recentes incluem rollback de release do GitHub para endpoints Serverless, endpoints de balanceamento de carga em beta e integração com o SDK de IA da Vercel por meio do pacote @runpod/ai-sdk-provider. O catálogo Public Endpoints cobre modelos de texto, imagem, vídeo e áudio com modelos de implantação pré-criados.
Crusoe
A Crusoe opera data centers com gás natural encalhado e queimado em flare, uma arbitragem de custo e emissões que financia a expansão de capacidade de H100 e B200. O catálogo abrange 5 famílias de modelos de GPU, incluindo AMD MI300X.19
FluidStack, Hyperstack, Nebius
A FluidStack agrega capacidade de GPU de vários operadores de data centers. A Hyperstack é uma das fontes de H100 com preços mais baixos no nível neocloud, com presença no Reino Unido e três níveis de cobrança. A Nebius tem sede na Europa (Países Baixos) e conta com B200 e B300 de última geração em seu catálogo.202122
Paperspace by DigitalOcean
A Paperspace foi adquirida pela DigitalOcean e afirma atender mais de 650.000 usuários. O catálogo abrange 12 famílias de modelos de GPU. A interface de notebook Jupyter pré-carregada e o gerenciamento visual de instâncias são os diferenciais históricos; usuários avançados normalmente substituem a GUI por fluxos de trabalho nativos de Jupyter ou SSH.23
Outros neoclouds especializados
TensorDock, CUDO Compute, Hot Aisle (foco em AMD MI300X), Sesterce, Lyceum, Cirrascale (somente reservado, inclui opções Cerebras e Graphcore), Together (camada de inferência) e Replicate (serverless) completam o nível especializado. A maioria opera somente sob demanda e tem como alvo equipes de desenvolvimento de IA de pequeno a médio porte.2425262728293031
Datacrunch e Seeweb (especialistas europeus)
A Datacrunch é uma neocloud sediada na Finlândia que opera com 100% de energia renovável e oferece H100, A100, RTX 6000 e V100 em grupos de 1, 2, 4 ou 8. A Seeweb é uma neocloud italiana que também opera com 100% de energia renovável, com cinco famílias de modelos de GPU e suporte a Terraform para fluxos de trabalho de infraestrutura como código.3233
Marketplaces comunitários
Os marketplaces comunitários agregam capacidade de GPU de muitos operadores pequenos, frequentemente no piso da variação de preços publicamente listada. O trade-off é a variabilidade: bare-metal compartilhado, SLA de uptime menos consistente e inventário que depende de quantos operadores de host estão online no momento da solicitação.
Vast.ai
A Vast.ai agrega 57 famílias de modelos de GPU e 196 configurações multi-GPU distintas, o catálogo mais profundo entre todos os provedores que acompanhamos. Três níveis de cobrança são expostos. O marketplace faz lances de inventário entre muitos pequenos operadores de host, o que significa que uma cotação de preço no painel reflete a disponibilidade atual e pode não se manter cinco minutos depois. O catálogo também inclui hardware legado (era GTX 1080, K80) que nenhum outro provedor rastreado lista, útil para experimentação orientada a custo e cargas de trabalho acadêmicas.34
Salad
A Salad roda em hardware distribuído de consumidores (PCs de jogos que participam da rede durante o tempo ocioso). A H100 não é listada publicamente; o catálogo se inclina para RTX 4090, RTX 5090 e outras placas de nível de consumidor no piso dessas classes de GPU em todos os provedores.35
Theta EdgeCloud
A Theta EdgeCloud abrange 23 famílias de modelos de GPU em uma infraestrutura de rede de borda. A arquitetura distribuída na borda é o diferencial para inferência com consciência regional; o preço é apenas sob demanda e o inventário varia de acordo com o nó de borda.36
Demanda por provedores: adoção, gastos e busca
A adoção, a participação nos gastos e a participação nas buscas medem a demanda por cada provedor.
- Adoção é a participação de compradores de GPU em nuvem que usam cada provedor.
- Participação nos gastos é a participação de cada provedor no total de dólares gastos em GPU em nuvem.
- Participação nas buscas é a parcela de cada provedor no volume mensal combinado de buscas das sete marcas pelos seus nomes de marca.
A adoção e a participação nos gastos vêm dos dados agregados de gastos com cartão em GPU em nuvem da Ramp.37
A CoreWeave lidera os três sinais no primeiro trimestre de 2026, com 35.4% dos compradores, 50.8% dos dólares e 31.3% das buscas. A maior divergência é entre a Crusoe e a RunPod. A Crusoe detém 27.7% dos dólares com 3.0% dos compradores e 0.9% das buscas. A RunPod responde por 27.7% dos compradores e 25.7% das buscas, com 0.5% dos gastos.
A participação nas buscas acompanha mais a conscientização do que a demanda comprometida, e pode correr à frente do dinheiro. A Vultr é o caso mais claro. Ela detém 18.5% das buscas contra 3.0% dos gastos porque é uma marca de VPS de uso geral, e a maior parte dessa busca pela marca é interesse em hospedagem, e não em aluguel de GPU.
Como os sinais de busca são medidos
A participação nas buscas soma 100% dentro dos provedores mostrados, e não no mercado inteiro, na janela do 3º trimestre de 2025 ao 1º trimestre de 2026, onde os três sinais se sobrepõem. A busca de cada provedor é contada pelo seu termo de marca:
Para as trajetórias de preço por trás desses provedores, consulte o índice de preços de aluguel de GPU em nuvem.
Modelos de implantação
Os serviços de aluguel de GPU chegam em três formatos de implantação. Cada formato troca controle por conveniência.
Serverless GPU
Os serviços serverless de GPU gerenciam o provisionamento, a escalabilidade e a desativação em nome do comprador. O provedor cobra por segundo ou por milissegundo de uso real da GPU; o tempo ocioso é gratuito. Esse formato atende a cargas de trabalho esporádicas, inferência em lote e aplicações de IA generativa com picos, onde a utilização média é baixa.
Os provedores comuns de GPU serverless incluem Replicate, RunPod Serverless, Modal, Fal.ai e Together. A taxa de transferência por dólar normalmente supera a GPU provisionada quando a utilização fica abaixo de 30-40%; acima desse limite, instâncias de GPU sob demanda ou reservadas são mais baratas.3138394030
Virtual GPU (vGPU)
As GPUs virtuais são o formato mais comum. Um hipervisor particiona uma GPU física em uma ou mais fatias virtuais, cada uma executando dentro de uma máquina virtual. Todos os principais hiperescaladores e a maioria dos neoclouds usam esse formato por padrão. Os trade-offs: custo previsível, ampla disponibilidade entre provedores e leve sobrecarga de latência da camada de virtualização.
Bare-metal GPU
Os serviços bare-metal de GPU fornecem um servidor dedicado de GPU física sem camada de virtualização. O comprador obtém acesso direto ao hardware para máximo desempenho e latência mínima. O formato se adequa a grandes execuções de treinamento, cargas de trabalho de HPC e qualquer caso em que a sobrecarga de virtualização importa. A OCI, a CoreWeave e a Lambda Labs oferecem opções bare-metal. A AWS e a Azure o expõem por meio de famílias de instâncias específicas (p5d na AWS, série ND na Azure).
Perguntas frequentes
Os hiperescaladores operam plataformas de nuvem amplas com aluguel de GPU como uma linha de produtos entre muitas. Os neoclouds especializados concentram-se em infraestrutura de GPU e IA como seu produto principal. Os hiperescaladores cobram de 3 a 6x acima dos neoclouds pela mesma GPU; a diferença reflete serviços empresariais agrupados em vez de silício bruto. Para uma comparação sustentada de tendências de preços entre os níveis, consulte o Índice de Preços de Aluguel de GPU em Nuvem.
Use serverless quando a utilização média da GPU estiver abaixo de 30-40%, quando as cargas de trabalho forem irregulares ou quando a sobrecarga de operações for um custo maior do que a tarifa por hora. A GPU provisionada em um neocloud é mais barata em alta utilização sustentada.
Para cargas de trabalho com requisitos de residência de dados na UE ou compradores que atendem clientes da UE em caminhos sensíveis à latência, sim. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch e Seeweb são opções com sede na UE. Os preços normalmente igualam ou excedem levemente os neoclouds sediados nos EUA; o prêmio é por residência, jurisdição e alegações de sustentabilidade, e não por computação bruta.
Leitura adicional
- Benchmark Multi-GPU: B200 vs H200 vs H100 vs MI300X
- Benchmark de concorrência de GPU
- Principais 25+ fabricantes de chips de IA: NVIDIA & seus concorrentes
- Índice de Preços de Aluguel de GPU em Nuvem
Cite esta pesquisa
Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.
@misc{dogan2026,
author = {Dogan, Sedat and Sarı, Ekrem},
title = {{Top 70+ provedores de GPU em nuvem}},
year = {2026},
month = aug,
howpublished = {\url{https://aimultiple.com/cloud-gpu-providers}},
note = {AIMultiple. Acessado em 25 Agosto 2026}
}Resultados e carimbos de data/hora de 82 pontos de dados. Baixe os dados utilizados neste artigo como um arquivo ZIP contendo 3 arquivos CSV.
Registro de alterações
20 atualizações- 2026
Substituída a lista de fornecedores por uma tabela comparativa em níveis com modelos, combinações e níveis de cobrança de 64 fornecedores.
Adicionado AWS EC2 G7e com GPUs NVIDIA Blackwell a Atualizações Recentes.
- 2025
Adicionado RunPod à seção de provedores de GPU virtuais.
Adicionado RunPod à lista de provedores de GPU Virtual.
Expandida a seção "O que são provedores de GPU sem servidor?".
Adicionado NVIDIA Confidential Computing à seção FAQ.
Expandida a seção de FAQ com informações sobre a escassez de fornecimento de GPU.
Adicionado RunPod à lista de provedores de GPU em nuvem.
Atualizada a introdução à seção do modelo de GPU.
- 2024
Atualizada a metodologia de classificação na introdução.
Adicionada uma seção sobre as GPUs em nuvem mais econômicas.
Adicionada uma seção, Como iniciar a instância correta para suas necessidades de GPU em nuvem.
Expandidos os Prós do NVIDIA DGX Cloud.
Substituídos os dados de preços do AWS EC2 na seção AWS.
- 2023
A introdução foi expandida com detalhes sobre a entrega de GPUs sem servidor, virtuais e bare-metal.
Adicionado Seeweb à lista de provedores europeus de GPU em nuvem.
Adicionadas informações do cliente Oracle à seção Oracle Cloud Infrastructure.
Adicionado OVHcloud à lista de futuros provedores de GPU em nuvem.
Adicionada uma seção, O que é uma plataforma de GPU em nuvem?, à seção Links externos.
Adicionado Alibaba Cloud à seção Links externos.
Links de referência
- Tem 20 anos de experiência como hacker de chapéu branco e guru de desenvolvimento, com ampla experiência em linguagens de programação e arquiteturas de servidores.
- É conselheiro de administração em uma VC que investe em empresas de tecnologia em estágio inicial e na Ödeal, uma plataforma regional de pagamentos digitais que atende 125.000 comerciantes.
- Liderou a infraestrutura tecnológica e a cibersegurança de sete eleições nacionais e foi reconhecido no Hall da Fama da cibersegurança por líderes globais de tecnologia, incluindo o Twitter.
Comentários 4
Compartilhe suas ideias
Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.
Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?
Sure, thank you for the suggestion, we will consider it in the next edit.
Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.
Sure, we'll review to see if we can include Dataoorts in the next edit.
Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.
Sure, we'll be reaching out to understand what Atlascloud.ai is offering.
Where is Nebius.ai ???
Thank you! It is added now.