Serviços
Contate-nos

Top 60+ Provedores de Cloud GPU

Sedat Dogan
Sedat Dogan
atualizado em 23 jul. 2026

Os provedores de cloud GPU se dividem em três níveis. Os hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos. Os neoclouds especializados focam em infraestrutura de GPU e IA como seu produto principal. Os marketplaces comunitários agregam inventário de muitos pequenos operadores, frequentemente no piso da faixa de preços publicada.

Acompanhamos 71 provedores de cloud GPU e 14 famílias de modelos GPU com curadoria, abrangendo mais de 2.500 configurações de instância distintas.

Preços por nível de provedor

Loading Chart

Escolha um modelo de GPU e um nível de provedor para comparar as trajetórias de preços sob demanda dentro desse nível nos últimos 25 meses.

Tabela de comparação de provedores

Definições das colunas:

  • Modelos: famílias distintas de modelos GPU oferecidas por todos os fornecedores (NVIDIA + AMD + Intel). H100 e H100 NVL contam como uma família.
  • Combinações: SKUs de instância distintos (modelo GPU, quantidade GPU) no catálogo público.
  • Níveis de faturamento: quantos entre Sob demanda, Spot e Reservado de 1 ano o provedor expõe (máx. 3).
  • Ponta: Sim se o provedor lista qualquer um entre B200, B300, MI300X ou RTX 5090.

Classificação: os patrocinadores têm link e destaque no topo da tabela. Os demais provedores são classificados por profundidade de catálogo (a coluna Combinações) em ordem decrescente.

IONOS

IONOS é uma plataforma de nuvem europeia sediada na Alemanha. O catálogo público de GPU abrange quatro SKUs de GPU única:

O SKU RTX PRO 6000 Blackwell é uma das poucas placas da geração Blackwell listadas publicamente por menos de $2/GPU/hora no lado da UE.

IONOS também opera um nível de servidor GPU dedicado com NVIDIA H100/H200 a $3.990/mês e NVIDIA L40s ou Intel Gaudi 2 e 3 sob consulta. Os quatro SKUs por hora acima são apenas sob demanda, com um limite máximo mensal publicado para cada um. A hospedagem e os data centers estão na UE/EEE, o que é relevante para compradores com requisitos de residência de dados do GDPR.

Provedores hyperscaler

Os hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos, juntamente com computação, armazenamento, redes, identidade e serviços gerenciados. Eles normalmente cobram 3-6x acima dos neoclouds especializados pela mesma GPU porque a capacidade alugada vem com SLA empresarial, certificações de conformidade e integração entre serviços.

Amazon Web Services

AWS é o maior hyperscaler. O catálogo abrange 15 famílias de modelos GPU e oferece H100 através da família de instâncias p5. Dois níveis de faturamento são listados publicamente (sob demanda e reservado de 1 ano); o preço spot existe mas passa por um fluxo de solicitação separado. EC2 G7e foi adicionado no início de 2026 com NVIDIA RTX PRO 6000 Blackwell, inicialmente em us-east-1 e us-east-2.1 2 3

A AWS também oferece seus próprios aceleradores de IA (Trainium para treinamento, Inferentia para inferência), que ficam fora do escopo de aluguel de GPU desta comparação. SageMaker, Redshift e o catálogo mais amplo de serviços gerenciados são razões comuns pelas quais as empresas escolhem a AWS apesar do prêmio na taxa de GPU.

A aprovação de cota é necessária para a maioria dos tipos de instância GPU. Recebemos cota para todos os tipos H100 e A100 dentro de um dia após a solicitação em nosso teste.

Microsoft Azure

Azure oferece H100 através da série ND H100 v5 (H100 SXM); configurações menores H100 PCIe estão disponíveis através da série NC. O catálogo abrange 10 famílias de modelos GPU e inclui B200 (ND B200) e AMD MI300X (ND MI300X v5).4 5

Todos os três níveis de faturamento são listados publicamente. Azure também vem desenvolvendo seu próprio programa de acelerador de IA (Maia) para cargas de trabalho de treinamento internas; esses chips não são alugáveis através da API padrão de instância GPU.6

Google Cloud Platform

GCP oferece o H100 mais barato no nível hyperscaler, mas a listagem agrupa três SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) em uma linha nos snapshots públicos do catálogo. A variante A3 Mega normalmente lista a ~$14.19/GPU/hora enquanto A3 Standard fica a ~$11.06, e a mediana visível se move conforme uma variante entra ou sai da listagem pública. O catálogo abrange 10 famílias de modelos GPU e inclui B200 através da família A3 Ultra.7

Todos os três níveis de faturamento são listados publicamente. GCP também oferece aceleradores TPU (v5p, v6e, Trillium) como uma linha de produto separada fora do escopo de aluguel de GPU desta comparação.

Oracle Cloud Infrastructure

OCI usa uma abordagem bare-metal-first: a maioria das ofertas de GPU roda diretamente no hardware do host sem uma camada de hypervisor. O catálogo abrange 13 famílias de modelos GPU, incluindo AMD MI300X e MI355X. Entre os hyperscalers, o bare-metal por padrão e a rede de cluster RoCE v2 da OCI são diferenciais para cargas de trabalho de treinamento multi-nó fortemente acopladas. Cohere, um cliente inicial, executa treinamento de LLM em clusters OCI; Oracle também investiu na Cohere como apoiadora estratégica.8

Outras nuvens gerais de nível hyperscaler

OVHcloud (sediada na França), Scaleway (França, com o supercomputador Nabu 2023 contendo 1.016 H100 GPUs), DigitalOcean, Vultr e Linode/Akamai completam o nível hyperscaler. Estas são plataformas de nuvem de propósito geral com aluguel de GPU como um componente. As sediadas na Europa (OVHcloud, Scaleway, IONOS) estão posicionadas para residência de dados na UE e reivindicações de sustentabilidade; Scaleway opera inteiramente com energia renovável em três regiões da UE.9 10 11 12 13 14

Alibaba Cloud é o único grande hyperscaler com disponibilidade na China continental. O catálogo é mais restrito (4 famílias de modelos GPU) e empresas dos EUA/UE com cargas de trabalho regulamentadas normalmente o descartam por motivos de jurisdição.15

Provedores neocloud

Neoclouds focam em infraestrutura de GPU e IA como seu produto principal. Eles normalmente reduzem os preços dos hyperscalers em 50-80% para a mesma GPU porque eliminam a sobrecarga da plataforma ampla. O trade-off é um catálogo de serviços mais restrito: computação e armazenamento básico são bem cobertos; identidade, bancos de dados gerenciados e integração entre serviços não são.

Lambda Labs

Lambda Labs afirma atender mais de 10.000 equipes de pesquisa. O catálogo abrange 8 famílias de modelos GPU e é exclusivamente GPU por design. Lambda Cloud vem pré-equipado com PyTorch, TensorFlow, drivers CUDA e um notebook Jupyter por instância, mais próximo de "clicar e treinar" do que outros neoclouds. Lambda também vende hardware GPU diretamente (desktops, servidores), remontando às raízes históricas da empresa. O preço é apenas sob demanda na listagem pública; compromissos de várias semanas e vários anos são baseados em orçamento.16

CoreWeave

CoreWeave é o maior neocloud especializado e foi selecionado como o primeiro provedor Elite de serviços em nuvem da NVIDIA. A empresa afirma ter 45.000 GPUs em seus data centers e conta com NVIDIA entre seus investidores. Dois níveis de faturamento são expostos (sob demanda e spot). O catálogo abrange 10 famílias de modelos GPU, incluindo B200 e B300.17

O programa ARENA da CoreWeave (IA-Ready Native Applications) permite que os clientes façam benchmark de cargas de trabalho em escala de produção contra infraestrutura real antes de se comprometerem com a capacidade. O preço fica mais próximo do nível hyperscaler do que outros neoclouds, refletindo o posicionamento empresarial de alto nível.

RunPod

RunPod opera dois níveis: Secure Cloud (bare-metal dedicado) e Community Cloud (bare-metal compartilhado com taxas mais baixas sem SLA). O catálogo abrange 19 famílias de modelos GPU, incluindo AMD MI300X. Três níveis de faturamento são expostos publicamente (sob demanda, spot e reservado). A inicialização da instância é inferior a um minuto, a mais rápida em nossas medições.18

Atualizações recentes incluem rollback de GitHub-release para endpoints Serverless, endpoints de balanceamento de carga em beta e integração com Vercel IA SDK via o pacote @runpod/ai-sdk-provider. O catálogo Public Endpoints cobre modelos de texto, imagem, vídeo e áudio com modelos de implantação prontos.

Crusoe

Crusoe opera data centers com gás natural encalhado e queimado, uma arbitragem de custo e emissões que financia a expansão agressiva de capacidade H100 e B200. O catálogo abrange 9 famílias de modelos GPU, incluindo AMD MI300X.19

FluidStack, Hyperstack, Nebius

FluidStack agrega capacidade de GPU de vários operadores de data center. Hyperstack é uma das fontes H100 de menor preço no nível neocloud com presença no Reino Unido e três níveis de faturamento. Nebius é sediada na Europa (Países Baixos) com B200 e B300 de ponta em seu catálogo.20 21 22

Paperspace by DigitalOcean

Paperspace foi adquirida pela DigitalOcean e afirma atender mais de 650.000 usuários. O catálogo abrange 12 famílias de modelos GPU. A interface de notebook Jupyter pré-carregada e o gerenciamento visual de instâncias são os diferenciais históricos; usuários avançados normalmente substituem a GUI por fluxos de trabalho nativos Jupyter ou SSH.23

Outros neoclouds especializados

TensorDock, CUDO Compute, Hot Aisle (foco em AMD MI300X), Sesterce, Lyceum, Cirrascale (apenas reservado, inclui opções Cerebras e Graphcore), Together (nível de inferência) e Replicate (serverless) completam o nível especializado. A maioria opera apenas sob demanda e atende equipes de desenvolvimento de IA de pequeno a médio porte.24 25 26 27 28 29 30 31

Datacrunch e Seeweb (especialistas europeus)

Datacrunch é um neocloud sediado na Finlândia operando com 100% de energia renovável com H100, A100, RTX 6000 e V100 em grupos de 1, 2, 4 ou 8. Seeweb é um neocloud italiano também operando com 100% de energia renovável com cinco famílias de modelos GPU e suporte Terraform para fluxos de trabalho de infraestrutura como código.32 33

Deixe nossa equipe automatizar um dos seus processos de negócio com agentes de IA, gratuitamente.
Automatizar um processo

Marketplaces comunitários

Marketplaces comunitários agregam capacidade de GPU de muitos pequenos operadores, frequentemente no piso da faixa de preços listada publicamente. O trade-off é a variabilidade: bare metal compartilhado, SLA de uptime menos consistente e inventário que depende de quantos operadores host estão online no momento da solicitação.

Vast.ai

Vast.ai agrega 54 famílias de modelos GPU e 180 configurações multi-GPU distintas, o catálogo mais profundo entre todos os provedores que acompanhamos. Três níveis de faturamento são expostos. O marketplace faz lances de inventário entre muitos pequenos operadores host, o que significa que uma cotação de preço no dashboard reflete a disponibilidade atual e pode não se manter cinco minutos depois. O catálogo também inclui hardware legado (GTX 1080, era K80) que nenhum outro provedor rastreado lista, útil para experimentação orientada a custos e cargas de trabalho acadêmicas.34

Salad

Salad opera em hardware de consumo distribuído (PCs gamers participando da rede durante o tempo ocioso). H100 não é listado publicamente; o catálogo inclina-se para RTX 4090, RTX 5090 e outras placas de nível consumidor no piso dessas classes de GPU entre todos os provedores.35

Theta EdgeCloud

Theta EdgeCloud abrange 28 famílias de modelos GPU em uma presença de rede de borda. A arquitetura distribuída na borda é o diferencial para inferência com reconhecimento de região; o preço é apenas sob demanda e o inventário varia por nó de borda.36

Demanda por provedor: adoção, gastos e busca

Adoção, participação nos gastos e participação nas buscas medem a demanda por cada provedor.

  • Adoção é a participação de compradores de GPU-cloud que usam cada provedor.
  • Participação nos gastos é a parcela de cada provedor no total de dólares em GPU-cloud.
  • Participação nas buscas é a porção de cada provedor no volume de busca mensal combinado dos sete provedores por seus nomes de marca.

Adoção e participação nos gastos vêm dos dados agregados de gastos com cartão em GPU-cloud da Ramp.37

CoreWeave lidera todos os três sinais no Q1 de 2026, com 35,4% dos compradores, 50,8% dos dólares e 31,3% das buscas. A maior divergência é entre Crusoe e RunPod. Crusoe detém 27,7% dos dólares com 3,0% dos compradores e 0,9% das buscas. RunPod responde por 27,7% dos compradores e 25,7% das buscas, com 0,5% dos gastos.

A participação nas buscas rastreia mais o conhecimento do que a demanda comprometida, e pode correr à frente do dinheiro. Vultr é o caso mais claro. Carrega 18,5% das buscas contra 3,0% dos gastos porque é uma marca de VPS de propósito geral, e a maior parte dessa busca de marca é interesse em hospedagem em vez de aluguel de GPU.

Como os sinais de busca são medidos

A participação nas buscas soma 100% dentro dos provedores mostrados em vez de em todo o mercado, na janela do Q3 de 2025 ao Q1 de 2026 onde todos os três sinais se sobrepõem. A busca de cada provedor é contada pelo seu termo de marca:

Para as trajetórias de preços por trás desses provedores, veja o Índice de preços de aluguel de Cloud GPU.

Não perca os nossos benchmarks e insights baseados em dados. O botão abre o Google; selecionar a AIMultiple confirma que deseja ver a AIMultiple com mais frequência nos resultados de pesquisa do Google.
GoogleAdicionar como fonte preferencial

Modelos de implantação

Os serviços de aluguel de GPU chegam em três formatos de implantação. Cada formato troca controle por conveniência.

GPU Serverless

Serviços de GPU serverless gerenciam provisionamento, escalonamento e remoção em nome do comprador. O provedor cobra por segundo ou por milissegundo de uso real da GPU; o tempo ocioso é gratuito. O formato atende cargas de trabalho esporádicas, inferência em lote e aplicações de IA generativa com picos onde a utilização média é baixa.

Provedores comuns de GPU serverless incluem Replicate, RunPod Serverless, Modal, Fal.ai e Together. O throughput por dólar normalmente supera GPU provisionada quando a utilização está abaixo de 30-40%; acima desse limite, instâncias GPU sob demanda ou reservadas são mais baratas.38 39 40 41 42

GPU Virtual (vGPU)

GPUs virtuais são o formato mais comum. Um hypervisor particiona uma GPU física em uma ou mais fatias virtuais, cada uma rodando dentro de uma máquina virtual. Todos os grandes hyperscalers e a maioria dos neoclouds usam este formato por padrão. Os trade-offs: custo previsível, ampla disponibilidade entre provedores e leve sobrecarga de latência da camada de virtualização.

GPU Bare-metal

Serviços de GPU bare-metal entregam um servidor GPU físico dedicado sem camada de virtualização. O comprador obtém acesso direto ao hardware para desempenho máximo e latência mínima. O formato atende grandes execuções de treinamento, cargas de trabalho HPC e qualquer caso onde a sobrecarga de virtualização importa. OCI, CoreWeave e Lambda Labs oferecem opções bare-metal. AWS e Azure expõem isso através de famílias de instâncias específicas (p5d na AWS, série ND na Azure).

Perguntas frequentes

Hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como uma linha de produto entre muitas. Neoclouds especializados focam em infraestrutura de GPU e IA como seu produto principal. Hyperscalers cobram 3-6x acima dos neoclouds pela mesma GPU; a diferença reflete serviços empresariais agregados em vez de silício bruto. Para comparação sustentada de tendências de preços entre níveis, veja o Índice de Preços de Aluguel de Cloud GPU.

Use serverless quando a utilização média da GPU estiver abaixo de 30-40%, quando as cargas de trabalho forem intermitentes ou quando a sobrecarga operacional for um custo mais alto que a taxa por hora. GPU provisionada em um neocloud é mais barata em alta utilização sustentada.

Para cargas de trabalho com requisitos de residência de dados na UE ou compradores atendendo clientes da UE em caminhos sensíveis à latência, sim. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch e Seeweb são opções sediadas na UE. Os preços normalmente igualam ou excedem ligeiramente os neoclouds sediados nos EUA; o prêmio é pela residência, jurisdição e reivindicações de sustentabilidade em vez de computação bruta.

Leitura adicional

Cite este benchmark

Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.

Sedat Dogan and Ekrem Sarı (2026) - "Top 60+ Provedores de Cloud GPU". Publicado on-line em AIMultiple.com. Acessado em 23 Julho 2026, em: https://aimultiple.com/cloud-gpu-providers [Recurso on-line]

Dogan, S., & Sarı, E. (2026, 23 Julho). Top 60+ Provedores de Cloud GPU. AIMultiple. https://aimultiple.com/cloud-gpu-providers

@misc{dogan2026,
  author = {Dogan, Sedat and Sarı, Ekrem},
  title  = {{Top 60+ Provedores de Cloud GPU}},
  year   = {2026},
  month  = jul,
  howpublished    = {\url{https://aimultiple.com/cloud-gpu-providers}},
  note   = {AIMultiple. Acessado em 23 Julho 2026}
}
Baixar todos os dados

Resultados e carimbos de data/hora de 318 pontos de dados. Baixe os dados utilizados neste artigo como um arquivo ZIP contendo 2 arquivos CSV e um README.

Última atualização: 10 Julho 2026
Baixar

Links de referência

1.
Instance Types
2.
Amazon EC2 P5 Instances – AWS
3.
What’s New at AWS – Cloud Innovation & News
4.
Pricing - Linux Virtual Machines | Microsoft Azure
5.
Virtual machine sizes overview - Azure Virtual Machines | Microsoft Learn
6.
Microsoft Source
7.
VM instance pricing | Google Cloud
8.
GPU, Virtual Machines and Bare Metal | Oracle
9.
Cloud GPU – Cloud instances for AI | OVHcloud Worldwide
10.
GPU-powered infrastructure | Scaleway
11.
Entreprise dedicated server rental: from €4.99 | Scaleway | Scaleway
12.
GPU Droplets | DigitalOcean
13.
Vultr Cloud GPU | Globally Available Cloud GPU Computing on Demand - Vultr.com
Vultr
14.
Cloud’s AI Infrastructure | GPU | Blackwell | Quadro RTX | Akamai
15.
Elastic GPU Service
16.
AI Cloud Pricing | GPU Compute & AI Infrastructure | Lambda
17.
CoreWeave Cloud Pricing | CoreWeave
18.
Pricing | Runpod
Runpod
19.
Crusoe Cloud Pricing for AI Compute & Inference | NVIDIA & AMD GPUs
Crusoe
20.
Fluidstack
Fluidstack
21.
Hyperstack AI Cloud Pricing | On-Demand, Reserved and Spot GPU VMs
22.
NVIDIA GPU Pricing | Nebius AI Cloud
23.
Pricing | DigitalOcean
24.
GPU Cloud — TensorDock
25.
Pricing - CUDO Compute
26.
https://hotaisle.xyz/pricing/
27.
GPU Rental - Cloud GPU | Sesterce
28.
lyceum.ai for sale | Spaceship.com
29.
Cirrascale | Private AI Cloud for Training & Inference
30.
Pricing | Together AI
31.
Pricing – Replicate
32.
AI Cloud - Verda, full-stack AI cloud
Verda
33.
Cloud Server GPU - Cloud GPU Computing for AI and Machine Learning | Seeweb
34.
GPU Pricing — Live Platform Rates | Vast.ai
Vast.ai
35.
Salad GPU Cloud Pricing | Rent GPUs from $0.02/hr
36.
Theta EdgeCloud
37.
GPU Cloud Ramp Rate: A Data-Backed Look
38.
Pricing – Replicate
39.
Serverless GPU Platform for AI Inference | Runpod
Runpod
40.
Plan Pricing | Modal
41.
GenAI API Pricing: Haliuo, Vidu, Pixverse | Pay-Per-Use | fal
42.
Pricing | Together AI
Sedat Dogan
Sedat Dogan
CTO
Sedat é um líder em tecnologia e segurança da informação com experiência em desenvolvimento de software, coleta de dados web e cibersegurança. Sedat: - Possui 20 anos de experiência como hacker ético e guru de desenvolvimento, com vasta expertise em linguagens de programação e arquiteturas de servidores. - É consultor de executivos de alto nível e membros do conselho de administração de empresas com operações tecnológicas de alto tráfego e missão crítica, como infraestrutura de pagamentos. - Possui grande perspicácia comercial, além de sua expertise técnica.
Ver perfil completo
Revisado tecnicamente por
Ekrem Sarı
Ekrem Sarı
Pesquisador de IA
Ekrem é pesquisador de IA na AIMultiple, com foco em automação inteligente, GPUs, agentes de IA e frameworks RAG.
Ver perfil completo

Comentários 4

Compartilhe suas ideias

Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.

0/450
Alisdair
Alisdair
Oct 22, 2024 at 05:36

Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?

Cem Dilmegani
Cem Dilmegani
Nov 10, 2024 at 07:13

Sure, thank you for the suggestion, we will consider it in the next edit.

Jesper
Jesper
Oct 06, 2024 at 03:58

Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.

Cem Dilmegani
Cem Dilmegani
Oct 22, 2024 at 03:18

Sure, we'll review to see if we can include Dataoorts in the next edit.

Jerry
Jerry
Jul 24, 2024 at 09:56

Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.

Cem Dilmegani
Cem Dilmegani
Jul 28, 2024 at 10:24

Sure, we'll be reaching out to understand what Atlascloud.ai is offering.

Evgenii Pavlov
Evgenii Pavlov
Jun 14, 2024 at 15:23

Where is Nebius.ai ???

Cem Dilmegani
Cem Dilmegani
Jul 14, 2024 at 08:45

Thank you! It is added now.