Los 60+ principales proveedores de GPU en la nube
Los proveedores de GPU en la nube se dividen en tres niveles. Los hyperscalers gestionan plataformas en la nube amplias donde el alquiler de GPU es un producto entre muchos. Las neoclouds especializadas se centran en la infraestructura de GPU y de IA como su producto principal. Los marketplaces comunitarios agregan inventario de muchos operadores pequeños, a menudo al mínimo del rango de precios publicado.
Hacemos un seguimiento de 71 proveedores de GPU en la nube y 14 familias de modelos de GPU seleccionadas que abarcan más de 2,500 configuraciones de instancia distintas.
Precios por nivel de proveedor
Elige un modelo de GPU y un nivel de proveedor para comparar las trayectorias de precios bajo demanda dentro de ese nivel durante los últimos 25 meses.
Tabla comparativa de proveedores
Definiciones de columnas:
- Modelos: familias de modelos de GPU distintas ofrecidas en todos los proveedores (NVIDIA + AMD + Intel). H100 y H100 NVL cuentan como una sola familia.
- Combinaciones: SKUs de instancia distintos (modelo de GPU, cantidad de GPU) en el catálogo público.
- Niveles de facturación: cuántos de Bajo demanda, Spot y Reservado (1 año) expone el proveedor (máx. 3).
- Vanguardia: Sí si el proveedor incluye alguno de B200, B300, MI300X o RTX 5090.
Clasificación: los patrocinadores están enlazados y destacados al principio de la tabla. Los demás proveedores se clasifican por profundidad de catálogo (columna Combinaciones) en orden descendente.
IONOS
IONOS es una plataforma europea en la nube con sede en Alemania. El catálogo público de GPU cubre cuatro SKUs de una sola GPU:
El SKU RTX PRO 6000 Blackwell es una de las pocas tarjetas de la generación Blackwell listadas públicamente por debajo de $2/GPU/h en el lado europeo.
IONOS también ofrece un nivel de servidor GPU dedicado con NVIDIA H100/H200 a $3,990/mes y NVIDIA L40s o Intel Gaudi 2 y 3 bajo pedido. Los cuatro SKUs por hora anteriores son solo bajo demanda, con un límite máximo mensual publicado en cada uno. El alojamiento y los centros de datos están en la UE/EEE, lo que es relevante para compradores con requisitos de residencia de datos del RGPD.
Proveedores hyperscaler
Los hyperscalers gestionan plataformas en la nube amplias donde el alquiler de GPU es un producto entre muchos, junto con computación, almacenamiento, redes, identidad y servicios gestionados. Suelen tener un precio de 3 a 6x por encima de las neoclouds especializadas por la misma GPU porque la capacidad alquilada incluye SLA empresarial, certificaciones de cumplimiento e integración entre servicios.
Amazon Web Services
AWS es el mayor hyperscaler. El catálogo abarca 15 familias de modelos de GPU y ofrece H100 a través de la familia de instancias p5. Dos niveles de facturación están disponibles públicamente (bajo demanda y reservado por 1 año); el precio spot existe pero se tramita a través de un flujo de solicitud separado. EC2 G7e se añadió a principios de 2026 con NVIDIA RTX PRO 6000 Blackwell, inicialmente en us-east-1 y us-east-2.1 2 3
AWS también ofrece sus propios aceleradores de IA (Trainium para entrenamiento, Inferentia para inferencia), que quedan fuera del alcance de este análisis de alquiler de GPU. SageMaker, Redshift y el catálogo más amplio de servicios gestionados son razones comunes por las que las empresas eligen AWS a pesar de la prima en la tarifa de GPU.
Se requiere aprobación de cuota para la mayoría de los tipos de instancia GPU. En nuestra prueba recibimos cuota para todos los tipos H100 y A100 en el plazo de un día tras solicitarla.
Microsoft Azure
Azure ofrece H100 a través de la serie ND H100 v5 (H100 SXM); las configuraciones más pequeñas de H100 PCIe están disponibles en la serie NC. El catálogo abarca 10 familias de modelos de GPU e incluye B200 (ND B200) y AMD MI300X (ND MI300X v5).4 5
Los tres niveles de facturación están disponibles públicamente. Azure también ha estado desarrollando su propio programa de aceleradores de IA (Maia) para cargas de trabajo de entrenamiento internas; esos chips no se pueden alquilar a través de la API estándar de instancias GPU.6
Google Cloud Platform
GCP ofrece el H100 más barato del nivel hyperscaler, pero la lista colapsa tres SKUs (a3-highgpu, a3-megagpu, a3-edgegpu) en una sola fila en las capturas públicas del catálogo. La variante A3 Mega suele cotizar a ~$14.19/GPU/h, mientras que la A3 Standard ronda ~$11.06, y la mediana visible se mueve cuando una variante entra o sale del listado público. El catálogo abarca 10 familias de modelos de GPU e incluye B200 a través de la familia A3 Ultra.7
Los tres niveles de facturación están disponibles públicamente. GCP también ofrece aceleradores TPU (v5p, v6e, Trillium) como una línea de producto separada, fuera del alcance de este análisis de alquiler de GPU.
Oracle Cloud Infrastructure
OCI utiliza un enfoque bare-metal primero: la mayoría de las ofertas de GPU se ejecutan directamente sobre el hardware del host, sin capa de hipervisor. El catálogo abarca 13 familias de modelos de GPU, incluyendo AMD MI300X y MI355X. Entre los hyperscalers, el bare-metal por defecto de OCI y la red de clúster RoCE v2 son diferenciadores para cargas de trabajo de entrenamiento multi-nodo estrechamente acopladas. Cohere, un cliente temprano, ejecuta entrenamiento de LLM en clústeres de OCI; Oracle también ha invertido en Cohere como respaldo estratégico.8
Otras nubes generales de nivel hyperscaler
OVHcloud (con sede en Francia), Scaleway (Francia, con el superordenador Nabu 2023 que alberga 1,016 H100 GPUs), DigitalOcean, Vultr y Linode/Akamai completan el nivel hyperscaler. Son plataformas en la nube de propósito general donde el alquiler de GPU es un componente más. Las que tienen sede europea (OVHcloud, Scaleway, IONOS) están posicionadas para la residencia de datos en la UE y afirmaciones de sostenibilidad; Scaleway opera completamente con energía renovable en tres regiones de la UE.9 10 11 12 13 14
Alibaba Cloud es el único hyperscaler importante con disponibilidad en China continental. El catálogo es más reducido (4 familias de modelos de GPU) y las empresas con cargas de trabajo reguladas en EE. UU./UE suelen descartarlo por motivos jurisdiccionales.15
Proveedores neocloud
Las neoclouds se centran en la infraestructura de GPU y de IA como su producto principal. Suelen reducir el precio de los hyperscalers entre un 50 y un 80% por la misma GPU porque evitan la sobrecarga de una plataforma amplia. La contrapartida es un catálogo de servicios más limitado: computación y almacenamiento básico están bien cubiertos; la identidad, las bases de datos gestionadas y la integración entre servicios no lo están.
Lambda Labs
Lambda Labs afirma dar servicio a más de 10,000 equipos de investigación. El catálogo abarca 8 familias de modelos de GPU y está diseñado exclusivamente para GPU. Lambda Cloud viene preconfigurado con PyTorch, TensorFlow, controladores CUDA y un notebook Jupyter por instancia, más cercano a "clic y entrenar" que otras neoclouds. Lambda también vende hardware de GPU directamente (equipos de sobremesa, servidores), herencia de los orígenes de la empresa. El precio es solo bajo demanda en el listado público; los compromisos de varias semanas o varios años se gestionan mediante presupuesto.16
CoreWeave
CoreWeave es la neocloud especializada más grande y fue seleccionada como el primer proveedor de servicios cloud Elite de NVIDIA. La empresa afirma contar con 45,000 GPUs en sus centros de datos y tiene a NVIDIA entre sus inversores. Se exponen dos niveles de facturación (bajo demanda y spot). El catálogo abarca 10 familias de modelos de GPU, incluyendo B200 y B300.17
El programa ARENA de CoreWeave (Aplicaciones Nativas Listas para IA) permite a los clientes comparar cargas de trabajo a escala de producción contra infraestructura real antes de comprometer capacidad. El precio se sitúa más cerca del nivel hyperscaler que de otras neoclouds, reflejando un posicionamiento empresarial de gama más alta.
RunPod
RunPod opera dos niveles: Secure Cloud (bare-metal dedicado) y Community Cloud (bare-metal compartido a tarifas más bajas sin SLA). El catálogo abarca 19 familias de modelos de GPU, incluyendo AMD MI300X. Se exponen públicamente tres niveles de facturación (bajo demanda, spot y reservado). El inicio de instancia es inferior a un minuto, el más rápido en nuestras mediciones.18
Las actualizaciones recientes incluyen la reversión de versiones de GitHub para endpoints Serverless, endpoints de balanceo de carga en fase beta e integración con el SDK de Vercel IA a través del paquete @runpod/ai-sdk-provider. El catálogo de Public Endpoints cubre modelos de texto, imagen, vídeo y audio con plantillas de despliegue predefinidas.
Crusoe
Crusoe gestiona centros de datos con gas natural varado y quemado en antorcha, un arbitraje de costes y emisiones que financia una expansión agresiva de capacidad de H100 y B200. El catálogo abarca 9 familias de modelos de GPU, incluyendo AMD MI300X.19
FluidStack, Hyperstack, Nebius
FluidStack agrega capacidad de GPU de múltiples operadores de centros de datos. Hyperstack es una de las fuentes de H100 con el precio más bajo del nivel neocloud, con presencia en el Reino Unido y tres niveles de facturación. Nebius tiene su sede en Europa (Países Bajos) e incluye en su catálogo los modelos de vanguardia B200 y B300.20 21 22
Paperspace de DigitalOcean
Paperspace fue adquirida por DigitalOcean y afirma dar servicio a más de 650,000 usuarios. El catálogo abarca 12 familias de modelos de GPU. La interfaz de notebook Jupyter precargada y la gestión visual de instancias son los diferenciadores históricos; los usuarios avanzados suelen sustituir la GUI por flujos de trabajo nativos de Jupyter o SSH.23
Otras neoclouds especializadas
TensorDock, CUDO Compute, Hot Aisle (con foco en AMD MI300X), Sesterce, Lyceum, Cirrascale (solo reservado, incluye opciones de Cerebras y Graphcore), Together (nivel de inferencia) y Replicate (serverless) completan el nivel especializado. La mayoría operan solo bajo demanda y se dirigen a equipos de desarrollo de IA pequeños y medianos.24 25 26 27 28 29 30 31
Datacrunch y Seeweb (especialistas europeos)
Datacrunch es una neocloud con sede en Finlandia que funciona con energía 100% renovable, con H100, A100, RTX 6000 y V100 en grupos de 1, 2, 4 u 8. Seeweb es una neocloud italiana que también funciona con energía 100% renovable, con cinco familias de modelos de GPU y compatibilidad con Terraform para flujos de trabajo de infraestructura como código.32 33
Marketplaces comunitarios
Los marketplaces comunitarios agregan capacidad de GPU de muchos operadores pequeños, a menudo al mínimo del rango de precios publicado. La contrapartida es la variabilidad: bare-metal compartido, SLA de tiempo de actividad menos consistente e inventario que depende de cuántos operadores anfitriones estén en línea en el momento de la solicitud.
Vast.ai
Vast.ai agrega 54 familias de modelos de GPU y 180 configuraciones multi-GPU distintas, el catálogo más amplio de todos los proveedores que seguimos. Se exponen tres niveles de facturación. El marketplace puja por el inventario de muchos operadores anfitriones pequeños, lo que significa que una cotización de precio en el panel refleja la disponibilidad actual y puede no mantenerse cinco minutos después. El catálogo también incluye hardware heredado (de la era GTX 1080, K80) que ningún otro proveedor rastreado lista, útil para experimentación basada en costes y cargas de trabajo académicas.34
Salad
Salad funciona sobre hardware de consumo distribuido (PCs de juegos que participan en la red durante el tiempo de inactividad). H100 no está listado públicamente; el catálogo se inclina por RTX 4090, RTX 5090 y otras tarjetas de gama de consumo, al mínimo de esas clases de GPU entre todos los proveedores.35
Theta EdgeCloud
Theta EdgeCloud abarca 28 familias de modelos de GPU en una red de nodos en el borde. La arquitectura distribuida en el borde es el diferenciador para inferencia sensible a la región; el precio es solo bajo demanda y el inventario varía según el nodo de borde.36
Demanda de proveedores: adopción, gasto y búsqueda
La adopción, la cuota de gasto y la cuota de búsqueda miden la demanda de cada proveedor.
- Adopción es la proporción de compradores de GPU en la nube que utilizan cada proveedor.
- Cuota de gasto es la participación de cada proveedor en el total de dólares gastados en GPU en la nube.
- Cuota de búsqueda es la porción de cada proveedor del volumen de búsqueda mensual combinado de los siete proveedores por sus nombres de marca.
La adopción y la cuota de gasto proceden de los datos agregados de gasto con tarjeta en GPU en la nube de Ramp.37
CoreWeave lidera las tres señales en el primer trimestre de 2026, con el 35.4% de compradores, el 50.8% de dólares y el 31.3% de búsqueda. La mayor divergencia se da entre Crusoe y RunPod. Crusoe tiene el 27.7% de dólares con solo el 3.0% de compradores y el 0.9% de búsquedas. RunPod representa el 27.7% de compradores y el 25.7% de búsquedas, con el 0.5% de gasto.
La cuota de búsqueda refleja más la notoriedad que la demanda comprometida, y puede adelantarse al dinero. Vultr es el caso más claro. Acapara el 18.5% de búsqueda frente al 3.0% de gasto porque es una marca de VPS de propósito general, y la mayor parte de esa búsqueda de marca es interés en alojamiento, no en alquiler de GPU.
Cómo se miden las señales de búsqueda
La cuota de búsqueda suma el 100% dentro de los proveedores mostrados, no en todo el mercado, durante la ventana del tercer trimestre de 2025 al primer trimestre de 2026 donde coinciden las tres señales. La búsqueda de cada proveedor se cuenta por su término de marca:
Para conocer las trayectorias de precios de estos proveedores, consulta el Índice de precios de alquiler de GPU en la nube.
Modelos de despliegue
Los servicios de alquiler de GPU se presentan en tres formas de despliegue. Cada forma intercambia control por comodidad.
GPU serverless
Los servicios de GPU serverless gestionan el aprovisionamiento, el escalado y la finalización en nombre del comprador. El proveedor cobra por segundo o por milisegundo de uso real de la GPU; el tiempo de inactividad es gratuito. Esta modalidad se adapta a cargas de trabajo esporádicas, inferencia por lotes y aplicaciones de IA generativa con picos de actividad donde la utilización media es baja.
Entre los proveedores habituales de GPU serverless se incluyen Replicate, RunPod Serverless, Modal, Fal.ai y Together. El rendimiento por dólar suele superar al de la GPU aprovisionada cuando la utilización es inferior al 30-40%; por encima de ese umbral, las instancias de GPU bajo demanda o reservadas resultan más baratas.38 39 40 41 42
GPU virtual (vGPU)
Las GPU virtuales son la modalidad más común. Un hipervisor particiona una GPU física en una o más porciones virtuales, cada una ejecutándose dentro de una máquina virtual. Todos los principales hyperscalers y la mayoría de las neoclouds adoptan por defecto esta modalidad. Las contrapartidas: coste predecible, amplia disponibilidad entre proveedores y una ligera sobrecarga de latencia debida a la capa de virtualización.
GPU bare-metal
Los servicios de GPU bare-metal entregan un servidor físico dedicado con GPU, sin capa de virtualización. El comprador obtiene acceso directo al hardware para obtener el máximo rendimiento y la mínima latencia. Esta modalidad se adapta a grandes ejecuciones de entrenamiento, cargas de trabajo HPC y cualquier caso en el que la sobrecarga de la virtualización sea relevante. OCI, CoreWeave y Lambda Labs ofrecen opciones bare-metal. AWS y Azure lo exponen a través de familias de instancias específicas (p5d en AWS, serie ND en Azure).
Preguntas frecuentes
Los hyperscalers gestionan plataformas en la nube amplias donde el alquiler de GPU es una línea de producto entre muchas. Las neoclouds especializadas se centran en la infraestructura de GPU y de IA como su producto principal. Los hyperscalers tienen un precio de 3 a 6x por encima de las neoclouds por la misma GPU; la diferencia refleja los servicios empresariales incluidos, no el silicio en bruto. Para una comparación sostenida de tendencias de precios entre niveles, consulta el Índice de precios de alquiler de GPU en la nube.
Usa serverless cuando la utilización media de la GPU sea inferior al 30-40%, cuando las cargas de trabajo tengan picos de actividad o cuando el coste operativo supere el precio por hora. Una GPU aprovisionada en una neocloud resulta más barata con una utilización alta y sostenida.
Para cargas de trabajo con requisitos de residencia de datos en la UE o compradores que atienden a clientes de la UE en rutas sensibles a la latencia, sí. IONOS, OVHcloud, Scaleway, Nebius, Datacrunch y Seeweb son opciones con sede en la UE. Los precios suelen igualar o superar ligeramente a los de las neoclouds con sede en EE. UU.; la prima se justifica por la residencia, la jurisdicción y las afirmaciones de sostenibilidad, más que por la capacidad de cómputo bruta.
Lecturas adicionales
- Comparativa multi-GPU: B200 vs H200 vs H100 vs MI300X
- Comparativa de concurrencia de GPU
- Los 25+ principales fabricantes de chips de IA: NVIDIA y sus competidores
- Índice de precios de alquiler de GPU en la nube
Cita este benchmark
Elige el formato que se ajuste al lugar donde vas a publicar. Pegar la versión con enlace en tu CMS conserva el enlace de retroceso.
@misc{dogan2026,
author = {Dogan, Sedat and Sarı, Ekrem},
title = {{Los 60+ principales proveedores de GPU en la nube}},
year = {2026},
month = jul,
howpublished = {\url{https://aimultiple.com/cloud-gpu-providers}},
note = {AIMultiple. Recuperado el 23 de Julio de 2026}
}Resultados y marcas de tiempo de 318 puntos de datos. Descargue los datos utilizados en este artículo como un archivo ZIP que contiene 2 archivos CSV y un README.
Comentarios 4
Comparte tus ideas
Tu dirección de correo electrónico no será publicada. Todos los campos son obligatorios. Los comentarios se dejan en su idioma original.
Nice article, Cem! Could you add Koyeb and a few other serverless GPU providers?
Sure, thank you for the suggestion, we will consider it in the next edit.
Hi Cem, please also check out Dataoorts at https://dataoorts.com. We'd greatly appreciate being listed here.
Sure, we'll review to see if we can include Dataoorts in the next edit.
Hi Cem, we just launched Atlascloud.ai with the lowest H100 pricing on internet 2.48 on demand. Would love to get on your list.
Sure, we'll be reaching out to understand what Atlascloud.ai is offering.
Where is Nebius.ai ???
Thank you! It is added now.