Negocios

Nube GPU (Neocloud)

Una nube GPU, a menudo llamada neocloud, es un proveedor de nube que se especializa en alquilar clusters de GPU de alta densidad para entrenamiento e inferencia de IA, en lugar de ofrecer la amplia cartera de servicios administrados que distingue a los proveedores en hiperescala.

Las nubes GPU — también llamadas neoclouds o nubes de IA — son proveedores de infraestructura cuya oferta principal es acceso bajo demanda a clusters de unidades de procesamiento gráfico de gama alta, el hardware que respalda tanto el entrenamiento de redes neuronales grandes como su servicio en el momento de inferencia. A diferencia de los proveedores en hiperescala (AWS, Azure, GCP), que ofrecen amplias carteras de bases de datos, servicios de redes y herramientas de desarrollador, los neoclouds se centran estrechamente en capacidad bruta de GPU y la infraestructura de interconexión de alta velocidad requerida para coordinar miles de aceleradores durante ejecuciones de entrenamiento distribuido.

El modelo de negocio se centra en adquirir clusters de GPUs NVIDIA H100, H200 o B200 — e incrementalmente AMD MI300X u aceleradores personalizados — y alquilarlos por hora, día o reserva a largo plazo. Los interconexos de alta velocidad (InfiniBand NDR o NVIDIA NVLink) son esenciales para el entrenamiento de múltiples nodos, y el rendimiento del almacenamiento es importante para los pipelines de datos. Los neoclouds destacados incluyen CoreWeave y Lambda Labs en los EE.UU., Crusoe Energy (que usa gas natural varado para energía) y Voltage Park. Together AI se enfoca específicamente en el servicio de inferencia. Los precios son típicamente más transparentes y las configuraciones más optimizadas para ML que las ofertas equivalentes de proveedores en hiperescala.

Los neoclouds emergieron como un segmento de mercado distinto alrededor de 2022–2023 cuando la demanda de poder de computación GPU para entrenamiento de IA vastamente superó la oferta en plataformas de proveedores en hiperescala, donde los tiempos de espera se extendieron a semanas y las configuraciones de instancia eran inflexibles. Los neoclouds ofrecieron tiempos de entrega más cortos y acceso de estilo metal desnudo a clusters de GPU grandes, atrayendo laboratorios de IA, startups y empresas que necesitaban capacidad de ráfaga sin comprometerse con el ecosistema más amplio de un proveedor en hiperescala.

Para 2026, el mercado neocloud es intensivo en capital e incrementalmente competitivo. CoreWeave se hizo pública en marzo de 2025 con una valoración cercana a $23 mil millones. Los proveedores en hiperescala han respondido expandiendo familias de instancia de IA dedicadas (AWS P5, Azure NDv5), pero los neoclouds retienen una ventaja de precio y disponibilidad para cargas de trabajo puras de GPU. Los programas de IA soberana en Oriente Medio, Europa y Asia también impulsan la demanda de infraestructura de estilo neocloud ubicada dentro de fronteras nacionales, creando una nueva clase de nubes GPU respaldadas por gobiernos u operadas nacionalmente.

Ejemplo

Un laboratorio de investigación de IA que necesita ejecutar un trabajo de pre-entrenamiento de 10.000 horas de GPU reserva un cluster NVIDIA H100 de 512 nodos en CoreWeave durante dos semanas en lugar de esperar meses por asignación de proveedor en hiperescala, cortando el tiempo al primer experimento en más de un mes.

Términos relacionados

← Glosario