Negócios

Nuvem de GPU (Neocloud)

Uma nuvem de GPU, frequentemente chamada de neocloud, é um provedor de nuvem que se especializa em alugar clusters de GPU de alta densidade para treinamento e inferência de IA, em vez de oferecer o amplo portfólio de serviços gerenciados que distinguem hyperscalers.

Nuvens de GPU — também chamadas de neoclouds ou nuvens de IA — são provedores de infraestrutura cuja ofererta principal é acesso sob demanda a clusters de unidades de processamento gráfico de alta qualidade, o hardware que sustenta tanto o treinamento de grandes redes neurais quanto seu serviço em tempo de inferência. Ao contrário dos hyperscalers (AWS, Azure, GCP), que oferecem amplos portfólios de bancos de dados, serviços de rede e ferramentas para desenvolvedores, as neoclouds estão focadas estritamente na capacidade bruta de GPU e na malha de interconexão de alta velocidade necessária para coordenar milhares de aceleradores durante execuções de treinamento distribuído.

O modelo de negócio centra-se em adquirir clusters de GPUs NVIDIA H100, H200 ou B200 — e cada vez mais AMD MI300X ou aceleradores personalizados — e alugá-los por hora, dia ou reserva de longo prazo. Interconexões de alta velocidade (InfiniBand NDR ou NVIDIA NVLink) são essenciais para treinamento multi-nó, e a taxa de transferência de armazenamento importa para pipelines de dados. Neoclouds proeminentes incluem CoreWeave e Lambda Labs nos EUA, Crusoe Energy (que usa gás natural retido para energia) e Voltage Park. Together AI se foca especificamente em serviço de inferência. O preço é tipicamente mais transparente e as configurações mais otimizadas para ML do que oferecimentos equivalentes de hyperscalers.

As neoclouds surgiram como um segmento de mercado distinto por volta de 2022–2023 quando a demanda por compute de GPU para treinamento de IA vastamente superou a oferta em plataformas de hyperscalers, onde os tempos de espera se estendiam por semanas e as configurações de instância eram inflexíveis. As neoclouds ofereciam tempos de entrega mais curtos e acesso do tipo bare-metal a grandes clusters de GPU, atraindo laboratórios de IA, startups e empresas que precisavam de capacidade de pico sem se comprometer com o ecossistema mais amplo de um hyperscaler.

Em 2026, o mercado de neocloud é intensivo em capital e cada vez mais competitivo. CoreWeave abriu capital em março de 2025 com avaliação próxima a $23 bilhões. Os hyperscalers responderam expandindo famílias de instâncias de IA dedicadas (AWS P5, Azure NDv5), mas as neoclouds retêm uma vantagem de preço e disponibilidade para cargas de trabalho puras de GPU. Programas soberanos de IA no Oriente Médio, Europa e Ásia também estão impulsionando a demanda por infraestrutura estilo neocloud localizada dentro das fronteiras nacionais, criando uma nova classe de nuvens de GPU apoiadas pelo governo ou operadas nacionalmente.

Exemplo

Um laboratório de pesquisa de IA que precisa executar um trabalho de pré-treinamento de 10.000 horas de GPU reserva um cluster NVIDIA H100 de 512 nós no CoreWeave por duas semanas em vez de esperar meses pela alocação de hyperscaler, reduzindo o tempo até o primeiro experimento em mais de um mês.

Termos relacionados

Últimas notícias sobre o tema

← Glossário