Cloud GPU (néocloud)
Un cloud GPU, souvent appelé un néocloud, est un fournisseur de cloud qui se spécialise dans la location de clusters GPU haute densité pour l'entraînement et l'inférence IA, plutôt que d'offrir le large portefeuille de services gérés qui distingue les hyperscalers.
Les clouds GPU — aussi appelés néoclouds ou clouds IA — sont des fournisseurs d'infrastructure dont l'offre principale est l'accès à la demande à des clusters d'unités de traitement graphique haute de gamme, le matériel qui soutient à la fois l'entraînement de grands réseaux de neurones et leur service au moment de l'inférence. Contrairement aux hyperscalers (AWS, Azure, GCP), qui offrent de larges portefeuilles de bases de données, de services de réseau et d'outils de développement, les néoclouds sont concentrés étroitement sur la capacité GPU brute et la structure d'interconnexion haute vitesse requise pour coordonner des milliers d'accélérateurs pendant les exécutions d'entraînement distribué.
Le modèle économique repose sur l'acquisition de clusters de GPU NVIDIA H100, H200 ou B200 — et de plus en plus AMD MI300X ou d'accélérateurs personnalisés — et leur location à l'heure, au jour ou par réservation à long terme. Les interconnexions haute vitesse (InfiniBand NDR ou NVIDIA NVLink) sont essentielles pour l'entraînement multi-nœud, et le débit de stockage importe pour les pipelines de données. Les néoclouds importants incluent CoreWeave et Lambda Labs aux États-Unis, Crusoe Energy (qui utilise le gaz naturel échoué pour l'alimentation) et Voltage Park. Together AI se concentre spécifiquement sur le service d'inférence. La tarification est généralement plus transparente et les configurations plus optimisées pour le ML que les offres équivalentes des hyperscalers.
Les néoclouds ont émergé comme un segment de marché distinct autour de 2022-2023 lorsque la demande de GPU compute pour l'entraînement IA a vastement dépassé l'offre sur les plateformes hyperscalers, où les délais d'attente s'étendaient à des semaines et les configurations d'instance étaient inflexibles. Les néoclouds ont offert des délais d'exécution plus courts et un accès de style bare-metal à de grands clusters GPU, attirant les laboratoires IA, les startups et les entreprises qui avaient besoin de capacité en rafales sans s'engager dans l'écosystème plus large d'un hyperscaler.
En 2026, le marché néocloud est capital-intensif et de plus en plus compétitif. CoreWeave est devenu public en mars 2025 avec une valorisation proche de 23 milliards de dollars. Les hyperscalers ont réagi en élargissant les familles d'instances IA dédiées (AWS P5, Azure NDv5), mais les néoclouds conservent un avantage en prix et disponibilité pour les charges de travail GPU pures. Les programmes IA souverains au Moyen-Orient, en Europe et en Asie stimulent également la demande pour une infrastructure de style néocloud localisée dans les frontières nationales, créant une nouvelle classe de clouds GPU soutenus par le gouvernement ou exploités nationalement.