Wired→ original

Nvidia Vera Rubin: единая система CPU и GPU, чтобы владеть каждым чипом в AI-дата-центрах

Nvidia превращает Vera Rubin в оружие вертикальной интеграции: фирменный Arm-процессор Vera и GPU Rubin с памятью HBM4 работают как единая система, а стойка NVL144 выдаёт до 3,6 эксафлопс в FP4-инференсе. Как пишет Wired, цель компании — владеть каждым чипом внутри AI-дата-центра. Поставки стартуют во второй половине 2026 года, Rubin Ultra — в 2027-м.

Traité par IA depuis Wired ; édité par Hamidun News
Nvidia Vera Rubin: единая система CPU и GPU, чтобы владеть каждым чипом в AI-дата-центрах
Source : Wired. Collage: Hamidun News.
◐ Écouter l'article

Nvidia fait de la plateforme Vera Rubin le cœur de sa stratégie : le système réunit les processeurs maison Vera (CPU) et les accélérateurs Rubin (GPU) en un produit unique, et ses livraisons sont prévues pour la seconde moitié de 2026. Comme l'écrit Wired, l'ambition de l'entreprise est de produire chaque puce à l'intérieur du data center IA : des superpuces de calcul à l'infrastructure réseau.

Qu'est-ce que Vera Rubin

Vera Rubin est la plateforme IA de nouvelle génération de Nvidia, que le CEO Jensen Huang a annoncée à la conférence GTC le 18 mars 2025 comme successeur de Grace Blackwell. La plateforme porte le nom de l'astronome Vera Rubin et fait pour la première fois du duo « CPU maison plus GPU maison » l'unité de base du rack de serveurs, et non une option réservée à certaines configurations.

  • Annonce — 18 mars 2025, keynote de Jensen Huang à la GTC
  • Composition : CPU Vera à 88 cœurs Arm personnalisés et GPU Rubin avec mémoire HBM4
  • Rack Vera Rubin NVL144 — jusqu'à 3,6 exaflops en inférence FP4
  • Début des livraisons — seconde moitié de 2026
  • Étape suivante — Rubin Ultra NVL576 à 15 exaflops en 2027

Selon Nvidia, le rack NVL144 est environ 3,3 fois plus performant en inférence que la génération actuelle Grace Blackwell NVL72 — et il a été conçu comme un système unique, et non comme un assemblage de composants compatibles.

Pourquoi Nvidia veut posséder chaque puce

Le contrôle de toutes les couches du data center protège les marges de Nvidia et attache les clients à son écosystème. Le segment des data centers a rapporté à l'entreprise 115,2 milliards de dollars de revenus sur l'exercice fiscal 2025, selon les comptes de Nvidia, et le portefeuille s'étend désormais bien au-delà des GPU : le processeur Arm Vera, l'interconnexion NVLink, les plateformes réseau Spectrum-X et le DPU BlueField couvrent pratiquement toute la liste du silicium d'un rack de serveurs. En mai 2025, l'entreprise a en outre présenté NVLink Fusion — une technologie qui admet des CPU et des accélérateurs tiers dans son interconnexion, mais aux conditions de Nvidia elle-même.

Wired y voit un basculement systémique : plus le CPU et le GPU sont étroitement intégrés dans une même superpuce, moins il reste de place pour les processeurs Intel et AMD dans les serveurs IA.

«

La plateforme Vera Rubin réunit CPU et GPU dans un système unique et reflète l'ambition croissante de l'entreprise de fournir chaque niveau de l'infrastructure IA », indique l'article de Wired.

Ce qui va changer pour le marché

L'achat d'accélérateurs Nvidia entraînera de plus en plus tout le reste du stack — du processeur central aux cartes réseau. Le processeur Vera avec ses 88 cœurs est, selon Nvidia, environ deux fois plus rapide que le précédent Grace, si bien que les clients ont de moins en moins d'arguments pour installer à côté un CPU d'un autre fournisseur. À la conférence GTC de Washington, en octobre 2025, Huang a déjà montré une superpuce Vera Rubin assemblée et affirmé que la plateforme respectait le calendrier.

Les hyperscalers répondent avec leur propre silicium : Google développe les TPU, Amazon — Trainium, tandis que Microsoft et Meta conçoivent leurs propres accélérateurs. Le pari de Nvidia sur des racks entièrement intégrés est un moyen de retenir ses plus gros clients dans son écosystème avant que ces alternatives n'arrivent à maturité.

Ce que cela signifie

Nvidia cesse d'être un fournisseur d'accélérateurs isolés pour devenir un fabricant verticalement intégré d'« usines à IA » dont chaque puce lui appartient. Les clients obtiennent des performances maximales clé en main — et une dépendance croissante envers un fournisseur unique, avec toutes les conséquences tarifaires que cela implique.

Questions fréquentes

Quand Vera Rubin sortira-t-elle ?

Nvidia promet de commencer les livraisons de la plateforme Vera Rubin dans la seconde moitié de 2026 ; la version renforcée Rubin Ultra NVL576 est annoncée pour 2027.

En quoi Vera Rubin diffère-t-elle de Blackwell ?

Vera Rubin réunit un CPU et un GPU maison dans un système unique et utilise de la mémoire HBM4, alors que la génération Grace Blackwell s'assemblait à partir de composants plus autonomes. En inférence, le rack NVL144 est, selon Nvidia, environ 3,3 fois plus rapide que Grace Blackwell NVL72.

  • Meta est reconnue comme organisation extrémiste et interdite en Russie.
ZK
Hamidun News
Actualités IA sans bruit. Sélection éditoriale quotidienne de plus de 50 sources. Produit de Zhemal Khamidun, Head of AI chez Alpina Digital.

Vous voulez cesser de lire sur l'IA et commencer à l'utiliser?

AI News est un fil d'actualité IA. Hamidun Academy vous apprend à utiliser l'IA dans votre travail.

Qu'en pensez-vous ?
Chargement des commentaires…