GTC 2026 : Nvidia lance la plateforme Vera Rubin
2026-03-16 · Éditeur : Nvidia · Domaine : Intelligence Artificielle
À la GTC de San Jose, Jensen Huang présente la plateforme Vera Rubin : sept puces en production, dont le premier LPU issu de Groq, pensées pour l'IA agentique. Il évoque 1 000 Md USD de commandes Blackwell et Vera Rubin d'ici 2027.
Ce qui change
- Sept puces en production : CPU Vera, GPU Rubin, NVLink 6, ConnectX-9, BlueField-4, Spectrum-6 et LPU Groq 3.
- Le rack Vera Rubin NVL72 (72 GPU, 36 CPU) annonce jusqu'à 10 fois plus de débit d'inférence par watt que Blackwell, selon Nvidia.
- Le rack Groq 3 LPX (256 LPU) promet jusqu'à 35 fois plus de débit par mégawatt, livraison au second semestre 2026.
- Jensen Huang évoque 1 000 Md USD de commandes Blackwell et Vera Rubin jusqu'en 2027.
Le 16 mars 2026, lors de la keynote de la GTC au SAP Center de San Jose, Jensen Huang présente la plateforme Vera Rubin, successeur de Grace Blackwell, que Nvidia positionne sur l'IA agentique et l'inférence à grande échelle. ### Ce qui s'est passé - La plateforme réunit sept puces annoncées en pleine production : le CPU Vera, le GPU Rubin, le commutateur NVLink 6, la SuperNIC ConnectX-9, le DPU BlueField-4, le commutateur Ethernet Spectrum-6 et le nouveau LPU Groq 3. - Le Groq 3 est la première puce issue de Groq, dont Nvidia a acquis l'essentiel des actifs en décembre 2025 pour 20 Md USD, sa plus grosse opération selon CNBC. - Nvidia décline la plateforme en cinq racks : Vera Rubin NVL72, rack CPU Vera, Groq 3 LPX, stockage BlueField-4 STX et Ethernet Spectrum-6 SPX. - Jensen Huang résume : « The agentic AI inflection point has arrived with Vera Rubin » (le point d'inflexion de l'IA agentique est arrivé avec Vera Rubin). ### Chiffres clés (annonces de Nvidia) | Élément | Valeur | |---|---| | Vera Rubin NVL72 | 72 GPU Rubin, 36 CPU Vera | | Entraînement de modèles MoE | quatre fois moins de GPU qu'avec Blackwell | | Débit d'inférence par watt | jusqu'à 10 fois celui de Blackwell | | Coût par token | jusqu'à 10 fois moins élevé | | Rack Groq 3 LPX | 256 LPU, 128 Go de SRAM, 640 To/s | | Gain Rubin + LPX | jusqu'à 35 fois plus de débit par mégawatt | | Commandes Blackwell et Vera Rubin jusqu'en 2027 | 1 000 Md USD, selon Jensen Huang | ### Pourquoi c'est un tournant Nvidia ne vend plus des puces mais des centres de calcul intégrés, du rack au « POD ». L'arrivée d'un processeur spécialisé dans l'inférence à faible latence, à côté des GPU, prend acte de l'explosion du nombre de tokens générés par les agents. Dario Amodei (Anthropic) et Sam Altman (OpenAI) figurent parmi les clients cités dans l'annonce. ### Réserves Les gains de performance sont des chiffres de Nvidia. Les systèmes Vera Rubin sont annoncés pour la fin de 2026 et le rack LPX pour le second semestre : l'efficacité réelle reste à mesurer en production. ### À retenir Vera Rubin fixe l'architecture des usines d'IA de 2026-2027. Nvidia annonce déjà Vera Rubin Ultra et l'architecture Kyber (144 GPU par rack) pour 2027.
Liens
Tags : IA, NVIDIA, Calcul, GPU, Infrastructure, Agents