Nvidia lance Vera Rubin et vise le contrôle des data centers IA

D'après WIRED (21 juillet 2026 à 17h00)

Résumé

Nvidia dévoile Vera Rubin, une plateforme mêlant GPU Rubin et CPU Vera conçue pour les agents d’IA, dix fois plus efficace que Grace Blackwell et déjà utilisée par OpenAI.

Les faits

Nvidia met en avant cette semaine son nouveau système de puces Vera Rubin, en publiant des benchmarks de performance pour cette combinaison GPU‑CPU avant l’événement annuel d’AMD à San Francisco. L’entreprise, historiquement spécialisée dans les GPU, cherche désormais à se positionner comme fournisseur de CPU capables d’alimenter des agents d’IA. Le passage vers des systèmes d’IA plus complexes et « agentiques » accroît la demande de CPU, utilisés pour orchestrer les flux de données, le réseau et diverses tâches logicielles. Nvidia présente Vera Rubin comme le successeur de son superchip hybride Grace Blackwell et comme la pierre angulaire de son avenir proche dans l’IA, avec une architecture offrant un CPU pour deux GPU. Dans un système Vera Rubin NVL72, on compte ainsi 36 CPU Vera pour 72 GPU Rubin. Nvidia propose le CPU Vera aussi en produit autonome, qu’elle aurait indiqué à des clients chinois pouvoir livrer dès août. La société affirme que le système Vera Rubin NVL72 traite dix fois plus de tokens par watt que le superchip Grace Blackwell et que le CPU Vera est plus rapide sur les tâches d’IA agentiques que des CPU concurrents d’AMD et d’Intel, même si les tests reposent sur des générations légèrement plus anciennes de ces puces. Les sous‑systèmes de mémoire localisée offriraient près de trois fois plus de bande passante mémoire que Blackwell, un atout dans un contexte de pénurie de mémoire à haute bande passante. Les nouveaux racks Vera Rubin NVL72, entièrement refroidis par liquide, sont présentés comme bien plus « plug‑and‑play » que les précédents systèmes de Nvidia. Le groupe affirme avoir réduit de façon significative le nombre de câbles nécessaires pour connecter les puces dans des systèmes multi‑racks, au point de promouvoir Vera Rubin comme une offre de calcul « sans câbles » et « échangeable à chaud », ce qui permettrait de ramener l’installation d’un rack de quelques heures à quelques minutes. Lors d’une visite de laboratoire, les dirigeants de Nvidia ont indiqué qu’OpenAI dispose déjà d’un rack Vera Rubin en production. Vera Rubin, dévoilé au printemps 2025, doit selon Jensen Huang monter en « pleine production » et être livré au second semestre de cette année, avec des clients initiaux comme Microsoft, OpenAI et Oracle. Nvidia reste particulièrement attentive à toute question de retard après les problèmes de surchauffe des puces Blackwell dans ses racks sur mesure, qui avaient forcé des modifications de conception et repoussé les livraisons. La campagne de promotion de Vera Rubin intervient alors qu’AMD détaille son rack Helios pour concurrencer ces nouveaux systèmes, dans une bataille pour des contrats pluriannuels auprès de hyperscalers comme Meta et Amazon et de laboratoires d’IA comme OpenAI, Anthropic et SpaceXAI. Au‑delà de la seule performance, les dirigeants Ian Buck et Andrew Bell insistent sur le caractère plus simple à installer des racks Vera Rubin et sur leur refroidissement entièrement liquide, moins énergivore que l’air. Buck résume la stratégie en expliquant que Nvidia suit une feuille de route pour « produire de nouvelles architectures, pas seulement des GPU mais aussi des CPU » et que l’entreprise « continuera à innover, car c’est faire cela ou mourir dans la Silicon Valley ».

Pourquoi c’est important

Vera Rubin marque un tournant stratégique pour Nvidia, qui ne veut plus seulement vendre des GPU mais contrôler l’ensemble de la pile matérielle des data centers d’IA, des CPU aux racks complets. En proposant une plateforme intégrée, plus simple à installer, plus efficace énergétiquement et optimisée pour les agents d’IA, le groupe cherche à verrouiller les budgets d’infrastructure des hyperscalers et des grands laboratoires. Cette offensive intervient dans un contexte de concurrence accrue avec AMD et Intel sur le marché des CPU de data center, et face à une pénurie persistante de mémoire à haute bande passante. Les promesses de dix fois plus de tokens par watt que Grace Blackwell, de mémoire presque triplée et de déploiements déjà chez OpenAI, Microsoft et Oracle renforcent la position dominante de Nvidia dans l’IA, tout en accentuant la dépendance de l’écosystème à ses plateformes propriétaires.

Questions fréquentes

Qu’est‑ce que Vera Rubin chez Nvidia ?

Vera Rubin est le successeur du superchip Grace Blackwell, combinant CPU Vera et GPU Rubin pour former une plateforme intégrée pour data centers d’IA.

Quelle configuration propose le système Vera Rubin NVL72 ?

Un système Vera Rubin NVL72 embarque 36 CPU Vera pour 72 GPU Rubin, avec un CPU pour deux GPU.

Quels gains de performance Nvidia revendique‑t‑elle ?

Nvidia affirme que Vera Rubin NVL72 traite dix fois plus de tokens par watt que Grace Blackwell et offre près de trois fois plus de bande passante mémoire.

Qui utilise déjà les racks Vera Rubin ?

Lors d’une visite de laboratoire, Nvidia a indiqué qu’OpenAI exploite déjà un rack Vera Rubin NVL72.

Quand Vera Rubin doit‑il être livré aux clients ?

Jensen Huang affirme que Vera Rubin monte en « pleine production » et sera livré au second semestre de cette année.

Source

WIRED

Auteur

Rédaction IA-Medias

Rédaction spécialisée dans la veille et l'analyse de l'actualité de l'intelligence artificielle, des puces IA, des robots, des agents IA et de la recherche.