Las Vegas, États-Unis – NVIDIA a annoncé que sa nouvelle plateforme de superpuce d’intelligence artificielle, Vera Rubin, entrera en production chez ses clients dès cette année. Cette avancée technologique promet de réduire considérablement les coûts d’exécution des modèles d’IA, tout en renforçant la position dominante de NVIDIA sur le marché.
Lors d’une conférence de presse au salon CES de Las Vegas lundi, Jensen Huang, PDG de NVIDIA, a déclaré : « Aujourd’hui, je peux vous annoncer que Vera Rubin est en pleine production. » Selon l’entreprise, cette nouvelle plateforme permettra de diviser par dix le coût d’exécution des modèles d’IA par rapport à son système de puce actuel, Blackwell.
NVIDIA précise également que Vera Rubin pourrait nécessiter seulement un quart du nombre de puces nécessaires pour entraîner certains grands modèles avec Blackwell. Ces gains de performance et d’efficacité pourraient rendre les systèmes d’IA avancés plus accessibles et dissuader les clients de se tourner vers d’autres fournisseurs.
Microsoft et CoreWeave figurent parmi les premiers partenaires de NVIDIA à proposer des services basés sur les puces Rubin, dès cette année. NVIDIA a révélé que deux centres de données d’IA en construction par Microsoft en Géorgie et dans le Wisconsin intégreront à terme des milliers de puces Rubin. Certains partenaires ont déjà commencé à tester leurs modèles d’IA de nouvelle génération sur ces premiers systèmes.
En outre, NVIDIA collabore avec Red Hat, spécialiste des logiciels d’entreprise open source, pour étendre l’offre de produits fonctionnant sur la plateforme Rubin. Cette collaboration vise à toucher des secteurs variés tels que la banque, l’automobile, l’aéronautique et le secteur public.
La plateforme Vera Rubin tire son nom de l’astronome américaine Vera Rubin, dont les travaux ont révolutionné la compréhension des galaxies. Le système est composé de six puces distinctes, dont le GPU Rubin et le CPU Vera, fabriquées à l’aide du processus de fabrication de 3 nanomètres de Taiwan Semiconductor Manufacturing Company (TSMC) et intégrant la technologie de mémoire à bande passante la plus avancée disponible. Les technologies d’interconnexion et de commutation de sixième génération de NVIDIA assurent la communication entre ces différentes puces.
« Chaque composant de ce système de puces est complètement révolutionnaire et le meilleur de son genre », a affirmé Jensen Huang lors de la conférence de presse.
Le développement du système Rubin s’étend sur plusieurs années. Jensen Huang avait initialement annoncé l’arrivée des puces en 2024, puis NVIDIA avait précisé que les systèmes basés sur Rubin seraient disponibles dans la seconde moitié de 2026. L’annonce de la « pleine production » vise à rassurer les investisseurs, selon Austin Lyons, analyste chez Creative Strategists, qui souligne que des rumeurs circulaient sur un éventuel retard du GPU Rubin.
Cette annonce intervient après un retard dans la livraison des puces Blackwell en 2024, dû à un défaut de conception causant une surchauffe. Les expéditions de Blackwell sont revenues à la normale mi-2025.
Alors que la demande pour les GPU NVIDIA reste forte dans le secteur en pleine expansion de l’IA, certains acteurs, comme OpenAI, investissent également dans la conception de puces personnalisées avec des partenaires comme Broadcom. Cependant, Austin Lyons estime que NVIDIA évolue vers un rôle d’« architecte de système d’IA complet », couvrant le calcul, la mise en réseau, la mémoire, le stockage et l’orchestration logicielle, rendant sa plateforme de plus en plus difficile à remplacer.
À ne pas manquer
