NVIDIA Spectrum-6, concu pour Vera Rubin, arrive dans les usines a IA a l'echelle gigascale
NVIDIA a annoncé le déploiement de Spectrum-6, un système de commutation Ethernet capable d'atteindre 102,4 térabits par seconde, soit le double de la capacité de la génération précédente. Conçu comme un élément central de la plateforme NVIDIA Vera Rubin, ce système s'installe désormais dans les plus grandes usines d'IA du monde, celles qui rassemblent des centaines de milliers de GPU et de CPU pour entraîner des modèles de pointe et faire fonctionner des applications d'IA agentique. Spectrum-6 s'appuie sur une puce de commutation associée à la carte réseau ConnectX-9 SuperNIC, et s'intègre à l'architecture Vera Rubin aux côtés du CPU Vera, du GPU Rubin, du commutateur NVLink 6 et du DPU BlueField-4. Le système prend en charge à la fois l'optique enfichable et l'optique co-packagée, ainsi que le refroidissement liquide, ce qui permet une approche de refroidissement de bout en bout pour l'ensemble de l'infrastructure tout en améliorant l'efficacité énergétique du réseau. Parmi les premiers acteurs à adopter cette technologie figurent CoreWeave, Microsoft, Nebius, SpaceX/xAI et Tesla.
Cette évolution répond à un problème devenu central dans l'IA à grande échelle : la performance brute des GPU ne suffit plus à prédire la performance globale d'une usine d'IA. Les charges de travail d'entraînement et d'inférence à grande échelle dépendent de milliers d'accélérateurs qui échangent des données en permanence, via des opérations de communication collective qui synchronisent le travail entre GPU. Or l'Ethernet classique a été conçu pour du trafic nord-sud entre utilisateurs, serveurs et stockage, pas pour ces schémas de communication massivement parallèles. En transformant l'Ethernet en une infrastructure réseau taillée pour l'IA, Spectrum-X promet de maintenir chaque GPU alimenté en données en continu. Pour les fournisseurs cloud, cela signifie pouvoir faire fonctionner davantage de capacité de calcul comme une ressource unifiée et performante, accélérant l'entraînement des modèles et le déploiement des services d'inférence pour leurs clients. Pour les acteurs qui construisent leur propre infrastructure, cela se traduit par plus de GPU synchronisés, une meilleure utilisation lors des opérations collectives intensives et davantage de résilience pour les tâches de longue durée.
Selon Min Jun, directeur produit réseau chez CoreWeave, l'intégration de Spectrum-6 et de l'infrastructure Spectrum-X Ethernet à refroidissement liquide doit apporter la bande passante, la résilience et l'efficacité nécessaires pour entraîner des modèles de pointe plus rapidement. Laurelle Roseman, vice-présidente des partenariats mondiaux chez Nebius, souligne qu'à cette échelle, la performance dépend avant tout de la coordination entre GPU, un seul lien lent pouvant bloquer l'ensemble d'une tâche. CoreWeave, Microsoft et Nebius comptent parmi les premiers fournisseurs à déployer une infrastructure basée sur Vera Rubin avec Spectrum-6, ouvrant l'accès à cette plateforme à une large communauté de développeurs, de startups et d'entreprises.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



