d-Matrix adopte NVIDIA NVLink Fusion pour ses déploiements XPU à l'échelle du rack
Le fabricant de puces d'inférence IA d-Matrix a annoncé qu'il utilisera la technologie NVLink Fusion de NVIDIA pour connecter ses futures puces Raptor XPU à la plateforme d'infrastructure IA de NVIDIA, rejoignant une liste croissante de partenaires qui compte déjà AWS, Arm, Intel, Fujitsu, SiFive, Alchip, Astera Labs, GUC, Marvell, MediaTek, Samsung, Cadence, Synopsys, Ayar Labs et Lightmatter. Sid Sheth, cofondateur et PDG de d-Matrix, a présenté l'accord lors d'un point presse, expliquant que "la demande d'inférence explose, mais le capital, le temps et l'énergie restent limités" et que NVLink Fusion combiné à l'architecture de racks MGX de NVIDIA offre à ses clients "une voie plus rapide et moins risquée pour déployer et faire évoluer une inférence à ultra-faible latence". Concrètement, les puces Raptor seront reliées via le réseau d'interconnexion NVLink en mode scale-up et le réseau Spectrum-X en mode scale-out, avec à la clé des performances annoncées de trois fois moins de latence puce à puce que l'Ethernet standard, dix fois plus de paquets traités par seconde, et une bande passante de 3 To/s par puce grâce à la sixième génération de NVLink.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de NVIDIA AI Blog. Lire l'article original →
Cette intégration change la donne pour les fabricants de silicium spécialisé, qui doivent habituellement construire eux-mêmes toute l'infrastructure de déploiement à grande échelle, des interfaces haut débit jusqu'au refroidissement liquide des racks, un processus long, coûteux et risqué. En s'appuyant sur l'écosystème MGX déjà validé de NVIDIA, d-Matrix évite de devoir concevoir sa propre architecture de racks et bénéficie d'une chaîne d'approvisionnement, d'une alimentation électrique et d'un refroidissement éprouvés. L'entreprise prévoit aussi d'intégrer les futurs processeurs NVIDIA Vera, les cartes réseau ConnectX-9 SuperNIC, les DPU BlueField-4 et le réseau Ethernet Spectrum-X, permettant à ses racks de fonctionner aux côtés des systèmes GPU NVIDIA comme le Vera Rubin NVL72 pour des architectures d'inférence désagrégée. Pour les opérateurs de data centers, l'intérêt est de pouvoir standardiser sur un seul type de rack capable d'accueillir GPU, CPU et XPU, sans multiplier les architectures dédiées par type de processeur.
Ce partenariat illustre la stratégie de NVIDIA consistant à rester verticalement intégré tout en s'ouvrant horizontalement à des puces tierces, un modèle que l'entreprise qualifie d'"usine IA semi-personnalisée": le partenaire se concentre sur l'innovation de son silicium tandis que NVIDIA fournit l'interconnexion, les racks, le logiciel et la chaîne logistique. NVLink Fusion supporte désormais toutes les grandes architectures de processeurs, Arm, x86 et RISC-V, aux côtés des GPU NVIDIA. Dans un contexte où de nombreux hyperscalers et fabricants développent leurs propres puces d'inférence pour réduire leur dépendance aux GPU génériques, cette ouverture permet à NVIDIA de conserver un rôle central dans l'infrastructure IA, même chez ses concurrents potentiels sur le marché des puces spécialisées.
Impact indirect seulement: les opérateurs de data centers européens pourraient a terme bénéficier de racks standardises compatibles GPU/CPU/XPU, mais aucune entreprise ni régulation française ou européenne n'est concernée directement.