Aller au contenu principal
SSD PCIe 6.0, HBM4 et SOCAMM2 : Micron fait « all-in » sur NVIDIA et l’IA
OutilsNext INpact · 2 min de lecture

SSD PCIe 6.0, HBM4 et SOCAMM2 : Micron fait « all-in » sur NVIDIA et l’IA

Source originale ↗·

Micron mise tout sur l'intelligence artificielle. À l'occasion de la GTC 2026 (GPU Technology Conference) de NVIDIA, le fabricant américain de semi-conducteurs a multiplié les annonces axées exclusivement sur les datacenters et les futurs GPU Rubin de NVIDIA, confirmant une stratégie résolument tournée vers la demande exponentielle en mémoire et stockage générée par l'IA générative.

Cette concentration sur l'IA n'est pas sans conséquences pour le marché grand public. En focalisant sa production sur des composants ultra-spécialisés pour les infrastructures d'hyperscalers, Micron, comme ses concurrents SK hynix et Samsung, contribue indirectement à la pénurie persistante de mémoire et à l'envolée des prix que subissent les consommateurs et les entreprises de taille intermédiaire. Le secteur des datacenters IA capte une part croissante de la capacité de fabrication mondiale.

Sur le plan technique, les annonces sont denses. Micron a lancé en production de masse ses modules HBM4 de 36 Go (12 couches) avec des débits atteignant 11 Gb/s par broche, soit une bande passante totale de plus de 2,8 To/s, 2,3 fois supérieure à la HBM3E avec une efficacité énergétique améliorée de 20 %. Des échantillons de modules 48 Go (16 couches) sont déjà en cours de qualification client, tandis qu'une version HBM4E de 64 Go est annoncée pour 2027. Côté mémoire serveur, les modules SOCAMM2, conçus spécifiquement pour les systèmes NVIDIA Vera Rubin NVL72, atteignent 256 Go par module, soit 2 To de capacité totale et 1,2 To/s de bande passante sur huit emplacements, avec une réduction d'un tiers de la consommation d'énergie par rapport aux RDIMM classiques. Enfin, le Micron 9650 s'impose comme le premier SSD datacenter en série en PCIe Gen 6, avec des débits de 28 Go/s en lecture et 14 Go/s en écriture.

Samsung n'est pas absent de la course : la firme coréenne a présenté pour la première fois une puce physique de HBM4E à la GTC, promettant 16 Gb/s par broche pour une bande passante de 4 To/s. La convergence des trois grands fabricants de mémoire autour des plateformes NVIDIA illustre à quel point l'écosystème Rubin est en train de remodeler toute la chaîne d'approvisionnement du secteur.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

NVIDIA fait progresser le graphisme et la simulation grâce à l'IA agentique et physique lors du SIGGRAPH
1NVIDIA AI Blog 

NVIDIA fait progresser le graphisme et la simulation grâce à l'IA agentique et physique lors du SIGGRAPH

NVIDIA a présenté ses dernières avancées en intelligence artificielle lors de la conférence SIGGRAPH, qui se tient jusqu'au jeudi 23 juillet à Los Angeles. Le discours d'ouverture de l'entreprise, animé par les responsables de la recherche Neil Ashton, Edward Liu et Ming-Yu Liu, a porté sur le rendu neuronal, les modèles de monde et les méthodes de simulation pour l'IA. Parmi les annonces figurent de nouvelles connexions au Model Context Protocol (MCP) pour intégrer des agents IA directement dans les outils de création de contenu, un nouveau microservice NIM baptisé Synthetic Video Detector destiné à repérer les vidéos générées artificiellement, le modèle de monde ouvert Cosmos 3 Edge pensé pour l'IA physique locale, ainsi que NemoClaw, un nouvel outil disponible sur les stations DGX Station et intégré au NVIDIA Agent Toolkit. Adobe, Affinity by Canva et Epic Games figurent parmi les partenaires ayant déjà ouvert leurs logiciels à ces connexions agentiques. Cette évolution marque un tournant pour les professionnels de la création numérique, artistes, monteurs, directeurs techniques et studios de jeux vidéo ou de cinéma. Grâce au protocole MCP, un agent IA peut désormais inspecter une scène pour détecter des textures manquantes, vérifier la cohérence de la gestion des couleurs, préparer des exports, générer des versions de visionnage pour les rushes quotidiens ou valider un plan selon les règles du studio, tout en laissant les décisions créatives entre les mains des humains. L'exécution locale de ces modèles, rendue possible par les stations de travail RTX PRO et les systèmes DGX Spark et DGX Station, améliore la réactivité, réduit la dépendance à des services externes et protège les données sensibles de production, un enjeu majeur pour les studios qui manipulent des contenus non encore publiés. Cette annonce s'inscrit dans une stratégie de longue date de NVIDIA, qui accélère depuis plus de vingt ans les outils de création via ses technologies GPU, le rendu par tracé de rayons RTX et le débruitage par IA. L'arrivée du MCP ouvre désormais un nouveau chapitre où ces logiciels ne se contentent plus d'aller plus vite, mais deviennent capables d'accueillir des agents autonomes. Adobe étend ainsi son assistant IA à travers Firefly, Express et Creative Cloud, et propose un serveur MCP dédié aux développeurs pour créer des extensions. Affinity by Canva a de son côté lancé un connecteur IA pour Claude, permettant d'automatiser en langage naturel des tâches répétitives comme le renommage de calques, le redimensionnement de fichiers pour plusieurs formats ou l'optimisation de tracés vectoriels. Cette convergence entre grands éditeurs de logiciels créatifs et fournisseurs de puissance de calcul comme NVIDIA illustre une transformation plus large de l'industrie, où l'intelligence artificielle s'intègre directement dans les chaînes de production plutôt que de rester un outil externe.

UELes studios de création européens pourraient bénéficier de l'exécution locale de ces outils IA, mais aucun acteur français ou réglementation européenne n'est directement concerne.

OutilsOutil
1 source
NVIDIA et Google Cloud misent sur la prochaine génération de créateurs en IA
2NVIDIA AI Blog 

NVIDIA et Google Cloud misent sur la prochaine génération de créateurs en IA

À l'occasion de Google I/O 2026, NVIDIA et Google Cloud ont annoncé une série de nouvelles ressources pour leur communauté de développeurs commune, qui regroupe désormais plus de 100 000 membres. Lancée lors de Google I/O l'année précédente, cette communauté réunit développeurs, data scientists et ingénieurs en machine learning autour de l'écosystème NVIDIA sur Google Cloud. Parmi les nouveautés dévoilées cette année : un parcours d'apprentissage dédié à la bibliothèque JAX sur GPU NVIDIA, un codelab centré sur NVIDIA Dynamo pour l'optimisation de l'inférence, ainsi que des livestreams mensuels. Les développeurs peuvent désormais déployer des applications multi-agents en combinant les modèles ouverts Gemma 4 de Google DeepMind, les modèles NVIDIA Nemotron et le Google Agent Development Kit, sur des machines virtuelles G4 de Google Cloud équipées de GPU NVIDIA RTX PRO 6000 Blackwell, via Google Cloud Run ou des instances spot. Le nouveau parcours JAX et le codelab NVIDIA Dynamo sur GKE seront disponibles le mois prochain pour les membres de la communauté. Ces annonces ont un impact direct pour les équipes techniques qui cherchent à passer du prototype à la production rapidement. En combinant des modèles ouverts, des bibliothèques accélérées comme cuDF dans Google Colab Enterprise ou Dataproc, et une infrastructure GPU de dernière génération, les développeurs disposent d'un pipeline complet pour construire des applications d'IA prêtes pour la production : des systèmes RAG (retrieval-augmented generation) sur GKE aux pipelines de données d'entreprise en passant par l'analyse sportive. La collaboration sur JAX, framework de calcul numérique utilisé notamment par Google DeepMind pour l'entraînement de grands modèles, étend ces optimisations jusqu'à la plateforme Google Cloud AI Hypercomputer et au framework MaxText, permettant de passer d'expériences sur un seul GPU à des déploiements multi-rack avec une expérience cohérente. L'un des volets les plus significatifs du partenariat concerne l'IA responsable : NVIDIA est le premier partenaire industriel à avoir collaboré avec Google DeepMind sur SynthID, une technologie de tatouage numérique qui intègre des filigranes robustes directement dans les contenus générés par l'IA. Cette technologie est appliquée aux modèles Cosmos de NVIDIA, des modèles de fondation dédiés à la perception 3D et à la simulation pour robots et systèmes autonomes, disponibles sur build.nvidia.com. Dans un contexte où les agents IA combinent de plus en plus modèles propriétaires et open source pour raisonner et agir de manière autonome, cette couche de transparence devient un enjeu central pour la confiance des organisations qui déploient ces systèmes à grande échelle.

UELa technologie SynthID de filigrane numérique, développée avec Google DeepMind et intégrée aux modèles NVIDIA, répond directement aux obligations de transparence de l'AI Act européen sur les contenus générés par IA (Article 50).

OutilsOutil
1 source
Nvidia dévoile NemoClaw, son logiciel pour agents IA
3The Information AI 

Nvidia dévoile NemoClaw, son logiciel pour agents IA

Nvidia franchit une nouvelle étape dans la course aux agents IA en dévoilant NemoClaw, une suite logicielle open source destinée aux entreprises souhaitant construire leurs propres agents intelligents. Le PDG Jensen Huang a présenté l'outil lundi, positionnant ainsi le géant des semi-conducteurs non plus seulement comme fabricant de puces, mais comme fournisseur de solutions logicielles complètes pour l'IA agentique. Ce lancement s'inscrit dans un contexte de compétition intense autour des agents IA, des systèmes capables d'exécuter des tâches complexes de manière autonome. En ciblant le segment entreprises, Nvidia entend capter une part du marché professionnel en pleine expansion, où les organisations cherchent à déployer des agents capables d'automatiser des workflows métier sans dépendre de solutions propriétaires fermées. NemoClaw s'inspire directement du succès d'OpenClaw, le logiciel open source dédié à la création d'agents personnels permettant notamment la rédaction de contenu. La décision de Jensen Huang d'adopter une approche open source pour la version entreprise répond à une demande croissante de flexibilité et de souveraineté technologique de la part des grandes organisations, qui souhaitent adapter les modèles à leurs données propriétaires. Ce mouvement stratégique confirme l'ambition de Nvidia de contrôler l'ensemble de la chaîne de valeur de l'IA, du silicium au logiciel, en réponse directe aux offres concurrentes d'OpenAI, Microsoft et Google sur le marché des agents d'entreprise.

UELes entreprises européennes peuvent adopter NemoClaw pour développer leurs propres agents IA en interne, sans dépendre de solutions propriétaires tierces.

OutilsOutil
1 source
GeForce RTX : avec DLSS 5 et son rendu photoréaliste, l’IA de NVIDIA va-t-elle trop loin ?
4Next INpact 

GeForce RTX : avec DLSS 5 et son rendu photoréaliste, l’IA de NVIDIA va-t-elle trop loin ?

NVIDIA franchit un nouveau cap dans l'intelligence artificielle appliquée au jeu vidéo avec l'annonce de DLSS 5, une technologie qui ambitionne de dépasser la simple performance pour atteindre un rendu photoréaliste en temps réel. Prévu pour l'automne 2026, ce système repose sur un modèle d'IA capable d'injecter un éclairage et des matériaux photoréalistes dans une scène 3D à partir d'une seule image, tout en maintenant la cohérence visuelle entre les frames. Une annonce qui divise : si certains y voient une avancée majeure, d'autres l'accusent de dériver vers l'« AI Slop ». Dans un contexte où NVIDIA concentre ses annonces matérielles sur les datacenters et l'IA générative (avec Vera Rubin en ligne de mire), le grand public reçoit des évolutions logicielles. Cela illustre une stratégie claire : monétiser l'IA sur tous les fronts, y compris le gaming, sans nécessairement livrer de nouvelles cartes graphiques. Pour les joueurs, la question centrale est de savoir jusqu'où l'IA peut, ou doit, se substituer au rendu GPU traditionnel, et si le résultat est encore perçu comme « authentique ». DLSS 4.5 arrive en premier, avec le Dynamic Multi Frame Generation et un nouveau mode 6x disponible dès le 31 mars via une bêta opt-in de l'application NVIDIA. Ce mode génère 5 images par IA pour 1 image réellement calculée par le GPU : un écran 240 Hz peut ainsi afficher 240 fps avec seulement 40 fps en sortie de carte. Réservé aux GeForce RTX série 50, il ajuste le multiplicateur de frames en temps réel pour correspondre au taux de rafraîchissement de l'écran. En parallèle, GeForce Now supporte désormais jusqu'à 90 FPS sur les casques VR dont l'Apple Vision Pro et le Meta Quest (contre 60 FPS auparavant), depuis le 19 mars. DLSS 5, lui, va plus loin : entraîné pour comprendre la « sémantique complexe de scènes », personnages, cheveux, peau, conditions d'éclairage, il promet un rendu déterministe et ancré dans l'intention artistique des développeurs, jusqu'à la résolution 4K. NVIDIA insiste sur la compatibilité via le framework NVIDIA Streamline, garantissant une intégration fluide pour les studios. Reste à voir si l'automne 2026 confirmera les promesses, ou si la frontière entre aide à la performance et remplacement du rendu réel sera jugée franchie par la communauté des joueurs.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic