Aller au contenu principal
GTC 2026 : avec le Groq 3 LPX, Nvidia ajoute pour la première fois du matériel d'inférence dédié à sa plateforme
OutilsThe Decoder · 1 min de lecture

GTC 2026 : avec le Groq 3 LPX, Nvidia ajoute pour la première fois du matériel d'inférence dédié à sa plateforme

Source originale ↗·

Nvidia a profité du GTC 2026 pour étendre considérablement sa plateforme Vera Rubin, introduite quelques mois plus tôt au CES, en y intégrant pour la première fois un composant matériel entièrement dédié à l'inférence. Cette annonce marque un tournant stratégique pour le fabricant de semi-conducteurs, qui ne se contente plus de dominer l'entraînement des modèles d'IA, mais cherche désormais à contrôler l'ensemble du cycle de vie de l'intelligence artificielle.

L'ajout du Groq 3 LPX à l'écosystème Vera Rubin illustre la volonté de Nvidia de proposer une plateforme verticalement intégrée, capable de gérer aussi bien l'entraînement que le déploiement des modèles. Dans un marché où l'inférence représente une part croissante des coûts opérationnels pour les entreprises, cette stratégie répond à une demande concrète des opérateurs de datacenters et des fournisseurs de services cloud.

L'offre dévoilée au GTC comprend des racks CPU personnalisés, une nouvelle architecture de stockage, un système d'exploitation dédié à l'inférence ainsi que des logiciels de sécurité pour les agents IA. Nvidia a également annoncé des alliances autour de modèles ouverts, signalant une ouverture vers l'écosystème open source pour renforcer l'adoption de sa plateforme auprès des développeurs.

Ces annonces positionnent Nvidia en concurrent direct des spécialistes de l'inférence comme Groq ou Cerebras, tout en consolidant son emprise sur l'infrastructure IA au sens large. La convergence du matériel, du logiciel système et des partenariats autour des modèles ouverts témoigne d'une ambition de plateforme totale, à l'image de ce qu'Apple a bâti dans le grand public, mais appliqué à l'IA d'entreprise.

Impact France/UE

Les entreprises européennes exploitant des infrastructures Nvidia pour l'inférence IA pourront bénéficier de puces dédiées plus performantes, réduisant potentiellement les coûts et la latence des déploiements de modèles à grande échelle.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Nvidia lance une plateforme d'agents IA pour entreprises avec Adobe, Salesforce et SAP parmi 17 adopteurs à GTC 2026
1VentureBeat AI 

Nvidia lance une plateforme d'agents IA pour entreprises avec Adobe, Salesforce et SAP parmi 17 adopteurs à GTC 2026

Lors de la conférence GTC 2026, Jensen Huang a présenté lundi l'Agent Toolkit de Nvidia, une plateforme open source destinée à la création d'agents d'IA autonomes en entreprise. Dix-sept géants du logiciel ont immédiatement annoncé leur adoption : Adobe, Salesforce, SAP, ServiceNow, Siemens, CrowdStrike, Atlassian, Cadence, Synopsys, IQVIA, Palantir, Box, Cohesity, Dassault Systèmes, Red Hat, Cisco et Amdocs. La plateforme regroupe quatre composants clés : Nemotron, une famille de modèles ouverts optimisés pour le raisonnement agentique ; AI-Q, un blueprint permettant aux agents de percevoir, raisonner et agir sur les données d'entreprise ; OpenShell, un environnement d'exécution open source imposant des garde-fous de sécurité, de réseau et de confidentialité ; et cuOpt, une bibliothèque d'optimisation. Ces agents peuvent traiter des tickets de support client, concevoir des semi-conducteurs, gérer des essais cliniques ou piloter des campagnes marketing, le tout de façon autonome. L'enjeu commercial est considérable. En faisant adopter cette pile logicielle par des entreprises présentes dans pratiquement chaque secteur du Fortune 500, Nvidia ne vend pas directement ses GPU, il conçoit un écosystème logiciel qui les rend indispensables. Le composant AI-Q promet par ailleurs de réduire les coûts de traitement de plus de 50 % en routant les tâches complexes vers des modèles frontier et les tâches de recherche vers les modèles Nemotron moins coûteux. Nvidia revendique également que son agent basé sur AI-Q se classe en tête des benchmarks DeepResearch Bench et DeepResearch Bench II, ce qui, si validé indépendamment, rendrait la plateforme non seulement pratique mais compétitivement incontournable. La confiance des entreprises, obstacle historique au déploiement d'agents autonomes, est adressée via OpenShell, développé en collaboration avec Cisco, CrowdStrike, Google, Microsoft Security et TrendAI. Cette annonce s'inscrit dans une stratégie plus large de Nvidia pour étendre son emprise au-delà du matériel. Jusqu'ici, construire un agent d'IA d'entreprise nécessitait d'assembler des briques disparates, modèle de langage, système de récupération d'information, couche de sécurité, orchestrateur, issues de fournisseurs différents jamais conçus pour fonctionner ensemble. Nvidia résout ce problème de fragmentation en proposant une fondation unifiée, open source dans sa licence mais optimisée pour ses propres puces. La stratégie rappelle celle d'une infrastructure de péage : ouverte à tous, mais dont Nvidia contrôle l'architecture. Alors que les entreprises s'apprêtent à déployer massivement des agents autonomes dans leurs systèmes informatiques, la question n'est plus tant de savoir si elles adopteront ces outils, mais si une alternative crédible à l'écosystème Nvidia pourra émerger avant que la dépendance ne soit totale.

UESAP, Siemens et Dassault Systèmes figurent parmi les 17 premiers adopteurs, exposant les grandes entreprises européennes à une dépendance croissante envers l'écosystème logiciel et matériel de Nvidia pour leurs déploiements d'agents IA.

OutilsOpinion
1 source
Nvidia dévoile un système de puces basé sur Groq pour accélérer les tâches d'IA comme le codage
2The Information AI 

Nvidia dévoile un système de puces basé sur Groq pour accélérer les tâches d'IA comme le codage

Nvidia franchit une étape inédite en intégrant pour la première fois la technologie d'un concurrent dans ses serveurs IA. Le PDG Jensen Huang a annoncé un nouveau système de serveurs basé sur une architecture de puces développée par la startup Groq, dont Nvidia avait acquis la licence l'an dernier. L'objectif : rendre ses infrastructures IA plus performantes en termes de consommation énergétique et de coût, notamment pour des tâches comme le codage assisté par IA. Ce partenariat inattendu illustre un tournant stratégique dans l'industrie des semi-conducteurs. Alors que la demande en inférence IA explose, portée par les agents de code, les assistants et les modèles de raisonnement, l'efficacité énergétique devient un facteur concurrentiel aussi crucial que la puissance brute. Les opérateurs de centres de données cherchent à réduire leur TCO (coût total de possession), et Nvidia répond directement à cette pression. Groq est connue pour son architecture LPU (Language Processing Unit), conçue spécifiquement pour l'inférence rapide à faible latence, là où les GPU traditionnels sont optimisés pour l'entraînement. En licenciant cette technologie dès l'an dernier et en l'intégrant désormais dans ses propres systèmes serveurs, Nvidia reconnaît implicitement que ses GPU seuls ne couvrent pas tous les cas d'usage de manière optimale, une admission rare de la part du leader du marché. Cette annonce positionne Nvidia non plus uniquement comme fabricant de puces, mais comme architecte de systèmes IA hybrides, capable d'assembler les meilleures technologies disponibles. Pour Groq, c'est une validation industrielle majeure qui pourrait accélérer l'adoption de son approche auprès d'autres acteurs du secteur.

OutilsActu
1 source
IBM lance la plateforme IA Bob pour maîtriser les coûts du cycle de développement logiciel
3AI News 

IBM lance la plateforme IA Bob pour maîtriser les coûts du cycle de développement logiciel

IBM a lancé Bob, une plateforme d'intelligence artificielle conçue pour encadrer et rationaliser l'ensemble du cycle de développement logiciel en entreprise. L'annonce a été portée par Dinesh Nirmal, vice-président senior d'IBM Software, qui a résumé l'enjeu : « Chaque entreprise cherche à se moderniser, mais la vitesse sans contrôle est un risque. IBM Bob permet aux entreprises d'avancer à la vitesse de l'IA sans sacrifier la gouvernance et la sécurité. » La plateforme s'intègre directement dans le cycle de vie logiciel complet, avec des modes basés sur des profils utilisateurs, des appels d'outils automatisés et des contrôles humains à chaque étape critique. L'un de ses premiers cas d'usage concrets est APIS IT, une entreprise qui a déployé Bob pour moderniser des systèmes gouvernementaux chargés de décennies de dette technique sur des environnements mainframe et .NET. Résultat : une analyse d'architecture et une documentation produites dix fois plus vite, avec une précision de 100 % sur des systèmes JCL/PL1 vieillissants, et des migrations de services .NET réalisées en quelques heures au lieu de plusieurs semaines. L'enjeu est massif : entre 60 et 80 % du budget d'ingénierie des grandes organisations est absorbé par la maintenance et la mise à niveau de systèmes existants, des projets qui s'étirent souvent sur des mois. Les assistants de code classiques aggravent le problème lorsqu'ils sont utilisés sans garde-fous, car ils génèrent du code syntaxiquement correct mais fonctionnellement inutile, incapable de comprendre les bibliothèques internes ou la logique propriétaire d'une entreprise. Bob répond à ce problème en cartographiant d'abord les dépendances avant toute refactorisation, puis en coordonnant des agents spécialisés pour les tests, la documentation et l'intégration continue. Le système utilise une orchestration multi-modèles dynamique : les tâches simples sont routées vers des modèles légers et économiques, tandis que les raisonnements architecturaux complexes mobilisent des modèles de pointe comme Claude d'Anthropic, Mistral ou IBM Granite. Ce lancement s'inscrit dans une course plus large à l'automatisation du développement logiciel en entreprise, un marché où GitHub Copilot, Google Gemini Code Assist et des dizaines de startups se disputent déjà les contrats. IBM mise sur une différenciation claire : là où ses concurrents proposent des assistants de productivité individuelle, Bob cible la gouvernance à l'échelle de l'organisation, avec une traçabilité des coûts et une transparence sur les dépenses IA directement liées aux résultats en production. La capacité à gérer des environnements mainframe, souvent ignorés par les nouveaux entrants du marché, constitue un avantage stratégique pour IBM auprès de ses clients traditionnels dans la finance, les assurances et le secteur public, des industries où la dette technique se chiffre en milliards et où la compliance réglementaire n'est pas négociable.

UEIBM Bob cible explicitement les secteurs finance, assurance et secteur public, où les DSI françaises et européennes gèrent d'importantes dettes techniques sous contraintes réglementaires strictes.

OutilsOutil
1 source
GTC : ce qu'il faut attendre de la puce Groq de Nvidia
4The Information AI 

GTC : ce qu'il faut attendre de la puce Groq de Nvidia

La conférence annuelle GTC de Nvidia ouvre ses portes ce lundi à San Jose, en Californie, avec en point d'orgue une keynote très attendue du PDG Jensen Huang. L'annonce la plus anticipée : un nouveau système de puces combinant la technologie de Nvidia avec celle de Groq, la société indépendante de semi-conducteurs dont Nvidia a acquis la licence technologique fin 2024. L'enjeu est considérable pour l'industrie. Il s'agit de la première fois que Nvidia intègre le processeur IA d'une autre entreprise directement dans ses racks de serveurs, une rupture nette avec la philosophie maison, qui reposait jusqu'ici quasi exclusivement sur ses propres composants et interconnexions haute vitesse. Le deal sous-jacent à cette intégration a été conclu fin 2024 pour environ 20 milliards de $, faisant de l'accord Nvidia-Groq l'une des transactions les plus significatives du secteur des semi-conducteurs dédiés à l'IA. Les systèmes phares actuels de Nvidia s'appuient entièrement sur leurs propres puces, ce qui rend cette ouverture architecturale d'autant plus remarquable. Cette évolution pourrait signaler un tournant stratégique pour Nvidia : plutôt que de tout concevoir en interne, le géant des GPU semble prêt à orchestrer un écosystème de partenaires matériels. La keynote de Jensen Huang demain matin sera scrutée de près pour les détails techniques et les implications commerciales de cette nouvelle architecture hybride.

OutilsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic