Aller au contenu principal
Meta Iris : la puce IA de Meta pour rivaliser avec Nvidia
InfrastructureLe Big Data · 2 min de lecture

Meta Iris : la puce IA de Meta pour rivaliser avec Nvidia

Source originale ↗·

Meta a dévoilé Iris, une nouvelle puce d'intelligence artificielle destinée à équiper ses centres de données, avec une production industrielle prévue dès septembre 2026. Ce composant constitue la quatrième génération du programme Meta Training and Inference Accelerator (MTIA), lancé par le groupe de Mark Zuckerberg pour développer sa propre famille de processeurs spécialisés. Iris repose sur une architecture en chiplets, qui assemble plusieurs blocs spécialisés au sein d'un même circuit plutôt qu'un design monolithique classique, ce qui facilite les évolutions futures de l'architecture. Sa conception associe plusieurs poids lourds des semi-conducteurs : Broadcom pour l'architecture, TSMC pour la gravure des circuits, et Samsung pour les technologies mémoire. La puce cible en priorité les charges de travail internes de Meta, à savoir les systèmes de recommandation, la personnalisation des contenus diffusés sur Facebook, Instagram et WhatsApp, ainsi que l'exécution des modèles d'IA générative.

L'enjeu dépasse la seule performance technique. En développant son propre silicium, Meta cherche avant tout à réduire sa dépendance aux GPU de Nvidia, dont les coûts d'achat restent très élevés et dont la disponibilité reste contrainte par une demande mondiale qui dépasse largement l'offre. Une puce taillée sur mesure permet à Meta d'optimiser spécifiquement les tâches d'inférence, c'est-à-dire l'exécution de modèles déjà entraînés, une phase qui consomme une part croissante des ressources de calcul à mesure que les services d'IA générative se déploient à grande échelle sur les applications du groupe. Pour les utilisateurs de Facebook, Instagram et WhatsApp, cela devrait se traduire à terme par des fonctionnalités d'IA plus rapides et moins coûteuses à exploiter, sans dégradation de la qualité de service liée à des pénuries de composants sur le marché mondial.

Cette stratégie s'inscrit dans un mouvement plus large de l'industrie technologique vers l'intégration verticale du matériel et des modèles d'intelligence artificielle. Google a déjà emprunté cette voie avec ses puces TPU, développées en interne pour ses propres besoins de calcul, et Meta se rapproche désormais de cette logique. Longtemps entièrement dépendant des GPU Nvidia pour entraîner et faire tourner ses grands modèles de langage et ses systèmes de recommandation, le groupe formalise avec Iris un virage engagé depuis plusieurs générations de son programme MTIA. En se donnant les moyens de maîtriser à la fois les modèles et les composants qui les font fonctionner, Meta cherche à sécuriser sa capacité de calcul face à une demande mondiale de puces IA qui continue de dépasser l'offre, à l'heure où la course à l'infrastructure oppose les géants technologiques autant sur le terrain du matériel que sur celui des algorithmes.

Impact France/UE

Une moindre dépendance de Meta aux GPU Nvidia pourrait légèrement détendre l'offre mondiale de puces IA, ce qui profiterait indirectement aux acteurs du cloud et de l'IA en France et en UE.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

NVIDIA et la Corée du Sud s'associent pour construire l'avenir de l'IA
1NVIDIA AI Blog 

NVIDIA et la Corée du Sud s'associent pour construire l'avenir de l'IA

Jensen Huang, fondateur et PDG de Nvidia, a atterri à Séoul vendredi 4 juin, accueilli par des fans et des journalistes dès sa descente d'avion. Ce déplacement fait suite à la conférence GTC Taipei organisée lors du COMPUTEX, et s'inscrit dans une tournée asiatique chargée. Huang a tenu à préciser l'enjeu central de sa visite : aligner la chaîne d'approvisionnement en IA avant une deuxième partie d'année qui s'annonce intense. Il a confirmé que Grace Blackwell, la plateforme phare de Nvidia, affiche de solides performances commerciales, et que Vera Rubin, la génération suivante, est désormais en pleine production industrielle. "Le premier semestre a déjà été très réussi, et nous allons être très occupés au second semestre", a-t-il déclaré à la presse. La Corée du Sud n'est pas un simple arrêt diplomatique dans l'agenda de Huang : c'est l'un des maillons stratégiques de l'écosystème mondial de l'IA. Le pays abrite des acteurs critiques de la fabrication de mémoires, une communauté gaming parmi les plus actives au monde, et un tissu industriel en robotique en pleine montée en puissance. Huang a explicitement identifié la robotique et l'IA physique comme "le prochain grand secteur" pour la Corée, appelant à des investissements ciblés dans ce domaine. Ce positionnement n'est pas anodin : la robotique incarnée, qui nécessite des puces, des capteurs et des modèles d'inférence rapide, est précisément le terrain où Nvidia cherche à imposer ses architectures comme standard de fait. La visite de Huang à Séoul s'inscrit dans une dynamique plus large de consolidation des alliances industrielles face à la pression géopolitique sur les semi-conducteurs. Alors que les restrictions américaines sur les exportations de puces vers certains marchés asiatiques compliquent le paysage, la Corée du Sud reste un partenaire de premier plan, à la fois client et fournisseur clé via Samsung et SK Hynix. Le programme de la visite inclut des rencontres avec des partenaires locaux dans la mémoire, la robotique et le gaming, avant que Huang ne passe à la table pour du poulet frit et du barbecue coréen, qu'il a jugés, sobrement, "délicieux".

UELes entreprises européennes dépendantes des puces NVIDIA et de la mémoire coréenne (Samsung, SK Hynix) pourraient bénéficier indirectement d'une chaîne d'approvisionnement renforcée, mais l'impact direct sur la France ou l'UE reste limité.

InfrastructureOpinion
1 source
Anthropic explorerait la fabrication de puces sur mesure avec Samsung, tout en maintenant l'importance de Nvidia
2The Decoder 

Anthropic explorerait la fabrication de puces sur mesure avec Samsung, tout en maintenant l'importance de Nvidia

Anthropic, la startup d'intelligence artificielle fondée par d'anciens ingénieurs d'OpenAI, serait engagée dans des discussions avec le géant sud-coréen Samsung Electronics en vue de la fabrication d'une puce IA sur mesure. Le projet en serait encore à un stade précoce, mais l'entreprise a déjà recruté des ingénieurs spécialisés dans la conception de semi-conducteurs pour le piloter. Cette démarche intervient peu après l'annonce par OpenAI de son propre projet de puce interne, baptisée "Jalapeño", confirmant une tendance de fond chez les grands acteurs de l'IA générative : développer leurs propres composants plutôt que de dépendre exclusivement des fournisseurs traditionnels. Malgré cette diversification vers le silicium propriétaire, Anthropic aurait tenu à préciser que Nvidia demeure un partenaire essentiel et que ses puces continueront de jouer un rôle central dans son infrastructure. Cette initiative illustre la pression croissante que subissent les entreprises d'IA face à l'explosion des coûts d'entraînement et d'exécution de leurs modèles. En s'associant à Samsung, l'un des rares fondeurs capables de produire des puces avancées à grande échelle, Anthropic chercherait à réduire sa dépendance aux GPU Nvidia, dont la demande mondiale dépasse largement l'offre et dont les prix restent élevés. Pour l'industrie, ce mouvement confirme que même les entreprises les mieux financées jugent nécessaire de maîtriser une partie de leur chaîne d'approvisionnement en calcul, un enjeu à la fois stratégique et économique. À terme, des puces sur mesure pourraient permettre à Anthropic d'optimiser ses coûts d'inférence tout en gagnant en indépendance vis-à-vis des cycles de production de Nvidia. Ce virage s'inscrit dans une dynamique plus large où plusieurs géants de la tech, dont Google avec ses puces TPU et Amazon avec ses processeurs Trainium, ont déjà investi massivement dans le silicium propriétaire pour l'IA. OpenAI a ouvert la voie avec Jalapeño, et Anthropic semble vouloir lui emboîter le pas, signe que la course à l'infrastructure devient un facteur de différenciation aussi important que la qualité des modèles eux-mêmes. Le choix de Samsung comme partenaire pourrait aussi refléter une volonté de diversifier les fournisseurs face à la position dominante de TSMC dans la fonderie avancée. Reste à savoir si ce projet aboutira à une puce déployée à grande échelle, et selon quel calendrier, dans un secteur où la demande en puissance de calcul continue de croître à un rythme vertigineux.

InfrastructureActu
1 source
Meta a racheté Rivos pour accélérer ses puces IA, sans succès pour l'instant
3The Information AI 

Meta a racheté Rivos pour accélérer ses puces IA, sans succès pour l'instant

Meta a acquis le fabricant de puces Rivos en 2025 pour accélérer le développement de ses propres processeurs et réduire sa dépendance à Nvidia, dont les GPU dominent l'infrastructure IA du groupe. Six mois après la clôture du rachat, l'intégration est en difficulté : selon onze employés actuels et anciens de l'équipe, la division puces est paralysée par des mois d'incertitude stratégique, des changements de priorités au sommet de la hiérarchie, et des tensions persistantes entre les ingénieurs de Rivos et les équipes historiques de Meta. L'échec à capitaliser sur cette acquisition illustre un problème plus profond pour Meta : concevoir ses propres puces ne se limite pas à racheter un talent ou une technologie. Cela exige une vision stable, une organisation cohérente et une chaîne de décision claire. Sans cela, même les meilleures équipes d'ingénierie stagnent. Pour Meta, réussir dans les semi-conducteurs est pourtant stratégique : chaque dollar investi dans des puces maison est un dollar retiré à Nvidia, dont la dépendance pèse lourd à l'heure où le groupe investit massivement dans ses data centers. La course aux puces IA internes est devenue un enjeu central pour les géants technologiques. Google dispose de ses TPU depuis des années, Apple maîtrise ses SoC, et Amazon a ses Trainium et Inferentia. Meta, en retard, a choisi l'acquisition comme raccourci vers la maturité technologique. L'affaire Rivos montre que cette stratégie ne suffit pas sans une culture d'intégration solide et une direction stable. Les prochains mois seront déterminants pour savoir si Meta peut transformer cet investissement en avantage compétitif réel.

InfrastructureActu
1 source
Bristol Myers Squibb achète un système IA Nvidia pour la découverte de médicaments
4AI News 

Bristol Myers Squibb achète un système IA Nvidia pour la découverte de médicaments

Bristol Myers Squibb va acquérir un supercalculateur Nvidia DGX SuperPOD reposant sur l'architecture Vera Rubin, tout juste dévoilée cette année par Nvidia comme la relève de sa génération actuelle de systèmes d'intelligence artificielle. Le laboratoire pharmaceutique affirme être la première entreprise du secteur des sciences de la vie à s'équiper d'un DGX SuperPOD basé sur cette architecture. Le nouveau cluster comprendra huit systèmes DGX Vera Rubin NVL72, chacun combinant les processeurs Vera et les puces graphiques Rubin de Nvidia à l'échelle d'un rack complet. Le montant de la transaction n'a pas été communiqué. Cette acquisition vient compléter l'infrastructure Nvidia déjà utilisée par BMS, qui exploite depuis environ trois ans un SuperPOD antérieur, aujourd'hui jugé deux à trois générations en retard par les dirigeants de l'entreprise. Les deux systèmes seront réunis au sein d'un environnement de calcul partagé, accessible depuis l'ensemble des sites de recherche du groupe dans le monde, avec une pile logicielle capable de répartir automatiquement les charges d'entraînement, de prédiction et de développement. Cette montée en puissance répond à une saturation de l'infrastructure actuelle. Erin Davis, vice-présidente en charge des technologies et des données de recherche chez BMS, explique que la demande croissante provient des prédictions à grande échelle sur les grosses molécules ainsi que du développement de modèles de fondation internes. Selon Greg Meyers, directeur digital et technologique de BMS, les besoins en puissance de calcul ont explosé à mesure que l'entreprise déploie des modèles d'IA toujours plus volumineux dans ses équipes de recherche. Concrètement, l'IA intervient désormais dans la conception de tous les programmes portant sur de petites molécules et de la majorité de ceux portant sur de grosses molécules, notamment pour l'identification de cibles thérapeutiques, l'optimisation de candidats médicaments et les prédictions moléculaires. BMS indique que l'identification de cibles assistée par IA a permis de réduire de plusieurs semaines certaines tâches de recherche manuelles. Surtout, l'accès à cette puissance de calcul sera désormais ouvert à l'ensemble de l'organisation de recherche, sans les délais d'attente ni les restrictions d'accès qui limitaient jusqu'ici l'usage aux seuls chercheurs spécialisés en calcul. Robert Plenge, directeur de la recherche chez BMS, illustre l'ampleur du changement attendu : là où l'entreprise pouvait auparavant évaluer une dizaine de candidats médicaments lors des premières étapes de développement, elle pourra désormais en tester des dizaines. Cette capacité s'appuie sur une méthode maison baptisée "Predict First", qui utilise des prédictions générées par des modèles pour écarter en amont les molécules ne répondant pas aux critères requis, avant même leur synthèse en laboratoire. Payal Sheth, vice-présidente senior chargée des sciences de découverte thérapeutique, précise que ces prédictions permettent de prioriser la synthèse des molécules présentant la combinaison de propriétés recherchée, afin de concentrer les expérimentations coûteuses sur les candidats ayant la plus forte probabilité de succès. BMS a également utilisé l'IA pour étoffer sa bibliothèque de composés CELMoD, conçus pour dégrader sélectivement les protéines impliquées dans le développement de cancers.

InfrastructureActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic