Aller au contenu principal
Microsoft montre des premiers résultats avec ses puces IA maison, après un démarrage lent
InfrastructureThe Information AI · 1 min de lecture

Microsoft montre des premiers résultats avec ses puces IA maison, après un démarrage lent

Source originale ↗·

Microsoft prévoit d'augmenter significativement en 2027 la production de sa nouvelle puce d'intelligence artificielle Maia 300, selon deux sources proches du dossier. L'entreprise a engagé des discussions avec le fabricant taïwanais TSMC pour sécuriser une capacité de fabrication portant sur plus de 300 000 puces, un volume dix fois supérieur aux dizaines de milliers d'exemplaires produits jusqu'ici pour la génération précédente, la Maia 200. Microsoft compte dévoiler publiquement la Maia 300 cet automne, potentiellement dès le mois prochain. L'objectif affiché est de convaincre de grands clients du cloud, comme Anthropic, d'adopter ces puces maison malgré l'adoption limitée de la Maia 200 jusqu'à présent.

Cette montée en puissance illustre la volonté de Microsoft de réduire sa dépendance aux puces Nvidia, qui dominent encore largement l'entraînement et l'exécution des modèles d'IA dans ses centres de données Azure. Si l'entreprise parvient à faire adopter ses propres processeurs par des clients externes majeurs comme Anthropic, elle réaliserait des économies substantielles sur les coûts d'infrastructure tout en gagnant en indépendance stratégique face aux fournisseurs de semi-conducteurs. Pour l'industrie du cloud dans son ensemble, cela renforcerait une tendance déjà engagée par Google et Amazon, qui développent également leurs propres puces IA pour limiter leur exposition à la pénurie et aux prix élevés pratiqués par Nvidia.

Ce pari s'inscrit dans une course plus large entre géants technologiques pour maîtriser toute la chaîne de valeur de l'IA, du silicium aux modèles. Microsoft investit massivement dans Anthropic, ce qui rend d'autant plus stratégique la capacité à convaincre cette dernière d'utiliser ses puces plutôt que celles de Nvidia. Le recours à TSMC pour la fabrication souligne aussi la centralité persistante du fondeur taïwanais dans l'écosystème mondial des semi-conducteurs avancés, malgré les tensions géopolitiques entourant Taïwan. La réussite de ce plan dépendra largement des performances réelles de la Maia 300 face aux puces Nvidia et de la capacité de Microsoft à tenir ses délais de livraison pour 2027.

Impact France/UE

Une concurrence accrue sur les puces IA pourrait a terme influencer les couts du cloud pour les entreprises europeennes, mais sans impact direct immediat sur la France ou l'UE.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

La puce quantique Majorana 2 de Microsoft illustre le rôle des agents IA dans la R&D
1AI News 

La puce quantique Majorana 2 de Microsoft illustre le rôle des agents IA dans la R&D

Microsoft a dévoilé cette semaine le processeur quantique Majorana 2, accompagné de chiffres qui redéfinissent les standards du secteur : des qubits mille fois plus fiables que ceux de la première génération, une durée de vie moyenne de 20 secondes contre quelques microsecondes pour les puces concurrentes, et un objectif de calculateur quantique commercialement utilisable d'ici 2029. Le changement clé à l'origine de ce bond : le remplacement du matériau supraconducteur, passant de l'aluminium au plomb, une décision issue d'années de recherche conventionnelle en science des matériaux. En parallèle, Microsoft a annoncé la disponibilité générale de Microsoft Discovery, sa plateforme d'IA agentique dédiée à la R&D scientifique, dont le développement de Majorana 2 constitue la première démonstration publique d'efficacité. Ce qui rend cette annonce structurellement importante, ce n'est pas que l'IA ait conçu la puce, mais ce qu'elle a rendu possible autour de la recherche humaine. Microsoft Discovery n'a pas choisi le plomb comme matériau, mais ses agents ont pris en charge la gestion des flux de fabrication, l'automatisation de mesures qui prenaient auparavant plusieurs semaines chacune, et surtout la synthèse de près de vingt ans de données de recherche cloisonnées. Zulfi Alam, vice-président corporate de Microsoft pour le quantum, résume : "Les agents IA peuvent recréer des corrélations que nous, en tant qu'humains, ne pouvons pas voir, parce qu'aucun individu n'a cette vision sur autant de données." Concrètement, la détection des états quantiques sur des fils semi-conducteurs, un processus manuel qui s'étalait sur des semaines, est désormais automatisée en continu par un agent spécialisé capable d'ajuster simultanément des centaines de paramètres de tension, là où un chercheur raisonne nécessairement de façon linéaire. La course à l'informatique quantique fiable oppose depuis des années Microsoft, Google, IBM et quelques startups comme IonQ ou PsiQuantum, chacun misant sur des architectures radicalement différentes. Microsoft a longtemps été en retrait sur les résultats concrets, pariant sur les qubits topologiques basés sur les fermions de Majorana, une approche théoriquement plus robuste mais expérimentalement très difficile à réaliser. Majorana 2 marque un tournant crédible dans cette stratégie. Mais l'enjeu dépasse le quantum : avec la mise en disponibilité générale de Microsoft Discovery pour les entreprises, incluant des agents spécialisés, un moteur de raisonnement et une gouvernance de niveau entreprise, Microsoft positionne l'IA agentique comme infrastructure centrale de la R&D industrielle. Si la preuve par la puce quantique tient ses promesses, d'autres secteurs, pharmaceutique, matériaux, énergie, pourraient rapidement adopter ce modèle où l'IA compresse les cycles expérimentaux et libère les chercheurs des tâches de mesure et de synthèse de données.

UELes entreprises européennes des secteurs pharmaceutique, des matériaux et de l'énergie peuvent désormais accéder à Microsoft Discovery en disponibilité générale pour accélérer leurs cycles de R&D.

💬 Ce qui m'intéresse dans cette annonce, c'est pas la puce, c'est ce que Discovery a rendu possible autour : 20 ans de données de recherche cloisonnées synthétisées, des mesures qui prenaient des semaines automatisées en continu par des agents. L'IA n'a pas choisi le plomb comme matériau, c'est des années de science des matériaux classique qui ont mené là. Reste à voir si ça tient hors labo, mais le pharma et l'énergie ont de bonnes raisons de regarder ça de très près.

InfrastructureOpinion
1 source
Nvidia perd du terrain sur les puces IA : Microsoft se tourne vers AMD, et Anthropic pourrait suivre
2The Decoder 

Nvidia perd du terrain sur les puces IA : Microsoft se tourne vers AMD, et Anthropic pourrait suivre

Microsoft élargit l'infrastructure IA d'Azure en intégrant Helios, la nouvelle plateforme d'AMD, qui doit concurrencer directement les systèmes GPU de Nvidia à partir du second semestre 2026. Cette annonce marque un tournant dans la stratégie d'approvisionnement en puces du géant du cloud, jusqu'ici très dépendant de Nvidia pour ses charges de travail liées à l'intelligence artificielle. Un profil GitHub public suggère par ailleurs qu'Anthropic teste également du matériel AMD, ce qui indique que l'entreprise pourrait suivre le mouvement amorcé par Microsoft et diversifier ses propres fournisseurs de calcul. Cette évolution représente une pression supplémentaire sur le pouvoir de fixation des prix de Nvidia, qui domine largement le marché des puces dédiées à l'entraînement et à l'inférence des modèles d'IA. Pour les grands fournisseurs de cloud et les laboratoires d'IA, disposer d'une alternative crédible comme AMD permet de négocier de meilleurs tarifs et de réduire la dépendance à un fournisseur unique, un enjeu stratégique majeur compte tenu des sommes colossales investies dans les infrastructures de calcul. Pour les utilisateurs finaux, une concurrence accrue pourrait à terme se traduire par une baisse des coûts d'accès aux services d'IA hébergés sur le cloud. Ce mouvement s'inscrit dans un contexte plus large où les grands acteurs technologiques cherchent à diversifier leurs sources d'approvisionnement en puces, face à la demande explosive de capacité de calcul pour l'IA générative et aux tensions sur les chaînes d'approvisionnement. Nvidia reste pour l'instant le leader incontesté du marché, mais l'arrivée de plateformes concurrentes crédibles comme Helios d'AMD, combinée à l'intérêt manifesté par des clients de poids comme Microsoft et potentiellement Anthropic, pourrait redessiner les rapports de force dans les prochaines années et inciter d'autres acteurs à suivre cette diversification.

InfrastructureActu
1 source
Anthropic en négociations pour utiliser les puces IA de Microsoft
3The Information AI 

Anthropic en négociations pour utiliser les puces IA de Microsoft

Anthropic serait en discussions avec Microsoft pour louer des serveurs équipés de puces d'intelligence artificielle conçues en interne par le géant de Redmond. Selon deux personnes ayant eu des échanges directs avec des dirigeants impliqués dans les négociations, la startup fondatrice de Claude cherche à augmenter sa capacité de calcul pour répondre à une demande croissante pour ses modèles d'IA. Aucun accord n'a encore été officialisé, mais les tractations sont en cours. Pour Microsoft, convaincre Anthropic d'adopter ses propres puces constituerait une victoire symbolique et commerciale majeure. L'effort de design de puces maison de l'entreprise a accusé des retards en 2024, compliquant sa stratégie d'indépendance vis-à-vis des fournisseurs externes. Séduire un acteur aussi visible qu'Anthropic permettrait à Microsoft de valider publiquement ses capacités matérielles et de diversifier les revenus issus de son infrastructure cloud Azure. La démarche s'inscrit dans une tendance de fond : les grands fournisseurs de cloud cherchent à réduire leur dépendance aux puces Nvidia, qui dominent aujourd'hui presque l'intégralité du marché des accélérateurs IA et dont la disponibilité reste contrainte. Google dispose déjà de ses TPU, Amazon de ses puces Trainium et Inferentia. Microsoft, en retard sur ce front, tente de combler l'écart. Anthropic, de son côté, bénéficie déjà d'investissements massifs d'Amazon et de Google, ce qui rend un partenariat avec Microsoft d'autant plus significatif sur le plan stratégique.

InfrastructureActu
1 source
OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles
4VentureBeat AI 

OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles

OpenAI et Broadcom ont dévoilé ce matin leur premier processeur d'inférence IA sur mesure, baptisé "Jalapeño". Contrairement aux GPU grand public d'Nvidia ou AMD, ce circuit intégré à application spécifique (ASIC) est conçu exclusivement pour faire tourner des grands modèles de langage en production, notamment derrière ChatGPT, Codex et l'API OpenAI. Ce qui frappe d'emblée, c'est la vitesse de développement : de la conception initiale à la fabrication, seulement neuf mois se sont écoulés, là où un cycle habituel de développement de processeur se compte en années. Le partenariat entre OpenAI et Broadcom n'avait d'ailleurs été annoncé publiquement qu'en octobre 2025. Greg Brockman, président et cofondateur d'OpenAI, ainsi que Hock Tan, PDG de Broadcom, ont présenté la puce ce matin sur CNBC. Brockman a précisé que le processus de conception a lui-même été accéléré grâce aux propres modèles d'OpenAI, des versions antérieures au GPT-5.5. OpenAI indique avoir déjà testé GPT-5.3-Codex-Spark sur ces puces dans un environnement de production simulé, et prévoit de déployer Jalapeño dans ses centres de données actifs d'ici fin 2026. Les performances initiales sont décrites comme "remarquables", Brockman écrivant sur X que le ratio performance par watt est "incroyable". L'enjeu dépasse largement la performance technique : il s'agit de survie économique. Des documents financiers audités récemment révélés montrent qu'OpenAI a généré 13,07 milliards de dollars de revenus en 2025, mais a engagé 34 milliards de dépenses opérationnelles, accusant une perte d'exploitation de près de 20,92 milliards de dollars. La principale cause : le coût titanesque de la puissance de calcul, essentiellement louée auprès de Microsoft Azure sur des GPU Nvidia. Concevoir ses propres puces optimisées pour l'inférence LLM permettrait à OpenAI de drastiquement réduire ce coût marginal par requête et d'atteindre enfin une rentabilité opérationnelle. Broadcom apporte la conception silicium et son réseau Tomahawk, tandis que Celestica gère l'intégration au niveau carte, rack et système. Cette annonce s'inscrit dans une stratégie plus large de verticalisation de la filière IA, un mouvement déjà emprunté par Google avec ses TPU et Amazon avec ses puces Trainium et Inferentia. OpenAI, longtemps dépendant des infrastructures de ses partenaires et investisseurs, cherche à contrôler toute sa pile technologique. Fait notable : les deux entreprises positionnent explicitement Jalapeño comme une puce "construite de zéro pour les LLMs actuels et futurs de toute l'industrie", ouvrant la voie à une commercialisation auprès d'autres acteurs de l'IA. De nombreuses questions restent ouvertes, notamment les performances comparatives face aux solutions Nvidia, les coûts de fabrication et la viabilité à grande échelle. Mais si le pari réussit, OpenAI ne sera plus seulement un éditeur de modèles : il deviendra un fournisseur d'infrastructure à part entière.

UEUne réduction future des coûts d'inférence pourrait bénéficier indirectement aux entreprises et développeurs européens utilisant l'API OpenAI, sans impact réglementaire ou industriel direct sur la France/UE.

💬 Quand tu perds 21 milliards par an, tu te construis tes propres puces. Ce que Jalapeño change vraiment, c'est pas la performance par watt, c'est qu'OpenAI sort enfin d'une dépendance à Nvidia qui les saignait à blanc requête après requête. Neuf mois de conception accélérée par leurs propres modèles, c'est la vraie rupture.

InfrastructureOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic