Aller au contenu principal
Infrastructure · Actu ·

Microsoft prépare Maia 300 : la puce IA conçue pour tuer Nvidia

Microsoft prépare Maia 300, la troisième génération de ses puces d'intelligence artificielle maison, avec une présentation envisagée dès septembre 2026 selon des informations de The Information relayées par Reuters. Le groupe n'a pas confirmé officiellement ce calendrier. Cette nouvelle puce succéderait à Maia 200, dévoilée en janvier 2026, fabriquée par TSMC en gravure 3 nm et conçue pour l'inférence, la phase où un modèle déjà entraîné répond aux requêtes des utilisateurs. Maia 200 embarque plus de 140 milliards de transistors, 216 Go de mémoire HBM3e offrant 7 To/s de bande passante et 272 Mo de SRAM sur puce, pour plus de 10 pétaFLOPS en FP4 et plus de 5 pétaFLOPS en FP8, avec un gain revendiqué d'environ 30% de performances par dollar par rapport aux systèmes précédemment utilisés par Microsoft. Pour Maia 300, Microsoft discuterait avec TSMC afin de réserver une capacité de production supérieure à 300 000 puces pour des livraisons en 2027, avec l'ambition affichée de dépasser à terme le million d'unités.

2 min de lecturePertinence 42

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de Le Big Data. Lire l'article original →

Ces volumes marquent un changement d'échelle pour Microsoft, qui ne cherche plus seulement à démontrer sa capacité à concevoir du silicium mais à faire de Maia un pilier structurant de l'infrastructure Azure. L'enjeu central est la réduction de la dépendance aux GPU Nvidia, dont les prix élevés et les contraintes d'approvisionnement pèsent lourdement sur les coûts des géants du cloud qui déploient l'IA à grande échelle. Un accélérateur maison, produit en volume, permettrait à Microsoft de mieux maîtriser ses coûts d'inférence et de négocier en position de force avec ses fournisseurs. Pour les clients d'Azure, cela pourrait à terme se traduire par des offres de calcul IA plus compétitives, tout en renforçant le poids de Microsoft face à Nvidia dans les rapports de force de l'industrie des semi-conducteurs.

Cette stratégie s'inscrit dans une course plus large où chaque grand acteur du cloud cherche à internaliser la conception de ses puces IA. Google dispose depuis plusieurs générations de ses TPU, Amazon développe ses accélérateurs Trainium, et Meta travaille sur ses propres composants avec des projets comme Meta Iris. Microsoft, Meta, Google et Amazon investissent ainsi massivement dans le silicium propriétaire, une tendance qui alimente aussi les interrogations sur une possible bulle des investissements liés à l'intelligence artificielle. La réussite du pari Maia 300 dépendra largement de la disponibilité des composants et des capacités de production que TSMC pourra effectivement allouer à Microsoft, dans un contexte où la demande mondiale de puces IA reste extrêmement tendue.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE, mais les clients européens d'Azure pourraient a terme bénéficier de couts de calcul IA plus compétitifs si Microsoft réduit sa dépendance a Nvidia.

À lire ensuite

01Meta Iris : la puce IA de Meta pour rivaliser avec Nvidia41Le Big DataInfrastructure 02Nvidia perd du terrain sur les puces IA : Microsoft se tourne vers AMD, et Anthropic pourrait suivre45The DecoderInfrastructure 03Anthropic en négociations pour utiliser les puces IA de Microsoft43The Information AIInfrastructure 
Dossier · MicrosoftSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.