Aller au contenu principal
Infrastructure · Actu ·

Microsoft veut faire tourner des IA géantes sur PC : prévoyez jusqu’à 60 Go de RAM

Microsoft prépare l'exécution locale, sur les PC Windows, de modèles d'IA de très grande taille, entre 70 et 284 milliards de paramètres. Trois modèles sont concernés : MAI Code 1.1 Flash, développé par Microsoft, un nouveau modèle de la famille Nemotron de Nvidia, et DeepSeek V4 Flash. Ce dernier, une fois compressé en 1,6 bit par paramètre, tient dans environ 60 Go de mémoire, ce qui fixe un ordre de grandeur de la RAM nécessaire pour les configurations les plus ambitieuses. Microsoft insiste surtout sur une approche d'« intelligence hybride », où le PC s'appuie à la fois sur des modèles locaux et sur ceux du cloud selon les besoins.

2 min de lecturePertinence 58

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de Frandroid. Lire l'article original →

L'enjeu est d'abord matériel. Jusqu'ici, les PC dits « IA » faisaient tourner des modèles de quelques milliards de paramètres, nettement plus modestes. Viser des modèles de plusieurs dizaines ou centaines de milliards de paramètres suppose des machines dotées de 64 Go de mémoire ou plus, ce qui concerne pour l'instant surtout les postes haut de gamme et professionnels. Pour les utilisateurs, l'intérêt est double : une meilleure confidentialité, puisque les données restent sur l'appareil, et la possibilité de travailler sans connexion ou avec une latence réduite. Pour les développeurs, l'exécution locale d'un modèle de code comme MAI Code 1.1 Flash ouvre la voie à des assistants plus réactifs et moins coûteux à exploiter.

Cette stratégie s'inscrit dans la course à l'IA embarquée que se livrent Microsoft, Nvidia, Apple et les fabricants de puces, après des années de promesses autour des PC dotés d'unités de calcul neuronal. La compression extrême des modèles, ici en 1,6 bit, est devenue un levier central pour rapprocher des modèles géants des machines grand public, au prix d'une possible perte de qualité. Le choix de mêler un modèle maison, un modèle de Nvidia et un modèle du laboratoire chinois DeepSeek montre aussi que Microsoft cherche à ne pas dépendre d'un seul fournisseur. Reste à voir quels PC pourront réellement absorber ces exigences mémoire, et à quel prix.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01AMD : ce mini PC fait tourner des IA géantes… sans cloud ni abonnement49Le Big DataInfrastructure 02Microsoft lance le Surface RTX Spark Dev Box pour faire tourner de grands modèles IA sans recourir au cloud45VentureBeat AIInfrastructure 03☕️ Microsoft se tournerait vers AWS pour absorber l’explosion des usages IA sur GitHub42Next INpactInfrastructure 
Dossier · MicrosoftSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.