Microsoft lance ses propres modèles IA, promettant jusqu'à 89% de réduction des coûts par rapport à OpenAI
Microsoft AI a dévoilé mercredi deux nouveaux modèles maison en préversion publique, MAI-Image-2.5-Pro et MAI-Voice-2-Flash, tout en publiant des données de production destinées à démontrer que le groupe peut désormais faire tourner ses produits sans dépendre des modèles phares d'OpenAI. L'annonce, portée par l'équipe Superintelligence de Microsoft AI, intervient environ un an après l'engagement de l'entreprise à développer ses propres modèles spécialisés. Ces deux nouveautés équipent déjà Bing, PowerPoint, OneDrive, Dynamics 365, Excel, GitHub Copilot et Azure. MAI-Image-2.5-Pro vise le haut de gamme, avec des images de qualité soignée, des capacités d'édition détaillées et un rendu précis du texte intégré aux images, un point faible traditionnel des générateurs. Il est facturé 5 dollars par million de tokens de texte en entrée, 8 dollars par million de tokens d'image en entrée et 106 dollars par million de tokens d'image en sortie. Le modèle de base MAI-Image-2.5 s'est récemment classé deuxième en édition d'image sur Arena, le classement communautaire de référence. MAI-Voice-2-Flash, présenté d'abord lors de la conférence Build, tourne deux fois plus vite que MAI-Voice-2 pour un coût inférieur de 32%, à 15 dollars par million de caractères, et cible les centres d'appels et agents vocaux à fort volume.
Ces lancements s'accompagnent surtout de chiffres de déploiement qui pèsent lourd pour les clients entreprise. Bing Image Creator fonctionne désormais entièrement sur MAI-Image-2.5. Dans PowerPoint, Microsoft affirme réduire les coûts GPU jusqu'à 84% par rapport à GPT-Image-2 d'OpenAI. Dans OneDrive, où MAI-Image-2.5 est devenu le modèle par défaut pour l'édition d'images, l'entreprise rapporte une hausse de 26% du taux de sauvegarde, une latence P95 réduite d'environ 25% et une efficacité 2,5 fois supérieure en charge moyenne. Côté voix, MAI-Voice-2-Flash équipe Dynamics 365 Contact Center, utilisé par des clients comme T-Mobile et EasyJet, avec des réductions de coûts GPU annoncées jusqu'à 89%. Rob Reilly, directeur créatif mondial de WPP, a qualifié le modèle Pro d'avancée majeure pour les outils de création de contenu généré par IA. Pour les entreprises clientes, le message est clair: des performances comparables à moindre coût et une dépendance réduite à un fournisseur externe unique.
Cette stratégie s'inscrit dans une bascule engagée depuis un an, quand Microsoft a décidé de construire des familles de modèles adaptés à des usages précis plutôt qu'un modèle unique polyvalent, jugeant qu'un studio créatif cherchant une fidélité maximale n'a pas les mêmes besoins qu'un centre d'appels traitant des millions de communications quotidiennes. La démarche s'inscrit dans un contexte de tensions croissantes entre Microsoft et OpenAI, partenaire historique mais aussi concurrent de plus en plus direct depuis que Microsoft investit massivement dans ses propres capacités d'inférence. Le groupe cite également des déploiements dans le secteur de la santé, signe d'une extension prévue au-delà des usages bureautiques. Reste à savoir si la qualité de ces modèles maison tiendra la comparaison sur la durée face aux modèles frontière d'OpenAI, Google ou Anthropic, et si cette stratégie d'indépendance technologique se traduira par une réduction tangible des prix pour les clients finaux.
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



