Aller au contenu principal

Azure· sujet

195 articlesmis à jour le 20 juillet 2026

Suivi des annonces IA d'Azure : services cloud, intégration des modèles OpenAI, outils pour développeurs et déploiements en entreprise.

Hub d'actualité sur Azure, agrégé en continu depuis 72 sources éditoriales. Pour les analyses long-form, voir /analyses.

Le pouls du sujet · 30 derniers jours

données Le Fil IA
26 62%
articles (vs 30j préc.)
3.1%
de la couverture IA
Souvent associé à

Mesuré sur notre corpus de 50+ sources, fenêtre glissante de 30 jours. Part de voix = part des articles IA de la période mentionnant Azure. Voir le Baromètre IA complet

À retenir · 30 derniers jours

Azure, c'est l'infrastructure cloud de Microsoft, et l'un des endroits où une grande partie de l'IA mondiale tourne concrètement. Quand une entreprise « utilise l'IA », il y a de fortes chances qu'un modèle s'exécute sur les serveurs Azure, que ce soit pour entraîner un système ou pour le faire répondre à des millions de requêtes. C'est cette plomberie, peu visible mais décisive, qui fait d'Azure une pièce centrale du secteur.

Sa position durable tient à trois choses. Microsoft y vend la puissance de calcul, les modèles prêts à l'emploi (les siens, ceux d'OpenAI, et d'autres), et les outils pour brancher tout ça sur les logiciels que les entreprises utilisent déjà, à commencer par Office et Windows. Cette intégration profonde dans le monde professionnel est son principal atout face à Google et Amazon. En face, sa dépendance historique à OpenAI évolue : Microsoft développe ses propres modèles et muscle son autonomie.

Pour un usage pro, l'enjeu est concret : choisir Azure, c'est arbitrer entre commodité, coût, souveraineté des données et risque de dépendance à un seul fournisseur.

Dans ce hub, on suit l'évolution de l'offre IA d'Azure, ses rapports de force avec ses partenaires et concurrents, et ce que cela change pour les organisations qui s'appuient dessus.

Analyses long-form sur Azure

Quand un sujet mérite un format long, c'est ici.

Toute l'actualité Azure

Flux automatique. Articles classés par pertinence, agrégés en continu.

1Next INpact BusinessActu

AMD s’engage à investir 5 milliards de dollars dans Anthropic via un nouvel accord croisé

AMD s'engage à investir jusqu'à 5 milliards de dollars dans Anthropic, l'éditeur des modèles Claude, dans le cadre d'un accord croisé annoncé cette semaine. En contrepartie, Anthropic promet de déployer l'équivalent de 2 gigawatts de puces AMD au sein de ses infrastructures de calcul, avec un premier gigawatt attendu au premier semestre 2027. Ces déploiements reposeront sur Helios, la nouvelle gamme de racks dédiés à l'IA d'AMD, dévoilée en octobre dernier et mise en avant lors du dernier CES. Le système combine des GPU Instinct MI450, des processeurs EPYC de classe Venice et une couche réseau maison baptisée Pensando, le tout piloté par ROCm, la pile logicielle open source qu'AMD développe comme alternative à CUDA de Nvidia. Anthropic, qui exploite déjà des GPU Instinct MI355X sur une partie de son infrastructure, va donc étendre significativement son usage du matériel AMD. Les deux entreprises ont également formalisé un accord de collaboration logicielle : les équipes d'AMD utiliseront Claude pour optimiser les charges de travail sur GPU Instinct et accélérer le développement de ROCm, et déploieront le modèle à grande échelle dans leurs équipes d'ingénierie. Cet accord pèse lourd pour les deux parties. Pour AMD, il s'agit d'une validation commerciale majeure face à la domination de Nvidia sur le marché des puces IA, avec un client de premier plan qui s'engage sur des volumes massifs et pluriannuels. Pour Anthropic, diversifier ses fournisseurs de calcul au-delà de Nvidia réduit sa dépendance à un seul acteur et lui donne un levier de négociation sur les prix, un enjeu crucial à mesure que l'entraînement et l'inférence de ses modèles Claude deviennent plus gourmands en ressources. L'investissement de 5 milliards de dollars, versé par paliers selon les volumes réellement commandés, sécurise aussi le développement futur d'Anthropic sans dilution immédiate au capital. Mais ce type d'accord réciproque, où le fournisseur de puces investit dans son propre client, alimente aussi les inquiétudes sur une possible bulle spéculative autour des investissements dans l'IA générative. Ce partenariat s'inscrit dans une série d'accords similaires signés par Anthropic ces derniers mois : un engagement avec Amazon en avril dernier autour des puces Trainium, également assorti d'un investissement de 5 milliards de dollars, puis un accord avec Google en octobre 2025 pour un approvisionnement garanti en TPU. OpenAI multiplie de son côté les engagements croisés avec Nvidia pour les puces et Oracle pour la construction de datacenters. AMD, de son côté, enchaîne les contrats : l'entreprise avait déjà annoncé lundi 20 juillet un accord de grande envergure avec Microsoft, portant lui aussi sur des systèmes Helios destinés aux services d'inférence d'Azure, avec une livraison prévue au second semestre 2026, sans que le montant du contrat soit communiqué.

UECet accord entre acteurs americains n'implique aucune entreprise europeenne, mais la concurrence accrue face a Nvidia sur le marche des puces IA pourrait indirectement influencer les couts de calcul des entreprises europeennes dependantes de ces infrastructures.

2Le Big Data 

Microsoft accélère sa conquête des entreprises européennes grâce à Mistral

Voici le résumé en 300-450 mots, article autonome en 3 paragraphes : Microsoft a annoncé l'extension de son partenariat avec la start-up française Mistral AI, engageant plusieurs milliards de dollars pour soutenir le développement de ses infrastructures de calcul en Europe et intégrer davantage ses modèles dans son écosystème cloud. Les deux entreprises collaborent depuis 2023. Mistral construit actuellement une importante capacité de calcul en Europe grâce à des milliers de GPU NVIDIA Vera Rubin, dont une partie sera financée par Microsoft, qui exploitera en retour une portion de cette puissance pour alimenter ses propres services cloud et IA. Concrètement, les modèles Mistral Medium 3.5 et OCR 4 sont désormais disponibles au sein de Microsoft Foundry, Copilot Studio et Azure Local, permettant aux entreprises de les exécuter dans le cloud Azure, dans leurs propres centres de données, voire dans des environnements totalement déconnectés d'Internet. Cette annonce répond à une demande croissante des entreprises européennes pour des solutions d'intelligence artificielle conciliant performance, conformité réglementaire et souveraineté des données. Les secteurs les plus réglementés, comme la santé, la finance, l'industrie ou les infrastructures critiques, sont particulièrement concernés par ces exigences de confidentialité, de continuité d'activité et de résidence des données. En s'appuyant sur un acteur européen reconnu plutôt que sur un écosystème américain fermé, Microsoft peut proposer différents niveaux de contrôle selon les besoins de chaque client, un argument de poids dans les appels d'offres où la souveraineté numérique devient un critère décisif. Pour Mistral, ce partenariat représente un accélérateur majeur de diffusion de ses modèles auprès des grands comptes européens et internationaux. Ce rapprochement s'inscrit dans un contexte réglementaire tendu : l'Union européenne pousse les fournisseurs cloud à renforcer leurs garanties sur la localisation des données, tandis que Microsoft fait lui-même l'objet d'un examen accru des autorités européennes concernant la concurrence sur le marché du cloud. En misant sur un champion européen de l'IA, le groupe américain cherche à démontrer qu'il favorise le choix des clients plutôt qu'un enfermement technologique. Cette alliance s'inscrit plus largement dans une stratégie de diversification du catalogue de modèles disponibles sur Azure AI Foundry, longtemps dominé par le seul partenariat avec OpenAI. Microsoft y intègre désormais aussi Meta avec Llama pour les modèles ouverts, xAI pour élargir l'offre de grands modèles, Cohere pour les cas d'usage professionnels, et DeepSeek comme alternative compétitive aux modèles américains, Mistral occupant quant à lui le créneau spécifique de l'IA souveraine destinée aux entreprises européennes.

UERenforce Mistral AI, entreprise française, comme acteur clé de la souveraineté numérique européenne et facilite l'accès des secteurs réglementés (santé, finance, industrie) à des solutions IA conformes aux exigences de résidence des données en France et dans l'UE.

BusinessActu
1 source
3Next INpact 

Microsoft engage plusieurs milliards de dollars aux côtés de Mistral en Europe

Microsoft et Mistral AI annoncent un renforcement majeur de leur partenariat, scellé par un accord portant sur plusieurs milliards de dollars destinés à développer l'infrastructure d'intelligence artificielle en Europe. Les deux groupes collaborent depuis 2024 dans le cadre d'un accord de distribution des modèles du laboratoire français sur la plateforme Azure, mais cette nouvelle étape va nettement plus loin. Grâce à ces fonds, Mistral va pouvoir augmenter ses capacités de calcul en s'appuyant sur des milliers de GPU NVIDIA Vera Rubin de dernière génération, et poursuivre la construction de centres de données en France et ailleurs en Europe. L'accord prévoit aussi une intégration renforcée des modèles de Mistral dans l'écosystème Microsoft : Medium 3.5 est désormais disponible dans Microsoft Foundry, Azure et Copilot Studio, tandis qu'OCR 4, la dernière version du modèle de reconnaissance de texte devenu parseur documentaire sémantique, rejoint également Foundry. Les modèles peuvent en outre être déployés via Azure Local (l'ancien Azure Stack HCI) directement sur les serveurs des clients, y compris dans des environnements totalement coupés d'internet. Cet accord répond à un double enjeu, industriel et politique. Pour Mistral, c'est une manne financière et technique considérable qui lui permet d'accélérer l'entraînement, l'inférence et le déploiement à grande échelle de ses modèles, dans un secteur où la course aux capacités GPU est devenue le principal facteur de compétitivité. Pour Microsoft, l'intérêt est de renforcer sa présence en Europe tout en apaisant les inquiétudes des régulateurs et des entreprises sur la souveraineté numérique. Arthur Mensch, directeur général de Mistral, souligne que ces nouvelles capacités permettront à ses modèles d'être déployés par des entreprises et des institutions publiques du monde entier sur une plateforme conçue pour répondre aux exigences des environnements les plus critiques et réglementés. Concrètement, cela signifie que des organisations soucieuses de confidentialité, banques, administrations, secteurs sensibles, pourront utiliser une IA de pointe européenne sans dépendre exclusivement d'infrastructures américaines classiques. Cette annonce s'inscrit dans la continuité des engagements pris par Microsoft en mai 2025, lorsque son président Brad Smith avait publié une tribune promettant davantage de transparence sur la gouvernance, la confidentialité des données et la collaboration avec les institutions européennes. Interrogé par le Wall Street Journal, Brad Smith a été explicite : les clients qui veulent s'appuyer sur les modèles de Mistral n'ont pas besoin de choisir un fournisseur comme Anthropic ou OpenAI, ils bénéficient d'une technologie américaine mais peuvent l'exécuter dans un environnement déconnecté. En misant sur Mistral, Microsoft cherche donc à la fois à consolider sa position face à ses rivaux cloud et à se positionner favorablement auprès des régulateurs européens, alors que les débats sur la souveraineté technologique et la dépendance aux géants américains du numérique restent vifs sur le continent.

UEL'accord renforce les capacites de calcul et les centres de donnees de Mistral en France et en Europe, offrant aux entreprises et institutions publiques francaises une alternative de souverainete numerique face aux infrastructures americaines classiques.

4NVIDIA AI Blog 

NVIDIA Vera Rubin améliore la performance par watt et réduit le coût par token pour ses partenaires dans le monde

Voici l'article traduit et résumé. NVIDIA a annoncé la montée en production de sa plateforme Vera Rubin NVL72, déployée chez des partenaires majeurs comme CoreWeave, Google Cloud, Microsoft Azure et Oracle Cloud Infrastructure. La chaîne d'approvisionnement s'appuie sur plus de 350 sites industriels répartis dans 30 pays, ce que NVIDIA présente comme la chaîne logistique rack-scale la plus vaste et la plus mature jamais assemblée. Selon un premier benchmark de CoreWeave sur le modèle DeepSeek-R1, la plateforme atteint un débit dix fois supérieur par mégawatt comparé à la génération précédente Grace Blackwell NVL72. Le système repose sur une co-conception poussée de sept puces et cinq plateaux de rack, dont le nouveau CPU Vera doté d'un cœur Olympus offrant deux fois les performances mono-thread, trois fois la bande passante inter-cœurs et une latence mémoire réduite de 40% par rapport aux puces chiplet concurrentes. Côté réseau, l'interconnexion NVLink de sixième génération double le débit sur les charges complexes tout en réduisant la latence par trois, et le réseau Spectrum-X Ethernet, combiné aux commutateurs Spectrum-6 et aux SuperNIC ConnectX-9, apporte 60% de bande passante RDMA supplémentaire face aux solutions Ethernet standards. Cette avancée compte avant tout parce qu'elle s'attaque directement au principal goulot d'étranglement des centres de données d'intelligence artificielle actuels: la consommation électrique. En multipliant par dix le débit par mégawatt, NVIDIA permet aux opérateurs de data centers de traiter davantage de requêtes sans construire de nouvelles centrales ou étendre leurs capacités énergétiques, un enjeu critique alors que la demande en calcul explose. L'architecture sans câbles, ventilateurs ni tuyaux dans les plateaux de calcul réduit le temps d'assemblage de plusieurs heures à une seule minute, tandis que le refroidissement liquide fonctionnant à 45°C en entrée permet un fonctionnement sans réfrigérateur, économisant des millions de litres d'eau par mégawatt chaque année. Des géants comme SpaceX et Tesla figurent parmi les premiers à adopter les commutateurs Spectrum-6, signe que cette technologie dépasse le seul cadre du cloud pour toucher l'IA embarquée et les infrastructures propriétaires. Le contexte européen illustre l'ampleur stratégique de ce déploiement: mardi 21 juillet, NVIDIA a dévoilé un partenariat élargi entre Microsoft et Mistral AI, doté d'un accord pluriannuel évalué en milliards de dollars pour développer les infrastructures IA en Europe. Mistral ajoutera des milliers de GPU Vera Rubin à sa capacité de calcul, créant une plateforme partagée pour l'entraînement et le déploiement de modèles ouverts, tout en donnant aux gouvernements et industries régulées un contrôle accru sur leurs environnements. Cette initiative s'inscrit dans une compétition mondiale où les fabricants de puces cherchent à équiper les hyperscalers tout en répondant aux exigences de souveraineté numérique, un sujet particulièrement sensible en Europe. Avec NVLink Fusion ouvrant également son écosystème aux puces tierces, NVIDIA cherche à consolider sa position d'infrastructure de référence face à une concurrence croissante dans la course aux capacités de calcul IA.

UEMistral AI, entreprise française, va integrer des milliers de GPU Vera Rubin grace a un accord pluriannuel avec Microsoft, renforçant les capacites de calcul IA en Europe et la souverainete numerique des secteurs regules.

InfrastructureActu
1 source
5Le Big Data 

Pourquoi Microsoft mise davantage sur AMD pour développer Azure AI ?

Microsoft et AMD ont annoncé le 20 juillet 2026 un élargissement de leur partenariat stratégique pour équiper le cloud Azure. Cet accord porte sur l'intégration de la plateforme AMD Helios, qui combine les futurs GPU Instinct MI455X, les processeurs EPYC de sixième génération portant le nom de code « Venice », les unités de traitement de données (DPU) Pensando et la pile logicielle ROCm. Microsoft prévoit de déployer cette infrastructure dès le second semestre 2026, aussi bien pour ses propres services Azure AI que pour les charges de travail de ses clients entreprises. Trois nouvelles familles de machines virtuelles verront le jour : les instances HDv2, pensées pour les pipelines de données, l'apprentissage par renforcement et les systèmes d'agents autonomes ; les HXv2, dédiées aux simulations scientifiques, au calcul technique et à la conception de semi-conducteurs ; et les ND MI455X v7, qui s'appuieront directement sur Helios pour accélérer l'inférence des modèles d'IA en production. Cette annonce marque un tournant dans la manière dont Microsoft envisage l'infrastructure de son cloud. L'entreprise ne se contente plus d'ajouter de nouvelles puces à son catalogue : elle réorganise l'architecture d'Azure autour de plusieurs technologies complémentaires plutôt que d'une solution unique. Pour les entreprises clientes, cela signifie un accès à des machines virtuelles calibrées selon la nature exacte de leurs projets, qu'il s'agisse d'entraîner des modèles, de faire tourner des agents IA ou de préparer des données à grande échelle. Cette diversification matérielle limite aussi la dépendance de Microsoft à un fournisseur unique de puces, un enjeu stratégique et économique majeur dans un marché du cloud où la demande de calcul pour l'IA continue de croître fortement. Ce rapprochement s'inscrit dans un contexte de concurrence croissante entre fournisseurs d'infrastructures IA, où la position dominante de Nvidia pousse les géants du cloud à multiplier leurs sources d'approvisionnement. Plusieurs acteurs développent déjà leurs propres puces maison, tandis que d'autres, comme Microsoft, choisissent de renforcer leurs liens avec des partenaires établis comme AMD pour diversifier leur offre. En intégrant l'ensemble de la chaîne, des GPU aux réseaux en passant par les processeurs et les logiciels, Microsoft cherche à sécuriser sa capacité à répondre aux besoins futurs de ses clients, qu'il s'agisse de laboratoires de recherche entraînant des modèles de fondation ou d'entreprises déployant des applications d'IA générative en production. Les prochains mois, avec les premières livraisons attendues fin 2026, permettront de mesurer concrètement l'impact de cette stratégie sur les performances et les coûts proposés aux clients d'Azure.

UELes entreprises europeennes clientes d'Azure pourront a terme acceder a cette nouvelle infrastructure GPU/CPU, mais aucune entreprise ou reglementation francaise ou europeenne n'est directement impliquee.

InfrastructureActu
1 source
6AI News 

Chine : des modèles ouverts bon marché, mais à quel prix pour Washington ?

Moonshot AI a lancé Kimi K3 le 16 juillet, le plus grand modèle en poids ouverts jamais publié, avec un prix de 15 dollars par million de tokens en sortie et un seul mode de fonctionnement, le raisonnement maximal. En quelques jours, ce lancement a ravivé à Washington un débat resté en sommeil depuis un an. L'étincelle est venue de Dean Ball, responsable des perspectives stratégiques chez OpenAI et ancien conseiller IA à la Maison-Blanche sous Trump. Dans une analyse largement positive, il a jugé le modèle très performant, sans que sa qualité puisse selon lui s'expliquer par une simple distillation d'un modèle existant, tout en notant qu'il consommait énormément de tokens, rendant son coût réel incertain. Il a ensuite prédit que l'administration Trump finirait par créer un risque réglementaire autour des modèles chinois en poids ouverts, non pas via une interdiction franche, qu'il a qualifiée d'une des idées les plus absurdes en matière de politique de l'IA, mais par des mises en garde informelles d'agences fédérales évoquant d'éventuelles portes dérobées, sans besoin de preuves solides, suffisant à pousser les entreprises régulées à se retirer d'elles-mêmes. La réaction a été vive et est venue de responsables américains eux-mêmes: David Sacks, coprésident du conseil scientifique et technologique de la présidence, a accusé Ball soit d'avouer une stratégie de capture réglementaire, soit d'en prédire une, dénonçant l'instrumentalisation de l'incertitude réglementaire par un duopole de laboratoires fermés cherchant à écarter la concurrence open source. Yann LeCun et Martin Casado ont pour leur part défendu la coexistence des modèles ouverts et propriétaires. Ball a ensuite précisé qu'il décrivait une tendance plutôt qu'il ne la recommandait. Cette controverse dépasse la joute d'opinions: elle touche directement les décisions d'achat des entreprises, en dehors même des États-Unis, car les règles de marchés publics fédéraux, les listes noires à l'export et les alertes de sécurité transitent par les mêmes fournisseurs cloud qui équipent la majorité du marché mondial. L'enjeu économique est concret: les modèles ouverts chinois, moins chers, compriment les revenus par token des laboratoires fermés sans réduire l'usage global de l'IA. Selon les données de routage de Vercel, ces modèles ont traité 29% des tokens transitant par sa plateforme en juin, contre environ 11% en avril, pour moins de 4% des dépenses totales. Signe de cette pression venue de l'intérieur même de l'écosystème américain, GitHub a intégré Kimi K2.7 Code de Moonshot à Copilot dès le 1er juillet, hébergé sur Microsoft Azure, et Microsoft évaluerait désormais l'ajout de K3 pour remplacer certaines fonctions actuellement confiées à OpenAI et Anthropic, avec des économies d'inférence potentielles atteignant 600 millions de dollars, un chiffre non confirmé par l'entreprise. L'argument sécuritaire mérite néanmoins d'être pris au sérieux indépendamment des motivations commerciales. Un modèle en poids ouverts, une fois téléchargé et déployé dans des milliers d'organisations, ne peut plus être rappelé, corrigé à distance ni révoqué par son éditeur, contrairement à une API hébergée. Son comportement est aussi plus difficile à auditer que du code classique: un réglage fin peut introduire des biais ou des failles qu'aucune inspection de licence ne permettrait de détecter, posant une question de fond sur la confiance à accorder à des modèles dont la chaîne de fabrication échappe à tout contrôle occidental.

RégulationReglementation
1 source
Les modèles Anthropic tournent désormais sur NVIDIA GB300 Blackwell Ultra dans Azure
7NVIDIA AI Blog 

Les modèles Anthropic tournent désormais sur NVIDIA GB300 Blackwell Ultra dans Azure

Les modèles Claude d'Anthropic sont désormais disponibles en accès général sur Microsoft Azure via Microsoft Foundry, avec une infrastructure propulsée par les GPU NVIDIA GB300 Blackwell Ultra. Ces systèmes reposent sur des configurations NVL72 couplées au réseau InfiniBand Quantum-X800, ce qui représente une montée en puissance significative pour les entreprises qui souhaitent déployer des agents IA autonomes sur le cloud Azure. Ce lancement s'inscrit dans la continuité d'un partenariat tripartite annoncé en novembre 2025 entre Microsoft, NVIDIA et Anthropic, qui visait à élargir l'accès entreprise aux modèles Claude sur des infrastructures accélérées. Concrètement, cette disponibilité générale change la donne pour les organisations qui construisent des systèmes multi-agents complexes. Les GPU Blackwell Ultra offrent des performances d'inférence nettement supérieures, ce qui réduit le coût total de possession et rend économiquement viable le déploiement d'agents spécialisés opérant en parallèle sur différents domaines métiers. NVIDIA et Anthropic travaillent également à intégrer les outils NVIDIA directement dans la pile Anthropic, permettant d'enrichir les agents Claude de compétences sectorielles précises via les "NVIDIA Verified Agent Skills". Ces agents peuvent ainsi être déployés comme une couche opérationnelle centrale au sein d'une organisation. Sur le plan de la gouvernance, NVIDIA propose un cadre de référence baptisé Secure Agent Workspace Reference Design, qui permet de faire tourner des agents autonomes dans un environnement contrôlé où l'identité, les accès réseau, les credentials et les politiques d'exécution sont gérés au niveau de l'infrastructure. Cette approche répond à l'une des principales préoccupations des directions informatiques face aux agents IA : le contrôle et la traçabilité. La convergence entre les grands modèles de langage d'Anthropic, la puissance de calcul de NVIDIA et l'écosystème cloud de Microsoft dessine un modèle d'intégration qui pourrait devenir une référence pour les déploiements IA en entreprise au cours des prochains mois.

UELes entreprises européennes utilisant Microsoft Azure peuvent désormais déployer les modèles Claude sur des GPU Blackwell Ultra, ce qui améliore les performances d'inférence et réduit les coûts pour les déploiements d'agents IA en entreprise dans le cloud.

OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles
8VentureBeat AI 

OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles

OpenAI et Broadcom ont dévoilé ce matin leur premier processeur d'inférence IA sur mesure, baptisé "Jalapeño". Contrairement aux GPU grand public d'Nvidia ou AMD, ce circuit intégré à application spécifique (ASIC) est conçu exclusivement pour faire tourner des grands modèles de langage en production, notamment derrière ChatGPT, Codex et l'API OpenAI. Ce qui frappe d'emblée, c'est la vitesse de développement : de la conception initiale à la fabrication, seulement neuf mois se sont écoulés, là où un cycle habituel de développement de processeur se compte en années. Le partenariat entre OpenAI et Broadcom n'avait d'ailleurs été annoncé publiquement qu'en octobre 2025. Greg Brockman, président et cofondateur d'OpenAI, ainsi que Hock Tan, PDG de Broadcom, ont présenté la puce ce matin sur CNBC. Brockman a précisé que le processus de conception a lui-même été accéléré grâce aux propres modèles d'OpenAI, des versions antérieures au GPT-5.5. OpenAI indique avoir déjà testé GPT-5.3-Codex-Spark sur ces puces dans un environnement de production simulé, et prévoit de déployer Jalapeño dans ses centres de données actifs d'ici fin 2026. Les performances initiales sont décrites comme "remarquables", Brockman écrivant sur X que le ratio performance par watt est "incroyable". L'enjeu dépasse largement la performance technique : il s'agit de survie économique. Des documents financiers audités récemment révélés montrent qu'OpenAI a généré 13,07 milliards de dollars de revenus en 2025, mais a engagé 34 milliards de dépenses opérationnelles, accusant une perte d'exploitation de près de 20,92 milliards de dollars. La principale cause : le coût titanesque de la puissance de calcul, essentiellement louée auprès de Microsoft Azure sur des GPU Nvidia. Concevoir ses propres puces optimisées pour l'inférence LLM permettrait à OpenAI de drastiquement réduire ce coût marginal par requête et d'atteindre enfin une rentabilité opérationnelle. Broadcom apporte la conception silicium et son réseau Tomahawk, tandis que Celestica gère l'intégration au niveau carte, rack et système. Cette annonce s'inscrit dans une stratégie plus large de verticalisation de la filière IA, un mouvement déjà emprunté par Google avec ses TPU et Amazon avec ses puces Trainium et Inferentia. OpenAI, longtemps dépendant des infrastructures de ses partenaires et investisseurs, cherche à contrôler toute sa pile technologique. Fait notable : les deux entreprises positionnent explicitement Jalapeño comme une puce "construite de zéro pour les LLMs actuels et futurs de toute l'industrie", ouvrant la voie à une commercialisation auprès d'autres acteurs de l'IA. De nombreuses questions restent ouvertes, notamment les performances comparatives face aux solutions Nvidia, les coûts de fabrication et la viabilité à grande échelle. Mais si le pari réussit, OpenAI ne sera plus seulement un éditeur de modèles : il deviendra un fournisseur d'infrastructure à part entière.

UEUne réduction future des coûts d'inférence pourrait bénéficier indirectement aux entreprises et développeurs européens utilisant l'API OpenAI, sans impact réglementaire ou industriel direct sur la France/UE.

💬 Quand tu perds 21 milliards par an, tu te construis tes propres puces. Ce que Jalapeño change vraiment, c'est pas la performance par watt, c'est qu'OpenAI sort enfin d'une dépendance à Nvidia qui les saignait à blanc requête après requête. Neuf mois de conception accélérée par leurs propres modèles, c'est la vraie rupture.

Créer un assistant de recherche sur les protéines avec Amazon Bedrock AgentCore
9AWS ML Blog 

Créer un assistant de recherche sur les protéines avec Amazon Bedrock AgentCore

Amazon Web Services a publié un guide technique détaillant la construction d'un assistant conversationnel dédié à la recherche sur les protéines, baptisé "protein research copilot", reposant sur Amazon Bedrock AgentCore. Le système permet aux chercheurs de soumettre des requêtes en langage naturel, par exemple "Trouve 10 peptides similaires au peptide du virus de la dengue LPAIVREAI", et d'obtenir automatiquement des résultats de similarité structurelle accompagnés d'une synthèse scientifique générée par IA. L'architecture s'appuie sur le SDK Strands Agents pour orchestrer trois outils spécialisés au sein d'un agent unique : un parseur de requêtes, un moteur de recherche vectorielle, et un summariseur. Les embeddings protéiques sont calculés via le modèle ESM-C 300M déployé comme endpoint serverless sur Amazon SageMaker AI, puis comparés par similarité cosinus dans une base Amazon Aurora PostgreSQL avec l'extension pgvector. L'interface utilisateur tourne sur AWS Fargate via Streamlit, et le modèle de langage central est Claude Sonnet 4.6 d'Anthropic, accessible via l'API Bedrock Converse. Ce type d'outil répond à un problème concret dans les laboratoires de biologie computationnelle : la recherche manuelle de peptides structurellement similaires parmi des milliers de séquences est lente, sujette aux erreurs, et exige une expertise pointue pour interpréter les résultats. En automatisant l'ensemble du pipeline, de la formulation de la question à la synthèse des résultats, le copilote réduit drastiquement le temps passé sur des tâches répétitives et rend la recherche accessible à des profils moins spécialisés en bioinformatique. Le pattern "LLM-as-parser" utilisé pour extraire des paramètres structurés depuis du langage naturel est directement réutilisable dans d'autres domaines scientifiques où les données sont complexes et la formulation des requêtes peu standardisée. Cette publication s'inscrit dans la stratégie d'AWS de positionner Bedrock AgentCore comme plateforme de référence pour déployer des agents IA en production, face à des concurrents comme Google Vertex AI ou Microsoft Azure AI Studio. Le secteur biotech et pharmaceutique représente une cible prioritaire : la recherche sur les épitopes viraux, le dataset utilisé ici est celui de l'IEDB (Immune Epitope Database), est au coeur du développement de vaccins et de thérapies antivirales. Le modèle ESM-C, développé par EvolutionaryScale, est l'un des modèles de langage protéique les plus performants du moment. Le déploiement complet est estimé entre 30 et 45 minutes, mais implique des coûts sur Bedrock, SageMaker, Aurora Serverless v2 et Fargate qu'AWS invite explicitement à consulter avant de lancer l'infrastructure. Les prochaines étapes naturelles seraient l'intégration de bases de données protéiques publiques comme UniProt ou PDB, et l'extension à d'autres types de molécules biologiques.

UECet outil développé par AWS peut bénéficier aux chercheurs en biologie computationnelle en France et dans l'UE en automatisant la recherche de peptides structurellement similaires, améliorant ainsi l'efficacité et rendant ces tâches moins spécialisées.

AutrePaper
1 source
Copilot a fouillé vos emails, LiteLLM a exposé des clés admin : faites cet audit en 5 points
10VentureBeat AI 

Copilot a fouillé vos emails, LiteLLM a exposé des clés admin : faites cet audit en 5 points

En l'espace de deux semaines, quatre équipes de recherche ont révélé des failles critiques dans des outils d'IA d'entreprise, mettant à nu un même défaut structurel. Le 15 juin 2026, Varonis a divulgué SearchLeak (CVE-2026-42824), une chaîne d'exfiltration silencieuse dans Microsoft 365 Copilot Enterprise Search : un utilisateur clique sur une URL piégée hébergée sur microsoft.com, Copilot effectue une recherche dans sa propre boîte mail, et les données quittent le périmètre via un SSRF Bing, sans plugin, sans second clic, sans aucun indicateur visible. Quatre jours plus tôt, Obsidian Security avait publié une chaîne de trois CVE contre LiteLLM, une passerelle proxy qui centralise les accès à OpenAI, Anthropic, Azure et Bedrock. CVE-2026-47101 permet à un compte non-administrateur de générer une clé API universelle ; CVE-2026-47102 élève ce compte au rang d'administrateur via un endpoint non protégé ; CVE-2026-40217 permet une évasion du sandbox par exécution de code arbitraire. La chaîne combinée est scorée à CVSS 9.9. S'y ajoute CVE-2026-42271, une injection de commande dans les endpoints MCP de LiteLLM, inscrite sur la liste CISA KEV le 8 juin avec échéance de remédiation au 22 juin. Langflow a simultanément vu CVE-2026-5027 exploitée activement dès le 9 juin : une traversée de chemin dans l'upload de fichiers combinée à une auto-connexion activée par défaut ouvre une exécution de code à distance sans authentification sur environ 7 000 instances exposées, avec attribution à MuddyWater. Ces vulnérabilités révèlent un problème de fond identique : les outils IA d'entreprise acceptent des entrées externes sans frontière de confiance. Dans le cas de Copilot Enterprise Search, l'étendue est particulièrement préoccupante puisque l'outil hérite des droits organisationnels complets de l'utilisateur, exposant potentiellement l'ensemble de ce qu'il peut atteindre. Pour LiteLLM, compromettre la passerelle revient à obtenir simultanément toutes les clés de fournisseurs d'une organisation. Avec plus de 40 000 étoiles sur GitHub et des milliers de déploiements en entreprise, l'exposition est massive. L'exploitation active de Langflow par un acteur étatique iranien sur des milliers d'instances illustre la rapidité avec laquelle ces failles sont weaponisées après divulgation. Ces incidents s'inscrivent dans une tendance plus large. SearchLeak est la troisième chaîne d'exfiltration Copilot publiée par Varonis en douze mois, après Reprompt en janvier 2026 et EchoLeak en 2025, chaque fois avec un périmètre élargi. LiteLLM avait déjà été compromis en mars 2026 via une attaque supply chain qui avait backdooré les versions 1.82.7 et 1.82.8 sur PyPI. La campagne Mini Shai-Hulud a confirmé la viralité du vecteur : après la publication du code source d'un ver le 12 mai, des variantes ont compromis 32 packages npm de Red Hat Cloud Services le 1er juin, des packages téléchargés 80 000 fois par semaine. Le schéma est systémique : à mesure que l'IA s'intègre dans les infrastructures critiques, chaque couche de la chaîne, modèle, proxy, orchestrateur, dépendances, devient un vecteur d'attaque potentiel que les périmètres de confiance traditionnels ne couvrent pas.

UEDes milliers d'organisations européennes sont directement exposées à des exfiltrations silencieuses de données et compromissions de clés API via leurs outils IA d'entreprise, avec exploitation active confirmée par un acteur étatique iranien ciblant des instances non patchées.

SécuritéOpinion
1 source
OpenAI : une croissance fulgurante, mais des pertes colossales
11Next INpact 

OpenAI : une croissance fulgurante, mais des pertes colossales

OpenAI a transmis à la SEC américaine un dossier financier confidentiel dans le cadre de sa préparation à une introduction en Bourse. Des documents ont fuité, révélant l'état réel des finances du laboratoire. En 2025, OpenAI a généré 13,1 milliards de dollars de chiffre d'affaires, contre 3,7 milliards en 2024, soit une hausse de plus de 250 % en un an. À fin 2025, la société encaissait 2 milliards de dollars par mois, deux fois plus que son chiffre trimestriel de fin 2024. Mais les pertes nettes ont atteint 38,5 milliards de dollars sur l'exercice, contre 5,09 milliards l'année précédente. En retranchant un ajustement comptable exceptionnel d'environ 30 milliards lié à la réorganisation juridique de l'entreprise, les pertes opérationnelles réelles s'établissent à 8 milliards, soit tout de même 60 % de plus qu'en 2024. Les dépenses d'exploitation ont failli tripler, passant de 12,5 à 34 milliards de dollars, avec une R&D qui explose à 19,18 milliards contre 7,81 milliards l'année précédente. En 2025, Microsoft a perçu 17,2 milliards de dollars d'OpenAI, dont 10,59 milliards pour couvrir les coûts d'infrastructure Azure liés à l'entraînement des modèles. Ces chiffres illustrent une réalité structurelle de l'IA générative : même les acteurs les plus rentables sur le plan commercial brûlent des liquidités à une vitesse sans précédent. OpenAI dépense nettement plus vite qu'elle ne gagne, et la dynamique ne semble pas près de s'inverser. Pour les utilisateurs et les entreprises clientes, cela signifie que la course aux modèles toujours plus puissants est financée par une accumulation de pertes qui repose entièrement sur la confiance des investisseurs. Pour l'industrie, cela confirme que le modèle économique de l'IA de pointe reste fragile : les marges sont négatives et les infrastructures de calcul représentent un coût colossal, capturé ici en grande partie par Microsoft via Azure. OpenAI a entamé sa transformation en société à but lucratif classique au cours des derniers mois, une restructuration juridique qui a généré la charge comptable exceptionnelle de 30 milliards. Ce changement de statut est précisément ce qui ouvre la voie à une introduction en Bourse. En mars 2026, la société annonçait une levée de fonds de 122 milliards de dollars sur une valorisation de 852 milliards, ce qui lui laisse 25 milliards de trésorerie disponible. SoftBank figure parmi les investisseurs clés avec 867 millions versés à OpenAI, tandis que Microsoft, malgré ses 17 milliards encaissés, reste à la fois fournisseur d'infrastructure, partenaire stratégique et client. La future cotation en Bourse imposera une transparence totale sur ces flux financiers complexes, et les marchés devront alors trancher : OpenAI vaut-elle vraiment près de mille milliards de dollars, ou est-elle une bulle alimentée par l'enthousiasme autour de l'IA ?

UELes entreprises européennes clientes des API OpenAI sont exposées à un risque structurel : leur fournisseur stratégique brûle des liquidités à un rythme sans précédent, ce qui interroge la durabilité tarifaire et la stabilité du service à long terme.

BusinessOpinion
1 source
Google Cloud soutient l’ambition de superintelligence d’Ineffable Intelligence
12Le Big Data 

Google Cloud soutient l’ambition de superintelligence d’Ineffable Intelligence

Ineffable Intelligence, startup londonienne fondée par David Silver, le chercheur britannique à l'origine d'AlphaGo, a annoncé lors du Google Cloud Summit London 2026 un partenariat stratégique avec Google Cloud pour soutenir le développement de son projet de superintelligence. Cette alliance intervient dans la foulée d'une levée de fonds de 1,1 milliard de dollars, la plus importante jamais réalisée par une startup européenne spécialisée dans l'IA. Concrètement, Ineffable Intelligence déploiera sur l'infrastructure Google Cloud l'un des plus grands clusters A5X au monde, équipé de GPU NVIDIA Vera Rubin NVL72, pour entraîner ce qu'elle appelle un « super-apprenant » : une intelligence artificielle capable d'acquérir des connaissances par l'expérience directe, en continu, plutôt qu'à partir de vastes ensembles de données précompilées. L'enjeu dépasse largement le simple choix d'un prestataire cloud. Les systèmes fondés sur l'apprentissage par renforcement continu imposent des contraintes d'infrastructure radicalement différentes des modèles génératifs classiques : ils génèrent, évaluent et exploitent en temps réel des flux d'expériences, ce qui exige non seulement une puissance de calcul considérable, mais aussi une interconnexion ultra-performante entre GPU, réseau à haut débit et stockage optimisé. Google Cloud se positionne précisément sur cette architecture intégrée, présentée comme un avantage décisif pour les laboratoires les plus exigeants. Pour l'industrie, ce partenariat marque une étape dans la compétition entre hyperscalers pour capter les projets d'IA les plus ambitieux, où l'infrastructure devient un levier de différenciation aussi important que les algorithmes eux-mêmes. David Silver, figure emblématique du domaine depuis sa contribution décisive à AlphaGo chez DeepMind, a quitté Google pour fonder Ineffable Intelligence avec l'ambition explicite de développer des systèmes capables de dépasser les capacités humaines dans des domaines comme les sciences, les mathématiques ou la technologie. L'approche par apprentissage par renforcement qu'il défend s'inscrit dans une tradition de recherche distincte des grandes entreprises qui misent sur la mise à l'échelle de modèles de langage entraînés sur du texte. Le choix de Google Cloud comme partenaire est une décision stratégique pour les deux parties : Ineffable Intelligence bénéficie d'une infrastructure de premier rang à grande échelle, tandis que Google utilise ce partenariat comme vitrine pour démontrer la maturité de son offre IA à une période où la concurrence entre Azure, AWS et Google Cloud pour attirer les laboratoires de recherche de pointe n'a jamais été aussi intense. La levée de 1,1 milliard confirme que le projet est pris très au sérieux par les investisseurs, même si l'horizon d'une superintelligence opérationnelle reste indéfini.

UELa levée record d'1,1 milliard de dollars par Ineffable Intelligence, startup londonienne fondée par le chercheur britannique à l'origine d'AlphaGo, s'impose comme un signal fort pour l'écosystème européen de l'IA, confirmant sa capacité à générer des laboratoires de recherche de niveau mondial capables de rivaliser avec les géants américains.

💬 David Silver quitte Google pour lever 1,1 milliard et retourner entraîner ses modèles sur... l'infra Google. Le serpent qui se mord la queue, mais version superintelligence. Ce qui m'intéresse vraiment là-dedans, c'est l'approche : de l'apprentissage par renforcement continu plutôt que du scaling de LLM sur texte, c'est une vraie bifurcation par rapport à ce que font OpenAI ou Anthropic. Reste à voir si ça donne quelque chose en dehors des jeux de plateau.

BusinessOpinion
1 source
☕️ Microsoft bloque Claude Fable 5 en interne à cause de la rétention des données
13Next INpact 

☕️ Microsoft bloque Claude Fable 5 en interne à cause de la rétention des données

Microsoft a intégré Claude Fable 5 d'Anthropic à GitHub Copilot et à sa plateforme Azure Foundry pour le développement d'applications IA, mais a bloqué l'accès au modèle pour ses propres employés dans les versions internes de ces outils. La raison : une politique de rétention des données incompatible avec les exigences internes de l'éditeur. Anthropic conserve en effet les requêtes et les réponses générées par Fable 5 pendant 30 jours, une durée qui peut s'étendre à deux ans en cas de suspicion d'usage malveillant. Ce délai existe parce que Fable 5 repose sur la même architecture que Mythos, le modèle à capacités avancées d'Anthropic, même s'il en est une version bridée : toute question touchant à la cybersécurité, la biologie, la chimie ou la distillation de modèles IA est automatiquement redirigée vers Opus 4.8, plus restreint. Pour les utilisateurs individuels de Claude.ai ou de l'application mobile, cette rétention de 30 jours est déjà la norme et ne change rien. En revanche, pour les entreprises qui accèdent à Claude via la console professionnelle, Amazon Bedrock, Google Cloud Agent ou Foundry avec le mode Zero Data Retention activé, c'est une rupture nette. Ce mode, proposé par Anthropic à certains clients enterprise, garantissait jusqu'ici qu'aucune donnée n'était conservée après traitement. Fable 5 ne supporte plus cette garantie, ce qui expose potentiellement des données sensibles, des informations confidentielles ou des propriétés intellectuelles aux conditions de rétention d'Anthropic. L'équipe juridique de Microsoft évalue actuellement les implications de ce changement, sans calendrier de résolution annoncé. Le cas illustre une tension structurelle croissante dans l'adoption des LLM de pointe par les grandes entreprises : plus les modèles sont puissants et soumis à des exigences de surveillance réglementaire, plus les conditions d'utilisation deviennent contraignantes pour les clients professionnels. D'autres organisations utilisant Fable 5 via ces mêmes canaux pourraient se retrouver dans la même situation que Microsoft, ce qui pourrait freiner l'adoption enterprise du modèle malgré ses performances.

UELes entreprises européennes utilisant Claude Fable 5 via Azure Foundry, Amazon Bedrock ou Google Cloud Agent perdent la garantie Zero Data Retention, créant un risque concret de non-conformité RGPD pour les données professionnelles sensibles.

💬 Le Zero Data Retention, c'était l'argument qui faisait craquer les directions juridiques. Anthropic le retire avec Fable 5 parce que le modèle partage une base avec Mythos et qu'ils veulent surveiller les requêtes sensibles, la logique est là, mais ça va freiner l'adoption enterprise bien plus sûrement que n'importe quel mauvais benchmark. Pour les boîtes européennes qui bossent sous RGPD, c'est pas une friction, c'est un mur.

LLMsOpinion
1 source
Des outils Microsoft piratés pour voler des identifiants d’outils IA comme Claude Code
14Next INpact 

Des outils Microsoft piratés pour voler des identifiants d’outils IA comme Claude Code

Microsoft a dû désactiver l'accès à plus de 70 de ses propres dépôts GitHub suite à une campagne d'attaques nommée « Miasma », révélée début juin 2026. Parmi les dépôts compromis figurent des projets critiques comme « Azure/functions-action », utilisé pour déployer du code sur Azure Functions, et le framework Durable Task, décrit comme « utilisé activement en production par de nombreuses équipes d'ingénierie au sein de Microsoft ». L'entreprise de sécurité StepSecurity a identifié le vecteur précis : un commit malveillant poussé dans le dépôt Azure/durabletask via un compte de contributeur piraté, ajoutant cinq fichiers conçus pour s'exécuter automatiquement dans quatre environnements de développement. Le code s'active dès qu'un développeur ouvre le dépôt dans Claude Code, Gemini CLI, Cursor ou VS Code, avec pour objectif de dérober des identifiants. L'impact est particulièrement insidieux car l'attaque ne repose sur aucune faille technique de GitHub ou de npm, mais exploite la confiance accordée aux flux de publication légitimes. En s'emparant des identifiants d'un mainteneur, les attaquants ont pu demander un jeton OIDC GitHub valide, publier une version infectée avec une provenance SLSA authentique, et contourner ainsi les scanners de sécurité conventionnels qui l'ont traitée comme une mise à jour de routine. Comme le souligne l'entreprise Cloudsmith, « le ver s'est fondu dans les flux de travail légitimes » : les paquets malveillants portaient des signatures cryptographiques valides, indiscernables de celles d'un éditeur légitime. Les développeurs qui clonent un dépôt ne sont pas exposés, mais ceux qui l'ouvrent directement dans leur IDE l'étaient. Paradoxalement, c'est l'équipe de sécurité de Microsoft elle-même qui avait détecté Miasma en premier, non pas dans ses propres projets, mais chez Red Hat le 2 juin, où 32 paquets npm du périmètre @redhat-cloud-services avaient été modifiés dans plus de 90 versions. StepSecurity relie cette campagne à une attaque antérieure, « Mini Shai-Hulud », menée par le groupe TeamPCP, les deux opérations partageant un même domaine de commande et contrôle. Le compte piraté chez Microsoft est le même dont les identifiants avaient servi lors d'une attaque contre PyPI le 19 mai. Cette série d'incidents illustre une tendance de fond : la compromission des identifiants développeurs comme point d'entrée privilégié dans la chaîne d'approvisionnement logicielle, un vecteur d'autant plus difficile à contrer que les outils de vérification d'intégrité comme SLSA ne distinguent pas un éditeur authentique d'un attaquant ayant volé ses clés.

UELes développeurs européens utilisant Claude Code, Gemini CLI, Cursor ou VS Code sont directement exposés au vol de credentials s'ils ont ouvert des dépôts Microsoft ou Red Hat compromis dans ces environnements.

💬 Ce qui me frappe, c'est pas l'ampleur de la campagne. C'est que tous nos garde-fous, SLSA, les signatures cryptographiques, les pipelines de provenance qu'on impose aux projets OSS depuis des années, sont aveugles face à des credentials volés : la signature est valide, les scanners voient du vert, et t'es quand même compromis. C'est le genre de faille qu'on va pas résoudre avec un outil de plus dans la chaîne.

SécuritéOpinion
1 source
Microsoft Discovery en disponibilité générale sur Azure, alimentant l'IA à base d'agents de la puce quantique Majorana 2
15InfoQ AI 

Microsoft Discovery en disponibilité générale sur Azure, alimentant l'IA à base d'agents de la puce quantique Majorana 2

Microsoft a annoncé la disponibilité générale de Microsoft Discovery, sa plateforme Azure dédiée au déploiement d'équipes d'agents IA autonomes pour la recherche scientifique. C'est cette même plateforme qui a piloté le développement de Majorana 2, une puce quantique topologique affichant une fiabilité multipliée par 1 000 par rapport aux générations précédentes, avec des durées de vie de qubits atteignant 20 secondes. Microsoft fixe désormais à 2029 l'horizon d'un ordinateur quantique opérationnel à grande échelle, soit deux fois plus tôt que son calendrier initial. L'enjeu est considérable : un ordinateur quantique suffisamment fiable permettrait de résoudre des problèmes inaccessibles aux supercalculateurs classiques, notamment en chimie moléculaire, en cryptographie ou en optimisation logistique. En mettant ses agents IA au service de la conception de hardware quantique, Microsoft franchit une étape symbolique forte : l'IA ne se contente plus d'assister les chercheurs humains, elle orchestre elle-même des cycles d'expérimentation scientifique bout en bout. La course au quantique s'intensifie avec Google, IBM et plusieurs startups comme IonQ ou PsiQuantum comme principaux concurrents. Microsoft mise sur une architecture topologique reposant sur les qubits de Majorana, jugés intrinsèquement plus stables que les qubits supraconducteurs privilégiés par ses rivaux. La combinaison de cette approche matérielle distinctive et d'une plateforme IA agentique directement accessible sur Azure positionne Microsoft comme un acteur à double avantage dans la prochaine phase de la compétition quantique mondiale.

UELa disponibilité sur Azure en Europe donne aux laboratoires et entreprises de recherche de l'UE un accès à cette plateforme d'IA agentique pour la recherche scientifique, sans impact réglementaire ou institutionnel direct pour la France.

InfrastructureActu
1 source
Doctolib réfute livrer « les infos de ses utilisateurs » aux grands acteurs de l’IA
16Next INpact 

Doctolib réfute livrer « les infos de ses utilisateurs » aux grands acteurs de l’IA

Le Canard Enchaîné a affirmé, dans son édition du 2 juin 2026, que Doctolib transmettait les données de ses utilisateurs à Microsoft, Anthropic et Google dans le but d'entraîner leurs grands modèles de langage. L'article vise notamment l'assistant de consultation que la licorne française commercialise depuis 2024 auprès des professionnels de santé. Ce service écoute les consultations médicales, avec l'accord du patient, pour générer automatiquement comptes-rendus et courriers. Or, les documents contractuels de Doctolib consultés par la rédaction de Next confirment que Microsoft Azure, Anthropic et Google Irlande figurent bien dans la liste des « sous-traitants ultérieurs » de l'entreprise, avec pour service déclaré la « fourniture du modèle de LLM » et pour finalité l'« analyse et création de contenu à des fins d'automatisation de tâches ». Doctolib dément catégoriquement que ces données médicales servent à entraîner les modèles de ses fournisseurs. Selon un porte-parole de l'entreprise, Microsoft, Anthropic et Google interviennent exclusivement comme prestataires techniques, sur instructions strictes de Doctolib, dans un cadre contractuel qui leur interdit d'utiliser les données à d'autres fins que la fourniture du service. En clair : les LLM américains sont bien mobilisés pour faire tourner les fonctionnalités de transcription et de synthèse, mais les notes médicales ne serviraient pas à affiner leurs poids. Sur le plan du stockage, Doctolib assure que les données sont hébergées sur des serveurs européens certifiés Hébergement de Données de Santé. Le Canard Enchaîné objecte toutefois que la justice américaine peut contraindre ces entreprises à transmettre des données outre-Atlantique, indépendamment de leur localisation physique. Cette controverse s'inscrit dans un débat plus large sur la souveraineté numérique des données de santé en France. Doctolib, qui traite des dizaines de millions de consultations, est une infrastructure critique du système de soins français, et toute ambiguïté sur le traitement de ses données sensitives déclenche une réaction immédiate. La tension entre innovation IA et protection des données médicales est structurelle : utiliser des LLM de pointe implique presque inévitablement de s'appuyer sur les infrastructures des géants américains, Microsoft, Google ou Anthropic, faute d'alternatives européennes comparables. Le RGPD et la certification HDS imposent des garanties, mais le Cloud Act américain crée un angle mort juridique que ni les certifications ni les contrats ne peuvent complètement combler. L'affaire illustre la fragilité des engagements de confidentialité dès lors que les données de santé transitent, même partiellement, par des acteurs soumis au droit américain.

UELes données médicales de millions de patients français transitent par des sous-traitants américains soumis au Cloud Act, créant une faille juridique structurelle que ni la certification HDS ni le RGPD ne peuvent entièrement combler.

💬 La distinction que fait Doctolib entre "faire tourner" et "entraîner" un LLM, elle est réelle. Mais ça n'enlève pas le truc qui gratte : tes comptes-rendus médicaux passent par des serveurs d'entreprises soumises au Cloud Act, et aucun label HDS ne te protège de ça. C'est une impasse structurelle, pas une faute de Doctolib spécifiquement.

ÉthiqueReglementation
1 source
Microsoft a désormais son propre modèle de raisonnement
17Next INpact 

Microsoft a désormais son propre modèle de raisonnement

Lors de sa conférence BUILD, Microsoft a dévoilé MAI-Thinking-1, son premier modèle de raisonnement maison, marquant une rupture significative dans la stratégie IA de l'entreprise. Ce modèle de type Mixture of Experts (MoE) embarque 35 milliards de paramètres actifs et une fenêtre de contexte de 256 000 tokens, soit l'équivalent d'environ 600 pages. Sur les benchmarks mathématiques AIME 2025 et 2026, il atteint respectivement 97 % et 94,5 %. Microsoft affirme qu'il égale Claude Opus 4.6 sur SWE-Bench Pro, un benchmark de codage, et qu'il a été préféré à Claude Sonnet 4.6 dans des évaluations indépendantes en aveugle conduites par Surge. CNBC rapporte même une démonstration affichant des résultats supérieurs à GPT-5.5 d'OpenAI, avec un coût dix fois inférieur sur des données McKinsey. Le modèle est actuellement en préversion privée via Microsoft Foundry, intégré à GitHub Copilot Enterprise, avec une version pour Azure Confidential Computing annoncée. La famille MAI s'enrichit également de six autres modèles : MAI-Image-2.5 et sa variante Flash pour la génération d'images (déployés dans PowerPoint et OneDrive), et MAI-Transcribe-1.5, présenté comme le meilleur modèle de transcription au monde. Jusqu'à présent, Microsoft occupait surtout le rôle de distributeur de modèles tiers, OpenAI via Copilot, Anthropic via ses assistants, sans disposer de sa propre capacité de raisonnement avancée. L'émergence de MAI-Thinking-1 change fondamentalement cette donne. Pour les entreprises utilisant Azure et GitHub Copilot Enterprise, cela signifie un accès à un modèle de raisonnement compétitif sans dépendre d'un fournisseur externe. Le fait que Microsoft insiste sur un entraînement "from scratch" à partir de données commercialement licenciées, sans distillation depuis d'autres modèles, est aussi un argument juridique et commercial fort pour les clients soucieux de conformité et de propriété intellectuelle. Ce pivot s'explique par une évolution du paysage des alliances. OpenAI, dans lequel Microsoft a investi plusieurs milliards de dollars, suit désormais sa propre trajectoire de manière nettement plus autonome. Anthropic, de son côté, a considérablement gagné en influence, notamment dans les usages développeurs. Pour Redmond, rester dans une position de simple relais devenait stratégiquement risqué. En développant sa propre gamme MAI, Microsoft affirme une indépendance technologique qui lui permet de négocier différemment avec ses partenaires LLM tout en proposant une offre intégrée de bout en bout. La prochaine étape sera la disponibilité générale du modèle et la publication de sa tarification complète sur les tokens de raisonnement, deux inconnues qui détermineront son adoption réelle face à des concurrents déjà bien établis.

UELes entreprises européennes utilisant Azure ou GitHub Copilot Enterprise pourront accéder à un modèle de raisonnement compétitif entraîné sur données commercialement licenciées, un argument de conformité pertinent face aux exigences de l'AI Act et du RGPD.

💬 Microsoft en simple distributeur d'OpenAI et d'Anthropic, ça ne pouvait pas durer. MAI-Thinking-1, c'est leur sortie de cette dépendance, et vu la trajectoire d'OpenAI ces derniers mois, on comprend le timing. Les benchmarks sont convaincants sur le papier (97% sur AIME, parité avec Claude Opus sur SWE-Bench), mais le vrai test, c'est la tarification complète et la sortie de preview.

OpenAI et Microsoft présentent de nouvelles offres IA aux entreprises
18The Information AI 

OpenAI et Microsoft présentent de nouvelles offres IA aux entreprises

Le même mardi, OpenAI et Microsoft ont chacun organisé un événement dédié aux entreprises, dans deux villes différentes. OpenAI a tenu une présentation à New York pour promouvoir de nouveaux outils d'intelligence artificielle à destination des professionnels, dont plusieurs conçus pour des secteurs précis comme le trading d'actions et la banque d'investissement. En parallèle, Microsoft tenait son propre événement à San Francisco, où l'entreprise a dévoilé du nouveau matériel informatique spécifiquement pensé pour l'IA, notamment un ordinateur de bureau et des modèles d'IA destinés aux entreprises clientes. Ces annonces simultanées illustrent la pression croissante que subissent les responsables des achats technologiques dans les grandes entreprises. La multiplication des offres d'IA entreprise rend les décisions d'achat de plus en plus complexes : chaque acteur majeur du secteur déploie désormais des équipes de consultants, souvent rebaptisés "forward-deployed engineers", pour convaincre les directions informatiques d'adopter leurs solutions. Pour OpenAI, dont le modèle économique repose largement sur les contrats d'entreprise, s'imposer sur ce segment est devenu une priorité stratégique et financière majeure. Le marché de l'IA en entreprise est aujourd'hui perçu comme un terrain sur lequel Anthropic, concurrent direct d'OpenAI, jouit d'une longueur d'avance et d'une image particulièrement solide auprès des directions techniques et des grands comptes. Microsoft, actionnaire historique d'OpenAI et partenaire de longue date des entreprises via Azure et la suite Office, occupe quant à lui une position établie dans cet écosystème. L'offensive conjointe des deux alliés témoigne néanmoins de l'intensification de la bataille pour capter les budgets informatiques des grandes organisations, à mesure que l'IA générative passe du stade expérimental à celui de l'outil opérationnel intégré dans les processus métier.

UELes entreprises européennes devront arbitrer entre les offres concurrentes d'OpenAI et Microsoft pour leurs budgets IA, avec une complexité croissante des décisions d'achat technologique à mesure que l'IA générative s'intègre dans les processus métier.

💬 Deux événements le même jour, deux villes différentes : OpenAI et Microsoft ne laissent plus rien au hasard sur le segment entreprise. Le signal, c'est qu'ils sentent tous les deux la pression d'Anthropic, qui s'est imposé chez les équipes techniques sans avoir eu besoin de tout ce cirque commercial. Reste à voir si les "forward-deployed engineers" suffisent à renverser ça.

NVIDIA et Microsoft s'associent pour un environnement unifié de déploiement d'agents IA, des appareils Windows au cloud
19NVIDIA AI Blog 

NVIDIA et Microsoft s'associent pour un environnement unifié de déploiement d'agents IA, des appareils Windows au cloud

NVIDIA et Microsoft ont dévoilé lors de Microsoft Build un partenariat élargi pour déployer une pile technologique unifiée dédiée à l'IA agentique, couvrant les PC Windows, le cloud Azure et les environnements locaux. Jensen Huang, fondateur et PDG de NVIDIA, est intervenu en direct depuis Taipei aux côtés de Satya Nadella pour présenter les nouvelles initiatives. Au programme : les PC RTX Spark et les stations DGX Station for Windows, l'accélération GPU de Microsoft Fabric, les modèles ouverts NVIDIA sur Microsoft Foundry, et le runtime sécurisé NVIDIA OpenShell intégré à GitHub Copilot. RTX Spark cible les laptops et petits ordinateurs de bureau avec 1 pétaflop de performance IA, jusqu'à 128 Go de mémoire unifiée et une autonomie toute la journée, avec des systèmes attendus cet automne chez Microsoft Surface, ASUS, Dell, HP, Lenovo et MSI. La DGX Station for Windows, propulsée par le superchip NVIDIA GB300 Grace Blackwell Ultra, offre jusqu'à 748 Go de mémoire cohérente et 20 pétaflops en FP4, capable de faire tourner des modèles jusqu'à 1 billion de paramètres, avec des livraisons prévues au quatrième trimestre 2026 chez ASUS, Dell, GIGABYTE, HP, MSI et Supermicro. Ce partenariat marque un tournant dans la course à l'IA agentique d'entreprise en proposant, pour la première fois, une chaîne complète allant du matériel personnel à l'infrastructure cloud. Pour les développeurs et les entreprises, cela signifie pouvoir construire, affiner et déployer des agents IA directement sur Windows sans dépendre exclusivement du cloud. Les modèles Claude d'Anthropic tournent désormais nativement sur les systèmes Blackwell Ultra dans Azure, avec une disponibilité annoncée dans les prochaines semaines. Sur Microsoft Foundry, le nouveau NVIDIA Nemotron 3 Ultra, conçu pour le raisonnement de longue durée dans des tâches de codage, de recherche et de workflows d'entreprise, est disponible dès ce mois-ci, accompagné de Nemotron 3.5 ASR pour la reconnaissance vocale et Nemotron 3.5 Content Safety pour la modération de contenu. Ce rapprochement intervient alors que l'ensemble de l'industrie cherche à concrétiser la promesse des agents IA autonomes capables d'exécuter des tâches complexes sur la durée. NVIDIA, dont les GPU sont devenus incontournables dans les data centers, étend son influence jusqu'au bureau et au PC personnel, concurrençant indirectement Apple Silicon et AMD sur le terrain de l'inférence locale. Le runtime OpenShell, sécurisé nativement, répond aux exigences de gouvernance des grandes entreprises qui hésitent encore à confier des tâches autonomes à des agents. L'intégration des bibliothèques CUDA-X comme cuDF, cuOpt et NeMo directement accessibles aux agents ouvre la voie à des workflows scientifiques plus complexes, notamment avec le modèle Cosmos 3 pour la simulation du monde physique et les modèles météo Earth-2 disponibles via Microsoft Planetary Computer Pro.

UELes entreprises européennes utilisant Azure et Windows bénéficieront d'une chaîne de déploiement IA unifiée du PC personnel au cloud, réduisant la dépendance exclusive à l'infrastructure cloud pour les workflows agentiques.

💬 Jensen Huang qui s'invite en hologramme depuis Taipei pendant le keynote de Satya, c'est le genre de mise en scène qui cache souvent un partenariat creux. Là, non : la DGX Station sous Windows avec 748 Go de mémoire cohérente et 20 pétaflops, c'est du concret pour les boîtes qui refusent de tout mettre dans Azure. Reste à voir si les prix seront accessibles à autre chose qu'aux grands comptes, mais l'idée d'une chaîne complète du laptop au datacenter sans changer de stack, ça change vraiment quelque chose pour les équipes qui font tourner des agents en prod.

InfrastructureActu
1 source
Microsoft dévoile sept modèles d’IA maison pour s’émanciper d’OpenAI et partir chasser sur les terres d’Anthropic et de Google
20Frandroid 

Microsoft dévoile sept modèles d’IA maison pour s’émanciper d’OpenAI et partir chasser sur les terres d’Anthropic et de Google

Lors de sa conférence Build, Microsoft a annoncé le lancement de sept modèles d'intelligence artificielle développés entièrement en interne, marquant une rupture stratégique significative avec sa dépendance historique à OpenAI. Cette famille de modèles maison, dévoilée devant les développeurs et partenaires de l'entreprise, couvre différentes tailles et usages, des modèles légers optimisés pour les appareils locaux aux versions plus puissantes destinées au cloud Azure. Microsoft positionne explicitement ces modèles face à Claude d'Anthropic et aux modèles Gemini de Google. Ce pivot vers l'autonomie technologique représente un changement profond pour les entreprises clientes de Microsoft, qui disposent désormais d'une alternative aux modèles OpenAI au sein même de l'écosystème Azure et Copilot. Pour les développeurs, cela signifie plus de choix, potentiellement des coûts différents et une moindre exposition aux aléas de la relation Microsoft-OpenAI. Pour l'industrie, c'est la confirmation que les grands éditeurs tech ne veulent plus sous-traiter le cerveau de leurs produits IA. Ce mouvement s'inscrit dans une tension croissante entre Microsoft et OpenAI, deux entités liées par un partenariat de plusieurs milliards de dollars mais dont les intérêts divergent à mesure qu'OpenAI se rapproche d'une structure commerciale indépendante. En bâtissant sa propre capacité de modélisation, Microsoft réduit sa vulnérabilité stratégique et entre directement en compétition avec les laboratoires qu'elle finançait indirectement. La guerre des modèles fondamentaux se joue désormais aussi dans les couloirs de Redmond.

UELes entreprises et développeurs européens utilisant Azure et Copilot disposent désormais d'alternatives aux modèles OpenAI, avec des implications potentielles sur les coûts et la dépendance stratégique au sein de l'écosystème Microsoft.

💬 C'est le genre de move qu'on voyait venir depuis que la relation Microsoft-OpenAI a commencé à craquer en public. Sept modèles d'un coup, du léger pour les appareils locaux au costaud pour Azure, ça ressemble moins à une annonce produit qu'à une déclaration d'indépendance. Bon, faut encore que ces modèles tiennent la route, parce que s'attaquer frontalement à Claude et Gemini, c'est pas anodin.

LLMsOpinion
1 source
Le jour d'indépendance de Microsoft dans l'IA
21The Information AI 

Le jour d'indépendance de Microsoft dans l'IA

Microsoft a ouvert mardi sa conférence annuelle Build 2026 à San Francisco, devant quelque 2 500 développeurs d'applications. L'événement prend cette année une coloration particulière : il survient deux mois après ce que la presse américaine a qualifié de "découplage conscient" entre Microsoft et OpenAI, et sert de vitrine officielle aux modèles d'intelligence artificielle que Microsoft développe désormais en propre, sans s'appuyer sur la technologie du créateur de ChatGPT ni sur celle d'Anthropic. Pour Microsoft, l'enjeu est de taille : prouver que sa division IA peut rivaliser de façon autonome sur un marché où OpenAI et Anthropic s'imposent comme références. Proposer ses propres modèles aux développeurs signifie réduire sa dépendance structurelle vis-à-vis d'un partenaire avec lequel les tensions se sont accumulées, tout en reprenant la main sur la chaîne de valeur. Pour les milliers d'équipes qui bâtissent des applications sur l'écosystème Microsoft, le signal est clair : une alternative interne existe désormais. Cette émancipation s'inscrit dans une reconfiguration profonde des alliances dans l'industrie de l'IA. Microsoft a investi des milliards de dollars dans OpenAI depuis 2019, intégrant ses modèles dans Azure, Copilot et Office. Mais la multiplication des acteurs, la montée en puissance des modèles open source et les frictions stratégiques entre les deux entreprises ont accéléré l'ambition de Redmond de contrôler sa propre pile technologique. Build 2026 marque symboliquement ce tournant.

UELes entreprises et développeurs européens qui s'appuient sur l'écosystème Microsoft (Azure, Copilot, Office 365) doivent anticiper une transition vers des modèles maison, avec des implications potentielles sur les contrats, les performances et la roadmap de leurs intégrations IA.

💬 Ça faisait longtemps que ça devait arriver. Mettre des milliards dans OpenAI tout en leur confiant toute la chaîne de valeur, c'est le genre de pari qui finit par se retourner contre toi. Bon, sur le papier c'est la bonne décision, mais leurs modèles maison vont devoir tenir la route face à Claude et GPT, pas juste sur les benchmarks.

BusinessOpinion
1 source
Anthropic rachète Stainless, la startup API convoitée par OpenAI et Google
22Le Big Data 

Anthropic rachète Stainless, la startup API convoitée par OpenAI et Google

Anthropic a annoncé le 18 mai 2026 l'acquisition de Stainless, une startup new-yorkaise fondée en 2022 par Alex Rattray, ancien ingénieur de Stripe. Spécialisée dans l'automatisation des SDK et des connecteurs API, Stainless avait bâti en quelques années une position de référence dans l'écosystème IA. Selon The Information, l'opération dépasserait les 300 millions de dollars. La technologie de Stainless transforme des spécifications d'API en kits de développement logiciel prêts pour la production, compatibles avec Python, Go, Java, Kotlin et TypeScript. Son avantage distinctif est la maintenance automatique de ces SDK : à chaque évolution d'une API, les bibliothèques sont mises à jour sans intervention humaine. Anthropic utilisait déjà Stainless depuis les premières versions de son API Claude, mais la startup fournissait également ses outils à OpenAI, Google, Replicate, Runway et Cloudflare. Ces clients perdront l'accès aux produits hébergés de Stainless, dont son générateur de SDK, bien qu'ils conservent la propriété des SDK déjà générés et le droit de les modifier. Cette acquisition positionne Anthropic sur un terrain stratégique qui dépasse le simple rachat technologique. Dans le marché de l'IA agentique, la valeur ne réside plus uniquement dans la puissance des modèles, mais dans leur capacité à se connecter à des systèmes externes, des bases de données et des logiciels métiers. Les SDK, serveurs MCP et connecteurs sont précisément la couche technique qui rend cette connexion possible. En intégrant Stainless, Anthropic renforce toute son infrastructure développeur autour de Claude et prive simultanément ses concurrents directs d'un fournisseur jusqu'ici commun. OpenAI et Google, qui comptaient sur ces outils, devront désormais trouver ou développer des alternatives, ce qui représente un coût de friction non négligeable pour leurs équipes techniques et leurs clients. Cette opération s'inscrit dans une logique que les grandes plateformes cloud ont perfectionnée depuis des décennies. AWS, Microsoft Azure et Google Cloud n'ont pas construit leur domination uniquement sur l'infrastructure brute, mais surtout sur des couches d'outils qui fidélisent les développeurs et rendent le changement de fournisseur coûteux. Anthropic applique aujourd'hui cette même recette au marché des agents IA, en s'appropriant une infrastructure critique juste au moment où la compétition s'intensifie. La société pousse parallèlement son protocole MCP, qui standardise la communication entre agents IA et applications tierces, et Stainless vient directement renforcer cette pile. Le rachat transforme Anthropic d'un fabricant de modèles en véritable opérateur d'infrastructure pour développeurs, un positionnement qui pourrait peser lourd dans la consolidation qui s'annonce dans le secteur.

UELes développeurs européens utilisant les outils Stainless via OpenAI ou Google devront migrer vers des alternatives, renforçant leur dépendance à l'écosystème Anthropic/Claude.

💬 Le vrai coup, c'est pas les 300 millions, c'est qu'OpenAI et Google perdent leur fournisseur de SDK commun du jour au lendemain. La maintenance automatique des bibliothèques à chaque évolution d'API, c'est invisible, mais c'est exactement le genre de truc qui colle aux mains et crée une vraie dépendance. Avec MCP qui pousse en parallèle, Anthropic est en train de bâtir la couche infrastructure dont on ne sort pas facilement.

5 % d'utilisation GPU : le problème d'infrastructure IA à 401 milliards de dollars que les entreprises ne peuvent plus ignorer
23VentureBeat AI 

5 % d'utilisation GPU : le problème d'infrastructure IA à 401 milliards de dollars que les entreprises ne peuvent plus ignorer

Les entreprises ont dépensé des milliards pour sécuriser des GPU à tout prix, et la facture est désormais présentée. Selon Gartner, l'infrastructure IA représente 401 milliards de dollars de nouvelles dépenses en 2025, mais des audits terrain révèlent une réalité bien plus sombre : le taux d'utilisation moyen des GPU en entreprise stagne à 5 %. Pendant deux ans, la panique du « GPU scramble » a poussé DSI et directions financières à constituer des réserves de capacité sous des cycles d'amortissement de trois à cinq ans. Ces actifs sont désormais des coûts fixes inscrits aux bilans, indépendamment de leur usage effectif. Les chiffres du Q1 2026 confirment le basculement : dans le baromètre de VentureBeat, le critère « accès aux GPU » est passé de 20,8 % à 15,4 % en un seul trimestre comme moteur principal des décisions d'achat, tandis que le coût par inférence et le TCO (coût total de possession) bondissaient de 34 % à 41 %, dépassant la performance pure comme critère dominant. À 5 % d'utilisation, l'arithmétique est brutale : pour chaque dollar investi en silicium, 95 centimes partent directement dans la marge des fournisseurs cloud. Dans n'importe quel autre département, un taux de gaspillage de 95 % serait un motif de licenciement ; dans l'infrastructure IA, on appelait ça de la « préparation ». Les grands groupes comme Intuit, Mastercard ou Pfizer, qui bénéficiaient de relations privilégiées avec AWS, Azure et GCP pour sécuriser des réservations de capacité, se sont retrouvés riches en GPU mais pauvres en production : des équipes internes paralysées par la gouvernance des données, la gravité des données et une immaturité architecturale persistante ont empêché toute valorisation réelle de ces ressources. Le discours dominant sur la rareté du silicium a servi d'écran commode pour masquer cette inefficacité structurelle. Ce virage marque la fin de l'ère du chèque en blanc. Le passage à une tarification à l'usage en 2026 transforme les architectures héritées des phases pilotes, pensées avec des tokens en coûts fixes, en véritables passifs financiers. Les agents en contexte long et les pipelines de récupération complexes, construits quand les tokens étaient un coût noyé dans des licences forfaitaires, deviennent intenables sous une facturation mesuréé. L'inférence n'est plus un projet tactique : c'est un modèle économique stratégique dont les unités économiques sont, pour la plupart des entreprises, encore insoutenables. La question n'est plus de savoir si les investissements passés étaient justifiés, mais comment extraire un retour mesurable d'une infrastructure déjà déployée avant que les cycles d'amortissement ne l'emportent.

UELes entreprises européennes investies en infrastructure GPU sont exposées au même risque de sous-utilisation à 5 %, avec des cycles d'amortissement sur 3-5 ans qui transforment ces actifs en passifs financiers au moment où le marché bascule vers une tarification à l'usage.

💬 5 % d'utilisation, c'est le genre de stat qui ferait renvoyer n'importe quel responsable infra dans un département classique. La panique du GPU scramble a servi de couverture : on achetait du silicium pour ne pas rater le train, sans se demander si les équipes data étaient capables d'en faire quelque chose. Le basculement vers le pay-as-you-go va transformer ces réserves en passifs, et ça va faire des dégâts.

InfrastructureOpinion
1 source
Dopés par l’IA, les géants du cloud projettent 700 milliards $ d’investissements en 2026
24Next INpact 

Dopés par l’IA, les géants du cloud projettent 700 milliards $ d’investissements en 2026

Microsoft, Meta, Amazon et Alphabet ont publié simultanément leurs résultats financiers le 29 avril 2026, tous supérieurs aux attentes, et tous accompagnés d'une révision à la hausse de leurs prévisions d'investissement dans l'intelligence artificielle. Additionnées, leurs enveloppes atteignent désormais 700 milliards de dollars pour l'année en cours. Google Cloud se distingue particulièrement avec un chiffre d'affaires bondissant de 12,26 à 20 milliards de dollars sur le seul premier trimestre, soit une progression de 60 %, adossée à un carnet de commandes dépassant 460 milliards. La maison mère Alphabet clôture le trimestre à près de 110 milliards de chiffre d'affaires, en hausse de 22 % sur un an, portée aussi bien par la publicité search (+20 %, à 60 milliards) que par YouTube. Amazon Web Services, leader mondial du cloud, enregistre pour sa part une croissance de 28 % sur un an, à 37,6 milliards de dollars, sa meilleure performance depuis quinze trimestres. Le trimestre a également vu AWS signer une trentaine de partenariats stratégiques avec OpenAI, Anthropic, NVIDIA, Meta, l'armée américaine et le groupe français Veolia. Ces chiffres signalent que l'IA n'est plus seulement un poste de dépenses pour les géants du cloud : elle est devenue un moteur de revenus mesurable. Sundar Pichai indique que les modèles Gemini traitent désormais plus de 16 milliards de tokens par minute via l'API, soit une hausse de 60 % par rapport au trimestre précédent. Chez Amazon, la division Bedrock aurait traité sur ce seul trimestre plus de tokens que sur toutes les années précédentes cumulées. Au-delà du cloud stricto sensu, l'IA irrigue désormais la publicité programmatique et les outils d'automatisation des achats médias, élargissant son impact à l'ensemble de l'écosystème numérique. Amazon monte également en puissance dans les semiconducteurs, avec une activité projetée à plus de 20 milliards de dollars annuels, positionnant le groupe comme fournisseur et premier client de ses propres puces. Cette publication groupée intervient dans un contexte où les interrogations sur une éventuelle bulle spéculative autour de l'IA se multiplient, sans que les résultats opérationnels ne les confirment pour l'instant. Les quatre groupes ont massivement investi dans les data centers et les infrastructures GPU depuis 2023, des dépenses qui commencent à se traduire en revenus récurrents via les contrats cloud longue durée. La concentration des investissements autour de quelques acteurs, AWS, Google Cloud, Azure, renforce une logique d'oligopole qui rend l'entrée sur ce marché structurellement difficile pour les challengers. Les prochains trimestres seront déterminants pour confirmer si cette dynamique tient face aux incertitudes tarifaires américaines et à la montée en puissance de concurrents chinois comme Alibaba Cloud ou Huawei.

UELe groupe français Veolia a signé un partenariat stratégique avec AWS, et la concentration des 700 milliards d'investissements autour de quelques acteurs américains renforce la dépendance structurelle des entreprises et États européens vis-à-vis du cloud américain.

💬 700 milliards, c'est plus une promesse, c'est du revenu qui rentre. AWS à +28 %, Google Cloud à +60 % sur un seul trimestre, bon, le discours sur la bulle spéculative devient difficile à tenir. Le vrai sujet, c'est l'oligopole qui se cimente, et pour les entreprises et États européens, cette dépendance va coûter cher.

BusinessOpinion
1 source
Le pari d'Amazon sur OpenAI marque une nouvelle phase dans la guerre du cloud, sans exclusivité
25VentureBeat AI 

Le pari d'Amazon sur OpenAI marque une nouvelle phase dans la guerre du cloud, sans exclusivité

Amazon Web Services a lancé mardi l'une des offensives les plus significatives de ses vingt ans d'histoire dans l'IA d'entreprise. Lors d'un événement à San Francisco intitulé "What's Next with AWS", le cloud d'Amazon a annoncé simultanément l'intégration des modèles OpenAI les plus puissants sur sa plateforme Bedrock, le lancement d'un nouveau framework de développement agentique, d'un outil de productivité desktop appelé Amazon Quick, et l'extension d'Amazon Connect en une famille de quatre solutions d'IA ciblant les chaînes d'approvisionnement, le recrutement, la santé et l'expérience client. Les modèles GPT-5.4 et GPT-5.5 d'OpenAI sont désormais accessibles via Bedrock en préversion limitée, avec une disponibilité générale attendue dans les prochaines semaines. Ces annonces sont intervenues exactement vingt-quatre heures après la restructuration publique du partenariat exclusif entre OpenAI et Microsoft, qui libère pour la première fois OpenAI de toute restriction de distribution vers d'autres fournisseurs cloud. Le PDG d'AWS, Matt Garman, a qualifié l'accord de "partenariat majeur", précisant que les clients réclamaient les modèles OpenAI sur AWS "depuis les tous premiers jours". L'impact concret pour les entreprises est immédiat. Anthony Liguori, vice-président et ingénieur distingué chez AWS, a souligné que l'intégration via les API sans état, les API chat completions et responses classiquement utilisées, supprime totalement la friction de migration : les clients peuvent basculer leurs charges de travail existantes sur AWS sans réécrire une seule ligne de code. Les modèles OpenAI rejoignent désormais sur Bedrock les offres d'Anthropic, Meta, Mistral, Cohere et les propres modèles d'Amazon, sous un cadre unifié de sécurité, gouvernance et contrôle des coûts. Pour les équipes achats des grandes entreprises, ce qui était un écosystème multi-fournisseurs fragmenté se consolide en un seul point d'accès. AWS positionne ainsi Bedrock comme l'infrastructure de référence pour l'ère des agents logiciels autonomes. Le chemin vers cette alliance n'a pas été linéaire. L'accord de 50 milliards de dollars entre Amazon et OpenAI, annoncé en février 2026, avait créé une tension juridique avec Microsoft, qui revendiquait une exclusivité sur les API stateless d'OpenAI via Azure. Le Financial Times avait même rapporté que Microsoft envisageait des poursuites judiciaires. Le nouvel accord signé lundi a remplacé cette exclusivité à durée indéterminée par une licence non exclusive courant jusqu'en 2032, débloquant ainsi la voie pour AWS. Ce repositionnement marque une rupture structurelle dans les guerres du cloud : la course à l'exclusivité des modèles IA laisse place à une compétition sur l'infrastructure, l'outillage et l'expérience développeur. OpenAI, désormais libre de distribuer ses modèles partout, joue la carte de la ubiquité, tandis qu'AWS et Microsoft s'affrontent sur leur capacité à être la meilleure plateforme pour les déployer à l'échelle.

UELa consolidation du cloud IA entre AWS et OpenAI renforce la domination américaine sur l'infrastructure IA, réduisant l'espace stratégique pour des acteurs européens comme Mistral, déjà présent sur Bedrock mais en position minoritaire face à des plateformes unifiées.

BusinessOpinion
1 source
Entre OpenAI et Microsoft la rupture se précise : ChatGPT peut aller se vendre ailleurs
26Frandroid 

Entre OpenAI et Microsoft la rupture se précise : ChatGPT peut aller se vendre ailleurs

OpenAI et Microsoft ont revu en profondeur les termes de leur partenariat historique, conclu en 2019 et renforcé par des investissements cumulés de Microsoft dépassant les 13 milliards de dollars. Selon les nouvelles modalités de l'accord, OpenAI n'est plus tenu de distribuer exclusivement ses modèles et services via Azure, le cloud de Microsoft. La startup peut désormais nouer des accords commerciaux avec d'autres fournisseurs d'infrastructure, tout en maintenant une relation privilégiée avec Redmond, qui conserve un accès prioritaire aux technologies d'OpenAI. Ce changement redistribue les cartes dans la compétition pour l'infrastructure IA. Google Cloud, Oracle ou encore Amazon Web Services peuvent désormais accueillir les API d'OpenAI, ce qui ouvre à la startup un marché bien plus large pour monétiser ses modèles. Pour les entreprises clientes, cela signifie davantage de flexibilité : elles pourront intégrer GPT-4o ou d'autres modèles sans passer obligatoirement par Azure. Microsoft, de son côté, perd un avantage concurrentiel majeur qui lui avait permis de dominer le segment entreprise de l'IA depuis 2023. Ce rééquilibrage s'inscrit dans la transformation profonde qu'OpenAI traverse depuis fin 2024 : la startup accélère sa conversion en société à but lucratif classique et prépare une potentielle introduction en bourse, estimant sa valeur autour de 300 milliards de dollars. Prendre ses distances avec un partenaire unique devient une nécessité stratégique pour attirer de nouveaux investisseurs et démontrer son autonomie commerciale. Microsoft reste actionnaire et partenaire de référence, mais l'ère de l'exclusivité de fait semble bel et bien révolue.

UELes entreprises européennes utilisant les API OpenAI via Azure pourront désormais choisir d'autres fournisseurs cloud, réduisant leur dépendance à un fournisseur unique et potentiellement renégociant leurs contrats d'infrastructure IA.

BusinessOpinion
1 source
Fin de l’exclusivité, revenus plafonnés : les coulisses du nouveau deal Microsoft et OpenAI
27Le Big Data 

Fin de l’exclusivité, revenus plafonnés : les coulisses du nouveau deal Microsoft et OpenAI

Le 27 avril 2026, Microsoft et OpenAI ont officialisé une refonte en profondeur de leur partenariat stratégique, noué en 2019. Les deux entreprises ont annoncé la fin de l'exclusivité stricte qui liait jusqu'ici leurs relations commerciales, l'introduction d'un plafond sur les flux financiers mutuels, et une ouverture explicite au multi-cloud. Concrètement, Microsoft conserve son statut de partenaire cloud prioritaire jusqu'en 2032, ce qui signifie que les produits OpenAI continueront d'être lancés en premier sur Azure. Mais OpenAI peut désormais distribuer ses solutions sur d'autres infrastructures cloud, notamment si certaines fonctionnalités ne sont pas supportées par Microsoft. Côté propriété intellectuelle, la licence accordée à Microsoft sur les modèles OpenAI reste valable jusqu'en 2032, mais devient non exclusive. Sur le plan financier, Microsoft cesse de verser sa part de revenus à OpenAI, tandis que les flux inverses sont maintenus jusqu'en 2030 avec un plafond global. Microsoft demeure actionnaire clé d'OpenAI, et les deux partenaires poursuivront des projets communs, dont l'expansion de centres de données à l'échelle du gigawatt et le développement de semi-conducteurs dédiés à l'IA. Cet accord redistribue les cartes dans l'économie de l'IA générative en entreprise. Pour OpenAI, la liberté de déployer sur d'autres clouds est un gain commercial majeur : l'entreprise peut désormais répondre aux besoins clients sur AWS, Google Cloud ou Oracle sans dépendre du bon vouloir de Microsoft. Pour les entreprises utilisatrices, cela signifie davantage de choix d'infrastructure sans renoncer aux modèles d'OpenAI. Pour Microsoft, l'assouplissement est un pari calculé : Azure perd son monopole de fait sur les modèles GPT, mais le plafond de revenus et le maintien d'un accès privilégié limitent les risques financiers et technologiques. La logique de revenus bornés introduit surtout une prévisibilité que les deux groupes jugent préférable à une dépendance mutuelle de plus en plus contraignante dans un marché en accélération. Depuis les premiers investissements de Microsoft en 2019, puis le passage à plusieurs milliards de dollars injectés au fil des années, ce partenariat a structuré la montée en puissance de l'IA générative dans le monde professionnel, faisant d'Azure la porte d'entrée quasi obligatoire pour les entreprises voulant exploiter GPT-4 ou les modèles successeurs. Mais l'émergence de rivaux crédibles, Anthropic chez Amazon, Gemini chez Google, ainsi que la multiplication des cas d'usage et des clients souhaitant éviter un fournisseur unique, rendaient l'architecture exclusive de moins en moins tenable. Sam Altman a confirmé la nouvelle sur X dès le 27 avril, soulignant qu'OpenAI reste engagé à fournir modèles et produits à Microsoft jusqu'en 2032. La prochaine étape à surveiller est la conversion d'OpenAI en société à but lucratif classique, un processus en cours qui renforcera encore l'autonomie stratégique de l'entreprise vis-à-vis de ses partenaires historiques.

UELes entreprises européennes utilisant OpenAI gagnent en flexibilité d'infrastructure cloud, pouvant désormais déployer les modèles OpenAI sur AWS, Google Cloud ou Oracle sans dépendre exclusivement d'Azure.

💬 L'exclusivité, c'était une coquille qui craquait de partout. OpenAI peut maintenant déployer sur AWS ou GCP sans demander la permission à Microsoft, et pour les entreprises qui voulaient éviter de tout concentrer sur Azure, c'est un soulagement réel. Reste à voir si le "partenaire prioritaire jusqu'en 2032" c'est du cosmétique ou si Azure garde vraiment la main.

BusinessOpinion
1 source
Microsoft et OpenAI mettent fin à l'exclusivité de leur accord, ouvrant AWS et Google Cloud à OpenAI
28VentureBeat AI 

Microsoft et OpenAI mettent fin à l'exclusivité de leur accord, ouvrant AWS et Google Cloud à OpenAI

Microsoft et OpenAI ont annoncé lundi une refonte majeure de leur partenariat, mettant fin à l'exclusivité commerciale qui liait les deux entreprises depuis 2019. Selon les nouvelles modalités, OpenAI peut désormais distribuer ses produits sur n'importe quel fournisseur cloud, y compris Amazon Web Services et Google Cloud, une rupture avec l'accord initial qui réservait exclusivement à Azure l'hébergement de l'API d'OpenAI. Microsoft cesse de percevoir une part de revenus sur les accès aux modèles d'OpenAI via Azure, tandis qu'OpenAI continuera de reverser 20 % de ses recettes à Microsoft jusqu'en 2030, avec un plafond global désormais fixé. Microsoft conserve une licence sur la propriété intellectuelle d'OpenAI jusqu'en 2032, mais celle-ci est explicitement non exclusive. Les deux entreprises ont présenté cet accord dans des billets de blog publiés simultanément lundi. Cette restructuration ouvre la voie à OpenAI pour séduire les grandes entreprises qui exigent une flexibilité multi-cloud. Ces clients, le segment à la croissance la plus rapide d'OpenAI, refusaient de dépendre d'un seul fournisseur d'infrastructure. En permettant à OpenAI de vendre directement sur AWS et Google Cloud, l'accord lève un frein commercial majeur à un moment où la concurrence entre fournisseurs de modèles s'intensifie. Pour Microsoft, la fin de la part de revenus sur Azure représente un manque à gagner potentiel, mais l'entreprise conserve un accès privilégié et une licence sur la technologie d'OpenAI jusqu'en 2032. Pour l'industrie dans son ensemble, ce virage signale que même les alliances technologiques les plus exclusives cèdent sous la pression des réalités commerciales. Le partenariat originel remontait à 2019, quand Microsoft avait investi 1 milliard de dollars dans OpenAI, avant de porter ses engagements cumulés à plus de 13 milliards. En échange, Microsoft obtenait un accès commercial exclusif aux modèles d'OpenAI et à sa propriété intellectuelle. L'accord contenait même une clause philosophique singulière : l'exclusivité de Microsoft devait durer jusqu'à ce qu'OpenAI atteigne l'intelligence artificielle générale, dont la définition était laissée à la discrétion du conseil d'administration d'OpenAI. Ce modèle fonctionnait quand OpenAI n'était qu'un laboratoire de recherche, mais l'explosion de ChatGPT fin 2022 et la montée en flèche des revenus vers plusieurs milliards de dollars annuels ont rendu la contrainte insoutenable. La directrice des revenus d'OpenAI, Denise Dresser, avait récemment reconnu en interne que le partenariat "limitait la capacité de l'entreprise à rejoindre les clients là où ils se trouvent". Après des mois de tensions en coulisses, de contradictions publiques et de menaces de litiges, les deux entreprises ont choisi de transformer leur alliance exclusive en une relation commerciale stratégique mais nettement plus souple.

UELes entreprises européennes utilisant OpenAI gagnent en flexibilité multi-cloud, pouvant désormais déployer les modèles sur AWS et Google Cloud sans dépendance exclusive à Azure.

BusinessOpinion
1 source
Fin de l'exclusivité : Microsoft autorise OpenAI à recourir à d'autres fournisseurs cloud
29Ars Technica AI 

Fin de l'exclusivité : Microsoft autorise OpenAI à recourir à d'autres fournisseurs cloud

Microsoft et OpenAI ont annoncé conjointement une révision majeure de leur accord de partenariat, mettant fin à l'exclusivité qui liait les deux entreprises depuis 2019. Selon les termes du nouvel accord, OpenAI pourra désormais proposer l'ensemble de ses produits et modèles à des clients utilisant n'importe quel fournisseur cloud, et non plus exclusivement Microsoft Azure. Microsoft conserve néanmoins une licence sur la propriété intellectuelle et les modèles d'OpenAI jusqu'en 2032, et Azure demeure le "partenaire cloud principal" de l'entreprise pendant cette période. Le partage de revenus de 20 % versé par OpenAI à Microsoft est maintenu, mais il sera désormais plafonné à un montant non divulgué et uniquement garanti jusqu'en 2030. Ce changement ouvre une brèche considérable dans l'un des accords les plus structurants de l'industrie de l'intelligence artificielle. OpenAI pourra désormais nouer des partenariats avec des concurrents d'Azure comme Amazon Web Services ou Google Cloud Platform, intensifiant la compétition entre les géants du cloud pour héberger les modèles les plus puissants du marché. Pour les entreprises clientes d'OpenAI, cela signifie potentiellement plus de flexibilité dans le choix de leur infrastructure. Côté Microsoft, l'accord reste avantageux sur le plan de la licence, mais le groupe cède une position d'exclusivité qu'il détenait depuis six ans. Le partenariat originel avait débuté en 2019 avec un investissement initial de Microsoft d'un milliard de dollars, suivi d'engagements supplémentaires estimés à plusieurs milliards. L'un des points les plus controversés de l'accord initial était la "clause AGI" : elle prévoyait la fin de l'exclusivité si OpenAI venait à atteindre le seuil de l'intelligence artificielle générale, un critère notoirement difficile à définir. La révision annoncée rend désormais le partage de revenus "indépendant des progrès technologiques d'OpenAI", supprimant de fait cette clause ambiguë. Cette évolution intervient alors qu'OpenAI cherche à s'affirmer comme une entreprise pleinement indépendante, dans un contexte où les débats autour de sa gouvernance et de son statut à but non lucratif continuent d'agiter la Silicon Valley.

UELes entreprises européennes clientes d'OpenAI pourront désormais choisir librement leur fournisseur cloud (AWS, GCP) au lieu d'être contraintes à Azure, offrant plus de flexibilité stratégique et potentiellement de meilleures conditions tarifaires.

BusinessOpinion
1 source
Microsoft et OpenAI mettent fin à leur accord exclusif et s'ouvrent aux clouds concurrents
30Interesting Engineering 

Microsoft et OpenAI mettent fin à leur accord exclusif et s'ouvrent aux clouds concurrents

Microsoft et OpenAI ont officiellement mis fin à leur relation exclusive le 27 avril 2026, restructurant en profondeur l'accord qui liait les deux entreprises depuis plusieurs années. Selon les termes révisés, OpenAI pourra désormais proposer ses produits et services sur l'ensemble des plateformes cloud, y compris AWS d'Amazon et Google Cloud d'Alphabet, alors qu'Azure de Microsoft était jusqu'ici le seul partenaire autorisé. Microsoft conserve son statut de partenaire cloud principal et bénéficie d'une licence non exclusive sur les modèles et produits d'OpenAI jusqu'en 2032. Sur le plan financier, Microsoft cesse de percevoir une part des revenus générés via Azure, tandis qu'OpenAI continuera de lui verser une commission jusqu'en 2030, mais plafonnée et désormais découplée des jalons technologiques comme l'intelligence artificielle générale, qui conditionnaient auparavant les versements. Ce changement ouvre concrètement le marché entreprise à OpenAI d'une façon qui n'était pas possible jusqu'ici. Gil Luria, analyste chez D.A. Davidson & Co., l'a formulé clairement dans les colonnes de Reuters : les clients AWS et Google Cloud étaient freinés dans leur adoption des outils OpenAI précisément à cause de l'exclusivité, et ils vont désormais pouvoir envisager OpenAI aux côtés d'Anthropic. Pour les grandes organisations qui opèrent en dehors de l'écosystème Microsoft, c'est une levée de verrou majeure. Les analystes de Barclays y voient un bénéfice mutuel : Microsoft réduit sa charge d'infrastructure, tandis qu'OpenAI accélère son déploiement à grande échelle sans dépendre d'un seul fournisseur. Cette évolution s'inscrit dans un contexte de maturité du marché de l'IA d'entreprise, mais aussi de pression réglementaire croissante aux États-Unis, au Royaume-Uni et en Europe, où l'exclusivité entre les deux géants suscitait des inquiétudes sur la concurrence dans le cloud. De son côté, Microsoft diversifie déjà sa stratégie IA en développant ses propres modèles et en intégrant des alternatives comme ceux d'Anthropic dans Microsoft 365 Copilot. OpenAI, pour sa part, avait anticipé ce tournant en sécurisant d'autres partenariats cloud pour augmenter sa capacité de calcul. Les deux entreprises ont annoncé qu'elles poursuivront leur collaboration sur l'expansion des centres de données, le co-développement de puces avancées et la cybersécurité pilotée par l'IA. Le partenariat n'est plus exclusif, mais il reste structurant pour l'avenir de l'IA en entreprise.

UELes entreprises européennes hébergées sur AWS ou Google Cloud peuvent désormais adopter les outils OpenAI sans migrer vers Azure, ce qui répond aux préoccupations des régulateurs européens sur la concurrence dans le marché cloud IA.

💬 C'était écrit, et franchement j'attendais ça. L'exclusivité Azure freinait des pans entiers du marché enterprise (les boîtes sur AWS ou GCP ne voulaient pas migrer juste pour accéder aux outils OpenAI), sans compter les régulateurs européens qui commençaient à montrer les dents. OpenAI récupère sa liberté de distribution, Microsoft conserve sa licence et sa commission jusqu'en 2032, tout le monde rentre à la maison content, sur le papier du moins.

BusinessOpinion
1 source
Gemini Enterprise : Google lance sa plateforme unifiée pour orchestrer des agents IA
31Le Big Data 

Gemini Enterprise : Google lance sa plateforme unifiée pour orchestrer des agents IA

Google a présenté le 22 avril 2026, lors de Google Cloud Next 2026, Gemini Enterprise : une plateforme unifiée conçue pour orchestrer des flottes d'agents IA à l'échelle de l'entreprise. La nouveauté fusionne l'application Gemini Enterprise pour les utilisateurs finaux et la nouvelle Gemini Enterprise Agent Platform pour les développeurs, absorbant au passage Vertex AI qui disparaît en tant que plateforme indépendante. Plus de 200 modèles sont accessibles via Model Garden, dont les dernières générations Gemini mais aussi des modèles tiers d'Anthropic et autres. La marketplace intégrée permet de connecter des agents issus de partenaires comme Oracle, ServiceNow, Adobe, Salesforce ou Workday. Du côté technique, la plateforme introduit Agent Studio pour le développement low-code, un SDK basé sur des graphes pour les systèmes multi-agents, et Agent Runtime pour des agents capables de fonctionner en continu pendant des heures, voire des jours. Des outils d'optimisation complètent l'ensemble : Agent Simulation, Evaluation et Observability. Pour les directions informatiques, la gouvernance est au coeur du dispositif. Chaque agent se voit attribuer une identité cryptographique via Agent Identity, tandis qu'un registre central valide les outils et agents autorisés, et qu'Agent Gateway applique les politiques de sécurité à l'échelle de l'organisation. La couche de protection intègre Model Armor pour contrer les injections malveillantes et les fuites de données, appuyée par Security Command Center pour la détection des vulnérabilités. Du côté des équipes métier, Agent Designer permet de créer et déployer des agents sans écrire de code, depuis une interface unique avec boîte de réception centralisée, espaces projets à mémoire partagée et outil collaboratif Canvas pour produire des documents exportables vers Microsoft Office. Un agent Data Insights natif analyse données structurées et non structurées pour générer visualisations et rapports, tandis que Deep Research synthétise sources web et données internes. Ce lancement s'inscrit dans une course intense entre les grands acteurs du cloud pour capter les budgets IA des entreprises. Microsoft, avec Copilot Studio et Azure AI Foundry, Amazon avec Bedrock Agents, et Salesforce avec Agentforce occupent le même terrain. Google répond en cassant la fragmentation de son offre précédente : Vertex AI, Duet AI, Gemini for Workspace coexistaient sans cohérence claire pour les acheteurs. En absorbant tout dans une plateforme unique, Google vise à simplifier les cycles de vente et à verrouiller les grandes entreprises dans son écosystème. La compatibilité revendiquée avec Microsoft 365 et Google Workspace trahit la volonté de ne pas imposer une migration brutale, mais de s'intégrer aux environnements existants. L'enjeu des prochains mois sera la disponibilité réelle de ces fonctionnalités et leur tenue à l'échelle, deux points sur lesquels les annonces de Cloud Next ont historically précédé des déploiements progressifs.

UELes entreprises européennes utilisant Google Cloud devront évaluer la migration vers cette plateforme unifiée, dont les mécanismes de gouvernance (identité cryptographique des agents, registre central, audit de sécurité) pourraient faciliter la mise en conformité avec l'AI Act.

OutilsOutil
1 source
32The Decoder 

Amazon investit 33 milliards dans Anthropic, qui s'engage à dépenser 100 milliards sur AWS

Amazon a annoncé un investissement supplémentaire pouvant atteindre 25 milliards de dollars dans Anthropic, portant l'engagement total du géant du e-commerce à environ 33 milliards de dollars dans la startup d'intelligence artificielle. En contrepartie, Anthropic s'est engagée à dépenser plus de 100 milliards de dollars sur l'infrastructure cloud d'Amazon Web Services au cours des dix prochaines années. Cet accord massif vise notamment à répondre à la tension croissante sur les capacités de calcul dont Anthropic a besoin pour entraîner et déployer ses modèles Claude à grande échelle. L'impact de ce partenariat est considérable pour l'ensemble de l'industrie de l'IA. Pour Anthropic, l'accès garanti à une infrastructure AWS de cette ampleur lui permet de rivaliser avec OpenAI et Google DeepMind sans être freinée par des contraintes de capacité. Pour Amazon, l'accord consolide AWS comme fournisseur cloud de référence pour les acteurs de l'IA générative, un marché en pleine explosion où Microsoft Azure et Google Cloud se disputent chaque contrat stratégique. Ce deal illustre parfaitement la dynamique circulaire qui caractérise désormais le secteur : les grands fournisseurs cloud injectent des milliards dans des startups IA, qui recyclent immédiatement ces fonds en achats d'infrastructure chez ces mêmes investisseurs. Amazon avait déjà investi 4 milliards de dollars dans Anthropic en 2023, avant un second engagement de plusieurs milliards en 2024. Cette escalade des montants reflète la course aux ressources de calcul qui structure la compétition mondiale en intelligence artificielle, où la puissance de traitement est devenue l'actif stratégique le plus convoité.

UELe renforcement d'AWS comme infrastructure cloud dominante pour l'IA générative accentue la dépendance des entreprises européennes envers les hyperscalers américains, creusant l'écart avec les ambitions de souveraineté numérique portées par le Cloud de Confiance et les initiatives européennes.

33Le Big Data 

Pourquoi les infrastructures cloud dédiées à l’IA deviennent un enjeu stratégique en Europe ?

Le groupe SWI (Stoneweg Icona Group) a annoncé l'acquisition d'une participation majoritaire dans Polarise, une société allemande spécialisée dans les infrastructures cloud pour l'intelligence artificielle, valorisant cette dernière à 500 millions d'euros. En parallèle, SWI s'engage à injecter un milliard d'euros supplémentaires pour accélérer le développement de ce qui se veut le premier opérateur d'infrastructures numériques souveraines à l'échelle européenne. Polarise dispose déjà de 14 centres de données opérationnels à travers l'Europe, d'une capacité totale de 2,3 GW via sa plateforme AiOnX, et d'un partenariat privilégié avec Nvidia lui donnant accès direct aux GPU les plus puissants du marché. La société a également lancé la première "AI Factory" d'Allemagne en collaboration avec Deutsche Telekom, positionnant d'emblée ce rapprochement comme une initiative industrielle de premier plan. Max-Hervé George, fondateur et PDG de SWI Group, pilote cette stratégie d'intégration verticale, couvrant la chaîne complète du foncier aux logiciels cloud. L'enjeu est considérable : les entreprises et gouvernements européens cherchent à réduire leur dépendance aux hyperscalers américains, AWS, Azure, Google Cloud, pour les charges de travail les plus sensibles. L'acquisition permet à SWI de proposer un modèle "GPU-as-a-Service" permettant aux organisations de louer de la puissance de calcul GPU à la demande, sans investissement lourd en matériel, via une infrastructure localisée en Europe et soumise au droit européen. Pour les industries de pointe en Allemagne, en France ou en Norvège, cela représente un accès à des capacités de calcul haute performance sans compromis sur la souveraineté des données. Ce modèle favorise également une innovation plus rapide pour les startups et PME qui n'ont pas les moyens de construire leur propre infrastructure. Cette opération s'inscrit dans un mouvement plus large de structuration de la filière IA européenne face à la domination des géants américains et à la montée en puissance des acteurs chinois. L'Union européenne multiplie depuis plusieurs années les appels à bâtir une capacité numérique autonome, notamment à travers le règlement sur l'IA et les investissements du programme Horizon. La rareté des GPU Nvidia, dont Polarise est revendeur agréé, confère à cette alliance un avantage concurrentiel structurel dans un marché sous tension. Les prochaines étapes visent l'extension géographique vers l'Allemagne et la Norvège, deux pays disposant d'une énergie abondante et bon marché indispensable pour alimenter ces infrastructures énergivores. Si SWI tient ses engagements d'investissement, le groupe pourrait devenir un acteur de référence pour les contrats publics et les grandes entreprises cherchant une alternative crédible aux solutions extraeuropéennes.

UEL'acquisition crée un opérateur cloud souverain européen offrant aux entreprises et gouvernements de l'UE une alternative concrète aux hyperscalers américains pour leurs charges de travail sensibles, avec accès aux GPU Nvidia via une infrastructure soumise au droit européen.

InfrastructureOpinion
1 source
34AI News 

Commvault déploie une fonction 'Annuler' pour les charges de travail d'IA dans le cloud

Paragraphe 1 (Les faits): Le fournisseur de protection des données, Commvault, a déployé "AI Protect", une solution qui offre une fonctionnalité 'annuler' pour les agents d'IA dans les environnements cloud entreprises. Ces agents autonomes peuvent potentiellement supprimer des fichiers, lire des bases de données, lancer des clusters de serveurs et même modifier les politiques d'accès. AI Protect surveille ces actions au sein d'AWS, Microsoft Azure et Google Cloud. Les outils traditionnels de gouvernance reposent sur des règles statiques ; toute action est clairement attribuée à un utilisateur humain. Les agents d'IA, en revanche, montrent un comportement émergent. Ils combinent les autorisations approuvées de manière imprévue pour résoudre des problèmes complexes. Si un agent juge que la suppression complète d'une base de données de production optimise les coûts de stockage en nuage, il exécutera rapidement cette commande, bien plus vite qu'un ingénieur humain pourrait réagir. Paragraphe 2 (Pourquoi c'est important): L'introduction d'une telle fonctionnalité est cruciale car les agents d'IA peuvent effectuer des actions destructrices en millisecondes, bien plus rapidement que les équipes de sécurité opérationnelles humaines peuvent réagir. AI Protect force ces acteurs cachés à l'éclairage en identifiant et surveillant leurs activités spécifiques via des appels API et interactions de données, à travers les principaux fournisseurs cloud. La fonction de retour en arrière offre une sécurité essentielle : les administrateurs peuvent restaurer l'environnement à son état exact avant que le modèle n'initie la séquence destructrice si l'agent commet une erreur ou malinterprète une commande. Cependant, en raison de la nature très interconnectée et de l'état-état des infrastructures cloud, un simple restaure d'une table de base de données n'est pas suffisant ; tous les changements apportés par le machine doivent être précisément suivis, y compris modifications de règles de réseau, triggers de fonctions serveurless et ajustements des politiques de gestion des identités. Paragraphe 3 (Le contexte): Ce développement survient à mesure que les entreprises doivent faire face aux défis croissants posés par l'utilisation croissante des agents d'IA, souvent créés et déployés sans supervision par les développeurs. Les outils de gouvernance évoluent pour répondre à cette nouvelle réalité. Commvault joue un rôle clé en bridant l'architecture de sauvegarde traditionnelle avec la surveillance continue du cloud, en cartographiant ainsi le rayon d'impact des sessions des agents d'IA pour isoler les dommages et éviter les retours arrière indiscriminés pouvant effacer des transactions clients valides ou annuler des travaux légitimes effectués par des ingénieurs humains. À mesure que les machines continuent d'exécuter des tâches plus rapidement que les opérateurs humains peuvent les surveiller, l'accent est mis sur la mise en place de garde-fous pour permettre un revers instantané et précis des actions autonomes.

UECommvault offre une solution cruciale pour surveiller et contrôler les actions potentiellement destructrices des agents d'IA dans les environnements cloud, atténuant ainsi les risques de sécurité pour les entreprises européennes.

💬 Un bouton "annuler" pour les agents IA, c'est exactement le genre de truc qu'on aurait dû exiger avant de lâcher ces trucs en prod. Le vrai problème, c'est que dans un cloud bien emmêlé, rollback une table ne suffit pas : il faut tout retracer, les règles réseau, les fonctions serverless, les IAM policies modifiées dans la foulée. Commvault a visiblement compris ça, bon, reste à voir si leur cartographie tient en conditions réelles.

SécuritéActu
1 source
35The Information AI 

Microsoft freine ses investissements dans l'IA et cherche maintenant à rattraper son retard

Microsoft se retrouve aujourd'hui en retard dans la course aux infrastructures d'intelligence artificielle, après une série de décisions qui lui ont coûté une avance considérable sur ses concurrents. Au début du boom de l'IA, l'équipe infrastructure de l'entreprise avait constitué un portefeuille de sites de data centers représentant 9 gigawatts de capacité électrique, l'équivalent de neuf réacteurs nucléaires, ce qui faisait l'envie du secteur. Mais fin 2024 et début 2025, face à des dépenses d'investissement en infrastructure qui menaçaient de dépasser les 80 milliards de dollars budgétés pour l'exercice fiscal, la directrice financière Amy Hood a mis le frein. L'équipe énergie de Microsoft a dû abandonner ou suspendre plusieurs projets de data centers en cours, aussi bien aux États-Unis qu'en Europe. En octobre dernier, Hood reconnaissait publiquement que le service cloud Azure manquait de capacité. "Je pensais que nous allions rattraper notre retard. Ce n'est pas le cas", déclarait-elle lors d'un appel aux investisseurs. Microsoft restera "limité en capacité" au moins jusqu'à la fin de son exercice fiscal en juin 2026. Les conséquences de ce retrait ont été immédiates et concrètes pour la position compétitive de Microsoft. Google, Oracle et d'autres acteurs ont profité du vide laissé pour avancer leurs propres projets et sécuriser des raccordements au réseau électrique que Microsoft avait abandonnés. Oracle a récupéré une part importante de la capacité disponible pour son data center en construction à Port Washington, dans le Wisconsin, destiné à accueillir les besoins d'OpenAI. Google a accéléré le développement de deux campus en Indiana pendant que Microsoft était en mode attente. Plusieurs membres de l'équipe énergie ont depuis quitté l'entreprise, dont le directeur énergie Bobby Hollis, dont le départ a été annoncé le 31 mars 2026. Pour combler l'écart, Microsoft a signé des accords avec des partenaires tiers, dont les acteurs spécialisés Nscale et Crusoe, ainsi qu'avec le géant énergétique Chevron et le fonds Engine No. 1, en misant sur une production électrique privée hors réseau alimentée au gaz naturel, notamment au Texas et en Virginie-Occidentale. Cette situation s'inscrit dans un contexte de tension structurelle sur le réseau électrique américain, où obtenir un raccordement peut prendre plusieurs années. Microsoft n'est pas en mesure de retrouver sa place dans les files d'attente des opérateurs réseau qu'elle a libérées. Certains observateurs, dont des responsables d'infrastructure familiers des projets, estiment que la discipline budgétaire imposée par Hood pourrait néanmoins s'avérer judicieuse à long terme : en transférant une partie du risque de construction à ses partenaires, Microsoft préserve sa flexibilité pour acquérir des sites à des conditions plus favorables dans un marché qui commence à se rationaliser. Alistair Speirs, directeur général de l'infrastructure Azure, a défendu une "approche fondée sur la flexibilité et les options", en fonction des signaux de demande à court et long terme.

UEMicrosoft a suspendu plusieurs projets de data centers en Europe, réduisant la capacité cloud Azure disponible pour les entreprises européennes et retardant l'accès à l'infrastructure IA dans la région.

💬 9 gigawatts en portefeuille, et ils ont lâché les raccordements réseau au pire moment. Dans un marché où se connecter au réseau électrique prend parfois des années, tu ne reviens pas dans la file une fois que t'en es sorti, peu importe le budget que tu remets sur la table ensuite. Google et Oracle n'ont pas eu besoin de se battre, ils ont juste ramassé ce que Microsoft avait laissé.

InfrastructureActu
1 source
Sauver la France et l’Europe face à l’IA : Mistral AI pousse 22 mesures d’urgence
36Le Big Data 

Sauver la France et l’Europe face à l’IA : Mistral AI pousse 22 mesures d’urgence

Mistral AI, la licorne française valorisée 11,7 milliards d'euros, a publié un document détaillant 22 mesures d'urgence pour permettre à l'Europe de ne pas se laisser distancer par les États-Unis et la Chine dans la course à l'intelligence artificielle. Parmi les propositions phares figure la création d'une "AI blue card", un titre de séjour simplifié inspiré de la carte bleue européenne, destiné à faciliter l'installation de chercheurs et développeurs étrangers sur le continent. L'entreprise appelle également à instaurer une préférence européenne dans les marchés publics, à introduire des incitations fiscales pour l'adoption d'infrastructures locales, et à centraliser les oeuvres du domaine public afin d'alimenter l'entraînement des modèles d'IA sans dépendre des plateformes étrangères. Pour donner corps à sa vision, Mistral AI a levé 830 millions de dollars de dette, destinés notamment à la construction d'un centre de données en France, avec un objectif de plus d'un milliard d'euros de chiffre d'affaires d'ici 2026. Ces propositions s'attaquent à un déséquilibre structurel documenté : sur 1 400 milliards de dollars investis dans le numérique à l'échelle mondiale, 80 % sont captés par les États-Unis. L'Europe dispose des talents et d'une capacité de financement, mais peine à organiser un marché cohérent qui permette à ses acteurs de rivaliser. Si les mesures proposées par Mistral étaient adoptées, elles changeraient concrètement les règles du jeu pour les entreprises et administrations européennes, qui seraient incitées à privilégier des solutions locales plutôt que de s'appuyer sur AWS, Azure ou Google Cloud. Pour les chercheurs étrangers, la "AI blue card" représenterait un signal fort que l'Europe entend sérieusement concurrencer la Silicon Valley en matière d'attractivité. Ces propositions s'inscrivent dans un contexte de prise de conscience accélérée sur la souveraineté technologique en Europe. OpenAI elle-même a publié récemment 13 pages de recommandations sur l'encadrement de l'automatisation, signe que les grands acteurs cherchent à peser sur les débats réglementaires avant que les gouvernements ne tranchent. Mistral, fondée en 2023 par d'anciens chercheurs de DeepMind et Meta, s'est rapidement imposée comme le champion européen de l'IA générative, avec des modèles open source compétitifs face aux offres américaines. En publiant ce plan en 22 points, la startup sort d'une posture purement technique pour entrer dans le débat politique et industriel, à un moment où la Commission européenne et les États membres cherchent encore leur doctrine face à la montée en puissance des grands modèles. Les prochains mois seront décisifs : si ces mesures trouvent un écho à Bruxelles ou à Paris, elles pourraient redéfinir les conditions dans lesquelles se développe l'IA en Europe.

UEMistral AI, licorne française, propose 22 mesures concrètes, préférence européenne dans les marchés publics, 'AI blue card' pour les talents étrangers, incitations fiscales pour l'infrastructure locale, qui pourraient redéfinir les règles du jeu pour les entreprises et administrations françaises et européennes.

RégulationReglementation
1 source
Microsoft publie un toolkit open source pour sécuriser les agents IA en production
37AI News 

Microsoft publie un toolkit open source pour sécuriser les agents IA en production

Microsoft a publié un toolkit open-source destiné à sécuriser les agents d'intelligence artificielle en temps réel au sein des environnements d'entreprise. Baptisé runtime security toolkit, cet outil s'intercale entre le modèle de langage et le réseau d'entreprise pour surveiller, évaluer et bloquer les actions des agents autonomes au moment précis où ils tentent de les exécuter. Concrètement, lorsqu'un agent IA déclenche un appel vers un outil externe, une base de données, un pipeline CI/CD ou un dépôt cloud, le toolkit intercepte la requête, la compare à un ensemble de règles de gouvernance centralisées, et bloque l'action si elle enfreint la politique définie. Un agent autorisé uniquement à consulter un inventaire qui tenterait de passer une commande d'achat se verrait immédiatement arrêté, et l'événement serait journalisé pour révision humaine. L'enjeu est considérable pour les équipes de sécurité et les développeurs. Les systèmes d'IA d'entreprise ne se contentent plus de répondre à des questions : ils exécutent du code, envoient des e-mails, modifient des fichiers et interagissent avec des API critiques sans intervention humaine directe. Les méthodes traditionnelles, analyse statique du code, scan de vulnérabilités avant déploiement, sont structurellement inadaptées aux modèles de langage non-déterministes. Une seule attaque par injection de prompt ou une hallucination mal orientée peut suffire à écraser une base de données ou exfiltrer des données clients. Le toolkit de Microsoft découple la politique de sécurité de la logique applicative : les développeurs n'ont plus à hardcoder des règles de sécurité dans chaque prompt, et les équipes sécurité disposent d'une piste d'audit vérifiable pour chaque décision autonome du modèle. Le choix de publier ce toolkit sous licence open-source n'est pas anodin. Les développeurs construisent aujourd'hui des workflows autonomes en combinant des bibliothèques open-source, des frameworks variés et des modèles tiers, Anthropic, Meta, Mistral ou d'autres. Un outil propriétaire lié à l'écosystème Microsoft aurait probablement été contourné au profit de solutions non vérifiées, sous pression des délais. En ouvrant le code, Microsoft permet à n'importe quelle organisation, qu'elle tourne sur des modèles locaux, sur Azure ou sur des architectures hybrides, d'intégrer ces contrôles de gouvernance sans dépendance fournisseur. L'ouverture invite aussi la communauté cybersécurité à contribuer et à empiler des outils commerciaux, tableaux de bord, intégrations de réponse aux incidents, par-dessus cette fondation commune, accélérant la maturité de tout l'écosystème. À mesure que les agents autonomes s'imposent dans les entreprises, ce type de couche de sécurité d'infrastructure pourrait devenir un standard incontournable.

UELes entreprises européennes déployant des agents IA peuvent adopter cet outil open-source pour répondre aux exigences de gouvernance et de traçabilité imposées par l'AI Act.

SécuritéOpinion
1 source
Microsoft lance 3 nouveaux modèles d'IA pour rivaliser avec OpenAI et Google
38VentureBeat AI 

Microsoft lance 3 nouveaux modèles d'IA pour rivaliser avec OpenAI et Google

Microsoft a lancé mercredi trois nouveaux modèles d'intelligence artificielle développés entièrement en interne : MAI-Transcribe-1, un système de transcription vocale, MAI-Voice-1, un moteur de synthèse vocale, et MAI-Image-2, un générateur d'images amélioré. Disponibles immédiatement via Microsoft Foundry et un nouveau MAI Playground, ces modèles positionnent le géant du logiciel — valorisé 3 000 milliards de dollars — en concurrent direct d'OpenAI, Google et ElevenLabs sur le terrain du développement de modèles fondamentaux, et plus seulement sur leur distribution. MAI-Transcribe-1 affiche un taux d'erreur moyen de 3,8 % sur le benchmark FLEURS dans les 25 langues les plus utilisées dans les produits Microsoft, surpassant Whisper-large-v3 d'OpenAI sur l'ensemble de ces langues, et Gemini Flash de Google sur 22 d'entre elles. Le modèle traite les fichiers MP3, WAV et FLAC jusqu'à 200 Mo, avec une vitesse de transcription 2,5 fois supérieure à l'offre Azure actuelle, tout en consommant deux fois moins de GPU que la concurrence selon Microsoft. MAI-Voice-1 génère 60 secondes d'audio naturel en une seconde, à 22 dollars par million de caractères. MAI-Image-2, classé dans le top 3 sur Arena.ai, est déployé dans Bing et PowerPoint à 33 dollars par million de tokens image, et compte déjà WPP, le plus grand groupe publicitaire mondial, parmi ses premiers clients entreprise. Ces trois modèles constituent la première réponse concrète de Microsoft à une pression considérable des investisseurs : l'action vient de clôturer son pire trimestre depuis la crise financière de 2008, alors que des centaines de milliards de dépenses en infrastructure IA tardent à se traduire en revenus. En développant ses propres modèles, Microsoft réduit son coût de revient en remplaçant progressivement les modèles tiers — à commencer par une intégration de MAI-Transcribe-1 dans Copilot Voice et Microsoft Teams. La stratégie d'« autosuffisance en IA », formulée par Mustafa Suleyman, patron de Microsoft AI, vise à transformer l'entreprise d'un distributeur de technologie externe en producteur de modèles de pointe. Ce pivot n'aurait pas été possible sans un changement contractuel majeur survenu en octobre 2025. Le contrat originel de 2019 entre Microsoft et OpenAI interdisait explicitement à Microsoft de développer ses propres modèles d'intelligence artificielle générale en échange d'une licence sur les modèles d'OpenAI. La renégociation de cet accord a libéré Microsoft, qui a aussitôt constitué une équipe dédiée à la superintelligence — celle-là même qui vient de produire ces premiers résultats en six mois seulement. L'enjeu dépasse le seul marché de la transcription ou des images : Microsoft cherche à ne plus dépendre d'un partenaire unique pour alimenter ses produits phares, à l'heure où la compétition entre labs frontier s'intensifie et où chaque point de marge compte face à des coûts d'infrastructure colossaux.

UELes développeurs et entreprises européens peuvent accéder immédiatement à ces modèles via Microsoft Foundry, avec un impact potentiel sur les choix de fournisseurs pour la transcription vocale, la synthèse et la génération d'images dans les produits Microsoft déjà largement déployés en Europe.

💬 Ce qui me frappe dans cette news, c'est pas les benchmarks, c'est la clause contractuelle de 2019 qu'on découvre en passant : pendant six ans, Microsoft était littéralement interdit de construire ses propres modèles. Six ans à jouer le revendeur d'OpenAI. La renégociation d'octobre dernier change tout, et six mois plus tard ils sortent trois modèles qui tiennent la route. Reste à voir si c'est le début d'une vraie indépendance ou juste un argument de plus pour les actionnaires.

La levée de fonds d'OpenAI ; La (désastreuse) promotion des IPO de 2021
39The Information AI 

La levée de fonds d'OpenAI ; La (désastreuse) promotion des IPO de 2021

OpenAI a officialisé une levée de fonds massive, annonçant des engagements totaux atteignant 122 milliards de dollars. Parmi les contributeurs principaux, Amazon s'est engagé à hauteur de 50 milliards de dollars, dont seulement 15 milliards sont versés immédiatement — le reste étant conditionné à plusieurs facteurs, notamment l'entrée en Bourse d'OpenAI. SoftBank participera pour 30 milliards de dollars, répartis en trois versements échelonnés jusqu'en octobre. Il est important de souligner que ces chiffres représentent des engagements, pas des fonds déjà transférés : une grande partie de cet argent n'a pas encore atterri sur les comptes bancaires de l'entreprise. Cette opération confirme qu'OpenAI reste l'acteur le plus capitalisé de la course à l'intelligence artificielle générale, avec une capacité à mobiliser des partenaires stratégiques de premier plan. Pour Amazon, cet engagement massif renforce son positionnement dans l'IA au moment où AWS cherche à concurrencer Microsoft Azure, déjà partenaire historique d'OpenAI via un accord de plusieurs dizaines de milliards. Pour SoftBank, dont la stratégie repose sur des paris à long terme dans la tech, l'investissement reflète une conviction renouvelée dans le potentiel commercial de l'IA — après des années marquées par des paris controversés comme WeWork. Cette levée intervient dans un contexte de vive compétition entre les grands laboratoires d'IA, avec Anthropic (soutenu par Google et Amazon) et Google DeepMind en embuscade. Le calendrier des versements, lié en partie à une éventuelle introduction en Bourse d'OpenAI, illustre la pression croissante sur la startup pour monétiser ses produits et justifier des valorisations stratosphériques. Pendant ce temps, des tensions géopolitiques se font sentir : des menaces iraniennes visant des infrastructures technologiques américaines au Moyen-Orient font peser une incertitude supplémentaire sur un secteur déjà sous surveillance réglementaire intense en Europe et aux États-Unis.

UELa domination capitalistique renforcée d'OpenAI accentue la pression sur les régulateurs européens pour faire appliquer l'AI Act face à des acteurs américains aux moyens quasi-illimités.

💬 122 milliards sur le papier, c'est impressionnant, mais la moitié de cet argent n'existe pas encore vraiment : Amazon garde 35 milliards dans sa poche jusqu'à l'IPO, SoftBank échelonne sur deux ans. C'est le genre de levée où le communiqué de presse est deux fois plus gros que le chèque. Reste que même à moitié encaissé, ça fait une sacrée piste d'atterrissage pour OpenAI face à Anthropic et Google.

BusinessOpinion
1 source
Microsoft lance de nouvelles améliorations de Copilot combinant les modèles Anthropic et OpenAI
40The Information AI 

Microsoft lance de nouvelles améliorations de Copilot combinant les modèles Anthropic et OpenAI

Microsoft a dévoilé lundi de nouvelles fonctionnalités pour son logiciel 365 Copilot, intégrant simultanément les modèles d'intelligence artificielle d'OpenAI et d'Anthropic pour automatiser les tâches dans ses applications Office et Teams. Parmi les nouveautés, une fonction baptisée « Critique » combine les deux fournisseurs de manière séquentielle : les modèles d'OpenAI compilent d'abord une recherche sur un sujet donné, puis les modèles d'Anthropic (Claude) analysent et critiquent ce résultat pour en améliorer la qualité finale. Microsoft a également annoncé des améliorations à la mémoire de Copilot et à ses capacités d'agents autonomes. Cette intégration multi-modèles marque un tournant dans la stratégie de Microsoft : plutôt que de s'appuyer exclusivement sur son partenaire historique OpenAI — dans lequel il a investi plus de 13 milliards de dollars —, l'entreprise orchestre désormais plusieurs LLMs en fonction de leurs forces respectives. Pour les quelque 400 millions d'utilisateurs de la suite Microsoft 365, cela se traduit par des assistants plus fiables capables d'auto-corriger leurs propres sorties. Ce virage reflète une tendance de fond dans l'industrie : les grandes entreprises adoptent des architectures « multi-modèles » pour optimiser coût, performance et résilience. Microsoft, qui distribue aussi les modèles d'Anthropic via Azure, se positionne en orchestrateur neutre plutôt qu'en champion exclusif d'OpenAI. La relation entre les deux entreprises reste étroite, mais la dépendance s'allège — un signal fort à l'heure où Google, Meta et Amazon renforcent également leurs propres offres d'IA en entreprise.

UELes entreprises françaises et européennes équipées de Microsoft 365 bénéficieront directement des nouvelles capacités Copilot multi-modèles, sans surcoût ni migration requise.

OutilsOutil
1 source
Mistral AI lève 830 millions de dollars pour un centre de données IA
41AI Business 

Mistral AI lève 830 millions de dollars pour un centre de données IA

Mistral AI a annoncé avoir levé 830 millions de dollars pour financer la construction d'un centre de données dédié à l'intelligence artificielle, qui sera implanté en région parisienne. Cette infrastructure, alimentée par des milliers de puces Nvidia, représente l'un des investissements les plus importants jamais réalisés dans l'IA en Europe. La startup française, fondée en 2023, consolide ainsi sa position parmi les acteurs majeurs du secteur à l'échelle mondiale. Ce centre de calcul donnera à Mistral une capacité d'entraînement et d'inférence souveraine, réduisant sa dépendance aux infrastructures cloud américaines comme AWS ou Azure. Pour les entreprises et institutions européennes soucieuses de la localisation de leurs données, cette infrastructure sur sol français représente une alternative crédible aux géants américains. C'est aussi un signal fort sur la capacité de l'Europe à construire une filière IA complète, du modèle jusqu'au silicium. Mistral s'inscrit dans une course mondiale à la puissance de calcul où les États-Unis et la Chine investissent des dizaines de milliards. La France, qui a fait de l'IA souveraine une priorité industrielle, bénéficie ici d'un effet d'entraînement : après les annonces gouvernementales du plan France 2030, un acteur privé passe à l'acte à grande échelle. Les prochains mois diront si d'autres startups européennes suivront cette voie ou si Mistral restera une exception dans un paysage dominé par les hyperscalers américains.

UEMistral AI construit un centre de calcul souverain en région parisienne, offrant aux entreprises et institutions françaises et européennes une alternative locale aux hyperscalers américains pour l'hébergement et l'inférence IA sensibles.

💬 830 millions pour un datacenter, c'est le moment où Mistral arrête de jouer dans la cour des grands et devient un grand. Ce qui m'intéresse vraiment là-dedans, c'est la souveraineté d'inférence : des boîtes françaises qui pourront faire tourner des modèles sans que leurs données passent par Virginia ou Oregon. Reste à voir combien ça coûtera à l'usage.

Mistral réunit 722 millions d’euros pour financer l’achat de 13 800 GPU NVIDIA
42Next INpact 

Mistral réunit 722 millions d’euros pour financer l’achat de 13 800 GPU NVIDIA

Mistral AI a finalisé lundi 30 mars un emprunt de 830 millions de dollars (722 millions d'euros) auprès d'un pool de sept banques pour équiper son datacenter de Bruyères-le-Châtel, au sud de Paris. Cet argent servira à acquérir 13 800 puces GB300 de NVIDIA, les processeurs de dernière génération destinés aux charges d'IA intensives. Une fois déployée, cette infrastructure portera la puissance informatique disponible pour la startup à 44 mégawatts. Le financement mobilise une majorité d'acteurs français — Bpifrance, BNP Paribas, Crédit Agricole CIB, HSBC, La Banque Postale et Natixis — ainsi que la banque japonaise MUFG (groupe Mitsubishi). La mise en service est annoncée pour le deuxième trimestre 2026. Cet investissement positionne Mistral comme le premier opérateur d'infrastructure IA souveraine en Europe capable d'offrir à ses clients institutionnels une puissance de calcul hors de toute juridiction extraterritoriale américaine. C'est l'enjeu central de l'offre Mistral Compute, lancée en juin 2025 et déjà contractualisée avec le ministère des Armées français en janvier 2026. Pour les gouvernements, administrations et grandes entreprises qui cherchent à déployer des modèles IA sans dépendre d'AWS, Azure ou Google Cloud, cette infrastructure représente une alternative concrète et européenne — un argument commercial de poids dans un contexte de tensions géopolitiques et de débats sur la souveraineté numérique. Le projet avait été annoncé en février 2025, avec Eclairion — spécialiste français des datacenters haute densité — comme partenaire de construction. À l'époque, l'intégrateur britannique devenu américain Fluidstack était également associé au projet, mais Bloomberg indique qu'il a depuis réorienté ses investissements vers les États-Unis, laissant le champ plus libre à une configuration franco-française. En décembre 2025, le CEO d'Eclairion évoquait encore un cluster de puces GB200 comme « la plus grosse machine d'IA de France » sur le point d'entrer en production pour Mistral — les cartes semblent avoir été rebattues depuis, avec une transition vers les GB300, génération supérieure. En parallèle, Mistral a annoncé en février 2026 un second investissement de 1,2 milliard d'euros dans un autre projet de datacenter, confirmant une stratégie d'expansion infrastructure qui va bien au-delà du seul développement de modèles de langage. La startup cofondée par Arthur Mensch se construit désormais en fournisseur de cloud souverain à part entière.

UEMistral installe à Bruyères-le-Châtel la première infrastructure IA souveraine d'Europe hors juridiction américaine, déjà contractualisée avec le ministère des Armées français, offrant aux institutions et entreprises européennes une alternative concrète aux hyperscalers américains.

💬 722 millions d'euros de dette pour acheter des GPU, c'est pas anodin comme pari. Bon, sur le papier le timing est parfait : les gouvernements européens cherchent désespérément une sortie des hyperscalers américains, et Mistral vient d'arriver avec 13 800 GB300 et un contrat Armées déjà dans la poche. Ce qui me frappe surtout, c'est le pivot : on parle plus d'une boîte de modèles, mais d'un vrai fournisseur de cloud souverain.

InfrastructureOpinion
1 source
Mistral AI lève 830 millions de dollars en dette pour financer un datacenter près de Paris
43TechCrunch AI 

Mistral AI lève 830 millions de dollars en dette pour financer un datacenter près de Paris

Mistral AI a annoncé une levée de 830 millions de dollars sous forme de dette pour financer la construction d'un centre de données situé près de Paris. La startup française, fondée en 2023, prévoit de mettre en service cette infrastructure dès le deuxième trimestre 2026. Ce financement par dette — distinct d'une levée en capital — lui permet de préserver sa structure actionnariale tout en mobilisant des ressources massives pour déployer ses propres capacités de calcul. Cette décision marque un tournant stratégique majeur : disposer de son propre data center permettra à Mistral de réduire sa dépendance aux fournisseurs cloud américains comme AWS ou Azure, de maîtriser ses coûts d'inférence à grande échelle, et de répondre aux exigences de souveraineté numérique de clients institutionnels et gouvernementaux européens. Pour l'industrie, c'est un signal fort que les acteurs IA européens entendent concurrencer les géants américains sur leur propre terrain — celui de l'infrastructure. Mistral s'est imposée comme le principal champion européen de l'IA générative, avec des modèles comme Mistral Large et Mixtral. La France a fait de l'IA souveraine une priorité nationale, et la startup bénéficie d'un soutien politique fort. Alors que les besoins en puissance de calcul explosent avec la montée en charge des usages LLM, contrôler son infrastructure devient un avantage concurrentiel décisif — et un argument commercial de poids face aux entreprises européennes soucieuses de la localisation de leurs données.

UELa construction d'un data center souverain près de Paris par Mistral AI renforce l'autonomie numérique française et européenne, offrant aux institutions et entreprises de l'UE une alternative aux hyperscalers américains pour leurs besoins en calcul IA.

💬 830 millions en dette, pas en capital, c'est malin. Mistral garde la main sur son actionnariat tout en se construisant une infra qui va peser lourd dans les appels d'offres publics, ceux où "hébergé en France" n'est plus un bonus mais un prérequis. Reste à voir si le datacenter tourne vraiment au T2 2026 comme annoncé.

Mistral lève 830 millions d’euros pour financer un gros projet en France
4401net 

Mistral lève 830 millions d’euros pour financer un gros projet en France

Mistral AI a annoncé une levée de fonds de 830 millions d'euros sous forme de dette, quelques mois seulement après son précédent tour de table qui lui avait permis d'atteindre une valorisation de 6 milliards de dollars. Cette opération, l'une des plus importantes jamais réalisées par une start-up européenne dans le domaine de l'intelligence artificielle, vise à financer un projet d'infrastructure de grande envergure sur le territoire français. Cet afflux de capitaux doit permettre à Mistral de réduire sa dépendance aux infrastructures cloud américaines — Amazon Web Services, Microsoft Azure ou Google Cloud — qui dominent aujourd'hui le marché du calcul pour l'IA. En construisant sa propre capacité de calcul en France, la start-up entend maîtriser ses coûts à long terme tout en offrant à ses clients européens une alternative souveraine aux hyperscalers américains. Fondée en 2023 par d'anciens chercheurs de Google DeepMind et Meta, Mistral s'est imposée comme le principal rival européen d'OpenAI. Cette levée intervient dans un contexte de course effrénée aux ressources GPU, alors que les modèles de nouvelle génération exigent des investissements infrastructurels colossaux. La stratégie d'indépendance cloud de Mistral pourrait faire école auprès d'autres acteurs européens cherchant à s'affranchir de la tutelle des géants américains.

UEMistral construit une infrastructure de calcul souveraine en France, offrant aux entreprises et institutions européennes une alternative concrète aux hyperscalers américains.

💬 830 millions en dette, c'est un pari énorme sur leur capacité à monétiser vite. Ce qui m'intéresse, c'est pas la somme, c'est le choix de sortir des hyperscalers américains : si ça marche, Mistral contrôle ses marges ET son destin réglementaire. Reste à voir si les clients européens suivent vraiment, ou si AWS reste "plus simple" comme toujours.

Mistral AI sécurise 830 millions de dollars en dette pour exploiter son premier centre de données en France
45Maddyness 

Mistral AI sécurise 830 millions de dollars en dette pour exploiter son premier centre de données en France

Mistral AI a finalisé un financement par dette de 830 millions de dollars destiné à l'exploitation de son premier centre de données souverain en France. Cette opération, distincte d'une levée de fonds en capital classique, permet à la startup parisienne fondée en 2023 de conserver sa structure actionnariale tout en mobilisant des ressources massives pour une infrastructure physique propre. Ce passage à l'hébergement en propre marque un tournant stratégique majeur : Mistral ne dépend plus uniquement des hyperscalers américains comme AWS ou Azure pour faire tourner ses modèles. Disposer d'un datacenter français signifie une maîtrise totale de la chaîne de traitement des données, un argument de poids auprès des clients institutionnels et des gouvernements européens soucieux de souveraineté numérique. Ce mouvement s'inscrit dans une course mondiale à la puissance de calcul où les acteurs de l'IA réalisent que le contrôle de l'infrastructure est aussi stratégique que les modèles eux-mêmes. Mistral, qui compte parmi ses clients la Commission européenne et plusieurs États membres, consolide ainsi sa position de champion européen face aux géants américains. L'opération pourrait également préfigurer une introduction en bourse ou un partenariat industriel à grande échelle dans les mois à venir.

UEMistral AI construit un datacenter souverain en France, réduisant la dépendance aux hyperscalers américains et offrant aux institutions publiques et gouvernements européens une alternative crédible pour le traitement souverain des données.

💬 C'est le move qu'on attendait depuis que Mistral a commencé à vendre aux gouvernements. Un datacenter souverain en France, c'est pas un bonus symbolique, c'est la condition pour décrocher les gros contrats institutionnels sans que personne te demande où tournent les données. Et 830 millions en dette plutôt qu'en capital, ça dit beaucoup sur leur ambition : ils préservent l'actionnariat pour ce qui vient après.

MISTRAL mobilise 705 millions d’euros pour son data center et avancerait désormais seul
46FrenchWeb 

MISTRAL mobilise 705 millions d’euros pour son data center et avancerait désormais seul

Mistral AI a annoncé une levée de dette de 705 millions d'euros destinée à financer la construction d'un centre de données aux portes de Paris. L'objectif central de cette opération est l'acquisition de 13 800 GPU Nvidia, ce qui permettrait à la startup française d'internaliser une capacité de calcul significative jusqu'ici dépendante de fournisseurs cloud tiers. Cette annonce marque un tournant stratégique majeur pour la jeune entreprise, fondée en 2023 et déjà valorisée plusieurs milliards d'euros. Ce virage infrastructurel confère à Mistral un contrôle direct sur ses coûts de formation et d'inférence, réduisant sa dépendance aux grandes plateformes cloud américaines comme AWS ou Azure. Posséder sa propre puissance de calcul est désormais considéré comme un impératif compétitif dans la course aux modèles de langage avancés — ceux qui nécessitent des dizaines de milliers de GPU pour s'entraîner. Pour l'écosystème européen de l'IA, un tel investissement représente aussi un signal fort : la souveraineté numérique passe désormais par la maîtrise du silicium. Cette décision s'inscrit dans un contexte où l'IA mondiale franchit une nouvelle phase, après deux ans centrés sur la course aux modèles. Les acteurs qui ne contrôlent pas leur infrastructure risquent d'être dépendants — techniquement et financièrement — des hyperscalers américains. Mistral semble par ailleurs vouloir avancer en autonomie accrue, sans nouveaux partenaires stratégiques majeurs pour cette opération, ce qui suggère une montée en maturité et une volonté d'indépendance industrielle assumée.

UEL'investissement de Mistral dans un data center francilien avec 13 800 GPU Nvidia constitue un acte concret de souveraineté numérique européenne, réduisant la dépendance des acteurs français aux hyperscalers américains pour l'entraînement et l'inférence de modèles IA.

💬 705 millions en dette pour 13 800 GPU, c'est un pari énorme. Ce qui me frappe surtout, c'est qu'ils avancent seuls, sans nouveau partenaire au capital, ce qui veut dire soit qu'ils ont vraiment les reins solides, soit que les discussions n'ont rien donné de satisfaisant. Reste à voir si l'infra suit quand les modèles de prochaine génération demanderont le double.

InfrastructureOpinion
1 source
Microsoft lance un agent Azure Copilot pour accélérer la planification des migrations cloud
47InfoQ AI 

Microsoft lance un agent Azure Copilot pour accélérer la planification des migrations cloud

Microsoft a lancé l'Azure Copilot Migration Agent, un assistant IA intégré directement au portail Azure, destiné à accélérer la planification des migrations vers le cloud. L'outil automatise trois tâches clés : la découverte sans agent des environnements VMware, la planification de migration et la création de zones d'atterrissage (landing zones). Présenté comme disponible en général (GA), le service est en réalité toujours en préversion publique — une nuance importante que Microsoft n'a pas mise en avant. La promesse est de réduire significativement le temps consacré à la phase d'évaluation et de préparation, souvent la plus fastidieuse des projets de migration cloud. Pour les équipes IT gérant des parcs VMware importants, la découverte automatique des machines virtuelles sans installation d'agent représente un gain opérationnel réel. Cependant, l'outil ne peut pas exécuter les migrations lui-même : la réplication des données et le basculement (cutover) restent des opérations manuelles dans Azure Migrate, ce qui limite son périmètre à la planification seule. Ce lancement s'inscrit dans un contexte favorable à Microsoft : depuis le rachat de VMware par Broadcom en 2023 et la hausse brutale des licences qui a suivi, de nombreuses entreprises cherchent à migrer leurs workloads vers des alternatives cloud. Azure est l'un des principaux bénéficiaires de cet exode, aux côtés d'AWS et Google Cloud. En automatisant la phase de planification, Microsoft cherche à abaisser la barrière d'entrée et à accélérer les décisions de migration — tout en restant prudent sur ce qu'il promet réellement livrer à ce stade.

UELes entreprises françaises et européennes contraintes de quitter VMware suite aux hausses de licences Broadcom peuvent utiliser cet outil pour accélérer leur planification de migration vers Azure.

OutilsActu
1 source
Actualité : GitHub Copilot : Microsoft va utiliser vos données pour alimenter son IA, sauf si vous refusez
48Les Numériques IA 

Actualité : GitHub Copilot : Microsoft va utiliser vos données pour alimenter son IA, sauf si vous refusez

Microsoft a annoncé en mars 2026 une modification de sa politique de données pour GitHub Copilot : les données des utilisateurs — incluant le code, les interactions et les comportements sur la plateforme — seront désormais utilisées pour entraîner ses modèles d'intelligence artificielle, sauf si les utilisateurs se désinscrivent explicitement via les paramètres de leur compte. Ce changement concerne l'ensemble des utilisateurs de GitHub Copilot, qu'ils soient en version gratuite ou payante, et prend effet dans les prochaines semaines. Pour des millions de développeurs, cela signifie que leur code — parfois propriétaire ou sensible — pourrait contribuer à améliorer les outils IA de Microsoft sans action de leur part. Le mécanisme d'opt-out existe, mais il repose sur la démarche active de l'utilisateur, ce qui, statistiquement, laisse la grande majorité des données accessibles. Pour les entreprises qui utilisent GitHub en environnement professionnel, la question de la confidentialité du code source devient immédiatement critique. Microsoft a racheté GitHub en 2018 pour 7,5 milliards de dollars, un investissement dont la rentabilisation passe largement par Copilot, lancé en 2021 et aujourd'hui intégré dans l'écosystème Visual Studio et Azure. La firme de Redmond s'inscrit ainsi dans une tendance plus large : OpenAI, Google et Meta ont tous adopté des politiques similaires d'utilisation des données utilisateurs pour affiner leurs modèles. La pression réglementaire européenne, notamment via le RGPD, pourrait cependant contraindre Microsoft à adapter ces pratiques pour les utilisateurs de l'Union européenne.

UELes développeurs européens utilisant GitHub Copilot doivent se désinscrire activement pour protéger leur code propriétaire ; le RGPD pourrait contraindre Microsoft à imposer un mécanisme d'opt-in explicite pour les utilisateurs de l'UE.

ÉthiqueReglementation
1 source
49The Decoder 

OpenAI : l'accord avec AWS pourrait fragiliser l'exclusivité de Microsoft sur Azure

OpenAI a conclu un accord avec AWS (Amazon Web Services), ce qui inquiète Microsoft : ce partenariat pourrait violer les droits d'exclusivité prévus dans leur contrat avec Azure. Microsoft craint que l'utilisation de l'infrastructure cloud d'Amazon par OpenAI ne contrevienne à leurs engagements contractuels.

BusinessOpinion
1 source
Microsoft s'inquiète qu'un produit OpenAI-AWS puisse violer son contrat Azure
50The Information AI 

Microsoft s'inquiète qu'un produit OpenAI-AWS puisse violer son contrat Azure

Microsoft s'inquiète qu'un accord entre OpenAI et Amazon Web Services viole le contrat d'exclusivité liant OpenAI à Azure. Des cadres supérieurs de Microsoft ont exprimé des préoccupations après qu'OpenAI a annoncé le lancement d'un agent IA via AWS, potentiellement en contradiction avec l'obligation de faire tourner ses modèles exclusivement sur le cloud Azure. La situation laisse entrevoir une fracture croissante entre les deux partenaires historiques.

BusinessActu
1 source

Suivre Azure en continu

Recevez chaque jour les articles essentiels du sujet. Pas de bruit, pas de spam.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic