Aller au contenu principal

Dossier Azure — page 2

193 articles · page 2 sur 4

Suivi des annonces IA d'Azure : services cloud, intégration des modèles OpenAI, outils pour développeurs et déploiements en entreprise.

51The Decoder InfrastructureActu

Nvidia perd du terrain sur les puces IA : Microsoft se tourne vers AMD, et Anthropic pourrait suivre

Microsoft élargit l'infrastructure IA d'Azure en intégrant Helios, la nouvelle plateforme d'AMD, qui doit concurrencer directement les systèmes GPU de Nvidia à partir du second semestre 2026. Cette annonce marque un tournant dans la stratégie d'approvisionnement en puces du géant du cloud, jusqu'ici très dépendant de Nvidia pour ses charges de travail liées à l'intelligence artificielle. Un profil GitHub public suggère par ailleurs qu'Anthropic teste également du matériel AMD, ce qui indique que l'entreprise pourrait suivre le mouvement amorcé par Microsoft et diversifier ses propres fournisseurs de calcul. Cette évolution représente une pression supplémentaire sur le pouvoir de fixation des prix de Nvidia, qui domine largement le marché des puces dédiées à l'entraînement et à l'inférence des modèles d'IA. Pour les grands fournisseurs de cloud et les laboratoires d'IA, disposer d'une alternative crédible comme AMD permet de négocier de meilleurs tarifs et de réduire la dépendance à un fournisseur unique, un enjeu stratégique majeur compte tenu des sommes colossales investies dans les infrastructures de calcul. Pour les utilisateurs finaux, une concurrence accrue pourrait à terme se traduire par une baisse des coûts d'accès aux services d'IA hébergés sur le cloud. Ce mouvement s'inscrit dans un contexte plus large où les grands acteurs technologiques cherchent à diversifier leurs sources d'approvisionnement en puces, face à la demande explosive de capacité de calcul pour l'IA générative et aux tensions sur les chaînes d'approvisionnement. Nvidia reste pour l'instant le leader incontesté du marché, mais l'arrivée de plateformes concurrentes crédibles comme Helios d'AMD, combinée à l'intérêt manifesté par des clients de poids comme Microsoft et potentiellement Anthropic, pourrait redessiner les rapports de force dans les prochaines années et inciter d'autres acteurs à suivre cette diversification.

1 source
Génération d'images IA d'entreprise en 2 secondes : Krea 2 Raw et Turbo en open weights sous licence personnalisée
52VentureBeat AI 

Génération d'images IA d'entreprise en 2 secondes : Krea 2 Raw et Turbo en open weights sous licence personnalisée

La startup américaine Krea vient d'ouvrir les poids de son nouveau modèle de génération d'images Krea 2, disponible en deux variantes sur Hugging Face : « Krea 2 Raw », orienté qualité maximale, et « Krea 2 Turbo », capable de produire une image en seulement 2 secondes. Le modèle est publié sous une licence personnalisée qui impose des conditions précises : les entreprises de plus de 50 utilisateurs doivent souscrire à une offre Enterprise payante, et tous les utilisateurs, quelle que soit leur taille, sont tenus de mettre en place des garde-fous techniques pour empêcher la génération de contenus illégaux, d'images intimes non consenties (NCII), de matériel pédopornographique (CSAM) ou de contenus diffamatoires. Au-delà de la vitesse, Krea met en avant une variété visuelle supérieure aux générateurs habituels, une meilleure fidélité aux prompts, et des capacités de personnalisation étendues, notamment la compatibilité avec les LoRA et les références de style. L'enjeu est de taille pour les entreprises qui intègrent déjà la génération d'images dans leurs workflows de production. Une critique récurrente dans l'industrie pointe la monotonie esthétique de l'imagerie IA, ce que les anglophones appellent désormais l'« AI slop » : des visuels interchangeables, sans personnalité, incapables de différencier une marque de ses concurrentes. Krea tente de répondre directement à ce problème en offrant un modèle ouvert qui permet aux équipes techniques d'affiner les sorties selon leur identité visuelle. La vitesse de Krea 2 Turbo le positionne également comme un outil viable pour les pipelines à fort débit : à 2 secondes par image, il devance des références comme Midjourney v8.1 en mode Turbo (3 à 6 secondes) ou FLUX.2 [klein] de Black Forest Labs (3,9 à 4,6 secondes selon la variante), et ne se retrouve dépassé que par des modèles très optimisés comme FLUX.1 [schnell] de Prodia (0,5 seconde) ou Z-Image Turbo sur Replicate et fal.ai (1,8 seconde). Ce lancement s'inscrit dans une dynamique plus large de démocratisation des modèles de génération d'images, où les acteurs open source cherchent à concurrencer directement des plateformes propriétaires comme Midjourney ou les solutions cloud de Microsoft (MAI Image 2 via Azure) et Google. En adoptant un modèle hybride, poids ouverts pour les petits utilisateurs, licence commerciale pour les grandes organisations, Krea suit une stratégie similaire à celle de Black Forest Labs avec la famille FLUX, tentant de capter simultanément la communauté des développeurs et les budgets des entreprises. La contrainte de safeguards techniques imposée à tous les utilisateurs reflète aussi une pression réglementaire croissante, notamment en Europe, sur la responsabilité des fournisseurs d'outils génératifs face aux contenus préjudiciables.

UELa licence imposant des garde-fous techniques contre les contenus illégaux s'aligne avec les obligations de l'AI Act européen, facilitant l'adoption de ce modèle ouvert dans les workflows d'entreprises soumises à la réglementation européenne.

CréationOpinion
1 source
Réseaux autonomes : Nokia embarque les agents IA Gemini de Google Cloud
53Le Big Data 

Réseaux autonomes : Nokia embarque les agents IA Gemini de Google Cloud

Nokia a annoncé le 22 juin 2026 l'intégration des modèles Gemini de Google Cloud au sein de son Nokia Assurance Center, la plateforme logicielle utilisée par les opérateurs télécoms pour superviser et optimiser leurs infrastructures réseau. Le cœur du dispositif repose sur six agents IA spécialisés, chacun dédié à une fonction précise du cycle d'exploitation : coordination centrale, analyse des alarmes, identification des causes racines, interprétation des indicateurs de performance et recommandation d'actions correctives. Développés à partir de l'Agent Development Kit (ADK) de Google Cloud et de la plateforme Gemini Enterprise Agent, ces agents promettent des gains de 50 à 80 % sur les délais de traitement des incidents réseau. Le déploiement s'appuie sur des outils standards comme Kubernetes et Google Cloud Storage, sans nécessiter d'infrastructure propriétaire supplémentaire. L'enjeu est considérable pour les opérateurs télécoms, qui gèrent quotidiennement des milliers d'événements techniques et peinent à distinguer les incidents critiques du bruit de fond. En permettant aux agents d'analyser simultanément plusieurs sources d'information grâce aux capacités de raisonnement multimodal de Gemini, Nokia vise à faire basculer les opérateurs d'une logique de supervision réactive vers une gestion proactive : anticiper les pannes et les corriger avant qu'elles n'affectent les utilisateurs finaux. Ce passage à l'autonomie opérationnelle réduit mécaniquement les coûts d'exploitation, diminue la dépendance aux interventions humaines de routine et améliore la fiabilité des infrastructures, un argument de poids dans un secteur où chaque minute d'interruption de service représente des pertes directes pour les opérateurs. Cette annonce s'inscrit dans une relation déjà établie entre Nokia et Google Cloud, que les deux groupes approfondissent à mesure que l'IA agentique mûrit techniquement. Nokia, équipementier historique en difficulté de repositionnement face aux concurrents asiatiques, mise sur l'intelligence artificielle pour différencier sa suite logicielle et fidéliser une base de clients opérateurs soumis à une pression tarifaire croissante. Google Cloud, de son côté, cherche à imposer Gemini comme socle applicatif dans les environnements industriels critiques, un marché où AWS et Microsoft Azure sont également très actifs. L'architecture multi-agents représente une étape vers le concept de réseau autonome, un objectif de long terme de l'industrie télécoms où le réseau se configure, se répare et s'optimise seul. Les prochaines étapes devraient voir ces six agents s'étendre à d'autres modules de la plateforme Nokia, avec des annonces attendues lors des grands salons télécoms de la seconde moitié de 2026.

UENokia, équipementier finlandais, intègre des agents IA directement dans la plateforme utilisée par les opérateurs télécoms européens, avec un impact potentiel concret sur leurs coûts d'exploitation réseau et la fiabilité de leurs infrastructures.

OutilsOpinion
1 source
SpaceX est déjà un fournisseur cloud de 28 milliards de dollars par an
54Latent Space 

SpaceX est déjà un fournisseur cloud de 28 milliards de dollars par an

SpaceX vient de signer un troisième contrat de location de GPU, cette fois avec la startup Reflection AI, s'ajoutant aux accords déjà connus avec Anthropic et Google. L'analyste Jamin Ball a compilé les chiffres : les trois contrats totalisent 2,32 milliards de dollars par mois, à plus de 10 dollars de l'heure pour des GPU Blackwell de Nvidia. Annualisé, ce montant atteint 28 milliards de dollars par an, soit environ le double du revenu actuel de Coreweave, le spécialiste du cloud GPU introduit en bourse il y a un an pour une valorisation de 60 milliards. Baseten, de son côté, a officialisé une levée de fonds de 13 milliards de dollars en Série F, confirmant l'appétit massif des investisseurs pour l'infrastructure d'IA. L'émergence de SpaceX comme fournisseur cloud de premier plan redistribue les cartes dans un marché jusqu'ici dominé par AWS, Azure et Google Cloud. Le fait qu'Anthropic et Google, concurrents directs sur le terrain des modèles, louent simultanément de la capacité chez SpaceX révèle une pénurie structurelle de GPU Blackwell que les hyperscalers peinent à absorber seuls. Pour les startups d'IA, cette nouvelle offre réduit la dépendance à un fournisseur unique et pourrait, à terme, peser sur les tarifs. Le tarif actuel, supérieur à 10 dollars de l'heure, reste néanmoins très élevé, signe que la demande dépasse largement l'offre disponible sur le marché. Cette percée de SpaceX s'inscrit dans un moment de transformation accélérée de l'ensemble de l'écosystème. OpenAI a étendu son programme Daybreak avec le lancement de GPT-5.5-Cyber, un modèle dédié à la cybersécurité déjà revendiqué comme état de l'art sur le benchmark CyberGym, accompagné d'un plugin Codex Security couvrant plus de 30 millions de commits et 30 000 dépôts, avec pour ambition de passer de la simple détection de vulnérabilités à leur correction automatisée en boucle fermée. Sakana AI a de son côté lancé Fugu, une couche d'orchestration qui sélectionne et combine dynamiquement plusieurs modèles frontier via une API unique, rapidement intégrée par Vercel dans son AI Gateway. Les benchmarks présentés ont toutefois suscité une vive controverse, des observateurs pointant des baselines opaques, l'absence de comptabilisation des coûts et un retard d'environ dix points sur Opus dans SWE-Bench Pro. La question de qui manque encore à la liste des clients de SpaceX, notamment Meta ou Microsoft, reste posée et pourrait bien définir la prochaine vague de contrats.

UELa pénurie structurelle de GPU Blackwell et les tarifs supérieurs à 10 $/heure affectent indirectement les startups européennes d'IA qui dépendent de ces ressources de calcul, sans qu'aucun acteur ou régulation européen ne soit directement impliqué.

💬 Quand Anthropic et Google louent des GPU au même fournisseur en même temps, c'est pas un choix stratégique, c'est une pénurie. SpaceX ramasse 28 milliards annualisés sans avoir sorti un seul modèle, juste en achetant des Blackwell au bon moment pendant que les hyperscalers étaient à court, et ça dit quelque chose de net sur qui a compris que le calcul allait devenir la vraie contrainte. Meta et Microsoft sont absents de la liste.

InfrastructureOpinion
1 source
Apple Private Cloud Compute : la révolution invisible qui verrouille la sécurité de l’IA
55Le Big Data 

Apple Private Cloud Compute : la révolution invisible qui verrouille la sécurité de l’IA

Apple a déployé une infrastructure cloud radicalement différente des modèles existants pour alimenter Apple Intelligence, son système d'intelligence artificielle lancé en 2024. Baptisée Private Cloud Compute (PCC), cette architecture mobilise des serveurs distants dédiés aux modèles d'IA trop lourds pour être exécutés localement sur les puces A17 Pro, A18 ou M des appareils Apple. Ces serveurs fonctionnent selon cinq principes stricts : traitement sans état (les données sont effacées de la RAM sitôt la requête traitée, sans jamais toucher un disque), verrouillage cryptographique du micrologiciel, absence totale d'accès privilégié pour les ingénieurs Apple eux-mêmes, impossibilité technique de cibler un utilisateur précis, et vérifiabilité publique de l'architecture. Apple a également ouvert récemment cette infrastructure à des développeurs tiers, leur permettant d'y déployer leurs propres modèles dans ce cadre sécurisé. L'enjeu est direct pour des centaines de millions d'utilisateurs d'iPhone, d'iPad et de Mac : les agents autonomes capables d'enchaîner des tâches complexes nécessitent des modèles dont la taille dépasse la RAM disponible sur n'importe quel smartphone, et une exécution locale viderait la batterie en quelques minutes. Sans PCC, Apple devrait choisir entre brider ces fonctionnalités ou envoyer les données des utilisateurs vers un cloud opaque, comme le font Google, Microsoft ou OpenAI. Le PCC résout cette tension en offrant une garantie mathématique et matérielle : même Apple ne peut pas lire les requêtes traitées par ses propres serveurs. Pour l'industrie, c'est un modèle alternatif crédible à l'hyperscaler classique, et une réponse concrète aux régulateurs européens qui scrutent le traitement des données personnelles dans l'IA. Ce projet s'inscrit dans la stratégie de différenciation longue d'Apple, qui a fait de la vie privée un argument commercial central depuis plusieurs années face à Google et Meta. La montée en puissance des agents IA, qui accèdent à des emails, calendriers, messages et fichiers personnels, rendait cette infrastructure indispensable : confier ces données à un serveur standard aurait représenté un risque réputationnel et réglementaire majeur. L'ouverture récente à des tiers marque une nouvelle étape, Apple cherchant à faire du PCC une plateforme en concurrence directe avec les offres de confidential computing de Google (Confidential VMs) et Microsoft (Azure Confidential Computing). La prochaine question est de savoir si les entreprises et les régulateurs accepteront ces garanties comme suffisantes, ou exigeront des audits indépendants plus poussés du code et des matériels Apple.

UELe modèle PCC d'Apple, avec ses garanties cryptographiques sur le traitement des données, pourrait constituer une réponse concrète aux exigences du RGPD et faciliter l'adoption d'Apple Intelligence par les entreprises et administrations européennes soumises aux règles strictes de protection des données personnelles.

InfrastructureOpinion
1 source
AWS juge les agents IA insuffisants en contexte métier et sécurité, et lance deux services pour y remédier
56The Decoder 

AWS juge les agents IA insuffisants en contexte métier et sécurité, et lance deux services pour y remédier

Lors de son sommet à New York, AWS a dévoilé deux nouveaux services destinés à combler les lacunes des agents IA en entreprise. Le premier, baptisé Continuum, détecte automatiquement les vulnérabilités dans le code, les priorise et propose des correctifs sans intervention humaine. Le second, Context, construit un graphe de connaissances à partir des données internes de l'entreprise afin de fournir aux agents IA le contexte métier dont ils ont besoin pour opérer correctement. Ces deux services s'attaquent à un problème central qui freine l'adoption des agents IA dans les environnements professionnels : ces systèmes produisent du code rapidement, mais commettent trop souvent des erreurs, qu'il s'agisse de failles de sécurité ou de décisions inadaptées faute de comprendre le fonctionnement réel de l'organisation. Continuum réduit la surface d'attaque en automatisant la détection de vulnérabilités, tandis que Context évite les hallucinations et les erreurs de jugement en ancrant les agents dans la réalité de l'entreprise, ses processus, ses données, ses contraintes. Cette annonce intervient alors que les grands fournisseurs cloud rivalisent pour s'imposer comme l'infrastructure de référence pour les agents IA d'entreprise. Microsoft Azure, Google Cloud et AWS se disputent un marché en pleine expansion, où la promesse d'automatisation se heurte encore à des problèmes de fiabilité et de sécurité. En proposant des couches de correction et de contextualisation natives, AWS cherche à rassurer les DSI et RSSI qui hésitent encore à déployer ces agents en production sur des systèmes critiques.

UELes DSI et RSSI européens pourront évaluer ces services AWS pour sécuriser et contextualiser leurs déploiements d'agents IA en environnement de production.

💬 AWS dit tout haut ce que les DSI savent depuis un moment : les agents IA produisent du code vite, mais sans contexte métier ni filet de sécurité, ça casse en prod. Context et Continuum s'attaquent enfin aux deux vrais blocages, ce qui change quelque chose pour les équipes qui hésitaient à franchir le pas en environnement critique. C'est le genre de couche infrastructure qui manquait pour que les agents IA deviennent un outil sérieux, pas juste une démo.

OutilsOutil
1 source
Amazon Bedrock AgentCore est disponible en production : passez d'une idée à un agent opérationnel en quelques minutes
57AWS ML Blog 

Amazon Bedrock AgentCore est disponible en production : passez d'une idée à un agent opérationnel en quelques minutes

Amazon a annoncé le 18 juin 2026 la disponibilité générale d'AgentCore Harness, une nouvelle couche d'infrastructure de sa plateforme Bedrock conçue pour déployer des agents IA en production en quelques minutes. Le service repose sur deux appels API, CreateHarness pour définir un agent, InvokeHarness pour l'exécuter, et s'appuie sur les six primitives déjà disponibles en préversion depuis avril : Runtime, Memory, Gateway, Browser, Identity et Observability. L'agent tourne dans un environnement isolé doté d'un système de fichiers et d'un shell, peut lire des fichiers, exécuter des commandes et écrire du code. Il conserve la mémoire des utilisateurs et des conversations entre sessions, navigue sur le web, appelle des outils via MCP ou Gateway, et chaque étape est automatiquement tracée vers CloudWatch. Le problème qu'AgentCore Harness cherche à résoudre n'est pas la conception de l'agent, c'est tout ce qui l'entoure. Monter un prototype en local prend une après-midi ; le passer en production explose le volume de travail : concurrence, isolation, gestion des identités, état distribué, mise à l'échelle. Et ce coût se répétait à chaque nouveau cas d'usage, chaque changement de modèle, chaque nouvel outil. Le Harness absorbe ce câblage en tant qu'abstraction gérée, ce qui le transforme en quelque chose qu'on configure plutôt que quelque chose qu'on construit. Pour les équipes qui expérimentent plusieurs modèles ou cherchent à optimiser le rapport prix-performance, la fonctionnalité la plus attendue est la capacité à changer de fournisseur de modèle en cours de session sans perdre le contexte conversationnel. La compatibilité multi-modèles est au coeur de l'offre. Bedrock supporte déjà Anthropic Claude, Amazon Nova, Meta Llama, DeepSeek, Qwen, Cohere et Mistral, et vient d'intégrer OpenAI GPT-5.5 et GPT-5.4. Le service s'étend également à l'API OpenAI directe, Google Gemini, et via LiteLLM à Vertex, Azure OpenAI et d'autres. Cette ouverture reflète une tendance de fond : les grandes plateformes cloud se positionnent non plus comme fournisseurs d'un seul modèle, mais comme couches d'orchestration universelles. Amazon rejoint ainsi Microsoft Azure AI Foundry et Google Vertex AI dans la course aux plateformes d'agents prêtes pour la production. La prochaine étape sera de voir si cette abstraction tient sous la charge réelle et si les équipes adoptent le catalogue de compétences AWS plutôt que de continuer à construire leurs propres outils.

UELes équipes européennes développant des agents IA peuvent adopter cette infrastructure gérée pour réduire la charge opérationnelle liée au déploiement en production, mais aucune entreprise ou réglementation française ou européenne n'est directement impliquée.

OutilsOpinion
1 source
Microsoft vend les modèles OpenAI en Chine, OpenAI et Anthropic refusent
58AI News 

Microsoft vend les modèles OpenAI en Chine, OpenAI et Anthropic refusent

Microsoft est devenu, discrètement mais significativement, le principal fournisseur de modèles OpenAI en Chine. Selon une enquête de Bloomberg publiée cette semaine, les plus grandes entreprises internet chinoises achètent les modèles GPT via Azure, la plateforme cloud de Microsoft, alors qu'OpenAI et Anthropic refusent de commercialiser leurs technologies directement dans le pays, invoquant des risques de détournement de propriété intellectuelle. ByteDance, la maison mère de TikTok, est le plus grand client IA de Microsoft dans le monde, et devrait dépenser plus d'un milliard de dollars par an en services cloud et IA Microsoft. Ant Group, Meituan et Tencent font également partie des acheteurs. En interne, la croissance est célébrée : les revenus IA d'Azure en Chine ont environ triplé sur l'exercice fiscal clos en juin 2025, après une hausse de 400 % l'année précédente. Judson Althoff, alors directeur commercial, a présenté Microsoft comme la seule entreprise capable de "relier les deux pôles" de l'IA mondiale, soit la côte ouest américaine et la Chine. Cette situation place Microsoft dans une position géopolitique et commerciale inédite : l'entreprise encaisse la marge des deux côtés d'une frontière technologique que ses propres partenaires refusent de franchir. Le contrat singulier liant Microsoft à OpenAI lui permet de fixer ses propres conditions pour revendre les modèles GPT à l'étranger, ce qu'OpenAI ne fait pas lui-même. Mais cette position soulève des questions concrètes sur le contrôle des usages : OpenAI a en privé demandé à Microsoft de mieux surveiller la pratique de "distillation", technique consistant à utiliser les sorties d'un modèle pour en entraîner un autre. Microsoft affirme se limiter aux entreprises établies et s'appuyer sur une surveillance automatisée, mais des sources proches du dossier indiquent qu'aucune vigilance particulière n'est exercée sur les clients chinois, et que les données synthétiques générées restent difficiles à tracer. Le paradoxe s'approfondit lorsqu'on examine la stratégie globale de Microsoft. D'un côté, la société vend des modèles américains en Chine. De l'autre, elle a ajouté DeepSeek R1 à Azure AI Foundry en janvier 2025 et teste actuellement une version affinée de DeepSeek-V4 pour alimenter son agent d'entreprise Copilot Cowork, aujourd'hui propulsé par OpenAI et Anthropic. Microsoft vend donc aussi un modèle chinois à ses clients occidentaux, captant la marge sur les deux jambes du commerce. Cette acrobatie s'inscrit dans un contexte politique tendu : à Washington, des élus considèrent la poussée IA chinoise comme une menace directe pour l'industrie américaine, et la part du marché chinois représentait environ 1,5 % du chiffre d'affaires de Microsoft en 2024 selon Brad Smith, son président. La pression pourrait s'intensifier si OpenAI décide de rendre publiques ses objections, jusqu'ici discrètes.

UELa révélation de ce commerce triangulaire entre modèles IA américains et clients chinois via le cloud pourrait alimenter les débats européens sur la souveraineté numérique et renforcer les appels à encadrer les conditions d'accès aux grands modèles dans le cadre de l'AI Act.

BusinessActu
1 source
Amazon Bedrock AgentCore : des agents plus informés et capables d'apprentissage continu
59AWS ML Blog 

Amazon Bedrock AgentCore : des agents plus informés et capables d'apprentissage continu

Amazon a annoncé cette semaine de nouvelles fonctionnalités pour Bedrock AgentCore, sa plateforme de développement d'agents IA, avec pour objectif de combler l'écart entre la puissance théorique des modèles de langage et leurs performances réelles en production. La mise à jour introduit trois couches d'accès à la connaissance : la Managed Knowledge Base, un outil de recherche web natif, et un accès à des données payantes. La Managed Knowledge Base permet désormais aux agents de se connecter directement aux sources de données internes des entreprises, SharePoint, Google Drive, Confluence, S3 et wikis internes, sans que les équipes techniques aient à construire leurs propres pipelines d'ingestion. Amazon gère le stockage vectoriel, les modèles d'embeddings et de reranking, ainsi que les questions de scalabilité. Au cœur de ce système se trouve un retriever agentique qui va bien au-delà du RAG classique : il planifie des requêtes croisées sur plusieurs bases de connaissance, relie des concepts connexes entre documents, et évalue les résultats intermédiaires avant de répondre. L'outil Web Search, lui, s'appuie sur la même infrastructure de recherche qui propulse Alexa+, Amazon Quick Suite et Kiro, et renvoie des extraits optimisés pour la densité d'information par token. Ces ajouts répondent à un problème concret et coûteux pour les entreprises déployant des agents IA : un modèle aussi performant soit-il reste inutile s'il ne peut pas accéder au document où se trouve la réponse. Un agent de service client incapable d'atteindre la politique de remboursement stockée dans SharePoint, un agent de recherche limité à ses données d'entraînement, un conseiller financier privé de données de marché en temps réel, tous sont des cas réels qui freinent le déploiement en production. La Managed Knowledge Base élimine plusieurs mois d'ingénierie préalable, tandis que le Web Search maintient les données dans l'environnement sécurisé AWS du client, un point critique pour les secteurs réglementés comme la finance ou la santé. Cette annonce s'inscrit dans la compétition intense entre fournisseurs cloud pour s'imposer comme plateforme de référence pour les agents IA d'entreprise. AWS, Google Cloud avec Vertex AI et Microsoft avec Azure AI Foundry se disputent le même marché : les équipes qui veulent déployer des agents capables d'agir réellement sur des données métier, pas seulement générer du texte. Amazon capitalise ici sur son infrastructure de recherche existante et son écosystème de services cloud pour offrir une intégration verticale que les solutions tierces ont du mal à concurrencer. La promesse d'amélioration continue via des boucles de rétroaction en production, mentionnée dans l'annonce, suggère qu'AgentCore ambitionne de devenir non seulement un outil de déploiement mais une plateforme d'optimisation itérative des agents dans la durée.

UELes entreprises européennes des secteurs réglementés (finance, santé) peuvent adopter ces fonctionnalités, les données restant dans l'environnement AWS sécurisé du client, ce qui simplifie la conformité réglementaire.

💬 Le vrai goulot d'étranglement pour les agents en prod, c'est jamais le modèle, c'est l'accès aux données d'entreprise. Avec AgentCore, Amazon efface plusieurs mois d'ingénierie RAG maison (SharePoint, Confluence, S3 gérés nativement) et garde les données dans son cloud sécurisé. AWS joue ici son principal atout : l'intégration verticale que ni Google ni Microsoft ne peuvent répliquer aussi facilement.

OutilsOutil
1 source
OpenAI Partner Network : un réseau pour industrialiser l’IA
60Le Big Data 

OpenAI Partner Network : un réseau pour industrialiser l’IA

OpenAI a annoncé le 15 juin 2026 le lancement de l'OpenAI Partner Network, un programme mondial d'écosystème partenaires accompagné d'un investissement de 150 millions de dollars. L'objectif affiché est de former et certifier 300 000 consultants d'ici fin 2026, en structurant un réseau d'intégrateurs systèmes, de cabinets de conseil, de spécialistes des données et de fournisseurs technologiques. Ce réseau s'organise en trois niveaux de partenariat, Select, Advanced et Elite, chacun soumis à des critères précis de compétences techniques, de performance commerciale et d'expérience de déploiement. Les partenaires sont appelés à intervenir sur l'ensemble de la chaîne de valeur : définition de stratégie IA, intégration technique, modernisation des infrastructures et conduite du changement organisationnel. Ce virage stratégique répond à un constat que les grandes organisations vivent au quotidien : la performance des modèles d'IA n'est plus le principal frein à leur adoption. C'est désormais leur déploiement concret dans les systèmes existants, la gouvernance des données, la sécurité et l'accompagnement des équipes qui bloquent la transformation. En créant ce réseau, OpenAI reconnaît explicitement qu'aucun acteur ne peut seul couvrir tous les secteurs et tous les marchés. Pour les DSI et directions métiers, l'émergence de partenaires certifiés par OpenAI représente une réduction concrète des risques : des interlocuteurs qualifiés capables de structurer des projets IA avec des garanties de gouvernance et d'intégration, là où les expérimentations internes restent souvent cantonnées à des pilotes sans suite industrielle. Ce mouvement s'inscrit dans une logique bien connue des grands éditeurs cloud, AWS, Microsoft Azure, Google Cloud, qui ont bâti leur dominance autant sur leurs réseaux de partenaires que sur la technologie elle-même. OpenAI adopte aujourd'hui ce modèle d'écosystème, cherchant à transformer l'IA générative en infrastructure opérationnelle pérenne plutôt qu'en outil expérimental. L'investissement de 150 millions de dollars témoigne de l'ampleur de cette ambition. L'objectif des 300 000 consultants certifiés d'ici fin 2026 illustre surtout l'enjeu humain derrière la promesse technologique : industrialiser l'IA suppose une montée en compétences massive du marché. À mesure que la concurrence avec Anthropic, Google DeepMind et les acteurs open source s'intensifie sur les modèles eux-mêmes, c'est désormais sur le terrain de l'intégration et de l'adoption en entreprise que se jouera une partie décisive de la bataille pour la domination du marché IA.

UELes cabinets de conseil et intégrateurs français peuvent rejoindre le réseau et obtenir des certifications OpenAI, ce qui pourrait accélérer et structurer l'adoption de l'IA générative dans les grandes entreprises européennes.

💬 Le chiffre de 300 000 consultants certifiés avant fin 2026, c'est pour les slides. Mais la mécanique, elle est sérieuse, et je pense qu'on sous-estime à quel point c'est le mouvement AWS de 2015 : verrouiller le marché via l'écosystème partenaires plutôt que via la techno seule. Si tu as des projets IA coincés en phase pilote depuis trop longtemps, ça peut débloquer des choses, à condition que les certifiés Elite arrivent avec autre chose qu'un badge sur leur deck.

Google Research : Gemini-SQL2 domine les benchmarks text-to-SQL avec une large avance
61The Decoder 

Google Research : Gemini-SQL2 domine les benchmarks text-to-SQL avec une large avance

Google Research a publié Gemini-SQL2, un système capable de convertir du langage naturel en requêtes SQL exécutables, construit sur le modèle Gemini 3.1 Pro. Sur le benchmark BIRD, référence industrielle pour évaluer la conversion texte-vers-SQL, Gemini-SQL2 atteint un taux de précision de 80,04 %, distançant significativement les solutions concurrentes d'OpenAI et d'Anthropic. Cette performance place Google en tête d'un domaine à fort enjeu commercial : la capacité à interroger des bases de données en langage courant, sans écrire une seule ligne de code, ouvre l'accès à la donnée à des profils non techniques au sein des entreprises. Pour Google, l'intégration de cette technologie dans ses services de données comme BigQuery ou Looker pourrait accélérer l'adoption par des équipes analytiques qui dépendent aujourd'hui d'ingénieurs pour formuler leurs requêtes. Le benchmark BIRD, qui évalue la robustesse des modèles sur des bases de données réelles et complexes, est devenu le baromètre de référence depuis 2023 pour comparer les approches text-to-SQL. La course à ce type de capacité s'inscrit dans une compétition plus large entre les grands laboratoires pour intégrer l'intelligence artificielle directement dans les flux de travail d'entreprise. Avec Gemini-SQL2, Google consolide sa position sur le segment des outils de productivité données, un marché où Microsoft, via Copilot for Azure, et les startups spécialisées comme Text2SQL.ai exercent également une pression croissante.

UELes entreprises européennes pourraient simplifier l'accès à leurs données analytiques en permettant à des profils non techniques d'interroger leurs bases sans écrire de SQL.

💬 80% sur BIRD sur des vraies bases de données complexes, c'est pas du benchmarking en chambre. Ce qui est intéressant c'est moins le score que l'intégration qui vient (BigQuery, Looker) : là, les équipes métier qui passaient leur vie à attendre un data engineer vont pouvoir requêter elles-mêmes. Reste à voir si ça tient quand les schémas sont vraiment sales, parce qu'en prod, c'est rarement aussi propre que dans les benchmarks.

LLMsActu
1 source
KPMG et Microsoft généralisent l’usage des agents IA dans les entreprises
62Le Big Data 

KPMG et Microsoft généralisent l’usage des agents IA dans les entreprises

KPMG et Microsoft ont annoncé un renforcement significatif de leur partenariat mondial, avec deux axes majeurs : le déploiement de Microsoft 365 Copilot auprès des 276 000 collaborateurs de KPMG répartis dans 138 pays, et l'adoption de Microsoft Agent 365 pour superviser et gouverner les agents IA au sein du cabinet et chez ses clients. Cette extension, qui s'appuie sur plus de dix ans de collaboration entre les deux groupes, marque le passage d'une phase d'expérimentation à une industrialisation réelle de l'IA dans les grandes organisations de conseil. KPMG s'appuiera sur KPMG Workbench, une plateforme construite sur Microsoft Azure AI Foundry, pour coordonner plusieurs agents IA à travers ses services d'audit, de fiscalité et de conseil. Dans l'audit, ces capacités seront intégrées progressivement à KPMG Clara, la plateforme mondiale du groupe, pour renforcer l'analyse en temps réel et améliorer la détection précoce des risques. L'enjeu central de cet accord n'est pas l'adoption de l'IA en elle-même, mais sa gouvernance à l'échelle. Plus les entreprises multiplient les agents semi-autonomes, ces systèmes capables d'exécuter des tâches complexes, d'interagir avec plusieurs applications et de participer à des processus métiers, plus elles doivent pouvoir répondre à des questions précises : quels agents sont actifs, quelles données traitent-ils, quelles décisions prennent-ils, et qui en est responsable. C'est précisément ce verrou organisationnel que Microsoft Agent 365 cherche à lever, en proposant une couche centralisée de déploiement, de supervision et de contrôle. Pour KPMG, cela se traduit aussi par un renforcement de son framework Trusted AI, conçu pour garantir une utilisation responsable de l'IA aussi bien en interne que chez ses clients grands comptes. Cette annonce s'inscrit dans une tendance de fond qui traverse l'ensemble du secteur des services professionnels : après deux années de pilotes et d'expérimentations, les grands cabinets de conseil et d'audit cherchent à standardiser leurs usages IA pour en tirer un avantage concurrentiel mesurable. Microsoft, de son côté, positionne Agent 365 comme une réponse directe aux inquiétudes des DSI et des directions juridiques face à la multiplication incontrôlée des agents autonomes dans leurs systèmes d'information. L'accord KPMG-Microsoft pourrait servir de modèle de référence pour d'autres organisations de taille comparable souhaitant franchir le cap de l'industrialisation sans sacrifier conformité et sécurité des données sensibles.

UEKPMG France, en tant que membre du réseau mondial, est directement incluse dans ce déploiement massif, ce qui impacte les pratiques d'audit et de conseil auprès des grandes entreprises françaises clientes du cabinet.

BusinessOpinion
1 source
Le futuriste IA de Microsoft explique comment il utilise Copilot et les problèmes concrets que les entreprises résolvent avec des agents
63VentureBeat AI 

Le futuriste IA de Microsoft explique comment il utilise Copilot et les problèmes concrets que les entreprises résolvent avec des agents

Lors de sa conférence Build 2026, Microsoft a dévoilé cette semaine une série d'annonces destinées à ancrer les agents d'intelligence artificielle au cœur des systèmes d'entreprise. La firme a présenté Microsoft IQ, une couche contextuelle unifiée couvrant GitHub Copilot, Microsoft Foundry et Copilot Studio, ainsi que des API Work IQ dont le lancement est prévu le 16 juin. S'y ajoutent Fabric IQ pour les données métier structurées, Foundry IQ pour la récupération d'informations à travers les bases de connaissances d'entreprise et le web en temps réel, et Web IQ, un moteur de recherche conçu spécifiquement pour les agents. Microsoft a également introduit Scout, un assistant personnel de travail autonome, et annoncé sept nouveaux modèles maison regroupés sous la famille MAI, dont MAI-Thinking-1, optimisés pour l'efficience en tokens et la personnalisation sur données propriétaires. En parallèle, Claude Opus 4.8 d'Anthropic est désormais disponible sur Azure Foundry, aux côtés des modèles OpenAI GPT, témoignant d'une stratégie délibérée de choix multiple de modèles. Ces annonces marquent un tournant dans la façon dont Microsoft positionne son infrastructure IA : ce n'est plus l'accès à un modèle puissant qui fait la différence, mais la capacité à donner aux agents un contexte fiable, une identité, une mémoire et un accès sécurisé aux données d'entreprise. Pour les DSI et équipes techniques, cela se traduit concrètement par la possibilité de déployer des agents gérés dans Foundry, avec gestion automatique du dimensionnement et de la conteneurisation, sans avoir à construire cette infrastructure from scratch. L'enjeu est de taille : les entreprises qui parviennent à brancher leurs agents sur leurs données internes et leurs workflows existants pourront automatiser des processus complexes à grande échelle, là où les expériences pilotes restaient jusqu'ici cantonnées à des cas d'usage isolés. Marco Casalaina, VP Products Core AI et "AI Futurist" de Microsoft, est au cœur de cette stratégie. Ancien responsable de l'équipe Einstein AI chez Salesforce et diplômé en informatique de Cornell, il a rejoint Microsoft début 2022 pour prendre la tête des Azure Cognitive Services avant d'étendre son périmètre à l'ensemble des outils pour développeurs IA, incluant Foundry, VS Code, GitHub et GitHub Copilot. Son rôle de futuriste a une définition très concrète chez Microsoft : il est systématiquement le premier à tester chaque nouvelle fonctionnalité en provenance de toutes les équipes de la firme. Cette position d'observatoire lui permet de tracer ce qu'il appelle "le futur immédiat", c'est-à-dire l'horizon à douze mois des capacités agentiques. La compétition pour devenir la plateforme de référence des agents d'entreprise est désormais ouverte, avec Google et AWS comme principaux rivaux dans une course où le contexte, la gouvernance et l'intégration des données deviennent les véritables différenciateurs.

UELes entreprises européennes peuvent évaluer les API Work IQ sur Azure (lancement le 16 juin) et les modèles MAI pour l'automatisation de leurs workflows internes, avec des enjeux de souveraineté des données à considérer.

💬 Microsoft assume enfin que la guerre se joue sur la plomberie, pas sur les modèles. Donner aux agents un contexte fiable, une identité et un accès sécurisé aux données internes, c'est précisément ce qui bloquait les pilotes depuis deux ans. Et avoir Claude d'Anthropic sur Azure aux côtés d'OpenAI, c'est malin : un argument de neutralité que Google et AWS n'ont pas encore.

OutilsOutil
1 source
Les équipes platform chez LinkedIn déploient MCP et outils multi-agents à grande échelle
64InfoQ AI 

Les équipes platform chez LinkedIn déploient MCP et outils multi-agents à grande échelle

Karthik Ramgopal et Prince Valluri, ingénieurs chez LinkedIn, ont présenté leur approche pour déployer l'intelligence artificielle à grande échelle au sein d'une organisation de plusieurs milliers de développeurs. Plutôt que de laisser chaque équipe construire ses propres solutions en silo, ils ont mis en place une couche d'abstraction commune reposant sur le protocole MCP (Model Context Protocol) pour orchestrer des agents, structurer le contexte et sécuriser l'accès aux outils internes. Cette architecture a permis de déployer concrètement trois types d'agents en production : des agents de génération de code, des agents d'observation système et des agents de test d'interface utilisateur. L'enjeu est considérable pour les grandes entreprises technologiques : sans infrastructure partagée, chaque équipe réinvente la roue et les agents IA restent des expérimentations isolées sans impact à l'échelle. En centralisant l'orchestration et la gestion du contexte via une plateforme commune, LinkedIn parvient à transformer l'IA en véritable moteur d'exécution engineering, capable d'automatiser des tâches complexes comme les tests UI ou la surveillance de systèmes distribués, avec des garanties de sécurité homogènes. Cette initiative s'inscrit dans une tendance de fond : les grandes entreprises tech passent du stade des prototypes d'agents IA à celui des déploiements industriels, ce qui exige des équipes plateformes dédiées. Le protocole MCP, porté initialement par Anthropic et rapidement adopté par l'industrie, s'impose comme standard d'interopérabilité entre agents et outils. LinkedIn, filiale de Microsoft, bénéficie par ailleurs d'un accès privilégié aux modèles GPT-4o via Azure, ce qui accélère ces expérimentations à une échelle que peu d'entreprises peuvent atteindre.

UELes équipes d'ingénierie européennes peuvent s'inspirer de cette architecture MCP pour structurer leurs propres déploiements d'agents IA à l'échelle, le protocole MCP s'imposant comme standard industriel d'interopérabilité.

💬 MCP en prod chez LinkedIn sur des milliers de devs, c'est le signal qu'on attendait pour que le protocole bascule vraiment en standard industriel. Ce qui est intéressant là-dedans, c'est pas la tech en elle-même (Anthropic a bien bossé le design), c'est l'architecture plateforme : une couche commune au lieu que chaque équipe réinvente ses propres outils d'orchestration dans son coin. Reste à voir ce que ça donne pour les boîtes qui n'ont pas Azure et GPT-4o derrière.

InfrastructureOpinion
1 source
IA d’entreprise : Snowflake et Anthropic renforcent la gouvernance des modèles IA
65Le Big Data 

IA d’entreprise : Snowflake et Anthropic renforcent la gouvernance des modèles IA

Snowflake et Anthropic ont annoncé le 2 juin 2026, lors du Snowflake Summit 2026, un renforcement significatif de leur partenariat autour de l'IA d'entreprise. Concrètement, les modèles Claude d'Anthropic s'intègrent désormais plus profondément dans Snowflake Cortex AI, notamment pour alimenter Snowflake Cortex Code et Snowflake Intelligence. L'objectif est de permettre aux organisations de déployer des agents IA directement dans leur environnement de données existant, sans avoir à externaliser ou déplacer des données sensibles. Des entreprises comme Block, Indeed, Carvana, Notion ou eSentire utilisent déjà cette combinaison en production. Christian Kleinerman, EVP Product chez Snowflake, a indiqué que Snowflake Cortex Code serait devenu le produit à la croissance la plus rapide de toute l'histoire du groupe. L'enjeu central de ce partenariat est la gouvernance : les entreprises des secteurs réglementés, finance, santé, cybersécurité, retail, ne peuvent pas déployer l'IA sur des données critiques sans garanties fortes en matière de sécurité, de conformité et de traçabilité. En combinant la couche de gouvernance et de contrôle d'accès de Snowflake avec les capacités de raisonnement de Claude, les deux groupes proposent une architecture où le modèle devient une extension native de la plateforme data de l'entreprise plutôt qu'un outil externe. Cela change concrètement le profil de risque de l'IA générative pour les décideurs : Block automatise ainsi des workflows de conformité pour Square et Cash App, eSentire automatise des analyses SOC de niveau 1 pour libérer ses analystes humains des tâches répétitives, et Carvana optimise ses opérations logistiques et financières grâce à cette architecture. Ce renforcement s'inscrit dans la continuité d'un accord élargi signé fin 2025, qui avait déjà permis l'intégration native de Claude dans Cortex AI sur les principaux clouds. Le marché de l'IA d'entreprise est en train de basculer d'une phase d'expérimentation vers des déploiements opérationnels à grande échelle, et plusieurs acteurs, Microsoft avec Azure OpenAI, Google avec Vertex AI, AWS avec Bedrock, se livrent une concurrence intense pour capter cette demande. Snowflake, en tant que plateforme data indépendante du cloud, joue une carte différente : celle de la neutralité et de la gouvernance centralisée. Anthropic, de son côté, accélère sa distribution en entreprise via des partenariats stratégiques plutôt que par une offre cloud propriétaire. Les prochaines étapes du partenariat devraient porter sur l'extension de Claude Marketplace au sein de l'écosystème Snowflake, ouvrant la porte à un modèle de distribution plus large pour les modèles d'Anthropic dans les environnements data d'entreprise.

UELes entreprises européennes des secteurs réglementés (finance, santé, cybersécurité) disposent d'une architecture permettant de déployer Claude directement dans leur environnement de données existant, sans externaliser de données sensibles, un argument clé pour la conformité RGPD.

OutilsOpinion
1 source
Les modèles OpenAI et Codex sont désormais disponibles sur Amazon Bedrock
66AWS ML Blog 

Les modèles OpenAI et Codex sont désormais disponibles sur Amazon Bedrock

OpenAI et Amazon Web Services ont rendu officiellement disponibles, début juin 2026, GPT-5.5, GPT-5.4 et l'agent de code Codex sur Amazon Bedrock, un mois après l'annonce de leur partenariat élargi. Les trois modèles sont désormais accessibles en production via le catalogue Bedrock, avec une tarification identique à celle pratiquée directement par OpenAI, sans frais supplémentaires. GPT-5.5, le modèle le plus avancé de la gamme, excelle dans les tâches agentiques complexes : rédaction et débogage de code sur de grandes bases, analyse de données, génération de documents, et exécution autonome de séquences multi-étapes. Codex, l'agent de développement logiciel d'OpenAI, comptabilise plus de 5 millions d'utilisateurs hebdomadaires et est désormais accessible via l'application Codex, le CLI, ainsi que les intégrations IDE pour Visual Studio Code, JetBrains et Xcode, avec toute l'inférence routée par Bedrock. Pour les entreprises, cette disponibilité générale représente un changement opérationnel concret : les appels aux modèles OpenAI s'intègrent désormais dans les engagements AWS existants, comptent dans les crédits contractuels, et bénéficient des mécanismes de gouvernance déjà en place, notamment les permissions IAM, l'isolation réseau via VPC et PrivateLink, le chiffrement KMS et les journaux d'audit CloudTrail. Bedrock garantit par ailleurs une file d'attente isolée par client avec gestion automatique de la capacité, ce qui assure une performance prévisible même sous forte charge. Fait notable pour les secteurs réglementés : les prompts et réponses ne sont pas utilisés pour entraîner les modèles, et ne sont pas partagés avec OpenAI. Amgen, le géant pharmaceutique, a déjà exprimé son intérêt, son directeur technique Sean Bruich soulignant la qualité et la consistance de GPT-5.5 pour des contextes où la précision scientifique est critique. Ce déploiement s'inscrit dans une dynamique de consolidation entre les grands fournisseurs de cloud et les développeurs de modèles frontière. OpenAI cherche à multiplier les canaux de distribution pour ses modèles, en s'appuyant sur les infrastructures cloud existantes pour atteindre des clients enterprise déjà engagés avec AWS, plutôt que de les forcer à migrer vers une API directe. Pour Amazon, intégrer GPT-5.5 aux côtés de ses propres modèles Titan et des offres Anthropic et Mistral déjà disponibles sur Bedrock renforce le positionnement de la plateforme comme guichet unique du marché des modèles. L'enjeu sous-jacent est la rétention des dépenses cloud enterprise : en faisant compter l'usage d'OpenAI dans les engagements AWS, les deux sociétés créent une friction supplémentaire contre la migration vers Azure ou Google Cloud, où GPT-5.5 est également accessible.

UELes entreprises européennes sous contrat AWS peuvent désormais accéder aux modèles GPT-5.5 et Codex via Bedrock avec des garanties de conformité adaptées au RGPD (données non utilisées pour l'entraînement, isolation réseau VPC, chiffrement KMS), facilitant l'adoption dans les secteurs réglementés.

Chargement des LLM accéléré et fenêtres de contexte élargies avec GPUDirect, Amazon FSx for Lustre et TurboQuant
67AWS ML Blog 

Chargement des LLM accéléré et fenêtres de contexte élargies avec GPUDirect, Amazon FSx for Lustre et TurboQuant

Amazon Web Services vient d'annoncer une combinaison technique qui pourrait transformer le déploiement de grands modèles de langage en production : l'utilisation conjointe d'Amazon FSx for Lustre, de NVIDIA GPUDirect Storage (GDS) et d'une nouvelle technique de quantification appelée TurboQuant. Concrètement, charger un modèle comme Llama 3.1 405B, soit environ 800 gigaoctets de poids en BF16, prend aujourd'hui entre 10 et 20 minutes avec une infrastructure classique. Avec GDS sur les nouvelles instances P6 et P6e d'AWS, propulsées par l'architecture NVIDIA Blackwell, ce délai tombe à quelques secondes. Le flagship P6e UltraServer concentre 72 GPU Blackwell dans un seul domaine NVLink, avec 13,4 téraoctets de mémoire HBM3e et 360 pétaflops de calcul en FP8. Le problème que résout cette approche est fondamental pour l'industrie de l'inférence à grande échelle. Dans le pipeline traditionnel, les poids du modèle transitent séquentiellement depuis le stockage vers la RAM CPU, sont désérialisés, éventuellement quantifiés, puis copiés un par un vers chaque GPU via le bus PCIe. Pendant tout ce temps, parfois vingt minutes, les GPU les plus chers de l'infrastructure restent inactifs. GPUDirect Storage court-circuite entièrement ce chemin : les checkpoints du modèle sont pré-découpés en fragments sur FSx for Lustre, et les huit GPU d'une instance lisent leurs fragments en parallèle directement dans leur mémoire HBM, sans jamais passer par le CPU ni le PCIe. L'impact est immédiat sur trois métriques critiques : la latence au premier token lors d'un démarrage à froid, la réactivité de l'autoscaling lors des pics de charge, et le coût d'infrastructure lié aux GPU qui attendent. Cette annonce s'inscrit dans une course à l'optimisation de l'inférence LLM qui s'est intensifiée depuis l'émergence de modèles à plusieurs centaines de milliards de paramètres. Des frameworks comme vLLM ont certes amélioré le chargement parallèle des poids depuis la version 0.19 et son moteur V1, mais les données continuent d'emprunter le CPU et le bus PCIe, une limitation structurelle que GDS supprime à la racine. AWS introduit simultanément TurboQuant, une technique de mise en cache KV qui permet d'augmenter significativement la taille des fenêtres de contexte disponibles sur ces instances. Ces deux avancées combinées positionnent AWS comme un acteur offensif sur le marché de l'infrastructure d'inférence, face à des concurrents comme Google Cloud et Azure qui développent leurs propres accélérateurs et solutions de stockage haute performance pour répondre aux mêmes contraintes.

UELes entreprises européennes déployant des LLMs à grande échelle sur AWS pourront réduire significativement leurs coûts d'infrastructure liés aux GPU inactifs au démarrage, avec un impact direct sur la compétitivité des services d'inférence en Europe.

InfrastructureOpinion
1 source
Microsoft Build 2026 : ce qu’il faut attendre — et ce qu’il ne faut pas espérer
68Le Big Data 

Microsoft Build 2026 : ce qu’il faut attendre — et ce qu’il ne faut pas espérer

Microsoft Build 2026 ouvre ses portes les 2 et 3 juin au Fort Mason Center de San Francisco, avec un accès en ligne gratuit pour les développeurs du monde entier. Satya Nadella prendra la parole en keynote dès 9h30 heure du Pacifique. L'édition 2026 tourne résolument autour de l'IA agentique : des systèmes capables non plus seulement de répondre à des questions, mais d'agir de manière autonome sur des tâches complexes, en coordonnant plusieurs agents entre eux. Azure AI Foundry est présenté comme le socle technique de ces architectures multi-agents. GitHub Copilot devrait lui aussi franchir un cap, avec des capacités renforcées de débogage, de tests et de correction de code. Reuters signale en parallèle que Microsoft prépare de nouveaux modèles maison, dont un orienté code, pour alimenter Copilot. Côté Windows, Windows AI Foundry permettrait aux applications d'exécuter certains modèles directement sur les PC, via NPU, GPU ou CPU, sans passer par le cloud. Ces annonces dépassent largement le cercle des développeurs. Si les briques agentiques déployées sur Azure finissent intégrées dans Excel, Teams ou Outlook, elles modifieront concrètement les flux de travail de millions d'utilisateurs en entreprise. L'exécution locale des modèles via Windows AI Foundry présente des avantages tangibles : latence réduite, confidentialité améliorée et fonctionnement hors ligne. Microsoft devrait aussi détailler comment réduire les coûts et les délais du passage des prototypes IA à la production, un point de friction majeur pour les équipes qui cherchent à industrialiser ces outils. L'enjeu est de rendre ces technologies utilisables à grande échelle, pas seulement impressionnantes en démonstration. Microsoft Build 2026 s'inscrit dans une course effrénée entre les grands acteurs technologiques pour imposer leurs plateformes comme infrastructure de référence de la prochaine génération d'applications IA. Google, Amazon et Meta jouent la même partition, et chaque Build est aussi une occasion pour Microsoft de montrer que son investissement massif dans OpenAI et dans Azure se traduit en outils concrets pour les développeurs. Le Windows Agent Framework, pressenti pour transformer les agents IA en fonctionnalités système à part entière, et un Windows Agent Store avec un partage de revenus à 85% pour les éditeurs, témoignent d'une ambition claire : faire de Windows une plateforme agentique native. Ce que Build ne montrera probablement pas : du nouveau matériel Surface, un Windows 12 ou des surprises Xbox. L'événement est avant tout une vitrine pour les outils que Microsoft veut mettre dans les mains des développeurs afin de construire la prochaine vague d'applications IA, dont les effets réels se feront sentir sur les mois qui suivent.

UELes développeurs et entreprises européens utilisant Azure et GitHub Copilot seront directement impactés par les nouvelles capacités agentiques, tandis que l'exécution locale de modèles via Windows AI Foundry pourrait faciliter la conformité RGPD en réduisant les transferts de données vers le cloud.

OutilsOutil
1 source
Microsoft ouvre un nouveau front dans le débat sur les données pour les agents IA
69The Information AI 

Microsoft ouvre un nouveau front dans le débat sur les données pour les agents IA

Microsoft a durci sa position face à Databricks en bloquant l'accès de ce partenaire de longue date à Power BI, son outil phare d'analyse et de visualisation de données. Début mars, Databricks avait commencé à tester une nouvelle fonctionnalité permettant à ses clients de connecter facilement leurs données hébergées sur sa plateforme à des outils de visualisation tiers, dont Power BI. Microsoft a réagi en fermant cette intégration, protégeant ainsi un produit utilisé par la quasi-totalité des entreprises du Fortune 500 pour piloter leurs opérations via tableaux de bord et graphiques. Cette décision illustre une tension croissante autour du contrôle des flux de données dans l'écosystème des agents IA. Power BI n'est plus seulement un outil de reporting : il devient une porte d'entrée stratégique vers les données d'entreprise que les agents IA exploitent pour automatiser des décisions. En bloquant Databricks, Microsoft cherche à s'assurer que ces flux restent dans son propre écosystème, renforçant l'attrait de ses solutions Fabric et Azure pour les entreprises qui déploient des agents. Ce bras de fer s'inscrit dans une recomposition plus large du marché des données d'entreprise, où Databricks, valorisé à plus de 62 milliards de dollars, concurrence directement Microsoft sur le terrain du traitement analytique et de l'IA. La relation entre les deux entreprises, autrefois complémentaire, se transforme en rivalité frontale à mesure que l'IA agentique redéfinit la valeur des couches données. D'autres partenaires de Microsoft pourraient se trouver dans la même situation si leurs outils empiètent sur des territoires que Redmond considère comme stratégiques.

UELes entreprises européennes utilisant conjointement Power BI et Databricks devront évaluer les risques de verrouillage dans l'écosystème Microsoft pour leurs déploiements d'agents IA.

💬 C'est le jeu classique de la plateforme qui ferme ses portes dès que les enjeux deviennent vraiment sérieux. Microsoft ne bloque pas Databricks parce que ça les gêne aujourd'hui, il bloque parce que Power BI est en train de devenir le point de passage obligatoire pour tout agent IA qui veut lire les données de ton entreprise. À 62 milliards de valorisation, Databricks n'est plus un partenaire à ménager.

BusinessOpinion
1 source
Microsoft et EY investissent 1 milliard de dollars pour accélérer l’industrialisation de l’IA
70Le Big Data 

Microsoft et EY investissent 1 milliard de dollars pour accélérer l’industrialisation de l’IA

Microsoft et EY ont annoncé le 21 mai 2026 un partenariat stratégique d'un milliard de dollars sur cinq ans pour accélérer le déploiement industriel de l'intelligence artificielle dans les grandes entreprises. L'initiative prévoit la constitution d'équipes mixtes, composées d'ingénieurs Microsoft et de consultants sectoriels EY, chargées d'accompagner les organisations dans l'intégration de l'IA au coeur de leurs opérations critiques. Les secteurs ciblés en priorité sont les services financiers, l'industrie, l'énergie, la santé, le secteur public, la distribution et les biens de consommation. EY a déjà généralisé Microsoft 365 E7 à plus de 400 000 collaborateurs dans le monde, après avoir déployé Copilot auprès de 150 000 employés avec un gain de productivité estimé à 15 %. Dans la finance, l'usage de Microsoft Power Platform et Copilot Studio aurait réduit certains délais opérationnels de 95 % et les coûts de plus de 37 %. EY a par ailleurs intégré un système multi-agents basé sur Azure, Microsoft Foundry et Microsoft Fabric dans sa plateforme d'audit EY Canvas, couvrant déjà 130 000 professionnels sur 160 000 missions. Ce partenariat répond à un blocage structurel que rencontrent aujourd'hui la plupart des grands groupes : passer des expérimentations isolées à un déploiement IA à l'échelle de l'entreprise. La majorité des organisations accumulent des pilotes sans parvenir à les industrialiser, faute de gouvernance adaptée, de formation des collaborateurs et de processus internes reconfigurés. En ciblant précisément les secteurs où l'automatisation et l'analyse de données produisent des impacts financiers rapides et mesurables, Microsoft et EY cherchent à répondre à l'exigence croissante de retour sur investissement concret que posent les directions générales avant tout nouvel engagement budgétaire dans l'IA. EY joue dans cette alliance la carte du "Client Zéro" : le cabinet teste les technologies Microsoft sur ses propres opérations avant de les proposer à ses clients, ce qui lui confère un avantage crédible dans un marché saturé de promesses non vérifiées. Ce positionnement intervient dans un contexte de compétition intense entre les grands cabinets de conseil et les éditeurs technologiques pour capter les budgets de transformation IA des entreprises du Fortune 500. Microsoft, de son côté, consolide son écosystème Azure et Copilot comme infrastructure de référence pour l'entreprise, face à la concurrence de Google Cloud et AWS. La suite dépendra de la capacité des deux groupes à démontrer des résultats reproductibles et auditables, condition sine qua non pour convaincre les directions financières d'accélérer leurs investissements au-delà des phases pilotes.

UELes grandes entreprises françaises et européennes des secteurs financier, énergétique, de la santé et du secteur public sont directement ciblées par ce programme d'industrialisation IA, susceptible d'accélérer les transformations numériques dans l'UE.

💬 Le problème qu'ils attaquent, l'industrialisation après les pilotes, c'est le vrai blocage de l'IA en entreprise depuis deux ans. EY qui joue le Client Zéro sur 400 000 collaborateurs, c'est l'argument le plus solide qu'un cabinet peut sortir face aux DG qui ont avalé trop de PowerPoints. Les 95% de réduction de délais affichés, bon, sur le papier ça claque, mais ça va être une autre histoire à reproduire sans EY dans la boucle.

BusinessOpinion
1 source
Créer des agents multi-locataires avec Amazon Bedrock AgentCore
71AWS ML Blog 

Créer des agents multi-locataires avec Amazon Bedrock AgentCore

Amazon a lancé Bedrock AgentCore, un service managé et serverless conçu pour permettre aux éditeurs de logiciels SaaS de déployer des applications agentiques en environnement multi-tenant sur AWS. Le service offre des primitives pour héberger des agents et des serveurs MCP (Model Context Protocol), avec une gestion intégrée des identités, de la mémoire, de l'observabilité et des évaluations. Le coeur de son architecture repose sur des microVMs isolées par session: chaque session client obtient son propre environnement d'exécution éphémère, avec un système de fichiers persistant propre, sans le coût ni la latence d'une machine virtuelle complète. Le contexte du tenant transite via des en-têtes HTTP personnalisés, portant l'identifiant du tenant, son niveau de service, ses préférences régionales et ses droits d'accès aux outils, ce qui permet à l'agent d'adapter dynamiquement son comportement sans logique de routage codée en dur. Cette approche répond directement au fossé qui sépare un prototype fonctionnel d'un déploiement en production dans un contexte SaaS. Les architectes d'applications agentiques devaient jusqu'ici résoudre manuellement six problèmes distincts: l'isolation des tenants, la propagation de leur identité, l'observabilité par tenant, l'isolation des données, l'attribution des coûts et la mitigation du "noisy neighbor" (un tenant monopolisant les ressources au détriment des autres). AgentCore propose trois patterns d'isolation, appelés Silo, Pool et Bridge, chacun offrant un compromis différent entre protection stricte et mutualisation des coûts. Pour les éditeurs gérant des centaines ou des milliers de clients sur une même plateforme, cette capacité à choisir un modèle d'isolation par segment tarifaire change concrètement l'équation économique et de conformité. Le lancement s'inscrit dans une course des grands fournisseurs cloud à imposer leurs infrastructures agentiques comme standard de facto pour la prochaine génération d'applications IA. AWS fait face à la concurrence directe de Google avec Vertex AI Agent Builder et de Microsoft avec Azure AI Agent Service, tous trois cherchant à capter les équipes d'ingénierie qui passent de l'expérimentation à la production. L'article publié par AWS est le premier d'une série, ce qui suggère que d'autres composants d'AgentCore (évaluation, fine-tuning par tenant, facturation granulaire) seront détaillés dans les prochaines semaines. La question centrale pour les équipes SaaS reste le degré de lock-in accepté en échange de la simplicité opérationnelle qu'offre un service pleinement managé.

UELes éditeurs SaaS européens construisant sur AWS peuvent exploiter les patterns d'isolation et les préférences régionales d'AgentCore pour satisfaire les exigences de résidence des données imposées par le RGPD.

OutilsOpinion
1 source
Amazon SageMaker AI prend en charge l'API compatible OpenAI
72AWS ML Blog 

Amazon SageMaker AI prend en charge l'API compatible OpenAI

Amazon a annoncé ce mois-ci que SageMaker AI supporte désormais une API compatible avec celle d'OpenAI pour ses endpoints d'inférence en temps réel. Concrètement, les développeurs qui utilisent le SDK OpenAI, LangChain ou le framework Strands Agents peuvent désormais router leurs appels vers des modèles hébergés sur SageMaker AI en changeant uniquement l'URL de l'endpoint. Plus besoin de client personnalisé, de wrapper SigV4, ni de réécriture de code. Les endpoints SageMaker exposent un chemin /openai/v1 qui accepte les requêtes au format Chat Completions et renvoie les réponses du conteneur telles quelles, y compris en streaming. L'authentification repose sur des tokens bearer à durée limitée (jusqu'à 12 heures), générés à partir des credentials AWS existants via le SDK Python SageMaker, sans clé API supplémentaire. Ce changement simplifie radicalement l'intégration de SageMaker dans les stacks d'IA existantes. Pour les équipes qui orchestrent des agents multi-LLM via une gateway (comme Bifrost, mentionnée par Giorgio Piatti, ingénieur ML chez Caffeine.AI), SageMaker devient un fournisseur interchangeable sans adaptation technique. Les cas d'usage sont nombreux : workflows agentiques tournant entièrement sur de l'infrastructure dédiée en compte AWS, hébergement multi-modèles sur un seul endpoint via les inference components (par exemple Llama pour les tâches générales, un Mistral fine-tuné pour un domaine métier, et un petit modèle de classification), ou encore déploiement de modèles open source fine-tunés sans toucher au code applicatif existant. Pour les entreprises soumises à des contraintes de souveraineté des données ou de conformité, c'est un gain concret : elles peuvent utiliser les mêmes frameworks standardisés OpenAI tout en gardant les modèles dans leur propre compte AWS. Cette annonce s'inscrit dans une bataille plus large pour capter les workloads d'inférence IA en entreprise. Le standard OpenAI s'est imposé de facto comme protocole universel pour les LLMs, et les grands fournisseurs cloud (AWS, Google, Azure) cherchent à réduire les frictions pour attirer des équipes déjà investies dans cet écosystème. Amazon avait déjà investi massivement dans Bedrock et SageMaker, mais l'adoption restait freinée par les incompatibilités d'API qui forçaient les migrations de code. En adoptant la compatibilité OpenAI directement au niveau de SageMaker AI, AWS ferme cet écart et concurrence frontalement des solutions comme Azure OpenAI Service ou les endpoints Vertex AI de Google. Le notebook d'exemple avec Qwen3-4B (modèle d'Alibaba disponible sur Hugging Face) illustre aussi l'ouverture vers les modèles open source, un segment en forte croissance face aux modèles propriétaires.

UELes entreprises européennes soumises aux contraintes RGPD et de souveraineté des données peuvent désormais utiliser les frameworks OpenAI standard tout en maintenant leurs modèles dans leur propre infrastructure AWS hébergée en région européenne.

💬 C'est le genre de truc qui semble anodin et qui change tout en pratique. Changer juste l'URL pour basculer d'OpenAI vers SageMaker, sans toucher au code, c'est exactement ce que les équipes enterprise attendaient pour switcher sans se battre avec leur DSI. Bon, ça reste AWS, donc la facture peut vite grimper, mais pour les boîtes avec des contraintes de souveraineté data, l'argument est solide.

OutilsOpinion
1 source
AION : la gigafactory IA d'Orange, EDF et Capgemini
73FrenchWeb 

AION : la gigafactory IA d'Orange, EDF et Capgemini

Ardian, Orange, EDF, Capgemini, Artefact, Bull, le Groupe iliad et Scaleway ont annoncé leur regroupement au sein du consortium AION pour déposer une candidature française au programme européen des AI Gigafactories. Cette initiative, portée par la Commission européenne dans le cadre de son agenda pour la souveraineté numérique, vise à financer la construction de centres de calcul massifs dédiés à l'intelligence artificielle sur le sol européen. L'alliance réunit ainsi des acteurs complémentaires : un fonds d'investissement de premier plan, deux géants de l'énergie et des télécoms, un intégrateur IT mondial et plusieurs spécialistes du cloud français. L'enjeu est considérable pour l'écosystème européen de l'IA. L'Europe accuse un retard structurel face aux États-Unis et à la Chine en matière de puissance de calcul disponible pour entraîner et faire tourner des grands modèles de langage. Une gigafactory labellisée par Bruxelles permettrait de concentrer des milliers de GPU sur un même site, d'en garantir l'accès à des startups et laboratoires de recherche européens à des conditions compétitives, et de réduire la dépendance aux infrastructures américaines comme AWS ou Azure. Le programme AI Gigafactories s'inscrit dans le plan InvestAI annoncé par la Commission européenne début 2025, qui ambitionne de mobiliser 200 milliards d'euros pour rattraper le retard du continent. Plusieurs États membres ont déjà soumis des candidatures, et la France entend peser dans cette compétition en fédérant ses acteurs industriels et technologiques les plus solides. Le choix des lauréats par Bruxelles déterminera quels pays accueilleront les prochains piliers de l'infrastructure IA continentale.

UELe consortium AION réunit Orange, EDF, Capgemini, iliad et Scaleway pour candidater au programme européen des AI Gigafactories, ce qui pourrait permettre à la France d'accueillir un centre de calcul souverain offrant aux startups et laboratoires européens un accès compétitif à la puissance GPU nécessaire à l'entraînement de grands modèles.

💬 Du lourd dans ce consortium : Orange, EDF, Scaleway, iliad, c'est pas une candidature symbolique. Ce qui m'intéresse vraiment là-dedans, c'est pas la gigafactory en elle-même, c'est l'accès GPU garanti pour les startups et labos européens qui galèrent à se payer du compute H100. Bruxelles retient 2-3 sites max sur tout le continent, et là, faut pas se louper.

InfrastructureActu
1 source
Face aux États-Unis et à la Chine, MISTRAL cherche son propre modèle d’IA et fait l’acquisition d’Emmi AI
74FrenchWeb 

Face aux États-Unis et à la Chine, MISTRAL cherche son propre modèle d’IA et fait l’acquisition d’Emmi AI

Mistral AI, la startup parisienne fondée en 2023 et valorisée plus de six milliards d'euros, annonce l'acquisition d'Emmi AI, une société spécialisée dans les agents conversationnels d'entreprise. Cette opération s'inscrit dans une stratégie de diversification accélérée : plutôt que de se limiter à l'entraînement de modèles fondationnels, Mistral cherche à construire une offre verticalement intégrée, allant du modèle de base jusqu'aux applications déployées chez les clients. Les détails financiers de l'acquisition n'ont pas été rendus publics. L'enjeu est de taille pour l'écosystème européen. Les entreprises du continent restent largement dépendantes des hyperscalers américains (AWS, Azure, Google Cloud) pour leurs infrastructures, des GPU NVIDIA pour le calcul, et des modèles d'OpenAI, Anthropic ou Google pour l'inférence. En absorbant Emmi AI, Mistral tente de proposer une alternative souveraine complète aux directions informatiques européennes soucieuses de leur autonomie stratégique et de conformité réglementaire, notamment au regard de l'AI Act européen entré en vigueur en 2024. Ce rachat intervient alors que la compétition internationale s'intensifie sur deux fronts simultanés : les États-Unis maintiennent leur avance sur les modèles de pointe, tandis que la Chine rattrape son retard à marche forcée avec des architectures intégrées comme celles de Huawei ou Baidu. Pour Mistral, qui a levé 1,1 milliard de dollars en 2024 avec des investisseurs comme Andreessen Horowitz et la Banque publique d'investissement, l'heure est au passage à l'échelle commerciale, pas seulement technologique.

UEL'acquisition d'Emmi AI par Mistral AI renforce l'offre souveraine européenne en agents IA d'entreprise, donnant aux DSI françaises et européennes une alternative intégrée aux solutions américaines, dans un contexte de conformité à l'AI Act.

💬 Mistral fait le pari qu'un modèle de base, ça ne suffit plus. Racheter Emmi AI, c'est aller chercher le client là où il est, dans ses workflows d'entreprise, plutôt que d'attendre qu'il vienne lui-même sur une API. Reste à voir si une startup, même avec un milliard en caisse, peut tenir tête aux hyperscalers sur leur propre terrain.

BusinessOpinion
1 source
Microsoft a récupéré plus du double de son investissement de 13 milliards de dollars dans OpenAI
75The Information AI 

Microsoft a récupéré plus du double de son investissement de 13 milliards de dollars dans OpenAI

Microsoft a investi 13 milliards de dollars dans OpenAI sur plusieurs années, obtenant en échange un droit exclusif de revendre les modèles de langage de la startup à d'autres entreprises via son cloud Azure. Pendant trois ans, Microsoft était ainsi le seul fournisseur cloud autorisé à commercialiser GPT-4 et ses successeurs auprès des professionnels. Malgré cet avantage concurrentiel, les données révèlent que les entreprises ont acheté davantage de capacités directement auprès d'OpenAI que via Microsoft durant cette période. Selon les estimations de The Information, basées sur des documents financiers d'OpenAI et des témoignages internes, Microsoft a toutefois déjà récupéré plus du double de son investissement initial en revenus nouveaux générés par les services liés à la technologie d'OpenAI. Ce résultat illustre que la valeur du partenariat pour Microsoft dépasse largement la simple revente de modèles. L'intégration de Copilot dans Microsoft 365, Azure OpenAI Service et les outils GitHub ont tous bénéficié directement de l'accès privilégié aux modèles d'OpenAI, générant des milliards de revenus supplémentaires que la comptabilité classique ne capturait pas forcément. Ce partenariat s'est construit dans un contexte de course effrénée à l'IA générative, où Microsoft cherchait à rattraper Google sur le terrain de la recherche et des outils de productivité. La relation entre les deux entreprises reste toutefois complexe : OpenAI développe désormais ses propres offres cloud concurrentes, et l'exclusivité commerciale de Microsoft s'érode progressivement, redessinant les contours d'une alliance stratégique à plusieurs dizaines de milliards de dollars.

UEL'érosion progressive de l'exclusivité commerciale de Microsoft sur les modèles OpenAI pourrait modifier les conditions d'accès et de tarification pour les entreprises européennes utilisant Azure OpenAI Service.

BusinessActu
1 source
OpenAI va économiser 97 milliards de dollars d'ici 2030 grâce à son nouvel accord avec Microsoft
76The Information AI 

OpenAI va économiser 97 milliards de dollars d'ici 2030 grâce à son nouvel accord avec Microsoft

OpenAI a conclu un nouvel accord avec Microsoft qui lui permettra d'économiser jusqu'à 97 milliards de dollars d'ici 2030. C'est la directrice financière Sarah Friar qui supervise cette renégociation majeure, dont les détails n'avaient jusqu'ici pas été rendus publics. Selon les termes initiaux du partenariat, OpenAI devait reverser 20 % de ses revenus à Microsoft, une clause qui aurait pu représenter 135 milliards de dollars si la société atteignait ses objectifs de croissance à long terme. Le nouvel accord réduit drastiquement cette obligation, limitant la part due à Microsoft à une fraction de ce montant. Cet allègement financier est considérable pour OpenAI, dont les ambitions d'expansion nécessitent des capitaux massifs. La société, valorisée à plus de 300 milliards de dollars après sa dernière levée de fonds, doit financer le développement de ses modèles, l'infrastructure de calcul et l'internationalisation de ChatGPT. Réduire la charge liée au partage de revenus libère des marges de manœuvre significatives pour investir dans la recherche et rester compétitif face à Google, Anthropic et Meta. Le partenariat entre OpenAI et Microsoft remonte à 2019, quand le géant de Redmond a injecté un premier milliard de dollars dans la startup. Depuis, Microsoft a engagé plus de 13 milliards de dollars et intégré les technologies d'OpenAI dans ses produits phares, de Copilot à Azure. La renégociation de cet accord de partage de revenus reflète le rapport de force qui a évolué entre les deux entités, OpenAI cherchant à préserver son autonomie financière à mesure qu'elle se transforme en une entreprise à but lucratif.

💬 Le rapport de force a changé de camp. Quand Microsoft a posé son premier milliard en 2019, les termes du deal reflétaient exactement ça, OpenAI avait besoin d'eux. À 300 milliards de valorisation, continuer à reverser 20% des revenus à Redmond, c'était une anomalie qui ne pouvait pas tenir.

BusinessActu
1 source
Claude sur AWS : toute la plateforme d'Anthropic
77Le Big Data 

Claude sur AWS : toute la plateforme d'Anthropic

Anthropic a annoncé ce 11 mai 2026 que l'intégralité de sa plateforme Claude est désormais accessible directement depuis Amazon Web Services, sous forme de disponibilité générale. Concrètement, les clients AWS peuvent désormais utiliser l'ensemble des fonctionnalités de l'API Claude, Claude Managed Agents pour déployer des agents IA à grande échelle, exécution de code Python via API, recherche web intégrée, et un système de Skills permettant à Claude d'apprendre des comportements ou méthodes de travail spécifiques, sans quitter leur environnement cloud habituel. L'intégration couvre l'authentification IAM, la facturation unifiée AWS, les audits via CloudTrail, et un accès immédiat aux nouvelles fonctionnalités au fil de leur sortie. Jusqu'ici, plusieurs capacités avancées de Claude restaient réservées à l'API native d'Anthropic. Pour les équipes techniques en entreprise, le gain est avant tout opérationnel : plus besoin de gérer des systèmes parallèles de connexion, de facturation ou de permissions. Cette simplification réduit la friction à l'adoption et abaisse la barrière d'entrée pour les organisations déjà investies dans AWS. Anthropic précise toutefois que le traitement des données sur cette plateforme s'effectue en dehors de l'infrastructure AWS classique, une nuance importante pour les entreprises soumises à des contraintes strictes de souveraineté ou de conformité. Pour celles-là, Anthropic maintient une offre distincte via Amazon Bedrock, où AWS reste l'opérateur principal et les données demeurent dans l'infrastructure Amazon, deux positionnements qui ciblent deux profils d'entreprises différents. Cette annonce s'inscrit dans une bataille industrielle plus large où les plateformes cloud sont devenues les principales portes d'entrée de l'IA générative. OpenAI pousse ChatGPT Enterprise, Google multiplie les intégrations Gemini dans son écosystème, Microsoft verrouille ses capacités IA dans Azure, et Anthropic devait muscler son jeu pour ne pas rester un fournisseur de modèles sans ancrage infrastructure. Le partenariat entre Anthropic et Amazon, qui s'est matérialisé par un investissement massif d'Amazon dans Anthropic ces dernières années, trouve ici une nouvelle expression concrète. En intégrant Claude profondément dans AWS, Anthropic gagne en distribution et en crédibilité enterprise, tandis qu'Amazon renforce l'attractivité de son cloud pour les projets IA. La prochaine étape sera de voir si cette intégration accélère effectivement l'adoption de Claude dans les grandes organisations, ou si la question non résolue de la localisation des données freinera les déploiements dans les secteurs les plus régulés.

UELes entreprises européennes sur AWS peuvent désormais accéder à l'ensemble de la plateforme Claude sans friction opérationnelle, mais le traitement des données hors infrastructure AWS standard soulève des questions de conformité pour les secteurs soumis aux exigences de souveraineté numérique de l'UE.

OutilsOpinion
1 source
Ruben BRYON, construire une alternative européenne au cloud américain
78FrenchWeb 

Ruben BRYON, construire une alternative européenne au cloud américain

Ruben Bryon a commencé à coder seul à l'âge de 12 ans, allant jusqu'à percer un mur dans le garage familial pour refroidir ses premiers serveurs. Quinze ans plus tard, il dirige Verda, une entreprise fondée sous le nom de DataCrunch, qui ambitionne de construire la première "Gigafactory" européenne de l'intelligence artificielle. Concrètement, il s'agit de déployer des centres de données massivement équipés en GPU, les puces indispensables à l'entraînement et à l'inférence des grands modèles d'IA, sur le sol européen, en dehors de la dépendance aux hyperscalers américains comme AWS, Azure ou Google Cloud. L'enjeu est considérable pour l'industrie technologique européenne. Les startups et laboratoires de recherche du continent paient aujourd'hui leurs coûts de calcul à des entreprises américaines, ce qui crée une dépendance structurelle tant sur le plan économique que réglementaire. Une infrastructure GPU souveraine permettrait aux acteurs européens de développer et déployer des modèles d'IA sans que leurs données transitent par des juridictions soumises au droit américain, un point particulièrement sensible depuis le Cloud Act de 2018. L'initiative de Bryon s'inscrit dans un mouvement plus large de souveraineté numérique européenne, porté aussi bien par des régulations comme le RGPD que par des initiatives industrielles telles que GAIA-X. Face à la concentration du marché du cloud d'IA entre les mains de quelques géants américains, des acteurs comme Verda cherchent à occuper le créneau de l'infrastructure de confiance en Europe, à mesure que la demande en puissance de calcul pour l'IA continue d'exploser.

UEVerda déploie des centres de données GPU sur sol européen pour permettre aux startups et laboratoires de recherche européens d'entraîner leurs modèles d'IA sans transiter par des juridictions soumises au Cloud Act américain.

💬 C'est exactement ce qu'on attendait depuis que le Cloud Act a rendu la question brûlante. Partir de l'infra GPU, pas du cadre réglementaire, c'est ce qui distingue Verda de toutes les initiatives européennes de souveraineté numérique qui finissent en comité de pilotage. Reste à voir si les capitaux suivent à l'échelle d'une gigafactory.

InfrastructureOpinion
1 source
AgentCore Optimization : AWS lance une boucle d'amélioration des performances des agents
79AWS ML Blog 

AgentCore Optimization : AWS lance une boucle d'amélioration des performances des agents

Amazon a annoncé le lancement en préversion d'AgentCore Optimization, une nouvelle fonctionnalité intégrée à sa plateforme Amazon Bedrock AgentCore. Cette brique complète ce qu'Amazon appelle la boucle "observer, évaluer, améliorer" pour les agents IA en production. Concrètement, le système analyse automatiquement les traces de production, génère des recommandations d'optimisation pour les prompts système ou les descriptions d'outils, puis propose deux mécanismes de validation : l'évaluation par lot sur des jeux de données prédéfinis, et les tests A/B en conditions réelles via AgentCore Gateway, avec découpage du trafic en production à un pourcentage configurable et résultats assortis d'intervalles de confiance et de signification statistique. NTT DATA, partenaire annoncé lors du lancement, indique que des processus qui nécessitaient auparavant plusieurs semaines d'ajustement manuel de prompts peuvent désormais s'exécuter en cycles rapides et reproductibles. L'enjeu est de taille pour les équipes produit qui déploient des agents IA : la qualité d'un agent se dégrade silencieusement à mesure que les modèles évoluent, que le comportement des utilisateurs change, et que les prompts sont réutilisés dans des contextes imprévus. Jusqu'ici, la remédiation reposait entièrement sur l'intuition du développeur, lire des traces, formuler une hypothèse, réécrire le prompt, tester quelques cas, déployer, un cycle qui introduit souvent de nouveaux problèmes en corrigeant les anciens. AgentCore Optimization remplace cette boucle artisanale par un processus systématique fondé sur les données : les recommandations sont générées à partir des traces réelles et validées avant tout déploiement, éliminant la part de pari inhérente aux corrections en aveugle. Amazon Bedrock AgentCore, déjà utilisé par des milliers de développeurs pour construire des agents capables de raisonner et d'agir dans des workflows complexes, s'enrichit ainsi d'une couche d'amélioration continue qui manquait jusqu'à présent à l'écosystème. Les grandes équipes disposent certes d'équipes scientifiques dédiées et de benchmarks centralisés, mais ces dispositifs fonctionnent sur des cycles hebdomadaires ou mensuels, pendant que les agents dérivent en production chaque jour. En intégrant la traçabilité OpenTelemetry, les évaluateurs built-in (taux de succès, précision de sélection d'outils, sécurité), et la possibilité de simuler des jeux de données via un acteur LLM jouant le rôle de l'utilisateur final, Amazon positionne AgentCore comme une plateforme complète pour industrialiser l'optimisation des agents, une capacité qui pourrait devenir un critère de choix déterminant face à des concurrents comme Google Vertex AI ou Microsoft Azure AI Foundry.

UELes équipes européennes déployant des agents IA sur Amazon Bedrock peuvent désormais automatiser l'optimisation de leurs prompts et outils, réduisant des cycles d'ajustement manuel qui duraient plusieurs semaines à des itérations rapides et reproductibles.

OutilsOutil
1 source
Big Tech prouve l'efficacité de ses dépenses en infrastructure IA, et augmente quand même la facture
80AI News 

Big Tech prouve l'efficacité de ses dépenses en infrastructure IA, et augmente quand même la facture

Microsoft, Alphabet, Meta et Amazon ont publié leurs résultats trimestriels le même jour, offrant la première vérification à grande échelle du pari colossal qu'elles ont engagé sur l'infrastructure IA. Le verdict est sans ambiguïté : les quatre entreprises ont dépassé les attentes des analystes, et toutes quatre ont simultanément rehaussé leurs prévisions de dépenses en capital pour 2026. Ensemble, elles s'engagent désormais sur une enveloppe totale comprise entre 630 et 650 milliards de dollars pour l'année. Microsoft a enregistré un chiffre d'affaires de 82,9 milliards de dollars au premier trimestre, en hausse de 18 % sur un an, avec une croissance d'Azure à 40 % en devise constante, au-delà des 38,8 % anticipés par le consensus CNBC. Les revenus annualisés liés à l'IA dépassent désormais 37 milliards de dollars. Alphabet a affiché sa plus forte croissance trimestrielle depuis 2022, avec un bond de 63 % pour Google Cloud et un bénéfice net de 62,57 milliards de dollars, en hausse de 81 % sur un an. Meta a de son côté enregistré une croissance de 33 % de ses revenus, à 56,31 milliards de dollars, son rythme le plus rapide depuis 2021. AWS d'Amazon a connu sa croissance la plus rapide en quinze trimestres. Ces chiffres importent parce qu'ils répondent à la question que les marchés posaient depuis des mois : l'infrastructure IA génère-t-elle des retours ? La réponse est oui, mais avec une nuance cruciale. Chez Meta, c'est la plateforme publicitaire Advantage+, dopée à l'IA, qui transforme les investissements en revenus. Chez Microsoft, les obligations de performances commerciales restantes ont bondi de 99 % à 627 milliards de dollars, signe d'une demande entreprise robuste. Chez Alphabet, le PDG Sundar Pichai a lui-même reconnu que la société est "contrainte à court terme par les capacités de calcul", ce qui signifie que la demande dépasse la vitesse de construction. Pourtant, malgré des résultats opérationnels solides, le titre Microsoft a reculé de plus de 3 % en après-marché, preuve que les investisseurs scrutent désormais les dépenses autant que les revenus. Cet épisode s'inscrit dans une dynamique plus large qui s'est accélérée depuis le lancement de ChatGPT fin 2022 : les grandes plateformes technologiques ont transformé leurs bilans en paris sur l'infrastructure IA, convaincues que celui qui construit le plus vite capturera la valeur de la prochaine décennie. Microsoft relève sa prévision de capex annuel à 190 milliards de dollars, bien au-delà des 154,6 milliards attendus. Meta porte la sienne à 125-145 milliards, en partie à cause de la hausse des prix des composants. Alphabet annonce que ses dépenses 2027 "augmenteront significativement" par rapport à 2026. La question ouverte est celle de la soutenabilité : les revenus publicitaires et cloud peuvent-ils continuer à financer des engagements qui rivalisent avec le PIB de certains États, à mesure que la concurrence entre Google, Microsoft, Meta et Amazon s'intensifie sur chaque couche de la pile IA ?

UELes engagements massifs de capex des géants américains conditionnent l'offre et les tarifs cloud IA accessibles aux entreprises européennes à moyen terme.

BusinessOpinion
1 source
IDC : comment les DSI de la zone EMEA peuvent accélérer leurs déploiements IA
81AI News 

IDC : comment les DSI de la zone EMEA peuvent accélérer leurs déploiements IA

Selon une étude IDC publiée en 2026, seulement 9 % des organisations de la région EMEA ont réussi à tirer des résultats business quantifiables de la majorité de leurs projets d'intelligence artificielle au cours des deux dernières années. Les 91 % restants sont enlisés dans la même impasse : des pilotes qui ne franchissent jamais le stade de la production. Après dix-huit mois d'investissements massifs dans les grands modèles de langage et le machine learning, les conseils d'administration freinent désormais, réduisent la voilure ou réorientent leurs initiatives IA. La cause n'est pas un désintérêt technique, mais une incapacité à démontrer un retour sur investissement concret face à des directions financières de plus en plus sceptiques et des pressions macroéconomiques croissantes. Le problème central tient à une inadéquation entre les méthodes traditionnelles d'évaluation et la nature réelle de la valeur générée par l'IA. Les outils de procurement classiques mesurent le logiciel à l'aune de la réduction de personnel, alors que les bénéfices des modèles génératifs se matérialisent différemment : nouveaux flux de revenus, accélération de la productivité, réduction des risques opérationnels. Un outil de maintenance prédictive dans une usine manufacturière n'élimine pas des postes d'ingénieurs, mais peut éviter une panne catastrophique de la chaîne d'assemblage, une économie réelle qui n'apparaît sur aucun tableau de bord budgétaire standard. Sans cadre financier adapté, les pilotes prometteurs perdent leur financement avant d'atteindre les réseaux de production. À cela s'ajoute le gouffre infrastructurel : passer d'un environnement sandbox AWS ou Azure à un déploiement d'entreprise complet expose des incompatibilités majeures entre bases vectorielles modernes et systèmes Oracle ou SAP vieillissants, des données mal structurées qui alimentent les hallucinations, et des coûts d'inférence et de fine-tuning qui explosent à mesure que le déploiement s'étend. Ce blocage s'inscrit dans un contexte réglementaire européen particulièrement exigeant, où les lois sur la protection des données et la cybersécurité imposent des contraintes strictes : documentation des arbres de décision des modèles, protection contre les attaques par injection de prompts, gouvernance formelle. Si beaucoup d'équipes vivent ces obligations comme un frein, IDC observe que les rares organisations ayant réussi à scaler leurs projets adoptent la posture inverse : elles intègrent la conformité dès la conception, ce qui accélère in fine le déploiement, améliore la résilience des systèmes et renforce la confiance des clients. Pour débloquer la situation, IDC recommande aux DSI de retravailler activement leurs calculs de ROI pour capturer ces bénéfices indirects, et de traiter la réglementation non comme un obstacle mais comme un levier d'architecture.

UELes DSI français et européens doivent revoir leurs cadres de mesure du ROI et peuvent transformer les contraintes réglementaires européennes (AI Act, RGPD, cybersécurité) en levier d'accélération en intégrant la conformité dès la conception de leurs projets IA.

BusinessOpinion
1 source
L'accord historique sur l'AGI entre Microsoft et OpenAI prend fin
82The Verge 

L'accord historique sur l'AGI entre Microsoft et OpenAI prend fin

Microsoft a annoncé lundi matin des modifications majeures à son partenariat historique avec OpenAI, dont la plus symbolique est la suppression officielle de la clause sur l'intelligence artificielle générale (AGI) qui régissait leur accord depuis plusieurs années. Selon les nouveaux termes, Microsoft demeure le "partenaire cloud principal" d'OpenAI, les produits de la startup étant toujours déployés en priorité sur Azure, sauf si Microsoft choisit de ne pas supporter les capacités requises. La rupture décisive: OpenAI peut désormais distribuer l'ensemble de ses produits à ses clients via n'importe quel fournisseur cloud. Ce changement libère considérablement OpenAI dans sa conquête du marché entreprise. En pouvant s'appuyer sur AWS, Google Cloud ou d'autres infrastructures concurrentes, la startup n'est plus tributaire des capacités ou des priorités commerciales de Microsoft. Pour les grandes entreprises clientes, cela signifie davantage de choix et de flexibilité pour intégrer les technologies OpenAI dans leurs environnements existants, ce qui rend OpenAI plus compétitif face à des acteurs comme Anthropic ou Google DeepMind. L'accord originel entre les deux entreprises, construit autour d'un investissement total de Microsoft dépassant treize milliards de dollars, contenait une clause AGI à la portée symbolique considérable: une fois OpenAI jugée avoir atteint l'AGI, les termes du partenariat devaient être renégociés. Sa suppression intervient alors qu'OpenAI finalise sa transformation en société à but lucratif classique et cherche activement à diversifier ses revenus et ses alliances technologiques dans un marché de l'IA de plus en plus concurrentiel.

UELes entreprises européennes clientes d'OpenAI gagnent en flexibilité pour déployer ses technologies sur des infrastructures cloud alternatives, potentiellement incluant des fournisseurs européens, réduisant leur dépendance à Azure.

BusinessOpinion
1 source
Les nuances de la marge brute de Cursor, comparatif GPT-5.5 et Claude Mythos
83The Information AI 

Les nuances de la marge brute de Cursor, comparatif GPT-5.5 et Claude Mythos

Microsoft et OpenAI ont revu les termes de leur partenariat, avec deux concessions majeures : Azure perd son droit exclusif de distribuer les modèles OpenAI, et Microsoft n'est plus tenu de reverser 20 % des revenus générés par ces modèles sur sa plateforme cloud. Cette renégociation intervient après que des cadres de Microsoft ont exprimé des inquiétudes le mois dernier : OpenAI avait annoncé un projet de déploiement d'un agent IA via Amazon Web Services, ce qui, selon eux, violait le contrat d'exclusivité liant les deux entreprises. Par ailleurs, Cursor, la startup spécialisée dans le codage assisté par IA, continue sa montée en puissance avec un chiffre d'affaires annualisé atteignant 2,7 milliards de dollars en mars 2026, contre 1 milliard en novembre 2025. SpaceX dispose désormais d'une option d'achat sur la société valorisée à 60 milliards de dollars. Ces deux révélations illustrent les tensions structurelles qui traversent l'écosystème IA. Du côté OpenAI-Microsoft, la fin de l'exclusivité Azure signifie qu'OpenAI peut désormais s'appuyer sur d'autres clouds pour commercialiser ses modèles, ce qui lui donne un levier de négociation et une flexibilité stratégique accrue. Pour Cursor, la croissance spectaculaire masque une réalité financière préoccupante : la marge brute était de -23 % au trimestre clos en janvier 2026, avant de passer tout juste en territoire positif. Les coûts d'inférence, c'est-à-dire le calcul nécessaire pour faire tourner les modèles, plombent la rentabilité. Ce contexte met en lumière une pratique comptable discrète mais répandue dans le secteur : certaines startups IA classent une partie de leurs dépenses d'inférence en frais marketing plutôt qu'en coût des ventes. Cela ne change pas les pertes nettes, mais améliore artificiellement la marge brute, un indicateur clé pour les investisseurs. Ce tour de passe-passe comptable révèle à quel point les marges sont sous pression dans l'IA générative, y compris pour des acteurs en forte croissance. La question de la rentabilité réelle de ces modèles économiques reste entière, alors que les valorisations continuent de s'envoler.

UELa fin de l'exclusivité Azure pour les modèles OpenAI pourrait indirectement modifier les conditions d'accès des entreprises européennes aux API d'OpenAI via d'autres clouds, mais l'impact direct sur la France ou l'UE reste limité à court terme.

BusinessOpinion
1 source
Google prêt à investir 40 milliards dans Anthropic pour rivaliser avec OpenAI
84Le Big Data 

Google prêt à investir 40 milliards dans Anthropic pour rivaliser avec OpenAI

Google s'apprête à injecter au minimum 10 milliards de dollars dans Anthropic, avec une enveloppe totale pouvant atteindre 40 milliards si la startup atteint certains objectifs de performance. L'annonce, révélée par Bloomberg le 24 avril 2026, propulse la valorisation d'Anthropic à 350 milliards de dollars. Ce mouvement intervient quelques jours après qu'Amazon a lui-même engagé 5 milliards supplémentaires dans la même entreprise. Côté infrastructure, Google s'engage également à fournir 5 gigawatts de puissance de calcul via ses TPU sur cinq ans, une ressource aussi stratégique que le capital financier pour une startup dont les modèles tournent en permanence à pleine capacité. Google n'est pas un nouvel entrant dans le capital d'Anthropic, mais l'ampleur de cet engagement marque un changement d'échelle radical. Cet investissement révèle une logique qui dépasse le simple pari financier. Google cherche à sécuriser un accès privilégié aux technologies d'Anthropic pour combler son retard face à OpenAI, dont ChatGPT domine encore les usages professionnels et grand public. En échange, Anthropic consomme les infrastructures cloud et les puces de ses investisseurs, ce qui génère en retour des revenus pour Google Cloud, lesquels dépasseraient déjà ceux produits par Gemini selon des données de marché citées dans l'annonce. La startup attire ces capitaux grâce à la traction réelle de ses produits : les modèles Claude et notamment Claude Code connaissent une adoption rapide dans les environnements de développement logiciel, même si les gains de productivité restent inégaux selon les cas d'usage. La croissance brutale de la demande a cependant généré des tensions opérationnelles, avec des pannes et des limitations de service aux heures de pointe que l'entreprise tente de réguler en bridant certaines fonctionnalités pour les offres d'entrée de gamme. Cette opération s'inscrit dans une recomposition profonde du marché de l'IA, où les géants du cloud ne développent plus uniquement leurs propres modèles mais financent des acteurs indépendants pour diversifier leurs positions. Microsoft applique la même stratégie avec OpenAI depuis 2019, combinant investissement massif et fourniture d'infrastructures Azure. Amazon multiplie les paris avec Anthropic et d'autres startups. Google joue désormais sur les deux tableaux : Gemini en interne, Claude en externe. Ce modèle d'alliance hybride devient la norme dans une industrie où les coûts d'entraînement et d'inférence à grande échelle dépassent ce que même les mieux financés peuvent absorber seuls. La prochaine étape pour Anthropic sera de démontrer que cette valorisation de 350 milliards se justifie par des revenus récurrents solides, dans un marché où la concurrence entre OpenAI, Google, Meta et les challengers comme Mistral ne laisse aucune place à la stagnation.

UECet investissement massif consolide la domination américaine dans l'IA générative et intensifie la pression concurrentielle sur les acteurs européens, notamment Mistral, dans la course aux modèles fondateurs.

OpenAI intensifie sa présence sur AWS alors que ses clients se tournent vers la concurrence
85The Information AI 

OpenAI intensifie sa présence sur AWS alors que ses clients se tournent vers la concurrence

Amazon Web Services a annoncé un accord pour intégrer les modèles d'OpenAI à sa plateforme cloud, via une nouvelle offre orientée vers l'exécution d'agents IA. L'annonce, attendue depuis plusieurs années, marque la première présence officielle d'OpenAI sur AWS, le plus grand fournisseur de cloud au monde. Six entreprises interrogées, clientes d'AWS ou consultantes pour ses clients, ont réagi avec un enthousiasme modéré, soulignant qu'elles n'ont pas attendu pour trouver des alternatives. L'arrivée tardive d'OpenAI sur AWS change peu de chose pour une partie des acteurs du marché : beaucoup se sont déjà organisés autour d'autres modèles disponibles via le service Bedrock d'Amazon, notamment ceux d'Anthropic et les modèles maison Amazon Nova, réputés pour leur rapport qualité-prix. Certaines entreprises accèdent déjà aux modèles OpenAI via Microsoft Azure ou Google Cloud, rendant l'accord AWS moins stratégique qu'il n'y paraît. Pour elles, le changement de fournisseur représente un coût de migration difficile à justifier. Cet accord intervient trois ans après qu'OpenAI a déclenché la course mondiale à l'IA avec le lancement de ChatGPT, période durant laquelle les concurrents ont comblé une grande partie de l'écart technologique. Amazon a massivement investi dans Anthropic, et les clients ont eu le temps de construire des intégrations solides avec ces modèles alternatifs. L'enjeu pour OpenAI est désormais de convaincre un marché qui a appris à se passer de lui, dans un contexte où la fidélité aux fournisseurs cloud se construit sur des mois d'intégration technique.

UELes entreprises européennes hébergées sur ce cloud disposent désormais d'un canal supplémentaire pour accéder aux modèles d'OpenAI, mais l'impact pratique reste limité car la majorité a déjà construit des intégrations solides avec des alternatives compétitives.

BusinessOpinion
1 source
Google I/O : les entreprises veulent de l'aide pour exploiter l'IA
86The Information AI 

Google I/O : les entreprises veulent de l'aide pour exploiter l'IA

Lors de la conférence Google Cloud Next, le discours dominant a changé de cap par rapport à l'année précédente. En 2025, les dirigeants de Google vantaient la puissance brute de leurs modèles d'IA pour les entreprises. En 2026, le message central est devenu : comment aider concrètement les entreprises à faire fonctionner ces modèles. Des entretiens menés sur place auprès de clients et de revendeurs Google Cloud révèlent que de nombreuses organisations buttent sur des obstacles concrets dans leur adoption de l'IA, certaines peinent encore à déployer leur premier agent, tandis que d'autres se retrouvent à gérer une multitude d'agents dont la coordination devient ingérable. Ce glissement de priorité illustre un problème structurel de l'industrie : l'écart entre la promesse marketing des outils d'IA et leur déploiement opérationnel réel. Les entreprises ne manquent pas de modèles ni d'accès aux API, elles manquent d'expertise pour intégrer ces briques dans leurs processus métier, gérer les erreurs, orchestrer plusieurs agents en parallèle et maintenir des systèmes fiables en production. C'est un frein majeur à la monétisation pour les fournisseurs de cloud, qui misent sur la consommation à grande échelle. Google Cloud se retrouve dans une position partagée par ses concurrents Microsoft Azure et Amazon Web Services : après avoir massivement investi dans la course aux modèles, les hyperscalers doivent maintenant construire la couche de services, d'outillage et d'accompagnement qui transforme la puissance brute en valeur business. La conférence Next marque ainsi une maturité nouvelle du marché, où l'implémentation devient le vrai champ de bataille.

UELes entreprises européennes font face aux mêmes obstacles d'adoption de l'IA, et pourraient bénéficier des nouvelles couches de services et d'outillage que les hyperscalers développent pour faciliter le déploiement opérationnel.

BusinessOpinion
1 source
Health Data Hub : la France acte (enfin) son virage vers un cloud souverain / UNIVITY mise 27 millions d’euros sur une infrastructure spatiale 5G / De Mistral à xAI : Devendra Chaplot change de camp
87FrenchWeb 

Health Data Hub : la France acte (enfin) son virage vers un cloud souverain / UNIVITY mise 27 millions d’euros sur une infrastructure spatiale 5G / De Mistral à xAI : Devendra Chaplot change de camp

La Plateforme des données de santé a officiellement sélectionné Scaleway, filiale du groupe Iliad, pour héberger ses infrastructures, mettant fin à des années de dépendance vis-à-vis de Microsoft Azure. Ce choix, issu d'un appel d'offres rigoureux, éloigne les données médicales de millions de Français du spectre du Cloud Act américain et affirme un virage vers la souveraineté numérique. En parallèle, la startup UNIVITY annonce une levée de 27 millions d'euros pour déployer une infrastructure 5G spatiale combinant satellites et réseaux terrestres. Enfin, Devendra Chaplot, chercheur passé par Mistral AI, rejoint xAI, la société d'intelligence artificielle d'Elon Musk. Ces trois actualités convergent autour d'un même enjeu : la souveraineté technologique européenne. Le choix de Scaleway par le Health Data Hub répond aux alertes répétées de la CNIL sur les risques d'exposition des données de santé aux injonctions extraterritoriales américaines, et constitue un signal fort pour les opérateurs de cloud souverain français. L'investissement d'UNIVITY positionne l'Europe sur le marché de la connectivité satellitaire face à Starlink, tandis que le départ de Chaplot vers xAI illustre la capacité des mastodontes américains à capter les talents IA européens. La controverse autour du Health Data Hub remonte à 2020, quand le contrat Microsoft avait déclenché une vague de critiques de juristes et d'associations de défense des droits numériques. Scaleway, certifié hébergeur de données de santé (HDS), était depuis le candidat naturel à ce contrat stratégique. Plus largement, ces trois événements dessinent un écosystème européen en tension entre ambition souveraine et attraction irrésistible des géants américains de la tech.

UELe Health Data Hub migre de Microsoft Azure vers Scaleway (groupe Iliad), soustrayant les données médicales de millions de Français au Cloud Act américain, victoire directe pour la souveraineté numérique française et signal fort pour l'écosystème cloud souverain européen.

InfrastructureActu
1 source
Google lance ses TPU v8 et spécialise ses puces pour l’IA : enjeux et comparatif maison
88Next INpact 

Google lance ses TPU v8 et spécialise ses puces pour l’IA : enjeux et comparatif maison

Google a annoncé sa huitième génération de Tensor Processing Units (TPU), ses puces spécialisées dans les calculs d'intelligence artificielle. Pour la première fois dans l'histoire de la gamme, la firme de Mountain View propose deux variantes distinctes basées non plus sur le niveau de performance, mais sur le type d'usage : le TPU v8t, orienté vers l'entraînement des modèles, et le TPU v8i, dédié à l'inférence. C'est une rupture notable avec les générations précédentes, comme les v5e et v5p, qui se différenciaient uniquement par l'efficacité énergétique contre la puissance brute. Cette spécialisation par usage représente un changement de stratégie significatif pour Google. Selon la firme elle-même, "les deux puces peuvent gérer différentes charges de travail, mais la spécialisation permet d'obtenir des gains significatifs". En séparant l'entraînement de l'inférence au niveau matériel, Google cherche à optimiser le rapport performances/coût pour chaque étape du cycle de vie d'un modèle d'IA. Pour les entreprises clientes de Google Cloud, cela se traduit potentiellement par des coûts d'exploitation réduits et une meilleure efficacité dans le déploiement de modèles génératifs à grande échelle. Cette annonce s'inscrit dans une course aux puces IA qui s'est considérablement intensifiée depuis 2018, date des TPU v3. En huit générations, Google a construit une alternative crédible aux GPU de Nvidia, qui dominent encore largement le marché de l'accélération IA. La firme utilise ses TPU en interne pour entraîner ses propres modèles Gemini, ce qui lui confère un avantage compétitif double : maîtrise du hardware et du software. Face à la montée en puissance de concurrents comme les puces Trainium d'Amazon ou les Gaudi d'Intel, la spécialisation des TPU v8 pourrait devenir un argument commercial décisif pour attirer les grandes entreprises vers Google Cloud plutôt que vers AWS ou Azure.

UELes entreprises européennes qui s'appuient sur Google Cloud pour entraîner ou déployer des modèles d'IA pourraient bénéficier d'une réduction des coûts d'exploitation grâce à la spécialisation matérielle des TPU v8.

InfrastructureOpinion
1 source
AutoAdapt : adaptation automatique des grands modèles de langage à des domaines spécifiques
89Microsoft Research 

AutoAdapt : adaptation automatique des grands modèles de langage à des domaines spécifiques

Des chercheurs de Microsoft Research ont publié AutoAdapt, un cadre automatisé destiné à adapter les grands modèles de langage (LLM) à des domaines spécialisés à forts enjeux, comme le droit, la médecine ou la gestion d'incidents cloud. Présenté dans un article intitulé "AutoAdapt: An Automated Domain Adaptation Framework for Large Language Models", le système prend en entrée un objectif défini en langage naturel, des données de domaine et des contraintes pratiques (latence, matériel, budget, confidentialité), puis construit automatiquement un pipeline d'adaptation complet et reproductible. Pour y parvenir, AutoAdapt s'appuie sur trois composants : un graphe de configuration appelé Adaptation Configuration Graph (ACG) qui cartographie l'espace des possibles, un agent planificateur qui sélectionne et séquence les bonnes étapes, et une boucle d'optimisation budgétaire nommée AutoRefine qui affine le résultat dans les limites imposées. L'enjeu est considérable pour les équipes qui déploient des LLM en production. Aujourd'hui, spécialiser un modèle généraliste implique de choisir manuellement entre des approches comme la génération augmentée par récupération (RAG), le fine-tuning supervisé ou des méthodes à efficacité paramétrique comme LoRA, puis d'ajuster des dizaines d'hyperparamètres dans un espace de décision vaste et peu lisible. Ce processus prend des semaines, sans garantie de résultat reproductible. Pour une équipe qui gère une panne critique, un modèle qui dérive de ses exigences de domaine n'est tout simplement pas une option. AutoAdapt transforme ce tâtonnement coûteux en un pipeline exécutable en une fraction du temps, rendant les LLM fiables et prévisibles dans des contextes où les erreurs ont des conséquences réelles. Cette publication s'inscrit dans une tendance de fond qui vise à industrialiser le déploiement des LLM, au-delà de la simple performance sur des benchmarks génériques. Les entreprises qui adoptent ces modèles dans des secteurs régulés ou techniques se heurtent systématiquement au même mur : la spécialisation est longue, chère et fragile. Microsoft Research, qui présente ce travail dans le cadre de son Microsoft Research Forum, positionne AutoAdapt comme une réponse structurée à ce goulot d'étranglement. Le système ouvre la voie à une standardisation des pratiques d'adaptation, là où chaque équipe réinventait jusqu'ici sa propre méthode. La prochaine étape logique sera de voir si ce cadre peut être intégré directement dans des plateformes cloud comme Azure AI Studio, ce qui accélérerait son adoption à grande échelle.

UELes entreprises européennes déployant des LLM dans des secteurs réglementés (santé, droit, finance) pourraient réduire significativement leurs coûts et délais de spécialisation grâce à ce type de framework d'adaptation automatisé.

RecherchePaper
1 source
Gemini tourne désormais sur un serveur isolé du réseau, et s'efface si on coupe le courant
90VentureBeat AI 

Gemini tourne désormais sur un serveur isolé du réseau, et s'efface si on coupe le courant

Cirrascale Cloud Services a annoncé lors du Google Cloud Next 2026 à Las Vegas un accord élargi avec Google Cloud pour déployer le modèle Gemini en mode entièrement déconnecté, sur des serveurs physiques isolés d'internet. Cirrascale devient ainsi le premier fournisseur de cloud spécialisé à proposer le modèle phare de Google sous forme d'appliance privée, installée soit dans les centres de données de Cirrascale, soit directement dans les locaux du client. Le système repose sur un serveur certifié Google, fabriqué par Dell, équipé de huit GPU Nvidia et protégé par des mécanismes de calcul confidentiel. Une préversion est disponible immédiatement, avec une disponibilité générale attendue en juin ou juillet 2026. Dave Driggers, PDG de Cirrascale, a insisté sur un point clé : il s'agit du modèle Gemini complet, sans aucune restriction ni version allégée, déployé dans un environnement où les données d'entrée comme de sortie restent entièrement sous le contrôle du client. Fait notable sur le plan technique, les poids du modèle résident uniquement en mémoire volatile : dès que l'alimentation est coupée, le modèle disparaît sans laisser de trace persistante. Cette annonce répond à un problème structurel qui bloque depuis des années les secteurs régulés comme la finance, la santé, la défense et les administrations publiques. Ces organisations devaient jusqu'ici choisir entre accéder aux modèles les plus puissants via des API cloud publiques, au risque d'exposer leurs données sensibles à l'infrastructure d'un tiers, ou se contenter de modèles open source moins performants hébergés en interne. Le déploiement Cirrascale entend supprimer ce compromis. Driggers décrit l'escalade du problème de confiance : après les inquiétudes sur les données propriétaires confiées aux hyperscalers, les entreprises ont pris conscience que les prompts et les réponses générées étaient également récupérés par ces mêmes plateformes pour alimenter leurs propres systèmes, ce qui a rendu la demande de souveraineté totale incontournable. Cette évolution s'inscrit dans un mouvement plus large de migration des modèles d'IA frontier hors des centres de données des grands hyperscalers, vers les infrastructures propres des clients, ce qui représente une rupture avec la logique cloud dominante de la dernière décennie. Driggers distingue explicitement cette offre des déploiements on-premises proposés par Microsoft Azure avec les modèles OpenAI ou par AWS Outposts : dans ces cas, les modèles restent liés à l'infrastructure de leurs éditeurs. Ici, Google ne possède pas le matériel, et son modèle fonctionne en dehors de tout réseau Google. Pour le géant de Mountain View, accepter ce niveau de délégation sur son modèle le plus avancé traduit une stratégie commerciale claire : conquérir les marchés réglementés qui lui étaient jusqu'ici fermés, quitte à renoncer au contrôle direct de l'inférence.

UECe mode de déploiement air-gap répond directement aux exigences du RGPD et de l'AI Act en matière de souveraineté des données, ouvrant potentiellement Gemini aux administrations publiques, établissements de santé et institutions financières européennes soumis à des contraintes strictes de localisation et d'isolation des données.

💬 Le truc des poids uniquement en mémoire volatile, c'est la partie que je trouve la plus maligne. Parce que le blocage dans les secteurs régulés c'était pas juste "mes données sortent du réseau", c'était aussi "quelqu'un peut extraire ou copier le modèle", et là, coupe l'alimentation, ça disparaît. Google accepte de perdre le contrôle de l'inférence de son meilleur modèle pour aller chercher des marchés qui lui étaient fermés depuis des années. Ça, c'est un vrai mouvement.

InfrastructureOpinion
1 source
Les entreprises surestiment leur contrôle sur l'IA : 72 % ne sont pas aussi sécurisées qu'elles le croient
91VentureBeat AI 

Les entreprises surestiment leur contrôle sur l'IA : 72 % ne sont pas aussi sécurisées qu'elles le croient

Dans 72 % des entreprises interrogées, les décideurs affirment utiliser au moins deux plateformes d'intelligence artificielle qu'ils considèrent comme leur couche "primaire", selon une enquête menée par VentureBeat auprès de 40 grandes entreprises entre janvier et mars 2026. Ce chiffre révèle un écart béant entre la perception du contrôle et la réalité opérationnelle. L'exemple le plus frappant vient du système hospitalier Mass General Brigham (MGB), plus grand employeur du Massachusetts avec 90 000 salariés : l'an dernier, son directeur technique Nallan Sriraman a dû stopper un nombre incontrôlé de projets pilotes internes en IA qui avaient proliféré sans supervision. MGB a depuis construit une plateforme sécurisée maison autour de Microsoft Copilot, capable de supporter jusqu'à 30 000 utilisateurs, pour empêcher que les données de santé protégées (PHI) des patients ne soient transmises au fournisseur du modèle sous-jacent, OpenAI. En parallèle, l'hôpital doit bâtir un "plan de contrôle" central pour orchestrer les agents IA déployés séparément par Epic, Workday et ServiceNow, qui fonctionnent tous différemment. Ce phénomène de dispersion, que VentureBeat nomme "gouvernance mirage", traduit une contradiction structurelle : les entreprises croient avoir mis en place une gouvernance solide alors qu'elles n'ont défini ni responsabilités claires, ni garde-fous précis, ni processus d'évaluation ou de sécurité réels. Pour les responsables de la sécurité en particulier, cette multiplicité de plateformes, issues de Microsoft Azure, Google, OpenAI, Anthropic ou d'éditeurs applicatifs, élargit mécaniquement la surface d'attaque, à un moment où les cyberattaques assistées par IA gagnent en sophistication. Le paradoxe est d'autant plus aigu que les entreprises se sont tournées vers leurs grands fournisseurs logiciels existants pour éviter de dupliquer les efforts, mais se retrouvent malgré tout contraintes de construire autour de leurs lacunes. Ce contexte reflète la vitesse à laquelle les hyperscalers et les grands éditeurs ont intégré l'IA dans leurs offres, forçant leurs clients entreprise à absorber une complexité non anticipée. Comme l'explique Sriraman avec l'analogie des "six aveugles et l'éléphant", chaque fournisseur décrit l'IA à sa façon, rendant toute vision cohérente difficile à construire. Le marché reste "encore naissant", selon ses termes, ce qui rend les décisions stratégiques particulièrement hasardeuses. La prochaine étape pour des organisations comme MGB sera de stabiliser ces plans de contrôle multi-agents tout en attendant que les fournisseurs mûrissent leurs propres capacités de sécurité, un pari sur un calendrier que personne ne maîtrise vraiment.

UELes entreprises européennes soumises aux obligations de conformité de l'AI Act sont particulièrement exposées à ce risque de 'gouvernance mirage', où un écart entre gouvernance déclarée et réalité opérationnelle pourrait constituer une non-conformité réglementaire.

SécuritéActu
1 source
Google et le Pentagone discutent d'un accord IA classifié, l'entreprise renouant avec le secteur militaire
92The Information AI 

Google et le Pentagone discutent d'un accord IA classifié, l'entreprise renouant avec le secteur militaire

Google est en négociation avec le Département de la Défense américain pour un accord qui permettrait au Pentagone de déployer les modèles d'intelligence artificielle Gemini dans des environnements classifiés. L'information, révélée par deux personnes ayant une connaissance directe des discussions, indique que les deux parties envisagent un contrat autorisant l'utilisation de l'IA de Google pour l'ensemble des usages légaux au sein des forces armées américaines. Selon l'une de ces sources, Google aurait proposé d'inclure dans le contrat des clauses restrictives visant à empêcher que ses modèles soient utilisés pour de la surveillance de masse intérieure ou pour des systèmes d'armes autonomes, notamment le ciblage, sans supervision humaine "appropriée". Cet accord marquerait un tournant majeur dans la relation entre Google et le secteur militaire. L'entreprise deviendrait un contractant technologique significatif du Pentagone, avec un accès potentiel à des infrastructures classifiées, un niveau d'engagement rarement atteint dans l'industrie tech civile. Pour l'armée américaine, intégrer Gemini dans des environnements sécurisés ouvrirait la voie à des capacités d'analyse, de traitement du renseignement et de prise de décision assistée par IA à une échelle et une vitesse sans précédent. Les garde-fous proposés par Google, bien que symboliquement importants, restent formulés de façon vague, notamment autour de la notion de contrôle humain "approprié", ce qui laisse une marge d'interprétation considérable. Ce rapprochement s'inscrit dans un renversement de position spectaculaire pour Google. En 2018, face à une fronde interne massive de ses employés, l'entreprise avait abandonné le projet Maven, un contrat avec le Pentagone portant sur l'analyse d'images de drones par IA, et s'était engagée à ne pas développer d'IA à usage militaire offensif. Depuis, la concurrence acharnée avec Microsoft, qui fournit déjà des services cloud et d'IA à l'armée via Azure et ses partenariats avec OpenAI, ainsi que la pression des actionnaires ont poussé Google à reconsidérer cette posture. La course aux contrats gouvernementaux dans le domaine de l'IA est désormais un enjeu stratégique majeur pour l'ensemble des grandes entreprises technologiques américaines.

UECe rapprochement militaro-technologique américain pourrait accélérer les débats européens sur la souveraineté technologique et l'encadrement de l'IA dans la défense.

BusinessActu
1 source
Gemini 3.1 Flash TTS : prenez les commandes de l’émotion grâce aux balises audio
93Le Big Data 

Gemini 3.1 Flash TTS : prenez les commandes de l’émotion grâce aux balises audio

Google a lancé le 15 avril 2026 Gemini 3.1 Flash TTS, son nouveau modèle de synthèse vocale conçu pour donner aux créateurs un contrôle fin sur le rendu émotionnel des voix générées. La principale nouveauté réside dans l'introduction des balises audio, des commandes en langage naturel intégrées directement dans le texte pour piloter le rythme, l'intonation et le style vocal phrase par phrase. Concrètement, un développeur peut indiquer dans sa requête qu'un passage doit être prononcé avec "excitation" ou de manière "explicative", et le modèle adapte sa synthèse en conséquence. Le modèle prend en charge plus de 70 langues, dont 24 bénéficient d'une qualité dite premium, parmi lesquelles l'hindi, le japonais et l'allemand. Il est déjà intégré dans Google Vids, la Gemini API et Google AI Studio, et inclut le watermarking SynthID sur tous les outputs. Cette capacité à sculpter la voix par instructions textuelles représente un changement de paradigme pour les producteurs de contenu audio et les équipes de développement. Jusqu'ici, les modèles TTS généraient une voix uniforme, difficile à différencier selon le contexte ou le ton voulu. Avec Gemini 3.1 Flash TTS, les entreprises qui produisent des podcasts automatisés, des assistants vocaux, des vidéos pédagogiques ou des expériences de narration interactive peuvent adapter le rendu vocal sans post-production manuelle. La couverture multilingue avec maintien de la cohérence émotionnelle ouvre aussi la voie à des déploiements localisés à grande échelle, un enjeu crucial pour les acteurs globaux qui ne peuvent pas se permettre de perdre en expressivité lors du passage d'une langue à l'autre. Cette annonce s'inscrit dans une course intense entre les grands acteurs de l'IA générative pour dominer le segment de la voix. OpenAI a lancé ses propres capacités TTS via l'API et ses modèles de voix en temps réel, ElevenLabs a consolidé sa position sur le marché des créateurs, et Microsoft intègre des fonctions similaires dans Azure Cognitive Services. Google, avec DeepMind en soutien, mise sur l'intégration native dans son écosystème existant, Google Vids, AI Studio, pour accélérer l'adoption sans friction. Le fait que Gemini 3.1 Flash TTS soit directement accessible via la Gemini API suggère une stratégie orientée développeurs d'abord, avant un éventuel déploiement grand public. Les prochaines étapes probables incluent une extension des langues premium, un affinement des balises disponibles et une intégration dans NotebookLM ou d'autres outils de productivité Google déjà très utilisés.

UELes développeurs et producteurs de contenu européens peuvent intégrer dès maintenant des capacités TTS émotionnelles multilingues via la Gemini API, ouvrant la voie à des déploiements localisés à grande échelle sans post-production vocale manuelle.

CréationOpinion
1 source
« L’IA va nous détruire » : le manifeste du premier terroriste anti-ChatGPT
94Le Big Data 

« L’IA va nous détruire » : le manifeste du premier terroriste anti-ChatGPT

Un homme a lancé un cocktail Molotov contre la résidence de Sam Altman, PDG d'OpenAI, située au 950 Lombard Street à San Francisco, dans le quartier de Russian Hill, une propriété estimée à 27 millions de dollars. L'attaque, survenue début avril 2026, s'inscrit dans le cadre d'un manifeste de 45 pages intitulé « La Dernière Résistance Humaine », diffusé sur X et 4chan, qui appelle au sabotage physique des centres de données et à la destruction des infrastructures d'intelligence artificielle générative. L'assaillant, radicalisé par les thèses néo-luddites, a été placé en garde à vue. Le manifeste identifie 12 sites critiques aux États-Unis, principalement en Californie et en Oregon, hébergeant des clusters de processeurs H100 de Nvidia, et réclame l'arrêt immédiat de l'entraînement de modèles comme GPT-5 ainsi que le démantèlement des infrastructures Microsoft Azure. Le FBI et le Department of Homeland Security classent désormais les extrémistes anti-technologie comme une menace prioritaire. Cet acte marque un tournant dans la perception des risques liés au développement de l'IA : pour la première fois, la violence physique ciblée contre des dirigeants tech s'organise autour d'une idéologie structurée et d'une liste de cibles précises. L'onde de choc a immédiatement atteint les investisseurs de Y Combinator et les dirigeants de Google DeepMind. OpenAI a multiplié son budget sécurité par cinq, déployant un blindage balistique de niveau NIJ III sur les vitres du domicile d'Altman et une garde rapprochée composée d'anciens Navy SEALs, pour un coût supérieur à 800 000 dollars par mois. Des algorithmes de surveillance des forums radicaux ont également été activés. La menace dépasse le cas individuel : elle interroge la capacité des entreprises d'IA à protéger leurs dirigeants et infrastructures dans un climat de défiance croissante. La rhétorique du manifeste est paradoxale : son auteur cite les propres avertissements de Sam Altman et du prix Nobel Geoffrey Hinton sur les risques existentiels de l'intelligence artificielle générale pour légitimer le recours à la violence. Ce retournement sémantique rappelle la trajectoire de Theodore Kaczynski, l'Unabomber, dont le manifeste fut publié par le New York Times en 1995 après une campagne d'attentats contre des universitaires et des compagnies aériennes. Là où les luddites du XIXe siècle s'en prenaient aux métiers à tisser pour protéger leurs emplois, et où Kaczynski visait la société industrielle en général, ce nouveau mouvement cible spécifiquement les architectes des grands modèles de langage et les GPU qui les font tourner. L'analyse de CrowdStrike confirme que le document circule dans des réseaux cryptés et pourrait inspirer des actes similaires, faisant basculer le débat sur les risques de l'IA du registre académique vers celui de la sécurité nationale.

UEL'émergence d'un mouvement néo-luddite violent aux États-Unis pourrait inspirer des actes similaires en Europe, contraignant les entreprises et infrastructures d'IA européennes à renforcer leur sécurité physique.

💬 On savait que la tension montait, mais là on a franchi un cap. Ce qui est glaçant, c'est pas l'acte en lui-même, c'est le manifeste : 45 pages structurées, une liste de 12 cibles précises, une idéologie qui recycle les propres mots d'Altman pour justifier la violence. C'est plus un dérangé isolé, c'est le début d'une doctrine.

SécuritéOpinion
1 source
95VentureBeat AI 

Claude Managed Agents d'Anthropic offre aux entreprises un guichet unique mais soulève un risque de dépendance fournisseur

Anthropic a lancé la semaine dernière une nouvelle plateforme baptisée Claude Managed Agents, destinée aux entreprises souhaitant déployer des agents IA sans se confronter aux complexités techniques habituelles de l'orchestration. Selon Anthropic, la plateforme permet de passer d'un déploiement en semaines ou en mois à quelques jours seulement, en gérant nativement la définition des tâches, des outils et des garde-fous, ainsi que l'exécution des graphes d'état, le routage, la gestion des permissions et le traçage de bout en bout. Des données directionnelles de VentureBeat portant sur plusieurs dizaines d'entreprises au premier trimestre 2026 montrent par ailleurs que l'adoption des API d'orchestration native d'Anthropic est passée de 0 % à 5,7 % entre janvier et février, sur des panels respectifs de 56 et 70 organisations de plus de 100 employés. Microsoft Copilot Studio et Azure AI Studio restaient en tête avec 38,6 % des répondants en février, suivis d'OpenAI à 25,7 %. L'enjeu concret pour les entreprises est double. D'un côté, Claude Managed Agents promet de supprimer la couche d'orchestration externe, sandboxing, checkpointing, gestion des credentials, traçabilité, en l'absorbant directement dans le modèle. C'est un gain de vitesse et de simplicité réel pour des équipes déjà saturées par la multiplication des agents. De l'autre, cela implique de confier les données de session à une base gérée par Anthropic et de laisser l'exécution des agents se dérouler dans un environnement que l'entreprise ne contrôle pas pleinement. Le comportement des agents devient plus difficile à garantir, et les organisations s'exposent à des instructions contradictoires si leur seul levier de contrôle reste le prompting contextuel. Cette sortie s'inscrit dans une course à l'orchestration qui s'intensifie à mesure que les entreprises industrialisent leurs workflows agentiques. Anthropic, porté notamment par l'essor de Claude Code au cours de l'année écoulée, tente ainsi d'élargir son empreinte au-delà de la fourniture de modèles fondamentaux pour devenir le runtime de référence des agents d'entreprise. La stratégie ressemble à celle des grandes plateformes SaaS : créer un écosystème suffisamment intégré pour devenir difficile à quitter. C'est précisément ce que beaucoup d'entreprises espéraient éviter en adoptant l'IA, après avoir déjà subi les effets du lock-in avec leurs fournisseurs logiciels traditionnels. La question qui se pose désormais est de savoir si la promesse de simplicité et de rapidité justifie cette dépendance accrue à un fournisseur unique, et si les concurrents comme Microsoft ou OpenAI proposeront rapidement des alternatives comparables.

UELes entreprises européennes qui adoptent Claude Managed Agents s'exposent à un risque de dépendance fournisseur accru, sans cadre contractuel ou réglementaire spécifique encadrant la souveraineté des données de session confiées à Anthropic.

OutilsOpinion
1 source
OpenAI tacle Microsoft : l’alliance avec Amazon devient la nouvelle priorité stratégique
96Le Big Data 

OpenAI tacle Microsoft : l’alliance avec Amazon devient la nouvelle priorité stratégique

OpenAI vient de franchir une étape symbolique dans sa stratégie commerciale : selon une note interne de Denise Dresser, directrice des revenus de l'entreprise, le partenariat signé avec Amazon représente désormais un moteur de croissance prioritaire pour le segment enterprise. Ce partenariat, annoncé il y a moins de deux mois et adossé à un engagement financier d'Amazon de 50 milliards de dollars, s'appuie sur AWS Bedrock, la plateforme cloud qui permet aux entreprises d'accéder à plusieurs modèles d'IA dont ceux d'OpenAI. Dans la même note, Dresser reconnaît explicitement que l'alliance historique avec Microsoft, qui a investi plus de 13 milliards de dollars depuis 2019, « restreint » désormais la capacité d'OpenAI à répondre aux besoins du marché. Le segment enterprise représente déjà 40 % du chiffre d'affaires d'OpenAI, et la demande enregistrée depuis l'intégration via Bedrock est décrite comme « stupéfiante ». Ce pivotement stratégique a des conséquences directes pour les clients entreprises et pour l'ensemble de l'industrie cloud. En permettant l'accès à ses modèles via AWS plutôt qu'exclusivement via Azure, OpenAI s'aligne sur les infrastructures déjà en place chez la majorité de ses clients B2B, levant ainsi un frein concret à l'adoption. La flexibilité offerte par Bedrock, présentée comme une couche d'accès plus ouverte que l'écosystème Microsoft, répond à une demande réelle du marché. Pour OpenAI, l'enjeu est aussi défensif : Anthropic, avec son modèle Claude, a enregistré un chiffre d'affaires annualisé supérieur à 30 milliards de dollars et gagne rapidement du terrain dans les entreprises, au point d'avoir généré ce qu'on a appelé la « Claudemania » lors de la conférence HumanX à San Francisco. La relation entre OpenAI et Microsoft se dégrade donc progressivement depuis mi-2024, date à laquelle Microsoft a officiellement classé OpenAI parmi ses concurrents dans son rapport annuel, aux côtés d'Amazon, Google et Meta. Redmond développe en parallèle ses propres modèles d'IA et renforce Copilot, réduisant mécaniquement sa dépendance à son ancien partenaire exclusif. OpenAI, de son côté, diversifie déjà ses fournisseurs de calcul vers Oracle, Google et CoreWeave. Ce décroisement progressif dessine une nouvelle carte du pouvoir dans l'IA enterprise : des alliances moins exclusives, plus pragmatiques, dictées par la présence réelle des clients dans les écosystèmes cloud. La bataille pour le marché B2B de l'IA n'en est qu'à ses débuts, et chaque géant repositionne ses pièces en conséquence.

UELes entreprises européennes déjà hébergées sur AWS peuvent désormais accéder aux modèles OpenAI via Bedrock sans migration vers Azure, réduisant concrètement le frein à l'adoption de l'IA dans les environnements cloud existants.

💬 Microsoft a mis 13 milliards sur la table depuis 2019 et se retrouve aujourd'hui listé comme concurrent dans les rapports annuels d'OpenAI, c'est assez symptomatique de la vitesse à laquelle les alliances se déconstruisent dans ce secteur. Le fond du sujet, c'est que les clients enterprise sont déjà sur AWS, pas sur Azure, et OpenAI a visiblement décidé d'aller là où se trouvent les deals plutôt que de défendre une exclusivité qui lui coûte des contrats. La pression de Claude en arrière-plan accélère tout ça.

BusinessOpinion
1 source
Nebius en discussions pour racheter la startup israélienne AI21 après l'échec des négociations avec Nvidia
97The Information AI 

Nebius en discussions pour racheter la startup israélienne AI21 après l'échec des négociations avec Nvidia

Nebius, fournisseur cloud soutenu par Nvidia et valorisé à 32 milliards de dollars, est en discussions pour racheter la startup israélienne AI21 Labs, selon des sources proches du dossier. La société, basée à Amsterdam, cherche à élargir ses services d'intelligence artificielle au-delà de son activité principale de location de serveurs GPU. AI21 Labs, dont la dernière valorisation connue était de 1,4 milliard de dollars en 2023, développe des grands modèles de langage et des systèmes d'agents pour les entreprises. Ce rachat potentiel permettrait à Nebius de monter dans la chaîne de valeur de l'IA, en passant de simple infrastructure à fournisseur de solutions logicielles complètes. Pour ses clients, cela signifierait un accès intégré à des modèles et outils d'IA directement via la plateforme cloud, sans passer par des tiers. Pour AI21 Labs, une acquisition représente une issue après l'échec d'une précédente tentative de vente à Nvidia, qui ne s'était pas concrétisée. AI21 Labs fait partie de la première vague de startups israéliennes spécialisées en IA générative, concurrente directe d'OpenAI et Anthropic sur le segment entreprise. La startup avait levé des fonds auprès d'investisseurs majeurs dont Google, Intel Capital et Nvidia lui-même. Le secteur cloud connaît une consolidation accélérée, les fournisseurs d'infrastructure cherchant à intégrer verticalement des capacités IA pour fidéliser leurs clients face à la concurrence d'AWS, Azure et Google Cloud.

UENebius étant basée à Amsterdam, ce rachat potentiel renforcerait la position d'un acteur cloud ancré en Europe dans la chaîne de valeur de l'IA générative enterprise.

BusinessActu
1 source
Manipulateur, sociopathe : qui est vraiment le patron de ChatGPT ?
98Le Big Data 

Manipulateur, sociopathe : qui est vraiment le patron de ChatGPT ?

Une enquête publiée par le New Yorker le 6 avril 2026, signée par les journalistes Ronan Farrow et Andrew Marantz, dresse un portrait sévère de Sam Altman, PDG d'OpenAI. Basée sur des mémos internes inédits et plus de 200 pages de documents, l'enquête compile des témoignages d'anciens collaborateurs qui décrivent un dirigeant au profil atypique : non pas un ingénieur visionnaire, mais un stratège de la persuasion. Altman dirige une entreprise valorisée près de 1 000 milliards de dollars, et son influence sur le secteur de l'intelligence artificielle est considérable. Pourtant, plusieurs sources lui reprochent un rapport très flexible à la vérité : renégociation d'accords après coup, déni d'engagements pourtant documentés, reformulation des faits selon les circonstances. Un ancien collaborateur décrit un effet "Jedi", une capacité à faire croire à chaque interlocuteur que la vision d'Altman est en réalité la sienne. L'impact de ces révélations dépasse le simple portrait de dirigeant. OpenAI occupe une position centrale dans le développement de l'IA mondiale, et la question de sa gouvernance touche directement à la confiance que lui accordent partenaires, régulateurs et utilisateurs. Le cas de Dario Amodei, ancien cadre d'OpenAI devenu PDG d'Anthropic, est particulièrement éloquent : lors des négociations avec Microsoft en 2019, des garanties strictes en matière de sécurité auraient été validées, avant qu'une clause clé ne soit discrètement modifiée. Altman aurait ensuite nié l'existence de ce changement malgré des preuves écrites. Microsoft, principal investisseur d'OpenAI, aurait également subi des revirements similaires : alors qu'OpenAI réaffirmait publiquement l'exclusivité de Azure comme fournisseur cloud, l'entreprise annonçait en parallèle un partenariat avec Amazon sur sa plateforme Frontier dédiée aux agents IA. Ce double discours érode la confiance des partenaires et brouille la lisibilité stratégique d'une entreprise dont chaque mouvement est scruté à l'échelle mondiale. Ces tensions s'inscrivent dans un contexte plus large de questionnement sur la gouvernance d'OpenAI. En novembre 2023, le conseil d'administration avait temporairement évincé Altman avant de le réintégrer sous pression des employés et des investisseurs, révélant déjà des fractures profondes. La conversion d'OpenAI d'organisation à but non lucratif en entreprise commerciale alimente les doutes sur la sincérité de ses engagements éthiques. Le terme "sociopathe" revient dans plusieurs témoignages, ce qui illustre la violence des jugements portés en interne. Altman, lui, continue de se présenter comme un acteur responsable de la transition vers l'IA générale. La question qui traverse toute l'enquête est finalement celle-ci : peut-on bâtir une technologie civilisationnelle en s'appuyant sur un leadership dont la méthode principale est la manipulation, même brillante ?

UELes révélations sur la gouvernance d'OpenAI pourraient renforcer la méfiance des régulateurs européens et compliquer les négociations de conformité dans le cadre de l'AI Act.

BusinessActu
1 source
Nvidia et des startups s'affrontent pour rendre OpenClaw plus sûr
99The Information AI 

Nvidia et des startups s'affrontent pour rendre OpenClaw plus sûr

Nvidia, des startups comme Perplexity et Genspark s'activent pour proposer des versions sécurisées d'OpenClaw, le logiciel open-source populaire pour agents IA personnels, après plusieurs incidents de sécurité embarrassants — dont la suppression massive d'e-mails de la directrice d'alignement de Meta, Summer Yue. En Chine, des agences gouvernementales ont déjà interdit l'installation d'OpenClaw sur les appareils professionnels. Genspark lance notamment Genspark Claw, qui isole l'agent dans une machine virtuelle cloud (Microsoft Azure) pour contenir les dommages potentiels, à 80 ou 140 $/mois selon Wen Sang, co-fondateur et COO.

SécuritéActu
1 source
Anthropic veut imposer Claude aux entreprises avec sa marketplace
100Le Big Data 

Anthropic veut imposer Claude aux entreprises avec sa marketplace

Anthropic lance l'Anthropic Marketplace, une plateforme permettant aux entreprises clientes d'utiliser leur budget API existant pour acheter des logiciels de partenaires comme Snowflake, Harvey et Replit, sans multiplier les contrats séparés. Contrairement aux marketplaces cloud d'AWS ou Azure, Anthropic ne prélève aucune commission sur les ventes, misant sur la fidélisation plutôt que sur les revenus directs. Ce lancement intervient dans un contexte tendu : le Pentagone vient de classer Anthropic comme risque pour sa chaîne d'approvisionnement, compliquant ses relations avec certaines organisations liées au ministère de la Défense.

BusinessActu
1 source