Aller au contenu principal

Dossier Microsoft — page 5

1370 articles · page 5 sur 28

Microsoft et l'IA : Copilot, l'intégration d'OpenAI dans Azure et Office, les modèles maison et les annonces produits suivies au fil de l'actualité.

201Latent Space LLMsActu

Le compagnon IA de Superapp franchit un nouveau million d'utilisateurs

Les usages d'agents de codage d'OpenAI connaissent une croissance inhabituelle : Sam Altman a indiqué que l'utilisation de Codex et de ChatGPT Work a été multipliée par 2,5 en une semaine, ajoutant que la demande pour GPT-5.6 Sol est si forte qu'elle pourrait provoquer des tensions sur l'infrastructure le temps que la capacité suive. JetBrains a fait de Codex son agent recommandé, tandis que LangChain a ajouté le traçage de Codex dans LangSmith avant de l'étendre à Cursor, Copilot, Pi et OpenCode, exposant les appels d'outils, les sous-agents et la consommation de tokens. Côté modèles ouverts, PrismML a publié Bonsai 27B, basé sur Qwen 3.6 27B, en deux versions compressées : une variante ternaire de 5,9 Go (1,71 bit effectif) et une variante à 1 bit de 3,9 Go (1,125 bit effectif), toutes deux sous licence Apache 2.0. Tencent a de son côté publié Hy3, un modèle de 295 milliards de paramètres disponible en versions 1 bit et 4 bits, capable de tourner sur un seul GPU via llama.cpp. Enfin, le laboratoire OpenMOSS a présenté MOSS-VL-Realtime, une famille de modèles vision-langage de 11 milliards de paramètres à contexte de 256 000 tokens, conçue pour analyser des flux vidéo en continu. Ces annonces marquent un changement de nature dans l'IA appliquée au travail quotidien des développeurs et des entreprises. La croissance explosive de Codex montre que les agents de codage passent du statut de gadget expérimental à celui d'outil de production utilisé à grande échelle, ce qui pousse tout l'écosystème, éditeurs comme JetBrains ou plateformes d'observabilité comme LangSmith, à s'adapter en urgence pour suivre, tracer et fiabiliser ces usages. La compression extrême de modèles comme Bonsai 27B ou Hy3 change aussi la donne pour les utilisateurs individuels : des modèles proches de la frontière technologique peuvent désormais tourner sur une carte graphique grand public, voire sur un téléphone, sans dépendre du cloud. Cela ouvre la voie à des workflows agentiques locaux plus rapides, plus privés et moins coûteux, un enjeu majeur pour les professionnels et les entreprises soucieuses de confidentialité des données. Ces évolutions s'inscrivent dans une course plus large entre les grands laboratoires d'IA et les acteurs open source pour dominer les usages professionnels réels, au-delà des simples benchmarks. La qualité des harnais d'agents, c'est-à-dire la manière dont un modèle est encadré, tracé et corrigé en production, devient un facteur de différenciation aussi important que la qualité brute du modèle lui-même, comme l'ont souligné plusieurs commentateurs du secteur. Parallèlement, la quantification agressive et les architectures multimodales en temps réel, capables de regarder une vidéo en continu et de réagir aux changements de scène, annoncent une nouvelle génération d'assistants capables d'agir et de percevoir en continu plutôt que de simplement répondre à des requêtes ponctuelles.

1 source
Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement
202Next INpact 

Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement

Anthropic a annoncé le 30 juin le retour de Mythos 5, suivi de Fable 5 dès le 1er juillet, mettant fin à un épisode de trois semaines qui a fragilisé l'entreprise face à la concurrence chinoise des modèles à poids ouvert. Les faits remontent au 9 juin 2026, date de lancement de Claude Fable 5, version publique et encadrée de l'architecture Mythos, tandis que Mythos 5, dépourvue de ces garde-fous, restait réservée aux organisations vérifiées via le programme Glasswing. Trois jours plus tard, le 12 juin, le secrétaire au Commerce Howard Lutnick a adressé à Anthropic une directive de contrôle des exportations exigeant la suspension immédiate de l'accès aux deux modèles pour tout ressortissant étranger dans le monde, y compris les propres employés étrangers de l'entreprise. Incapable de filtrer ses utilisateurs par nationalité en temps réel, Anthropic a coupé l'accès sur Claude.ai, son API, AWS Bedrock, Google Cloud et Microsoft Foundry. Le 26 juin, Washington a autorisé un retour partiel de Mythos 5 pour une centaine d'organisations liées aux infrastructures critiques et à la cyberdéfense, laissant Fable 5 hors service jusqu'à ce 1er juillet. Cet épisode illustre la fragilité des positions commerciales face à des décisions politiques soudaines : des centaines de millions d'utilisateurs à travers le monde se sont retrouvés privés d'accès du jour au lendemain, et les entreprises clientes de l'API ou des plateformes cloud partenaires ont dû composer avec plusieurs semaines d'incertitude. Pendant ce temps, les modèles chinois à poids ouvert ont continué de progresser, profitant du retrait temporaire d'un concurrent majeur. L'image d'Anthropic sort également écornée, des rumeurs de surveillance d'utilisateurs chinois étant venues s'ajouter à la confusion entourant cette affaire. Le fond du dossier reste flou. Selon Anthropic, la lettre reçue ne détaillait pas la menace précise pour la sécurité nationale, mais l'entreprise a compris que le gouvernement avait eu vent d'une méthode permettant de contourner les protections de Fable 5, en lui demandant par exemple d'analyser une base de code donnée pour en corriger les failles. Des rumeurs, invérifiables, ont même évoqué un modèle capable de mettre à mal les défenses de la NSA. Anthropic conteste la proportionnalité de la mesure, rappelant que des tests menés avec le gouvernement américain, l'AISI britannique et des tiers n'avaient révélé aucun jailbreak universel, et que le niveau de capacité en cause était comparable à celui de GPT-5.5 d'OpenAI. L'épisode relance ainsi le débat sur l'équilibre entre sécurité nationale et compétitivité de l'industrie américaine de l'IA face à la Chine.

UELes entreprises et developpeurs europeens utilisant l'API Claude via AWS Bedrock, Google Cloud ou Microsoft Foundry ont subi plusieurs semaines de coupure d'acces a Mythos 5 et Fable 5, sans qu'aucune decision reglementaire europeenne n'en soit la cause.

💬 Ce qui frappe, c'est la vitesse à laquelle une boîte peut se retrouver à genoux à cause d'une lettre de Washington, pas d'un bug ou d'un concurrent. Anthropic a coupé l'accès à Fable 5 dans le monde entier pendant trois semaines sur simple injonction, pendant que les modèles chinois à poids ouvert avançaient tranquillement. Le vrai enseignement de cet épisode : la sécurité nationale américaine est en train de devenir un facteur de compétitivité aussi déterminant que la puissance des modèles eux-mêmes, et ça peut jouer contre les boîtes américaines autant que pour elles.

RégulationReglementation
1 source
Google Meet laisse maintenant Gemini prendre des notes à votre place pendant vos appels
203Le Big Data 

Google Meet laisse maintenant Gemini prendre des notes à votre place pendant vos appels

Google intègre désormais Gemini dans Google Meet pour automatiser la prise de notes lors des visioconférences. La fonctionnalité, en cours de déploiement progressif, permet à l'assistant d'écouter les échanges en temps réel, d'identifier les points clés, les décisions prises et les prochaines étapes évoquées pendant l'appel. Un compte rendu structuré est ensuite généré automatiquement dans un document Google Docs enregistré sur le Drive de l'utilisateur, accompagné d'un e-mail récapitulatif envoyé à la fin de la réunion. Pour l'activer, il suffit de cliquer sur l'icône en forme de crayon dans l'interface Meet, ou de configurer l'option directement depuis les paramètres. La transparence est imposée par défaut : dès que Gemini prend la main, tous les participants reçoivent une notification visible. La fonctionnalité est réservée aux abonnés Google AI Pro, Google AI Ultra et à certains clients Google Workspace éligibles, avec une disponibilité linguistique encore limitée mais appelée à s'élargir. L'enjeu pratique est immédiat pour les professionnels dont les journées s'enchaînent en réunions : ne plus avoir à arbitrer entre suivre la conversation et capturer l'information en direct. En déléguant cette tâche à l'IA, Google cherche à réduire la charge cognitive des participants et à améliorer la qualité d'attention pendant les appels. La génération automatique des actions à mener représente également un gain de temps en aval, en évitant de relire des transcriptions brutes pour en extraire les engagements pris. Pour les équipes distribuées ou les organisations fortement dépendantes des outils Google Workspace, l'intégration native dans l'écosystème Drive et Gmail renforce l'attractivité du dispositif sans friction d'adoption supplémentaire. Cette annonce s'inscrit dans une stratégie d'intégration accélérée de Gemini à travers l'ensemble des produits Google, observable depuis le début de l'année 2025. Google concurrence frontalement Microsoft, qui déploie Copilot dans Teams avec des fonctionnalités comparables, et Zoom, qui a lancé ses propres outils de synthèse IA. La course à l'assistant de réunion intelligent est devenue un terrain central pour fidéliser les entreprises dans leurs écosystèmes cloud respectifs. La question de la confidentialité reste néanmoins structurante : l'obligation de notifier tous les participants signale que Google anticipe les résistances liées à l'enregistrement et à l'analyse automatique de conversations professionnelles. Le déploiement par paliers, d'abord réservé aux abonnés premium, laisse entendre que la fonctionnalité pourrait être étendue à terme à une base d'utilisateurs plus large, selon l'adoption et les retours terrain.

UEL'intégration de Gemini dans Google Meet soulève des questions de conformité RGPD pour les entreprises européennes utilisant Google Workspace, notamment concernant l'enregistrement et l'analyse automatique de conversations professionnelles.

OutilsOutil
1 source
Gemini s’invite dans Google Play pour trier les applis à votre place
204Le Big Data 

Gemini s’invite dans Google Play pour trier les applis à votre place

Google a intégré son assistant Gemini directement au Play Store, permettant aux utilisateurs Android de rechercher des applications via une conversation naturelle sans ouvrir la boutique. Concrètement, une extension relie les deux services : l'utilisateur formule sa demande dans l'interface de Gemini, qui analyse la requête et propose une sélection d'applications correspondantes. Un clic sur l'icône choisie redirige vers la fiche Play Store classique, où l'installation reste une action manuelle. L'assistant peut également afficher l'historique des achats intégrés dans une application donnée, et préparer un parcours d'achat pour des cartes-cadeaux Google Play, là encore sans finaliser la transaction de façon autonome. L'accès requiert d'être majeur, de posséder un appareil Android avec l'application Gemini connectée à un compte Google personnel, et d'avoir activé l'option "Conserver l'activité" dans les paramètres Gemini. La disponibilité reste progressive selon les pays et les appareils. Cette intégration change la façon dont des millions d'utilisateurs Android vont découvrir des applications. La recherche textuelle classique dans le Play Store suppose de connaître le nom ou la catégorie exacte d'une appli ; Gemini permet de formuler un besoin flou ("je cherche quelque chose pour gérer mes finances en déplacement") et d'obtenir une sélection pertinente. Pour Google, l'enjeu est double : augmenter le taux de découverte d'applications sur sa boutique et renforcer l'utilité perçue de Gemini dans le quotidien des utilisateurs. Le fait que l'assistant puisse désormais se rapprocher du portefeuille, via les suggestions d'achats et de cartes-cadeaux, représente aussi une opportunité commerciale non négligeable pour l'entreprise. Cette fonctionnalité s'inscrit dans la stratégie plus large de Google visant à faire de Gemini le point d'entrée central de l'écosystème Android, au détriment de l'architecture en silos d'applications séparées. Depuis le lancement de Gemini en 2024 en remplacement de Google Assistant, le groupe cherche à démontrer une valeur ajoutée concrète face à des concurrents comme ChatGPT d'OpenAI ou Copilot de Microsoft, qui intègrent eux aussi des capacités d'action sur des services tiers. L'extension Play Store rejoint un écosystème d'intégrations qui devrait s'élargir, Google ayant indiqué que l'offre d'applications et de fonctions continuera à s'étoffer. La vraie question à terme est celle de la neutralité algorithmique : une barre de recherche renvoie des résultats, un assistant en recommande, et les critères de sélection de Gemini restent, pour l'instant, opaques.

UELes utilisateurs Android en France pourront progressivement accéder à cette fonctionnalité, soulevant des questions sur la transparence des critères de recommandation de Gemini au regard du règlement européen sur les marchés numériques (DMA).

OutilsOutil
1 source
L'injection de prompts exploite les failles de conception des IA d'entreprise : agents, pipelines RAG et routeurs de modèles ciblés
205VentureBeat AI 

L'injection de prompts exploite les failles de conception des IA d'entreprise : agents, pipelines RAG et routeurs de modèles ciblés

L'injection de prompts s'est imposée comme la menace la plus critique pesant sur les systèmes d'intelligence artificielle en entreprise, selon plusieurs rapports convergents publiés entre 2025 et 2026. L'OWASP LLM Top 10 (édition 2025) la classe en première position pour la deuxième édition consécutive, reconnaissant l'incapacité persistante des grands modèles de langage à distinguer fiablement les instructions des données qu'ils traitent. Le rapport CrowdStrike Global Threat Report 2026, s'appuyant sur le suivi de plus de 280 groupes d'adversaires, documente des injections de prompts malveillants dans des outils d'IA générative légitimes au sein de plus de 90 organisations en 2025, utilisées pour voler des identifiants et des cryptomonnaies. Les attaquants pilotés par l'IA ont augmenté leur volume d'attaques de 89 % en un an, résumant la situation en une formule : "Les prompts sont le nouveau malware." Deux incidents concrets illustrent l'ampleur réelle du problème. En août 2024, des chercheurs de PromptArmor ont révélé une faille dans Slack AI permettant d'exfiltrer des données de canaux privés, y compris des clés API, simplement en plaçant une instruction malveillante dans un canal public. En juin 2025, Aim Security a divulgué EchoLeak (CVE-2025-32711, score CVSS 9.3), premier exploit zero-click documenté contre un système IA en production : en envoyant un seul email piégé, sans aucune interaction de l'utilisateur, un attaquant pouvait forcer Microsoft 365 Copilot à transmettre des fichiers internes vers un serveur externe. Les deux vulnérabilités ont depuis été corrigées. L'impact de ces attaques dépasse largement le cas isolé : elles exposent une faille structurelle dans la manière dont les entreprises déploient l'IA à grande échelle. Lorsqu'un modèle traite des instructions, résume des informations et déclenche des workflows automatisés, il devient difficile de distinguer une commande légitime d'une donnée corrompue. Les agents IA modernes peuvent envoyer des emails, modifier des infrastructures cloud, exécuter du code et interagir avec des systèmes internes, ce qui signifie qu'une seule instruction malveillante peut déclencher des actions aux conséquences réelles et durables. Le problème touche directement les équipes de sécurité, les DSI et les développeurs qui déploient ces systèmes sans protocoles de validation robustes. Les techniques d'injection ont considérablement évolué, ciblant désormais des architectures bien plus complexes que le simple chatbot. L'injection inter-modèles exploite le fait que la sortie corrompue d'un modèle sera traitée par d'autres modèles en aval, propageant ainsi la manipulation à travers toute la chaîne. L'empoisonnement de pipelines RAG consiste à publier des contenus malveillants (documentations, articles, READMEs GitHub) en espérant qu'ils soient ingérés par les systèmes de récupération d'information des entreprises. Le détournement d'agents et les attaques par débordement de contexte, utilisant des fenêtres de millions de tokens pour noyer les garde-fous dans un flot de données, complètent un arsenal en constante expansion. Face à cette réalité, la question n'est plus de savoir si une organisation sera ciblée, mais à quel moment ses pipelines IA seront compromis, et si elle aura mis en place les contrôles nécessaires pour le détecter.

UELes entreprises françaises et européennes déployant Microsoft 365 Copilot, des agents IA ou des pipelines RAG sont directement exposées aux vecteurs documentés, notamment EchoLeak (CVE-2025-32711, CVSS 9.3) qui permettait l'exfiltration silencieuse de fichiers internes sans interaction utilisateur.

SécuritéOpinion
1 source
Gemini transforme Google Sheets en assistant anti erreurs de formules
206Le Big Data 

Gemini transforme Google Sheets en assistant anti erreurs de formules

Google a déployé le 22 juin 2026 une nouvelle fonctionnalité intégrant Gemini directement dans Google Sheets, permettant à l'IA de détecter et corriger les erreurs de formules en temps réel. Lorsqu'une cellule affiche une erreur, parenthèse manquante, fonction mal imbriquée, référence incorrecte, Gemini analyse l'ensemble de la structure du document pour comprendre l'intention initiale, puis propose une correction accompagnée d'une explication en langage naturel, sans que l'utilisateur ait à quitter la feuille de calcul. Le déploiement s'étale sur quinze jours et s'accompagne d'une promotion temporaire jusqu'au 15 juillet 2026 élargissant les quotas d'utilisation, avant l'application de limites individuelles selon les forfaits. Pour les millions d'utilisateurs de Sheets, des novices aux analystes financiers, cette intégration supprime l'une des frictions les plus communes du travail en tableur : la chasse aux erreurs de syntaxe, souvent chronophage et décourageante. Un comptable qui débogue un VLOOKUP mal paramétré ou un data analyst avec une formule ARRAYFORMULA complexe peuvent désormais obtenir un diagnostic instantané sans basculer vers la documentation officielle ou Stack Overflow. Le gain de productivité est réel, particulièrement sur des fichiers denses où une erreur en cascade peut paralyser l'ensemble d'un modèle. Google positionne ainsi Sheets non plus comme un simple tableur, mais comme un environnement de travail semi-automatisé où l'IA absorbe une partie de la charge cognitive liée à la syntaxe. Cette fonctionnalité s'inscrit dans la stratégie de Google d'intégrer Gemini à travers toute la suite Workspace, Docs, Gmail, Slides, Meet, pour justifier ses abonnements premium face à la concurrence de Microsoft Copilot dans Office 365. L'accès reste pour l'instant réservé aux forfaits Google AI Pro et Ultra pour les particuliers, et aux abonnements Workspace Business Standard, Business Plus, Enterprise Standard et Enterprise Plus pour les organisations, avec une activation requise côté administrateur. Le secteur éducatif bénéficie de conditions d'accès spécifiques via Google AI Pro. Cette montée en puissance progressive, avec quotas puis généralisation, est typique de la méthode Google pour mesurer l'adoption avant de décider d'une diffusion plus large, et pour surveiller la charge d'inférence que représente une assistance permanente dans un outil utilisé quotidiennement par des centaines de millions de personnes.

UELes organisations françaises et européennes disposant d'abonnements Workspace éligibles bénéficient d'une assistance IA immédiate pour la correction de formules, avec des implications potentielles de conformité RGPD sur le traitement des données de tableurs en cloud américain.

OutilsOutil
1 source
Mistral lance OCR 4, un outil d'extraction documentaire taillé pour l'IA en entreprise
207VentureBeat AI 

Mistral lance OCR 4, un outil d'extraction documentaire taillé pour l'IA en entreprise

Mistral AI a lancé mardi OCR 4, sa quatrième génération de technologie de reconnaissance optique de caractères en à peine quinze mois. Ce modèle de traitement documentaire dépasse la simple extraction de texte brut : il retourne une représentation structurée complète de chaque document, avec des boîtes de délimitation précises pour chaque bloc, une classification par type de contenu (titre, tableau, équation, signature) et des scores de confiance mot par mot. Le modèle supporte 170 langues, accepte les formats PDF, DOC, PPT et OpenDocument, et peut être déployé en conteneur autonome sur l'infrastructure interne d'une organisation. Il est disponible immédiatement via l'API Mistral, Document AI dans Mistral Studio, Amazon SageMaker et Microsoft Foundry, avec une intégration Snowflake annoncée prochainement. La tarification débute à 4 dollars pour 1 000 pages, ramenée à 2 dollars via l'API batch. Lors d'évaluations humaines indépendantes, les annotateurs ont préféré les sorties d'OCR 4 dans 72 % des cas face aux solutions concurrentes. Le changement central d'OCR 4 est architectural. Plutôt que de produire un flux plat de texte extrait, le modèle génère une carte sémantique du document : chaque bloc est localisé, typé et scoré. Cette traçabilité répond à une friction majeure des équipes qui construisent des pipelines RAG (retrieval-augmented generation) ou des workflows de conformité, où la question "d'où vient ce chiffre, sur quelle page ?" exige une réponse auditable. La classification des blocs permet en outre d'orienter automatiquement un tableau vers un pipeline de données structurées, un titre vers un découpage sémantique, ou une signature vers un workflow de caviardage. Packager ces sorties directement dans le modèle OCR supprime une couche d'analyse de mise en page que les équipes devaient jusqu'ici construire et maintenir séparément. Les scores de confiance permettent quant à eux de router programmatiquement les extractions incertaines vers des relecteurs humains, sans qu'une personne n'ait à vérifier chaque page de chaque document. Ce lancement intervient dans un contexte particulièrement porteur pour Mistral. La startup française, dont la proposition de souveraineté numérique européenne n'a jamais été aussi commercialement pertinente, cible explicitement les entreprises des secteurs réglementés, finance, santé, juridique, qui ne peuvent pas faire transiter leurs documents sensibles par des API cloud sous juridiction américaine. La capacité de déploiement on-premise en conteneur unique est le principal levier de différenciation face à des acteurs comme Google Document AI ou AWS Textract. Pour les développeurs, l'enjeu est aussi économique : dans les systèmes de production, l'OCR n'est que la première étape d'un pipeline plus large, et la reconstruction manuelle de la structure documentaire consomme souvent plus de temps d'ingénierie que la logique IA en aval. OCR 4 vise à éliminer cette étape, et si le modèle tient ses promesses, les gains se mesurent autant en heures d'ingénierie économisées qu'en coût d'extraction.

UEMistral AI, startup française, propose un déploiement on-premise en conteneur qui offre aux entreprises européennes des secteurs réglementés (finance, santé, juridique) une alternative souveraine aux solutions cloud sous juridiction américaine.

OutilsOutil
1 source
OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles
208VentureBeat AI 

OpenAI dévoile sa première puce d'inférence IA maison, Jalapeño, développée avec Broadcom grâce à ses propres modèles

OpenAI et Broadcom ont dévoilé ce matin leur premier processeur d'inférence IA sur mesure, baptisé "Jalapeño". Contrairement aux GPU grand public d'Nvidia ou AMD, ce circuit intégré à application spécifique (ASIC) est conçu exclusivement pour faire tourner des grands modèles de langage en production, notamment derrière ChatGPT, Codex et l'API OpenAI. Ce qui frappe d'emblée, c'est la vitesse de développement : de la conception initiale à la fabrication, seulement neuf mois se sont écoulés, là où un cycle habituel de développement de processeur se compte en années. Le partenariat entre OpenAI et Broadcom n'avait d'ailleurs été annoncé publiquement qu'en octobre 2025. Greg Brockman, président et cofondateur d'OpenAI, ainsi que Hock Tan, PDG de Broadcom, ont présenté la puce ce matin sur CNBC. Brockman a précisé que le processus de conception a lui-même été accéléré grâce aux propres modèles d'OpenAI, des versions antérieures au GPT-5.5. OpenAI indique avoir déjà testé GPT-5.3-Codex-Spark sur ces puces dans un environnement de production simulé, et prévoit de déployer Jalapeño dans ses centres de données actifs d'ici fin 2026. Les performances initiales sont décrites comme "remarquables", Brockman écrivant sur X que le ratio performance par watt est "incroyable". L'enjeu dépasse largement la performance technique : il s'agit de survie économique. Des documents financiers audités récemment révélés montrent qu'OpenAI a généré 13,07 milliards de dollars de revenus en 2025, mais a engagé 34 milliards de dépenses opérationnelles, accusant une perte d'exploitation de près de 20,92 milliards de dollars. La principale cause : le coût titanesque de la puissance de calcul, essentiellement louée auprès de Microsoft Azure sur des GPU Nvidia. Concevoir ses propres puces optimisées pour l'inférence LLM permettrait à OpenAI de drastiquement réduire ce coût marginal par requête et d'atteindre enfin une rentabilité opérationnelle. Broadcom apporte la conception silicium et son réseau Tomahawk, tandis que Celestica gère l'intégration au niveau carte, rack et système. Cette annonce s'inscrit dans une stratégie plus large de verticalisation de la filière IA, un mouvement déjà emprunté par Google avec ses TPU et Amazon avec ses puces Trainium et Inferentia. OpenAI, longtemps dépendant des infrastructures de ses partenaires et investisseurs, cherche à contrôler toute sa pile technologique. Fait notable : les deux entreprises positionnent explicitement Jalapeño comme une puce "construite de zéro pour les LLMs actuels et futurs de toute l'industrie", ouvrant la voie à une commercialisation auprès d'autres acteurs de l'IA. De nombreuses questions restent ouvertes, notamment les performances comparatives face aux solutions Nvidia, les coûts de fabrication et la viabilité à grande échelle. Mais si le pari réussit, OpenAI ne sera plus seulement un éditeur de modèles : il deviendra un fournisseur d'infrastructure à part entière.

UEUne réduction future des coûts d'inférence pourrait bénéficier indirectement aux entreprises et développeurs européens utilisant l'API OpenAI, sans impact réglementaire ou industriel direct sur la France/UE.

💬 Quand tu perds 21 milliards par an, tu te construis tes propres puces. Ce que Jalapeño change vraiment, c'est pas la performance par watt, c'est qu'OpenAI sort enfin d'une dépendance à Nvidia qui les saignait à blanc requête après requête. Neuf mois de conception accélérée par leurs propres modèles, c'est la vraie rupture.

xAI lance /goal dans Grok Build : exécution autonome longue durée avec vérification intégrée pour les tâches de codage en plusieurs étapes
209MarkTechPost 

xAI lance /goal dans Grok Build : exécution autonome longue durée avec vérification intégrée pour les tâches de codage en plusieurs étapes

xAI a lancé une nouvelle fonctionnalité baptisée /goal au sein de Grok Build, son agent de codage en ligne de commande. Le mode cible l'exécution autonome de tâches longues et complexes : l'utilisateur soumet un objectif en une seule ligne, par exemple "Migrate the auth module to the new API", et l'agent prend en charge l'ensemble du processus sans supervision à chaque étape. Grok Build planifie une approche, la décompose en une liste de tâches visible, puis exécute chaque point séquentiellement. Une fois l'objectif atteint, le panneau bascule sur "Complete" et chaque élément apparaît comme coché. L'utilisateur peut continuer à transmettre des instructions pendant l'exécution, ou piloter la session via les commandes status, pause, resume et clear. L'accès nécessite un abonnement SuperGrok ou X Premium Plus, et le CLI s'installe via une commande curl en une ligne. Ce qui distingue /goal d'un simple agent d'édition de fichiers, c'est l'intégration native de la vérification. L'agent ne s'arrête pas après avoir écrit du code : il continue jusqu'à ce que la tâche soit réalisée et validée. Cette vérification peut prendre trois formes concrètes : relecture du code produit, inspection de pages web pour confirmer le comportement attendu, ou exécution de scripts de test. Ce mécanisme répond à l'une des limites les plus critiquées des agents autonomes, la tendance à déclarer une tâche terminée avant que le résultat ne soit réellement fonctionnel. Pour les développeurs, cela transforme la relation au travail délégué, notamment sur des tâches mécaniques mais étendues : migration de services, ajout d'endpoints, mise à jour de dépendances, portage de configurations sur plusieurs fichiers. Grok Build est l'outil de développement d'xAI, la société d'Elon Musk fondée en 2023, et embarque déjà plusieurs fonctionnalités orientées agents : un mode plan qui bloque les modifications jusqu'à validation explicite, des sous-agents spécialisés travaillant en parallèle, et la compatibilité native avec le protocole MCP (Model Context Protocol), qui permet aux agents de se connecter à des outils et sources de données externes. /goal s'inscrit dans une compétition intense entre les grands acteurs du codage assisté, que ce soit Cursor, GitHub Copilot, Anthropic avec Claude Code ou Google avec Gemini, tous engagés dans une course à l'autonomie fiable sur des tâches longues. La vraie bataille ne porte plus sur la qualité d'une réponse unique, mais sur la capacité à mener à bien une tâche entière, sans supervision constante, et surtout en sachant s'arrêter au bon moment.

💬 La vérification intégrée, c'est exactement ce que tous les agents rataient jusqu'ici. Pas juste écrire le code et te passer la main en prétendant avoir fini, mais inspecter, tester, confirmer que ça tourne, et seulement après s'arrêter. Reste à voir si ça tient vraiment sur de vraies migrations en prod, mais xAI vient d'attaquer le bon problème.

OutilsOutil
1 source
OpenAI : une croissance fulgurante, mais des pertes colossales
210Next INpact 

OpenAI : une croissance fulgurante, mais des pertes colossales

OpenAI a transmis à la SEC américaine un dossier financier confidentiel dans le cadre de sa préparation à une introduction en Bourse. Des documents ont fuité, révélant l'état réel des finances du laboratoire. En 2025, OpenAI a généré 13,1 milliards de dollars de chiffre d'affaires, contre 3,7 milliards en 2024, soit une hausse de plus de 250 % en un an. À fin 2025, la société encaissait 2 milliards de dollars par mois, deux fois plus que son chiffre trimestriel de fin 2024. Mais les pertes nettes ont atteint 38,5 milliards de dollars sur l'exercice, contre 5,09 milliards l'année précédente. En retranchant un ajustement comptable exceptionnel d'environ 30 milliards lié à la réorganisation juridique de l'entreprise, les pertes opérationnelles réelles s'établissent à 8 milliards, soit tout de même 60 % de plus qu'en 2024. Les dépenses d'exploitation ont failli tripler, passant de 12,5 à 34 milliards de dollars, avec une R&D qui explose à 19,18 milliards contre 7,81 milliards l'année précédente. En 2025, Microsoft a perçu 17,2 milliards de dollars d'OpenAI, dont 10,59 milliards pour couvrir les coûts d'infrastructure Azure liés à l'entraînement des modèles. Ces chiffres illustrent une réalité structurelle de l'IA générative : même les acteurs les plus rentables sur le plan commercial brûlent des liquidités à une vitesse sans précédent. OpenAI dépense nettement plus vite qu'elle ne gagne, et la dynamique ne semble pas près de s'inverser. Pour les utilisateurs et les entreprises clientes, cela signifie que la course aux modèles toujours plus puissants est financée par une accumulation de pertes qui repose entièrement sur la confiance des investisseurs. Pour l'industrie, cela confirme que le modèle économique de l'IA de pointe reste fragile : les marges sont négatives et les infrastructures de calcul représentent un coût colossal, capturé ici en grande partie par Microsoft via Azure. OpenAI a entamé sa transformation en société à but lucratif classique au cours des derniers mois, une restructuration juridique qui a généré la charge comptable exceptionnelle de 30 milliards. Ce changement de statut est précisément ce qui ouvre la voie à une introduction en Bourse. En mars 2026, la société annonçait une levée de fonds de 122 milliards de dollars sur une valorisation de 852 milliards, ce qui lui laisse 25 milliards de trésorerie disponible. SoftBank figure parmi les investisseurs clés avec 867 millions versés à OpenAI, tandis que Microsoft, malgré ses 17 milliards encaissés, reste à la fois fournisseur d'infrastructure, partenaire stratégique et client. La future cotation en Bourse imposera une transparence totale sur ces flux financiers complexes, et les marchés devront alors trancher : OpenAI vaut-elle vraiment près de mille milliards de dollars, ou est-elle une bulle alimentée par l'enthousiasme autour de l'IA ?

UELes entreprises européennes clientes des API OpenAI sont exposées à un risque structurel : leur fournisseur stratégique brûle des liquidités à un rythme sans précédent, ce qui interroge la durabilité tarifaire et la stabilité du service à long terme.

BusinessOpinion
1 source
Amazon Quick intègre des agents autonomes pour vous faire gagner des heures chaque jour
211AWS ML Blog 

Amazon Quick intègre des agents autonomes pour vous faire gagner des heures chaque jour

Amazon a annoncé cette semaine une mise à jour majeure de Quick, son assistant IA d'entreprise, avec le lancement d'agents autonomes capables de travailler en continu pour le compte des utilisateurs, même lorsque ceux-ci sont en réunion. Ces agents se configurent en quelques minutes via une description en langage naturel, sans aucune ligne de code, et peuvent se voir attribuer des niveaux d'autonomie variables : des instructions précises étape par étape jusqu'à des objectifs larges que l'agent atteint par ses propres moyens. Concrètement, un commercial peut revenir d'une journée de réunions et trouver les deals bloqués signalés, les relances rédigées et les notes CRM mises à jour. Un responsable conformité découvre au matin un résumé d'impact d'une réglementation publiée la nuit. Un acheteur voit ses bons de commande traités en continu. Amazon introduit également un "activity feed" repensé qui consolide e-mails, messageries, calendrier et tâches en une vue unique priorisée, avec des ébauches de réponses déjà générées et des notes de réunion préparées avant même que l'invitation soit ouverte. Cette évolution marque un pas vers ce que l'industrie appelle l'"agentic AI" : des systèmes qui ne se contentent plus de répondre aux questions mais initient des actions de manière proactive, sur la durée. Pour les entreprises, l'enjeu est de récupérer du temps de travail à haute valeur ajoutée en automatisant la gestion de flux d'information dispersés. Amazon positionne Quick comme un hub universel en annonçant simultanément 16 nouvelles intégrations, dont Adobe, Figma, Google Chat, Shopify, Snowflake, WhatsApp, Zapier, ZoomInfo, Cisco Webex, Dun & Bradstreet et Microsoft OneNote. Cela porte l'offre à plus de 30 compétences prêtes à l'emploi couvrant les ventes, la finance, les opérations et la conformité. Quick s'inscrit dans une bataille plus large entre les grandes plateformes cloud pour capter les budgets d'automatisation des entreprises. Microsoft intègre Copilot dans Microsoft 365, Google déploie ses Agents dans Workspace, et Salesforce avance avec Agentforce. Amazon, dont la position dans le marché des assistants d'entreprise reste moins dominante que ses concurrents dans les suites bureautiques, mise sur l'interopérabilité pour se différencier : pas de silos propriétaires, mais une couche d'orchestration capable de connecter l'existant. Le catalogue ouvert d'agents et de connecteurs, publiable par les organisations elles-mêmes, rappelle la logique des app stores et pourrait accélérer l'adoption si l'écosystème de partenaires se densifie rapidement. La prochaine étape sera de démontrer la fiabilité de ces agents sur des tâches à fort enjeu, là où une erreur autonome coûte plus cher que l'heure gagnée.

UELes entreprises européennes sous AWS pourraient adopter ces agents autonomes, mais Quick reste marginal face à Microsoft 365 et Google Workspace qui dominent les suites bureautiques d'entreprise en Europe.

OutilsOutil
1 source
Microsoft serre la vis sur Claude Fable 5 pour ses employés, voici pourquoi
212Le Big Data 

Microsoft serre la vis sur Claude Fable 5 pour ses employés, voici pourquoi

Microsoft a décidé de restreindre temporairement l'accès de ses employés à Claude Fable 5, le dernier modèle d'Anthropic lancé il y a quelques jours, selon des informations rapportées par The Verge. En cause, non pas les performances du modèle, qui sont saluées dans le secteur, mais les conditions de conservation des données imposées par Anthropic. La politique applicable à la famille Fable prévoit que les échanges avec le modèle soient conservés pendant au moins 30 jours à des fins de sécurité. Dans certains cas, notamment lorsqu'un contenu est signalé pour des besoins d'enquête ou des obligations légales, cette rétention peut s'étendre jusqu'à deux ans. Pour une entreprise de la taille de Microsoft, dont les salariés traitent quotidiennement des informations confidentielles, propriétaires ou soumises à des réglementations strictes, cette configuration est jugée incompatible avec les exigences internes de conformité. La décision illustre une tension croissante entre la puissance des modèles d'IA de pointe et les contraintes de gouvernance des données dans les grandes entreprises. Microsoft ne remet pas en cause les capacités techniques de Claude Fable 5, qui affiche des résultats remarquables en programmation automatisée, en cybersécurité et dans des tâches de raisonnement complexe, surpassant selon Anthropic plusieurs références du secteur sur de nombreux benchmarks. Ce qui est en jeu, c'est la souveraineté sur les données internes. Pour les équipes juridiques et de sécurité de Microsoft, le risque qu'un employé partage par inadvertance une information sensible avec un modèle externe, dont les logs sont conservés pendant des mois, est un risque réel qu'elles ne sont pas prêtes à accepter. Ce blocage s'inscrit dans une stratégie plus large que Microsoft semble délibérément mettre en oeuvre. En parallèle de cette restriction, l'entreprise a commencé à orienter ses développeurs vers ses propres outils, notamment GitHub Copilot et ses interfaces en ligne de commande. Microsoft, rappelons-le, est l'un des principaux investisseurs d'OpenAI et dispose de son propre écosystème d'IA, qu'il cherche à consolider en interne. Claude Fable 5 est issu de la famille Mythos, une version qu'Anthropic avait d'abord réservée à un nombre limité de partenaires en raison de ses capacités jugées particulièrement avancées, avant de lancer Fable 5 comme une déclinaison à usage général. L'épisode montre que même les modèles les plus performants du marché se heurtent aux exigences de conformité des grands groupes, et que la bataille pour l'adoption en entreprise ne se joue pas uniquement sur les benchmarks, mais aussi sur la transparence des politiques de traitement des données.

UELes directions informatiques et juridiques européennes, soumises au RGPD, sont directement concernées par les politiques de rétention des données des fournisseurs d'IA : ce cas illustre un risque de conformité réel pour toute entreprise européenne adoptant des modèles d'IA externes.

Apple rend enfin Siri intelligent avec Siri AI (mais pas tout de suite en Europe…)
21301net 

Apple rend enfin Siri intelligent avec Siri AI (mais pas tout de suite en Europe…)

Apple s'apprête à transformer radicalement Siri en 2026, en intégrant l'intelligence artificielle générative ainsi que le modèle Gemini de Google au coeur de son assistant vocal. Cette refonte majeure dotера Siri d'une interface redessinée, d'une voix personnalisable et d'une capacité de compréhension contextuelle nettement améliorée, capable de produire des réponses plus précises et adaptées aux besoins de chaque utilisateur. Une nouvelle application dédiée permettra également de consulter l'historique complet des conversations et de synchroniser toutes les interactions sur l'ensemble des appareils Apple. Cette mise à jour représente un tournant pour Apple, qui accuse un retard significatif face à des concurrents comme OpenAI avec ChatGPT, Google avec Gemini ou Microsoft avec Copilot. L'intégration de l'IA générative devrait transformer Siri d'un assistant limité en un véritable copilote numérique capable de raisonner, d'enchaîner des tâches complexes et de maintenir le fil d'une conversation sur la durée. Pour les quelque 2 milliards d'utilisateurs d'appareils Apple dans le monde, cela représente un changement d'usage potentiellement profond. Le déploiement ne sera cependant pas immédiat ni universel : l'Europe, soumise aux contraintes réglementaires du Digital Markets Act, devra attendre une date encore indéfinie avant d'accéder à ces fonctionnalités. Ce retard illustre la tension croissante entre les ambitions des géants technologiques américains et le cadre législatif européen. Apple avait déjà retardé plusieurs fonctions d'Apple Intelligence dans l'Union européenne pour des raisons similaires, laissant les utilisateurs du Vieux Continent en marge des dernières avancées de la plateforme.

UELes utilisateurs européens d'appareils Apple devront attendre une date indéfinie avant d'accéder aux nouvelles fonctionnalités de Siri AI, le Digital Markets Act imposant des contraintes réglementaires qui excluent temporairement l'UE de ce déploiement majeur.

💬 Siri avec du raisonnement contextuel et Gemini derrière, c'est quand même pas rien pour 2 milliards d'appareils. Apple accusait un retard visible depuis des années, tout le monde le voyait, et là c'est enfin du concret. En Europe on attend encore, le DMA fait son travail, et on commence à s'y habituer.

OutilsOpinion
1 source
ZoomMate connecte les conversations aux workflows
214Le Big Data 

ZoomMate connecte les conversations aux workflows

Zoom a dévoilé ZoomMate et son AI Productivity Suite, deux nouvelles offres destinées à transformer les conversations professionnelles en actions concrètes au sein des workflows d'entreprise. Présentées comme un "espace de travail intelligent", ces solutions s'appuient sur un moteur de recherche capable d'interroger simultanément les données stockées dans Zoom et dans une dizaine d'applications tierces : Salesforce, Jira, ServiceNow, Slack, Workday, Microsoft 365 et Google Workspace sont notamment intégrés. L'objectif est de permettre aux équipes de retrouver instantanément une information issue d'une réunion, de déclencher des tâches, de planifier des rendez-vous ou de mettre à jour des dossiers directement depuis l'interface Zoom. L'AI Productivity Suite ajoute une couche de génération documentaire : présentations, comptes rendus, feuilles de calcul et propositions commerciales peuvent être produits automatiquement à partir du contenu des échanges, chaque document restant traçable jusqu'à la conversation qui l'a engendré. L'enjeu pour les entreprises est réel : une part considérable de la valeur produite lors des réunions se perd faute de mécanismes efficaces pour en extraire et redistribuer l'information. En reliant directement les échanges aux outils opérationnels, Zoom cherche à réduire la friction entre décision et exécution, un problème chronique dans les organisations distribuées qui jonglent entre visioconférence, CRM, gestion de projet et messagerie. Si les promesses sont tenues, les équipes commerciales pourraient mettre à jour un compte Salesforce en sortant d'un appel client, ou les développeurs créer un ticket Jira dès la fin d'une réunion de sprint, sans changer d'outil. Zoom insiste également sur le respect des règles de sécurité et des permissions définies par chaque organisation, un argument central pour convaincre les DSI dans des contextes réglementés. Ces annonces s'inscrivent dans une transformation stratégique profonde de Zoom, dont la croissance explosive pendant la pandémie a brutalement ralenti avec le retour au bureau. Confronté à la concurrence de Microsoft Teams, qui dispose déjà de Copilot intégré à tout l'écosystème 365, et de Google Meet, Zoom ne peut plus se contenter d'être une application de visioconférence. L'entreprise cherche à se repositionner comme une plateforme de productivité à part entière, un terrain où elle affronte directement des acteurs bien établis. L'intégration de l'IA générative dans le cœur du produit est désormais le passage obligé pour justifier les licences entreprise et enrayer le churn. ZoomMate représente le pari que la richesse des conversations professionnelles captées sur la plateforme constitue un avantage différenciant, à condition que les intégrations tierces fonctionnent avec la fiabilité que les équipes métier exigent au quotidien.

UELes entreprises françaises et européennes utilisant Zoom pourraient automatiser leurs workflows entre réunions et outils métier (CRM, gestion de projet), sous réserve que les intégrations tierces respectent les contraintes réglementaires locales.

OutilsOutil
1 source
Doctolib réfute livrer « les infos de ses utilisateurs » aux grands acteurs de l’IA
215Next INpact 

Doctolib réfute livrer « les infos de ses utilisateurs » aux grands acteurs de l’IA

Le Canard Enchaîné a affirmé, dans son édition du 2 juin 2026, que Doctolib transmettait les données de ses utilisateurs à Microsoft, Anthropic et Google dans le but d'entraîner leurs grands modèles de langage. L'article vise notamment l'assistant de consultation que la licorne française commercialise depuis 2024 auprès des professionnels de santé. Ce service écoute les consultations médicales, avec l'accord du patient, pour générer automatiquement comptes-rendus et courriers. Or, les documents contractuels de Doctolib consultés par la rédaction de Next confirment que Microsoft Azure, Anthropic et Google Irlande figurent bien dans la liste des « sous-traitants ultérieurs » de l'entreprise, avec pour service déclaré la « fourniture du modèle de LLM » et pour finalité l'« analyse et création de contenu à des fins d'automatisation de tâches ». Doctolib dément catégoriquement que ces données médicales servent à entraîner les modèles de ses fournisseurs. Selon un porte-parole de l'entreprise, Microsoft, Anthropic et Google interviennent exclusivement comme prestataires techniques, sur instructions strictes de Doctolib, dans un cadre contractuel qui leur interdit d'utiliser les données à d'autres fins que la fourniture du service. En clair : les LLM américains sont bien mobilisés pour faire tourner les fonctionnalités de transcription et de synthèse, mais les notes médicales ne serviraient pas à affiner leurs poids. Sur le plan du stockage, Doctolib assure que les données sont hébergées sur des serveurs européens certifiés Hébergement de Données de Santé. Le Canard Enchaîné objecte toutefois que la justice américaine peut contraindre ces entreprises à transmettre des données outre-Atlantique, indépendamment de leur localisation physique. Cette controverse s'inscrit dans un débat plus large sur la souveraineté numérique des données de santé en France. Doctolib, qui traite des dizaines de millions de consultations, est une infrastructure critique du système de soins français, et toute ambiguïté sur le traitement de ses données sensitives déclenche une réaction immédiate. La tension entre innovation IA et protection des données médicales est structurelle : utiliser des LLM de pointe implique presque inévitablement de s'appuyer sur les infrastructures des géants américains, Microsoft, Google ou Anthropic, faute d'alternatives européennes comparables. Le RGPD et la certification HDS imposent des garanties, mais le Cloud Act américain crée un angle mort juridique que ni les certifications ni les contrats ne peuvent complètement combler. L'affaire illustre la fragilité des engagements de confidentialité dès lors que les données de santé transitent, même partiellement, par des acteurs soumis au droit américain.

UELes données médicales de millions de patients français transitent par des sous-traitants américains soumis au Cloud Act, créant une faille juridique structurelle que ni la certification HDS ni le RGPD ne peuvent entièrement combler.

💬 La distinction que fait Doctolib entre "faire tourner" et "entraîner" un LLM, elle est réelle. Mais ça n'enlève pas le truc qui gratte : tes comptes-rendus médicaux passent par des serveurs d'entreprises soumises au Cloud Act, et aucun label HDS ne te protège de ça. C'est une impasse structurelle, pas une faute de Doctolib spécifiquement.

ÉthiqueReglementation
1 source
Scout, l'Autopilot à base d'agents de Microsoft pour l'ensemble de M365
216AI News 

Scout, l'Autopilot à base d'agents de Microsoft pour l'ensemble de M365

Microsoft a présenté Scout lors de sa conférence Build 2026 cette semaine, le positionnant comme le premier représentant d'une nouvelle catégorie d'agents autonomes qu'il nomme "Autopilots". Testé en interne par des employés de Microsoft avant d'être étendu à un groupe restreint de clients et d'organisations membres du programme Frontier, Scout opère au sein de l'écosystème Microsoft 365 : Outlook, OneDrive, SharePoint et Teams. L'agent planifie des réunions, signale des messages prioritaires, génère des événements de calendrier et anticipe les échéances en bloquant des créneaux dans l'agenda d'un utilisateur pour dégager du temps de travail concentré. Il apprend progressivement les habitudes et préférences de chaque utilisateur pour affiner ses priorités. Techniquement, Scout repose sur OpenClaw, un projet open source développé en un week-end par Peter Steinberger, et Microsoft s'est engagé à contribuer en retour à ce projet. L'annonce a été rédigée par Omar Shahine, vice-président de Microsoft Scout, vétéran de Redmond dont le parcours inclut les divisions Windows Live, OneDrive et Mac Office. Pour accéder à Scout, les entreprises doivent être inscrites au programme Frontier, disposer d'une configuration Intune, d'une licence GitHub Copilot active et soumettre une attestation d'acceptation explicite. Scout représente une évolution significative dans la manière dont les outils de productivité intègrent l'automatisation. Contrairement à un simple assistant réactif, un Autopilot possède sa propre identité numérique, ce qui permet à plusieurs agents de coexister avec des règles de gouvernance distinctes : une instance personnelle et une instance professionnelle peuvent fonctionner en parallèle avec des droits différenciés selon le contexte. Pour les équipes informatiques, l'intégration via Microsoft Entra permet de vérifier l'identité des agents et de s'assurer qu'ils respectent les politiques de sécurité internes. La protection des données s'appuie sur Microsoft Purview, les identifiants liés aux identités machines étant masqués dans les journaux de diagnostics. Les actions jugées sensibles par l'algorithme requièrent systématiquement une validation humaine, ce qui préserve un contrôle sur les décisions à fort impact. La notion d'Autopilot s'inscrit dans la course que se livrent les grandes plateformes pour intégrer des agents réellement autonomes dans les flux de travail professionnels. Microsoft, qui a massivement investi dans l'IA générative depuis son partenariat avec OpenAI, cherche à différencier sa suite Copilot en y ajoutant une couche d'agentivité persistante et contextuelle. En bâtissant Scout sur une base open source et en promettant d'y contribuer, l'entreprise adopte une posture d'ouverture inhabituelle dans ce segment très compétitif. La prochaine étape sera l'élargissement progressif du programme Frontier et l'extension des capacités de Scout au-delà de Microsoft 365 vers d'autres surfaces applicatives, à mesure que les essais en conditions réelles permettront d'affiner la gestion des risques de sécurité identifiés lors des tests internes.

UELes entreprises françaises et européennes utilisant Microsoft 365 devront évaluer les implications de gouvernance et de conformité (RGPD, AI Act) liées à l'adoption d'agents autonomes dotés d'une identité numérique propre.

OutilsOutil
1 source
Simplifier les enquêtes de satisfaction des employés avec l'application Google Gemini
217The Information AI 

Simplifier les enquêtes de satisfaction des employés avec l'application Google Gemini

Les équipes RH des grandes entreprises passent parfois des semaines à construire leurs enquêtes de satisfaction interne, puis des semaines supplémentaires à dépouiller manuellement les résultats. Google propose désormais un guide pratique pour intégrer Gemini dans ce processus en quatre étapes : conception des questions, révision avant diffusion, nettoyage automatisé des données brutes, puis analyse des tendances. Concrètement, un responsable RH peut soumettre à Gemini un simple prompt, "génère une liste de questions pour notre enquête d'engagement à l'échelle de l'entreprise", et obtenir en quelques secondes un premier brouillon exploitable, qu'il peut affiner en dialoguant avec l'outil. Le système accepte également l'import de sondages passés pour en reproduire le ton et identifier les priorités déjà établies. Une fois les réponses collectées, Gemini peut nettoyer un tableur en une seule instruction : remplacer les noms manquants par "Anonyme", harmoniser les labels géographiques, supprimer les lignes incomplètes, et exporter un fichier propre prêt à l'analyse. L'enjeu est de réduire drastiquement le délai entre la collecte du feedback et la prise de décision concrète. Dans les cycles traditionnels, le nettoyage et l'analyse des données représentent une part disproportionnée du temps total, au détriment de l'action. En automatisant les tâches répétitives, reformatage, standardisation, détection de tendances dans les verbatims, Gemini permet aux équipes RH de se concentrer sur l'interprétation et les décisions managériales. Pour les organisations de taille importante, où une enquête annuelle peut générer des milliers de réponses libres difficiles à traiter, ce gain de temps n'est pas marginal : il détermine souvent si les insights arrivent à temps pour influencer les cycles budgétaires ou les réorganisations en cours. Ce guide s'inscrit dans la stratégie de Google visant à imposer Gemini comme assistant de productivité dans les environnements professionnels, en concurrence directe avec Microsoft Copilot, désormais intégré à la suite Microsoft 365. La bataille se joue précisément sur ce terrain des usages RH et opérationnels, où les gains de temps sont mesurables et les arguments commerciaux faciles à défendre auprès des directions. Google prend soin de préciser que Gemini ne remplace pas l'expertise humaine, le concept de "human-in-the-loop" est explicitement mentionné, ce qui reflète aussi une posture défensive face aux critiques sur l'automatisation excessive des processus sensibles. Les prochaines étapes probables incluent une intégration plus profonde avec Google Workspace Forms et Sheets, pour que l'ensemble du cycle enquête se déroule sans quitter l'écosystème Google.

OutilsOutil
1 source
Un badge d’accès dopé à l’IA : le gadget de Microsoft qui voit, écoute et accompagne les salariés
218Le Big Data 

Un badge d’accès dopé à l’IA : le gadget de Microsoft qui voit, écoute et accompagne les salariés

Microsoft a présenté lors de sa conférence Build un prototype de badge d'entreprise dopé à l'intelligence artificielle, baptisé Project Solara. Cet objet, conçu comme un compagnon de terrain connecté à Copilot, embarque un écran tactile, une caméra latérale, un microphone, un capteur d'empreintes digitales, du Wi-Fi et de la 5G. Steven Bathiche, expert technique chez Microsoft, a démontré sur scène comment demander à Copilot de repérer des prises de vue, de les retoucher et de les envoyer directement à une équipe. Un second prototype, lui destiné à rester sur un bureau, intègre des capteurs de présence à ultra-large bande capables de détecter l'approche de l'utilisateur, et se synchronise avec le PC principal via Bluetooth pour permettre de basculer des tâches entre les deux appareils. L'ambition de Microsoft est claire : faire sortir ses agents d'IA des interfaces logicielles pour les ancrer dans le monde physique, doté d'yeux, d'oreilles et d'une connexion permanente. La cible prioritaire n'est pas le cadre devant son écran, mais les travailleurs de première ligne, infirmières, employés de magasin, techniciens de terrain, pour qui un assistant capable de lire une scène en temps réel représente un gain concret. Le badge tire sa force du format lui-même : c'est un objet déjà accepté, voire ignoré, dans la plupart des organisations, ce qui facilite son adoption. Mais cette même discrétion soulève des questions immédiates sur la vie privée : un badge avec caméra et micro porté en permanence au travail franchit rapidement la ligne entre outil d'assistance et dispositif de surveillance. Cette annonce s'inscrit dans une stratégie plus large que Microsoft déploie depuis plusieurs années : après les PC Copilot, les agents logiciels autonomes et l'intégration de l'IA dans Microsoft 365, l'entreprise cherche à coloniser tous les points de contact du quotidien professionnel. Le mouvement n'est pas isolé, lunettes connectées, pendentifs IA et autres wearables fleurissent chez des concurrents comme Meta ou des startups spécialisées. Microsoft mise ici sur le monde de l'entreprise plutôt que sur le grand public, avec des secteurs comme la santé ou la distribution en ligne de mire. Le projet reste à ce stade un concept sans date de commercialisation annoncée, mais il signale une direction : si les agents d'IA doivent devenir vraiment utiles hors des bureaux, ils auront besoin d'un support physique. Microsoft parie que ce support pourrait se porter autour du cou.

UELe port permanent d'un badge caméra-micro en entreprise se heurterait directement au RGPD et au droit du travail français, qui encadrent strictement la surveillance des salariés et imposent un consentement explicite pour toute collecte de données biométriques ou audio sur le lieu de travail.

OutilsOutil
1 source
Solara : Microsoft lance son propre système d’exploitation pour l’IA
219Le Big Data 

Solara : Microsoft lance son propre système d’exploitation pour l’IA

Le 2 juin 2026, lors de sa conférence Build, Microsoft a dévoilé Solara, une nouvelle plateforme logicielle conçue spécifiquement pour alimenter une catégorie émergente d'appareils centrés sur l'intelligence artificielle. Contrairement à ce que l'on pourrait attendre du géant de Redmond, Solara ne repose pas sur Windows mais sur Android, choix délibéré pour s'adapter aux contraintes matérielles des appareils compacts et peu énergivores. Pour illustrer le concept, Microsoft a présenté deux prototypes : un écran connecté comparable à un Amazon Echo Show, équipé de reconnaissance faciale pour accéder à différents agents IA, et un badge portable intégrant caméra, lecteur d'empreintes et transcription en temps réel, activable d'une simple pression pour donner à l'agent la capacité de voir, d'entendre et de comprendre l'utilisateur. Ces deux dispositifs ne seront pas commercialisés directement par Microsoft, mais serviront de modèles de référence pour les fabricants tiers. L'enjeu de Solara dépasse la simple annonce produit : Microsoft tente de définir les règles d'une nouvelle catégorie d'appareils, celle des gadgets IA autonomes, dont l'industrie technologique parle depuis des années sans avoir trouvé de formule viable. En positionnant Solara comme une plateforme pensée "dès le départ" pour des agents intelligents, l'entreprise cherche à répliquer ce que Google a accompli avec Android dans le mobile : imposer un socle commun que les fabricants adoptent massivement. Des partenaires comme AccuWeather, Best Buy, CVS Healthcare et Target participent déjà à des programmes pilotes, ce qui suggère un intérêt réel du côté des entreprises prêtes à intégrer ces interfaces dans leurs environnements professionnels et commerciaux. Le choix d'Android révèle une inflexion culturelle significative chez Microsoft, qui reconnaît implicitement que Windows n'est plus la réponse universelle à tous les usages. Depuis l'explosion des grands modèles de langage en 2022-2023, l'industrie cherche le facteur de forme idéal pour les agents IA : ni smartphone, ni ordinateur classique, mais un objet intermédiaire, permanent et contextuel. Microsoft, qui a massivement investi dans OpenAI et intégré Copilot dans l'ensemble de sa suite logicielle, cherche maintenant à étendre son influence jusqu'à la couche matérielle. Solara reste toutefois à un stade précoce de développement, et le succès du projet dépendra de la capacité des fabricants partenaires à produire des appareils convaincants, accessibles et suffisamment utiles pour justifier une adoption à grande échelle.

UESi Solara s'impose comme standard de référence, les fabricants d'appareils européens pourraient être amenés à l'adopter, mais aucun partenaire ni enjeu réglementaire européen n'est mentionné à ce stade.

OutilsOpinion
1 source
Claude Mythos : Anthropic ouvre son IA à 150 nouvelles organisations
220Le Big Data 

Claude Mythos : Anthropic ouvre son IA à 150 nouvelles organisations

Anthropic a annoncé le 2 juin 2026 l'élargissement de son programme Project Glasswing, ouvrant l'accès à son IA spécialisée en cybersécurité Claude Mythos à environ 150 nouvelles organisations réparties dans plus de 15 pays. Lancé en avril 2026, le programme comptait initialement une cinquantaine de partenaires parmi lesquels AWS, Apple, Google et Microsoft. Ces premiers participants auraient, selon Anthropic, identifié plus de 10 000 vulnérabilités critiques dans différents projets logiciels en l'espace de quelques semaines. La nouvelle vague d'organisations intègre des secteurs considérés comme essentiels : énergie, santé, télécommunications et gestion de l'eau. Sur le plan géographique, l'expansion touche plusieurs pays européens, mais aussi le Canada, l'Australie, le Japon, l'Inde et la Corée du Sud. L'ENISA, l'agence européenne de cybersécurité, figure parmi les nouveaux membres du programme. L'enjeu est considérable : en donnant à des défenseurs un accès anticipé aux capacités d'analyse de Mythos, Anthropic cherche à inverser l'asymétrie traditionnelle entre attaquants et défenseurs dans le cyberespace. Les secteurs critiques comme les hôpitaux ou les réseaux électriques sont des cibles de choix pour les cyberattaques, souvent paralysées par des failles logicielles non corrigées. Disposer d'un outil capable de détecter automatiquement ces vulnérabilités avant leur exploitation représente un avantage opérationnel majeur. Pour les équipes de sécurité, cela se traduit par une capacité à traiter en quelques jours un volume d'analyse qui aurait autrefois mobilisé des équipes entières pendant des mois. Project Glasswing illustre un débat structurant de l'industrie de l'IA : comment mettre à disposition des outils puissants sans les transformer en vecteurs d'attaque. L'accès à Mythos reste contrôlé et réservé à des acteurs vérifiés, une approche délibérément prudente face à des capacités qui, entre de mauvaises mains, pourraient tout aussi bien servir à exploiter les failles qu'à les colmater. La pression internationale avait par ailleurs pesé sur cette décision : plusieurs gouvernements et régulateurs hors des États-Unis réclamaient un accès équitable à ces outils, estimant ne pas pouvoir assurer la défense de leurs infrastructures sans disposer des mêmes capacités analytiques que leurs homologues américains. Cette expansion marque donc à la fois une réponse diplomatique et une validation commerciale du modèle : les résultats obtenus lors de la première phase ont suffisamment convaincu Anthropic pour accélérer le déploiement et asseoir Mythos comme référence dans la cybersécurité assistée par IA.

UEL'ENISA rejoint le programme et des organisations européennes des secteurs critiques (énergie, santé, télécoms) accèdent à Claude Mythos pour détecter automatiquement des vulnérabilités dans leurs infrastructures avant exploitation.

💬 10 000 vulnérabilités identifiées en quelques semaines par la première vague de partenaires, c'est le genre de stat difficile à ignorer. Ce qui change avec cette expansion, c'est l'ENISA et les infras critiques européennes dans la boucle, les défenseurs hors États-Unis avaient jusqu'ici les mains vides. Garder l'accès contrôlé à 150 organisations dans 15 pays, c'est là que ça va devenir intéressant à surveiller.

Opus 4.8
221Ben's Bites 

Opus 4.8

Anthropic a lancé Claude Opus 4.8 en intégrant une nouvelle fonctionnalité centrale dans Claude Code : les workflows dynamiques. Concrètement, le modèle génère désormais un script d'orchestration, puis instancie des sous-agents en parallèle pour traiter des tâches complexes en simultané. Sur le benchmark ARC-AGI-3, Opus 4.8 obtient le meilleur score du marché, triplant celui de GPT-5.5. Les avis divergent cependant sur l'ampleur du progrès : Simon Willison le qualifie d'amélioration modeste mais utile, notamment parce que le modèle est plus honnête sur ses incertitudes et moins enclin à rater ses propres erreurs de code. La publication Every, de son côté, est bien plus enthousiaste : ses tests internes positionnent Opus 4.8 comme un bond significatif par rapport à 4.7, compétitif avec GPT-5.5 sur un benchmark d'ingénieur senior. Le benchmark Datacurve nuance ce tableau en le plaçant en dessous de GPT-5.5 et marginalement au-dessus d'Opus 4.6, tout en signalant une consommation de tokens nettement plus élevée. En parallèle, Anthropic a déposé un S-1 confidentiel auprès de la SEC et bouclé une levée de fonds en Serie H à 65 milliards de dollars, portant sa valorisation post-money à 965 milliards de dollars, avec une introduction en bourse potentielle d'ici fin 2026. L'arrivée des workflows dynamiques dans Claude Code marque un tournant pour les développeurs qui utilisent des agents LLM en production. Plutôt que d'enchaîner les appels séquentiels, le modèle peut désormais décomposer une tâche, déléguer ses parties en parallèle et les réassembler, ce qui réduit les temps de traitement sur des projets complexes. Plusieurs observateurs soulignent toutefois une limite structurelle : les systèmes multi-agents lâches restent peu fiables, et les workflows déterministes construits autour de petites boucles agentiques sont plus robustes en pratique. Côté valorisation, 965 milliards de dollars place Anthropic parmi les entreprises privées les mieux valorisées au monde, à un niveau comparable à des géants cotés du secteur technologique. Si l'IPO se concrétise cette année, elle redéfinirait les références de valorisation de l'ensemble du secteur de l'IA générative. Cette sortie intervient dans un contexte de compétition féroce entre Anthropic et OpenAI, dont les modèles phares se disputent le leadership sur chaque nouveau benchmark. La même semaine, NVIDIA et Microsoft annonçaient le RTX Spark, une puce Windows atteignant 1 petaflop avec jusqu'à 128 Go de mémoire unifiée et capable de faire tourner localement des modèles de 120 milliards de paramètres, accompagnée de primitives de sécurité pour agents sur Windows. OpenAI, de son côté, étoffait Codex avec le contrôle à distance de machines sous Windows et un SDK Python. La convergence de ces annonces dessine une infrastructure commune qui rapproche les modèles frontières du poste de travail et ouvre la voie à des agents autonomes opérant directement sur les appareils des utilisateurs.

UELes workflows dynamiques de Claude Code offrent aux développeurs européens une nouvelle capacité d'orchestration parallèle pour leurs agents IA en production ; l'IPO potentielle d'Anthropic à près de 1 000 milliards de dollars pourrait également remodeler les standards de valorisation pour les startups IA européennes.

💬 Les workflows dynamiques dans Claude Code, c'est le vrai gain ici, pas le benchmark. Le modèle peut désormais découper une tâche, déléguer ses parties en parallèle et réassembler le tout sans qu'on câble tout à la main. La conso de tokens va piquer, mais un modèle plus honnête sur ses propres erreurs de code (Simon Willison l'a bien noté), ça compte plus à mes yeux que tripler un score ARC-AGI-3.

LLMsOpinion
1 source
L'IA peut désormais gérer votre administration
222MIT Technology Review 

L'IA peut désormais gérer votre administration

L'actualité de l'IA cette semaine illustre à la fois son essor commercial et les tensions qu'il suscite. Anthropic, la startup fondée par d'anciens membres d'OpenAI, a déposé confidentiellement un dossier d'introduction en bourse et vise une entrée sur les marchés dès cet automne, possiblement avant OpenAI elle-même, sans dévoiler de valorisation cible. En parallèle, la Floride est devenue le premier État américain à poursuivre OpenAI en justice, accusant ChatGPT de mettre en danger la sécurité des enfants et de faire primer le profit sur la sûreté publique, selon le procureur général James Uthmeier. Du côté de la cybersécurité, des hackers ont pris le contrôle de comptes Instagram de célébrités en exploitant Meta AI : en demandant simplement des informations d'accès à l'assistant, ils ont contourné les protections habituelles. Enfin, l'Union européenne envisage d'exclure les géants américains du cloud, notamment Amazon, Microsoft et Google, des contrats liés aux infrastructures critiques, dans le cadre d'un effort de souveraineté numérique accéléré par les tensions commerciales avec Washington. Ces événements convergent pour dessiner un secteur à un tournant décisif. L'IPO d'Anthropic s'inscrit dans une course au capital où être premier en bourse pourrait donner un avantage symbolique et financier considérable face à OpenAI, attendue juste après la cotation de SpaceX, valorisée à mille milliards de dollars. La poursuite floridienne signale que la patience des régulateurs américains s'amenuise face aux risques supposés des chatbots grand public, une préoccupation qui pousse déjà plusieurs plateformes à intégrer des vérifications d'âge. La faille Meta AI révèle un risque systémique croissant : déléguer le support client à des intelligences artificielles crée de nouveaux vecteurs d'attaque que les équipes de sécurité n'ont pas encore pleinement anticipés. Pour les petites entreprises, en revanche, l'IA représente une opportunité concrète : les modèles actuels peuvent déjà gérer la comptabilité de base, la facturation, la prise de notes ou la planification des réseaux sociaux, des tâches autrefois réservées aux structures capables d'embaucher des spécialistes. Ces développements s'inscrivent dans un contexte où l'IA s'est imposée en moins de quatre ans comme un enjeu géopolitique, économique et social de premier ordre. La décision européenne d'écarter les fournisseurs américains reflète une défiance croissante vis-à-vis de la dépendance technologique envers les États-Unis, renforcée par les politiques commerciales de l'administration Trump. Pendant ce temps, des universités chinoises affiliées à l'armée cherchent à se procurer des puces Nvidia en dépit des restrictions américaines à l'exportation, et Pékin développerait des outils capables de prédire la dissidence politique. Sur le front scientifique, Meta, Anthropic et DeepMind auraient intensifié leurs recherches sur la conscience des machines, ouvrant un débat philosophique que la communauté scientifique commence à prendre au sérieux. L'ensemble du secteur avance à une vitesse que les cadres réglementaires, les protocoles de sécurité et les normes éthiques peinent encore à suivre.

UEL'UE envisage d'exclure Amazon, Microsoft et Google des contrats d'infrastructures critiques, une décision qui pourrait remodeler le marché du cloud souverain européen et accélérer l'adoption de solutions locales.

💬 L'IA qui gère ton administration, c'est pas du flan, les modèles actuels font vraiment le boulot sur la compta de base ou la facturation. Mais la faille Meta AI cette semaine rappelle un truc simple : brancher un assistant sur des processus sensibles sans repenser la sécurité, c'est offrir un boulevard aux attaquants. Bon, on le savait, mais là c'est plus théorique.

BusinessReglementation
1 source
GitHub Copilot augmente ses prix selon la consommation de tokens
223AI News 

GitHub Copilot augmente ses prix selon la consommation de tokens

Depuis le 1er juin 2026, GitHub Copilot a basculé vers un système de facturation à la consommation de tokens, remplaçant l'accès illimité aux modèles d'IA inclus dans les abonnements mensuels. Les tarifs d'abonnement restent inchangés, Copilot Pro à 10 dollars par mois, Pro+ à 39 dollars, Business à 19 dollars par utilisateur, Enterprise à 39 dollars, mais ils définissent désormais un nombre de crédits mensuels, et non plus un accès illimité. Un utilisateur Enterprise dispose ainsi de 3 900 crédits, un utilisateur Business de 1 900. Ces crédits se consomment en tokens selon le modèle choisi : avec GPT-5.2 par exemple, les tokens en entrée coûtent 1,75 dollar par million, les tokens en sortie 14 dollars par million. Les complétions de code dans l'éditeur et les suggestions "next edit" restent gratuites, mais toutes les autres fonctionnalités, y compris la revue de code, sont désormais décomptées. Le changement a provoqué une vague de réactions sur le forum GitHub Community Discussions dès le lendemain de l'entrée en vigueur. Plusieurs utilisateurs signalent un épuisement rapide et inattendu de leurs crédits. L'un d'eux, "rvs99", rapporte avoir dépensé environ 0,35 dollar par ligne modifiée sur une tâche mineure avec Claude Sonnet 4.6. Un autre, "prhost", montre qu'après une seule journée de travail, il ne lui reste que 3 705 crédits sur une allocation de 7 000, concluant que Microsoft "s'est tiré une balle dans le pied". La frustration est réelle : des équipes entières voient leur budget LLM exploser sans avoir modifié leurs habitudes de travail, simplement parce que la transparence sur les coûts réels était absente des offres initiales. La transition était pourtant prévisible. Microsoft avait annoncé ce changement de modèle dès avril 2026, et les abonnements à tarif fixe avec accès illimité aux LLMs constituaient clairement des offres d'appel, destinées à ancrer GitHub Copilot comme outil standard dans les équipes de développement. Faire tourner des modèles de langage à grande échelle est coûteux, entre l'infrastructure GPU, le post-entraînement, la maintenance et la construction de nouveaux datacenters. La facturation au token aligne désormais les recettes de GitHub sur les coûts réels de la plateforme. Pour les entreprises, l'équation change : les directions techniques devront soit encadrer strictement l'usage des modèles les plus puissants, soit réévaluer leur dépendance à Copilot face à des alternatives comme Cursor ou des solutions auto-hébergées. Ce virage tarifaire de Microsoft pourrait accélérer une rationalisation plus large du marché des assistants de code.

UELes équipes de développement françaises et européennes utilisant GitHub Copilot doivent revoir leurs budgets LLM et envisager des alternatives auto-hébergées ou des outils concurrents, car leurs coûts réels pourraient exploser sans modification de leurs habitudes de travail.

💬 C'était écrit depuis le début : l'accès illimité pour 10 dollars par mois, c'était du prix d'appel pour t'ancrer dans l'outil. Maintenant que la dépendance est bien installée, Microsoft présente l'addition, et les chiffres sont saignants (0,35 dollar la ligne modifiée, ça fait mal). Si tu as Cursor ou une solution auto-hébergée sous le coude, c'est le moment d'y regarder sérieusement.

OutilsOutil
1 source
NVIDIA lance Cosmos 3, Nemotron 3 Ultra et RTX Spark
224Latent Space 

NVIDIA lance Cosmos 3, Nemotron 3 Ultra et RTX Spark

NVIDIA a profité de la semaine du Computex 2026 à Taïwan pour lancer plusieurs modèles ouverts majeurs. Le plus attendu est Cosmos 3, une famille de modèles de monde omnimodaux capables de traiter simultanément le langage, l'image, la vidéo, l'audio et les actions physiques. L'architecture repose sur un mélange de transformeurs (Mixture-of-Transformers) combinant un raisonneur autorégressif et un générateur par diffusion, déclinée en deux versions : Nano (16 milliards de paramètres, deux tours de 8B) et Super (64 milliards, deux tours de 32B). Artificial Analysis a immédiatement classé Cosmos 3 en première position parmi les modèles ouverts sur ses classements Text-to-Image et Image-to-Video. NVIDIA a également annoncé Nemotron 3 Ultra, un modèle de langage de 550 milliards de paramètres dont 55 milliards actifs, salué comme le meilleur modèle ouvert américain à ce jour, capable de générer plus de 300 tokens par seconde selon certaines configurations. Enfin, le RTX Spark, un superchip personnel atteignant 1 pétaflop, a été présenté en partenariat avec Microsoft et OpenClaw. Ces annonces marquent un tournant dans la stratégie ouverte de NVIDIA. En publiant poids, code, jeux de données et recettes de fine-tuning pour Cosmos 3, l'entreprise positionne ses modèles comme une infrastructure commune pour l'IA physique, robotique, véhicules autonomes, simulation industrielle. La Cosmos Coalition, lancée avec des partenaires dont Runway, vise à construire un écosystème ouvert autour de ces modèles de monde. Pour Nemotron 3 Ultra, la communauté a réagi avec un enthousiasme inhabituel : sa densité d'activation, autour de 10 % contre 3 % pour des concurrents comme DeepSeek V4 ou Kimi K2, le rend à la fois plus coûteux à faire tourner, mais potentiellement plus prévisible en comportement, ce qui intéresse les entreprises cherchant de la fiabilité à grande échelle. Ces sorties s'inscrivent dans une semaine particulièrement dense pour les modèles ouverts. MiniMax a simultanément lancé M3, un modèle agent multimodal avec 1 million de tokens de contexte, affichant 59 % sur SWE-Bench Pro et un support immédiat chez Vercel, Cloudflare et Novita. Qwen3.7-Plus et Mellum2 de JetBrains ont également été publiés dans la même fenêtre. NVIDIA cherche à consolider sa domination au-delà du matériel : en proposant des modèles de référence ouverts pour l'IA physique, la société se place au cœur de la chaîne de valeur logicielle, là où Google et Meta se livrent déjà bataille. La convergence entre le RTX Spark, Cosmos 3 et l'écosystème de partenaires suggère une ambition claire : faire du PC local le prochain terrain de déploiement de l'IA agentique.

UELes poids, code et données d'entraînement de Cosmos 3 et Nemotron 3 Ultra étant publiés en open source, les entreprises et laboratoires européens peuvent les adopter sans dépendance à une API propriétaire américaine, ouvrant de nouvelles options pour l'IA physique et les grands modèles de langage.

💬 NVIDIA ne se contente plus de vendre des GPU, il cherche à posséder la pile logicielle de l'IA physique. Cosmos 3 open source avec poids et données, Nemotron Ultra pour la fiabilité en prod, RTX Spark pour le local, c'est une stratégie trop cohérente pour être coïncidence. Google et Meta sont déjà sur ce terrain, sauf qu'eux ne contrôlent pas le silicium en dessous.

LLMsOpinion
1 source
Nouveaux modèles d’IA, Windows repensé… Microsoft prépare du lourd pour Build 2026
225Le Big Data 

Nouveaux modèles d’IA, Windows repensé… Microsoft prépare du lourd pour Build 2026

Microsoft tiendra sa conférence annuelle Build 2026 dans les prochaines semaines, et les premières fuites dessinent un programme particulièrement dense. L'entreprise préparerait le lancement d'un nouveau modèle de raisonnement développé en interne par Microsoft AI, distinct des modèles génératifs classiques : conçu pour analyser les problèmes complexes, il produirait des réponses plus structurées et plus fiables sur des tâches de logique ou de planification. Copilot, l'assistant omnipresent de Microsoft, devrait lui aussi évoluer vers une version plus ambitieuse, décrite en interne comme une "super application" consolidant l'ensemble des services de l'écosystème Microsoft dans une interface unique. Côté Windows 11, plusieurs nouveautés sont attendues : amélioration des performances, réécriture de composants système pour gagner en réactivité, et une expérience dédiée aux développeurs avec des outils préinstallés, des scripts prêts à l'emploi et un environnement simplifié dès le démarrage. Ces annonces interviennent à un moment charnière pour Microsoft. La firme de Redmond a massivement investi dans l'IA depuis son partenariat avec OpenAI, mais doit maintenant prouver que ces investissements se traduisent en produits concrets et différenciants. Le nouveau modèle de raisonnement signalerait une volonté de ne plus dépendre uniquement des modèles OpenAI, en développant ses propres capacités maison. L'évolution de Copilot en point d'entrée universel de l'écosystème Microsoft représente un enjeu commercial majeur : si l'assistant devient la porte d'accès à Microsoft 365, Azure, Teams et Windows, c'est toute la fidélisation client qui se joue à travers lui. Pour les développeurs, une expérience Windows rationalisée peut réduire les frictions d'installation et de configuration, un argument de poids face à la popularité persistante de Linux et macOS dans ce segment. Build est historiquement la conférence où Microsoft trace sa feuille de route technique pour les douze mois suivants, et cette édition 2026 s'inscrit dans une compétition exacerbée avec Google, Apple et les acteurs purement IA comme Anthropic ou xAI. Microsoft doit également préparer Windows à la nouvelle génération de puces spécialisées pour l'IA, les NPU intégrés aux processeurs ARM et x86 récents, qui permettent d'exécuter des modèles localement sans passer par le cloud. La capacité du système à tirer parti de ce matériel sera déterminante pour les usages IA embarqués. Si les annonces tiennent leurs promesses, Build 2026 pourrait marquer un tournant réel pour Windows, qui n'a pas connu de refonte en profondeur depuis le passage à Windows 11 en 2021, les développeurs, eux, attendent des démonstrations avant de se laisser convaincre.

UELes entreprises européennes sous Microsoft 365 et Windows seraient directement concernées par l'intégration de capacités IA locales via NPU et l'évolution de Copilot en point d'entrée universel de l'écosystème.

LLMsOpinion
1 source
Faut-il dire adieu à la souris ? Windows lance l’IA qui clique et tape à votre place depuis la barre des tâches grâce à Nvidia
226Frandroid 

Faut-il dire adieu à la souris ? Windows lance l’IA qui clique et tape à votre place depuis la barre des tâches grâce à Nvidia

Microsoft et NVIDIA ont annoncé conjointement OpenShell, un runtime conçu pour transformer la barre des tâches de Windows en point de lancement d'agents IA autonomes. Ces agents sont capables d'interagir directement avec les applications installées sur le PC, en cliquant, en tapant et en naviguant à la place de l'utilisateur, sans intervention humaine. Les démonstrations présentées montrent des scénarios concrets où l'IA effectue des tâches complexes dans des logiciels tiers, du traitement de fichiers à la navigation dans des interfaces graphiques. L'impact potentiel est considérable, tant pour le grand public que pour les professionnels. Un utilisateur pourrait déléguer des tâches répétitives, comme remplir des formulaires, réorganiser des fichiers ou compiler des données, en donnant simplement une instruction en langage naturel. Pour les entreprises, cela ouvre la voie à une automatisation de bureau sans code, directement intégrée au système d'exploitation, sans passer par des outils tiers comme AutoHotkey ou des plateformes RPA spécialisées. Cette annonce s'inscrit dans la course que se livrent les géants technologiques pour intégrer l'IA agentique au coeur des systèmes d'exploitation. Microsoft pousse depuis plusieurs mois sa vision Copilot+ PC, tandis que NVIDIA apporte sa puissance de traitement GPU locale pour faire tourner ces modèles sans dépendre du cloud. OpenShell représente un pas vers un PC véritablement "piloté" par l'IA, une évolution qui soulève aussi des questions sur la sécurité des accès applicatifs et le contrôle laissé à l'utilisateur.

UELes entreprises françaises et européennes pourraient accéder à une automatisation de bureau sans code directement intégrée à Windows, mais les accès applicatifs autonomes soulèvent des questions de conformité RGPD pour les données manipulées par ces agents.

OutilsOutil
1 source
Une implémentation du Microsoft Agent Governance Toolkit pour un usage sécurisé des outils d'agents IA : politiques, validations, journaux d'audit et contrôles des risques
227MarkTechPost 

Une implémentation du Microsoft Agent Governance Toolkit pour un usage sécurisé des outils d'agents IA : politiques, validations, journaux d'audit et contrôles des risques

Microsoft a publié le Agent Governance Toolkit, un cadre de référence permettant de contrôler et d'auditer les actions des agents IA avant leur exécution. Un tutoriel d'implémentation, conçu pour fonctionner directement dans Google Colab, illustre concrètement son fonctionnement : les agents ne peuvent pas exécuter directement leurs outils. Chaque action est d'abord soumise à une couche de gouvernance qui vérifie l'identité de l'agent, son score de confiance, le niveau de risque de l'opération, la sensibilité des données concernées et les règles de politique applicables. Le système repose sur des fichiers de configuration YAML définissant des règles précises : blocage des opérations destructrices en base de données (suppression ou vidage de tables), approbation humaine obligatoire pour l'envoi d'e-mails vers des destinataires externes, exécution en bac à sable des commandes shell avec filtrage de termes dangereux comme rm -rf ou chmod 777, et refus d'accès aux données sensibles pour les agents dont le score de confiance est inférieur à 0,65. Le toolkit génère également des journaux d'audit infalsifiables, permet d'activer un coupe-circuit global et offre une visualisation graphique des relations entre agents, outils, règles et résultats. Cette architecture répond à un problème croissant dans le déploiement des agents IA : l'agentivité excessive. À mesure que ces systèmes deviennent capables d'enchaîner des actions autonomes, qu'il s'agisse d'écrire dans des bases de données, d'envoyer des e-mails ou d'exécuter du code, le risque qu'ils accomplissent des opérations non souhaitées ou dommageables augmente considérablement. Le toolkit propose un modèle où chaque action peut être autorisée, refusée, mise en sandbox ou redirigée vers un processus d'approbation humaine, selon des critères déterministes et traçables. Les règles s'appuient sur la taxonomie de risques de l'OWASP pour les agents IA, notamment les catégories « Tool misuse », « Goal hijacking » et « Unauthorized action », apportant un cadre de conformité reconnu aux équipes de sécurité. La publication de ce toolkit s'inscrit dans un mouvement plus large de l'industrie pour encadrer les agents autonomes, dont la prolifération s'est accélérée depuis 2024 avec l'essor de frameworks comme LangChain, AutoGen (lui aussi développé par Microsoft) et les API d'agents d'OpenAI et Anthropic. Microsoft, qui a massivement investi dans l'IA via son partenariat avec OpenAI et l'intégration dans Azure et Copilot, se positionne ainsi comme acteur de référence sur la gouvernance de ces systèmes. Le fait que l'implémentation soit reproductible dans un notebook Colab, sans infrastructure complexe, signale une volonté claire de démocratiser ces pratiques au-delà des grandes entreprises. Les étapes naturelles incluent l'intégration de ce type de couche dans les plateformes d'orchestration existantes et l'adoption de standards communs pour l'audit des décisions IA.

UELa taxonomie de risques OWASP intégrée au toolkit s'aligne directement avec les exigences de traçabilité et de supervision humaine de l'AI Act européen, facilitant la conformité des équipes qui déploient des agents IA autonomes.

SécuritéTuto
1 source
Cognition, créateur de l'agent de code Devin, plus que double sa valorisation à 26 milliards de dollars en moins de neuf mois
228The Decoder 

Cognition, créateur de l'agent de code Devin, plus que double sa valorisation à 26 milliards de dollars en moins de neuf mois

Cognition, la startup américaine à l'origine de Devin, l'agent de développement logiciel piloté par intelligence artificielle, a finalisé une levée de fonds dépassant le milliard de dollars, portant sa valorisation à plus de 26 milliards de dollars. Cette opération, bouclée en moins de neuf mois après un précédent tour de table, plus que double la valorisation de l'entreprise et s'impose comme l'une des plus importantes jamais réalisées dans le secteur des agents IA spécialisés dans le code. Devin avait été présenté en mars 2024 comme le premier "ingénieur logiciel autonome" capable de planifier, coder, tester et déployer des applications sans intervention humaine. Ce financement illustre l'appétit spectaculaire des investisseurs pour les outils capables d'automatiser le développement logiciel, un marché estimé à plusieurs centaines de milliards de dollars. Pour les entreprises tech, l'enjeu est concret : réduire les coûts de développement, accélérer les cycles de production et potentiellement redéfinir le rôle des ingénieurs humains. Pourtant, la valeur opérationnelle réelle de Devin reste vivement discutée dans la communauté des développeurs, certains benchmarks indépendants ayant remis en question ses performances annoncées. Cognition évolue dans un secteur de plus en plus disputé, face à GitHub Copilot d'OpenAI et Microsoft, Cursor, ou encore des agents comme Claude Code d'Anthropic. La course aux agents de codage s'intensifie alors que les grands modèles de langage atteignent un niveau de compétence technique suffisant pour traiter des tâches de programmation complexes. Cette méga-levée signale que, malgré les débats sur les performances actuelles, les investisseurs parient sur un basculement prochain vers une automatisation large du génie logiciel.

BusinessActu
1 source
Elon Musk prépare déjà Grok 5, la prochaine IA géante pour les développeurs ?
229Le Big Data 

Elon Musk prépare déjà Grok 5, la prochaine IA géante pour les développeurs ?

Elon Musk a annoncé le 25 mai 2026 la fin de l'entraînement du modèle Grok V9-Medium chez xAI, un système massif de 1,5 trillion de paramètres qui devrait être commercialisé sous le nom de Grok 4.5 ou Grok 5 d'ici deux à trois semaines. Ce chiffre représente trois fois la taille de la version actuelle V8-small utilisée pour le trafic quotidien de Grok. Le modèle entre désormais dans une phase de réglage fin supervisé, avec le lancement de l'apprentissage par renforcement prévu dans les prochains jours. Parmi les éléments notables de cet entraînement, xAI a intégré un volume important de données issues de Cursor, l'assistant de code alimenté par IA qui s'est imposé comme un outil de référence dans les workflows des développeurs professionnels. L'architecture a également été optimisée pour les GPU NVIDIA Blackwell afin d'améliorer l'efficacité de calcul et de réduire les coûts d'inférence. Ce qui distingue ce nouveau modèle des précédentes versions de Grok, c'est son orientation délibérée vers la programmation et l'ingénierie logicielle. En intégrant massivement des données réelles issues des habitudes des développeurs via Cursor, xAI cherche à construire un assistant capable de comprendre le code en profondeur, de corriger des bugs et de conduire un raisonnement logique complexe, plutôt que de simplement générer des extraits de code à la demande. Pour les entreprises tech et les équipes de développement, cela signifie un concurrent sérieux face à des outils comme GitHub Copilot, Claude ou GPT-4o dans le segment des assistants de codage, un marché en croissance rapide où la différenciation se joue désormais sur la spécialisation et la précision technique plutôt que sur les capacités généralistes. xAI s'inscrit dans une dynamique de course aux paramètres qui s'emballe depuis plusieurs mois dans l'industrie de l'IA, avec des annonces de modèles toujours plus massifs de la part d'OpenAI, Google DeepMind et Anthropic. Pour Musk, ce lancement représente également une opportunité de valoriser l'infrastructure du supercalculateur Colossus de xAI, dont la société cherche à prouver qu'elle peut rivaliser avec les centres de données des géants établis. La réduction des coûts d'inférence grâce à l'optimisation Blackwell est un enjeu stratégique concret : faire tourner un modèle de 1,5 trillion de paramètres à grande échelle représente des dépenses considérables, et la viabilité commerciale du produit dépendra autant de cette efficacité opérationnelle que de ses performances brutes sur les benchmarks. La sortie publique attendue courant juin 2026 constituera un test grandeur nature.

💬 1,5 trillion de paramètres, c'est soit impressionnant soit du flan selon comment tu arrives à le faire tourner à coût raisonnable. Ce qui m'intéresse vraiment, c'est les données Cursor : entraîner sur des vrais workflows de devs, pas juste du code GitHub, c'est une idée qui tient la route. Reste à voir si ça se traduit en gain réel ou juste en benchmark flatteur.

LLMsOpinion
1 source
Google Gemini : créer des plans de présentation en quelques secondes
230The Information AI 

Google Gemini : créer des plans de présentation en quelques secondes

Google a intégré dans Gemini une fonctionnalité qui permet aux dirigeants d'entreprise de générer en quelques secondes des plans de présentation structurés, là où les équipes consacraient auparavant des jours entiers à cette tâche. Le processus repose sur quatre étapes : rassembler ses idées brutes en cinq minutes de brainstorming libre, les charger dans un notebook Gemini aux côtés de documents existants (rapports trimestriels, guidelines de marque, présentations passées), formuler un prompt en langage naturel ou via Gemini Live (mode vocal sur mobile), puis itérer par conversation pour affiner le résultat. L'outil peut ensuite produire une décomposition slide par slide ou un tableau structuré prêt à transmettre à l'équipe, et même démarrer la présentation directement via la fonction Canvas. L'enjeu est significatif pour les organisations qui consacrent des ressources considérables à préparer des présentations stratégiques. Google illustre le cas d'un CEO de SaaS préparant un keynote pour le lancement d'un produit IA majeur devant des clients enterprise : au lieu de plusieurs réunions de cadrage, de longues chaînes d'e-mails et de cycles de relecture, un plan de haut niveau peut être posé en quelques minutes, donnant à l'équipe un fil directeur immédiat. La capacité de Gemini à ingérer de grands volumes de documents comme contexte d'un prompt permet de personnaliser la sortie bien au-delà d'un simple squelette générique. Pour les entreprises dont les présentations peuvent conditionner des décisions commerciales majeures, le gain en temps de coordination et en itérations internes est potentiellement très élevé. Cette annonce s'inscrit dans la bataille que se livrent Google, Microsoft et OpenAI pour ancrer leurs assistants IA dans les flux de travail professionnels quotidiens. Microsoft a poussé Copilot dans PowerPoint et Word ; OpenAI a développé des capacités de génération de documents structurés dans ChatGPT. Google répond en capitalisant sur l'intégration native de Gemini dans son écosystème Workspace, avec des notebooks qui servent de mémoire persistante entre les sessions. La fonctionnalité de prompt vocal via Gemini Live vise à réduire encore la friction, en permettant de dicter ses instructions comme on le ferait avec un collaborateur. La prochaine étape logique serait une intégration encore plus profonde avec Google Slides pour générer directement des decks complets, une direction que Google semble clairement préparer avec la fonction Canvas déjà disponible.

UELa fonctionnalité est intégrée à Google Workspace utilisé par des millions d'entreprises françaises et européennes, ce qui peut accélérer l'adoption de l'IA générative dans les processus de travail quotidiens.

💬 C'est pas la vitesse qui change le jeu, c'est le contexte. Pouvoir charger ses anciens decks, ses rapports Q, ses guidelines de marque, et obtenir un plan qui sonne vraiment comme ta boîte plutôt qu'un squelette sorti de nulle part, c'est ce que les autres n'ont pas encore bien résolu. Bon, faut que Canvas tienne ses promesses ensuite.

OutilsOutil
1 source
Anthropic présente Code with Claude, l'avenir du code selon eux
231MIT Technology Review 

Anthropic présente Code with Claude, l'avenir du code selon eux

Lors de l'événement "Code with Claude" organisé par Anthropic les 19 et 20 mai à Londres, Jeremy Hadfield, ingénieur chez Anthropic, a demandé à une salle comble de développeurs combien d'entre eux avaient fusionné une pull request entièrement rédigée par Claude sans en avoir lu une seule ligne de code. La majorité des mains sont restées levées, accompagnées de rires nerveux. Le même jour que Google I/O à Palo Alto, Anthropic affichait ses ambitions : "La majorité des logiciels chez Anthropic est désormais écrite par Claude, y compris le code de Claude Code lui-même", a déclaré Hadfield en ouverture. Boris Cherny, responsable de Claude Code, a résumé le nouveau paradigme : "Le réflexe par défaut n'est plus 'je vais prompter Claude', c'est désormais 'je vais laisser Claude se prompter lui-même'." Anthropic a également dévoilé une fonctionnalité baptisée "dreaming", annoncée deux semaines auparavant : les agents de Claude Code consignent des notes sur leurs tâches, que le système consolide ensuite pour identifier des patterns et des erreurs récurrentes, permettant aux agents suivants de monter en compétence plus rapidement sur une base de code donnée. Ce qui frappe dans cet événement, c'est la vitesse à laquelle ce nouveau mode de travail s'est normalisé. Il y a un an à peine, lors de la première édition de ces conférences développeurs, Anthropic venait de sortir Claude 4, capable de coder "dans une certaine mesure". Avec Claude 4.6 (février) puis 4.7 (avril), le seuil a été franchi : des entreprises comme Spotify, Delivery Hero, Lovable, Base44 et Monday.com ont restructuré leurs équipes de développement autour de Claude Code. L'objectif affiché par Anthropic est de pousser l'automatisation à son maximum, en faisant en sorte que Claude teste, corrige et itère de manière autonome, sans que l'ingénieur humain n'ait à voir les messages d'erreur. "Le principe clé, c'est de s'effacer et de laisser faire", a formulé l'ingénieur Ravi Trivedi. Pourtant, cette euphorie se heurte à des signaux contradictoires hors des murs de la conférence. Des rapports récents font état d'un nombre croissant de développeurs qui commencent à s'interroger sur leur rôle dans un environnement où leur expertise principale, écrire et lire du code, est en passe d'être entièrement déléguée à un modèle. OpenAI avec Codex, Google et Microsoft formulent des revendications similaires sur l'automatisation de leur propre développement logiciel. La question qui se profile n'est plus technologique mais structurelle : à mesure que les pull requests "zero human review" deviennent la norme, c'est toute la chaîne de responsabilité dans la production de logiciels qui se redessine, avec des implications qui dépassent largement les salles de conférence.

UEDes entreprises européennes comme Spotify (Suède) et Delivery Hero (Allemagne) ont restructuré leurs équipes de développement autour de Claude Code, signalant une transformation concrète des pratiques d'ingénierie logicielle en Europe.

💬 La salle qui lève la main en masse pour avouer avoir mergé une PR Claude sans en lire une ligne, c'est l'image qui résume tout. Je ne dis pas que c'est irresponsable, mais ça veut dire que la question n'est plus "est-ce que l'IA code bien" (elle code bien, on est d'accord), c'est "qui est responsable quand ça plante en prod". Ça, personne dans la conférence ne l'a vraiment posée.

OutilsOutil
1 source
Cursor profite des difficultés de GitHub
232The Information AI 

Cursor profite des difficultés de GitHub

Cursor, l'éditeur de code alimenté par l'IA, travaille sur un projet ambitieux visant à concurrencer directement GitHub sur ses fonctions essentielles. Baptisé en interne "Origin", ce projet est porté par les ingénieurs de Graphite, une startup spécialisée dans la revue de code que Cursor a rachetée l'an dernier. L'annonce officielle est prévue pour cet été. Selon une source proche du dossier, Origin proposera des dépôts de code, soit la fonction centrale de GitHub, ainsi qu'un ensemble de fonctionnalités avancées : revues de sécurité automatisées, actions programmées comme les tests continus, gestion des mises à jour sans interruption de service, et intégrations avec des outils tiers. Ce mouvement s'inscrit dans un contexte délicat pour GitHub, filiale de Microsoft. La plateforme a subi une série de pannes et de dysfonctionnements ces derniers mois, au point que Jay Parikh, le dirigeant qui supervise GitHub, a récemment mis en garde ses équipes : les outils de Cursor et d'Anthropic pourraient un jour rendre GitHub obsolète. Si un concurrent aussi jeune que Cursor parvient à intégrer gestion de dépôts, revue de code assistée par IA et automatisation en une seule plateforme cohérente, les millions de développeurs qui utilisent GitHub quotidiennement auraient une raison concrète de migrer. La montée en puissance des éditeurs de code IA redessine progressivement toute la chaîne du développement logiciel. Cursor, qui s'est imposé en quelques mois comme l'un des outils les plus populaires auprès des développeurs professionnels, ne se contente plus de compléter le code ligne par ligne : il s'attaque désormais à l'infrastructure collaborative qui entoure l'écriture du code. GitHub, de son côté, tente de répondre avec ses propres fonctionnalités IA via GitHub Copilot, mais la pression vient maintenant de plusieurs fronts simultanément, incluant Anthropic et d'autres acteurs. L'acquisition de Graphite l'année dernière prenait tout son sens stratégique : Cursor construisait déjà les briques d'une plateforme complète, bien au-delà du simple éditeur.

UELes développeurs français et européens pourraient bénéficier d'une concurrence accrue sur le marché des plateformes de développement collaboratif, potentiellement forçant une amélioration de la fiabilité et des fonctionnalités IA des outils existants.

OutilsOutil
1 source
Nexos.ai : on a testé l’outil qui veut convaincre votre DSI que l’IA n’est pas une passoire
233Le Big Data 

Nexos.ai : on a testé l’outil qui veut convaincre votre DSI que l’IA n’est pas une passoire

Nexos.ai, la plateforme développée par Nord Security, l'éditeur à l'origine de NordVPN, propose une solution de gouvernance de l'intelligence artificielle en entreprise. Le principe est simple : plutôt que de créer un nouveau modèle maison, Nexos fait office de hub centralisé permettant aux équipes d'accéder aux grands modèles du marché, OpenAI, Anthropic, Google, Mistral, depuis un environnement contrôlé, avec des journaux d'activité, des règles configurables et un administrateur aux commandes. L'interface, pensée pour être accessible sans formation, permet de choisir son modèle via un menu déroulant, de définir un profil global avec des instructions permanentes, et de désactiver la mémorisation d'un simple interrupteur. Un détail attire l'attention : un drapeau européen signale les modèles traités sur des serveurs en Europe, garantie concrète pour les entreprises soumises au RGPD. Côté routing, la plateforme dirige intelligemment les tâches vers le modèle le plus adapté, un modèle d'embedding Mistral pour indexer un PDF, sans mobiliser un modèle coûteux, sans que l'utilisateur n'ait à intervenir. L'enjeu adressé est loin d'être anecdotique. Le phénomène dit du "Shadow AI", ces salariés qui utilisent leur compte personnel ChatGPT ou Claude pour coller des contrats, des roadmaps ou des bilans RH, représente en 2026 l'un des principaux vecteurs de fuite de données sensibles en entreprise, non par malveillance, mais faute d'alternative sérieuse mise à disposition. Nexos tente de combler ce vide en offrant aux DSI une visibilité réelle sur les usages, et aux employés un outil suffisamment fluide pour ne pas générer de contournements. Pour un DAF surveillant sa facture cloud, l'optimisation automatique du routing entre modèles représente aussi un argument économique tangible, invisible pour l'utilisateur final mais visible dans les coûts d'infrastructure. Nord Security n'est pas un inconnu dans l'espace cybersécurité : l'entreprise a construit sa réputation sur NordVPN, un produit grand public devenu référence dans la protection de la vie privée en ligne. Ce positionnement lui confère une crédibilité initiale sur le marché de la gouvernance IA, un segment en pleine structuration alors que les régulations se durcissent des deux côtés de l'Atlantique, l'AI Act européen en tête. La limite que la revue identifie est structurelle : les promesses de "forteresse numérique" ne peuvent être vérifiées sans audit technique indépendant, et l'utilisateur doit in fine faire confiance à la réputation de l'éditeur. Dans un marché où les offres se multiplient, Microsoft Copilot, Glean, Perplexity Enterprise, Nexos mise sur la simplicité d'adoption et la conformité RGPD comme différenciateurs, deux arguments qui résonnent particulièrement auprès des ETI et grandes entreprises européennes encore hésitantes à franchir le pas.

UELes entreprises françaises et européennes soumises au RGPD et à l'AI Act disposent d'une plateforme de gouvernance IA avec hébergement européen, réduisant le risque juridique lié au Shadow AI.

SécuritéOutil
1 source
La puce Vera de Nvidia, le pari à 200 milliards de dollars que Jensen Huang veut mettre en avant
234AI News 

La puce Vera de Nvidia, le pari à 200 milliards de dollars que Jensen Huang veut mettre en avant

Nvidia a publié mercredi ses résultats du premier trimestre fiscal avec un chiffre d'affaires de 81,62 milliards de dollars, dépassant les 78,86 milliards attendus par les analystes. La guidance pour le deuxième trimestre est fixée à 91 milliards, là encore au-dessus des 86,84 milliards anticipés par Wall Street. Mais lors de la conférence avec les analystes, le PDG Jensen Huang a mis en avant un élément stratégique souvent éclipsé par les chiffres trimestriels : le processeur Vera. Huang estime que cette puce CPU ouvre un marché adressable de 200 milliards de dollars, entièrement distinct du marché d'un billion de dollars déjà projeté pour les GPU Blackwell et Rubin entre 2025 et 2027. Il prévoit que les revenus issus de Vera atteindront 20 milliards de dollars d'ici la fin de l'exercice fiscal en cours, ce qui en ferait le deuxième poste de revenus de l'entreprise. La plateforme complète Vera Rubin, combinant le CPU Vera avec les GPU Rubin, doit être lancée plus tard cette année. La mise sur Vera répond à une menace structurelle sur le segment de l'inférence. Google, Amazon et Microsoft devraient investir collectivement plus de 700 milliards de dollars dans l'infrastructure IA cette année, contre environ 400 milliards en 2025, mais développent simultanément leurs propres puces maison pour faire tourner les modèles d'IA à grande échelle. Les TPU de Google, Trainium d'Amazon, ainsi que les offres d'Intel et AMD positionnent désormais sérieusement leurs processeurs sur l'inférence, le maillon où la domination GPU de Nvidia est la plus exposée. Entraîner de grands modèles reste le terrain de chasse exclusif de Nvidia, mais générer des réponses en temps réel et à l'échelle, c'est là que la concurrence fait son chemin. La puce Vera a été développée en partie grâce à une technologie issue de Groq, une startup spécialisée dans l'inférence, dans le cadre d'un accord de licence estimé à environ 17 milliards de dollars. L'enjeu immédiat reste l'approvisionnement. Huang a reconnu sans détour que Nvidia sera probablement en tension sur les stocks durant toute la durée de vie de la plateforme Vera Rubin. Pour anticiper, les engagements d'approvisionnement de l'entreprise ont bondi à 119 milliards de dollars au premier trimestre, contre 95,2 milliards le trimestre précédent. Nvidia a également annoncé un programme de rachat d'actions de 80 milliards de dollars et relevé son dividende trimestriel de 1 centime à 25 cents par action. Malgré ces signaux de confiance, le titre a reculé de 1,6 % en after-hours : les analystes estiment que les performances record sont désormais intégrées dans le cours. La vraie question est de savoir si Nvidia peut convaincre que la dynamique de dépenses en IA restera solide jusqu'en 2027 et 2028, dans un contexte où les géants du cloud bâtissent activement des alternatives à ses GPU.

UELes entreprises européennes et data centers qui dépendent des GPU Nvidia pour leurs infrastructures IA pourraient être confrontés à des tensions d'approvisionnement prolongées sur la plateforme Vera Rubin, avec un impact potentiel sur les coûts et délais de déploiement.

💬 Le chiffre qui compte vraiment, c'est pas les 81 milliards de revenus. C'est que Google, Amazon et Microsoft vont dépenser 700 milliards en infra IA cette année, en bonne partie pour construire leurs propres puces et sortir de la dépendance Nvidia sur l'inférence. Vera, c'est Jensen qui joue défensif avant que les dégâts arrivent, et c'est ça que les résultats record font oublier.

Agents IA, recherche 24/7… la plus grosse refonte de Google Search depuis 25 ans
235Le Big Data 

Agents IA, recherche 24/7… la plus grosse refonte de Google Search depuis 25 ans

Lors de la conférence Google I/O 2026, le 19 mai, Google a officiellement enterré les « dix liens bleus » qui avaient défini la recherche sur internet depuis un quart de siècle. La refonte s'articule autour de trois axes majeurs déployés simultanément à l'échelle mondiale. D'abord, une nouvelle Intelligent Search Box remplace l'ancienne barre de saisie : l'interface s'adapte dynamiquement aux questions longues formulées en langage naturel et accepte désormais le glisser-déposer d'images, de fichiers PDF, de vidéos ou d'onglets Chrome directement dans le champ de recherche. Un système baptisé Query Coaching analyse l'intention de l'utilisateur en temps réel et suggère des reformulations avant même que la requête ne soit envoyée. Sous le capot, Google a intégré Gemini 3.5 Flash, son nouveau modèle phare, comme moteur par défaut de l'AI Mode désormais disponible partout : les réponses synthétiques s'affichent quatre fois plus vite que dans les versions précédentes, permettant une conversation continue avec suivi de contexte depuis les résultats. Enfin, les Information Agents, agents autonomes capables de surveiller le web en continu 24h/24, permettent à un utilisateur de déléguer la veille d'un sujet à une IA qui travaille en arrière-plan et notifie proactivement. L'impact est structurel pour l'ensemble de l'écosystème numérique. Pour les utilisateurs, la recherche cesse d'être un exercice de traduction de pensées en mots-clés calibrés : on peut interroger Google comme on pose une question à un expert, avec des documents en main. Pour les médias et éditeurs web, la bascule vers des réponses synthétiques générées par l'IA intensifie une menace déjà réelle sur le trafic organique, puisque le moteur répond de plus en plus sans renvoyer vers une source. Pour les entreprises, la surveillance automatisée par agents change radicalement la veille concurrentielle et la gestion de l'e-réputation, jusqu'ici réservées aux outils spécialisés. Cette transformation s'inscrit dans une course engagée depuis l'irruption de ChatGPT fin 2022, qui a forcé Google à accélérer son agenda IA et à assumer un risque de cannibalisation de son propre modèle publicitaire. Microsoft avait intégré GPT-4 dans Bing dès 2023, sans renverser les parts de marché, mais l'urgence stratégique n'en était pas moins réelle pour Google. La société a répondu avec les AI Overviews, déployées à grande échelle en 2024 malgré une série de bugs embarrassants, puis avec l'AI Mode progressivement étendu. Google I/O 2026 marque le saut qualitatif suivant : le moteur ne répond plus seulement aux requêtes, il anticipe les besoins et agit en autonomie. La question qui demeure ouverte est celle du financement du modèle : comment Google monétisera-t-il une interface où l'utilisateur n'a plus besoin de cliquer sur quoi que ce soit.

UELa bascule vers des réponses synthétiques générées par l'IA menace le trafic organique des éditeurs et médias français et européens, tandis que les agents autonomes de veille soulèvent des questions de conformité avec l'AI Act européen.

💬 Les agents de veille 24/7, c'est ce qu'on attendait depuis un moment. Jusqu'ici tu sortais la carte bleue pour Mention ou un outil dédié, là c'est embarqué nativement et accessible à tout le monde. Sur la monétisation, par contre, bonne question, parce que vendre de la pub sur une interface où personne ne clique, ça va être coton.

Google I/O 2026 : Google veut reconstruire Internet autour de l’IA
236FrenchWeb 

Google I/O 2026 : Google veut reconstruire Internet autour de l’IA

Lors de la conférence Google I/O 2026, le géant de Mountain View a officialisé une rupture profonde avec le modèle qui a fait sa fortune depuis 1998 : la page de résultats à dix liens bleus. Google y présente un moteur de recherche radicalement repensé, où l'intelligence artificielle répond directement aux questions des utilisateurs, synthétise l'information et guide les parcours de navigation sans nécessairement renvoyer vers des sites tiers. Les annonces couvrent l'ensemble de l'écosystème, de la Search aux outils de productivité Workspace, en passant par des modèles Gemini mis à jour. Ce pivot redéfinit les règles du jeu pour des millions d'acteurs du web. Les éditeurs de contenus, les sites e-commerce et les médias qui dépendent du trafic organique de Google risquent de voir leur audience s'effondrer si les réponses IA captent les requêtes en amont du clic. Pour les utilisateurs, l'expérience promet d'être plus rapide et fluide, mais soulève des questions sur la transparence des sources et la pluralité de l'information accessible. Cette transformation n'est pas soudaine : elle s'inscrit dans une course acharnée lancée par l'irruption de ChatGPT fin 2022, qui a contraint Google à accélérer massivement ses investissements dans l'IA générative. Face à Microsoft Bing dopé à GPT-4, puis à Perplexity et d'autres challengers, Google a d'abord introduit ses AI Overviews avant de franchir ce nouveau cap. La question qui demeure est de savoir si la justice et les régulateurs, notamment en Europe, accepteront qu'une seule entreprise contrôle à la fois la porte d'entrée du web et la couche IA qui le filtre.

UELes éditeurs, médias et sites e-commerce européens dépendant du trafic organique Google s'exposent à une chute structurelle de leurs audiences, tandis que les régulateurs européens devront statuer sur la légitimité qu'une seule entreprise contrôle simultanément la porte d'entrée du web et la couche IA qui en filtre l'accès.

💬 Tout le monde savait que ça allait arriver, mais voir Google officialiser la fin des dix liens bleus, ça fait quand même un effet. Les sites qui vivaient du trafic organique (médias compris) vont morfler, certains flanchent déjà. La vraie question c'est pas si les régulateurs européens s'en mêlent, c'est si ça changera quoi que ce soit.

OutilsOutil
1 source
Google rend la détection des deepfakes plus accessible au grand public
237The Verge AI 

Google rend la détection des deepfakes plus accessible au grand public

Google a annoncé lors de sa conférence Google I/O le déploiement de nouveaux outils de détection des contenus générés ou manipulés par l'intelligence artificielle, directement intégrés à Chrome et à son moteur de recherche. Dès aujourd'hui, la vérification des marqueurs SynthID, la technologie de tatouage numérique invisible développée par Google DeepMind, est disponible dans plusieurs fonctionnalités de Search, notamment Google Lens et le mode IA. La prise en charge des métadonnées C2PA (Coalition for Content Provenance and Authenticity), un standard ouvert de certification des contenus, sera également intégrée à Chrome pour permettre aux utilisateurs de consulter l'historique de création ou de modification d'une image directement depuis leur navigateur. Ces mises à jour visent à rendre la détection des deepfakes accessible au grand public, sans nécessiter d'outils tiers ni de compétences techniques particulières. Pour les journalistes, fact-checkers, et simples internautes, pouvoir vérifier en quelques clics si une image a été produite par un outil IA de Google ou certifiée par des éditeurs de confiance représente un changement significatif dans la lutte contre la désinformation visuelle. SynthID est développé par Google DeepMind depuis 2023 et intègre un filigrane imperceptible à l'oeil nu dans les images générées par les outils IA de Google. Le standard C2PA, soutenu par Adobe, Microsoft, la BBC et d'autres acteurs majeurs, permet d'attacher une chaîne de provenance vérifiable à tout contenu numérique. L'intégration de ces deux systèmes dans des produits utilisés par des milliards de personnes pourrait pousser le reste de l'industrie à adopter des mécanismes de traçabilité similaires.

UEL'intégration native du standard ouvert C2PA dans Chrome et de SynthID dans Google Search pourrait accélérer l'adoption de mécanismes de traçabilité des contenus en Europe, appuyant directement les obligations de lutte contre la désinformation imposées aux grandes plateformes par le Digital Services Act (DSA).

💬 Pas besoin d'être expert pour vérifier si une image sort d'un outil IA Google, à partir de maintenant. Ce qui change vraiment, c'est que Google joue le jeu du standard ouvert C2PA en plus de son SynthID maison : si ça prend, les autres plateformes vont devoir s'aligner, sans que personne n'ait à leur forcer la main officiellement. Pour l'instant ça ne couvre que l'écosystème Google, mais à cette échelle, c'est déjà un sacré levier.

SécuritéActu
1 source
Google lance un agent IA capable de rédiger vos emails, surveiller votre boîte et gérer vos dépenses
238VentureBeat AI 

Google lance un agent IA capable de rédiger vos emails, surveiller votre boîte et gérer vos dépenses

Google a dévoilé mardi 19 mai 2026, lors de sa conférence annuelle Google I/O, un nouvel agent d'IA personnelle baptisé Gemini Spark. Capable de rédiger des e-mails, assembler des documents, surveiller une boîte de réception et, à terme, effectuer des achats en ligne, Spark fonctionne en continu dans le cloud de Google, même lorsque l'ordinateur est fermé et le téléphone verrouillé. Il repose sur le nouveau modèle Gemini 3.5 Flash et une architecture interne appelée "Antigravity agent harness", la même infrastructure qui alimente les outils de développement internes de Google. Concrètement, un utilisateur peut donner une instruction complexe comme "envoie à mon patron un point de situation en tirant les derniers chiffres depuis notre tablette partagée et le calendrier du projet", Spark exécute l'ensemble sans intervention supplémentaire. Le déploiement commence cette semaine auprès d'un groupe restreint de testeurs, avec une bêta prévue la semaine prochaine pour les abonnés Google AI Ultra aux États-Unis. Sundar Pichai, PDG de Google et Alphabet, a résumé la promesse : "Vous n'avez pas besoin de garder votre ordinateur ouvert pour que ça tourne." Gemini Spark représente un saut qualitatif dans la façon dont les assistants IA s'intègrent au quotidien professionnel et personnel. Contrairement aux chatbots classiques qui ne s'activent que sur sollicitation, Spark opère de manière persistante et autonome, orchestrant des tâches multi-étapes à travers plusieurs applications Google simultanément, Gmail, Docs, Sheets, Slides, Agenda. Pour un indépendant, cela peut signifier une surveillance automatique des demandes clients entrant par e-mail. Pour un étudiant, un guide de révision qui se met à jour au fil des nouvelles consignes d'un professeur. Josh Woodward, vice-président de Google Labs, décrit l'expérience comme "jeter des choses par-dessus son épaule, Spark les attrape et les traite." L'enjeu commercial est massif : si l'agent tient ses promesses, Google ancre ses utilisateurs encore plus profondément dans son écosystème applicatif, tout en ouvrant un modèle économique inédit autour de l'action autonome payante. Ce lancement s'inscrit dans une compétition frontale entre les géants de la tech pour imposer leurs agents d'IA comme couche d'orchestration de la vie numérique. Microsoft, OpenAI, Anthropic et Apple développent tous des systèmes comparables, capables d'agir plutôt que de simplement converser. Google répond avec une architecture cloud-native pensée pour la délégation longue durée, et des ambitions qui vont au-delà des outils maison. D'ici la fin de l'année, Spark sera connecté via le protocole MCP à plus de 30 partenaires tiers dont Canva, OpenTable et Instacart, permettant des actions concrètes comme réserver une table ou passer une commande. Une interface Android baptisée Android Halo offrira une visibilité en temps réel sur les tâches en cours. Mais ces capacités soulèvent aussi des questions urgentes sur la confiance, les garde-fous financiers et les risques d'interprétation erronée des intentions, des défis que Google n'a pas encore résolus publiquement.

UELe déploiement est limité aux États-Unis dans un premier temps, mais l'accès persistant aux emails et documents personnels soulève des questions de conformité RGPD qui conditionneront et retarderont le lancement en Europe.

💬 L'architecture est soignée : faire tourner l'agent dans le cloud même quand le téléphone est verrouillé, c'est la vraie rupture, pas les cas d'usage marketing. Mais bon, si Spark tient ses promesses, Google réussit ce que les autres n'ont fait que promettre depuis deux ans, et ça va encore un peu plus te coincer dans leur écosystème. Le RGPD va freiner le déploiement en Europe, mais surtout, je me demande qui sera responsable quand Spark interprète mal une instruction et envoie n'importe quoi à ton patron.

OutilsOutil
1 source
Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini
239The Decoder 

Google I/O : nouveaux modèles, agent cloud permanent et refonte de l'application Gemini

Lors de sa conférence développeurs Google I/O, tenue cette semaine, Google a dévoilé plusieurs annonces majeures dans le domaine de l'intelligence artificielle. Au programme : un nouveau modèle de langage baptisé Gemini 3.5 Flash, conçu pour allier rapidité et efficacité, un modèle multimodal nommé Gemini Omni capable de traiter simultanément texte, images, audio et vidéo, ainsi qu'un agent personnel cloud appelé Gemini Spark, pensé pour fonctionner en continu, vingt-quatre heures sur vingt-quatre. L'application Gemini bénéficie par ailleurs d'une refonte visuelle et fonctionnelle complète. L'introduction de Gemini Spark marque un tournant dans la vision de Google pour l'IA personnelle. Contrairement aux assistants classiques qui se contentent de répondre à des requêtes ponctuelles, un agent cloud permanent peut exécuter des tâches de façon autonome, anticiper des besoins, surveiller des données ou déclencher des actions sans intervention humaine. Pour les développeurs comme pour les utilisateurs grand public, cela ouvre la voie à une nouvelle catégorie d'assistants proactifs, toujours disponibles et potentiellement connectés à l'ensemble des services Google. Ces annonces s'inscrivent dans une course effrénée à l'IA agentique que se livrent Google, OpenAI et Microsoft depuis début 2025. Google cherche à reprendre l'initiative après avoir été perçu comme en retrait face aux avancées de GPT-4o et des agents d'OpenAI. Avec cette vague de lancements, l'entreprise signale sa volonté de positionner Gemini non plus comme un simple chatbot, mais comme une infrastructure d'IA omniprésente, ancrée dans le cloud et intégrée à l'ensemble de son écosystème.

UELes nouveaux modèles Gemini et l'agent cloud permanent seront accessibles aux développeurs et entreprises européens, accélérant l'adoption de l'IA agentique dans l'écosystème Google en Europe.

LLMsActu
1 source
Anthropic rachète Stainless, la startup API convoitée par OpenAI et Google
240Le Big Data 

Anthropic rachète Stainless, la startup API convoitée par OpenAI et Google

Anthropic a annoncé le 18 mai 2026 l'acquisition de Stainless, une startup new-yorkaise fondée en 2022 par Alex Rattray, ancien ingénieur de Stripe. Spécialisée dans l'automatisation des SDK et des connecteurs API, Stainless avait bâti en quelques années une position de référence dans l'écosystème IA. Selon The Information, l'opération dépasserait les 300 millions de dollars. La technologie de Stainless transforme des spécifications d'API en kits de développement logiciel prêts pour la production, compatibles avec Python, Go, Java, Kotlin et TypeScript. Son avantage distinctif est la maintenance automatique de ces SDK : à chaque évolution d'une API, les bibliothèques sont mises à jour sans intervention humaine. Anthropic utilisait déjà Stainless depuis les premières versions de son API Claude, mais la startup fournissait également ses outils à OpenAI, Google, Replicate, Runway et Cloudflare. Ces clients perdront l'accès aux produits hébergés de Stainless, dont son générateur de SDK, bien qu'ils conservent la propriété des SDK déjà générés et le droit de les modifier. Cette acquisition positionne Anthropic sur un terrain stratégique qui dépasse le simple rachat technologique. Dans le marché de l'IA agentique, la valeur ne réside plus uniquement dans la puissance des modèles, mais dans leur capacité à se connecter à des systèmes externes, des bases de données et des logiciels métiers. Les SDK, serveurs MCP et connecteurs sont précisément la couche technique qui rend cette connexion possible. En intégrant Stainless, Anthropic renforce toute son infrastructure développeur autour de Claude et prive simultanément ses concurrents directs d'un fournisseur jusqu'ici commun. OpenAI et Google, qui comptaient sur ces outils, devront désormais trouver ou développer des alternatives, ce qui représente un coût de friction non négligeable pour leurs équipes techniques et leurs clients. Cette opération s'inscrit dans une logique que les grandes plateformes cloud ont perfectionnée depuis des décennies. AWS, Microsoft Azure et Google Cloud n'ont pas construit leur domination uniquement sur l'infrastructure brute, mais surtout sur des couches d'outils qui fidélisent les développeurs et rendent le changement de fournisseur coûteux. Anthropic applique aujourd'hui cette même recette au marché des agents IA, en s'appropriant une infrastructure critique juste au moment où la compétition s'intensifie. La société pousse parallèlement son protocole MCP, qui standardise la communication entre agents IA et applications tierces, et Stainless vient directement renforcer cette pile. Le rachat transforme Anthropic d'un fabricant de modèles en véritable opérateur d'infrastructure pour développeurs, un positionnement qui pourrait peser lourd dans la consolidation qui s'annonce dans le secteur.

UELes développeurs européens utilisant les outils Stainless via OpenAI ou Google devront migrer vers des alternatives, renforçant leur dépendance à l'écosystème Anthropic/Claude.

💬 Le vrai coup, c'est pas les 300 millions, c'est qu'OpenAI et Google perdent leur fournisseur de SDK commun du jour au lendemain. La maintenance automatique des bibliothèques à chaque évolution d'API, c'est invisible, mais c'est exactement le genre de truc qui colle aux mains et crée une vraie dépendance. Avec MCP qui pousse en parallèle, Anthropic est en train de bâtir la couche infrastructure dont on ne sort pas facilement.

Meilleures plateformes d'IA à agents autonomes pour les entreprises en 2026
241MarkTechPost 

Meilleures plateformes d'IA à agents autonomes pour les entreprises en 2026

En 2026, l'IA agentique d'entreprise a franchi le cap du projet pilote pour entrer dans les déploiements en production. Salesforce a conclu 29 000 contrats Agentforce depuis son lancement, générant 800 millions de dollars de revenus annuels récurrents. Microsoft Copilot Studio compte plus de 160 000 organisations qui font tourner plus de 400 000 agents personnalisés. ServiceNow a reconfiguré l'ensemble de son modèle commercial autour de niveaux d'autonomie IA. Sur le plan tarifaire, les modèles divergent : Agentforce facture 2 dollars par conversation ou 500 dollars pour 100 000 crédits Flex, tandis que Copilot Studio propose 200 dollars pour 25 000 crédits mensuels. Salesforce a par ailleurs finalisé en novembre 2025 l'acquisition d'Informatica pour renforcer la qualité des données intégrées à sa couche Data 360. Ces chiffres traduisent un basculement structurel : la question n'est plus de savoir s'il faut déployer des agents IA, mais quel outil convient à quel flux de travail. Ce mouvement massif vers la production révèle aussi ses limites. Les équipes qui ont réussi la transition des pilotes vers le déploiement réel rapportent que les échecs ne viennent pas des capacités des modèles, mais de trois problèmes récurrents : des données de mauvaise qualité, une propriété floue des cas limites, et une gouvernance jamais construite. Une pratique trompeuse s'est également généralisée dans le secteur, que les praticiens appellent l'« agent washing » : des éditeurs rebaptisent des chatbots existants, des scripts d'automatisation robotique ou des outils de workflow linéaires en les présentant comme des agents autonomes. Or, un vrai agent doit être capable de prise de décision autonome, de raisonnement multi-étapes et de gestion dynamique des erreurs, une barre que la majorité des produits commercialisés aujourd'hui ne franchit pas réellement. Les brochures marketing ne suffisent pas ; il faut tester sur des flux réels qui exigent ramifications, usage d'outils, rétention de contexte et récupération sur erreur. Les deux plateformes dominantes en volume illustrent une logique d'écosystème fermé. Agentforce s'appuie sur le moteur de raisonnement Atlas, qui décompose les tâches en étapes via une boucle Reason-Act-Observe, et reste nativement intégré aux données Salesforce, un avantage décisif pour les entreprises dont Salesforce est le système d'enregistrement central, mais une contrainte réelle pour les environnements SAP ou multi-stack. Copilot Studio bénéficie quant à lui d'une surface d'intégration massive : Teams, SharePoint, Dynamics 365 et le Microsoft Graph couvrent environ un milliard de sièges Microsoft 365 dans le monde. La stratégie gagnante pour 2026, selon les retours terrain, consiste à déployer un seul agent sur un workflow précis et bien documenté, mesurer les résultats, puis étendre progressivement, plutôt que de chercher une transformation générale en une seule vague.

UELes entreprises européennes sous écosystème Salesforce ou Microsoft 365 sont directement concernées par les nouvelles grilles tarifaires et les stratégies de déploiement d'agents autonomes décrites dans cet article.

OutilsOutil
1 source
Pourquoi Elon Musk a perdu son procès contre OpenAI
242MIT Technology Review 

Pourquoi Elon Musk a perdu son procès contre OpenAI

Un jury fédéral américain a rendu lundi un verdict consultatif unanime contre Elon Musk dans l'affaire Musk v. Altman, estimant que le milliardaire avait intenté son action en justice trop tard. La juge du district américain Yvonne Gonzalez Rogers a immédiatement accepté ce verdict, mettant fin aux deux chefs d'accusation de Musk : violation de la fiducie caritative qu'il avait constituée via ses donations, et enrichissement sans cause aux dépens d'Altman et Brockman. Musk avait donné 38 millions de dollars à OpenAI après sa cofondation en 2015, sur la foi de promesses selon lesquelles l'organisation resterait un but non lucratif dédié au bénéfice de l'humanité. Il avait assigné en justice en 2024 Sam Altman et Greg Brockman, réclamant l'annulation d'une restructuration de 2025 qui avait converti la filiale lucrative d'OpenAI en société à mission publique, ainsi que la révocation des deux dirigeants. Le délai de prescription applicable est de trois ans pour la violation de fiducie caritative, et de deux ans pour l'enrichissement sans cause, ce qui implique que Musk aurait dû avoir connaissance des faits litigieux au plus tôt en 2021 et 2022 respectivement. La décision ne tranche pas le fond de l'affaire, ce que Musk a aussitôt dénoncé sur X comme une simple "technicité calendaire." Il a annoncé faire appel. Concrètement, le verdict préserve la restructuration d'OpenAI : la filiale lucrative, désormais société à mission, peut poursuivre son développement sans être remise en cause par la justice. Pour Altman et Brockman, c'est une victoire totale sur la forme, qui leur évite un examen judiciaire de fond sur leurs décisions stratégiques. Pour OpenAI, entreprise désormais valorisée à plusieurs centaines de milliards de dollars et en cours de transformation capitalistique majeure, l'issue écarte une menace existentielle sur sa gouvernance. Le coeur du débat portait sur le moment précis où Musk aurait dû comprendre qu'OpenAI trahissait sa mission originelle. Dès 2017, deux ans après la fondation, Musk lui-même avait participé aux discussions sur la création d'une filiale lucrative et proposé une fusion avec Tesla, avant de se voir écarté dans une lutte de pouvoir interne. En 2019, OpenAI avait créé cette filiale avec des profits plafonnés et levé 1 milliard de dollars auprès de Microsoft. OpenAI a plaidé que ces jalons suffisaient à déclencher le délai de prescription bien avant 2021. Musk a témoigné avoir traversé "trois phases" : d'abord enthousiaste, puis méfiant, avant d'être "certain qu'ils pillaient le but non lucratif." Le tribunal d'appel devra trancher si cette chronologie donnait, ou non, à Musk des raisons suffisantes d'agir plus tôt.

UELa restructuration d'OpenAI en société à mission publique est juridiquement préservée, sécurisant la continuité des services et partenariats européens avec la plateforme sans risque de remise en cause de sa gouvernance.

💬 Le délai de prescription, ça paraît du détail procédural, mais c'est en fait le nœud de l'affaire : Musk était dans la salle en 2017 quand on dessinait la filiale lucrative, il a même proposé une fusion avec Tesla avant de se faire éjecter. Attendre 2024 pour attaquer en disant qu'on ne savait pas, après avoir participé à ces discussions, c'était bancal. Il fait appel, mais réécrire cette chronologie devant un tribunal d'appel, bonne chance.

Elon Musk perd son procès de 134 milliards de dollars contre OpenAI après deux heures de délibération
243The Decoder 

Elon Musk perd son procès de 134 milliards de dollars contre OpenAI après deux heures de délibération

Elon Musk a perdu sa bataille juridique contre Sam Altman et OpenAI. Un jury d'Oakland a délibéré moins de deux heures avant de rejeter l'intégralité des accusations, alors que le milliardaire réclamait jusqu'à 134 milliards de dollars en dommages et intérêts. La défaite est totale : la juge présidant l'audience a confié qu'elle aurait été prête à classer l'affaire immédiatement, avant même le retrait du jury, et l'avocat de Musk a d'ores et déjà annoncé son intention de faire appel. Ce verdict est une victoire nette pour OpenAI, qui peut désormais poursuivre sa transformation en entreprise à but lucratif sans cette menace juridique pesant sur ses plans de financement. Une condamnation à 134 milliards aurait pu être dévastatrice pour l'organisation et son partenaire Microsoft, compromettant les levées de capitaux en cours. La rapidité du délibéré envoie aussi un message clair sur la fragilité du dossier de Musk. Le procès s'inscrit dans une guerre ouverte entre Musk et ses anciens associés. Cofondateur d'OpenAI en 2015, il avait quitté le conseil d'administration en 2018 avant d'accuser Altman d'avoir trahi la mission originelle à but non lucratif de l'organisation au profit d'intérêts commerciaux, tandis qu'il lançait en parallèle sa propre IA concurrente, xAI, avec le modèle Grok. Un appel reste possible, mais la sévérité du verdict renforce la position d'OpenAI alors que la société finalise sa conversion en entité commerciale.

UELa conversion d'OpenAI en entreprise commerciale, désormais débloquée juridiquement, pourrait modifier les conditions d'accès, de tarification et de partenariat pour les entreprises et développeurs européens utilisant ses services.

💬 Moins de deux heures de délibéré, c'est à peine le temps d'un déjeuner. Le jury n'a pas eu besoin de chercher longtemps, et même la juge voulait classer l'affaire avant ça. Musk a joué le tout pour le tout sur un dossier manifestement creux, et OpenAI peut maintenant boucler sa conversion commerciale sans cette épée de Damoclès au-dessus des négociations.

Musk contre Altman, semaine 3 : guerre de crédibilité, au jury de trancher
244MIT Technology Review 

Musk contre Altman, semaine 3 : guerre de crédibilité, au jury de trancher

La troisième et dernière semaine du procès opposant Elon Musk à Sam Altman et OpenAI s'est achevée par les plaidoiries finales des deux camps, devant un jury californien. L'avocat de Musk, Steven Molo, a soutenu qu'Altman et Greg Brockman, président d'OpenAI, ont trahi la promesse faite au milliardaire lorsqu'il a financé l'organisation : maintenir OpenAI comme une association à but non lucratif développant l'IA au bénéfice de l'humanité. Au lieu de cela, ils ont créé une filiale commerciale qui les a rendus extraordinairement riches. L'avocate d'OpenAI, Sarah Eddy, a répliqué qu'aucune telle promesse n'a jamais été formulée, que l'organisation reste une entité non lucrative malgré sa restructuration, et que Musk a attendu trop longtemps pour agir, révélant ainsi son véritable mobile : saboter un concurrent direct de sa propre entreprise d'IA, xAI, lancée en 2023. Musk réclame l'annulation de la conversion d'OpenAI en société à bénéfice public réalisée en 2025, l'éviction d'Altman et Brockman, ainsi que jusqu'à 134 milliards de dollars de dommages à verser à Microsoft et OpenAI. Le jury entame ses délibérations lundi et rendra un verdict consultatif dès la semaine prochaine, verdict qui ne lie pas le juge, seul décideur final. L'enjeu financier est colossal. Une décision favorable à Musk pourrait compromettre l'introduction en bourse d'OpenAI, dont la valorisation approche les 1 000 milliards de dollars. Pendant ce temps, xAI devrait entrer en bourse dans le cadre de SpaceX dès juin prochain, avec une valorisation cible de 1 750 milliards de dollars. Le procès met également sous pression la crédibilité d'Altman, déjà fragilisée par son licenciement temporaire en novembre 2023. Ses anciens collègues, dont Ilya Sutskever et Mira Murati ainsi que les ex-administrateurs Helen Toner et Tasha McCauley, ont témoigné qu'il leur avait menti. Le comité de surveillance de la Chambre des représentants américaine a ouvert la semaine dernière une enquête sur ses conflits d'intérêts potentiels, notamment son investissement d'un tiers dans Helion Energy, société de fusion nucléaire à qui il aurait tenté d'orienter des contrats d'approvisionnement en énergie pour OpenAI. Des procureurs généraux d'au moins six États ont également demandé à la SEC d'examiner ces liens. Le procès révèle une fracture idéologique et personnelle profonde entre deux hommes qui cofondèrent OpenAI en 2015 avec une vision commune. Altman a affirmé devant le jury qu'en 2017, lors de discussions sur une possible filiale commerciale, Musk avait suggéré que le contrôle d'OpenAI passe à ses enfants en cas de décès, témoignage présenté comme preuve d'une ambition de pouvoir personnel. L'audience a aussi vu apparaître une anecdote symbolique : OpenAI a sorti un trophée en forme de postérieur d'âne, remis à un employé après que Musk l'eut traité de "jackass" pour avoir freiné ses plans d'accélération vers l'AGI. Quelle que soit l'issue, le procès a exposé publiquement les tensions internes qui ont secoué le laboratoire le plus influent de l'IA mondiale, à un moment où la course à l'intelligence artificielle générale s'intensifie entre tous les acteurs du secteur.

UEUn verdict défavorable à OpenAI pourrait compromettre son introduction en bourse et perturber l'accès aux services OpenAI utilisés massivement par les entreprises et développeurs européens, sans impact réglementaire direct sur la France ou l'UE à ce stade.

💬 Ce procès va surtout révéler ce que tout le monde savait au fond : la mission "IA pour l'humanité" n'était pas la priorité numéro un des deux hommes. Les anciens collègues d'Altman ont témoigné sous serment qu'il leur avait menti, et ça, ça colle à la peau longtemps, verdict consultatif ou pas. Un an avant une IPO à mille milliards, c'est franchement le pire moment pour que ça sorte.

BusinessOpinion
1 source
Le prochain défi de Claude en entreprise : pas les modèles, mais le plan de contrôle des agents
245VentureBeat AI 

Le prochain défi de Claude en entreprise : pas les modèles, mais le plan de contrôle des agents

Selon de nouvelles données publiées par VentureBeat Pulse, la prochaine bataille stratégique dans l'IA d'entreprise ne portera pas sur la qualité des modèles, mais sur le contrôle de la couche d'orchestration des agents. Le tracker indépendant VB Pulse, qui mesure régulièrement les préférences de décideurs techniques qualifiés en entreprise, révèle que Microsoft Copilot Studio et Azure AI Studio dominent ce segment avec 38,6 % d'adoption principale en février 2026, en hausse depuis 35,7 % en janvier. L'API Assistants et Responses d'OpenAI occupe la deuxième place avec 25,7 %, contre 23,2 % un mois plus tôt. Anthropic, lui, fait sa première apparition dans ce tracker : passant de 0 % en janvier à 5,7 % en février pour l'usage de ses outils et workflows natifs, soit quatre répondants sur un panel de 70 décideurs. Sur la couche modèle, les données sont encore plus spectaculaires pour l'entreprise de Dario Amodei : Claude est passé de 23,9 % en janvier à 28,6 % en février, puis à 56,2 % en mars, bien que cette dernière mesure soit qualifiée de directionnelle en raison d'un échantillon réduit à 16 répondants. Ce glissement d'Anthropic depuis la couche modèle vers l'orchestration native représente un signal stratégique significatif, même si les chiffres absolus restent modestes. Les entreprises ne choisissent plus seulement un chatbot ou un moteur de génération de texte : elles décident où installer la machinerie opérationnelle de leur IA, quels outils les agents peuvent appeler, quelles données ils peuvent consulter, quels workflows ils peuvent déclencher, et comment prouver aux équipes de sécurité que ces agents n'ont rien fait d'interdit. Tom Findling, PDG de la startup de cybersécurité IA Conifers, résume l'enjeu : les entreprises déplacent leur focus de la qualité du modèle vers le plan de contrôle qui l'entoure, notamment en matière de gouvernance, d'auditabilité et d'orchestration dans des environnements clients complexes. L'enjeu est d'autant plus lourd que remplacer un modèle reste relativement simple en théorie, une entreprise peut router une tâche vers Claude, une autre vers GPT, une troisième vers Gemini. Remplacer un runtime d'agents, en revanche, implique de reconfigurer des pipelines entiers, des intégrations d'outils, des politiques d'accès aux données et des mécanismes d'audit. Celui qui contrôle cette couche crée une dépendance bien plus profonde que celle d'un modèle. Microsoft dispose d'un avantage de distribution considérable dans les entreprises, et OpenAI d'une base installée bien plus large en orchestration. Mais la montée en puissance de Claude sur la couche modèle commence visiblement à se propager vers l'orchestration, et c'est précisément là que se joueront les parts de marché les plus durables des prochaines années.

💬 Anthropic gagne la bataille des modèles, et c'est bien, mais la vraie guerre se joue ailleurs. Changer de LLM, c'est l'affaire d'une clé API, mais démonter un runtime d'agents complet avec ses pipelines, ses intégrations et ses politiques d'accès, c'est des mois de boulot. Microsoft tient l'orchestration à 38 % et Anthropic débarque tout juste à 5,7 %, autant dire que c'est encore loin.

BusinessOpinion
1 source
xAI lance Grok Build : L’agent de codage qui veut détrôner Claude Code
246Le Big Data 

xAI lance Grok Build : L’agent de codage qui veut détrôner Claude Code

xAI, la société d'intelligence artificielle fondée par Elon Musk, a lancé le 14 mai 2026 Grok Build, un agent de codage en version bêta. Accessible uniquement aux abonnés SuperGrok Heavy à 300 dollars par mois, l'outil se présente comme un agent de programmation avancé doublé d'une interface en ligne de commande. Cette phase initiale est revendiquée par xAI comme un laboratoire grandeur nature : les retours des premiers utilisateurs serviront à corriger les bugs, affiner les performances et enrichir les fonctionnalités au fil du temps. L'installation s'effectue directement depuis le site officiel de xAI, via connexion au compte utilisateur. Grok Build cible explicitement les développeurs professionnels confrontés à des tâches complexes. Son mode sans interface graphique permet de l'intégrer dans des scripts et des automatisations existantes, et son interface en ligne de commande prend en charge le protocole ACP pour faciliter la création de bots personnalisés et d'applications orchestrant plusieurs agents. Pour les projets ambitieux, un mode planification permet à l'agent de préparer une stratégie détaillée que le développeur peut approuver, modifier ou réécrire avant toute exécution. Chaque modification s'affiche ensuite sous forme de diff structuré. L'outil reconnaît automatiquement les conventions d'un dépôt existant, prend en charge les fichiers AGENTS.md, plugins, hooks, skills et serveurs MCP, et peut déléguer certaines tâches à des sous-agents spécialisés exécutés en parallèle pour accélérer le développement. Le lancement de Grok Build s'inscrit dans une course effrénée aux agents de codage autonomes, marché où Anthropic s'est imposé avec Claude Code et où GitHub Copilot, Cursor ou Devin occupent déjà des positions établies. xAI, qui a considérablement accéléré le développement de sa famille de modèles Grok depuis le rachat de Twitter, cherche à transformer son avantage en données et en visibilité publique en une présence concrète dans les outils du quotidien des développeurs. La barrière d'entrée actuelle, 300 dollars mensuels pour un accès bêta, limite volontairement la base d'utilisateurs initiale afin de contrôler la charge et la qualité des retours. Si xAI parvient à démontrer des performances compétitives sur des benchmarks de codage réels, une ouverture plus large à des tarifs inférieurs semble probable. L'enjeu dépasse le simple outil : c'est la capacité de la plateforme Grok à s'imposer comme infrastructure de développement logiciel qui est en jeu.

💬 300 dollars par mois pour une bêta, ça élimine d'emblée les 99% qui auraient pu tester et critiquer sérieusement. Ce qui me parle dans les specs : AGENTS.md natif, MCP, sous-agents parallèles, diffs structurés... c'est exactement le workflow de Claude Code, recopié proprement. Reste à voir si Grok derrière tient en prod sur des bases de code un peu sérieuses.

OutilsOutil
1 source
Le fil AI : tout converge vers Conductor
247Latent Space 

Le fil AI : tout converge vers Conductor

GitHub a annoncé le 13 mai 2026 une préversion technique de son application GitHub Copilot App, un environnement de bureau conçu pour gérer des flux de travail parallèles, le cycle de vie des dépôts et des pull requests, avec flexibilité sur le choix de modèle. Dans le même mouvement, OpenAI a étendu son agent Codex vers les usages mobiles : les utilisateurs peuvent désormais lancer des tâches depuis l'application ChatGPT sur mobile, examiner les sorties, approuver des commandes et piloter l'exécution à distance pendant que Codex continue de tourner sur un laptop, un Mac mini ou un serveur de développement. OpenAI a également rendu généralement disponible le Remote SSH pour les environnements distants gérés, et ajouté des hooks ainsi que des jetons d'accès programmatiques pour l'automatisation Business et Enterprise autour du pipeline Codex. VS Code, de son côté, a livré une nouvelle fenêtre Agents pour les flux multi-agents et multi-projets, avec support navigateur et mobile via vscode.dev/agents, ainsi que des améliorations d'efficacité comme la compression des sorties terminal. Ces annonces convergentes signalent un basculement de l'écosystème entier vers une interface dite "agent-first" : les outils ne sont plus centrés sur l'édition de fichiers, mais sur la supervision d'agents autonomes qui exécutent des tâches longues en parallèle. Pour les développeurs, cela signifie pouvoir déléguer des chantiers entiers à un agent depuis son téléphone, tout en gardant le contrôle à distance. Pour les entreprises, les nouveaux tokens d'accès programmatiques d'OpenAI ouvrent la voie à des pipelines de développement entièrement automatisés. Du côté de l'infrastructure d'agents, LangChain a frappé fort avec le lancement de SmithDB, une base de données conçue spécifiquement pour les traces d'agents, et de LangSmith Engine, qui consomme ces traces, regroupe les échecs, identifie les problèmes dans le code et propose des correctifs, transformant l'observabilité passive en boucle d'amélioration continue. Derrière cette effervescence se profile une dynamique que les observateurs comparent à l'évolution convergente en biologie : tout comme le "plan crab" a émergé indépendamment sept fois dans l'évolution, l'interface "agent-first" est en train de s'imposer simultanément chez GitHub, Microsoft, OpenAI et d'autres. Conductor, la startup qui a popularisé ce paradigme, voit ses idées reprises à grande échelle, ce qui soulève une question structurante pour les pionniers : comment monétiser une innovation de forme quand les géants de l'industrie l'adoptent en quelques mois ? Garry Tan, PDG de Y Combinator, s'est montré publiquement enthousiaste à propos de Conductor, signal que l'écosystème startup suit de près ces convergences. Les prochains mois diront si les premiers à avoir défriché ce terrain peuvent transformer leur avance conceptuelle en avantage durable, ou si la compétition sur la forme laisse place à une guerre sur l'exécution et la distribution.

UELes développeurs et entreprises européens peuvent adopter ces nouveaux outils d'orchestration d'agents, mais aucune réglementation ou institution française ou européenne n'est directement concernée.

💬 C'est le genre de semaine où tout s'aligne. GitHub, OpenAI, VS Code, en même temps, sur le même paradigme : superviser des agents depuis ton mobile pendant qu'ils bossent en arrière-plan, c'est plus une démo, c'est la nouvelle interface standard. Conductor a visé juste, mais se faire copier par Microsoft et OpenAI en six mois, ça n'a jamais vraiment été une stratégie de sortie.

OutilsOutil
1 source
GitHub Spec-Kit : développement piloté par les specs
248MarkTechPost 

GitHub Spec-Kit : développement piloté par les specs

GitHub a publié en open source Spec-Kit, une boîte à outils conçue pour introduire le développement piloté par spécifications (SDD, Spec-Driven Development) dans les workflows d'agents IA comme GitHub Copilot, Claude Code ou Gemini CLI. Le dépôt a rapidement dépassé 90 000 étoiles et 8 000 forks sur GitHub, ce qui en fait l'un des projets d'outillage développeur à la croissance la plus rapide de ces derniers mois. Spec-Kit se compose de deux éléments principaux : la CLI Specify, écrite en Python 3.11+, et un ensemble de templates et scripts qui structurent l'expérience SDD. Après installation via uv, la commande specify init initialise un projet et donne accès à une série de commandes slash : /speckit.specify pour capturer ce qu'on veut construire, /speckit.plan pour générer le plan d'implémentation technique, /speckit.tasks pour décomposer ce plan en tâches ordonnées par dépendances, /speckit.taskstoissues pour convertir ces tâches en issues GitHub, et /speckit.implement pour confier leur exécution à l'agent IA. Des commandes optionnelles comme /speckit.clarify et /speckit.analyze permettent d'identifier les zones sous-spécifiées avant de lancer la génération de code. Le problème que Spec-Kit tente de résoudre est fondamental dans l'usage actuel des agents de codage IA : les développeurs ont tendance à les utiliser comme des moteurs de recherche, en décrivant vaguement ce qu'ils veulent, ce qui produit du code qui compile mais rate l'intention réelle. GitHub appelle cela le "vibe-coding", une approche acceptable pour des prototypes rapides mais insuffisante pour des applications critiques ou des bases de code complexes. En imposant une spécification structurée comme source de vérité, un document qui décrit le quoi et le pourquoi sans imposer de choix technologique, Spec-Kit force l'agent à travailler à partir d'instructions non ambiguës plutôt que d'interpréter des descriptions floues. La spec reste un artefact vivant, mis à jour à mesure que les exigences évoluent, et non un document figé rédigé puis oublié en début de projet. Le SDD n'est pas une idée entièrement nouvelle : des approches "documentation-first" ou "requirements-driven" existent depuis des décennies dans le génie logiciel. Ce que Spec-Kit change, c'est l'intégration native de cette discipline dans les outils d'IA générative, à un moment où l'industrie cherche à aller au-delà de l'autocomplétion intelligente vers une véritable délégation de tâches complexes à des agents autonomes. L'enjeu est de taille : si les agents de codage doivent gérer des missions de plus en plus ambitieuses, la qualité des instructions qu'on leur donne devient un levier critique de fiabilité. En open-sourçant Spec-Kit sous ce nom et avec cette adoption initiale, GitHub positionne clairement cette méthodologie comme une norme émergente, potentiellement intégrée à terme dans l'écosystème Copilot.

💬 90 000 étoiles en quelques semaines, c'est pas rien. L'idée de forcer une spec structurée avant de lancer l'agent, ça fait vingt ans qu'on sait que c'est la bonne approche, mais là GitHub fait enfin le lien avec les outils génératifs d'une façon qui peut vraiment coller aux équipes qui vivent dans Copilot. Reste à voir si la discipline tient dans la durée ou si ça finit comme tous les "requirements-first" qui crèvent dès le sprint 2.

OutilsOutil
1 source
Musk vs. Altman, semaine 2 : OpenAI riposte et Shivon Zilis révèle une tentative de débauchage
249MIT Technology Review 

Musk vs. Altman, semaine 2 : OpenAI riposte et Shivon Zilis révèle une tentative de débauchage

La deuxième semaine du procès opposant Elon Musk à OpenAI a mis en lumière les contradictions profondes entre les deux camps. Greg Brockman, président et cofondateur d'OpenAI, est monté à la barre en costume bleu, calme mais tendu sous l'interrogatoire de l'avocat de Musk, Steven Molo. Il a contredit point par point la version de Musk, qui avait affirmé la semaine précédente avoir donné 38 millions de dollars à une organisation promise à rester à but non lucratif, avant de se faire flouer par une restructuration en faveur des actionnaires. Brockman a rappelé qu'en 2017, après qu'un modèle d'OpenAI eut battu les meilleurs joueurs mondiaux au jeu vidéo Dota 2, Musk lui-même avait écrit dans un email que c'était "le moment de passer à l'étape suivante" et de créer une entité commerciale. Lors des semaines suivantes, Musk aurait réclamé une participation majoritaire au capital, le droit de nommer la majorité du conseil d'administration, et le poste de PDG. Shivon Zilis, ancienne membre du conseil d'OpenAI et mère de quatre enfants de Musk, a également témoigné : selon elle, Musk avait tenté de recruter Sam Altman pour diriger un nouveau laboratoire d'IA chez Tesla. Les enjeux financiers et juridiques du procès sont considérables. Musk réclame jusqu'à 134 milliards de dollars de dommages et intérêts à OpenAI et à Microsoft, principal investisseur de la société, et demande au tribunal d'écarter Altman et Brockman de leurs fonctions ainsi d'annuler la récente transformation de la filiale commerciale en "public benefit corporation". Une victoire de Musk pourrait faire dérailler l'introduction en bourse d'OpenAI, dont la valorisation approche 1 000 milliards de dollars. Deux jours avant l'ouverture du procès, Musk avait envoyé un message à Brockman pour évoquer un accord amiable ; quand Brockman proposa que chaque partie abandonne ses poursuites, Musk répondit : "D'ici la fin de la semaine, toi et Sam serez les hommes les plus haïs d'Amérique." Le procès s'inscrit dans une rivalité commerciale directe entre les deux hommes. Musk a quitté le conseil d'OpenAI en 2018, avant de fonder xAI en 2023, désormais intégré à SpaceX, avec une valorisation cible de 1 750 milliards de dollars en vue d'une entrée en bourse dès juin prochain. OpenAI soutient que la plainte n'est pas motivée par la défense d'une mission humaniste, mais par la volonté de nuire à un concurrent direct. Cette lecture est renforcée par les révélations sur la tentative de débauchage d'Altman vers Tesla. Le jury devra trancher entre deux récits incompatibles de la genèse d'une des entreprises les plus influentes du monde, alors que la course à l'intelligence artificielle générale s'accélère et que ses implications économiques, éthiques et géopolitiques n'ont jamais été aussi lourdes.

UESi le procès aboutit à une injonction bloquant l'introduction en bourse d'OpenAI ou à l'éviction de sa direction, les entreprises européennes dépendantes des APIs OpenAI pourraient subir une instabilité majeure de leur fournisseur d'IA générative le plus utilisé.

💬 Le témoignage de Shivon Zilis change tout : si Musk voulait recruter Altman pour Tesla, c'est qu'il voyait dans OpenAI une ressource à capturer, pas une cause à défendre. Le reste, les 134 milliards, les discours sur la mission humaniste, c'est du bruit. Le portrait qui se dessine, c'est celui d'un fondateur éjecté qui préfère brûler la maison plutôt que voir quelqu'un d'autre y habiter.

BusinessActu
1 source
GitHub sécurise les workflows à base d'agents dans les systèmes CI/CD modernes
250InfoQ AI 

GitHub sécurise les workflows à base d'agents dans les systèmes CI/CD modernes

GitHub a publié une architecture de sécurité dite "défense en profondeur" pour les flux de travail agentiques dans les pipelines CI/CD. Conçue par l'ingénieure Leela Kumili, cette approche repose sur trois piliers : l'isolation des environnements d'exécution, la restriction stricte des permissions accordées aux agents, et la traçabilité complète de chaque action effectuée. L'objectif est de permettre l'intégration d'agents IA autonomes dans les chaînes de développement logiciel sans exposer les systèmes à des risques nouveaux. L'enjeu est de taille : les agents IA opérant dans un pipeline CI/CD disposent d'un accès direct au code source, aux secrets d'infrastructure et aux systèmes de déploiement. Sans garde-fous adéquats, ils deviennent une surface d'attaque privilégiée. Les menaces identifiées par GitHub comprennent l'injection de prompts malveillants, l'escalade de privilèges non autorisée et l'exécution d'actions non intentionnelles. Pour y répondre, l'architecture préconise des environnements sandbox cloisonnés, des permissions minimales définies à la tâche, et un journal d'audit exhaustif permettant de retracer précisément ce qu'un agent a fait et pourquoi. Cette publication intervient alors que l'industrie du développement logiciel s'apprête à intégrer massivement des agents autonomes dans ses workflows, portés notamment par GitHub Copilot et ses concurrents comme Cursor ou Devin. Les équipes de sécurité peinent encore à établir des standards pour ces nouveaux acteurs capables d'écrire, tester et déployer du code sans intervention humaine. La démarche de GitHub, qui documente publiquement ses principes de conception, pourrait servir de référence pour l'ensemble de l'écosystème DevSecOps.

UELes équipes DevSecOps françaises et européennes peuvent s'appuyer sur ce cadre de référence pour sécuriser leurs pipelines CI/CD lors de l'intégration d'agents autonomes.

💬 Donner à un agent IA un accès direct à tes secrets d'infra et à ta pipeline de déploiement, c'est exactement aussi risqué que ça en a l'air. L'architecture proposée par GitHub est solide sur le papier : isolation des environnements, permissions minimales par tâche, audit complet de chaque action, c'est ce qu'on attendait avant de lâcher des agents autonomes dans nos repos. Reste à voir combien d'équipes vont vraiment l'implémenter plutôt que de cocher la case "sécurité" et continuer à déployer à l'arrache.

SécuritéActu
1 source