Aller au contenu principal
Anthropic veut contrôler mémoire, évaluations et orchestration des agents, de quoi inquiéter les entreprises
BusinessVentureBeat AI · 2 min de lecture

Anthropic veut contrôler mémoire, évaluations et orchestration des agents, de quoi inquiéter les entreprises

Source originale ↗·

Quelques semaines seulement après le lancement de Claude Managed Agents, Anthropic a enrichi sa plateforme de trois nouvelles fonctionnalités majeures : « Dreaming », « Outcomes » et « Multi-Agent Orchestration ». Dreaming permet aux agents de réviser leurs sessions passées pour construire une mémoire évolutive et détecter des patterns jusque-là invisibles. Outcomes offre aux équipes la possibilité de définir des critères de succès précis pour mesurer la performance de leurs agents. Quant à Multi-Agent Orchestration, elle permet à un agent principal de décomposer des tâches complexes et de les déléguer à des agents spécialisés. L'objectif affiché d'Anthropic est de réduire au minimum l'intervention humaine dans la gestion des agents, en intégrant mémoire, évaluation et orchestration au sein d'une seule et même infrastructure hébergée.

Ce repositionnement place Anthropic en concurrence directe avec un écosystème entier d'outils spécialisés que les entreprises utilisent aujourd'hui séparément : LangGraph et CrewAI pour l'orchestration, Pinecone pour la mémoire vectorielle à long terme, DeepEval pour l'évaluation externe, et des équipes humaines entières pour le contrôle qualité. En consolidant toutes ces couches dans un runtime unifié, Anthropic promet une traçabilité complète et un déploiement simplifié. Mais cette intégration verticale soulève des questions sérieuses pour les entreprises. La plateforme tourne sur une infrastructure qu'elles ne contrôlent pas, ce qui peut créer des problèmes de conformité sur la résidence des données, un point critique dans des secteurs régulés comme la finance ou la santé. Par ailleurs, les organisations déjà engagées dans de vastes chantiers de transformation IA ne peuvent pas forcément remplacer leurs systèmes existants du jour au lendemain sans casser leurs workflows.

La vraie tension est celle du lock-in. En concentrant mémoire, orchestration et évaluation dans une même couche, Anthropic capte l'essentiel de l'architecture décisionnelle des agents, et les entreprises qui adoptent pleinement la plateforme se retrouvent structurellement dépendantes d'un seul fournisseur. Cette dynamique n'est pas propre à Anthropic : OpenAI et Microsoft poussent également vers des architectures intégrées, au motif que rapprocher orchestration et modèle améliore le contrôle et la cohérence. Mais le mouvement accélère une recomposition du marché où les couches intermédiaires, mémoire, routing, évaluation, risquent d'être absorbées par les grands modèles eux-mêmes. Les entreprises qui ont investi dans des stacks modulaires et flexibles devront arbitrer entre la commodité d'une plateforme tout-en-un et leur capacité à rester agiles face à un marché encore en pleine définition.

Impact France/UE

Les entreprises européennes des secteurs régulés (finance, santé) devront évaluer la conformité de l'infrastructure hébergée d'Anthropic avec les exigences de résidence des données imposées par le RGPD.

💬 L'analyse de Mathieu

Anthropic ne vend plus un modèle, il vend une plateforme, et la différence va se payer cash d'ici 18 mois. Mémoire, orchestration, évaluation dans un seul runtime hébergé, c'est séduisant pour les équipes qui gèrent 4 outils différents, mais ça fait une dépendance énorme sur l'architecture décisionnelle complète. Pour les boîtes françaises en finance ou santé, la question de la résidence des données n'est pas rhétorique.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

L'orchestration à base d'agents : les entreprises ont un problème de déploiement, pas de plateforme, et confondent souvent chatbots et agents
1VentureBeat AI 

L'orchestration à base d'agents : les entreprises ont un problème de déploiement, pas de plateforme, et confondent souvent chatbots et agents

Une enquête VentureBeat Pulse Research menée en juin 2026 auprès de 101 entreprises de plus de 100 employés révèle une consolidation rapide de l'orchestration d'agents IA autour des grandes plateformes de modèles. Claude d'Anthropic domine largement le marché avec 40% des entreprises l'utilisant comme plateforme principale, plus de deux fois devant Microsoft (18%) et OpenAI (13%). Ce choix s'explique par ce que l'étude appelle la "gravité du modèle", c'est-à-dire l'alignement natif avec un modèle de pointe, cité par 21% des répondants. Le succès de ces déploiements est jugé sur l'exécution fiable de tâches multi-étapes: 32% des entreprises mesurent la fiabilité de complétion des tâches et 28% la gestion de workflows à plusieurs étapes. Pourtant, lorsqu'on leur demande d'évaluer honnêtement leur portefeuille, 71% des entreprises admettent qu'un quart ou moins de leurs "agents" déployés constituent réellement des workflows orchestrés multi-étapes, le reste n'étant que des chatbots à prompt unique déguisés en agents. Seules 10% des organisations ont dépassé la barre des 50% d'agents véritablement orchestrés. Cet écart entre l'ambition affichée et la réalité du terrain a des conséquences concrètes sur l'architecture que les entreprises mettent en place. D'ici fin 2026, 51% des organisations prévoient d'adopter un modèle hybride combinant orchestration native du fournisseur et outils externes, tandis que seulement 6% envisagent de confier entièrement le contrôle à un service géré par le fournisseur. La raison principale de cette prudence est la peur du verrouillage propriétaire (vendor lock-in), citée par 35% des répondants comme le risque le plus redouté. Les investissements suivent cette logique: les outils de workflow pour agents captent la plus grande part des dépenses (34%), suivis par la sécurité et l'application des permissions (25%). Autre signal préoccupant, plus d'un quart des entreprises (27%) ne disposent d'aucun moyen en temps réel d'arrêter un agent devenu incontrôlable avant que la facture n'arrive, révélant un angle mort important sur le contrôle des coûts. L'échantillon de l'enquête est réparti de façon équilibrée entre grandes tranches d'entreprises, avec des répondants majoritairement seniors et décisionnaires: chefs de produit et de programme (15%), CIO/CTO/CISO (13%), consultants (13%), et 81% impliqués dans les décisions d'achat de solutions IA. Le secteur technologique domine l'échantillon (44%), suivi des services financiers (17%) et de la santé (8%). Bien que basée sur un échantillon auto-sélectionné et non probabiliste, l'enquête offre une lecture directionnelle solide d'un secteur qui construit ses couches d'orchestration bien avant d'avoir rempli ses portefeuilles d'agents réellement autonomes.

BusinessOutil
1 source
L'orchestration à base d'agents : les entreprises ont un problème de déploiement, pas de plateforme, et confondent souvent chatbots et agents
2VentureBeat AI 

L'orchestration à base d'agents : les entreprises ont un problème de déploiement, pas de plateforme, et confondent souvent chatbots et agents

Traduction en cours. Anthropic conforte sa position de plateforme de référence pour l'orchestration d'agents en entreprise, selon une enquête VentureBeat Pulse Research menée en juin 2026 auprès de 101 organisations de plus de 100 salariés. Claude est déjà la plateforme principale pour 40% des entreprises interrogées, soit plus du double de son plus proche concurrent Microsoft (18%), OpenAI arrivant troisième avec 13%. Ce choix s'explique surtout par ce que l'étude appelle la "gravité du modèle", c'est-à-dire l'alignement natif avec un modèle de pointe (21% des répondants), la réussite d'un déploiement étant jugée sur la fiabilité d'exécution multi-étapes: 32% citent la fiabilité de complétion des tâches et 28% la gestion de workflows en plusieurs étapes comme critères clés. Mais l'écart est frappant: interrogées honnêtement sur leur portefeuille d'agents, 71% des entreprises admettent qu'un quart ou moins de leurs "agents" déployés sont de véritables workflows orchestrés en plusieurs étapes, le reste n'étant que des chatbots enrobés d'un seul prompt. Seules 10% dépassent la barre des 50% d'agents réellement orchestrés. Cet écart entre l'ambition et la réalité pèse directement sur les décisions d'architecture des entreprises. D'ici fin 2026, 51% des organisations prévoient d'adopter un plan de contrôle hybride, combinant outils natifs du fournisseur et orchestration externe, tandis que seulement 6% envisagent de confier entièrement ce contrôle à un service géré par le fournisseur du modèle. La raison principale de cette prudence est la peur du verrouillage propriétaire, citée par 35% des répondants comme le risque numéro un. Les budgets suivent cette logique de construction: les outils de workflow agentique captent la plus grosse part des investissements (34%), suivis par la sécurité et la gestion des permissions (25%). Autre signal inquiétant, le contrôle financier reste largement absent: plus d'un quart des entreprises (27%) n'ont aucun moyen en temps réel d'arrêter un agent qui s'emballerait avant que la facture n'arrive, ce qui expose les organisations à des dérapages de coûts liés à la consommation de tokens. Cette enquête s'inscrit dans la série Pulse Research de VentureBeat et repose sur une vague unique collectée en juin 2026, ce qui limite l'analyse à une lecture transversale plutôt qu'à une tendance dans le temps. L'échantillon est réparti équitablement entre grandes tranches d'effectifs, avec une forte représentation de décideurs seniors: 81% des répondants sont recommandeurs, influenceurs ou décideurs finaux sur les solutions d'IA, et le secteur technologique domine avec 44% des répondants, devant les services financiers (17%) et la santé (8%). Ces résultats confirment une dynamique de fond dans l'industrie: la consolidation rapide autour des grandes plateformes de modèles s'accompagne d'une méfiance persistante envers la dépendance à un seul fournisseur, poussant les entreprises à bâtir des architectures hybrides tout en peinant encore à combler le fossé entre le marketing de l'"agent" et la réalité opérationnelle de systèmes multi-étapes réellement autonomes et maîtrisés financièrement.

💬 Selon Le Fil IA, la vraie fracture de l'IA agentique en entreprise n'est pas technique, elle est comptable : 71% des boîtes appellent "agent" un chatbot avec un joli prompt, et 27% n'ont même pas de bouton pour arrêter la facture si ça déraille. Anthropic gagne la bataille de la plateforme (40%, loin devant Microsoft et OpenAI), mais gagner la course au modèle et savoir orchestrer un vrai workflow multi-étapes, ce sont deux histoires différentes. La méfiance envers le verrouillage propriétaire pousse tout le monde vers l'hybride, ce qui en dit long : les entreprises font confiance au modèle, pas encore au fournisseur.

BusinessActu
1 source
L'écart d'évaluation des agents : les organisations d'IA en entreprise ont un problème d'alignement avec la réalité, pas de couverture, et déploient quand même en production
3VentureBeat AI 

L'écart d'évaluation des agents : les organisations d'IA en entreprise ont un problème d'alignement avec la réalité, pas de couverture, et déploient quand même en production

Cent cinquante-sept entreprises ont participé à cette enquête menée par VentureBeat en juin 2026 dans le cadre de sa série Pulse Research, consacrée à la manière dont les organisations évaluent la fiabilité de leurs agents IA. Le constat central est frappant: la moitié des entreprises interrogées ont déployé, au cours de l'année écoulée, un agent ou une fonctionnalité basée sur un LLM qui avait pourtant réussi ses tests internes avant de provoquer un incident visible par les clients, et un quart d'entre elles ont connu ce type de défaillance plus d'une fois. Seules 5% des organisations disent faire pleinement confiance à leurs méthodes d'évaluation automatisée, la faiblesse la plus souvent citée (29%) étant le décalage entre les résultats des tests et les performances réelles en production. Malgré cela, 66% des entreprises autorisent déjà un déploiement entièrement automatisé, sans supervision humaine, pour les agents jugés à faible risque (34%), ou construisent activement leurs systèmes pour y parvenir dans les douze prochains mois (33%). L'échantillon, composé à 38% de décideurs finaux et 34% de personnes influentes dans les achats technologiques, provient majoritairement d'entreprises de taille moyenne, entre 100 et 2500 salariés, avec le secteur technologique en tête (23%), suivi du commerce de détail (15%) et de la santé (12%). Ce décalage entre l'autonomie accordée aux agents et la confiance réelle dans les outils censés la contrôler pose un problème concret pour les entreprises qui accélèrent l'adoption de l'IA agentique. Si un agent passe ses tests puis échoue devant un client, c'est la réputation de l'entreprise, sa relation commerciale et potentiellement sa conformité réglementaire qui sont en jeu. Le fait que les organisations avancent malgré tout vers plus d'automatisation, avec moins de supervision humaine, signifie qu'elles acceptent un risque opérationnel croissant sans disposer des garde-fous adéquats. Pour les équipes techniques, cela traduit une pression du marché à déployer vite, quitte à improviser la gouvernance des risques après coup plutôt qu'avant. Ce phénomène s'explique en partie par l'immaturité des outils d'évaluation disponibles: l'étude montre que les outils natifs fournis par les fournisseurs de modèles arrivent à égalité avec l'absence totale d'outillage dédié comme solution la plus répandue (17% chacun), et seulement un quart des entreprises effectuent des contrôles qualité en temps réel sur leur trafic de production réel. L'écosystème des plateformes de fiabilité et d'évaluation des agents reste donc fragmenté, ce qui alimente un cercle vicieux: plus les entreprises automatisent leurs déploiements, plus elles auraient besoin d'évaluations robustes, alors que ces dernières peinent justement à suivre le rythme de l'adoption. Les auteurs de l'étude soulignent que l'échantillon, bien que suffisamment large pour dégager des tendances, reste auto-sélectionné et penché vers le marché intermédiaire, ce qui invite à lire ces résultats comme un signal directionnel plutôt qu'une mesure précise de l'ensemble du marché.

BusinessActu
1 source
Les entreprises élargissent leur adoption de l'IA tout en maintenant le contrôle
4AI News 

Les entreprises élargissent leur adoption de l'IA tout en maintenant le contrôle

La majorité des entreprises déploient aujourd'hui l'intelligence artificielle de manière progressive et encadrée, loin des systèmes autonomes qui font régulièrement la une. Selon une étude de McKinsey & Company, la plupart des organisations utilisent désormais l'IA dans au moins un domaine de leur activité, mais rares sont celles qui l'ont déployée à l'échelle de l'ensemble de l'entreprise. Un exemple concret illustre cette tendance : S&P Global Market Intelligence a intégré des outils d'IA dans sa plateforme Capital IQ Pro, utilisée par des analystes financiers pour examiner des dépôts réglementaires, des transcriptions d'appels de résultats et des données de marché. Le système permet d'interroger de vastes ensembles de données via une interface conversationnelle, mais les résultats restent systématiquement ancrés dans des sources financières vérifiées, avec la possibilité de remonter aux documents d'origine pour limiter les erreurs. Ce choix d'une IA d'assistance plutôt qu'autonome n'est pas anodin dans des secteurs où une erreur peut entraîner des pertes financières importantes ou engager des responsabilités légales. En finance, les outils comme Capital IQ Pro sont conçus pour éclairer le jugement des analystes, pas pour le remplacer. La décision finale reste humaine. McKinsey souligne par ailleurs un écart croissant entre le déploiement de l'IA et la génération de valeur mesurable : de nombreuses organisations peinent à traduire leurs investissements en résultats concrets. Ce fossé pousse les directions à exiger des systèmes capables d'expliquer leurs sorties, de citer leurs sources et d'opérer dans des périmètres définis, trois conditions essentielles pour établir la confiance dans des environnements réglementés. Derrière cette prudence se dessine un enjeu de gouvernance qui mobilise de plus en plus d'acteurs. S&P Global Market Intelligence note que les organisations bâtissent activement des cadres pour gérer les risques liés à l'IA, notamment la qualité des données et les biais des modèles. Les systèmes agents, capables de planifier et d'agir sans intervention humaine directe, suscitent un intérêt grandissant, mais la majorité des entreprises en est encore aux premières étapes d'expérimentation. Les progrès continus sur les grands modèles de langage laissent entrevoir des usages plus autonomes à terme, en analyse financière, support client ou gestion de chaîne logistique. Ces questions seront au coeur de l'AI & Big Data Expo North America 2026, qui se tiendra les 18 et 19 mai prochains, avec S&P Global Market Intelligence parmi les sponsors, et des sessions dédiées à la gouvernance de l'IA et à son usage dans les industries régulées.

UELes entreprises européennes opérant dans des secteurs réglementés (finance, santé) sont directement concernées par les cadres de gouvernance IA décrits, notamment dans le contexte de la mise en conformité avec l'AI Act.

BusinessOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic