OutilsVentureBeat AI6sem· 2 min de lecture

Les agents IA en entreprise échouent souvent parce qu'ils ne retiennent pas ce qu'ils ont appris

Les agents d'intelligence artificielle déployés en entreprise échouent régulièrement dès qu'ils doivent enchaîner des décisions complexes, et la cause est souvent la même : ils oublient ce qu'ils ont appris. C'est le problème que cherche à résoudre Rippletide, une startup gravitant dans l'écosystème Neo4j, avec une architecture appelée "decision context graph". Fondée par Yann Bilien, co-fondateur et directeur scientifique, la société a conçu un système qui dote les agents d'une mémoire structurée, d'un raisonnement ancré dans le temps et d'une logique de décision explicite. L'objectif central : des agents dits "non-régressifs", capables de figer des séquences d'actions validées et de capitaliser dessus au fil du temps.

Le problème que Rippletide adresse touche au cœur de la majorité des déploiements d'IA en entreprise. Les architectures RAG (Retrieval-Augmented Generation), qui constituent aujourd'hui le standard, se contentent de récupérer des documents sémantiquement pertinents depuis des sources variées, ERP, bases de données, politiques internes, et de les injecter dans le contexte du modèle. Mais comme le souligne Wyatt Mayham, consultant chez Northwest AI Consulting, cette approche "fonctionne pour les chatbots, mais se brise immédiatement dès qu'un agent doit prendre des décisions et agir". Un document récupéré ne dit pas à l'agent s'il est encore valide, s'il a été remplacé, ou si une règle contradictoire a la priorité. Résultat : des agents qui combinent des règles incompatibles, inventent des contraintes pour combler les vides, et produisent des erreurs difficiles à tracer et à reproduire. À l'échelle d'un workflow multi-étapes, même un faible taux d'erreur par étape devient catastrophique, raison principale pour laquelle la plupart des agents d'entreprise ne sortent jamais de la phase pilote.

Le "decision context graph" répond à ce problème en encodant explicitement une carte structurée : quelles règles s'appliquent, dans quel contexte, et à quel moment. Le temps y est traité comme une dimension de premier ordre, chaque règle, décision et exception est délimitée temporellement, permettant à l'agent de distinguer "ce qui était vrai à ce moment-là" de "ce qui est vrai maintenant". Le système repose sur trois piliers : l'applicabilité (le bon contexte est retourné uniquement quand il est pertinent), la mémoire temporelle, et les chemins de décision explicites, l'agent peut expliquer pourquoi il a inclus tel contexte et non un autre. Lors de l'initialisation, les données non structurées sont ingérées puis organisées en ontologie. Ce marché de l'infrastructure agentique en entreprise attire une attention croissante alors que les limitations du RAG seul deviennent un frein réel au passage à l'échelle des systèmes d'IA autonomes.

Dans nos dossiers

Agents IA

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1VentureBeat AI

L'IA s'apprête à remplacer les interfaces, et les dirigeants d'entreprise ne sont pas prêts

Les agents d'intelligence artificielle sont en train de rendre obsolète la forme même du logiciel d'entreprise. Là où un salarié devait autrefois jongler entre un CRM, un outil de prévision, un tableau de bord support et plusieurs fils de discussion pour comprendre la situation d'un compte client, il lui suffira bientôt de poser une question à un agent unique : "Qu'est-ce qui nécessite mon attention aujourd'hui ?" L'agent identifie les comptes à risque, explique pourquoi, résume les interactions récentes, rédige des actions de suivi et déclenche les workflows suivants. Ce n'est plus une interface que l'on pilote, c'est un système qui comprend l'intention et agit en conséquence. L'enjeu dépasse largement l'expérience utilisateur. Pour qu'un agent réponde correctement à "Pourquoi le churn augmente-t-il dans notre segment entreprise ?", il ne suffit pas qu'il sache où se trouvent les données clients. Il doit comprendre comment l'entreprise définit le churn, quels comptes entrent dans la catégorie "entreprise", si les données d'utilisation produit sont plus fiables que les enquêtes, ce que les tickets support indiquent, et si la réponse varie selon la géographie. Cela signifie que les définitions, les règles métier et les hypothèses implicites qui donnent du sens aux données doivent être formalisées, documentées et cohérentes à l'échelle de l'organisation. La couche sémantique, longtemps considérée comme un problème technique réservé aux équipes data, devient une question stratégique de direction générale. Les entreprises qui laisseront chaque département former son propre agent avec sa propre version de la réalité obtiendront de l'inexactitude à grande échelle. Les dashboards ne disparaissent pas parce que les graphiques deviennent inutiles, mais parce que le reporting statique devient trop lent pour les besoins opérationnels réels. Cette transition soulève aussi un nouveau problème de gouvernance. Tant que l'IA se contentait de répondre à des questions, contrôler ses accès était déjà difficile mais gérable. Dès que les agents commencent à agir, émettre un remboursement, réapprovisionner des stocks ou envoyer un e-mail à un client, les conséquences d'une erreur changent de nature. Les entreprises qui ont investi dans des fondations solides, des définitions partagées, des accès gouvernés, une traçabilité claire et des workflows documentés seront celles capables de déployer ces agents avec confiance. Les autres risquent d'automatiser leurs propres incohérences. La course à l'IA agentique est donc aussi, fondamentalement, une course à la maturité organisationnelle.

OutilsOutil

1 source

2VentureBeat AI

Les agents IA apprennent en cours de tâche, mais pas pour toute l'équipe

Les agents d'intelligence artificielle peinent à devenir de véritables outils d'équipe. Selon une étude interne d'Asana, 75 % des travailleurs du savoir utilisent déjà l'IA au quotidien, mais seulement 5 % des entreprises déclarent en avoir tiré des gains de productivité mesurables. La raison principale : lorsqu'un collaborateur corrige ou améliore un agent, en affinant ses instructions, en lui fournissant un contexte plus précis, cette amélioration s'évapore dès qu'un collègue ouvre le même outil. Chaque utilisateur repart de zéro, entraînant en pratique une version différente du même agent selon la personne qui l'interroge. Arnab Bose, directeur produit d'Asana, résume le problème : les fournisseurs de modèles progressent rapidement sur le raisonnement et les boucles de correction, mais échouent à intégrer le contexte de travail d'entreprise d'une manière intelligible et partageable entre humains. Ce défaut architectural a des conséquences concrètes dans les workflows multi-agents, devenus la norme dans les grandes organisations : des agents qui se contredisent, des tâches répétées inutilement, des versions incohérentes de la réalité selon les équipes. Sriharsha Chintalapani, cofondateur et directeur technique de Collate, souligne que les agents sont extrêmement sensibles à la qualité des instructions reçues : un utilisateur expérimenté obtient de meilleurs résultats parce qu'il formule des prompts plus précis et donne de meilleurs retours correctifs, que l'agent mémorise et applique aux interactions suivantes. Ce mécanisme fonctionne bien pour un usage individuel, mais devient un avantage inégalement distribué dès qu'il s'agit d'un usage collectif. Neej Gore, directeur des données de Zeta Global, défend l'idée d'une mémoire partagée qui agirait comme une intelligence composée, s'enrichissant à chaque interaction et bénéficiant à toute l'organisation. La réponse d'Asana consiste à placer la mémoire partagée au coeur de sa plateforme Agentic Work Management : toute correction apportée par un membre de l'équipe s'applique automatiquement à l'ensemble des utilisateurs, via un graphe de contexte injecté directement dans les agents opérant dans son système. Plus besoin que chaque collaborateur maîtrise l'ingénierie des prompts. Mais la question de qui contrôle cette mémoire, ce qui y est stocké et comment elle reste cohérente quand plusieurs agents et utilisateurs y écrivent simultanément reste largement sans réponse dans l'industrie. Chintalapani avance que la piste la plus prometteuse consiste à construire des agents capables de récupérer la mémoire de manière relationnelle, en fonction du contexte précis de chaque requête, une approche que seules quelques organisations disposant de ressources importantes sont aujourd'hui en mesure de mettre en oeuvre.

UELes entreprises européennes déployant des agents IA en équipe font face au même problème architectural de mémoire non partagée, mais aucune réponse réglementaire ou solution propre au marché France/UE n'est évoquée.

OutilsOutil

1 source

3VentureBeat AI

Les agents IA entrent dans une phase de refonte face aux problèmes de fiabilité en entreprise

Les agents d'intelligence artificielle d'entreprise entrent dans une phase de refonte profonde. Après une première vague de déploiements rapides, de nombreuses organisations découvrent que la performance des modèles de langage ne suffit pas à garantir la fiabilité en production. Selon Preeti Somal, vice-présidente senior de l'ingénierie chez Temporal Technologies, intervenante lors d'un récent événement AI Impact Series à New York, de nombreuses équipes reviennent aujourd'hui construire une "version 2.0" de leurs agents. "Ils ont dû aller très vite, mais ils n'ont pas pris soin de la plomberie", a-t-elle déclaré. "Les systèmes s'effondrent, et ils se retrouvent à reconstruire avec une fondation fiable." Les difficultés concrètes sont multiples : gestion de l'état d'exécution, récupération après pannes, coordination entre APIs et systèmes d'entreprise, visibilité sur les processus, et maîtrise des coûts d'inférence. Un agent peut enchaîner plusieurs modèles de langage, des systèmes de récupération d'information et des applications externes, en maintenant un état sur plusieurs heures ou jours. L'enjeu est considérable pour les entreprises qui opèrent sous contraintes budgétaires. Redémarrer un processus après une panne peut multiplier les coûts d'inférence, augmenter la latence et dégrader l'expérience client. La distinction entre deux notions souvent confondues devient cruciale : l'état d'exécution, qui indique où en est l'agent dans un processus et à quel point reprendre après une défaillance, et la mémoire contextuelle, qui regroupe les informations transportées d'une interaction à l'autre. Somal cite l'exemple du client Abridge dans le secteur de la santé, où des processus traitent des visites médicales en plusieurs étapes : traitement audio, résumé, appels de modèles et génération de comptes-rendus post-consultation. Ces enchaînements longs et multi-étapes exigent une fiabilité structurelle que les premières architectures n'avaient pas anticipée. Temporal Technologies, dont l'infrastructure d'orchestration est antérieure à la vague actuelle de l'IA agentique, voit dans cette situation un écho direct à une période précédente de l'adoption du cloud en entreprise. Somal compare cette ruée vers l'IA à la stratégie "lift-and-shift" des débuts du cloud : migrer des charges de travail sans repenser les architectures sous-jacentes, pour finalement dépenser davantage sans en tirer la valeur attendue. "Cette précipitation vers l'IA dans un monde où vous n'avez même pas modernisé vos applications me rappelle un peu ce lift-and-shift qui s'est produit dans le cloud", a-t-elle dit. Les problèmes d'ingénierie fondamentaux comme la durabilité d'exécution et la récupération après défaillance n'émergent souvent qu'après le déploiement. L'IA agentique n'invente pas ces problèmes : elle les amplifie, et les entreprises qui n'ont pas modernisé leur socle applicatif risquent de reproduire les mêmes erreurs coûteuses qu'une décennie auparavant.

OutilsOpinion

1 source

4VentureBeat AI

Les agents IA ne sont pas freinés par les modèles, mais par les permissions

Les agents d'intelligence artificielle déployés en entreprise se heurtent moins à des limites de performance qu'à un problème de gouvernance : qui a le droit de faire quoi, au nom de qui, et comment le système peut-il en être certain ? C'est autour de cette question que Workday a construit Sana, son système de référence pour les agents IA, lancé en mars dernier. Gerrit Kazmaier, président produit et technologie de Workday, l'a confirmé dans un entretien à VentureBeat : les entreprises qui tentent de construire leurs propres solutions en accédant directement aux données brutes perdent la richesse du modèle de sécurité existant, et obtiennent des résultats trop larges, mal ciblés. En parallèle, Workday a élargi son partenariat avec Google pour intégrer Sana à Gemini Enterprise, rendant ainsi les agents construits sur cette infrastructure découvrables depuis l'écosystème Google. L'enjeu est particulièrement critique dans les domaines des ressources humaines et de la finance, où "presque juste n'est pas acceptable", selon Kazmaier. Un bulletin de salaire mal calculé, un entretien mal planifié ou une clôture comptable erronée ont des conséquences immédiates et souvent irréversibles, contrairement à la plupart des sorties d'IA générative, ces erreurs n'ont pas de boucle de correction. Workday a répondu à ce défi en construisant Gemini comme couche de raisonnement de base, puis en superposant son moteur de contexte métier et sa logique de processus. Des modèles de vérification et de classification "interrogent" les résultats avant toute exécution. Concrètement, l'agent Sana Self-Service utilise Gemini comme interface conversationnelle pour déclencher un flux de travail, mais l'utilisateur est ensuite authentifié et autorisé via le modèle d'identité Workday. L'agent n'agit qu'au nom de cet utilisateur précis, dans le périmètre exact de ses droits actuels. Le positionnement de Workday sur ce marché repose sur une réalité déjà bien établie : des fournisseurs d'identité majeurs comme Okta vérifient déjà leurs données en interrogeant Workday, qui fait de facto office de système de référence organisationnelle pour de nombreuses grandes entreprises. Cette position centrale lui permet d'inférer les hiérarchies et structures de ses clients directement à partir des données qu'ils lui confient. Des praticiens du secteur confirment que cette architecture n'est pas un choix technique parmi d'autres. Dan Obendorfer, directeur produit chez Würk, est catégorique : "Si vos permissions sont définies ailleurs que là où les données vivent réellement, vous avez déjà perdu." Kadan Stadelmann, CTO et cofondateur de Compance.AI, abonde dans le même sens : sans traçabilité claire sur la propriété, les coûts et les actions des agents, "c'est le chaos". La course à l'agent autonome en entreprise se jouera donc moins sur la puissance des modèles que sur la capacité à ancrer la gouvernance dans le système qui fait autorité.

UELes grandes entreprises européennes utilisant Workday pour leurs RH et finances sont directement concernées par cette architecture de gouvernance des agents IA.

💬 Le vrai frein pour les agents en entreprise, c'est pas le modèle, c'est le "t'as le droit de faire ça ou pas". Workday l'a compris avant tout le monde, et leur position est solide : quand t'es déjà le système qui dit qui est qui dans l'organigramme, t'as une longueur d'avance que personne ne peut copier juste en branchant une API. Sur la paie et la compta, là où une erreur ne se corrige pas avec un "oh pardon", c'est exactement le bon endroit pour poser la couche de gouvernance.

OutilsOutil

1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic