Aller au contenu principal
Un développeur Mozilla présente cq, un « Stack Overflow pour agents »
OutilsArs Technica AI · 1 min de lecture

Un développeur Mozilla présente cq, un « Stack Overflow pour agents »

Source originale ↗·

Peter Wilson, développeur chez Mozilla, a annoncé cq, un projet qu'il décrit comme un « Stack Overflow pour agents ». Publié sur le blog Mozilla.ai, ce projet naissant ambitionne de résoudre un problème structurel des agents IA modernes : leur incapacité à accéder à des informations à jour et à partager leurs connaissances entre eux.

Le problème est double. D'une part, les agents de codage s'appuient sur des données figées au moment de leur entraînement, ce qui les amène à tenter des appels à des API obsolètes ou à ignorer des évolutions récentes. Des techniques comme le RAG (Retrieval Augmented Generation) existent pour combler ce fossé, mais elles ne sont pas systématiquement déclenchées, le cas classique des « inconnues inconnues ». D'autre part, des centaines, voire des milliers d'agents se retrouvent à résoudre indépendamment les mêmes problèmes, sans mécanisme de partage des solutions après la date de coupure d'entraînement.

L'impact économique et environnemental n'est pas négligeable : chaque agent dépense des tokens coûteux et consomme de l'énergie pour re-résoudre des problèmes déjà résolus ailleurs. cq propose d'y remédier en créant une base de connaissances partagée et structurée, une sorte de mémoire collective pour agents, à la manière de ce que Stack Overflow a représenté pour les développeurs humains.

Le projet reste cependant très préliminaire, et Wilson lui-même reconnaît plusieurs défis critiques à surmonter : la sécurité, le data poisoning (empoisonnement des données par des entrées malveillantes) et la fiabilité des informations partagées. Ce sont précisément ces enjeux qui conditionneront l'adoption significative de cq au sein de l'écosystème des agents IA.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Anthropic conçoit un système à trois agents pour le développement full-stack de longue durée
1InfoQ AI 

Anthropic conçoit un système à trois agents pour le développement full-stack de longue durée

Anthropic a présenté une architecture expérimentale baptisée "three-agent harness", un dispositif en trois agents distincts conçu pour améliorer les workflows de développement logiciel autonome sur de longues durées. Le système dissocie trois fonctions jusqu'alors souvent mélangées dans un seul agent : la planification, la génération de code et l'évaluation des résultats. Chaque rôle est confié à un agent spécialisé, ce qui permet d'orchestrer des sessions de développement frontend et full-stack pouvant s'étendre sur plusieurs heures sans perte de cohérence. L'enjeu est considérable pour les équipes qui misent sur l'IA pour accélérer leur cycle de développement. En isolant l'évaluation dans un agent dédié, le système introduit une boucle de rétroaction itérative qui maintient la qualité du code généré même lorsque la tâche devient complexe ou que le contexte s'allonge. C'est précisément ce point de rupture, la dégradation des performances sur des tâches longues et multi-fichiers, qui freine l'adoption de l'IA en développement professionnel. Cette approche s'inscrit dans une réflexion plus large de l'industrie sur les "multi-agent systems", où la spécialisation des rôles permet de dépasser les limites d'un agent unique. Anthropic n'est pas seul sur ce terrain : OpenAI, Google DeepMind et des startups comme Cognition (Devin) explorent des architectures similaires. La publication de ce harness, accompagnée de commentaires techniques de l'industrie, suggère qu'Anthropic cherche à poser un standard méthodologique autant qu'à démontrer une capacité technique.

UELes équipes de développement européennes pourraient à terme bénéficier de cette architecture pour des workflows de codage assisté de longue durée, mais l'impact reste indirect et non immédiat.

💬 Le vrai problème sur les tâches longues, c'est que l'agent finit par se perdre entre ce qu'il planifie, ce qu'il génère et ce qu'il valide. Trois agents spécialisés avec une boucle d'évaluation dédiée, c'est la bonne architecture pour tenir sur plusieurs heures sans perdre le fil sur un projet multi-fichiers. Anthropic cherche clairement à poser un standard ici, pas juste à montrer une démo.

OutilsOutil
1 source
KTern.AI développe une IA à base d'agents pour SAP sur Amazon Bedrock AgentCore
2AWS ML Blog 

KTern.AI développe une IA à base d'agents pour SAP sur Amazon Bedrock AgentCore

Comment KTern.AI, plateforme de transformation digitale dédiée à SAP, a bâti son IA agentique sur Amazon Bedrock AgentCore en s'appuyant sur le kit Strands Agents SDK. KTern.AI est partenaire SAP Spotlight et opère une plateforme certifiée SAP de Digital Transformation as a Service, structurée autour de cinq automatisations : Digital Maps, Digital Projects, Digital Process, Digital Labs et Digital Mines. Son moteur propriétaire de connaissance institutionnelle encode des années de patterns de transformation SAP et de bonnes pratiques, permettant, combiné à une hyperautomatisation pilotée par la donnée, des transformations sept fois plus rapides avec une réduction de 24 % de l'effort global. Les nouveaux agents déployés orchestrent de façon autonome des workflows allant de la rétro-ingénierie à l'analyse de code, en passant par le fit-to-standard et le repérage d'exceptions dans les processus Finance et Ventes, sans que l'entreprise ait eu à construire une infrastructure d'agents sur mesure. Cette bascule change concrètement la donne pour les grands comptes engagés dans des migrations S/4HANA ou des conversions système, des projets qui s'étalent sur des mois voire des années et mobilisent une expertise SAP difficile à faire monter en échelle avec des consultants humains seuls. Avant AgentCore, KTern.AI faisait tourner son application sur une pile de conteneurs auto-gérée, développée et maintenue en interne, ce qui détournait du temps d'ingénierie vers de l'infrastructure sans lien avec son cœur de métier : concevoir des agents capables de comprendre la transformation SAP. En migrant vers AgentCore, l'entreprise a pu se recentrer sur cette différenciation tout en gagnant en fiabilité de production. Le passage à l'agentique posait plusieurs défis techniques qu'aucune infrastructure maison ne pouvait résoudre proprement. Il fallait un contexte persistant à grande échelle, les agents devant retenir un état sur des centaines d'interactions et bâtir un contexte cumulatif sur toute la durée d'un projet sans le perdre à chaque session, tout en évitant de les saturer d'informations superflues, ce qui ralentit les réponses, augmente les coûts et le risque d'hallucination. S'y ajoutaient l'accès sécurisé et gouverné aux API SAP, aux systèmes ERP clients et aux référentiels de processus via des connexions authentifiées et auditables, la multi-location avec une configuration propre à chaque client sans développement spécifique par déploiement, une scalabilité dynamique pouvant faire passer d'une poignée d'agents pour un audit rapide à des dizaines d'agents tournant en continu pendant des mois lors d'une migration complète, et enfin une observabilité de niveau production, avec logs, traces et métriques détaillés pour rendre traçable chaque décision d'agent et chaque appel d'outil dans des environnements d'entreprise.

💬 Reste à voir si l'infra managée tient vraiment la charge sur des migrations S/4HANA qui durent des mois, mais l'idée de fond est bonne : le vrai métier de KTern.AI c'est de comprendre SAP, pas de maintenir une stack de conteneurs. C'est un pattern qu'on va voir se généraliser chez tous les éditeurs verticaux, arrêter de réinventer l'orchestration d'agents pour se concentrer sur la donnée métier propriétaire. Le détail qui compte, c'est la gestion du contexte sur des centaines d'interactions sans saturer le modèle : c'est exactement le genre de problème qu'aucune boîte n'a envie de résoudre elle-même en interne.

OutilsActu
1 source
Un développeur d'Anthropic partage des conseils de prompting pour Fable 5, centrés sur ses propres angles morts
3The Decoder 

Un développeur d'Anthropic partage des conseils de prompting pour Fable 5, centrés sur ses propres angles morts

Thariq Shihipar, développeur chez Anthropic, a partagé une série de conseils pour tirer le meilleur parti de Fable 5, le nouveau modèle de l'entreprise, en s'appuyant sur son expérience de terrain. Sa thèse centrale renverse la perspective habituelle : selon lui, le principal frein à l'efficacité n'est plus la capacité du modèle, mais les angles morts de l'utilisateur lui-même, c'est-à-dire les connaissances implicites que le programmeur possède sans même s'en rendre compte et qu'il omet de transmettre à l'IA. Pour y remédier, Shihipar propose des méthodes concrètes, notamment des "passes de détection des angles morts" et des entretiens structurés, conçus pour aider les développeurs à identifier systématiquement ce qu'ils savent sans le formuler avant de déléguer une tâche d'implémentation à Claude. Cette approche marque un tournant dans la manière de penser l'usage professionnel des assistants de code IA. Plutôt que de chercher à améliorer le prompt par tâtonnement ou à multiplier les instructions techniques, elle invite les développeurs à interroger leur propre expertise tacite, celle qui guide intuitivement leurs décisions de conception mais reste rarement explicitée. Pour les équipes qui intègrent Claude dans leurs flux de travail quotidiens, cela signifie que la qualité des résultats dépend désormais moins des capacités brutes du modèle que de la capacité des humains à formaliser leur propre raisonnement, un enjeu de communication autant que de technique. Cette réflexion s'inscrit dans un mouvement plus large autour de l'ingénierie de prompt à mesure que les modèles gagnent en autonomie et en compétence sur des tâches complexes de programmation. À mesure que des modèles comme Fable 5 réduisent l'écart de performance brute, la valeur ajoutée se déplace vers la qualité de l'interaction humain-machine. Les praticiens chez Anthropic, en partageant ce type de retours d'expérience issus de leur propre usage interne des outils, cherchent à outiller la communauté des développeurs pour qu'elle exploite pleinement le potentiel de ces nouveaux modèles, plutôt que d'en rester à des pratiques de prompting héritées de générations d'IA moins capables.

💬 Ce qui bloque, c'est plus le modèle, c'est toi. Le vrai goulot d'étranglement avec Claude, c'est tout ce que tu sais sans le dire, ton contexte implicite que le modèle n'a jamais vu. Selon Le Fil IA, la prochaine bataille du prompting ne sera pas technique mais cognitive : apprendre à formaliser ce qu'on sait déjà.

OutilsTuto
1 source
4InfoQ AI 

LinkedIn présente son agent de mémoire cognitive pour les agents IA

LinkedIn a dévoilé le Cognitive Memory Agent (CMA), une couche d'infrastructure d'IA générative destinée à rendre les systèmes d'intelligence artificielle persistants et conscients du contexte dans lequel ils opèrent. Ce framework fournit une mémoire durable organisée en trois couches distinctes : épisodique, qui retient les interactions passées ; sémantique, qui stocke les connaissances générales ; et procédurale, qui encode les comportements appris. Le CMA prend également en charge la coordination entre plusieurs agents, la récupération d'informations et la gestion complète du cycle de vie des mémoires. Cette initiative s'attaque à une limitation fondamentale des grands modèles de langage : leur absence d'état entre les sessions. Sans mémoire externe, chaque interaction repart de zéro, rendant impossible toute personnalisation durable. En déployant le CMA dans ses propres applications, LinkedIn ouvre la voie à des assistants IA capables de se souvenir des préférences professionnelles d'un utilisateur, de ses recherches d'emploi passées ou de ses habitudes de networking, transformant ainsi l'expérience sur une plateforme de plus d'un milliard d'utilisateurs. La mémoire des agents est devenue l'un des chantiers prioritaires de l'industrie, alors que les entreprises cherchent à faire passer leurs systèmes d'IA du mode réactif au mode autonome et continu. OpenAI, Google DeepMind et Anthropic développent des architectures comparables, mais LinkedIn dispose d'un avantage singulier : une base de données professionnelles sans équivalent. Le CMA positionne l'entreprise pour intégrer ces capacités directement dans ses outils de recrutement, de formation et de recommandation, avec des implications profondes sur la façon dont les professionnels interagiront avec l'IA au quotidien.

UELes millions de professionnels français inscrits sur LinkedIn pourraient voir leurs interactions avec les outils de recrutement et de formation de la plateforme profondément transformées par cette couche de mémoire persistante.

OutilsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic