Aller au contenu principal
LLMs · Opinion ·

L'évolution du harnais d'agent

Vers Noël 2025, des ingénieurs en intelligence artificielle ont remarqué un changement net dans le comportement des agents IA : ils se sont mis à fonctionner correctement, pour de bon. Lukasz Kaiser, l'un des co-inventeurs de l'architecture Transformer chez Google, a évoqué ce basculement en juin dernier dans le podcast "Unsupervised Learning", expliquant qu'il est difficile d'en isoler la cause exacte : le harnais logiciel entourant les modèles a changé, du post-entraînement a été ajouté, de nouveaux modèles pré-entraînés sont sortis, et la combinaison a produit un saut de qualité difficile à attribuer à un seul facteur. L'article retrace la généalogie de ce "harnais d'agent" (agent harness), c'est-à-dire tout ce qui entoure les poids d'un modèle pour le faire fonctionner comme un agent : environnement, outils, contexte, mémoire et garde-fous. Il rappelle qu'en novembre 2022, ChatGPT n'avait accès à aucun outil, aucune recherche, aucun raisonnement structuré, seulement la prédiction du prochain mot affinée par apprentissage par renforcement à partir de retours humains. La technique ReAct, publiée en octobre 2022, a la première formalisé sur le papier la boucle "raisonner, agir, observer", suivie en février 2023 par Toolformer de Meta, qui a exploré l'idée d'entraîner directement l'usage d'outils dans le modèle plutôt que de le simuler par un simple prompt.

2 min de lecturePertinence 48
Source

Résumé et traduction réalisés par Le Fil IA à partir de Latent Space. Lire l'article original →

Cette évolution compte parce qu'elle explique pourquoi les agents IA sont passés, en l'espace de quelques mois, d'un statut de démonstrations fragiles à celui d'outils réellement utilisables au quotidien par les développeurs et les entreprises. L'auteur décrit deux courbes distinctes : ce que le harnais exige du modèle, et ce que le modèle est réellement capable de fournir. L'écart entre ces deux courbes détermine l'efficacité concrète d'un agent, et c'est la réduction progressive de cet écart, portée à la fois par des modèles plus capables et par des harnais mieux conçus, qui a produit le saut de performance observé fin 2025. À terme, les modèles tendent à absorber dans leurs propres poids des fonctions autrefois déléguées au harnais, poussant les ingénieurs à simplifier ce dernier au fil du temps.

Le contexte plus large est celui d'une course entre plusieurs laboratoires, dont OpenAI, Meta et Anthropic, pour équiper leurs modèles de capacités d'action autonome fiables. Le printemps 2023 avait déjà vu une tentative précoce et prématurée avec les projets AutoGPT et BabyAGI, qui donnaient une autonomie totale à des modèles encore trop fragiles pour la gérer, une boucle logicielle ne pouvant amplifier que les capacités déjà présentes dans un modèle, sans en créer de nouvelles. L'article suggère que cette trajectoire se poursuit, avec un harnais de plus en plus orienté vers l'attention humaine plutôt que vers l'assistance au modèle lui-même.

VidéoVoir la vidéo de cet article sur YouTube →
Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01L'évolution des encodeurs : des modèles simples à l'IA multimodale29AI NewsLLMs 02Ce que mon agent sait de moi43Ben's BitesLLMs 03Bilan IA Mars 2026 : GPT-5.4, Claude Mythos, Gemini 3.1 et la révolution des agents53Le Big DataLLMs 
Dossier · Meta IASuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.