Comment sécuriser les agents IA, serveurs MCP et applications LLM en production
Cette publication est cortée mais je peux tout de même produire l'article demandé à partir du contenu disponible.
L'éditeur de sécurité applicative Mend.io a publié un nouveau guide pratique intitulé « Securing AI agents, MCP servers & LLM apps: A practical framework », destiné aux équipes de sécurité confrontées à la multiplication des agents IA, des intégrations MCP (Model Context Protocol) et des applications basées sur des LLM dans les environnements de production. Le document s'articule autour de trois axes : identifier ce qui compte, corriger plus vite ce qui compte, et protéger l'IA en production. Il propose sept outils réutilisables, dont une cartographie de la surface d'attaque en cinq couches (interaction, agent, intégration, modèle, code), un registre enrichi baptisé AI-BOM comportant neuf champs par agent ou serveur MCP, et une checklist de douze points de mauvaise configuration à corriger, comme les identifiants partagés entre agents, les prompts système modifiables en production ou les modèles obsolètes non surveillés.
L'enjeu est de taille pour l'industrie : selon Mend.io, la sécurité applicative traditionnelle repose sur l'hypothèse que le comportement d'un logiciel découle directement de son code, une hypothèse que l'IA agentique invalide. Le comportement d'un agent émerge de la combinaison d'un modèle, d'un prompt système, du contexte récupéré, des entrées utilisateur et des outils qu'il peut appeler, si bien que deux déploiements identiques peuvent se comporter différemment. De nouveaux risques apparaissent, invisibles dans les flux CVE classiques : l'injection de prompt via des données plutôt que du code, un agent disposant de trop de permissions qui agit sans qu'aucune vulnérabilité ne soit exploitée, un modèle déprécié qui continue de produire des prédictions sans plus être corrigé, ou encore une description d'outil empoisonnée sur un serveur MCP capable de détourner le comportement d'un agent sans toucher à l'application elle-même.
Le guide s'inscrit dans un contexte où les agents IA et serveurs MCP s'introduisent souvent dans les systèmes d'information sans passer par les circuits d'achat habituels, ce qui complique leur détection. Mend.io recommande de traquer trois catégories à risque : les agents fantômes, les serveurs MCP non enregistrés et les frameworks IA embarqués, via cinq méthodes combinées, dont l'analyse des dépôts de code, la surveillance du trafic réseau sortant vers des API de modèles et l'audit des comptes de service. Sur le volet correction, le guide propose un pipeline enrichir-prioriser-trier fondé sur des signaux comme l'accessibilité réelle du risque ou le contexte métier, avec une règle stricte : toute clôture automatisée doit être appuyée par des preuves, sinon la décision revient à un humain. La protection en production, enfin, repose sur des garde-fous, un durcissement des prompts, l'application de politiques et une surveillance continue, en boucle avec des exercices de red teaming dédiés à l'IA.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.




