Aller au contenu principal
Sécurité · Outil ·

Okta réduit les coûts en tokens des agents IA grâce au scoping MCP

Okta a présenté un nouveau mécanisme visant à réduire les coûts de tokens liés à l'usage du Model Context Protocol (MCP) par les agents IA en entreprise. Le problème identifié par la société, surnommé la "tool tax" (taxe sur les outils), vient du fait que chaque appel à un modèle par un agent IA inclut les schémas, noms, descriptions et paramètres de tous les outils exposés par un serveur MCP, y compris ceux que l'agent n'utilisera jamais. Okta cite en exemple des connexions à Google Workspace, Slack ou des serveurs MCP internes, où le nombre d'outils exposés peut être élevé et où ce coût de prompt se répète à chaque tour de conversation, pour chaque utilisateur actif. Sa solution consiste à filtrer la liste des outils avant qu'elle n'atteigne le modèle, en fonction des permissions attribuées à l'identité de l'agent et à l'utilisateur associé. Un administrateur configure ces droits directement dans le tableau de bord Okta, qui renvoie ensuite un ensemble d'outils restreint plutôt que le catalogue complet du serveur, tout en revérifiant les autorisations au moment de l'exécution. Selon la modélisation interne d'Okta, basée sur des données produit et de la documentation publique de fournisseurs, sans données clients réelles, certains scénarios de permissions réduisent de plus de 90% le nombre d'outils visibles par le modèle, avec une baisse proportionnelle du coût des schémas d'outils, sans chiffres absolus en tokens ou en dollars.

2 min de lecturePertinence 49
Source

Résumé et traduction réalisés par Le Fil IA à partir de AI News. Lire l'article original →

Cette approche s'attaque à un problème à la fois économique et sécuritaire pour les entreprises qui déploient des agents IA à grande échelle. Sur le plan financier, réduire le nombre d'outils visibles diminue directement la facture de tokens consommés à chaque appel de modèle, un coût qui s'accumule rapidement avec le nombre d'utilisateurs et la fréquence des interactions. Sur le plan sécuritaire, un agent qui perçoit des outils hors de son périmètre d'autorisation peut tenter de les invoquer, un rejet a posteriori au moment de l'exécution ne permettant pas de récupérer les tokens déjà consommés pour traiter la définition de l'outil. En limitant l'exposition en amont, selon le principe du moindre privilège appliqué à l'échelle de chaque outil, Okta cherche à empêcher qu'un agent ait connaissance de ressources, bases de données ou fonctions qu'il n'est pas expressément autorisé à utiliser.

Cette annonce s'inscrit dans la stratégie plus large d'Okta autour de ce que l'entreprise appelle son "blueprint for the sécure agentic enterprise", un cadre demandant aux organisations d'identifier leurs agents IA, leurs connexions autorisées et leurs actions permises. Elle reflète une tendance de fond dans l'industrie, où la multiplication des serveurs MCP comme point de connexion entre agents IA, outils et données pousse les fournisseurs d'identité à repenser le contrôle d'accès non plus au niveau du serveur entier mais outil par outil. Okta ne mentionne toutefois aucun déploiement client réel à ce stade, ses conclusions reposant uniquement sur une modélisation interne portant sur un client MCP unique et des segments d'utilisateurs représentatifs, comme les agents du support technique ou les administrateurs système.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Le PDG d'Okta mise sur l'identité des agents IA47The Verge AISécurité 02AWS et Cisco AI Defense sécurisent les déploiements MCP et A2A pour les agents IA45AWS ML BlogSécurité 03Comment sécuriser les agents IA, serveurs MCP et applications LLM en production37MarkTechPostSécurité 
Dossier · Agents IASuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.