Aller au contenu principal
OutilsLe Big Data · 2 min de lecture

Cortex AI Gateway donne la main aux DSI

Source originale ↗·

Snowflake a présenté Cortex AI Gateway, une passerelle destinée à donner aux directions informatiques une vue unique sur les agents IA déployés dans l'entreprise, leurs autorisations et leurs dépenses. Le produit doit fédérer les agents propres à Snowflake, comme CoWork et CoCo, avec des outils tiers tels que Claude Code ou Cursor. Il encadrera les accès aux modèles, aux données, aux applications et aux serveurs MCP, avec une compatibilité annoncée pour plus de cent serveurs de ce type. La brique intègre aussi les technologies de Natoma, société rachetée par Snowflake en mai 2026. Des partenariats ont par ailleurs été noués avec 1Password, Aembit, Linx Security, Okta, SailPoint et Saviynt pour gérer l'identité des agents issus de plateformes externes. Le calendrier reste toutefois progressif : Cortex AI Gateway doit d'abord arriver en préversion publique, plusieurs intégrations partenaires sont prévues en préversion privée, et Okta ne rejoindra le dispositif qu'au quatrième trimestre 2026.

L'enjeu principal pour les entreprises est de reprendre le contrôle sur une dépense IA devenue difficile à suivre. Entre le nombre de modèles utilisés, la multiplication des équipes et les volumes de tokens consommés, la facture se répartit mal et échappe souvent aux directions financières. Cortex AI Gateway propose d'associer chaque dépense à un agent, un service ou une charge de travail précise, avec la possibilité de fixer des plafonds qui bloquent les dépassements avant la fin d'un cycle budgétaire. La passerelle peut aussi orienter automatiquement une requête vers le modèle le plus adapté selon le prix, la vitesse, la qualité attendue et la disponibilité, ce qui pourrait éviter que toutes les tâches soient envoyées par défaut vers le modèle le plus coûteux. Sur le plan de la sécurité, l'objectif est de limiter les autorisations d'un agent à la seule tâche qui lui est confiée, sans lui transférer l'ensemble des droits de l'utilisateur qui l'a activé.

Cette annonce répond à une diffusion rapide des agents IA dans les métiers, le développement logiciel et les outils de productivité, souvent connectés au cas par cas selon des règles et des connecteurs différents d'un service à l'autre. Cette dispersion complique les audits et alourdit la maintenance dans les grandes structures. Akhil Kapoor, de Saviynt, résume le problème en rappelant que « les modèles traditionnels de gestion des identités ont été conçus pour les utilisateurs humains, et non pour les agents d'IA », ce qui justifie le recours à des contrôles de type Zero Trust appliqués aux logiciels autonomes. Snowflake devra néanmoins démontrer que cette gouvernance reste simple à configurer pour les équipes IT, sous peine de déplacer la complexité plutôt que de la résoudre.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

AgentCore Gateway et sa compatibilité avec la spécification MCP 2026-07-28
1AWS ML Blog 

AgentCore Gateway et sa compatibilité avec la spécification MCP 2026-07-28

Le protocole MCP (Model Context Protocol) a publié le 28 juillet 2026 sa nouvelle spécification, la révision la plus importante depuis son lancement. Le changement majeur rend le protocole entièrement sans état (stateless) : jusqu'ici, chaque échange via Streamable HTTP démarrait par une poignée de main initialize/initialized, suivie de l'attribution d'un identifiant de session (Mcp-Session-Id) que chaque requête suivante devait porter. Cette session liait le client à un serveur précis, obligeant les opérateurs à mettre en place des sessions collantes au niveau du load balancer ou un magasin de sessions partagé pour faire tourner leurs serveurs MCP à l'échelle. Avec la version 2026-07-28, chaque requête embarque désormais la version du protocole, les informations et les capacités du client directement dans son paramètre _meta, supprimant le besoin de handshake initial ; une nouvelle méthode, server/discover, permet à tout moment de connaître les capacités d'un serveur. Amazon propose dès aujourd'hui de basculer sur cette version via AgentCore Gateway, une fonctionnalité d'Amazon Bedrock AgentCore, en appelant simplement UpdateGateway avec la liste des versions de protocole souhaitées, sans étape supplémentaire par cible. Cette bascule vers un protocole sans état change concrètement l'infrastructure nécessaire pour faire tourner des serveurs MCP en entreprise : un appel d'outil devient autonome, ne dépend plus d'un contexte de session préalable et peut être routé vers n'importe quelle instance de serveur, ce qui permet une mise à l'échelle horizontale classique sur de l'HTTPS standard. Pour les équipes qui déploient des agents IA à grande échelle, cela réduit la complexité opérationnelle et les coûts liés à la gestion d'état, tout en renforçant l'autorisation par un alignement plus strict sur les pratiques d'entreprise en OAuth 2.0 et OpenID Connect. Amazon insiste sur le fait que la mise à jour est optionnelle et rétrocompatible côté client : une passerelle qui annonce à la fois la version 2026-07-28 et l'ancienne version 2025-11-25 ne change rien pour les clients qui continuent de demander l'ancienne version, seuls ceux qui sollicitent explicitement la nouvelle en bénéficient. Ce changement d'architecture s'inscrit dans une problématique plus large de passage à l'échelle du protocole MCP, largement adopté depuis son lancement pour connecter des agents IA à des outils et données externes, mais dont le modèle de session posait des limites concrètes en environnement de production. Pour encadrer les futures évolutions sans provoquer de nouvelles ruptures de compatibilité, les mainteneurs du protocole ont aussi introduit des mécanismes de gouvernance : une politique de cycle de vie des fonctionnalités, un cadre d'extensions et une exigence de suite de conformité, documentés notamment via les propositions techniques SEP-2575 et SEP-2567. Le retrait de la session au niveau du protocole n'empêche pas pour autant les applications à état de fonctionner : les développeurs peuvent toujours assurer une continuité entre les appels en passant un identifiant explicite comme paramètre d'outil. Cette évolution marque ainsi un tournant dans la maturité du protocole, désormais pensé pour supporter des déploiements d'agents IA à grande échelle en entreprise.

UELes entreprises françaises et européennes déployant des agents IA via MCP pourront simplifier leur infrastructure de serveurs, sans acteur ni réglementation locale directement concernés.

OutilsActu
1 source
Codex gagne du terrain
2Ben's Bites 

Codex gagne du terrain

OpenAI accélère le déploiement de Codex auprès du grand public en annonçant plusieurs évolutions majeures visant à rendre l'outil accessible aux utilisateurs non techniques. La plateforme permet désormais d'importer des paramètres, plugins, agents et configurations de projets depuis des outils concurrents comme Claude, facilitant la migration pour ceux qui souhaitent changer d'environnement. Des améliorations concrètes ont également été déployées pour les tâches du quotidien : création de présentations et de feuilles de calcul, interface plus intuitive, et une intégration iMessage non officielle qui permet d'interagir avec Codex directement depuis son téléphone via un fil de discussion persistant. Par ailleurs, xAI a lancé Grok 4.3 dans son API publique : le modèle supporte un contexte d'un million de tokens, accepte texte et images en entrée, intègre des capacités de raisonnement et dispose d'une base de connaissance arrêtée à décembre 2025. Son tarif, fixé à 1,25 dollar pour un million de tokens en entrée et 2,50 dollars en sortie, le positionne comme une alternative nettement moins chère que Claude Sonnet 4.6 pour des performances comparables. Ces mouvements signalent une intensification de la concurrence dans le segment des assistants de développement et de productivité alimentés par l'IA. En ciblant explicitement les non-développeurs, OpenAI cherche à élargir considérablement son marché potentiel pour Codex, qui était jusqu'ici perçu comme un outil avant tout destiné aux ingénieurs. La guerre des prix entre modèles LLM s'accentue également : la tarification agressive de Grok 4.3 par xAI force les autres acteurs à justifier leurs propres coûts, ce qui devrait bénéficier aux entreprises et développeurs cherchant à réduire leurs dépenses d'infrastructure IA. Enfin, la société Entire, fondée par l'ex-PDG de GitHub, a dévoilé deux outils complémentaires : git-sync, un utilitaire pour synchroniser des dépôts git entre sources sans clonage local, et Dispatches, une fonctionnalité générant automatiquement des notes de version à partir des commits et sessions d'agents par dépôt et plage de dates. Codex a été lancé par OpenAI comme successeur de GitHub Copilot dans une logique d'agent de développement autonome, mais la plateforme peine encore à s'imposer comme outil universel face à des concurrents comme Claude ou Cursor. L'ouverture à des profils non techniques représente un pivot stratégique notable, dans un contexte où la frontière entre outils de développement et outils de productivité généraliste s'efface progressivement. Du côté des benchmarks, un signe d'avertissement : Base44 indique dans son outil Frustration Meter qu'Opus 4.7 génère 43 % de frustration en plus qu'Opus 4.6, suggérant que la course aux capacités ne se traduit pas toujours par une meilleure expérience utilisateur. Les semaines à venir diront si Codex réussit son pari d'élargissement, et si Grok 4.3 parvient à s'imposer comme le modèle rapport qualité-prix de référence.

UELa guerre des prix entre LLM (Grok 4.3 à 1,25 $/M tokens en entrée) devrait permettre aux développeurs et entreprises européens de réduire sensiblement leurs coûts d'infrastructure IA.

OutilsOutil
1 source
Amazon Bedrock AgentCore Gateway permet désormais de connecter des serveurs MCP via le flux Authorization Code
3AWS ML Blog 

Amazon Bedrock AgentCore Gateway permet désormais de connecter des serveurs MCP via le flux Authorization Code

Amazon a enrichi son service Bedrock AgentCore Gateway d'une nouvelle capacité majeure : la prise en charge du flux OAuth 2.0 Authorization Code, permettant aux agents d'IA de se connecter de manière sécurisée à des serveurs MCP protégés par authentification déléguée. Cette fonctionnalité, disponible via Amazon Bedrock AgentCore Identity, s'adresse aux organisations qui déploient des agents à grande échelle et qui doivent gérer des dizaines de connexions vers des serveurs tiers, dont ceux d'AWS, GitHub, Salesforce et Databricks. Concrètement, AgentCore Gateway joue le rôle de point d'entrée unique : les équipes configurent une seule URL Gateway au lieu de paramétrer chaque serveur MCP individuellement dans chaque IDE ou environnement de développement. L'authentification, l'observabilité et l'application des politiques de sécurité sont désormais centralisées en un seul plan de contrôle. Pour les organisations qui adoptent des agents d'IA en production, cette évolution résout un problème concret de gouvernance : jusqu'ici, chaque connexion à un serveur MCP devait être configurée et sécurisée séparément, ce qui devenait ingérable à mesure que le nombre de serveurs augmentait. Avec le flux Authorization Code, un agent peut agir au nom d'un utilisateur réel, obtenir un jeton d'accès via une authentification humaine, sans que les développeurs aient besoin d'embarquer des identifiants en dur dans le code applicatif ni de gérer manuellement le cycle de vie des tokens. Deux méthodes de création de cibles sont proposées : une synchronisation implicite où l'administrateur complète le flux d'autorisation lors de la création de la cible, et une méthode où le schéma d'outils est fourni directement à l'avance, recommandée quand une intervention humaine n'est pas possible en phase de déploiement. L'émergence du protocole MCP (Model Context Protocol) comme standard de connexion entre agents et outils externes a multiplié le nombre de serveurs que les équipes doivent orchestrer. Les grandes entreprises se retrouvent désormais à gérer des accès vers des systèmes hétérogènes, certains protégés par des fournisseurs d'identité fédérés, d'autres par leurs propres serveurs d'autorisation. AWS positionne AgentCore Gateway comme la réponse d'infrastructure à cette fragmentation, en apportant une couche de centralisation comparable à ce qu'une API Gateway classique fait pour les services REST. La prise en charge de l'Authorization Code flow, distincte des méthodes machine-à-machine comme Client Credentials, signale que Bedrock vise désormais des scénarios où des utilisateurs humains délèguent explicitement leurs droits à des agents, un cas d'usage clé pour les assistants d'entreprise qui accèdent à des outils SaaS au nom de leurs utilisateurs.

UELes entreprises européennes déployant des agents IA sur Amazon Bedrock peuvent centraliser la gestion des authentifications MCP, facilitant la conformité avec les exigences de sécurité du RGPD.

OutilsActu
1 source
Anthropic donne plus d'autonomie à Claude Code, mais garde le contrôle
4TechCrunch AI 

Anthropic donne plus d'autonomie à Claude Code, mais garde le contrôle

Anthropic franchit une nouvelle étape dans l'autonomisation de ses outils de développement : Claude Code dispose désormais d'un mode automatique permettant à l'IA d'exécuter des tâches complexes avec un nombre réduit de validations humaines. Ce changement marque une évolution significative dans la philosophie de l'entreprise vis-à-vis de l'agent coding. Cette décision reflète une tendance de fond dans le secteur : les outils d'IA pour développeurs évoluent vers davantage d'autonomie opérationnelle, réduisant les frictions dans les workflows. Pour les équipes d'ingénierie, cela signifie moins d'interruptions lors de l'exécution de tâches répétitives ou bien délimitées, un gain de productivité non négligeable à mesure que l'IA prend en charge des séquences d'actions plus longues. Anthropic souligne cependant que cette autonomie accrue s'accompagne de garde-fous intégrés, conçus pour maintenir un équilibre entre vitesse d'exécution et sécurité. Le nouveau mode auto ne signifie pas une délégation totale du contrôle, mais une recalibration du seuil d'approbation requis, avec des mécanismes de supervision qui restent actifs en arrière-plan. Cette évolution de Claude Code positionne Anthropic dans la course aux agents de développement autonomes, un segment où GitHub Copilot, Cursor et d'autres acteurs investissent massivement. La question centrale reste celle de la confiance : jusqu'où les développeurs sont-ils prêts à laisser l'IA agir sans supervision directe ?

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic