Aller au contenu principal
AWS juge les agents IA insuffisants en contexte métier et sécurité, et lance deux services pour y remédier
OutilsThe Decoder · 1 min de lecture

AWS juge les agents IA insuffisants en contexte métier et sécurité, et lance deux services pour y remédier

Source originale ↗·

Lors de son sommet à New York, AWS a dévoilé deux nouveaux services destinés à combler les lacunes des agents IA en entreprise. Le premier, baptisé Continuum, détecte automatiquement les vulnérabilités dans le code, les priorise et propose des correctifs sans intervention humaine. Le second, Context, construit un graphe de connaissances à partir des données internes de l'entreprise afin de fournir aux agents IA le contexte métier dont ils ont besoin pour opérer correctement.

Ces deux services s'attaquent à un problème central qui freine l'adoption des agents IA dans les environnements professionnels : ces systèmes produisent du code rapidement, mais commettent trop souvent des erreurs, qu'il s'agisse de failles de sécurité ou de décisions inadaptées faute de comprendre le fonctionnement réel de l'organisation. Continuum réduit la surface d'attaque en automatisant la détection de vulnérabilités, tandis que Context évite les hallucinations et les erreurs de jugement en ancrant les agents dans la réalité de l'entreprise, ses processus, ses données, ses contraintes.

Cette annonce intervient alors que les grands fournisseurs cloud rivalisent pour s'imposer comme l'infrastructure de référence pour les agents IA d'entreprise. Microsoft Azure, Google Cloud et AWS se disputent un marché en pleine expansion, où la promesse d'automatisation se heurte encore à des problèmes de fiabilité et de sécurité. En proposant des couches de correction et de contextualisation natives, AWS cherche à rassurer les DSI et RSSI qui hésitent encore à déployer ces agents en production sur des systèmes critiques.

Impact France/UE

Les DSI et RSSI européens pourront évaluer ces services AWS pour sécuriser et contextualiser leurs déploiements d'agents IA en environnement de production.

💬 L'analyse de Mathieu

AWS dit tout haut ce que les DSI savent depuis un moment : les agents IA produisent du code vite, mais sans contexte métier ni filet de sécurité, ça casse en prod. Context et Continuum s'attaquent enfin aux deux vrais blocages, ce qui change quelque chose pour les équipes qui hésitaient à franchir le pas en environnement critique. C'est le genre de couche infrastructure qui manquait pour que les agents IA deviennent un outil sérieux, pas juste une démo.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

AWS lance des agents autonomes pour les tests de sécurité et les opérations cloud
1AWS ML Blog 

AWS lance des agents autonomes pour les tests de sécurité et les opérations cloud

Amazon Web Services a annoncé la disponibilité générale de deux agents autonomes d'intelligence artificielle lors de son événement re:Invent : AWS Security Agent, dédié aux tests d'intrusion, et AWS DevOps Agent, spécialisé dans les opérations cloud. Ces systèmes appartiennent à une nouvelle catégorie baptisée « frontier agents », des IA capables de travailler de façon autonome pendant des heures, voire des jours, sans supervision humaine continue. Selon AWS, les retours des clients en phase de préversion sont significatifs : AWS Security Agent réduit les délais de tests de pénétration de plusieurs semaines à quelques heures, tandis qu'AWS DevOps Agent accélère la résolution d'incidents de 3 à 5 fois. Des entreprises comme Bamboo Health et HENNGE K.K. témoignent de résultats concrets, cette dernière affirmant avoir réduit la durée de ses cycles de sécurité de plus de 90 %. L'enjeu pour les équipes de sécurité et d'exploitation est majeur. La plupart des organisations ne peuvent aujourd'hui faire réaliser des tests de pénétration manuels que sur leurs applications les plus critiques, faute de temps et de budget, laissant la majorité de leur portefeuille logiciel vulnérable entre deux cycles d'audit. AWS Security Agent change cette équation en analysant le code source, les diagrammes d'architecture et la documentation pour reconstituer des chaînes d'attaque complexes que les scanners traditionnels ne détectent pas. Côté opérations, AWS DevOps Agent s'intègre avec les principaux outils du marché, CloudWatch, Datadog, Dynatrace, Splunk, Grafana, GitHub, GitLab, et corrèle télémétrie, code et données de déploiement pour identifier la cause racine d'un incident, qu'il s'agisse d'infrastructures AWS, Azure, hybrides ou on-premise. Pour les équipes SRE débordées, c'est la promesse d'un coéquipier disponible en permanence. Ces annonces s'inscrivent dans une course à l'automatisation des opérations IT qui s'intensifie depuis l'essor des grands modèles de langage. Les hyperscalers, AWS, Microsoft Azure, Google Cloud, cherchent tous à proposer des agents capables de gérer des tâches complexes et durables, au-delà des simples assistants conversationnels. AWS positionne explicitement ces outils non comme des aides ponctuelles, mais comme de véritables extensions de l'équipe humaine, capables de prendre des décisions en plusieurs étapes sans intervention constante. Amy Herzog, vice-présidente et RSSI d'AWS, indique que l'entreprise utilise elle-même AWS Security Agent en interne. La question qui se posera à mesure de l'adoption est celle de la gouvernance : jusqu'où déléguer à une IA des décisions critiques sur la sécurité ou la stabilité des systèmes de production ?

UELes entreprises européennes utilisant AWS peuvent adopter ces agents pour réduire leurs coûts et délais de tests de sécurité, mais la délégation de décisions critiques à une IA soulève des questions de conformité avec le RGPD et l'AI Act.

OutilsOutil
1 source
NemoClaw, analyse et prise en main de la « prison » pour sécuriser les agents IA
2Next INpact 

NemoClaw, analyse et prise en main de la « prison » pour sécuriser les agents IA

NVIDIA a présenté lors de sa conférence GTC un nouveau projet open source baptisé NemoClaw, actuellement en version alpha, conçu pour encadrer les agents IA et prévenir les comportements non souhaités. Présenté comme un environnement sécurisé, il intègre des garde-fous en matière de confidentialité et de sécurité, offrant aux utilisateurs un contrôle accru sur le comportement de leurs agents et la gestion de leurs données. L'annonce s'inscrit dans un contexte où la prolifération des agents IA soulève des questions de sécurité croissantes. Ces systèmes autonomes, capables d'accéder à des données personnelles et d'effectuer des actions en autonomie, représentent un risque réel si leur comportement n'est pas correctement contraint. NemoClaw répond à ce besoin en proposant une couche de contrôle structurée, particulièrement destinée à encadrer des agents comme OpenClaw. OpenClaw, anciennement connu sous les noms Clawdbot puis Moltbot, est un agent IA open source développé par Peter Steinberger, désormais employé chez OpenAI. Son principe : accéder à tout ou partie des données d'un utilisateur pour fonctionner comme assistant virtuel personnel. C'est précisément ce type d'accès étendu qui justifie l'existence d'une infrastructure de sécurité comme NemoClaw, pour s'assurer que l'agent ne dépasse pas les limites fixées. La mise à disposition en version alpha open source signale que NVIDIA cherche à impliquer la communauté dans la maturation du projet avant un déploiement plus large. Dans un secteur où la course aux agents autonomes s'accélère, la question du contrôle et de la gouvernance de ces systèmes devient un enjeu stratégique autant que technique.

OutilsOpinion
1 source
Claude Code lance l’auto mode, pour équilibrer l’autonomie de l’IA et la sécurité
3Blog du Modérateur 

Claude Code lance l’auto mode, pour équilibrer l’autonomie de l’IA et la sécurité

Anthropic franchit un nouveau cap dans l'automatisation des workflows de développement avec le lancement de l'auto mode pour Claude Code, son agent de codage en ligne de commande. Cette fonctionnalité permet à l'IA d'enchaîner les actions, lecture de fichiers, exécution de commandes, modifications du code, sans interrompre le développeur à chaque étape pour une validation manuelle. Le défi central de tout agent autonome reste le même : comment laisser l'IA agir librement tout en évitant les opérations destructrices ou irréversibles ? L'auto mode répond à cette tension en intercalant un classifieur IA entre chaque action et son exécution. Ce classifieur évalue en temps réel le niveau de risque de l'opération envisagée, décidant seul si l'action peut être effectuée sans supervision humaine. Pour les développeurs, cela représente un gain de fluidité significatif : fini les interruptions répétées pour approuver des actions routinières comme lire un fichier ou lancer des tests. L'architecture repose donc sur un double niveau d'intelligence : Claude Code planifie et exécute la tâche de développement, tandis qu'un modèle classifieur distinct joue le rôle de garde-fou. Cette séparation des responsabilités permet de calibrer l'autonomie sans sacrifier la sécurité. Anthropic positionne ainsi son agent comme adapté à des environnements de production réels, où une erreur de l'IA, suppression d'un fichier critique, exécution d'une commande système non souhaitée, peut avoir des conséquences sérieuses. Cette approche préfigure une tendance de fond dans le secteur : les agents IA de nouvelle génération ne cherchent plus simplement à être capables, mais à être dignes de confiance. En intégrant le contrôle directement dans la boucle d'exécution plutôt qu'en le déléguant entièrement à l'utilisateur, Anthropic propose un modèle de gouvernance de l'autonomie qui pourrait devenir une référence pour l'ensemble de l'industrie des agents de développement.

OutilsOutil
1 source
IBM lance Bob pour sécuriser le codage IA en production, via routage multi-modèles et contrôles humains
4VentureBeat AI 

IBM lance Bob pour sécuriser le codage IA en production, via routage multi-modèles et contrôles humains

IBM a lancé hier à l'échelle mondiale Bob, sa plateforme de développement logiciel propulsée par l'intelligence artificielle. L'outil, conçu pour écrire, tester et gérer du code tout au long du cycle de développement, est déjà utilisé par plus de 80 000 employés d'IBM après avoir démarré avec seulement 100 utilisateurs internes à l'été 2025. Bob repose sur un routage multi-modèles : il peut s'appuyer sur les modèles Granite d'IBM, les modèles Claude d'Anthropic, ou encore ceux de la société française Mistral, ainsi que sur des modèles distillés plus légers. Les modèles open source comme Qwen d'Alibaba sont explicitement exclus. Selon IBM, certaines équipes ont économisé jusqu'à 70 % du temps sur certaines tâches, soit en moyenne dix heures par semaine. Neal Sundaresan, directeur général de l'automatisation et de l'IA chez IBM, résume la philosophie de la plateforme : « La capacité du modèle seule ne suffit pas. La façon dont vous le déployez, dont vous structurez le contexte, et dont vous maintenez les humains dans la boucle détermine si l'IA tient réellement ses promesses. » Ce qui distingue Bob de concurrents comme Cursor ou Claude Code, c'est le niveau de contrôle et de gouvernance qu'il impose sur les workflows agentiques. Là où d'autres outils placent le développeur au début de la tâche pour qu'il enchaîne les étapes manuellement, Bob introduit des points de contrôle humains structurés à intervalles réguliers, tout en permettant à des agents IA d'accomplir des tâches complexes en plusieurs étapes. Cette approche répond directement aux besoins des grandes entreprises, qui craignent les failles de sécurité et les défaillances d'orchestration lorsque des agents autonomes accèdent à des données en production. Pour les directions techniques et les équipes d'audit, la traçabilité et la capacité à intervenir à tout moment priment sur la vitesse. Cette annonce s'inscrit dans une tension croissante dans l'industrie entre deux visions de l'IA agentique. D'un côté, des systèmes ouverts et autonomes comme OpenClaw ou NemoClaw de Nvidia, qui poussent les limites de l'automatisation dans des environnements bac à sable. De l'autre, des plateformes comme Bob qui privilégient la fiabilité, l'auditabilité et la supervision humaine. OpenAI a récemment ajouté dans son Agents SDK un support pour des implémentations en bac à sable, tandis que Kilo lançait Kilo Claw centré sur la sécurité des agents autonomes. IBM, fort de ses décennies d'expérience dans les systèmes d'entreprise critiques, choisit délibérément la prudence. Sundaresan le dit sans détour : « Il vaut mieux ouvrir la grille lentement que de dire, 'oups, comment je la referme maintenant ?' »

UEMistral, startup française, est intégrée nativement comme l'un des modèles supportés par Bob aux côtés de Claude et Granite, lui offrant une vitrine directe auprès des 80 000 développeurs IBM et renforçant la crédibilité des LLMs européens dans les environnements enterprise critiques.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic