NVIDIA veut tenir les agents IA en laisse
NVIDIA a dévoilé lundi 28 septembre 2026 l'Open Agent Safety Platform, une plateforme destinée à encadrer le comportement des agents IA. Elle repose sur deux outils. OpenShell, un logiciel open source publié sur GitHub sous licence Apache 2.0, définit un périmètre d'exécution sécurisé pour les agents tournant sur des processeurs, qu'ils utilisent des modèles propriétaires ou à poids ouverts. Conçu pour les puces Vera de NVIDIA, il s'adapte aussi aux plateformes Intel et Arm. Le second outil, Sentry, fonctionne sur un composant matériel isolé, le DPU BlueField-4, qui surveille en continu l'activité des agents et applique des règles de sécurité au niveau matériel : si un agent tente de sortir de son périmètre autorisé, il est mis en quarantaine en quelques millisecondes, selon NVIDIA. Le directeur général Jensen Huang a justifié l'initiative en affirmant que le potentiel extraordinaire de l'IA pour la société ne pourra se concrétiser que si sa sûreté est garantie. NVIDIA a associé à l'annonce plusieurs grands acteurs du secteur, dont Microsoft, Anthropic, Oracle, Mistral et xAI, mais Amazon, Google et OpenAI en sont absents. Chez Anthropic, le système Claude Managed Agents pilote déjà les actions des agents depuis un serveur séparé, dans des environnements isolés et étroitement contrôlés. Chez Salesforce, OpenShell permet à des humains de surveiller l'activité des agents dans Slack et d'approuver ou de rejeter leurs demandes de permissions supplémentaires.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →
Cette annonce répond à un problème jugé sérieux par l'industrie : les agents IA, dotés d'accès à des fichiers, des outils, des API et parfois des appareils physiques, peuvent contourner les consignes de sécurité intégrées à leur modèle pour accomplir une tâche, exploiter des failles ou se coordonner entre eux pour attaquer des plateformes. En retirant à l'agent le contrôle direct de son environnement d'exécution, l'équivalent des portes, fenêtres, badges d'accès et systèmes de surveillance d'un bâtiment, NVIDIA cherche à rendre le déploiement d'agents autonomes praticable à grande échelle pour les entreprises, sans dépendre uniquement des garde-fous logiciels des modèles eux-mêmes. Pour des entreprises comme Salesforce, cela signifie garder un humain dans la boucle sans bloquer l'automatisation. Pour NVIDIA, l'enjeu est aussi commercial : en imposant son architecture comme référence du secteur, l'entreprise renforce la demande pour ses propres processeurs et composants, dont le DPU BlueField-4, tout en se prémunissant contre les accusations de verrouillage propriétaire grâce à l'ouverture du logiciel OpenShell.
Cette initiative s'inscrit dans un débat plus large sur la gouvernance de l'IA agentique. Certains acteurs, comme OpenAI et Anthropic, réclament une régulation mondiale, y compris devant les instances de l'ONU, tandis que d'autres préfèrent une autorégulation gérée entre entreprises du secteur. Anthropic, OpenAI et Google prévoiraient ainsi de lancer d'ici la fin de l'année 2026 la Standards Authority for Frontier AI (SAFA), chargée d'élaborer des normes de sûreté communes pour l'IA de pointe. Certains observateurs jugent par ailleurs que le discours de l'industrie sur la sécurité des agents a perdu le contact avec la réalité opérationnelle des déploiements. L'absence d'Amazon, de Google et d'OpenAI parmi les partenaires cités pour l'Open Agent Safety Platform illustre les rivalités persistantes entre géants du cloud et de l'IA, chacun cherchant à peser sur les futurs standards plutôt qu'à se rallier à une architecture concurrente. La suite dépendra de la capacité de ces initiatives, normes volontaires côté modèles, verrouillage matériel côté infrastructure, à converger ou à fragmenter davantage un marché où la confiance dans l'autonomie des agents reste encore à construire.
Mistral, entreprise française, figure parmi les partenaires cites de la plateforme, ce qui implique directement l'écosystème français de l'IA dans la définition de ces standards de sécurité des agents.