Aller au contenu principal
IBM lance Bob pour sécuriser le codage IA en production, via routage multi-modèles et contrôles humains
OutilsVentureBeat AI · 2 min de lecture

IBM lance Bob pour sécuriser le codage IA en production, via routage multi-modèles et contrôles humains

Source originale ↗·

IBM a lancé hier à l'échelle mondiale Bob, sa plateforme de développement logiciel propulsée par l'intelligence artificielle. L'outil, conçu pour écrire, tester et gérer du code tout au long du cycle de développement, est déjà utilisé par plus de 80 000 employés d'IBM après avoir démarré avec seulement 100 utilisateurs internes à l'été 2025. Bob repose sur un routage multi-modèles : il peut s'appuyer sur les modèles Granite d'IBM, les modèles Claude d'Anthropic, ou encore ceux de la société française Mistral, ainsi que sur des modèles distillés plus légers. Les modèles open source comme Qwen d'Alibaba sont explicitement exclus. Selon IBM, certaines équipes ont économisé jusqu'à 70 % du temps sur certaines tâches, soit en moyenne dix heures par semaine. Neal Sundaresan, directeur général de l'automatisation et de l'IA chez IBM, résume la philosophie de la plateforme : « La capacité du modèle seule ne suffit pas. La façon dont vous le déployez, dont vous structurez le contexte, et dont vous maintenez les humains dans la boucle détermine si l'IA tient réellement ses promesses. »

Ce qui distingue Bob de concurrents comme Cursor ou Claude Code, c'est le niveau de contrôle et de gouvernance qu'il impose sur les workflows agentiques. Là où d'autres outils placent le développeur au début de la tâche pour qu'il enchaîne les étapes manuellement, Bob introduit des points de contrôle humains structurés à intervalles réguliers, tout en permettant à des agents IA d'accomplir des tâches complexes en plusieurs étapes. Cette approche répond directement aux besoins des grandes entreprises, qui craignent les failles de sécurité et les défaillances d'orchestration lorsque des agents autonomes accèdent à des données en production. Pour les directions techniques et les équipes d'audit, la traçabilité et la capacité à intervenir à tout moment priment sur la vitesse.

Cette annonce s'inscrit dans une tension croissante dans l'industrie entre deux visions de l'IA agentique. D'un côté, des systèmes ouverts et autonomes comme OpenClaw ou NemoClaw de Nvidia, qui poussent les limites de l'automatisation dans des environnements bac à sable. De l'autre, des plateformes comme Bob qui privilégient la fiabilité, l'auditabilité et la supervision humaine. OpenAI a récemment ajouté dans son Agents SDK un support pour des implémentations en bac à sable, tandis que Kilo lançait Kilo Claw centré sur la sécurité des agents autonomes. IBM, fort de ses décennies d'expérience dans les systèmes d'entreprise critiques, choisit délibérément la prudence. Sundaresan le dit sans détour : « Il vaut mieux ouvrir la grille lentement que de dire, 'oups, comment je la referme maintenant ?' »

Impact France/UE

Mistral, startup française, est intégrée nativement comme l'un des modèles supportés par Bob aux côtés de Claude et Granite, lui offrant une vitrine directe auprès des 80 000 développeurs IBM et renforçant la crédibilité des LLMs européens dans les environnements enterprise critiques.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

NemoClaw, analyse et prise en main de la « prison » pour sécuriser les agents IA
1Next INpact 

NemoClaw, analyse et prise en main de la « prison » pour sécuriser les agents IA

NVIDIA a présenté lors de sa conférence GTC un nouveau projet open source baptisé NemoClaw, actuellement en version alpha, conçu pour encadrer les agents IA et prévenir les comportements non souhaités. Présenté comme un environnement sécurisé, il intègre des garde-fous en matière de confidentialité et de sécurité, offrant aux utilisateurs un contrôle accru sur le comportement de leurs agents et la gestion de leurs données. L'annonce s'inscrit dans un contexte où la prolifération des agents IA soulève des questions de sécurité croissantes. Ces systèmes autonomes, capables d'accéder à des données personnelles et d'effectuer des actions en autonomie, représentent un risque réel si leur comportement n'est pas correctement contraint. NemoClaw répond à ce besoin en proposant une couche de contrôle structurée, particulièrement destinée à encadrer des agents comme OpenClaw. OpenClaw, anciennement connu sous les noms Clawdbot puis Moltbot, est un agent IA open source développé par Peter Steinberger, désormais employé chez OpenAI. Son principe : accéder à tout ou partie des données d'un utilisateur pour fonctionner comme assistant virtuel personnel. C'est précisément ce type d'accès étendu qui justifie l'existence d'une infrastructure de sécurité comme NemoClaw, pour s'assurer que l'agent ne dépasse pas les limites fixées. La mise à disposition en version alpha open source signale que NVIDIA cherche à impliquer la communauté dans la maturation du projet avant un déploiement plus large. Dans un secteur où la course aux agents autonomes s'accélère, la question du contrôle et de la gouvernance de ces systèmes devient un enjeu stratégique autant que technique.

OutilsOpinion
1 source
Des agents IA en production pour la conformite financiere : les lecons de Stripe
2AWS ML Blog 

Des agents IA en production pour la conformite financiere : les lecons de Stripe

Stripe, le géant américain des paiements en ligne, a déployé en production un système d'agents IA dédié à la conformité financière, développé sur Amazon Web Services avec Amazon Bedrock. L'entreprise traite 1 400 milliards de dollars de volume de paiements annuels dans 50 pays, en servant des millions d'entreprises allant des startups aux 62 % des sociétés du Fortune 500. Pour gérer les risques de fraude et respecter les obligations réglementaires à cette échelle, ses équipes de conformité devaient examiner des milliers de transactions chaque jour. Le système d'agents, conçu selon un cadre ReAct, a permis de réduire de 26 % le temps de traitement des dossiers, tout en obtenant un taux de satisfaction de 96 % auprès des analystes internes. Les décisions finales restent systématiquement entre les mains d'experts humains. Ce déploiement illustre un problème structurel que rencontrent toutes les grandes institutions financières : les analystes qualifiés passaient jusqu'à 80 % de leur temps à naviguer entre des systèmes fragmentés pour rassembler des documents, au lieu de réaliser des évaluations de risque à haute valeur ajoutée. L'agent IA automatise cette phase de pré-investigation et d'agrégation documentaire, libérant les équipes pour les jugements complexes. À l'échelle mondiale, le coût de la conformité financière est estimé à 206 milliards de dollars par an. L'approche de Stripe permettrait d'identifier 95 % des attaques par test de carte en temps réel et de réduire de 20 % les frictions inutiles pour les clients légitimes, tout en conservant la traçabilité intégrale exigée par les régulateurs grâce à des journaux d'audit immuables. La croissance rapide de Stripe, qui représente aujourd'hui environ 1,3 % du PIB mondial numérique, a rendu intenable une mise à l'échelle des équipes de conformité proportionnelle au volume de transactions. L'entreprise a opté pour une architecture en trois composantes : décomposition des tâches et orchestration des révisions, cadre d'agents ReAct, et services d'infrastructure dédiés. Une attention particulière a été portée à l'optimisation des coûts via le prompt caching et à la gouvernance, avec des workflows d'approbation configurables et des points de contrôle humains à chaque étape critique. Ce modèle, co-développé par les équipes de Stripe et d'AWS, est présenté comme une référence pour les organisations souhaitant industrialiser la conformité sans sacrifier la qualité ni l'auditabilité, dans un contexte où les régulateurs financiers du monde entier renforcent leurs exigences en matière de traçabilité des décisions assistées par IA.

UELes établissements financiers européens soumis aux obligations KYC/AML et aux futures exigences de traçabilité de l'AI Act peuvent s'appuyer sur ce retour d'expérience pour évaluer l'automatisation de leur conformité via des agents IA.

OutilsOutil
1 source
Claude Code lance l’auto mode, pour équilibrer l’autonomie de l’IA et la sécurité
3Blog du Modérateur 

Claude Code lance l’auto mode, pour équilibrer l’autonomie de l’IA et la sécurité

Anthropic franchit un nouveau cap dans l'automatisation des workflows de développement avec le lancement de l'auto mode pour Claude Code, son agent de codage en ligne de commande. Cette fonctionnalité permet à l'IA d'enchaîner les actions, lecture de fichiers, exécution de commandes, modifications du code, sans interrompre le développeur à chaque étape pour une validation manuelle. Le défi central de tout agent autonome reste le même : comment laisser l'IA agir librement tout en évitant les opérations destructrices ou irréversibles ? L'auto mode répond à cette tension en intercalant un classifieur IA entre chaque action et son exécution. Ce classifieur évalue en temps réel le niveau de risque de l'opération envisagée, décidant seul si l'action peut être effectuée sans supervision humaine. Pour les développeurs, cela représente un gain de fluidité significatif : fini les interruptions répétées pour approuver des actions routinières comme lire un fichier ou lancer des tests. L'architecture repose donc sur un double niveau d'intelligence : Claude Code planifie et exécute la tâche de développement, tandis qu'un modèle classifieur distinct joue le rôle de garde-fou. Cette séparation des responsabilités permet de calibrer l'autonomie sans sacrifier la sécurité. Anthropic positionne ainsi son agent comme adapté à des environnements de production réels, où une erreur de l'IA, suppression d'un fichier critique, exécution d'une commande système non souhaitée, peut avoir des conséquences sérieuses. Cette approche préfigure une tendance de fond dans le secteur : les agents IA de nouvelle génération ne cherchent plus simplement à être capables, mais à être dignes de confiance. En intégrant le contrôle directement dans la boucle d'exécution plutôt qu'en le déléguant entièrement à l'utilisateur, Anthropic propose un modèle de gouvernance de l'autonomie qui pourrait devenir une référence pour l'ensemble de l'industrie des agents de développement.

OutilsOutil
1 source
IBM lance la plateforme IA Bob pour maîtriser les coûts du cycle de développement logiciel
4AI News 

IBM lance la plateforme IA Bob pour maîtriser les coûts du cycle de développement logiciel

IBM a lancé Bob, une plateforme d'intelligence artificielle conçue pour encadrer et rationaliser l'ensemble du cycle de développement logiciel en entreprise. L'annonce a été portée par Dinesh Nirmal, vice-président senior d'IBM Software, qui a résumé l'enjeu : « Chaque entreprise cherche à se moderniser, mais la vitesse sans contrôle est un risque. IBM Bob permet aux entreprises d'avancer à la vitesse de l'IA sans sacrifier la gouvernance et la sécurité. » La plateforme s'intègre directement dans le cycle de vie logiciel complet, avec des modes basés sur des profils utilisateurs, des appels d'outils automatisés et des contrôles humains à chaque étape critique. L'un de ses premiers cas d'usage concrets est APIS IT, une entreprise qui a déployé Bob pour moderniser des systèmes gouvernementaux chargés de décennies de dette technique sur des environnements mainframe et .NET. Résultat : une analyse d'architecture et une documentation produites dix fois plus vite, avec une précision de 100 % sur des systèmes JCL/PL1 vieillissants, et des migrations de services .NET réalisées en quelques heures au lieu de plusieurs semaines. L'enjeu est massif : entre 60 et 80 % du budget d'ingénierie des grandes organisations est absorbé par la maintenance et la mise à niveau de systèmes existants, des projets qui s'étirent souvent sur des mois. Les assistants de code classiques aggravent le problème lorsqu'ils sont utilisés sans garde-fous, car ils génèrent du code syntaxiquement correct mais fonctionnellement inutile, incapable de comprendre les bibliothèques internes ou la logique propriétaire d'une entreprise. Bob répond à ce problème en cartographiant d'abord les dépendances avant toute refactorisation, puis en coordonnant des agents spécialisés pour les tests, la documentation et l'intégration continue. Le système utilise une orchestration multi-modèles dynamique : les tâches simples sont routées vers des modèles légers et économiques, tandis que les raisonnements architecturaux complexes mobilisent des modèles de pointe comme Claude d'Anthropic, Mistral ou IBM Granite. Ce lancement s'inscrit dans une course plus large à l'automatisation du développement logiciel en entreprise, un marché où GitHub Copilot, Google Gemini Code Assist et des dizaines de startups se disputent déjà les contrats. IBM mise sur une différenciation claire : là où ses concurrents proposent des assistants de productivité individuelle, Bob cible la gouvernance à l'échelle de l'organisation, avec une traçabilité des coûts et une transparence sur les dépenses IA directement liées aux résultats en production. La capacité à gérer des environnements mainframe, souvent ignorés par les nouveaux entrants du marché, constitue un avantage stratégique pour IBM auprès de ses clients traditionnels dans la finance, les assurances et le secteur public, des industries où la dette technique se chiffre en milliards et où la compliance réglementaire n'est pas négociable.

UEIBM Bob cible explicitement les secteurs finance, assurance et secteur public, où les DSI françaises et européennes gèrent d'importantes dettes techniques sous contraintes réglementaires strictes.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic