Aller au contenu principal
OutilsAWS ML Blog · 2 min de lecture

Se retire de l'extraction d'informations web automatisée par Amazon Bedrock AgentCore

Source originale ↗·

Amazon a présenté une solution technique permettant d'automatiser l'extraction d'informations à partir de sites web, construite autour d'Amazon Bedrock AgentCore, une plateforme dédiée à la création et à l'exploitation d'agents IA à grande échelle. Le système combine plusieurs services cloud : AgentCore Browser, un navigateur entièrement géré capable de restituer les pages riches en JavaScript, Amazon Bedrock pour l'analyse par IA, Amazon OpenSearch Serverless pour la recherche sémantique, et AWS Lambda pour l'orchestration. Concrètement, une règle Amazon EventBridge déclenche toutes les 15 minutes une fonction Lambda qui vérifie les flux RSS configurés et élimine les doublons via Amazon S3. Pour chaque nouvel article détecté, une session de navigateur s'ouvre via AgentCore et se connecte grâce à Playwright par le protocole Chrome DevTools (CDP) : contrairement à une simple requête HTTP, ce navigateur distant charge la page entière, attend le rendu des éléments dynamiques, capture une image d'écran et télécharge les visuels, avant que ces éléments ne soient stockés dans S3 dans un format structuré. Chaque dépôt sur S3 déclenche ensuite un message via Amazon SQS pour lancer le traitement par IA. Le code complet est disponible sur GitHub.

L'enjeu pour les entreprises est de taille : suivre manuellement des dizaines de sites concurrents, de blogs sectoriels ou de publications réglementaires est chronophage et repose sur des scrapers classiques, fragiles par nature, puisqu'ils dépendent étroitement de la structure des pages. Une simple refonte d'un site ou une migration vers un frontend en JavaScript peut casser silencieusement un pipeline pendant plusieurs jours sans que l'équipe s'en aperçoive. En rendant le rendu des pages plus fiable, AgentCore Browser réduit ce risque et permet à des équipes design, marketing ou produit de suivre en continu les nouveautés d'un concurrent, les changements de tarification ou les signaux faibles d'un marché, sans intervention manuelle quotidienne.

Cette architecture événementielle, qui sépare la collecte de contenu du traitement par IA, illustre une tendance plus large : l'automatisation de la veille par des agents capables de naviguer le web comme un humain plutôt que par des scripts rigides. Les cas d'usage identifiés par Amazon couvrent l'intelligence concurrentielle, la veille marché, la curation de contenu et la surveillance réglementaire. La recherche sémantique via des embeddings vectoriels dans OpenSearch Serverless permet ensuite d'interroger l'ensemble des informations collectées en langage naturel plutôt que par mots-clés exacts, ouvrant la voie à des tableaux de bord de veille alimentés en continu et consultables via une interface web.

Impact France/UE

Les entreprises françaises et européennes pourraient adopter cette architecture AWS pour automatiser leur veille concurrentielle et réglementaire, sans qu'aucune loi ou institution européenne ne soit directement concernée.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Amazon Bedrock Data Automation : améliorer la précision de l'extraction de plans
1AWS ML Blog 

Amazon Bedrock Data Automation : améliorer la précision de l'extraction de plans

Amazon Web Services a enrichi son service Amazon Bedrock Data Automation (BDA) d'une fonctionnalité appelée "blueprint instruction optimization", conçue pour améliorer automatiquement la précision d'extraction de données structurées à partir de documents non structurés, factures, contrats, formulaires fiscaux ou dossiers d'inscription. Le principe repose sur des blueprints, des schémas personnalisables qui définissent les champs à extraire (numéro de commande, montant total, date, demandes spéciales) accompagnés d'instructions en langage naturel guidant le modèle. Jusqu'ici, lorsqu'un champ était mal extrait, les équipes devaient affiner manuellement ces instructions en boucle. Désormais, il suffit de fournir entre trois et dix documents d'exemple avec les valeurs attendues : BDA analyse les écarts entre ses résultats et la vérité terrain, puis reformule automatiquement les instructions de chaque champ en quelques minutes. Aucun fine-tuning de modèle séparé n'est nécessaire. L'impact est direct pour les équipes en charge de l'automatisation documentaire dans les entreprises. Traiter des documents provenant de centaines de fournisseurs différents posait un problème structurel : les libellés varient ("subtotal" vs "total"), les mises en page changent selon les périodes ou les partenaires, et la qualité des scans dégrade encore la reconnaissance. Ce cycle d'itération manuelle pouvait prendre plusieurs semaines par type de document. Avec cette optimisation automatisée, ce délai tombe à quelques minutes, ce qui réduit considérablement le coût de mise en production de pipelines de traitement intelligent de documents (IDP). Les organisations qui gèrent de grands volumes documentaires, assureurs, cabinets comptables, services achats, sont les premières bénéficiaires. Cette annonce s'inscrit dans la stratégie d'AWS visant à rendre l'automatisation documentaire accessible sans expertise en machine learning. Amazon Bedrock Data Automation, lancé pour unifier classification, extraction, normalisation et validation via une seule API, fait face à une concurrence croissante d'acteurs spécialisés comme Google Document AI ou Microsoft Azure Form Recognizer, ainsi que de solutions fondées sur des modèles de vision généralistes. En supprimant la nécessité de fine-tuner un modèle tout en automatisant le travail d'ingénierie des prompts, AWS réduit la barrière d'entrée pour les équipes métier. La prochaine étape logique serait d'étendre cette optimisation à des flux documentaires plus complexes impliquant plusieurs types de documents interconnectés, un enjeu central pour des secteurs comme la finance ou la santé.

UELes entreprises françaises et européennes gérant de grands volumes documentaires (assureurs, cabinets comptables, services achats) peuvent réduire leurs délais de mise en production de pipelines d'extraction documentaire de plusieurs semaines à quelques minutes, sans expertise en machine learning.

OutilsOutil
1 source
Créer des agents d'automatisation de tableaux de bord propulsés par l'IA avec le NLP sur Amazon Bedrock AgentCore
2AWS ML Blog 

Créer des agents d'automatisation de tableaux de bord propulsés par l'IA avec le NLP sur Amazon Bedrock AgentCore

Amazon Web Services a dévoilé une solution d'automatisation de tableaux de bord basée sur l'intelligence artificielle, combinant trois de ses services : Amazon Bedrock AgentCore, le framework Strands Agents et Amazon QuickSight. L'architecture repose sur un système multi-agents composé de trois entités spécialisées : un agent de découverte (Find Dashboard Agent) chargé d'explorer les tableaux de bord et leurs métadonnées, un agent de modification (Modify Dashboard Agent) qui exécute les changements de configuration et crée de nouvelles versions, et un agent orchestrateur qui route les requêtes en langage naturel vers les agents appropriés. Concrètement, un analyste peut saisir une instruction comme "Ajoute le champ 'lastname' au tableau de bord testing" et le système interprète, valide et déploie la modification de façon autonome, tout en conservant une version originale pour permettre un retour arrière si nécessaire. L'enjeu est significatif pour les équipes métier : là où les processus traditionnels imposent plusieurs jours d'attente, soumission d'une demande à l'IT, interprétation des besoins, navigation dans la documentation d'API, déploiement, cette approche réduit le délai à quelques secondes. Le modèle de langage Amazon Nova assure la classification des requêtes entre interactions conversationnelles simples et opérations techniques réelles. Les modifications sont validées contre les colonnes disponibles dans les datasets avant exécution, ce qui maintient les contrôles de sécurité et génère des pistes d'audit. Pour les entreprises dont les décisions dépendent de données fraîches et de visualisations actualisées, supprimer ce goulot d'étranglement entre l'expression d'un besoin et sa concrétisation dans un dashboard représente un gain opérationnel direct. Cette solution s'inscrit dans la dynamique plus large d'AWS de rendre Amazon Bedrock AgentCore accessible comme plateforme d'hébergement d'agents en production, sans gestion d'infrastructure. La mémoire de session intégrée (AgentCore Memory) maintient le contexte des conversations, tandis que le module d'observabilité enregistre les décisions des agents et trace les appels API, deux composantes critiques pour déployer des agents autonomes dans des environnements d'entreprise régulés. Le framework Strands Agents, orienté code-first avec intégration native aux services AWS, positionne AWS face à des concurrents comme LangChain ou AutoGen sur le terrain des orchestrateurs d'agents. La prochaine étape logique pour ce type de système serait d'étendre la couverture au-delà de QuickSight vers d'autres services de données, voire de permettre aux agents de proposer eux-mêmes des modifications pertinentes en détectant des anomalies dans les métriques surveillées.

UELes équipes analytiques européennes utilisant des services de BI cloud pourraient réduire leurs délais de modification de tableaux de bord de plusieurs jours à quelques secondes, sans impact réglementaire direct sur la France ou l'UE.

OutilsOutil
1 source
Amazon Bedrock AgentCore intègre la recherche web
3AWS ML Blog 

Amazon Bedrock AgentCore intègre la recherche web

Amazon a annoncé la disponibilité générale de Web Search on Amazon Bedrock AgentCore, une fonctionnalité de recherche web entièrement gérée et compatible avec le protocole MCP (Model Context Protocol). Concrètement, elle permet aux agents d'IA déployés sur Bedrock d'accéder en temps réel à des informations issues du web, sans que les équipes techniques aient à gérer une API de recherche tierce, des clés d'accès, des quotas ou du code d'extraction de résultats. Le service s'intègre via l'AgentCore Gateway avec une simple authentification IAM ou JWT, et les agents le découvrent via un appel standard tools/list, comme n'importe quel autre outil MCP. Derrière ce connecteur repose un index web propriétaire maintenu par Amazon, couvrant des dizaines de milliards de documents, mis à jour en continu avec un délai de rafraîchissement de quelques minutes. Le service inclut également un graphe de connaissances pour les réponses factuelles à haute confiance, et une extraction sémantique de passages optimisée pour les fenêtres de contexte des modèles de langage. L'ensemble du trafic de requêtes reste dans l'infrastructure AWS, sans transmission externe. L'enjeu est structurel pour quiconque construit des agents d'IA en production : ces systèmes ont une connaissance figée à la date de leur entraînement. Interroger un agent sur un cours de bourse, un score sportif ou une annonce publiée il y a une heure retourne au mieux une réponse périmée, au pire une hallucination confiante. Web Search on AgentCore supprime ce plafond sans imposer aux équipes de construire et maintenir elles-mêmes une infrastructure de recherche, tâche qui représente en réalité plusieurs projets distincts, gestion des quotas, normalisation des formats, politique de rétention des données, fraîcheur de l'index. Pour les entreprises qui déploient des agents sur des cas d'usage temps réel (veille concurrentielle, support client, analyse de marché), la disponibilité générale de ce service réduit significativement le coût et la complexité d'un composant jusqu'ici souvent bricolé. Ce lancement s'inscrit dans la montée en puissance des architectures agentiques au sein des grands fournisseurs cloud, où Amazon, Google et Microsoft se disputent le rôle de plateforme de référence pour les agents d'entreprise. L'adoption du protocole MCP comme standard d'interopérabilité est un signal fort : Amazon ne cherche pas à enfermer les développeurs dans un écosystème propriétaire, mais à s'imposer comme couche d'infrastructure de confiance. La proposition de valeur repose sur trois piliers que les solutions tierces peinent à réunir simultanément : fraîcheur de l'index, confidentialité des requêtes garantie dans AWS, et qualité de l'extraction pour les modèles. La prochaine étape logique sera probablement l'intégration native avec d'autres outils AgentCore (mémoire, orchestration multi-agents), consolidant Bedrock comme environnement d'exécution complet pour les agents d'IA en production.

UELes entreprises européennes déployant des agents IA sur AWS Bedrock bénéficient d'un accès simplifié à la recherche web en temps réel, sans infrastructure de recherche tierce à maintenir.

💬 Ce qui me frappe plus que la feature en elle-même, c'est qu'Amazon a choisi MCP plutôt qu'une API proprio. En faisant ça, Bedrock se positionne comme couche d'infrastructure neutre pour les agents enterprise, pas comme un silo de plus, et c'est le genre de pari discret qui pèse plus lourd que ça en a l'air dans les décisions d'architecture. Si tu construis des agents avec des besoins temps réel, tu viens de perdre une bonne excuse pour bricoler ta propre pile de recherche.

OutilsOutil
1 source
Amazon Bedrock AgentCore au service des stratégies de vente par agents IA
4AWS ML Blog 

Amazon Bedrock AgentCore au service des stratégies de vente par agents IA

AWS a déployé en interne un assistant conversationnel baptisé Field Advisor, construit sur Amazon Bedrock AgentCore, pour résoudre un problème concret apparu dans ses propres équipes commerciales mondiales : la prolifération d'agents IA spécialisés sans coordination centrale. L'organisation AWS Sales utilisait plus de 20 agents distincts couvrant la gestion CRM, la planification de réunions, les recommandations produits, les analyses clients et les vérifications de conformité. Les représentants commerciaux devaient eux-mêmes choisir quel agent invoquer selon la tâche, gérer les changements de contexte entre systèmes fragmentés et assembler manuellement les résultats, une charge cognitive qui réduisait d'autant le temps passé avec les clients. Field Advisor agit comme une couche d'orchestration centrale : les commerciaux posent leurs questions en langage naturel, et le système route automatiquement les requêtes vers l'agent ou l'outil approprié, maintient le contexte conversationnel entre les interactions et livre une réponse unifiée via une interface unique. L'impact est concret pour les équipes de vente : Field Advisor s'intègre directement dans les outils déjà utilisés au quotidien, systèmes CRM, Slack, applications internes, évitant toute rupture de flux de travail. Le système inclut des mécanismes de validation humaine pour les opérations sensibles : avant de modifier des données CRM, il présente les changements proposés et attend une approbation explicite, ce qui préserve la fiabilité des données et la responsabilité des commerciaux. La mémoire persistante, combinant historique de session à court terme et mémoire sémantique à long terme, permet aux représentants de reprendre une conversation là où elle s'était arrêtée sans avoir à répéter le contexte à chaque interaction. L'ensemble de ces fonctionnalités réduit la charge opérationnelle et libère du temps pour les échanges à valeur ajoutée avec les clients. Ce projet illustre un défi structurel qui émerge dans de nombreuses grandes entreprises à mesure que l'adoption des agents IA s'accélère : la multiplication d'agents spécialisés crée paradoxalement une nouvelle complexité si aucune orchestration ne les unifie. AWS a choisi Bedrock AgentCore précisément pour ses capacités natives à l'échelle enterprise, environnements d'exécution isolés pour les opérations multi-locataires sécurisées, passerelle unifiée pour les outils et agents répartis sur plusieurs comptes AWS, propagation d'identité cohérente via OAuth et observabilité intégrée sur les flux complexes. En s'appuyant sur une infrastructure clé en main plutôt que sur du développement sur mesure, l'équipe d'ingénierie a pu concentrer ses efforts sur la logique métier plutôt que sur les fondations techniques. Field Advisor représente ainsi autant un cas d'usage commercial qu'une démonstration de la viabilité d'AgentCore comme substrat pour des déploiements agentiques en production à grande échelle.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic