Aller au contenu principal
Accélérer la reconnaissance d'entités personnalisées avec les outils Claude dans Amazon Bedrock
OutilsAWS ML Blog · 1 min de lecture

Accélérer la reconnaissance d'entités personnalisées avec les outils Claude dans Amazon Bedrock

Source originale ↗·

Amazon Bedrock intègre désormais une solution clé en main pour l'extraction d'entités personnalisées à partir de documents non structurés, en s'appuyant sur les capacités de Claude Tool use (aussi appelé function calling). Cette approche permet d'identifier et d'extraire des informations précises, noms, dates, adresses, sans entraînement de modèle préalable, simplement via des prompts en langage naturel.

L'enjeu est considérable pour les entreprises qui traitent de grands volumes de documents : factures, pièces d'identité, contrats. Les pipelines traditionnels d'extraction d'entités exigent des modèles spécialisés, des données d'entraînement étiquetées et une infrastructure dédiée. La combinaison Bedrock + Claude court-circuite cette complexité en rendant le processus dynamique et adaptable à tout type de document, sans configuration lourde.

L'architecture proposée est entièrement serverless et s'appuie sur trois services AWS : Amazon S3 reçoit les documents uploadés, AWS Lambda se déclenche automatiquement à chaque dépôt de fichier et interroge Amazon Bedrock, qui invoque Anthropic Claude pour extraire les entités. Les résultats sont tracés dans Amazon CloudWatch. L'exemple concret retenu est l'extraction de champs d'un permis de conduire, un cas d'usage représentatif de la reconnaissance de documents d'identité en production.

La solution est conçue pour monter en charge automatiquement, qu'il s'agisse de traiter quelques dizaines ou plusieurs milliers de documents. Elle suit les bonnes pratiques AWS en matière de gestion des permissions IAM et d'inférence cross-région pour les modèles Claude, ouvrant la voie à des déploiements en production robustes sans dépendance à une infrastructure fixe.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Amazon SageMaker AI accélère les appels d'outils des agents autonomes avec la personnalisation de modèles sans serveur
1AWS ML Blog 

Amazon SageMaker AI accélère les appels d'outils des agents autonomes avec la personnalisation de modèles sans serveur

Amazon a introduit une fonctionnalité de personnalisation de modèles sans serveur dans SageMaker AI, permettant aux équipes d'améliorer drastiquement les capacités d'appel d'outils des agents IA sans gérer d'infrastructure GPU. Dans un cas concret publié début avril 2026, des ingénieurs ont affiné le modèle Qwen 2.5 7B Instruct en utilisant la technique RLVR (Reinforcement Learning with Verifiable Rewards) et ont obtenu une amélioration de 57% du score de qualité des appels d'outils sur des scénarios inédits, c'est-à-dire des outils que le modèle n'avait jamais vus lors de l'entraînement. La méthode repose sur un principe simple : le modèle génère huit réponses candidates par prompt, une fonction de récompense vérifie lesquelles sont correctes, et l'algorithme GRPO (Group Relative Policy Optimization) renforce les comportements qui surpassent la moyenne du groupe. SageMaker AI prend en charge les familles de modèles Amazon Nova, Llama, Qwen et DeepSeek, avec un suivi des métriques via MLflow intégré. L'enjeu est concret : les agents IA en production échouent fréquemment lors des appels d'outils, qu'il s'agisse d'halluciner des fonctions inexistantes, de passer des paramètres incorrects, ou de déclencher une action là où ils devraient demander une clarification. Ces erreurs bloquent le déploiement en production et détruisent la confiance des utilisateurs. La nouvelle approche serverless d'Amazon supprime l'obstacle opérationnel majeur que représentait jusqu'ici le fine-tuning par renforcement : achat de GPU, orchestration mémoire entre les phases de rollout et d'entraînement, infrastructure de récompenses, gestion des checkpoints. Les équipes peuvent désormais se concentrer sur leurs données, leur modèle et leur fonction de récompense, le reste étant géré par la plateforme. Le fine-tuning supervisé classique (SFT) montre ses limites pour ce type de tâche : il nécessite des exemples étiquetés pour chaque comportement souhaité, mais peine à généraliser la prise de décision entre appeler un outil, demander des informations supplémentaires, ou refuser d'agir. RLVR contourne ce problème en exploitant la nature vérifiable des appels d'outils : soit le modèle a appelé la bonne fonction avec les bons paramètres, soit non. Cette objectivité binaire rend l'appel d'outils particulièrement adapté à l'apprentissage par renforcement. Amazon positionne cette offre dans un marché de l'IA agentique en forte croissance, où des acteurs comme Google (Vertex AI), Microsoft (Azure ML) et des startups spécialisées se disputent les équipes qui cherchent à industrialiser des agents fiables, avec un accès simplifié via SageMaker Studio et un compte AWS standard.

OutilsActu
1 source
Des évaluateurs personnalisés basés sur du code dans Amazon Bedrock AgentCore
2AWS ML Blog 

Des évaluateurs personnalisés basés sur du code dans Amazon Bedrock AgentCore

Amazon a lancé les évaluateurs personnalisés basés sur du code dans Amazon Bedrock AgentCore Evaluations, une fonctionnalité permettant aux équipes de développement d'intégrer des fonctions AWS Lambda comme moteur d'évaluation pour leurs agents IA. Contrairement aux juges LLM classiques, ces évaluateurs produisent des résultats déterministes : le même input donne toujours le même score. Ils peuvent être utilisés en mode on-demand, comme porte de validation dans les pipelines CI/CD, ou en mode online pour scorer du trafic de production en temps réel. L'annonce a été portée par une équipe pluridisciplinaire incluant Stephanie Yuan, Lefan Zhang, Ritvika Pillai, Vivek Singh et plusieurs ingénieurs et chefs de produit d'AWS. Pour les entreprises des secteurs financiers et spécialisés, cette capacité répond à des exigences concrètes que les LLM-as-a-Judge ne couvrent pas bien. Un agent de veille de marchés financiers doit citer des cours boursiers dans une fourchette de tolérance configurable, respecter un workflow d'identification du courtier avant d'accéder aux profils clients, retourner des sorties d'outils conformes à un schéma JSON strict, et ne jamais exposer d'informations personnelles identifiables. Un LLM est sujet à des erreurs arithmétiques, peut coûter cher à chaque appel, et ne convient pas à la vérification de règles objectives. Un évaluateur en code appelle directement le système de référence, calcule l'écart de tolérance, et signale chaque anomalie avec une précision que même un écart de 0,1 % peut déclencher, un seuil qui peut influencer une décision de trading. Le lancement s'inscrit dans un problème plus large que rencontre l'industrie : la transition des agents IA du prototype vers la production. Un agent fonctionnel en démo peut, en conditions réelles, produire des données mal formées suite à un bug de parsing ou une panne d'API tierce, divulguer des données confidentielles par inadvertance, ou ne pas respecter l'ordre des appels d'outils requis par une politique interne. Amazon propose désormais quatre dimensions d'évaluation adaptées au code : la validation de schéma des réponses d'outils, la précision numérique par rapport à une source de référence, la conformité au contrat de workflow, et la détection de PII ou de secrets via des services externes comme Amazon Comprehend. Ces évaluateurs peuvent être combinés avec les évaluateurs intégrés d'AgentCore et fonctionnent indépendamment du framework agent utilisé en production. L'enjeu est de donner aux équipes un filet de sécurité déterministe là où les capacités linguistiques des LLM atteignent leurs limites.

OutilsOutil
1 source
Des workflows guidés par agents pour accélérer la personnalisation de modèles dans Amazon SageMaker AI
3AWS ML Blog 

Des workflows guidés par agents pour accélérer la personnalisation de modèles dans Amazon SageMaker AI

Amazon a lancé une expérience agentique intégrée dans SageMaker AI pour simplifier radicalement la personnalisation des modèles de langage. Jusqu'ici, adapter un modèle fondation à un cas d'usage métier exigeait de maîtriser des techniques comme le Supervised Fine-Tuning (SFT), le Direct Preference Optimization (DPO) ou le Reinforcement Learning Verifiable Rewards (RLVR), de naviguer entre des APIs fragmentées et des formats de données spécifiques à chaque modèle, et de gérer des cycles d'expérimentation qui s'étiraient sur plusieurs mois. Désormais, un développeur peut décrire son cas d'usage en langage naturel, et l'agent de codage prend en charge l'ensemble du parcours: définition du problème, préparation des données, sélection de la technique d'entraînement, évaluation de la qualité du modèle, puis déploiement vers Amazon Bedrock ou un endpoint SageMaker AI. Amazon Kiro, l'agent de développement logiciel d'Amazon, est préconfiguré par défaut dans l'environnement JupyterLab de SageMaker AI Studio, avec complétion de code, débogage assisté et support interactif. Les agents compatibles avec le protocole ACP (Agent Communication Protocol), dont Claude Code d'Anthropic, peuvent également être intégrés et bénéficier des mêmes fonctionnalités. La version 4.1 ou supérieure de SageMaker AI Distribution est requise, ainsi qu'un rôle IAM avec la politique gérée AmazonSageMakerFullAccess. Le coeur du dispositif repose sur des "Skills", des modules d'instructions préconçus et modulaires qui encapsulent l'expertise AWS et data science sur l'ensemble du cycle de personnalisation. Lorsqu'un développeur décrit son besoin, l'agent active automatiquement les Skills pertinents, qui le guident à travers la validation des données, la configuration des hyperparamètres et l'évaluation du modèle via des métriques LLM-as-a-Judge. Chaque étape génère des notebooks directement exécutables, entièrement modifiables et réutilisables dans des workflows existants. Un avantage opérationnel concret: les Skills réduisent la consommation de tokens tout en augmentant la précision des réponses, car l'agent dispose d'un contexte spécialisé plutôt que de connaissances génériques. Les organisations peuvent personnaliser ces Skills pour les aligner sur leurs standards de gouvernance, leurs outils internes et leurs pratiques d'équipe, résolvant ainsi un problème récurrent avec les assistants de codage généralistes qui ne reproduisent pas de manière fiable les conventions maison. L'annonce s'inscrit dans une dynamique plus large où la personnalisation des modèles devient le principal levier de différenciation concurrentielle, tous les acteurs ayant accès aux mêmes modèles fondations publics. Amazon positionne SageMaker AI comme une plateforme bout-en-bout pour les équipes qui veulent exploiter leurs données propriétaires sans assembler elles-mêmes une chaîne d'outils dispersés. La prise en charge du protocole ACP ouvre la voie à un écosystème d'agents tiers, signalant une stratégie d'interopérabilité plutôt que de verrouillage. Les prochaines étapes naturelles incluent l'extension de ce type d'expérience agentique à d'autres phases du cycle MLOps, comme la surveillance des modèles en production ou la gestion des dérives de données.

UELes équipes data européennes utilisant AWS SageMaker AI peuvent accélérer leurs projets de fine-tuning de modèles fondation sans expertise MLOps avancée, réduisant les délais de personnalisation sur données propriétaires.

OutilsOutil
1 source
HippoRAG : RAG neuro-inspiré avec Amazon Bedrock, Amazon Neptune et un PageRank personnalisé
4AWS ML Blog 

HippoRAG : RAG neuro-inspiré avec Amazon Bedrock, Amazon Neptune et un PageRank personnalisé

HippoRAG est un nouveau framework RAG (Retrieval Augmented Generation) inspiré du système de mémoire hippocampique du cerveau humain, conçu pour mieux gérer les tâches de raisonnement multi-sauts qui nécessitent de relier des informations dispersées entre plusieurs documents. L'implémentation présentée s'appuie entièrement sur l'infrastructure AWS: Amazon Bedrock fournit les capacités de modèle de langage pour extraire les triplets du graphe de connaissances et identifier les entités nommées, Amazon Neptune Database stocke la structure du graphe, Amazon Neptune Analytics exécute les algorithmes de graphe avancés, notamment le Personalized PageRank pour le classement de pertinence, et Amazon Titan Embeddings génère les représentations vectorielles du texte. Le pipeline de données démarre à partir du jeu de données HotpotQA au format JSON: une classe nommée HotpotQANeptuneImporter orchestre la lecture du fichier source, la génération de fichiers CSV compatibles avec le chargeur en masse de Neptune, leur envoi vers un bucket Amazon S3, puis leur chargement effectif dans le cluster Neptune. Les prérequis incluent un compte AWS avec accès à Bedrock et Neptune, un cluster Neptune configuré, un graphe Neptune Analytics créé à partir de celui-ci, ainsi que les permissions IAM nécessaires pour Bedrock, Neptune, Neptune Analytics et S3. L'intérêt de cette approche tient au fait que les méthodes RAG classiques traitent chaque document de façon isolée, ce qui les rend peu efficaces dès qu'une question exige de croiser des informations provenant de plusieurs sources différentes. En s'appuyant sur un graphe de connaissances et sur l'algorithme Personalized PageRank pour la recherche de pertinence, HippoRAG permet une récupération multi-sauts en une seule étape, là où les architectures RAG traditionnelles ont souvent besoin de plusieurs itérations successives pour reconstituer le fil du raisonnement. Pour les entreprises qui déploient des systèmes de questions-réponses ou de recherche documentaire à grande échelle, cela promet des réponses plus précises sur des requêtes complexes, tout en conservant la fiabilité et la scalabilité des services managés d'AWS plutôt que de dépendre d'une infrastructure de graphe maison. Cette architecture s'inscrit dans la théorie de l'indexation hippocampique de la mémoire à long terme, selon laquelle le néocortex traite les informations perceptives tandis que l'hippocampe construit un index d'associations entre les souvenirs, permettant au cerveau humain d'intégrer efficacement des expériences variées. C'est cette division des rôles que le système technique cherche à reproduire, en séparant le traitement du langage confié à Bedrock de l'indexation relationnelle confiée à Neptune. À mesure que les entreprises accumulent des bases documentaires massives et hétérogènes, ce type d'approche hybride, combinant graphes de connaissances et grands modèles de langage, pourrait devenir un standard pour dépasser les limites actuelles du RAG classique, avec des extensions envisageables vers d'autres jeux de données que HotpotQA et vers des cas d'usage d'entreprise plus larges.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic