Aller au contenu principal
OutilsAWS ML Blog · 1 min de lecture

Utiliser RAG pour la génération vidéo avec Amazon Bedrock et Amazon Nova Reel

Source originale ↗·

La génération vidéo par intelligence artificielle franchit un nouveau cap avec l'introduction d'un pipeline Video Retrieval Augmented Generation (VRAG) développé sur les services cloud d'Amazon Web Services. Cette approche combine la récupération d'images pertinentes et la génération vidéo automatisée pour produire des contenus visuels personnalisés à partir de simples descriptions textuelles, surmontant ainsi la principale limite des modèles génératifs actuels, cantonnés à leurs données d'entraînement.

L'enjeu est considérable pour des secteurs entiers. La publicité, la production médiatique, l'éducation et le jeu vidéo peinent aujourd'hui à exploiter la génération vidéo IA faute de contrôle suffisant sur le contenu produit. En ancrant la génération dans une bibliothèque d'images réelles indexées, le pipeline VRAG permet une personnalisation précise, transformant un simple prompt comme "une agence de voyage veut illustrer une destination" en séquences vidéo cohérentes et fidèles à l'univers visuel de la marque.

Techniquement, la solution repose sur quatre composants AWS : Amazon Bedrock comme socle d'orchestration, Amazon Nova Reel pour la génération vidéo, le moteur vectoriel d'Amazon OpenSearch Service pour la recherche sémantique d'images, et Amazon S3 pour le stockage. Le workflow est entièrement automatisé : l'utilisateur fournit un objet d'intérêt (ex. : "ciel bleu") et un prompt d'action (ex. : "la caméra pivote dans le sens horaire"), le système récupère l'image la plus pertinente, génère la vidéo en mode asynchrone, puis stocke et télécharge automatiquement le résultat. Le traitement par lots via un fichier prompts.txt permet de produire plusieurs vidéos en une seule exécution.

Le potentiel applicatif est immédiat : création de vidéos pédagogiques puisant dans une base de connaissances illustrées, spots publicitaires ciblés alignés sur des profils démographiques précis, ou contenus personnalisés adaptés aux centres d'intérêt de chaque utilisateur. Cette approche VRAG représente une évolution structurelle dans la production vidéo assistée par IA, en faisant du contexte documentaire, et non plus du seul modèle, le véritable moteur de la personnalisation.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1AWS ML Blog 

Optimiser la recherche sémantique vidéo avec la distillation de modèles Amazon Nova sur Amazon Bedrock

Amazon Web Services a publié un tutoriel détaillé expliquant comment utiliser la technique de distillation de modèles sur Amazon Bedrock pour optimiser les systèmes de recherche sémantique vidéo. Le cœur du problème : les modèles de grande taille comme Claude Haiku d'Anthropic offrent une excellente précision pour interpréter l'intention de recherche des utilisateurs, mais ils allongent le temps de réponse à 2 à 4 secondes, représentant à eux seuls 75 % de la latence totale. La solution proposée consiste à transférer l'intelligence de routage d'un grand modèle dit "enseignant", Amazon Nova Premier, vers un modèle beaucoup plus léger dit "étudiant", Amazon Nova Micro. Le résultat : une réduction des coûts d'inférence de plus de 95 % et une baisse de la latence de 50 %, sans sacrifier la qualité de routage. L'enjeu est considérable pour les entreprises qui gèrent de larges catalogues vidéo. Lorsqu'un utilisateur tape "Olivia qui parle de son enfance dans la pauvreté", le système doit décider automatiquement quels aspects de la vidéo interroger en priorité : les métadonnées textuelles, la transcription audio, les données visuelles ou les informations structurées. Cette logique de routage devient rapidement complexe à l'échelle enterprise, où les attributs peuvent inclure les angles de caméra, le sentiment, les droits de diffusion ou des taxonomies métier propriétaires. Un modèle plus petit et distillé qui maîtrise cette tâche précise permet de traiter davantage de requêtes simultanément, à un coût marginal quasi nul, ce qui change fondamentalement l'équation économique des moteurs de recherche multimodaux. La distillation de modèles se distingue du fine-tuning supervisé classique par un avantage pratique majeur : elle ne nécessite pas de dataset entièrement étiqueté par des humains. Amazon Bedrock génère automatiquement jusqu'à 15 000 paires prompt-réponse en interrogeant le modèle enseignant, en appliquant des techniques de synthèse et d'augmentation de données. Dans ce pipeline, 10 000 exemples synthétiques ont été produits via Nova Premier, chargés sur Amazon S3, puis utilisés pour entraîner Nova Micro. Le modèle résultant est ensuite évalué via Amazon Bedrock Model Evaluation, comparé à la base Nova Micro et au Claude Haiku original. AWS a publié l'intégralité du notebook Jupyter, le script de génération des données et les utilitaires d'évaluation sur GitHub, rendant cette approche reproductible pour toute équipe souhaitant industrialiser la recherche vidéo à grande échelle.

OutilsTuto
1 source
2AWS ML Blog 

Génération SQL à partir de texte : une approche économique avec Amazon Nova Micro et Bedrock

Amazon Web Services propose une nouvelle approche pour déployer des modèles de langage spécialisés dans la génération de requêtes SQL à partir du langage naturel, en combinant l'optimisation LoRA (Low-Rank Adaptation) avec l'inférence serverless d'Amazon Bedrock. Le modèle ciblé est Amazon Nova Micro, un modèle fondation léger disponible sur Bedrock. La solution a été testée sur un volume de 22 000 requêtes mensuelles pour un coût de seulement 0,80 dollar par mois, contre des dépenses bien supérieures avec une infrastructure hébergée en permanence. Deux chemins d'implémentation distincts sont proposés : l'un via la personnalisation gérée d'Amazon Bedrock, l'autre via des jobs d'entraînement Amazon SageMaker AI pour un contrôle plus fin des hyperparamètres. Les deux options convergent vers le même pipeline de déploiement sur Bedrock en inférence à la demande. Le jeu de données utilisé pour la démonstration est sql-create-context, une combinaison des datasets WikiSQL et Spider comprenant plus de 78 000 exemples de questions en langage naturel associées à des requêtes SQL de complexité variable. L'enjeu principal est économique : les modèles fine-tunés nécessitent traditionnellement une infrastructure dédiée tournant en continu, même en l'absence de trafic, ce qui génère des coûts fixes importants. Le modèle pay-per-token d'Amazon Bedrock élimine ce gaspillage en ne facturant que les tokens réellement traités. Pour les entreprises avec des dialectes SQL maison ou des schémas métier très spécifiques, cette combinaison rend accessible la personnalisation des LLMs sans engager de budget infrastructure significatif. Les équipes techniques gagnent également en simplicité opérationnelle : pas de gestion de serveurs, pas de scaling manuel, pas de surveillance d'infrastructure GPU. La génération SQL par IA est un cas d'usage critique en entreprise, car elle permet à des utilisateurs non-techniques d'interroger des bases de données en langage naturel. Les modèles généralistes gèrent bien le SQL standard, mais échouent sur les dialectes propriétaires ou les schémas complexes propres à chaque organisation. Le fine-tuning résout ce problème, mais introduisait jusqu'ici un compromis coûteux. AWS positionne ici Bedrock comme une infrastructure mutualisée capable d'héberger des adaptateurs LoRA à la demande, une approche qui pourrait devenir un standard pour les déploiements d'IA spécialisée à faible volume. La maturité croissante des outils de personnalisation cloud laisse entrevoir une généralisation de ce modèle économique à d'autres tâches NLP d'entreprise.

UELes entreprises européennes hébergées sur AWS peuvent adopter cette architecture serverless pour réduire leurs coûts de déploiement de modèles SQL spécialisés, Bedrock étant disponible dans les régions EU.

OutilsOutil
1 source
Automatiser le tri et la priorisation de vos boîtes mail avec Amazon Bedrock
3AWS ML Blog 

Automatiser le tri et la priorisation de vos boîtes mail avec Amazon Bedrock

Amazon Web Services a publié un guide technique détaillant une solution d'intelligence artificielle destinée aux organismes du secteur public, en particulier aux collectivités locales britanniques, pour trier et prioriser automatiquement leurs courriels entrants grâce à Amazon Bedrock. Le système fonctionne ainsi : les messages électroniques sont déposés dans un espace de stockage Amazon S3, via Amazon Simple Email Service, une intégration tierce ou le SDK AWS. Chaque nouvel objet S3 déclenche une notification transmise à Amazon EventBridge, qui l'achemine vers une file d'attente Amazon SQS de type FIFO. Cette file est reliée, via EventBridge Pipes, à une machine à états AWS Step Functions, laquelle récupère le contenu du courriel puis interroge un modèle Amazon Bedrock, en l'occurrence Amazon Nova Pro, par le biais de l'API InvokeModel. Un prompt spécifique demande au modèle de classer chaque message selon le service municipal concerné (transports, aides sociales, taxe d'habitation, action sociale, gestion des déchets, environnement, informatique, protection de l'enfance, logement) et d'en évaluer le degré d'urgence, dans un format structuré. En cas d'échec de traitement, les messages sont redirigés vers une file d'attente de lettres mortes pour investigation. Cette automatisation répond à trois difficultés concrètes identifiées par AWS dans la gestion actuelle des courriels des collectivités. D'abord une crise des délais de réponse, avec des centaines de messages reçus chaque jour où les demandes urgentes se retrouvent noyées dans le flux général. Ensuite, un usage inefficace du temps des agents, qui consacrent des heures au tri manuel, un même message pouvant être examiné à plusieurs reprises par différents services avant d'aboutir au bon interlocuteur. Enfin, une évaluation de la gravité des demandes qui manque de cohérence d'un agent à l'autre. En automatisant ce triage, la solution vise à garantir que les dossiers urgents reçoivent une attention immédiate, tout en libérant le personnel administratif pour des tâches à plus forte valeur ajoutée dans le service aux citoyens. Cette initiative s'inscrit dans une tendance plus large d'adoption de l'IA générative par les administrations publiques, confrontées à des contraintes budgétaires et des effectifs limités alors que les attentes des usagers en matière de rapidité de traitement ne cessent de croître. AWS présente cette architecture comme une base de départ, conçue pour être adaptée et enrichie par les organismes qui l'adoptent plutôt que comme un produit fini. Le déploiement s'appuie exclusivement sur des services managés d'AWS, ce qui limite la charge d'exploitation pour des collectivités locales disposant rarement d'équipes informatiques dédiées à l'intelligence artificielle, tout en respectant les bonnes pratiques de sécurité recommandées pour le stockage de données sensibles sur Amazon S3, notamment le chiffrement et le principe du moindre privilège.

OutilsOutil
1 source
« Construire une interface utilisateur générative pour agents IA sur Amazon Bedrock AgentCore avec le protocole AG-UI »
4AWS ML Blog 

« Construire une interface utilisateur générative pour agents IA sur Amazon Bedrock AgentCore avec le protocole AG-UI »

Le géant du cloud AWS a dévoilé une intégration entre Amazon Bedrock AgentCore et le protocole ouvert AG-UI (Agent-User Interaction Protocol), conçue pour permettre aux agents IA de communiquer avec des interfaces utilisateur dynamiques plutôt que de se limiter à un simple chat textuel. Ce protocole, compatible avec plusieurs frameworks d'agents comme Strands Agents, LangGraph et CrewAI, ainsi qu'avec des bibliothèques frontend telles que React, Angular ou Vue, permet à un agent de générer des graphiques interactifs en ligne, de mettre à jour un canevas partagé en temps réel, ou de suspendre son exécution pour demander une validation humaine. L'intégration s'appuie sur le Fullstack AgentCore Solution Template (FAST), un projet de démarrage prêt à déployer qui connecte AgentCore Runtime, Gateway, Identity, Memory et Code Interpreter à un frontend React avec authentification Amazon Cognito, le tout défini via AWS Cloud Development Kit (CDK). La version FAST v0.4.1 a ajouté deux nouveaux modèles d'agents, agui-strands-agent et agui-langgraph-agent, qui partagent un seul et même analyseur frontend. AgentCore Runtime agit comme un proxy transparent gérant l'authentification via Signature Version 4 (SigV4) ou OAuth 2.0 par Cognito, l'isolation des sessions, la mise à l'échelle et l'observabilité, pendant que le conteneur de l'agent expose un point d'accès POST /invocations pour les requêtes AG-UI et un GET /ping pour les vérifications de santé sur le port 8080. Cette avancée répond à un besoin concret des développeurs d'agents IA: découpler le code backend de l'agent du code frontend, afin de choisir librement le meilleur framework pour chaque côté sans sacrifier l'interopérabilité. Pour les équipes qui construisent des applications agentiques destinées aux entreprises, cela signifie des interfaces plus riches que le simple chat, avec des composants visuels générés à la volée, des états partagés bidirectionnels et des mécanismes de supervision humaine intégrés nativement au protocole plutôt que bricolés au cas par cas. Cela réduit la complexité d'ingénierie et accélère le déploiement d'agents capables d'interactions plus naturelles et plus sûres, un enjeu central à mesure que les entreprises cherchent à industrialiser leurs cas d'usage d'IA générative au-delà des simples assistants conversationnels. Le protocole AG-UI s'inscrit dans un écosystème plus large de protocoles déjà supportés par AgentCore Runtime, aux côtés du Model Context Protocol (MCP), qui relie les agents aux outils, et d'Agent2Agent (A2A), qui relie les agents entre eux. Pour illustrer concrètement ces capacités, AWS a présenté un exemple combinant FAST avec CopilotKit, qui remplace l'interface de chat intégrée par défaut pour ajouter une génération d'interface utilisateur, un canevas de tâches à état partagé, et un planificateur de réunions illustrant l'intervention humaine en cours d'exécution, le tout déployé sur AgentCore Runtime avec authentification Cognito, connectivité MCP via AgentCore Gateway et conversations persistantes grâce à AgentCore Memory.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic