Aller au contenu principal
OutilsAWS ML Blog · 1 min de lecture

Migrer d'Amazon Nova 1 vers Amazon Nova 2 sur Amazon Bedrock

Source originale ↗·

Amazon franchit une nouvelle étape dans l'évolution de sa gamme de modèles d'IA avec le lancement d'Amazon Nova 2, disponible sur Amazon Bedrock. La version Nova 2 Lite constitue la migration recommandée pour l'ensemble des utilisateurs de la génération précédente, y compris ceux qui utilisaient Nova 1 Pro ou Nova Premier, grâce à des gains significatifs en raisonnement, en vitesse et en capacités agentiques.

Ce passage à Nova 2 Lite représente un tournant stratégique pour les entreprises déployant des applications d'automatisation à grande échelle. Le modèle introduit une fenêtre de contexte portée à 1 million de tokens (contre 300 000 pour Nova 1 Lite), un interpréteur de code intégré, un ancrage web natif et une fonctionnalité de raisonnement étendu (extended thinking). Ces ajouts permettent de traiter des documents plus longs et des workflows multi-étapes sans refonte majeure du code existant.

Les chiffres parlent d'eux-mêmes : Nova 2 Lite obtient 80,9 % sur le benchmark MMLU Pro et 70,8 % sur IF-Bench. Par rapport à Nova Premier, il surpasse ce dernier sur la résolution de problèmes multi-étapes tout en étant 7 fois moins coûteux et jusqu'à 5 fois plus rapide. Siemens figure parmi les premiers adoptants en production : leur moteur de recherche mondial tourne désormais sur Nova 2 Lite, affichant une amélioration de 300 % de la vitesse de recherche et une réduction des coûts de 70 % par rapport à leur solution LLM précédente.

Pour les équipes qui planifient leur migration, AWS fournit une correspondance directe entre les modèles, des exemples de code via la Converse API et une checklist de transition. La recommandation principale : activer le raisonnement étendu sur vos charges de travail existantes avant de basculer, afin de valider la qualité sur vos cas d'usage spécifiques.

Impact France/UE

Les entreprises européennes utilisant Amazon Bedrock peuvent migrer vers Nova 2 Lite pour diviser leurs coûts par 7 et multiplier leur vitesse par 5 par rapport à Nova Premier.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

MiniMax : ses modèles disponibles sur Amazon Bedrock
1AWS ML Blog 

MiniMax : ses modèles disponibles sur Amazon Bedrock

Ce contenu concerne une intégration de modèles tiers dans un service AWS (MiniMax sur Amazon Bedrock) et ne relève pas d'une tâche technique nécessitant une vérification via un outil dédié : il s'agit d'une simple traduction/synthèse journalistique. Voici l'article en français, format Le Fil IA : Amazon a annoncé la disponibilité de la famille de modèles MiniMax sur Amazon Bedrock, sa plateforme d'accès géré à des modèles de fondation tiers. Trois modèles sont désormais proposés : MiniMax M2, lancé en premier avec une fenêtre de contexte d'un million de tokens et de solides performances en génération multilingue, raisonnement et code ; MiniMax M2.1, qui améliore la profondeur de raisonnement, la précision du code et le suivi des instructions, avec une fenêtre de contexte de 196 000 tokens ; et MiniMax M2.5, le plus récent, entraîné spécifiquement pour l'exécution agentique native, avec un accent sur l'appel d'outils, la décomposition de tâches en plusieurs étapes et les tâches de programmation à long horizon. MiniMax, entreprise technologique mondiale spécialisée dans les modèles multimodaux, construit sa famille M2 autour d'une architecture de mélange d'experts (MoE) où seule une petite fraction des paramètres totaux s'active par token, ce qui offre la capacité de connaissance d'un modèle dense bien plus large pour un coût d'inférence réduit. Cette disponibilité répond à un besoin croissant des entreprises qui adoptent des modèles à poids ouverts pour leurs charges de travail de production, des assistants de codage agentiques à l'analyse de documents à long contexte. Amazon Bedrock garantit que les prompts et complétions des clients ne servent pas à entraîner les modèles et ne sont pas partagés avec les fournisseurs de modèles, l'inférence s'exécutant entièrement sur l'infrastructure gérée par AWS. Pour les organisations, cela signifie un accès à des modèles de pointe sans compromis sur la protection des données, la conformité réglementaire ou le contrôle opérationnel, et sans avoir à provisionner d'infrastructure, héberger les poids des modèles ou exploiter des piles d'inférence. Le caractère ouvert des poids permet en outre aux entreprises d'évaluer indépendamment l'architecture et la méthodologie d'entraînement, de lancer leurs propres benchmarks sur leurs charges de travail représentatives, et d'affiner les modèles sur des données propriétaires lorsqu'une personnalisation est nécessaire. Cette annonce s'inscrit dans la stratégie d'Amazon Bedrock d'élargir continuellement son catalogue de modèles tiers, à mesure que de nouvelles versions de MiniMax sont publiées. Elle illustre aussi une tendance plus large du marché des modèles de fondation : la montée des modèles à poids ouverts spécialisés dans les cas d'usage agentiques et de programmation, en concurrence directe avec les offres propriétaires. Pour les entreprises qui construisent des applications agentiques, des pipelines d'analyse documentaire longue ou des flux de travail d'ingénierie logicielle, le choix entre MiniMax M2, M2.1 et M2.5 dépendra des arbitrages entre taille de contexte, profondeur de raisonnement et spécialisation pour l'exécution autonome de tâches, avec la promesse d'un catalogue MiniMax appelé à continuer de s'enrichir sur Bedrock.

OutilsOutil
1 source
Migrer un agent texte vers un assistant vocal avec Amazon Nova 2 Sonic
2AWS ML Blog 

Migrer un agent texte vers un assistant vocal avec Amazon Nova 2 Sonic

Amazon a publié un guide technique détaillé sur la migration d'agents textuels vers des assistants vocaux en utilisant Amazon Nova 2 Sonic, son modèle de traitement de la parole en temps réel. L'article, publié en avril 2026, s'adresse aux équipes d'ingénierie qui ont déjà déployé des agents conversationnels textuels et souhaitent les adapter à des interfaces vocales. Les secteurs visés sont larges : finance, santé, éducation, réseaux sociaux et commerce de détail, tous confrontés à une demande croissante d'interactions orales naturelles et instantanées. Amazon propose même un outil intégré dans des IDE comme Kiro et Claude Code, capable de convertir automatiquement un agent textuel en agent vocal à partir d'un référentiel de code existant. La différence entre un agent texte et un agent vocal est bien plus profonde qu'il n'y paraît, et c'est là l'enjeu central du guide. Un agent textuel peut retourner des tableaux, des listes à puces et des liens cliquables, le tout en une seule réponse que l'utilisateur lit à son rythme. Un agent vocal doit fonctionner différemment : les réponses doivent être courtes, séquentielles, avec des confirmations intermédiaires. Exemple concret : là où l'agent textuel d'une banque affiche un récapitulatif complet de trois comptes en une fois, l'agent vocal annonce un compte, demande si l'utilisateur veut continuer, puis présente le suivant. La latence devient également un critère critique : quelques secondes d'attente sont tolérables à l'écrit, mais créent une impression de coupure à l'oral, où chaque appel d'outil ajoute un silence perceptible. Cela oblige à repenser l'architecture en profondeur : streaming audio bidirectionnel permanent, détection d'activité vocale, gestion des interruptions en cours de phrase, et traitement asynchrone des outils pour ne pas bloquer le flux. Cette publication intervient alors que les grandes plateformes cloud cherchent à démocratiser la voix comme interface standard pour les applications d'entreprise. Amazon Nova 2 Sonic s'inscrit dans une compétition directe avec des modèles comme GPT-4o Audio d'OpenAI et Gemini Live de Google, tous capables de traitement vocal en temps réel avec de faibles temps de latence. La migration vers la voix soulève des enjeux techniques considérables, notamment la gestion des tours de parole fluides, la réduction des délais lors des appels à des API externes, et l'adaptation des prompts système pour un style oral plutôt qu'écrit. Le fait qu'Amazon intègre un outil de conversion automatique dans les IDE suggère que l'entreprise veut abaisser le seuil d'entrée pour accélérer l'adoption, tout en conservant une dépendance à son écosystème cloud pour l'inférence et le déploiement.

OutilsOutil
1 source
L'accord de Bedrock d'Amazon migre et optimise les invites vers de nouveaux modèles
3AWS ML Blog 

L'accord de Bedrock d'Amazon migre et optimise les invites vers de nouveaux modèles

Amazon Bedrock lance Advanced Prompt Optimization, un outil qui permet d'optimiser automatiquement les prompts pour jusqu'à 5 modèles à la fois et de comparer leurs performances. Concrètement, un client fournit un modèle de prompt, des exemples de requêtes utilisateur (texte ou multimodal), éventuellement des réponses de référence, et une métrique d'évaluation. Le système envoie ensuite ce prompt aux modèles choisis sur Bedrock, évalue les réponses selon la métrique fixée, réécrit le prompt, puis recommence ce cycle évaluer-réécrire-évaluer de façon itérative, un peu comme une boucle d'apprentissage par renforcement, mais sans toucher aux poids du modèle. À l'issue du processus, l'utilisateur récupère le prompt original et sa version optimisée pour chaque modèle testé, avec pour chacun un score d'évaluation, le temps jusqu'au premier jeton généré (time to first token, ou TTFT, un indicateur de latence perçue) et une estimation du coût d'inférence au tarif à la demande. Le tout se fait en une seule soumission de job, avec jusqu'à 5 modèles candidats comparés simultanément sur qualité, latence et coût. Cette fonctionnalité s'attaque à un goulot d'étranglement bien connu des équipes qui déploient des applications d'IA générative en production. Migrer un prompt déjà réglé vers un nouveau modèle plus rapide ou moins cher, ou simplement l'optimiser pour le modèle en place, exige aujourd'hui des jours voire des semaines de réécritures manuelles, de tests et de comparaisons, un effort qui se multiplie par le nombre de templates de prompts et de modèles candidats. Résultat : beaucoup d'équipes restent enfermées sur un modèle par crainte du coût de migration, même quand un modèle plus récent offrirait de meilleures performances. D'autres exploitent mal les capacités réelles d'un nouveau modèle parce que leurs prompts ont été pensés pour un autre système, ou expédient sans le savoir des réponses dégradées faute d'évaluation systématique face à des données de référence. En automatisant ce cycle par une approche pilotée par les métriques, Amazon Bedrock veut libérer les ingénieurs des boucles interminables de tests A/B manuels pour qu'ils se concentrent sur le développement de fonctionnalités. Cette annonce s'inscrit dans une compétition plus large entre fournisseurs de cloud pour réduire la friction du cycle de vie des applications d'IA générative, alors que le rythme de sortie de nouveaux modèles s'accélère chez tous les grands acteurs. Le caractère agnostique de l'outil, compatible avec n'importe quel modèle disponible sur Bedrock, laisse penser qu'Amazon cherche à fidéliser les développeurs à sa plateforme plutôt qu'à un modèle en particulier, en simplifiant justement les changements de modèle qui pourraient sinon les pousser vers un concurrent. Reste à voir si cette automatisation tient ses promesses sur des cas d'usage complexes ou multimodaux, et si d'autres fournisseurs cloud répliqueront rapidement une approche similaire.

OutilsOutil
1 source
4AWS ML Blog 

Commandes omnicanales avec Amazon Bedrock AgentCore et Amazon Nova 2 Sonic

Amazon a présenté une architecture complète pour construire des systèmes de commande vocale omnicanaux en s'appuyant sur deux de ses services cloud : Amazon Bedrock AgentCore, une plateforme dédiée au déploiement d'agents IA en production, et Amazon Nova 2 Sonic, un modèle de fondation speech-to-speech disponible via Amazon Bedrock. La solution permet à une application de traiter des commandes vocales en temps réel sur plusieurs points de contact simultanément, application mobile, site web et interface vocale, tout en maintenant le contexte conversationnel entre les échanges. L'infrastructure s'appuie sur AWS CDK pour le déploiement, le protocole MCP (Model Context Protocol) pour connecter l'agent IA aux services métier, et une série de services managés : Amazon Cognito pour l'authentification OAuth 2.0, API Gateway pour exposer les endpoints REST, AWS Lambda pour la logique métier, DynamoDB pour le stockage des profils et commandes, et AWS Location Services pour les recommandations géolocalisées de points de retrait. L'intérêt principal de cette architecture réside dans sa capacité à isoler chaque composant pour les faire évoluer indépendamment. AgentCore Runtime exécute chaque session utilisateur dans une microVM isolée, ce qui garantit qu'un pic de charge sur une session n'affecte pas les autres, un problème classique des systèmes vocaux en production. Le MCP standardise la communication entre l'agent et les services backend, ce qui permet de modifier ou d'étendre la logique métier sans réécrire le code d'intégration. Pour les équipes qui construisent des expériences de commande vocale à grande échelle, restauration rapide, retail, logistique, cette séparation claire entre la couche IA, le frontend et le backend réduit significativement la complexité opérationnelle et les risques de régression lors des mises à jour. La publication de cette solution s'inscrit dans une compétition intense autour des agents IA en production. Google, Microsoft et des acteurs comme Anthropic proposent leurs propres infrastructures agentiques, mais AWS mise sur l'intégration native avec son écosystème de services cloud existants comme différenciateur clé. Nova 2 Sonic, le modèle speech-to-speech au coeur du système, représente l'entrée d'Amazon dans les interfaces vocales conversationnelles en temps réel, un segment où OpenAI s'est imposé avec GPT-4o Voice. En publiant ce tutoriel complet avec une architecture de restaurant fictive comme backend d'exemple, Amazon cherche à accélérer l'adoption par les développeurs et à établir AgentCore comme standard de fait pour le déploiement d'agents IA sur AWS. Les prochaines étapes logiques incluront probablement l'extension à d'autres modalités et l'intégration avec des systèmes de caisse et d'inventaire existants.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic