Aller au contenu principal
Outils · Actu ·

GLM 5.3 est désormais disponible sur Amazon Bedrock

Amazon Web Services a annoncé la disponibilité de GLM 5.3, le modèle de Z.ai (Zhipu AI), sur sa plateforme Amazon Bedrock. Publié sur Hugging Face Hub, ce modèle de type mélange d'experts compte 753 milliards de paramètres. Il est optimisé pour le code et les tâches d'agents à long horizon. Sur Bedrock, il s'utilise via des API entièrement managées : les API Responses et Chat Completions compatibles OpenAI, ainsi que les API Invoke et Converse d'Amazon. L'inférence inter-régions est proposée avec deux profils, américain (us.zai.glm-5.3) et mondial (global.zai.glm-5.3). Le modèle gère la mise en cache des prompts, implicite par défaut et explicite via des contrôles recommandés. Trois niveaux de service sont disponibles : Flex pour réduire les coûts des charges peu urgentes, Priority pour les requêtes sensibles à la latence moyennant un tarif plus élevé, et Standard comme compromis par défaut. L'accès est réservé aux clients entreprise éligibles. Z.ai affirme que GLM 5.3 est compétitif sur plusieurs benchmarks de code, dont DeepSWE, Terminal Bench 3.0 et FrontierSWE, et revendique 50 % de progression par rapport à GLM 5.2 sur son benchmark interne. Le modèle aurait aussi obtenu un score de 84,5 sur CyberGym, présenté comme le meilleur au moment de sa sortie.

2 min de lecturePertinence 40

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de AWS ML Blog. Lire l'article original →

Pour les entreprises, l'enjeu est avant tout opérationnel. Exploiter un modèle open-weight de cette taille exigeait jusqu'ici de provisionner et de gérer sa propre infrastructure d'inférence, ce qui représente un coût et une expertise considérables. Avec Bedrock, aucune infrastructure n'est à gérer. La mise en cache des prompts intéresse particulièrement les workflows d'agents, qui renvoient à chaque tour de gros prompts système ou le contexte d'un dépôt de code : elle réduit à la fois la latence et le coût des jetons d'entrée. Les capacités en cybersécurité ouvrent aussi des usages défensifs. AWS illustre cet angle avec un scénario réaliste : un test d'intrusion autorisé de sa propre application, réalisé avec Strix, un agent open source de pentest piloté par IA. Les équipes de sécurité peuvent ainsi automatiser une part de l'audit de leurs systèmes, à condition de disposer de l'autorisation nécessaire et d'accéder au modèle.

GLM 5.3 s'inscrit dans une lignée déjà présente sur Bedrock : GLM 5 y est arrivé plus tôt dans l'année. Z.ai indique ne pas fournir de comparaison directe avec GLM 5, car l'ampleur des progrès l'a conduit à mettre à jour ses tests internes depuis l'annonce de GLM 5.1. Ces chiffres restent donc des déclarations de l'éditeur, non des mesures indépendantes. Cette arrivée traduit la stratégie d'Amazon, qui veut faire de Bedrock une place de marché de modèles variés, y compris des modèles ouverts venus de laboratoires chinois, en rendant leur usage aussi simple que celui des modèles propriétaires. L'alignement croissant des API sur le format OpenAI facilite la migration des applications existantes. Pour tester le modèle, il faut un compte AWS avec les permissions IAM adéquates (bedrock:InvokeModel, bedrock:InvokeModelWithResponseStream et bedrock:CallWithBearerToken) et Python 3.10 ou plus récent. La démonstration de sécurité nécessite en plus Docker et Strix.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Grok 4.6 de xAI est désormais disponible sur Amazon Bedrock39AWS ML BlogOutils 02Grok 4.7 est désormais disponible sur Amazon Bedrock47AWS ML BlogLLMs 03Amazon Quick est désormais disponible sur ordinateur40AWS ML BlogOutils 
Dossier · AWSSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.