GLM-5.3 arrive sur l'API à 1,4/4,4 dollars par million de tokens
Le développeur chinois Z.ai a ouvert l'accès API à GLM-5.3, son nouveau modèle de langage frontière en open source, une semaine après un lancement remarqué où le modèle aurait détecté une vulnérabilité jusqu'alors inconnue dans l'éditeur Cursor. Les tarifs restent identiques à ceux de GLM-5.2 : 1,40 dollar par million de tokens en entrée et 4,40 dollars par million en sortie, avec un tarif réduit à 0,26 dollar pour les tokens en entrée mis en cache, dont le stockage est pour l'instant gratuit de façon temporaire. Les développeurs déjà abonnés au GLM Coding Plan sont pour le moment limités au protocole compatible OpenAI Chat Completions. Z.ai a annoncé son intention de publier prochainement les poids du modèle en libre accès, sans toutefois préciser de date ni de type de licence. Selon les tests indépendants d'Artificial Analysis, GLM-5.3 obtient un score de 60 sur l'Intelligence Index, ce qui en fait, à égalité avec Kimi K3 de Moonshot AI, le modèle open source le plus performant au monde, en progression de sept points par rapport à GLM-5.2.
Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →
Cette stabilité tarifaire malgré des gains de performance change la donne pour les entreprises qui déploient des agents de codage ou des applications à forte consommation de tokens. En combinant un million de tokens en entrée et un million en sortie, la facture s'élève à 5,80 dollars pour GLM-5.3, contre 8 dollars pour Grok 4.6 d'xAI sur son palier tarifaire le plus bas, 18 dollars pour Kimi K3, 30 dollars pour Claude Opus 5 d'Anthropic et jusqu'à 35 dollars pour GPT-5.6 Sol d'OpenAI en mode standard. Ce positionnement tarifaire nettement inférieur aux modèles frontières premium renforce l'attractivité de GLM-5.3 pour les développeurs cherchant à réduire leurs coûts d'infrastructure IA sans sacrifier les performances en codage et en tâches agentiques de longue durée, un argument commercial de plus en plus déterminant à mesure que les usages d'agents autonomes se généralisent.
GLM-5.3 ne reste toutefois pas l'option la moins chère du marché : Google propose actuellement Gemini 3.7 Flash à 0,75 dollar en entrée et 3,75 dollars en sortie jusqu'au 31 décembre 2026, tandis qu'OpenAI facture GPT-5.6 Luna à seulement 0,20 dollar en entrée et 1,20 dollar en sortie. Artificial Analysis relève d'ailleurs que le coût par tâche de l'Intelligence Index atteint environ 0,68 dollar pour GLM-5.3, contre 0,44 dollar pour GLM-5.2, à prix de token identique, signe que les gains de capacités s'accompagnent d'une consommation de tokens plus importante par tâche. Cette dynamique illustre la concurrence tarifaire intense entre laboratoires chinois (Z.ai, DeepSeek, Moonshot AI, Xiaomi) et occidentaux (OpenAI, Google, Anthropic, xAI) sur le marché des API, où la course aux prix bas coexiste désormais avec une course aux performances mesurées par des benchmarks indépendants.
Les developpeurs europeens deployant des agents de codage pourraient reduire leurs couts d'infrastructure IA grace a ce positionnement tarifaire, sans impact direct sur une entite ou regulation francaise ou europeenne.
GLM-5.3 fait tomber la facture d'un million de tokens à 5,80 dollars, contre 30 pour Opus 5 et jusqu'à 35 pour GPT-5.6 Sol, à niveau de perf comparable sur le codage. C'est ça, le vrai sujet du moment : les modèles chinois ne rattrapent plus juste les frontières américaines, ils font de l'écart de prix leur argument de vente numéro un. Reste un détail que personne ne dit assez fort : à token égal, GLM-5.3 en consomme plus par tâche que la version précédente, donc l'addition finale grimpe moins vite qu'annoncé.