Aller au contenu principal
LLMs · Actu ·

GLM-5.3 arrive sur l'API à 1,4/4,4 dollars par million de tokens

Le développeur chinois Z.ai a ouvert l'accès API à GLM-5.3, son nouveau modèle de langage frontière en open source, une semaine après un lancement remarqué où le modèle aurait détecté une vulnérabilité jusqu'alors inconnue dans l'éditeur Cursor. Les tarifs restent identiques à ceux de GLM-5.2 : 1,40 dollar par million de tokens en entrée et 4,40 dollars par million en sortie, avec un tarif réduit à 0,26 dollar pour les tokens en entrée mis en cache, dont le stockage est pour l'instant gratuit de façon temporaire. Les développeurs déjà abonnés au GLM Coding Plan sont pour le moment limités au protocole compatible OpenAI Chat Completions. Z.ai a annoncé son intention de publier prochainement les poids du modèle en libre accès, sans toutefois préciser de date ni de type de licence. Selon les tests indépendants d'Artificial Analysis, GLM-5.3 obtient un score de 60 sur l'Intelligence Index, ce qui en fait, à égalité avec Kimi K3 de Moonshot AI, le modèle open source le plus performant au monde, en progression de sept points par rapport à GLM-5.2.

2 min de lecturePertinence 57
Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Cette stabilité tarifaire malgré des gains de performance change la donne pour les entreprises qui déploient des agents de codage ou des applications à forte consommation de tokens. En combinant un million de tokens en entrée et un million en sortie, la facture s'élève à 5,80 dollars pour GLM-5.3, contre 8 dollars pour Grok 4.6 d'xAI sur son palier tarifaire le plus bas, 18 dollars pour Kimi K3, 30 dollars pour Claude Opus 5 d'Anthropic et jusqu'à 35 dollars pour GPT-5.6 Sol d'OpenAI en mode standard. Ce positionnement tarifaire nettement inférieur aux modèles frontières premium renforce l'attractivité de GLM-5.3 pour les développeurs cherchant à réduire leurs coûts d'infrastructure IA sans sacrifier les performances en codage et en tâches agentiques de longue durée, un argument commercial de plus en plus déterminant à mesure que les usages d'agents autonomes se généralisent.

GLM-5.3 ne reste toutefois pas l'option la moins chère du marché : Google propose actuellement Gemini 3.7 Flash à 0,75 dollar en entrée et 3,75 dollars en sortie jusqu'au 31 décembre 2026, tandis qu'OpenAI facture GPT-5.6 Luna à seulement 0,20 dollar en entrée et 1,20 dollar en sortie. Artificial Analysis relève d'ailleurs que le coût par tâche de l'Intelligence Index atteint environ 0,68 dollar pour GLM-5.3, contre 0,44 dollar pour GLM-5.2, à prix de token identique, signe que les gains de capacités s'accompagnent d'une consommation de tokens plus importante par tâche. Cette dynamique illustre la concurrence tarifaire intense entre laboratoires chinois (Z.ai, DeepSeek, Moonshot AI, Xiaomi) et occidentaux (OpenAI, Google, Anthropic, xAI) sur le marché des API, où la course aux prix bas coexiste désormais avec une course aux performances mesurées par des benchmarks indépendants.

Impact France / UEChamp produit par Le Fil IA

Les developpeurs europeens deployant des agents de codage pourraient reduire leurs couts d'infrastructure IA grace a ce positionnement tarifaire, sans impact direct sur une entite ou regulation francaise ou europeenne.

Notre lecture

GLM-5.3 fait tomber la facture d'un million de tokens à 5,80 dollars, contre 30 pour Opus 5 et jusqu'à 35 pour GPT-5.6 Sol, à niveau de perf comparable sur le codage. C'est ça, le vrai sujet du moment : les modèles chinois ne rattrapent plus juste les frontières américaines, ils font de l'écart de prix leur argument de vente numéro un. Reste un détail que personne ne dit assez fort : à token égal, GLM-5.3 en consomme plus par tâche que la version précédente, donc l'addition finale grimpe moins vite qu'annoncé.

À lire ensuite

01Grok 4.5 de SpaceXAI, entraîné par Cursor pour le code et les tâches à base d'agents, arrive à 2$/M tokens22MarkTechPostLLMs 02Alibaba lance Qwen3.7-Plus : texte, vidéo et images pour 0,4 $/1,6 $ par million de tokens, mais en source fermée49VentureBeat AILLMs 03Z.ai lance GLM-5.2 : contexte de 1 million de tokens, deux niveaux d'effort de raisonnement, sans benchmarks au lancement43MarkTechPostLLMs 
Dossier · Moonshot AISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.