GLM-5.3 arrive sur l'API à $1.40/$4.40 par million de tokens

Z.ai logoZ.aiFYI20 août 2026Tarification
Ce qui s’est passé
GLM-5.3 is live on Z.ai's API at $1.40 input and $4.40 output per million tokens, unchanged from GLM-5.2.
Pourquoi c’est important
Independent AA scoring puts it at 60 — level with Kimi K3, three points behind Claude Opus 5, with the open-weights tie taking effect once GLM-5.3's weights ship.
Que faire
Model GLM-5.3's ~20% verbosity bump into your cost estimate — and hold off standardizing until the open weights drop.

GLM-5.3 est désormais appelable sur l'API de Z.ai à $1.40 par million de tokens en entrée et $4.40 par million de tokens en sortie — inchangé par rapport à GLM-5.2 — et les évaluations indépendantes lui donnent 60 sur l'Indice d'Intelligence d'Artificial Analysis, à égalité avec le score de 60 de Kimi K3 — la marque que GLM-5.3 égalera dans la catégorie des poids ouverts une fois ses poids publiés. L'écart de prix que nous avions signalé au lancement est comblé.

Ce qui s'est passé

Z.ai a ouvert GLM-5.3 au trafic API au même tarif que son prédécesseur, avec l'entrée en cache à $0.26 par million de tokens (VentureBeat, 2026).

TarifPrix par 1M de tokens
Entrée$1.40
Sortie$4.40
Entrée en cache$0.26

Artificial Analysis l'a évalué à 60 sur l'Indice d'Intelligence — au niveau de Kimi K3 et à trois points derrière Claude Opus 5, le leader de la frontière fermée (Unite.AI, 2026).

Le hic, c'est l'efficacité des tokens. AA a mesuré GLM-5.3 à environ 18 700 tokens de sortie par tâche, soit environ 20 % de plus que GLM-5.2 — ce qui porte son coût réel par tâche de l'Indice d'Intelligence à environ $0.68 contre $0.44 pour GLM-5.2, toujours 19 % moins cher que Kimi K3 par tâche (Artificial Analysis, 2026).

Pourquoi c'est important

GLM-5.3 comble son dernier écart de lancement : la publication des tarifs par token. Combiné à un score d'intelligence de premier plan qui le place dans la catégorie des poids ouverts une fois les poids publiés, cela le met pleinement sur la frontière de Pareto pour les équipes qui hésitent entre les modèles chinois à poids ouverts et la frontière fermée.

Les poids ouverts sont encore retenus environ deux semaines pour le durcissement de sécurité — notre position sur GLM-5.3 reste donc conditionnelle : utilisez-le dès maintenant pour les charges de sécurité défensive et agentiques, mais attendez la publication des poids avant de standardiser.

Ce qui change pour vous

Si vous aviez benchmarké GLM-5.3 et attendiez pour les tarifs, le chiffre est désormais en ligne. Intégrez deux éléments à votre décision :

  • L'efficacité des tokens, pas seulement les tarifs par token. Une hausse de verbosité d'environ 20 % signifie que des tarifs par token stables ne donnent pas des coûts par tâche stables — $0.68 par tâche de l'indice contre $0.44 pour GLM-5.2.
  • Attendez les poids. L'auto-hébergement est encore à environ deux semaines ; ne figez pas votre architecture avant leur publication.

FAQ

Le prix de GLM-5.3 a-t-il changé par rapport à GLM-5.2 ? Non — il sort au même tarif de $1.40/$4.40 par million de tokens avec $0.26 d'entrée en cache. La nouveauté, c'est que le tarif est désormais publié, pas qu'il a bougé.

GLM-5.3 est-il moins cher que Kimi K3 ? Par tâche, oui — environ 19 % moins cher, même si les deux obtiennent 60 sur l'Indice d'Intelligence. L'écart se resserre parce que GLM-5.3 est plus verbeux par tâche.

Les poids ouverts sont-ils disponibles ? Pas encore. Z.ai les retient environ deux semaines pour le durcissement de sécurité.

Que faire

  1. 1 Model the ~20% verbosity bump into your per-task cost estimate before comparing GLM-5.3 to Kimi K3.
  2. 2 Hold off standardizing on GLM-5.3 until the open weights ship (~2 weeks out).

Outils et modèles concernés

Ne ratez plus jamais une mise à jour

Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.

En vous abonnant, vous acceptez notre Politique de confidentialité. Désabonnement à tout moment.