GLM-5.3 startet auf der API zu $1,40/$4,40 pro Million Tokens

Z.ai logoZ.aiFYI20. August 2026Preisgestaltung
Was ist passiert
GLM-5.3 is live on Z.ai's API at $1.40 input and $4.40 output per million tokens, unchanged from GLM-5.2.
Warum es wichtig ist
Independent AA scoring puts it at 60 — level with Kimi K3, three points behind Claude Opus 5, with the open-weights tie taking effect once GLM-5.3's weights ship.
Was zu tun ist
Model GLM-5.3's ~20% verbosity bump into your cost estimate — and hold off standardizing until the open weights drop.

GLM-5.3 ist ab sofort über die API von Z.ai zu $1,40 pro Million Eingabe- und $4,40 pro Million Ausgabe-Tokens aufrufbar — unverändert gegenüber GLM-5.2 — und unabhängige Bewertungen stufen es mit 60 im Artificial Analysis Intelligence Index ein, gleichauf mit den 60 Punkten von Kimi K3 — der Marke, die GLM-5.3 in der Open-Weight-Klasse erreichen wird, sobald seine Gewichte erscheinen. Die von uns beim Launch markierte Preislücke ist geschlossen.

Was ist passiert

Z.ai hat GLM-5.3 zum selben Tarif wie seinen Vorgänger für API-Traffic freigegeben, mit gecachtem Input zu $0,26 pro Million Tokens (VentureBeat, 2026).

TarifPreis pro 1 Mio. Tokens
Input$1,40
Output$4,40
Gecachter Input$0,26

Artificial Analysis bewertete es mit 60 im Intelligence Index — gleichauf mit Kimi K3 und drei Punkte hinter Claude Opus 5, dem Spitzenreiter der geschlossenen Frontier (Unite.AI, 2026).

Der Haken ist die Token-Effizienz. AA hat GLM-5.3 mit rund 18.700 Ausgabe-Tokens pro Aufgabe gemessen, etwa 20 % mehr als GLM-5.2 — was seine realen Kosten pro Intelligence-Index-Aufgabe auf rund $0,68 gegenüber $0,44 bei GLM-5.2 hebt, immer noch 19 % günstiger als Kimi K3 pro Aufgabe (Artificial Analysis, 2026).

Warum es wichtig ist

GLM-5.3 schließt seine letzte Launch-Lücke: die veröffentlichten Preise pro Token. Kombiniert mit einem Spitzenwert im Intelligence Index, der nach Erscheinen der Gewichte in der Open-Weight-Klasse landet, platziert ihn das mitten auf der Pareto-Frontier für Teams, die zwischen chinesischen Open-Weight-Modellen und der geschlossenen Frontier wählen.

Die offenen Gewichte werden noch rund zwei Wochen zum Safety-Hardening zurückgehalten — deshalb bleibt unsere Haltung zu GLM-5.3 bedingt: Setzen Sie es jetzt bei Defensive-Security- und agentischen Workloads ein, halten Sie aber mit der Standardisierung zurück, bis die Gewichte erscheinen.

Was sich für Sie ändert

Wenn Sie GLM-5.3 gebenchmarkt und wegen des Preises gewartet haben, ist die Zahl jetzt da. Berücksichtigen Sie zwei Dinge in Ihrer Entscheidung:

  • Token-Effizienz, nicht nur Preise pro Token. Ein Anstieg der Ausführlichkeit um ~20 % bedeutet: gleiche Preise pro Token sind nicht gleiche Kosten pro Aufgabe — $0,68 pro Index-Aufgabe gegenüber $0,44 bei GLM-5.2.
  • Warten Sie auf die Gewichte. Self-Hosting ist noch rund zwei Wochen entfernt; legen Sie Ihre Architektur nicht fest, bis sie erscheinen.

FAQ

Hat sich der Preis von GLM-5.3 gegenüber GLM-5.2 geändert? Nein — es startet zu denselben $1,40/$4,40 pro Million Tokens mit $0,26 für gecachten Input. Die Neuigkeit ist, dass der Tarif jetzt veröffentlicht ist, nicht dass er sich bewegt hat.

Ist GLM-5.3 günstiger als Kimi K3? Pro Aufgabe ja — etwa 19 % günstiger, obwohl beide 60 im Intelligence Index erreichen. Der Abstand schrumpft, weil GLM-5.3 pro Aufgabe ausführlicher ist.

Sind die offenen Gewichte verfügbar? Noch nicht. Z.ai hält sie rund zwei Wochen zum Safety-Hardening zurück.

Was zu tun ist

  1. 1 Model the ~20% verbosity bump into your per-task cost estimate before comparing GLM-5.3 to Kimi K3.
  2. 2 Hold off standardizing on GLM-5.3 until the open weights ship (~2 weeks out).

Betroffene Tools & Modelle

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.