GLM-5.3: Z.ais Modell führt CyberGym an, Gewichte in zwei Wochen
- Was ist passiert
- Z.ai released GLM-5.3, post-trained on the same base as GLM-5.2, with a more-than-6× Terminal-Bench 3.0 jump and CyberGym SOTA.
- Warum es wichtig ist
- It leads CyberGym at 84.5%, ahead of Mythos 5 and GPT-5.6 Sol — a sharper open-weight frontier on coding and security.
- Was zu tun ist
- Test via GLM Coding Plan or ZCode now; open weights land in about two weeks after safety review.
GLM-5.3 ist das erste Open-Weight-Modell, das CyberGym anführt — und es schlägt auf dem Weg dorthin Anthropics Mythos 5 und OpenAIs GPT-5.6 Sol. Das ist die Schlagzeile. Der Haken: Die Gewichte werden heute nicht ausgeliefert — sie sind für etwa zwei Wochen später vorgesehen, abhängig von Sicherheitsprüfung und Härtung. (Alle Zahlen hier stammen von Z.ai selbst und wurden über das Claude-Code-Harness ermittelt; wir haben sie nicht unabhängig reproduziert.)
Was passiert ist
Z.ai veröffentlichte GLM-5.3 als reines Post-Training-Update auf derselben Basis wie GLM-5.2. „Post-Training skalieren war alles, was wir gemacht haben", so Z.ai. Das ist kein neues Modell — es ist das, was ein Monat umgebungsskaliertes RL gebracht hat.
| Benchmark | GLM-5.2 | GLM-5.3 | Wo es landet |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6 % | 28,3 % | Open-Source-SOTA |
| Agents' Last Exam | 23,8 % | 28,5 % | — |
| CyberGym | — | 84,5 % | Vor Mythos 5 (83,8 %), GPT-5.6 Sol (83,6 %) |
| ExploitBench | 24,4 % | 54,4 % | Liegt weiter hinter Mythos 5 (78,0 %), GPT-5.6 Sol (76,5 %) |
Laut Z.ai fand das Modell 2.436 Schwachstellen in 269 Projekten — 1.097 davon kritisch oder hoch, einige reichen bis 1981 zurück.
Warum es wichtig ist
Die Cyber-Fähigkeit ist der Teil, den man im Auge behalten sollte. GLM-5.3 ist das erste Open-Weight-Modell, das CyberGym anführt, und die mehr als Verdopplung bei ExploitBench (24,4 % auf 54,4 %) ist genau dort der größte Zugewinn, wo die geschlossene Frontier am weitesten vorne liegt — es liegt weiterhin hinter Mythos 5 und GPT-5.6 Sol, schließt aber einen Großteil dieser Lücke in einem einzigen Post-Training-Lauf.
Für die Open-Weight-Welt schärft das die Frontier sowohl beim Coding als auch bei der Sicherheit. Aber „open" ist ein Versprechen mit zwei Wochen Vorlauf, heute noch keine Tatsache: Derzeit führt der einzige Weg zu GLM-5.3 über den GLM Coding Plan (nutzbar in ZCode, Claude Code, OpenCode).
Was sich für Sie ändert
- Sie können es noch nicht lokal ausführen. Die Gewichte erscheinen in etwa zwei Wochen auf Hugging Face, nach Sicherheitsprüfung und Härtung.
- Heute kommt eine Breaking Change.
thinking.type: "disabled"wird nicht mehr unterstützt — setzen Siethinking.typeauf"enabled"und verwenden Siereasoning_effort(low/high/max). - Testen Sie es jetzt über den GLM Coding Plan oder ZCode, wenn Sie die Fähigkeit vor dem Release der Gewichte nutzen möchten.
FAQ
Ist GLM-5.3 heute tatsächlich Open Weights? Nein. Die Gewichte sind für etwa zwei Wochen später vorgesehen, abhängig von Sicherheitsprüfung und Härtung. Bis dahin ist es nur über den GLM Coding Plan und ZCode erreichbar.
Ist das ein neues Modell? Nein — es ist Post-Training auf derselben Basis wie GLM-5.2. Die Zugewinne stammen allein aus dem Skalieren des Post-Trainings, was den Terminal-Bench-3.0-Sprung von 4,6 % auf 28,3 % bemerkenswert macht.
Was muss ich ändern, wenn ich von GLM-5.2 migriere? Setzen Sie thinking.type auf "enabled" und ergänzen Sie reasoning_effort (low/high/max). thinking.type: "disabled" funktioniert nicht mehr.
Fazit: Die Open-Weight-Frontier ist beim Coding und bei der Sicherheit gerade schärfer geworden — aber die eigentlichen Gewichte sind ein Zwei-Wochen-Versprechen, nichts, was Sie heute herunterladen können.
Was zu tun ist
- 1 Watch for GLM-5.3 weights on Hugging Face in about two weeks (gated on safety evaluation and hardening).
- 2 Test now via GLM Coding Plan or ZCode — note thinking.type: "disabled" is gone — set it to "enabled" and use reasoning_effort.
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.