GLM-5.2 erreicht Mythos-5-Niveau bei Cybersicherheit
- Was ist passiert
- Researchers confirmed Zhipu AI's open-weight GLM-5.2 matches Anthropic's restricted Mythos 5 on specific bug-finding and cybersecurity tasks — 17 days after the US banned Mythos 5 to contain those exact capabilities.
- Warum es wichtig ist
- The export-control approach banned a US model while a Chinese lab shipped comparable cyber capabilities under an MIT license — freely downloadable, self-hostable on consumer hardware, with zero oversight. The policy premise is broken.
- Was zu tun ist
- Security teams must threat-model for cyber-capable open-weight models available to adversaries today. Policy frameworks need to account for open-weight diffusion, not just US-lab restrictions.
Die Lücke bei Cybersicherheitsfähigkeiten zwischen eingeschränkten westlichen Modellen und Open-Weight-Alternativen hat sich geschlossen. Am 28. Juni bestätigten The Verge und The Wall Street Journal, dass Zhipu AIs GLM-5.2 — ein unter der MIT-Lizenz veröffentlichtes Open-Weight-Modell — Anthropics Mythos 5 bei der Fehlersuche und der Ausnutzung von Schwachstellen erreicht. Dies geschieht 17 Tage, nachdem die US-Regierung Mythos 5 gezielt verboten hat, um genau diese Fähigkeiten aus den Händen von Gegnern fernzuhalten. Das Modell, das sie eindämmen wollten, ist jetzt frei herunterladbar.
Wie GLM-5.2 Mythos 5 bei Cybersicherheit erreichte
Am 12. Juni verbot das Weiße Haus Mythos 5 und Fable 5 aufgrund von Bedenken hinsichtlich der Verbreitung von Cyber-Fähigkeiten. Nach zwei Wochen Verhandlungen kehrte Mythos 5 zurück — allerdings nur für rund 100 US-Organisationen, die kritische Infrastruktur betreiben, mit Schutzmaßnahmen und staatlicher Aufsicht.
Unterdessen beeindruckte GLM-5.2 — am 13. Juni vom chinesischen Labor Zhipu AI gestartet — bereits bei Coding-Benchmarks: 62,1 bei SWE-bench Pro, 81,0 bei Terminal-Bench 2.1, ein 1M-Token-Kontextfenster und Preise von $1,40/$4,40 pro 1M Token. Am 28. Juni bestätigten Forscher, dass seine Cybersicherheitsleistung bei der Schwachstellenerkennung und -ausnutzung Mythos-Niveau erreicht.
Der Kontrast ist deutlich:
| Fähigkeit | Mythos 5 | GLM-5.2 |
|---|---|---|
| Zugang | ~100 geprüfte US-Organisationen, staatliche Aufsicht | Jeder, MIT-Lizenz, keine Identitätsprüfung |
| Bereitstellung | Nur Anthropic API, kein Self-Hosting | Self-Hosting via vLLM/SGLang auf Consumer-GPUs |
| Cybersicherheit | Klassenführend (83,8 % CyberGym) | Erreicht Mythos-Niveau bei Schwachstellenerkennung |
| Preise | $10/$50 pro 1M Token | $1,40/$4,40 pro 1M Token |
Warum es wichtig ist
Die GLM-5.2-Erkenntnis legt einen strukturellen Fehler im aktuellen Exportkontrollansatz offen. US-Modelle zu verbieten, während Open-Weight-Alternativen bei denselben Fähigkeiten Gleichstand erreichen, führt zu einer einseitigen Einschränkung, die:
- US-Unternehmen benachteiligt. Anthropic verliert Umsatz und Marktposition, während chinesische Alternativen an Akzeptanz gewinnen.
- Das Sicherheitsziel verfehlt. Gegner erhalten die Fähigkeit über unregulierte Kanäle.
- Ausländische Alternativen beschleunigt. Das Verbot schuf Marktnachfrage, die chinesische Labore nun bedienen.
Was sich für Sie ändert
Sicherheitsteams: Nehmen Sie GLM-5.2 als cyber-fähiges Open-Weight-Modell in Ihre Bedrohungsmodelle auf, das Gegnern ab sofort zur Verfügung steht.
Red Teams: Benchmarken Sie GLM-5.2 mit Ihren internen Schwachstellendatensätzen.
Policy-Teams: Das Mythos-5-Exportverbot basierte auf der Prämisse, Cyber-Fähigkeiten aus Gegnerhänden fernzuhalten. GLM-5.2 untergräbt diese Prämisse.
Verteidiger: Der Diffusionszeitplan hat sich gerade verkürzt. Gehen Sie davon aus, dass Gegner ab sofort Zugang zu cyber-fähigen Frontier-Modellen haben.
FAQ
Ist GLM-5.2 insgesamt wirklich so gut wie Mythos 5? Nein. Es erreicht Mythos 5 spezifisch bei Cybersicherheits-Benchmarks. Bei allgemeinem logischem Denken und den schwierigsten langfristigen Coding-Aufgaben liegt GLM-5.2 weiterhin hinter Claude Opus 4.8 und GPT-5.6.
Können Gegner GLM-5.2 realistisch für Cyberangriffe nutzen? Ja — das Modell ist MIT-lizenziert mit offenen Gewichten, d. h. jeder kann es herunterladen und auf Consumer-Hardware ohne Identitätsprüfung, Nutzungsüberwachung oder geografische Einschränkung ausführen.
Bedeutet das, dass das Mythos-5-Exportverbot sinnlos war? Nicht sinnlos, aber als alleinige Maßnahme unzureichend.
Was zu tun ist
- 1 Security teams: add GLM-5.2 to threat models as a cyber-capable open-weight model available to adversaries today
- 2 Red teams: benchmark GLM-5.2 on your internal vulnerability datasets to validate the Mythos-matching claims
- 3 Policy teams: the Mythos 5 export ban was predicated on keeping cyber capabilities out of adversary hands — GLM-5.2 undermines that premise
- 4 Defenders: assume adversaries have access to cyber-capable frontier models — compress patch cadences and update detection playbooks
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.