GLM-5.2 égale Mythos 5 en cybersécurité
- Ce qui s’est passé
- Researchers confirmed Zhipu AI's open-weight GLM-5.2 matches Anthropic's restricted Mythos 5 on specific bug-finding and cybersecurity tasks — 17 days after the US banned Mythos 5 to contain those exact capabilities.
- Pourquoi c’est important
- The export-control approach banned a US model while a Chinese lab shipped comparable cyber capabilities under an MIT license — freely downloadable, self-hostable on consumer hardware, with zero oversight. The policy premise is broken.
- Que faire
- Security teams must threat-model for cyber-capable open-weight models available to adversaries today. Policy frameworks need to account for open-weight diffusion, not just US-lab restrictions.
L'écart de capacité en cybersécurité entre les modèles occidentaux restreints et les alternatives à poids ouverts s'est refermé. Le 28 juin, The Verge et le Wall Street Journal ont confirmé que GLM-5.2 de Zhipu AI — un modèle à poids ouverts publié sous licence MIT — égale Mythos 5 d'Anthropic sur les scénarios de découverte de bugs et d'exploitation de vulnérabilités. Cela survient 17 jours après que le gouvernement américain a interdit Mythos 5 précisément pour empêcher ces capacités de tomber entre les mains d'adversaires. Le modèle qu'ils ont tenté de contenir est désormais librement téléchargeable.
Comment GLM-5.2 a égalé Mythos 5 en cybersécurité
Le 12 juin, la Maison Blanche a interdit Mythos 5 et Fable 5 en raison de préoccupations liées à la prolifération des capacités cyber offensives. Après deux semaines de négociations, Mythos 5 est revenu — mais uniquement pour une centaine d'organisations américaines opérant des infrastructures critiques, avec garde-fous et supervision gouvernementale.
Pendant ce temps, GLM-5.2 — lancé le 13 juin par le laboratoire chinois Zhipu AI — impressionnait déjà sur les benchmarks de programmation : 62,1 sur SWE-bench Pro, 81,0 sur Terminal-Bench 2.1, une fenêtre de contexte de 1M tokens et des tarifs de 1,40 $/4,40 $ par million de tokens. Le 28 juin, des chercheurs ont confirmé que ses performances en cybersécurité atteignent le niveau Mythos sur les tâches de découverte de vulnérabilités et d'exploitation.
Le contraste est saisissant :
| Capacité | Mythos 5 | GLM-5.2 |
|---|---|---|
| Accès | ~100 organisations US sélectionnées, supervision gouvernementale | Tout le monde, licence MIT, sans vérification d'identité |
| Déploiement | API Anthropic uniquement, pas d'auto-hébergement | Auto-hébergeable via vLLM/SGLang sur GPU grand public |
| Cybersécurité | Niveau leader (83,8 % CyberGym) | Égal au niveau Mythos en découverte de vulnérabilités |
| Tarifs | 10 $/50 $ par million de tokens | 1,40 $/4,40 $ par million de tokens |
Pourquoi c'est important
La découverte concernant GLM-5.2 expose une faille structurelle dans l'approche actuelle des contrôles à l'exportation. Interdire les modèles américains pendant que des alternatives à poids ouverts atteignent la parité sur les mêmes capacités crée une restriction unilatérale qui :
- Désavantage les entreprises américaines. Anthropic perd des revenus et des parts de marché tandis que les alternatives chinoises gagnent en adoption.
- Échoue à atteindre l'objectif de sécurité. Les adversaires obtiennent la capacité par des canaux non réglementés.
- Accélère les alternatives étrangères. L'interdiction a créé une demande que les laboratoires chinois sont en train de satisfaire.
Ce qui change pour vous
Équipes de sécurité : Ajoutez GLM-5.2 à vos modèles de menace en tant que modèle à poids ouverts doté de capacités cyber, accessible aux adversaires dès aujourd'hui.
Red teams : Évaluez GLM-5.2 sur vos jeux de données internes de vulnérabilités.
Équipes réglementaires : L'interdiction d'exportation de Mythos 5 reposait sur la prémisse d'empêcher les capacités cyber de tomber entre les mains d'adversaires. GLM-5.2 sape cette prémisse.
Défenseurs : Le calendrier de diffusion vient de se comprimer. Partez du principe que les adversaires ont accès dès aujourd'hui à des modèles de pointe dotés de capacités cyber.
FAQ
Est-ce que GLM-5.2 est vraiment aussi bon que Mythos 5 dans l'ensemble ? Non. Il égale Mythos 5 spécifiquement sur les benchmarks de cybersécurité. Sur le raisonnement général et les tâches de programmation longue les plus difficiles, GLM-5.2 reste derrière Claude Opus 4.8 et GPT-5.6.
Les adversaires peuvent-ils réellement utiliser GLM-5.2 pour des cyberattaques ? Oui — le modèle est sous licence MIT avec poids ouverts, ce qui signifie que n'importe qui peut le télécharger et l'exécuter sur du matériel grand public sans aucune vérification d'identité, surveillance d'utilisation ou restriction géographique.
Cela signifie-t-il que l'interdiction d'exportation de Mythos 5 était inutile ? Pas inutile, mais insuffisante comme mesure isolée.
Que faire
- 1 Security teams: add GLM-5.2 to threat models as a cyber-capable open-weight model available to adversaries today
- 2 Red teams: benchmark GLM-5.2 on your internal vulnerability datasets to validate the Mythos-matching claims
- 3 Policy teams: the Mythos 5 export ban was predicated on keeping cyber capabilities out of adversary hands — GLM-5.2 undermines that premise
- 4 Defenders: assume adversaries have access to cyber-capable frontier models — compress patch cadences and update detection playbooks
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.