GLM-5.2
Z.ai · Lanzado jun 2026
El mejor modelo de código de pesos abiertos con contexto de 1M tokens y licencia MIT — supera a GPT-5.5 en múltiples benchmarks a una fracción del costo, pero aún va por detrás de Claude Opus 4.8 en las tareas más difíciles de largo alcance.
¿Es adecuada para ti?
Bueno para
- El modelo de código de pesos abiertos más potente en su lanzamiento — 62,1 en SWE-bench Pro, 81,0 en Terminal-Bench 2.1
- Ventana de contexto de 1M tokens — 5× más grande que GLM-5.1; procesa codebases enteras en un solo prompt
- Licencia MIT con pesos abiertos — totalmente autoalojable, sin restricciones de ingresos, uso comercial permitido
- Mejora masiva sobre GLM-5.1 — Terminal-Bench 2.1 saltó de 62,0 a 81,0; DeepSWE de 18,0 a 46,2
- La arquitectura IndexShare reduce los FLOPs por token en 2,9× con contexto de 1M — hace viable económicamente la programación de contexto largo
- Modos duales de esfuerzo de razonamiento (High y Max) — intercambia velocidad por profundidad
No recomendado para
- Alto consumo de tokens — algunos informes señalan un gasto elevado de tokens para tareas equivalentes frente a llamadas directas a la API
- El código de entrenamiento y el informe técnico completo no se publicaron en el lanzamiento — solo pesos de inferencia bajo MIT
- Aún por detrás de Claude Opus 4.8 en las tareas más difíciles (SWE-bench Pro: 62,1 vs 69,2; SWE-Marathon: 13,0 vs 26,0)
Rendimiento por tarea
Generación de código
El mejor modelo de pesos abiertos; supera a GPT-5.5 en SWE-bench Pro (62,1) y Terminal-Bench 2.1 (81,0)
Agentes de programación de largo alcance
Contexto de 1M maneja codebases enteras; buenos resultados en FrontierSWE (74,4) y DeepSWE (46,2) pero por detrás de Claude Opus 4.8
Programación competitiva
AIME 2026: 99,2; IMOAnswerBench: 91,0 — razonamiento matemático y de código líder en pesos abiertos
Razonamiento general
GPQA-D: 91,2; HLE: 40,5 — competitivo pero por detrás de Claude Opus 4.8 (93,6/49,8)
Precios
Entrada
$1.40 / 1M tokens
Salida
$4.40 / 1M tokens
Contexto
1M tokens
Pruebas de rendimiento
| Prueba | Puntuación | Fuente |
|---|---|---|
| SWE-bench Pro | 62.1 | Fuente |
| Terminal-Bench 2.1 (Terminus-2) | 81.0 | Fuente |
| Terminal-Bench 2.1 (Best Harness, Claude Code) | 82.7 | Fuente |
| FrontierSWE | 74.4 | Fuente |
| DeepSWE | 46.2 | Fuente |
| AIME 2026 | 99.2 | Fuente |
| GPQA-Diamond | 91.2 | Fuente |
| HLE (Humanity's Last Exam) | 40.5 | Fuente |
| HLE w/ Tools | 54.7 | Fuente |
| SWE-Marathon | 13.0 | Fuente |
| MCP-Atlas Public Set | 76.8 | Fuente |
| PostTrainBench | 34.3 | Fuente |
Aún no hay cambios de veredicto
El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.
Fuentes
- Developer Techjun 2026
- FelloAI — GLM-5.2 Complete Guidejun 2026
- Codersera — GLM-5.2 Complete Guidejun 2026
- Labellerr — GLM-5.2 Beats GPT-5.5jun 2026
- VentureBeat — GLM-5.2 Benchmark Coveragejun 2026
- llm-stats.com — GLM-5.2 Pricing & Benchmarksjun 2026
- BuildFastWithAI — GLM-5.2 Reviewjun 2026
- kilo.ai — GLM-5.2 Model Pagejun 2026
Registro de verificación
- Precios— Sin cambios
Agente automatizado
- Precios— Sin cambios
Agente automatizado
- Precios— Requiere atención
Agente automatizado
Source unavailable: z.ai/pricing returned HTTP 404. Stored pricing ($1.40/$4.40) retained.
- Precios— Sin cambios
Agente automatizado
Pricing unchanged: $1.40/$4.40 per 1M tokens, 1M context. z.ai/pricing returned 404 but aipricing.guru confirms rates as of Jun 28.
- Precios— Sin cambios
Agente automatizado
GLM-5.2 unchanged: $1.40/$4.40, 1M context. z.ai/pricing 404 but FriendliAI & Novita confirm rates.
- Precios— Sin cambios
Agente automatizado
- Precios— Sin cambios
Importado en el lanzamiento
- Perfil— Sin cambios
Importado en el lanzamiento