GLM-5.2
Z.ai · Lançado 06/2026
Melhor modelo de código com pesos abertos, 1M tokens de contexto e licença MIT — supera o GPT-5.5 em múltiplos benchmarks por uma fração do custo, mas ainda fica atrás do Claude Opus 4.8 nas tarefas mais difíceis de longa duração.
É adequada para ti?
Bom para
- Modelo de código de pesos abertos mais forte no lançamento — 62,1 no SWE-bench Pro, 81,0 no Terminal-Bench 2.1
- Janela de contexto de 1M tokens — 5 vezes maior que o GLM-5.1; pode processar bases de código inteiras num único prompt
- Licença MIT com pesos abertos — totalmente auto-hospedável, sem restrições de receita, uso comercial permitido
- Melhoria massiva sobre o GLM-5.1 — Terminal-Bench 2.1 saltou de 62,0 para 81,0; DeepSWE de 18,0 para 46,2
- Arquitetura IndexShare reduz os FLOPs por token em 2,9 vezes em contexto de 1M — torna a codificação de contexto longo economicamente viável
- Modos duplos de esforço de raciocínio (Alto e Máx.) — troque velocidade por profundidade
Não recomendado para
- Grande apetite por tokens — alguns relatos de consumo elevado de tokens para tarefas equivalentes face a chamadas diretas de API
- Código de treino e relatório técnico completo não divulgados no lançamento — apenas pesos de inferência sob MIT
- Ainda atrás do Claude Opus 4.8 nas tarefas mais difíceis (SWE-bench Pro: 62,1 vs 69,2; SWE-Marathon: 13,0 vs 26,0)
Desempenho por tarefa
Geração de código
Melhor modelo de pesos abertos; supera o GPT-5.5 no SWE-bench Pro (62,1) e Terminal-Bench 2.1 (81,0)
Agentes de codificação de longo horizonte
Contexto de 1M lida com bases de código inteiras; forte no FrontierSWE (74,4) e DeepSWE (46,2) mas fica atrás do Claude Opus 4.8
Programação competitiva
AIME 2026: 99,2; IMOAnswerBench: 91,0 — raciocínio matemático/código de pesos abertos líder da classe
Raciocínio geral
GPQA-D: 91,2; HLE: 40,5 — competitivo mas fica atrás do Claude Opus 4.8 (93,6/49,8)
Preços
Entrada
$1.40 / 1M tokens
Saída
$4.40 / 1M tokens
Contexto
1M tokens
Testes de desempenho
| Teste | Pontuação | Fonte |
|---|---|---|
| SWE-bench Pro | 62.1 | Fonte |
| Terminal-Bench 2.1 (Terminus-2) | 81.0 | Fonte |
| Terminal-Bench 2.1 (Best Harness, Claude Code) | 82.7 | Fonte |
| FrontierSWE | 74.4 | Fonte |
| DeepSWE | 46.2 | Fonte |
| AIME 2026 | 99.2 | Fonte |
| GPQA-Diamond | 91.2 | Fonte |
| HLE (Humanity's Last Exam) | 40.5 | Fonte |
| HLE w/ Tools | 54.7 | Fonte |
| SWE-Marathon | 13.0 | Fonte |
| MCP-Atlas Public Set | 76.8 | Fonte |
| PostTrainBench | 34.3 | Fonte |
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- Developer Tech06/2026
- FelloAI — GLM-5.2 Complete Guide06/2026
- Codersera — GLM-5.2 Complete Guide06/2026
- Labellerr — GLM-5.2 Beats GPT-5.506/2026
- VentureBeat — GLM-5.2 Benchmark Coverage06/2026
- llm-stats.com — GLM-5.2 Pricing & Benchmarks06/2026
- BuildFastWithAI — GLM-5.2 Review06/2026
- kilo.ai — GLM-5.2 Model Page06/2026
Registo de verificação
- Preços— Sem alterações
Agente automatizado
- Preços— Sem alterações
Agente automatizado
- Preços— Requer atenção
Agente automatizado
Source unavailable: z.ai/pricing returned HTTP 404. Stored pricing ($1.40/$4.40) retained.
- Preços— Sem alterações
Agente automatizado
Pricing unchanged: $1.40/$4.40 per 1M tokens, 1M context. z.ai/pricing returned 404 but aipricing.guru confirms rates as of Jun 28.
- Preços— Sem alterações
Agente automatizado
GLM-5.2 unchanged: $1.40/$4.40, 1M context. z.ai/pricing 404 but FriendliAI & Novita confirm rates.
- Preços— Sem alterações
Agente automatizado
- Preços— Sem alterações
Importado no lançamento
- Perfil— Sem alterações
Importado no lançamento