GLM-5.3: o modelo da Z.ai lidera o CyberGym; pesos em duas semanas
- O que aconteceu
- Z.ai released GLM-5.3, post-trained on the same base as GLM-5.2, with a more-than-6× Terminal-Bench 3.0 jump and CyberGym SOTA.
- Porque é importante
- It leads CyberGym at 84.5%, ahead of Mythos 5 and GPT-5.6 Sol — a sharper open-weight frontier on coding and security.
- O que fazer
- Test via GLM Coding Plan or ZCode now; open weights land in about two weeks after safety review.
O GLM-5.3 é o primeiro modelo de pesos abertos a liderar o CyberGym — e supera o Mythos 5 da Anthropic e o GPT-5.6 Sol da OpenAI para chegar lá. Essa é a manchete. O porém: os pesos não são liberados hoje — estão programados para daqui a cerca de duas semanas, condicionados à avaliação de segurança e ao endurecimento (hardening). (Todos os números aqui são da própria Z.ai, executados pelo harness do Claude Code; nós não os reproduzimos de forma independente.)
O que aconteceu
A Z.ai lançou o GLM-5.3 como uma atualização exclusivamente de pós-treinamento sobre o mesmo modelo-base do GLM-5.2. "Escalar o pós-treinamento foi tudo o que fizemos", segundo a Z.ai. Este não é um modelo novo — é o que um mês de RL em escala de ambiente comprou.
| Benchmark | GLM-5.2 | GLM-5.3 | Onde fica |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6% | 28,3% | SOTA open-source |
| Agents' Last Exam | 23,8% | 28,5% | — |
| CyberGym | — | 84,5% | À frente do Mythos 5 (83,8%) e do GPT-5.6 Sol (83,6%) |
| ExploitBench | 24,4% | 54,4% | Ainda atrás do Mythos 5 (78,0%) e do GPT-5.6 Sol (76,5%) |
A Z.ai afirma que o modelo encontrou 2.436 vulnerabilidades em 269 projetos — 1.097 críticas ou altas, algumas datadas de 1981.
Por que isso importa
A capacidade cibernética é a parte a se observar. O GLM-5.3 é o primeiro modelo de pesos abertos a liderar o CyberGym, e o mais-que-dobro no ExploitBench (de 24,4% para 54,4%) é o maior ganho justamente onde a fronteira fechada está mais à frente — ele ainda fica atrás do Mythos 5 e do GPT-5.6 Sol, mas fecha boa parte dessa lacuna em uma única rodada de pós-treinamento.
Para o mundo dos pesos abertos, isso afia a fronteira tanto em código quanto em segurança. Mas "aberto" é uma promessa com prazo de duas semanas, não um fato hoje: no momento, a única forma de acessar o GLM-5.3 é pelo GLM Coding Plan (utilizável no ZCode, Claude Code e OpenCode).
O que muda para você
- Você ainda não consegue rodá-lo localmente. Os pesos chegam ao Hugging Face em cerca de duas semanas, após a revisão de segurança e o endurecimento.
- Uma mudança que quebra compatibilidade chega hoje.
thinking.type: "disabled"não é mais suportado — definathinking.typecomo"enabled"e usereasoning_effort(low/high/max). - Teste agora pelo GLM Coding Plan ou pelo ZCode se você quer a capacidade antes de os pesos saírem.
FAQ
O GLM-5.3 tem mesmo pesos abertos hoje? Não. Os pesos estão programados para daqui a cerca de duas semanas, condicionados à avaliação de segurança e ao endurecimento. Até lá, ele só é acessível pelo GLM Coding Plan e pelo ZCode.
Este é um modelo novo? Não — é pós-treinamento sobre a mesma base do GLM-5.2. Os ganhos vêm apenas do escalonamento do pós-treinamento, que é o que torna notável o salto no Terminal-Bench 3.0 de 4,6% para 28,3%.
O que eu mudo se migrar do GLM-5.2? Defina thinking.type como "enabled" e adicione reasoning_effort (low/high/max). thinking.type: "disabled" não funciona mais.
Em suma: a fronteira de pesos abertos acabou de ficar mais afiada tanto em código quanto em segurança — mas os pesos em si são uma promessa de duas semanas, não algo que você possa baixar hoje.
O que fazer
- 1 Watch for GLM-5.3 weights on Hugging Face in about two weeks (gated on safety evaluation and hardening).
- 2 Test now via GLM Coding Plan or ZCode — note thinking.type: "disabled" is gone — set it to "enabled" and use reasoning_effort.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.