GLM-5.3 Chega à API a $1.40/$4.40 por Milhão de Tokens
- O que aconteceu
- GLM-5.3 is live on Z.ai's API at $1.40 input and $4.40 output per million tokens, unchanged from GLM-5.2.
- Porque é importante
- Independent AA scoring puts it at 60 — level with Kimi K3, three points behind Claude Opus 5, with the open-weights tie taking effect once GLM-5.3's weights ship.
- O que fazer
- Model GLM-5.3's ~20% verbosity bump into your cost estimate — and hold off standardizing until the open weights drop.
O GLM-5.3 já pode ser chamado na API da Z.ai a $1.40 por milhão de tokens de entrada e $4.40 por milhão de tokens de saída — inalterado em relação ao GLM-5.2 — e a avaliação independente o coloca em 60 no Artificial Analysis Intelligence Index, empatando com a pontuação de 60 do Kimi K3 — a marca que o GLM-5.3 vai igualar na classe de código aberto assim que seus pesos forem liberados. A lacuna de preços que sinalizamos no lançamento está fechada.
O que aconteceu
A Z.ai abriu o GLM-5.3 ao tráfego da API pela mesma tarifa do antecessor, com entrada em cache a $0.26 por milhão de tokens (VentureBeat, 2026).
| Tarifa | Preço por 1M de tokens |
|---|---|
| Entrada | $1.40 |
| Saída | $4.40 |
| Entrada em cache | $0.26 |
A Artificial Analysis o avaliou em 60 no Intelligence Index — no mesmo nível do Kimi K3 e três pontos atrás do Claude Opus 5, o líder da fronteira fechada (Unite.AI, 2026).
O ponto de atenção é a eficiência de tokens. A AA mediu o GLM-5.3 em cerca de 18.700 tokens de saída por tarefa, cerca de 20% a mais que o GLM-5.2 — o que eleva seu custo real por tarefa do Intelligence Index para cerca de $0.68 contra $0.44 do GLM-5.2, ainda 19% mais barato que o Kimi K3 por tarefa (Artificial Analysis, 2026).
Por que isso importa
O GLM-5.3 fecha sua última lacuna de lançamento: preços por token publicados. Somada a uma pontuação de inteligência de primeira linha que o coloca na classe de código aberto assim que os pesos forem liberados, isso o posiciona claramente na fronteira de Pareto para equipes que escolhem entre modelos chineses de código aberto e a fronteira fechada.
Os pesos abertos ainda ficam retidos por cerca de duas semanas para reforço de segurança — então nossa posição sobre o GLM-5.3 permanece condicional: recorra a ele agora em cargas de segurança defensiva e agênticas, mas evite padronizar até que os pesos sejam liberados.
O que muda para você
Se você fez benchmark do GLM-5.3 e segurou a decisão por causa do preço, o número agora está no ar. Modele duas coisas na sua decisão:
- Eficiência de tokens, não apenas tarifas por token. Um aumento de ~20% na verbosidade significa que tarifas por token iguais não são custos por tarefa iguais — $0.68 por tarefa do índice contra $0.44 do GLM-5.2.
- Espere pelos pesos. A auto-hospedagem ainda está a cerca de duas semanas; não trave sua arquitetura até que eles sejam liberados.
FAQ
O preço do GLM-5.3 mudou em relação ao GLM-5.2? Não — ele chega aos mesmos $1.40/$4.40 por milhão de tokens, com $0.26 de entrada em cache. A novidade é que a tarifa agora está publicada, não que tenha mudado.
O GLM-5.3 é mais barato que o Kimi K3? Por tarefa, sim — cerca de 19% mais barato, mesmo com ambos marcando 60 no Intelligence Index. A margem se estreita porque o GLM-5.3 é mais verboso por tarefa.
Os pesos abertos já estão disponíveis? Ainda não. A Z.ai os mantém retidos por cerca de duas semanas para reforço de segurança.
O que fazer
- 1 Model the ~20% verbosity bump into your per-task cost estimate before comparing GLM-5.3 to Kimi K3.
- 2 Hold off standardizing on GLM-5.3 until the open weights ship (~2 weeks out).
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.