GLM-5.3 Chega à API a $1.40/$4.40 por Milhão de Tokens

Z.ai logoZ.aiFYI20 de agosto de 2026Preços
O que aconteceu
GLM-5.3 is live on Z.ai's API at $1.40 input and $4.40 output per million tokens, unchanged from GLM-5.2.
Porque é importante
Independent AA scoring puts it at 60 — level with Kimi K3, three points behind Claude Opus 5, with the open-weights tie taking effect once GLM-5.3's weights ship.
O que fazer
Model GLM-5.3's ~20% verbosity bump into your cost estimate — and hold off standardizing until the open weights drop.

O GLM-5.3 já pode ser chamado na API da Z.ai a $1.40 por milhão de tokens de entrada e $4.40 por milhão de tokens de saída — inalterado em relação ao GLM-5.2 — e a avaliação independente o coloca em 60 no Artificial Analysis Intelligence Index, empatando com a pontuação de 60 do Kimi K3 — a marca que o GLM-5.3 vai igualar na classe de código aberto assim que seus pesos forem liberados. A lacuna de preços que sinalizamos no lançamento está fechada.

O que aconteceu

A Z.ai abriu o GLM-5.3 ao tráfego da API pela mesma tarifa do antecessor, com entrada em cache a $0.26 por milhão de tokens (VentureBeat, 2026).

TarifaPreço por 1M de tokens
Entrada$1.40
Saída$4.40
Entrada em cache$0.26

A Artificial Analysis o avaliou em 60 no Intelligence Index — no mesmo nível do Kimi K3 e três pontos atrás do Claude Opus 5, o líder da fronteira fechada (Unite.AI, 2026).

O ponto de atenção é a eficiência de tokens. A AA mediu o GLM-5.3 em cerca de 18.700 tokens de saída por tarefa, cerca de 20% a mais que o GLM-5.2 — o que eleva seu custo real por tarefa do Intelligence Index para cerca de $0.68 contra $0.44 do GLM-5.2, ainda 19% mais barato que o Kimi K3 por tarefa (Artificial Analysis, 2026).

Por que isso importa

O GLM-5.3 fecha sua última lacuna de lançamento: preços por token publicados. Somada a uma pontuação de inteligência de primeira linha que o coloca na classe de código aberto assim que os pesos forem liberados, isso o posiciona claramente na fronteira de Pareto para equipes que escolhem entre modelos chineses de código aberto e a fronteira fechada.

Os pesos abertos ainda ficam retidos por cerca de duas semanas para reforço de segurança — então nossa posição sobre o GLM-5.3 permanece condicional: recorra a ele agora em cargas de segurança defensiva e agênticas, mas evite padronizar até que os pesos sejam liberados.

O que muda para você

Se você fez benchmark do GLM-5.3 e segurou a decisão por causa do preço, o número agora está no ar. Modele duas coisas na sua decisão:

  • Eficiência de tokens, não apenas tarifas por token. Um aumento de ~20% na verbosidade significa que tarifas por token iguais não são custos por tarefa iguais — $0.68 por tarefa do índice contra $0.44 do GLM-5.2.
  • Espere pelos pesos. A auto-hospedagem ainda está a cerca de duas semanas; não trave sua arquitetura até que eles sejam liberados.

FAQ

O preço do GLM-5.3 mudou em relação ao GLM-5.2? Não — ele chega aos mesmos $1.40/$4.40 por milhão de tokens, com $0.26 de entrada em cache. A novidade é que a tarifa agora está publicada, não que tenha mudado.

O GLM-5.3 é mais barato que o Kimi K3? Por tarefa, sim — cerca de 19% mais barato, mesmo com ambos marcando 60 no Intelligence Index. A margem se estreita porque o GLM-5.3 é mais verboso por tarefa.

Os pesos abertos já estão disponíveis? Ainda não. A Z.ai os mantém retidos por cerca de duas semanas para reforço de segurança.

O que fazer

  1. 1 Model the ~20% verbosity bump into your per-task cost estimate before comparing GLM-5.3 to Kimi K3.
  2. 2 Hold off standardizing on GLM-5.3 until the open weights ship (~2 weeks out).

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.