GLM-5.3 llega a la API a $1.40/$4.40 por millón de tokens
- Qué pasó
- GLM-5.3 is live on Z.ai's API at $1.40 input and $4.40 output per million tokens, unchanged from GLM-5.2.
- Por qué importa
- Independent AA scoring puts it at 60 — level with Kimi K3, three points behind Claude Opus 5, with the open-weights tie taking effect once GLM-5.3's weights ship.
- Qué hacer
- Model GLM-5.3's ~20% verbosity bump into your cost estimate — and hold off standardizing until the open weights drop.
GLM-5.3 ya se puede invocar desde la API de Z.ai a $1.40 por millón de tokens de entrada y $4.40 por millón de tokens de salida — sin cambios respecto a GLM-5.2 — y una evaluación independiente lo sitúa en 60 en el Índice de Inteligencia de Artificial Analysis, empatando la puntuación de 60 de Kimi K3 — la marca que GLM-5.3 igualará en la categoría de pesos abiertos una vez que publique sus pesos. La brecha de precios que señalamos en su lanzamiento queda cerrada.
Qué pasó
Z.ai abrió GLM-5.3 al tráfico de la API a la misma tarifa que su predecesor, con la entrada en caché a $0.26 por millón de tokens (VentureBeat, 2026).
| Tarifa | Precio por 1M de tokens |
|---|---|
| Entrada | $1.40 |
| Salida | $4.40 |
| Entrada en caché | $0.26 |
Artificial Analysis lo evaluó con 60 en el Índice de Inteligencia — a la par de Kimi K3 y tres puntos por detrás de Claude Opus 5, el líder de la frontera cerrada (Unite.AI, 2026).
El problema es la eficiencia de tokens. AA midió GLM-5.3 en aproximadamente 18,700 tokens de salida por tarea, cerca de un 20% más que GLM-5.2 — lo que eleva su coste real por tarea del Índice de Inteligencia a unos $0.68 frente a los $0.44 de GLM-5.2, todavía un 19% más barato que Kimi K3 por tarea (Artificial Analysis, 2026).
Por qué importa
GLM-5.3 cierra su última brecha de lanzamiento: el precio por token publicado. Combinado con una puntuación de inteligencia de primer nivel que lo sitúa en la categoría de pesos abiertos una vez que se publiquen, lo coloca de lleno en la frontera de Pareto para los equipos que eligen entre modelos chinos de pesos abiertos y la frontera cerrada.
Los pesos abiertos siguen retenidos aproximadamente dos semanas para el endurecimiento de seguridad — así que nuestra postura sobre GLM-5.3 se mantiene condicional: recurre a él ya en cargas de seguridad defensiva y agénticas, pero no lo estandarices hasta que se publiquen los pesos.
Qué cambia para ti
Si evaluaste GLM-5.3 y te contuviste por el precio, la cifra ya está disponible. Incorpora dos cosas a tu decisión:
- Eficiencia de tokens, no solo tarifas por token. Un aumento de ~20% en la verbosidad significa que unas tarifas por token planas no son costes por tarea planos — $0.68 por tarea del índice frente a $0.44 para GLM-5.2.
- Espera a los pesos. El autoalojamiento todavía está a unas dos semanas; no fijes tu arquitectura hasta que se publiquen.
FAQ
¿Cambió el precio de GLM-5.3 respecto a GLM-5.2? No — llega con los mismos $1.40/$4.40 por millón de tokens y $0.26 de entrada en caché. La noticia es que la tarifa ya está publicada, no que haya cambiado.
¿Es GLM-5.3 más barato que Kimi K3? Por tarea, sí — cerca de un 19% más barato, aunque ambos obtienen 60 en el Índice de Inteligencia. El margen se estrecha porque GLM-5.3 es más verboso por tarea.
¿Están disponibles los pesos abiertos? Todavía no. Z.ai los está reteniendo aproximadamente dos semanas para el endurecimiento de seguridad.
Qué hacer
- 1 Model the ~20% verbosity bump into your per-task cost estimate before comparing GLM-5.3 to Kimi K3.
- 2 Hold off standardizing on GLM-5.3 until the open weights ship (~2 weeks out).
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.