Kimi K3 lidera Arena Coding a $3/$15, pesos abiertos el 27 de julio
- Qué pasó
- Moonshot AI launched Kimi K3, a 2.8T open-weight MoE model that beat Claude Fable 5 for #1 on Arena Code WebDev (1679) at $3/$15 per 1M tokens.
- Por qué importa
- It's the third Chinese frontier-competitive open-weight model this month — Hy3, GLM-5.2, and now K3 — while Google's Gemini 3.5 Pro was confirmed 'months behind' the same day, making the open-weight frontier a genuine challenge to US closed models.
- Qué hacer
- Watch the July 27 weight release, and if K3 ships open as promised, evaluate it for coding workloads where Fable 5's $10/$50 pricing is unsustainable — K3 at $3/$15 with 90%+ cache-hit rates sets a new cost baseline.
Kimi K3 es el modelo de pesos abiertos más grande jamás lanzado — y su primer acto es superar a Claude Fable 5 por el puesto #1 en Arena Code WebDev a un coste tres veces menor.
Moonshot AI lanzó el modelo de Mezcla de Expertos de 2.8 billones de parámetros el 16 de julio de 2026, con un precio fijo de $3/$15 por millón de tokens (Moonshot AI, 2026). El acceso por API ya está disponible en la app de Kimi, Kimi Code y a través de un endpoint compatible con OpenAI. Los pesos abiertos están prometidos para el 27 de julio — si se cumplen, K3 sería el modelo descargable más grande por un margen de casi 3x sobre la siguiente mayor liberación de pesos abiertos.
Lo que ofrece Kimi K3
K3 obtuvo 1679 en Arena Code WebDev — el primer puesto, por delante de Fable 5 y GPT-5.6 Sol X-High en tareas de programación front-end (LMSYS Arena, 2026). En el índice de inteligencia general de Artificial Analysis, alcanza 57 — comparable a Claude Opus 4.8 y GPT-5.5, aunque todavía por detrás de Fable 5 y Sol en pruebas de razonamiento general.
Dos nuevos componentes arquitectónicos separan a K3 de su predecesor, Kimi K2: Kimi Delta Attention (KDA), un mecanismo de atención lineal híbrida, y Attention Residuals (AttnRes). Juntos ofrecen aproximadamente 2.5x mejor eficiencia de escalado. La MoE de 896 expertos activa solo 16 expertos por token, manteniendo bajos los costes de inferencia (Moonshot AI, 2026).
| Modelo | Precio de entrada | Precio de salida | Arena WebDev | Pesos |
|---|---|---|---|---|
| Kimi K3 | $3 / 1M | $15 / 1M | 1679 (#1) | 27 jul (prometido) |
| Claude Fable 5 | $10 / 1M | $50 / 1M | #2 | Cerrado |
| GPT-5.6 Sol | $5 / 1M | $30 / 1M | #3 | Cerrado |
Moonshot está retirando su línea de modelos antiguos junto con el lanzamiento: K2.5 y la serie legacy moonshot-v1 cierran para nuevos usuarios, con apagado total el 31 de agosto (Moonshot AI, 2026).
Por qué es importante
Es el tercer modelo chino de pesos abiertos que entra en territorio competitivo de frontera en 30 días. Tencent lanzó Hy3 el 6 de julio con licencia Apache 2.0 y sólidas capacidades de tool-calling. Z.ai lanzó GLM-5.2 el 13 de junio bajo licencia MIT con contexto de 1M tokens. Ahora llega K3 con un #1 en Arena WebDev y el mayor número de parámetros jamás liberado abiertamente.
El momento es brutal para Google. El mismo día que se lanzó K3, Bloomberg confirmó que Gemini 3.5 Pro está "meses por detrás" de sus objetivos internos — el modelo estadounidense que debía ofrecer una tercera opción de frontera junto a Anthropic y OpenAI sigue sin estar disponible de forma general (Bloomberg, 2026).
Moonshot también está supuestamente recaudando nuevo capital con una valoración de $31.5 mil millones — un salto sustancial respecto a su ronda anterior, aunque la cifra de Serie C de $4.3B de enero de 2026 es difícil de verificar independientemente (Reuters, 2026). Es el tipo de trayectoria normalmente reservada para laboratorios que lanzan modelos de frontera cerrados. El mensaje es claro: los modelos de pesos abiertos están atrayendo inversión a escala de frontera.
La advertencia: K3 no lidera en razonamiento general. Fable 5 y GPT-5.6 Sol aún mantienen la ventaja en pruebas de ejecución precisa y análisis (Moonshot AI, 2026). Esto es una jugada de programación y eficiencia de costes, no una reclamación de la corona general de frontera. Y los pesos aún no son descargables — cada buque insignia anterior de Kimi sí liberó pesos abiertos, pero hasta el 27 de julio es una promesa, no un hecho.
Qué cambia para ti
Si estás pagando los precios de $10/$50 solo con créditos de Fable 5 para cargas de programación, K3 redefine la base de costes. El modelo reporta tasas de acierto de caché superiores al 90% en tareas de programación, con entrada en caché bajando a $0.30 por millón de tokens (Moonshot AI, 2026). Para un equipo que ejecuta pipelines pesados de programación a diario, la diferencia de coste no es marginal — es la diferencia entre un flujo de trabajo sostenible y uno racionado.
El acceso a pesos abiertos, si se cumple el calendario, también significa despliegue autoalojado para equipos con suficiente infraestructura GPU (64+ aceleradores). Sin dependencia de API, sin límites de tasa, sin que los datos salgan de tu infraestructura. Recomendamos evaluar K3 junto con GLM-5.2 y Hy3 una vez que los tres sean descargables.
El precio de caché es la ventaja oculta aquí. A $0.30 por millón de tokens para entrada en caché, las pasadas repetidas de programación — releyendo el mismo código base a través de iteraciones — se vuelven drásticamente más baratas. La arquitectura de K3 fue diseñada para este patrón, y las tasas de acierto del 90%+ que Moonshot reporta en cargas de programación sugieren que funciona según lo previsto.
FAQ
¿Es Kimi K3 realmente mejor que Fable 5?
En programación front-end y desarrollo web, sí — lidera Arena WebDev por un margen medible (1679 frente a la puntuación de Fable 5). En razonamiento general, ejecución precisa y pruebas de ciberseguridad, no — Fable 5 y GPT-5.6 Sol aún mantienen la ventaja. Piensa en K3 como un especialista en programación y eficiencia, no como un reemplazo de frontera de propósito general.
¿Cuándo puedo descargar los pesos?
Moonshot promete la liberación de pesos abiertos para el 27 de julio. Cada buque insignia anterior de Kimi (K1.5, K2, K2.5) liberó pesos, por lo que el historial respalda la afirmación. Hasta entonces, K3 solo está disponible vía API a través de la plataforma Kimi y endpoints compatibles con OpenAI.
¿Cómo se compara K3 con GLM-5.2 y Hy3?
K3 es más grande — 2.8 billones de parámetros frente a los 295B de Hy3 (21B activos) — y puntúa más alto en Arena WebDev. Hy3 gana en licencia permisiva Apache 2.0 y menores requisitos de autoalojamiento. GLM-5.2 tiene la ventaja de la licencia MIT y un historial más largo. Los tres son de pesos abiertos y con licencia permisiva, haciendo de esta ventana de 30 días algo sin precedentes en el panorama de modelos abiertos.
tldr
happened
Moonshot AI lanzó Kimi K3, un modelo MoE de pesos abiertos de 2.8 billones de parámetros que superó a Claude Fable 5 por el #1 en Arena Code WebDev (1679) a $3/$15 por 1M de tokens.
matters
Es el tercer modelo chino de pesos abiertos competitivo en frontera este mes — Hy3, GLM-5.2 y ahora K3 — mientras que el mismo día se confirmó que Gemini 3.5 Pro de Google está "meses por detrás", haciendo de la frontera de pesos abiertos un desafío real a los modelos cerrados de EE.UU.
action
Atento a la liberación de pesos del 27 de julio, y si K3 se publica en abierto según lo prometido, evalúalo para cargas de programación donde los precios de $10/$50 de Fable 5 son insostenibles — K3 a $3/$15 con tasas de acierto de caché del 90%+ establece una nueva base de costes.
Qué hacer
- 1 Evaluate Kimi K3 on your coding benchmarks once weights ship July 27 — at $3/$15 with 90%+ cache-hit rates, it resets the cost baseline for heavy coding workloads.
- 2 If self-hosting, budget for 64+ accelerators — K3's 2.8T MoE architecture demands serious GPU resources.
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.