Cuenta regresiva de pesos abiertos de Qwen3.8-Max: Anunciado, pero no entregado
- Qué pasó
- Alibaba confirmed on Aug 3 that Qwen3.8-Max open weights would ship 'next week' — as of Monday Aug 10, no repository exists and no license has been disclosed.
- Por qué importa
- This would be the first open-weight Qwen Max-class model, and its 27B dense companion is the artifact most developers can actually run.
- Qué hacer
- Watch the Qwen HuggingFace organization page this week; do not plan production deployments around an undelivered artifact.
El veredicto: anunciado, pero no entregado. No planifiques despliegues en producción basándote en un artefacto que no se ha publicado ni tiene licencia.
La cuenta de Alibaba @Alibaba_Qwen(se abre en una pestaña nueva) confirmó el 3 de agosto que los pesos abiertos de Qwen3.8-Max — un buque insignia de 2.4 billones de parámetros con arquitectura Mixture-of-Experts y ~95B de parámetros activos por token — se publicarían "la próxima semana", junto con un nuevo modelo denso acompañante de 27B. Esa semana es ahora. A fecha del lunes 10 de agosto, la página de la organización Qwen en Hugging Face(se abre en una pestaña nueva) no contiene ningún repositorio equivalente, el texto de la licencia no se ha revelado y la única fecha concreta — el 12 de agosto — proviene del usuario de X @hqmank(se abre en una pestaña nueva), no de Alibaba.
Si se materializa, sería el primer modelo de la gama Qwen Max publicado con pesos abiertos — y el segundo MoE de pesos abiertos más grande jamás lanzado, solo por detrás de Kimi K3 de Moonshot (2.8 billones de parámetros). Es un cambio estructural en la frontera de los pesos abiertos. Pero "si" es la palabra clave. Alibaba nunca antes había publicado con pesos abiertos un modelo de clase Max. Todos los buques insignia anteriores — Qwen3-Max, Qwen3.6-Max, Qwen3.7-Max — se mantuvieron solo como API. La tasa base de entrega es menos segura de lo que el anuncio sugiere.
Alibaba confirmó el 3 de agosto — los pesos siguen sin entregarse el 10 de agosto
El 3 de agosto, Alibaba lanzó Qwen3.8-Max como una API disponible públicamente con precios publicados y una tabla completa de benchmarks. El anuncio oficial en X(se abre en una pestaña nueva) estableció un plazo firme:
- Pesos abiertos para Qwen3.8-Max — el modelo MoE completo de 2.4 billones de parámetros, ~95B activos — llegarán a Hugging Face y ModelScope durante la semana del 10 de agosto.
- Qwen3.8-27B — un modelo denso acompañante de 27 mil millones de parámetros — se publica con pesos abiertos al mismo tiempo. Este es el artefacto que la mayoría de los desarrolladores realmente pueden ejecutar en hardware local.
- La API alojada está disponible en QwenCloud a $2/$6 por 1M tokens (entrada/salida) con $0.25 en entrada cacheada, y una ventana de contexto de 1M tokens.
A fecha del lunes 10 de agosto, la página de la organización Qwen en HuggingFace no contiene ningún repositorio equivalente, ni archivos de pesos, ni archivo de licencia. La única fecha concreta — el 12 de agosto — proviene del usuario de X @hqmank(se abre en una pestaña nueva), no de Alibaba. La ventana oficial se extiende hasta el 16 de agosto.
Alibaba publicó las siguientes cifras de benchmarks con el lanzamiento del 3 de agosto. Todas las cifras son declaradas por el proveedor, no reproducidas de forma independiente.
| Benchmark | Qwen3.8-Max | GPT-5.6 Sol Max | Fable 5 |
|---|---|---|---|
| Terminal-Bench 2.1 | 86.6 | 88.8 | 84.6 |
| OSWorld-Verified | 86.1 | 82.7 | — |
| SWE-bench Pro | 67.7 | — | 80.0 |
| FrontierSWE | 73.5 | — | 88.8 |
La ejecución autónoma de código durante 16 días y la reproducción de investigación en 5 días que Alibaba mostró junto a estas cifras son demostraciones del proveedor, no auditorías independientes.
Lo que sigue faltando: licencia, archivos, benchmarks, soporte en tiempo de ejecución
A fecha del 10 de agosto de 2026, no se conoce nada de lo siguiente:
| Qué | Estado |
|---|---|
| Archivos de pesos reales | No están en Hugging Face ni en ModelScope |
| Licencia | No revelada — Qwen3.6 usó Apache 2.0, pero eso es un precedente, no un compromiso |
| Arquitectura del 27B | Sin detalles publicados sobre ventana de contexto, benchmark ni arquitectura |
| Soporte en tiempo de ejecución | Sin guía de despliegue; los stacks de serving (vLLM, SGLang) necesitan una implementación de referencia |
| Versiones cuantizadas | Las cuantizaciones de la comunidad dependen del soporte en runtime, que depende de la publicación — días o semanas de retraso |
| Fecha de entrega | El 12 de agosto es un rumor de fuente secundaria, no una declaración oficial de Alibaba |
Digital Applied(se abre en una pestaña nueva) lo dice sin rodeos: "Un compromiso con fecha no es una descarga". El anuncio de reparto de ingresos de Alibaba para grandes usuarios de la API de Qwen3.8-Max — reportado junto al lanzamiento — indica que los términos comerciales de este modelo están evolucionando. Lee el archivo LICENSE antes de descargar, no el tuit de lanzamiento.
Por qué el modelo acompañante de 27B importa más que el buque insignia de 2.4 billones
Este lanzamiento — si se materializa — cierra una brecha estructural en la frontera de pesos abiertos. La línea Qwen Max ha sido exclusivamente API desde su creación. Abrirla indica que Alibaba apuesta por la adopción del ecosistema frente a la exclusividad, la misma jugada que DeepSeek y Moonshot hicieron antes.
Pero el modelo denso acompañante de 27B es, para la mayoría de los desarrolladores, el movimiento más relevante. Un MoE de 2.4 billones requiere hardware a escala de centro de datos — los 2.4 billones de pesos deben residir en memoria accesible por el acelerador, aunque solo ~95B se activen por token. El modelo de 27B cabe en una sola GPU de gama alta o en una máquina Apple Silicon Max, en el mismo rango que otros modelos de pesos abiertos de 2026 a esa escala. En r/LocalLLaMA, el modelo de 27B generó más entusiasmo que el buque insignia de 2.4 billones.
Para los desarrolladores, el cálculo se divide:
- Auto-alojadores obtienen capacidad de clase frontera sin tarifas por token ni preocupaciones de jurisdicción de datos — pero solo si disponen del hardware para servir un MoE de 2.4 billones. Para la mayoría de los equipos, eso implica un clúster multi-nodo de GPUs.
- Usuarios de API ya tienen acceso a $2/$6 por 1M tokens — menos de un tercio de los $30 de Claude Opus 5 y menos de un cuarto de los $35 de GPT-5.6 Sol Standard. Los pesos abiertos no cambian esa ecuación hoy.
- Usuarios del 27B obtienen el artefacto más práctico: un modelo que se ejecuta en hardware de consumo y que probablemente sea competitivo con otros modelos de pesos abiertos de 2026 en su clase.
Para el directorio: Qwen3.8-Max se mantiene como pending. Los pesos abiertos son una condición necesaria pero no suficiente para una recomendación. Necesitamos benchmarks independientes — no las cifras auto-declaradas de Alibaba — una licencia revelada y evidencia de que el modelo rinde al nivel declarado cuando se despliega fuera de la infraestructura de Alibaba.
Qué cambia para ti
- Monitoriza la página de la organización Qwen en HuggingFace esta semana. La ventana de la semana del 10 de agosto se extiende hasta el 16 de agosto. Revisa a diario — pero no bloquees tu sprint por un artefacto no entregado.
- Lee el archivo LICENSE antes de descargar o integrar en cualquier proyecto. El modelo de reparto de ingresos de Alibaba para grandes usuarios de API sugiere que los términos comerciales están en flujo. Apache 2.0 es el precedente de Qwen3.6, no un compromiso para 3.8.
- Apunta al 27B para experimentos de despliegue local. El MoE de 2.4 billones requiere clústeres multi-nodo de GPUs; el 27B cabe en una sola GPU de gama alta o en una máquina Apple Silicon.
- Espera benchmarks independientes antes de evaluar la calidad. Las cifras auto-declaradas de Alibaba en Terminal-Bench, OSWorld y SWE-bench son declaraciones del proveedor, no auditorías independientes.
- Si necesitas un modelo de producción hoy, usa Qwen3.6-27B, Gemma 4 o Kimi K3 — todos tienen pesos publicados y verificados con licencias claras.
FAQ: fechas de entrega, requisitos de hardware e incógnitas de licencia
¿Se publicarán los pesos realmente el 12 de agosto? La fecha del 12 de agosto proviene exclusivamente del usuario de X @hqmank(se abre en una pestaña nueva), no de Alibaba. El compromiso oficial es "la semana del 10 de agosto". Esa ventana se extiende hasta el 16 de agosto. Si la fecha es real, espera un repositorio en HuggingFace el martes. Si no, la ventana sigue abierta — y Alibaba nunca antes ha publicado pesos abiertos para un modelo de clase Max, así que no hay historial de entregas en el que apoyarse.
¿Puedo ejecutar un MoE de 2.4 billones en mi propio hardware? No sin un centro de datos. Aunque las arquitecturas MoE solo activen ~95B parámetros por token, los 2.4 billones de pesos deben residir en memoria direccionable por GPU. El modelo acompañante de 27B es el artefacto diseñado para despliegue local en una sola GPU de gama alta.
¿Qué licencia debo esperar? Se desconoce. Qwen3.6-27B llevaba Apache 2.0, pero el modelo de reparto de ingresos de Alibaba para grandes usuarios de API sugiere que los términos comerciales están en flujo. No asumas Apache 2.0. Lee el archivo LICENSE antes de integrar.
¿Va a cambiar el veredicto del directorio? No. El modelo se mantiene como pending. Los pesos abiertos son un hito, no una recomendación. Necesitamos benchmarks independientes, una licencia revelada y datos de rendimiento en despliegues reales antes de poder calificarlo.
¿Están verificados los benchmarks? No. Las cifras de la tabla anterior provienen del anuncio de lanzamiento de Alibaba del 3 de agosto y no han sido reproducidas de forma independiente. La ejecución autónoma de código durante 16 días y la reproducción de investigación en 5 días son demostraciones del proveedor, no auditorías independientes.
Qué hacer
- 1 Wait for the LICENSE file before downloading or integrating into any project
- 2 Target the 27B for local deployment experiments — the 2.4T MoE requires multi-node GPU clusters
- 3 Monitor the Qwen HuggingFace organization page this week for weight files
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.