Contagem Regressiva do Qwen3.8-Max Open Weights: Anunciado, Mas Não Entregue
- O que aconteceu
- Alibaba confirmed on Aug 3 that Qwen3.8-Max open weights would ship 'next week' — as of Monday Aug 10, no repository exists and no license has been disclosed.
- Porque é importante
- This would be the first open-weight Qwen Max-class model, and its 27B dense companion is the artifact most developers can actually run.
- O que fazer
- Watch the Qwen HuggingFace organization page this week; do not plan production deployments around an undelivered artifact.
O veredito: anunciado, não entregue. Não planeje implantações em produção com base em um artefato não entregue e sem licença.
A conta @Alibaba_Qwen(abre num novo separador) da Alibaba confirmou em 3 de agosto que os pesos abertos do Qwen3.8-Max — um carro-chefe Mixture-of-Experts de 2,4 trilhões de parâmetros com ~95B de parâmetros ativos por token — seriam liberados "na próxima semana", junto com um novo modelo complementar denso de 27B. Essa semana é agora. Até segunda-feira, 10 de agosto, a página da organização Qwen no Hugging Face(abre num novo separador) não contém nenhum repositório correspondente, o texto da licença não foi divulgado e a única data específica — 12 de agosto — vem do usuário do X @hqmank(abre num novo separador), não da Alibaba.
Se for lançado, este seria o primeiro modelo da linha Qwen Max lançado com pesos abertos — e o segundo maior MoE de pesos abertos já criado, atrás do Kimi K3 da Moonshot (2.8T parâmetros). Isso representa uma mudança estrutural na fronteira dos pesos abertos. Mas "se" é a palavra-chave. A Alibaba nunca disponibilizou pesos abertos para um modelo da classe Max antes. Todos os carros-chefe anteriores — Qwen3-Max, Qwen3.6-Max, Qwen3.7-Max — permaneceram apenas como serviços hospedados. A taxa básica de entrega é menos certa do que o anúncio sugere.
Alibaba confirmou em 3 de agosto — pesos ainda não entregues em 10 de agosto
Em 3 de agosto, a Alibaba lançou o Qwen3.8-Max como uma API geralmente disponível com preços publicados e uma tabela completa de benchmarks. O anúncio oficial no X(abre num novo separador) estabeleceu uma janela de tempo firme:
- Pesos abertos do Qwen3.8-Max — o modelo MoE completo de 2.4T parâmetros, ~95B ativos — chegam ao Hugging Face e ModelScope durante a semana de 10 de agosto.
- Qwen3.8-27B — um modelo complementar denso de 27 bilhões de parâmetros — fica disponível com pesos abertos ao mesmo tempo. Este é o artefato que a maioria dos desenvolvedores consegue realmente executar em hardware local.
- A API hospedada está ativa no QwenCloud a $2/$6 por 1M tokens (entrada/saída) com $0,25 para entrada em cache, e uma janela de contexto de 1M tokens.
Até segunda-feira, 10 de agosto, a página da organização Qwen no Hugging Face não contém nenhum repositório correspondente, nenhum arquivo de pesos e nenhum arquivo de licença. A única data específica — 12 de agosto — vem do usuário do X @hqmank(abre num novo separador), não da Alibaba. A janela oficial vai até 16 de agosto.
A Alibaba publicou os seguintes números de benchmark com o lançamento de 3 de agosto. Todos os números são alegados pelo fornecedor — não foram reproduzidos independentemente.
| Benchmark | Qwen3.8-Max | GPT-5.6 Sol Max | Fable 5 |
|---|---|---|---|
| Terminal-Bench 2.1 | 86.6 | 88.8 | 84.6 |
| OSWorld-Verified | 86.1 | 82.7 | — |
| SWE-bench Pro | 67.7 | — | 80.0 |
| FrontierSWE | 73.5 | — | 88.8 |
A execução de codificação autônoma de 16 dias e a reprodução de pesquisa de 5 dias que a Alibaba apresentou junto com esses números são demonstrações do fornecedor, não auditorias de terceiros.
O que ainda está faltando: licença, arquivos, benchmarks, suporte de runtime
Em 10 de agosto de 2026, nada do seguinte é conhecido:
| O quê | Status |
|---|---|
| Arquivos de pesos reais | Não estão no Hugging Face ou ModelScope |
| Licença | Não divulgada — Qwen3.6 usou Apache 2.0, mas isso é precedente, não um compromisso |
| Arquitetura do 27B | Nenhum detalhe de janela de contexto, benchmark ou arquitetura publicado |
| Suporte de runtime | Nenhum guia de implantação; stacks de serving (vLLM, SGLang) precisam de uma implementação de referência |
| Builds quantizados | Quants da comunidade dependem do suporte de runtime, que depende do lançamento — dias a semanas de atraso |
| Data de entrega | 12 de agosto é um rumor de fonte secundária, não uma declaração oficial da Alibaba |
Digital Applied(abre num novo separador) coloca de forma direta: "Um compromisso com data não é um download." O anúncio de participação na receita da Alibaba para grandes usuários da API do Qwen3.8-Max — reportado junto com o lançamento — sinaliza que os termos comerciais em torno deste modelo estão evoluindo. Leia o arquivo LICENSE antes de baixar, não o tweet de lançamento.
Por que o modelo complementar de 27B importa mais do que o carro-chefe de 2.4T
Este lançamento — se acontecer — fecha uma lacuna estrutural na fronteira dos pesos abertos. A linha Qwen Max tem sido exclusiva de API desde sua criação. Abri-la sinaliza que a Alibaba está apostando na adoção do ecossistema em vez da exclusividade, a mesma jogada que a DeepSeek e a Moonshot fizeram antes deles.
Mas o modelo complementar denso de 27B é, sem dúvida, o maior negócio para a maioria dos desenvolvedores. Um MoE de 2.4T requer hardware de escala de datacenter — todos os 2.4T de pesos devem estar residentes na memória acessível ao acelerador, mesmo que apenas ~95B sejam ativados por token. O 27B cabe em uma única GPU de ponta ou em uma máquina Apple Silicon Max, na mesma categoria de outros modelos de pesos abertos de 2026 nessa escala. No r/LocalLLaMA, o 27B gerou mais entusiasmo do que o carro-chefe de 2.4T.
Para os desenvolvedores, o cálculo é dividido:
- Auto-hospedadores obtêm capacidade de classe fronteira sem taxas por token ou preocupações com jurisdição de dados — mas somente se tiverem o hardware para servir um MoE de 2.4T. Para a maioria das equipes, isso significa um cluster de GPU multi-nó.
- Usuários da API já têm acesso a $2/$6 por 1M tokens — menos de um terço dos $30 do Claude Opus 5 e menos de um quarto dos $35 do GPT-5.6 Sol Standard. Os pesos abertos não mudam essa conta hoje.
- Usuários do 27B obtêm o artefato mais prático: um modelo que roda em hardware de consumo e provavelmente é competitivo com outros modelos de pesos abertos de 2026 em sua classe.
Para o diretório: Qwen3.8-Max permanece pending. Pesos abertos são uma condição necessária, mas não suficiente, para uma recomendação. Precisamos de benchmarks independentes — não os números auto-reportados pela Alibaba — uma licença divulgada e evidências de que o modelo tem o desempenho alegado quando implantado fora da infraestrutura da Alibaba.
O que muda para você
- Monitore a página da organização Qwen no Hugging Face esta semana. A janela da semana de 10 de agosto vai até 16 de agosto. Verifique diariamente — mas não bloqueie sua sprint em um artefato não entregue.
- Leia o arquivo LICENSE antes de baixar ou integrar a qualquer projeto. O modelo de participação na receita da Alibaba para grandes usuários da API sugere que os termos comerciais estão em fluxo. Apache 2.0 é precedente do Qwen3.6, não um compromisso para o 3.8.
- Mire no 27B para experimentos de implantação local. O MoE de 2.4T requer clusters de GPU multi-nó; o 27B cabe em uma única GPU de ponta ou máquina Apple Silicon.
- Aguarde benchmarks independentes antes de avaliar a qualidade. Os números auto-reportados pela Alibaba no Terminal-Bench, OSWorld e SWE-bench são alegações do fornecedor — não auditorias de terceiros.
- Se você precisa de um modelo de produção hoje, use Qwen3.6-27B, Gemma 4 ou Kimi K3 — todos têm pesos enviados e verificados com licenças claras.
FAQ: datas de entrega, requisitos de hardware e incógnitas de licença
Os pesos realmente serão lançados em 12 de agosto? A data de 12 de agosto vem exclusivamente do usuário do X @hqmank(abre num novo separador), não da Alibaba. O compromisso oficial é "a semana de 10 de agosto". Essa janela vai até 16 de agosto. Se a data for real, espere um repositório no Hugging Face na terça-feira. Se não for, a janela ainda está aberta — e a Alibaba nunca enviou pesos abertos para um modelo da classe Max antes, então não há histórico de entrega no qual se basear.
Posso executar um MoE de 2.4T no meu próprio hardware? Não sem um datacenter. Embora arquiteturas MoE ativem apenas ~95B parâmetros por token, todos os 2.4T de pesos devem estar residentes na memória endereçável pela GPU. O modelo complementar de 27B é o artefato projetado para implantação local em uma única GPU de ponta.
Que licença devo esperar? Desconhecida. O Qwen3.6-27B usava Apache 2.0, mas o modelo de participação na receita da Alibaba para grandes usuários da API sugere que os termos comerciais estão em fluxo. Não assuma Apache 2.0. Leia o arquivo LICENSE antes de integrar.
O veredito do diretório está mudando? Não. O modelo permanece pending. Pesos abertos são um marco, não uma recomendação. Exigimos benchmarks independentes, uma licença divulgada e dados de desempenho de implantação no mundo real antes de podermos avaliá-lo.
Os benchmarks são verificados? Não. Os números de benchmark na tabela acima vêm do post de lançamento da Alibaba de 3 de agosto e não foram reproduzidos independentemente. A execução de codificação autônoma de 16 dias e a reprodução de pesquisa de 5 dias são demonstrações do fornecedor, não auditorias de terceiros.
O que fazer
- 1 Wait for the LICENSE file before downloading or integrating into any project
- 2 Target the 27B for local deployment experiments — the 2.4T MoE requires multi-node GPU clusters
- 3 Monitor the Qwen HuggingFace organization page this week for weight files
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.