Preços da API do Qwen3.8-Max Chegam a $2/$6 por 1M de Tokens
- O que aconteceu
- Qwen3.8-Max now has published per-token API pricing at $2 input / $6 output per million tokens on QwenCloud, replacing the credit-only Token Plan preview.
- Porque é importante
- At $2/$6 it undercuts Kimi K3 by 2.5x on output and matches Grok 4.5 at the same rate — the first Max-class Qwen model with transparent per-token costs.
- O que fazer
- Test Qwen3.8-Max on coding and agent workloads at the published $2/$6 rate; monitor Hugging Face and ModelScope for open weights (promised this week) before committing to self-hosted deployments.
O Qwen3.8-Max, o carro-chefe Mixture-of-Experts de 2,4 trilhões de parâmetros do Alibaba, agora tem preços publicados de API por token no QwenCloud: $2,00 por milhão de tokens de entrada e $6,00 por milhão de tokens de saída. Isso substitui o sistema de preços por Token Plan baseado em créditos que estava em vigor desde a prévia de 19 de julho. Nosso veredito permanece pending — os preços agora são transparentes, mas pesos abertos, benchmarks independentes e uma licença divulgada ainda estão faltando.
O que aconteceu
Em 3 de agosto de 2026, o Alibaba moveu o Qwen3.8-Max de prévia para disponibilidade geral, publicando preços padrão pay-as-you-go por token a $2/$6 por milhão de tokens (QwenCloud, 2026). Por sete semanas antes, o modelo estava restrito aos planos de assinatura Token Plan do QwenCloud — usuários compravam pacotes mensais de crédito sem uma tabela de preços padrão.
O modelo é uma arquitetura MoE de 2,4T de parâmetros ativando aproximadamente 95 bilhões de parâmetros por token, com uma janela de contexto de 1 milhão de tokens e entrada multimodal nativa cobrindo texto, imagens, vídeo e documentos (QwenCloud, 2026). É acessível via APIs compatíveis com OpenAI e Anthropic, tornando-o drop-in compatível com Cursor, Claude Code, Codex e OpenCode.
O Alibaba se comprometeu a liberar pesos abertos tanto para o Qwen3.8-Max quanto para o acompanhante menor Qwen3.8-27B "dentro de cerca de uma semana" do lançamento GA de 3 de agosto (Alibaba Qwen, 2026) — o que colocaria o lançamento na semana de 10 de agosto. Até hoje (11 de agosto), nenhum repositório apareceu no Hugging Face ou ModelScope, e nenhuma licença foi divulgada.
Por que isso importa
A $2/$6, o Qwen3.8-Max tem preços agressivos para um modelo de escala de fronteira:
| Modelo | Entrada (por 1M tokens) | Saída (por 1M tokens) |
|---|---|---|
| Qwen3.8-Max | $2,00 | $6,00 |
| Kimi K3 | $3,00 | $15,00 |
| Grok 4.5 | $2,00 | $6,00 |
| Claude Opus 5 | $5,00 | $25,00 |
| GPT-5.6 Sol | $5,00 | $30,00 |
Ele reduz o Kimi K3 em 2,5x nos tokens de saída e iguala o Grok 4.5 na mesma taxa. Combinado com a janela de contexto de 1M de tokens e compatibilidade com API OpenAI/Anthropic, desenvolvedores agora podem testar um modelo de escala de fronteira em suas ferramentas existentes a um custo conhecido e competitivo.
A promessa de pesos abertos é o verdadeiro fator de decisão. Se o Alibaba liberar os pesos sob uma licença permissiva, o Qwen3.8-Max se torna o maior modelo de pesos abertos já lançado — maior em termos práticos que o Kimi K3, cuja licença impõe restrições comerciais e divulgações obrigatórias para provedores de Model-as-a-Service. Se os pesos não forem liberados, ou forem liberados sob termos restritivos, o modelo permanece mais uma opção apenas via API.
Os benchmarks auto-reportados do Alibaba colocam o Qwen3.8-Max em 86,1 no OSWorld-Verified, à frente tanto do GPT-5.6 Sol Max (83,2) quanto do Claude Fable 5 (85,0) nesse teste específico. Mas a verificação independente permanece limitada — até 8 de agosto, nem Artificial Analysis nem LMArena haviam pontuado o modelo independentemente.
O que muda para você
Se você já está testando o Qwen3.8-Max via Token Plan, agora você pode modelar seus custos a $2/$6 antes de se comprometer com cargas de trabalho em produção. Fixe o identificador de modelo qwen3.8-max explicitamente — um alias genérico "latest" corre o risco de uma futura troca de modelo silenciosamente alterar seu perfil de custo ou comportamento.
Se você está esperando pelos pesos abertos, a semana de 10 de agosto é a janela com a qual o Alibaba se comprometeu. Monitore a organização Qwen no Hugging Face e ModelScope pelos repositórios Qwen3.8-Max e Qwen3.8-27B. Até que a licença seja publicada, trate o lançamento de pesos abertos como uma promessa condicional, não um fato consumado.
Para implantações em produção, espere por benchmarks independentes do Artificial Analysis ou equivalente antes de se comprometer. Os números auto-reportados do Alibaba são direcionalmente fortes, mas não verificados.
FAQ
O Qwen3.8-Max é open source? Ainda não. O Alibaba se comprometeu a liberar pesos abertos tanto para o carro-chefe Max quanto para o acompanhante 27B dentro de uma semana do lançamento GA de 3 de agosto. Até 11 de agosto, nenhum modelo apareceu no Hugging Face ou ModelScope, e nenhuma licença foi divulgada.
Posso usá-lo com minhas ferramentas existentes? Sim. O Qwen3.8-Max suporta protocolos de API compatíveis com OpenAI e Anthropic, então funciona com Cursor, Claude Code, Codex, OpenCode e Qwen Code imediatamente. Use o ID de modelo qwen3.8-max e sua chave de API do QwenCloud.
Como ele se compara ao Kimi K3? Em preços, o Qwen3.8-Max é 2,5x mais barato na saída ($6 vs. $15 por milhão de tokens). Em benchmarks, as pontuações auto-reportadas do Alibaba são competitivas, mas não verificadas. O K3 tem pesos publicados sob uma licença restritiva; os pesos do Qwen3.8-Max ainda estão pendentes.
O que fazer
- 1 Test Qwen3.8-Max on coding and agent workloads at the published $2 input / $6 output per million tokens
- 2 Pin the explicit model identifier qwen3.8-max — do not use a generic 'latest' alias
- 3 Monitor Hugging Face and ModelScope for the promised open-weight release this week
- 4 Wait for independent benchmarks from Artificial Analysis or LMArena before production deployment
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.