Qwen3.8-Max : compte à rebours des poids ouverts — annoncé, mais pas livré

Alibaba logoAlibabaImportant10 août 2026Modèles
Ce qui s’est passé
Alibaba confirmed on Aug 3 that Qwen3.8-Max open weights would ship 'next week' — as of Monday Aug 10, no repository exists and no license has been disclosed.
Pourquoi c’est important
This would be the first open-weight Qwen Max-class model, and its 27B dense companion is the artifact most developers can actually run.
Que faire
Watch the Qwen HuggingFace organization page this week; do not plan production deployments around an undelivered artifact.

Le verdict : annoncé, pas livré. Ne planifiez pas de déploiements en production autour d'un artefact non livré et sans licence.

Le compte @Alibaba_Qwen(s’ouvre dans un nouvel onglet) a confirmé le 3 août que les poids ouverts de Qwen3.8-Max — un flagship Mixture-of-Experts de 2,4 billions de paramètres avec ~95B de paramètres actifs par token — seraient publiés « la semaine prochaine », accompagnés d'un nouveau compagnon dense 27B. Cette semaine, c'est maintenant. En ce lundi 10 août, la page de l'organisation Qwen sur Hugging Face(s’ouvre dans un nouvel onglet) ne contient aucun dépôt correspondant, le texte de la licence n'est pas divulgué, et la seule date précise — le 12 août — provient de l'utilisateur X @hqmank(s’ouvre dans un nouvel onglet), pas d'Alibaba.

Si cela aboutit, ce serait le premier modèle de la gamme Qwen Max publié avec des poids ouverts — et le deuxième plus grand MoE à poids ouverts jamais publié, après le Kimi K3 de Moonshot (2,8T paramètres). C'est un changement structurel pour la frontière des poids ouverts. Mais « si » est le mot clé. Alibaba n'a jamais ouvert les poids d'un modèle de classe Max auparavant. Tous les flagships précédents — Qwen3-Max, Qwen3.6-Max, Qwen3.7-Max — sont restés exclusivement hébergés. La probabilité de livraison est moins certaine que l'annonce ne le suggère.

Alibaba a confirmé le 3 août — les poids toujours non livrés le 10 août

Le 3 août, Alibaba a lancé Qwen3.8-Max en tant qu'API généralement disponible avec des tarifs publiés et un tableau complet de benchmarks. L'annonce officielle sur X(s’ouvre dans un nouvel onglet) a établi une fenêtre temporelle ferme :

  • Poids ouverts pour Qwen3.8-Max — le modèle MoE complet de 2,4T paramètres, ~95B actifs — arrivent sur Hugging Face et ModelScope durant la semaine du 10 août.
  • Qwen3.8-27B — un compagnon dense de 27 milliards de paramètres — passe en poids ouverts au même moment. C'est l'artefact que la plupart des développeurs peuvent réellement exécuter sur du matériel local.
  • L'API hébergée est disponible sur QwenCloud à 2 $/6 $ par 1M tokens (entrée/sortie) avec 0,25 $ en entrée mise en cache, et une fenêtre de contexte de 1M tokens.

Ce lundi 10 août, la page de l'organisation Qwen sur HuggingFace ne contient aucun dépôt correspondant, aucun fichier de poids, ni aucun fichier de licence. La seule date précise — le 12 août — provient de l'utilisateur X @hqmank(s’ouvre dans un nouvel onglet), pas d'Alibaba. La fenêtre officielle court jusqu'au 16 août.

Alibaba a publié les chiffres de benchmark suivants avec le lancement du 3 août. Tous les chiffres sont revendiqués par le fournisseur — non reproduits indépendamment.

BenchmarkQwen3.8-MaxGPT-5.6 Sol MaxFable 5
Terminal-Bench 2.186,688,884,6
OSWorld-Verified86,182,7
SWE-bench Pro67,780,0
FrontierSWE73,588,8

La démonstration de codage autonome sur 16 jours et la reproduction de recherche sur 5 jours présentées par Alibaba sont des démonstrations du fournisseur, pas des audits tiers.

Ce qui manque encore : licence, fichiers, benchmarks, support d'exécution

Au 10 août 2026, aucun des éléments suivants n'est connu :

ÉlémentStatut
Fichiers de poids réelsAbsents de Hugging Face et ModelScope
LicenceNon divulguée — Qwen3.6 utilisait Apache 2.0, mais c'est un précédent, pas un engagement
Architecture du 27BAucune fenêtre de contexte, benchmark ou détail d'architecture publié
Support d'exécutionAucun guide de déploiement ; les stacks d'inférence (vLLM, SGLang) ont besoin d'une implémentation de référence
Builds quantifiésLes quants communautaires suivent le support d'exécution, qui suit la sortie — des jours voire des semaines de décalage
Date de livraisonLe 12 août est une rumeur de source secondaire, pas une déclaration officielle d'Alibaba

Digital Applied(s’ouvre dans un nouvel onglet) le dit sans détour : « Un engagement daté n'est pas un téléchargement. » L'annonce par Alibaba d'un partage de revenus pour les gros utilisateurs de l'API Qwen3.8-Max — signalée lors du lancement — indique que les conditions commerciales autour de ce modèle évoluent. Lisez le fichier LICENSE avant de télécharger, pas le tweet de lancement.

Pourquoi le compagnon 27B importe plus que le flagship 2,4T

Cette sortie — si elle aboutit — comble un vide structurel dans la frontière des poids ouverts. La gamme Qwen Max est exclusivement API depuis sa création. L'ouvrir signale qu'Alibaba mise sur l'adoption par l'écosystème plutôt que sur l'exclusivité, la même stratégie que DeepSeek et Moonshot ont suivie avant eux.

Mais le compagnon dense 27B est sans doute la plus grosse affaire pour la plupart des développeurs. Un MoE 2,4T nécessite du matériel à l'échelle d'un datacenter — tous les 2,4T de poids doivent résider en mémoire accessible par l'accélérateur, même si seulement ~95B s'activent par token. Le 27B tient sur un seul GPU haut de gamme ou une machine Apple Silicon Max, dans la même catégorie que les autres modèles à poids ouverts de 2026 à cette échelle. Sur r/LocalLLaMA, le 27B a généré plus d'enthousiasme que le flagship 2,4T.

Pour les développeurs, le calcul est divisé :

  • Les auto-hébergeurs obtiennent une capacité de classe frontière sans frais par token ni problèmes de juridiction des données — mais seulement s'ils disposent du matériel pour servir un MoE 2,4T. Pour la plupart des équipes, cela signifie un cluster GPU multi-nœuds.
  • Les utilisateurs de l'API y ont déjà accès à 2 $/6 $ par 1M tokens — moins d'un tiers des 30 $ de Claude Opus 5 et moins d'un quart des 35 $ de GPT-5.6 Sol Standard. Les poids ouverts ne changent pas ce calcul aujourd'hui.
  • Les utilisateurs du 27B obtiennent l'artefact le plus pratique : un modèle qui tourne sur du matériel grand public et probablement compétitif avec les autres modèles à poids ouverts de 2026 dans sa catégorie.

Pour le répertoire : Qwen3.8-Max reste pending. Les poids ouverts sont une condition nécessaire mais pas suffisante pour une recommandation. Nous avons besoin de benchmarks indépendants — pas les chiffres auto-déclarés d'Alibaba — d'une licence divulguée, et de preuves que le modèle performe au niveau revendiqué lorsqu'il est déployé en dehors de l'infrastructure d'Alibaba.

Ce qui change pour vous

  • Surveillez la page de l'organisation Qwen sur HuggingFace cette semaine. La fenêtre de la semaine du 10 août court jusqu'au 16 août. Vérifiez quotidiennement — mais ne bloquez pas votre sprint sur un artefact non livré.
  • Lisez le fichier LICENSE avant de télécharger ou d'intégrer dans un projet. Le modèle de partage de revenus d'Alibaba pour les gros utilisateurs de l'API suggère que les conditions commerciales évoluent. Apache 2.0 est un précédent de Qwen3.6, pas un engagement pour la 3.8.
  • Ciblez le 27B pour les expérimentations de déploiement local. Le MoE 2,4T nécessite des clusters GPU multi-nœuds ; le 27B tient sur un seul GPU haut de gamme ou une machine Apple Silicon.
  • Attendez des benchmarks indépendants avant d'évaluer la qualité. Les chiffres auto-déclarés d'Alibaba sur Terminal-Bench, OSWorld et SWE-bench sont des revendications du fournisseur — pas des audits tiers.
  • Si vous avez besoin d'un modèle de production aujourd'hui, utilisez Qwen3.6-27B, Gemma 4 ou Kimi K3 — tous ont des poids livrés et vérifiés avec des licences claires.

FAQ : dates de livraison, exigences matérielles et inconnues de licence

Les poids vont-ils vraiment sortir le 12 août ? La date du 12 août provient exclusivement de l'utilisateur X @hqmank(s’ouvre dans un nouvel onglet), pas d'Alibaba. L'engagement officiel est « la semaine du 10 août ». Cette fenêtre court jusqu'au 16 août. Si la date est réelle, attendez-vous à un dépôt Hugging Face mardi. Sinon, la fenêtre est encore ouverte — et Alibaba n'a jamais livré de poids ouverts pour un modèle de classe Max auparavant, il n'y a donc aucun historique de livraison sur lequel s'appuyer.

Puis-je exécuter un MoE 2,4T sur mon propre matériel ? Pas sans un datacenter. Bien que les architectures MoE n'activent qu'environ 95B de paramètres par token, tous les 2,4T de poids doivent résider en mémoire accessible par le GPU. Le compagnon 27B est l'artefact conçu pour le déploiement local sur un seul GPU haut de gamme.

Quelle licence dois-je attendre ? Inconnue. Qwen3.6-27B était sous Apache 2.0, mais le modèle de partage de revenus d'Alibaba pour les gros utilisateurs de l'API suggère que les conditions commerciales évoluent. Ne présumez pas Apache 2.0. Lisez le fichier LICENSE avant d'intégrer.

Le verdict du répertoire change-t-il ? Non. Le modèle reste pending. Les poids ouverts sont une étape importante, pas une recommandation. Nous avons besoin de benchmarks indépendants, d'une licence divulguée et de données de performance en déploiement réel avant de pouvoir l'évaluer.

Les benchmarks sont-ils vérifiés ? Non. Les chiffres de benchmark dans le tableau ci-dessus proviennent du post de lancement d'Alibaba du 3 août et n'ont pas été reproduits indépendamment. La démonstration de codage autonome sur 16 jours et la reproduction de recherche sur 5 jours sont des démonstrations du fournisseur, pas des audits tiers.

Que faire

  1. 1 Wait for the LICENSE file before downloading or integrating into any project
  2. 2 Target the 27B for local deployment experiments — the 2.4T MoE requires multi-node GPU clusters
  3. 3 Monitor the Qwen HuggingFace organization page this week for weight files

Outils et modèles concernés

Ne ratez plus jamais une mise à jour

Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.

En vous abonnant, vous acceptez notre Politique de confidentialité. Désabonnement à tout moment.