Présentation

Qwen3.8-Max a été dévoilé en préversion le 19 juillet 2026 lors de la conférence WAIC à Shanghai, puis officiellement lancé le 3 août 2026. C’est le plus grand modèle jamais publié par Alibaba : architecture MoE à attention hybride, 2,4 billions de paramètres au total dont environ 95 milliards actifs par token, avec un contexte allant jusqu’à un million de tokens.

Un point de vigilance sur l’ouverture des poids

Alibaba présente Qwen3.8-Max comme le premier modèle phare de la famille Qwen dont les poids seront rendus publics — mais à la date de rédaction, cette publication restait annoncée comme « prévue » plutôt que confirmée effective : le blog officiel du projet open source Qwen n’avait pas encore été mis à jour à ce sujet. Nous classons ce modèle en « open-weights » sur la base de l’intention annoncée par Alibaba, à vérifier avant toute réutilisation de cette information.

Tarification et disponibilité

Un tarif d’environ 2 $ par million de tokens en entrée et 6 $ en sortie est largement repris par la presse spécialisée, mais nous n’avons pas pu le confirmer directement sur une page de tarification officielle d’Alibaba Cloud au moment de la rédaction.

Performance annoncée

Selon Alibaba, Qwen3.8-Max se classerait 5ᵉ sur le classement de référence LMArena (texte), 2ᵉ sur l’arène vision et 4ᵉ sur l’arène code frontend — des classements, pas des scores bruts. Alibaba met aussi en avant un test interne où le modèle aurait mené un projet logiciel de façon autonome pendant 16 jours — une allégation du fabricant sur une évaluation interne, pas un résultat reproduit de façon indépendante.

Avis de la rédaction

Les notes ci-dessus sont une analyse éditoriale de la rédaction, fondée sur les éléments communiqués par Alibaba — pas un test indépendant complet réalisé en interne, et avec plusieurs chiffres (tarif exact, publication effective des poids) non confirmés sur une source officielle au moment de la rédaction.