Le modèle Qwen3.8-Flash-Next serait sur le point d’être publié en open source par Alibaba, selon plusieurs sources concordantes repérées ces dernières heures : une fiche modèle apparue sur ModelScope, relayée sur Hacker News où elle a rapidement dépassé 300 points, et deux médias spécialisés, TechNode et Biggo, qui évoquent tous deux une sortie le 27 août. Rien de tout cela n’a encore été confirmé officiellement par Alibaba ou l’équipe Qwen — ce qui en fait, à ce stade, une annonce à prendre au conditionnel.
Un « Next » qui préparerait le terrain pour Qwen4
Ce qui retient l’attention n’est pas tant le modèle lui-même que ce qu’il représenterait : selon TechNode, Qwen3.8-Flash-Next servirait de vitrine à une nouvelle architecture, celle qui devrait ensuite être généralisée à la future génération Qwen4. La fiche repérée sur ModelScope et relayée sur Hacker News mentionne un format « 125B a6B », c’est-à-dire un modèle de mélange d’experts (MoE) pesant environ 125 milliards de paramètres au total, dont seulement 6 milliards seraient activés à chaque calcul — une manière de garder un modèle massif tout en limitant le coût réel de l’inférence.
Pourquoi Alibaba teste ses architectures en public
Depuis le lancement de la famille Qwen, Alibaba a pris l’habitude de faire circuler des variantes « Flash » ou « Next » avant ses sorties majeures, une façon de faire tester une nouvelle architecture par la communauté open source avant de l’engager sur un modèle phare. La série Qwen3 avait déjà suivi ce schéma avec plusieurs déclinaisons intermédiaires avant les versions les plus abouties. Si la tendance se confirme, Qwen3.8-Flash-Next jouerait ce rôle de banc d’essai pour Qwen4.
Ce qu’il faudra vérifier
Trois points restent à confirmer une fois la sortie effective : la licence exacte du modèle, ses performances sur les benchmarks de référence face aux autres modèles ouverts chinois (Kimi, GLM, DeepSeek), et surtout si l’architecture testée ici sera bien celle retenue pour Qwen4, ou seulement l’une des pistes explorées par l’équipe.
Ce qu’il faut retenir
- Qwen3.8-Flash-Next : sortie open source évoquée pour le 27 août 2026, non confirmée officiellement par Alibaba.
- Architecture MoE annoncée à environ 125 milliards de paramètres au total, 6 milliards actifs par calcul.
- Présenté par plusieurs sources comme un aperçu de l’architecture prévue pour Qwen4.
- Fiche modèle repérée sur ModelScope, relayée par la communauté Hacker News et les médias TechNode et Biggo.
Fiche du modèle sur ModelScope.
Qwen3.8-Flash-Next est-il déjà sorti ?
Non, à l’heure de la publication de cet article, seule une fiche modèle sur ModelScope et des relais communautaires évoquent une sortie le 27 août 2026. Alibaba n’a pas encore communiqué officiellement.
Quelle est la taille de Qwen3.8-Flash-Next ?
Selon la fiche repérée sur ModelScope, il s’agirait d’un modèle MoE d’environ 125 milliards de paramètres au total, dont 6 milliards actifs à chaque calcul.
Quel est le lien avec Qwen4 ?
Plusieurs sources, dont TechNode, présentent ce modèle comme un aperçu de l’architecture que Qwen4 pourrait adopter, sans confirmation officielle d’Alibaba à ce stade.

