Qwen3.8-Max-0902 est la mise à jour discrète mais substantielle qu’Alibaba a apportée à son modèle phare dans la nuit du 1er au 2 septembre 2026. Sans passer à un nouveau numéro de version majeure, ce checkpoint de post-entraînement grimpe en tête du classement Code Arena WebDev avec 1 691 points, devant Claude Opus 5 (1 688) — mais la propre communication d’Alibaba reconnaît que Claude Opus 5 reste devant sur la majorité de ses propres benchmarks internes.
Key Takeaways
- Mise en production dans la nuit du 1er au 2 septembre 2026, annoncée par le compte X officiel @Alibaba_Qwen.
- Mise à jour de post-entraînement uniquement : toujours 2 400 milliards de paramètres (architecture MoE, ~95 milliards actifs par requête), pas de changement d’architecture.
- #1 du classement Code Arena WebDev avec 1 691 points, devant Claude Opus 5 (1 688) et Kimi K3 (1 674).
- Progression nette sur le codage : TerminalBench 3.0 passe de 11,3 à 29,0, DeepSWE 1.1 de 56,6 % à 69,3 %.
- Nuance importante : sur son propre tableau de benchmarks, Qwen reconnaît que Claude Opus 5 reste devant sur la majorité des lignes publiées.
- Aucun poids ouvert publié pour ce checkpoint — accessible uniquement via l’API QwenCloud, à un tarif inchangé de 2 $ / 6 $ par million de tokens (entrée/sortie).
- Accueil communautaire mesuré : gain salué, mais scepticisme persistant sur l’absence de poids ouverts et le choix sélectif des benchmarks publiés.
Table des matières
- Qu’est-ce que Qwen3.8-Max-0902 ?
- Quels sont les scores officiels de cette mise à jour ?
- Combien coûte Qwen3.8-Max-0902 et comment y accéder ?
- Que dit la communauté technique de cette mise à jour ?
- Faut-il basculer vers Qwen3.8-Max-0902 ?
- Sources
Qu’est-ce que Qwen3.8-Max-0902 ?
Qwen3.8-Max-0902 est un nouveau checkpoint du modèle Qwen3.8-Max, lancé initialement par Alibaba le 3 août 2026. Le suffixe « 0902 » désigne une date (2 septembre), pas un numéro de version majeure : Alibaba ne parle pas de « Qwen3.9 ». Il s’agit d’une mise à jour de post-entraînement uniquement, sans changement d’architecture — le modèle conserve ses 2 400 milliards de paramètres au format MoE (mélange d’experts), avec environ 95 milliards de paramètres actifs par requête, et sa fenêtre de contexte d’un million de tokens.
L’annonce a circulé principalement via le compte X officiel @Alibaba_Qwen et la fiche produit QwenCloud, plutôt que via un billet de blog dédié sur qwenlm.github.io — signe d’une mise à jour traitée comme un ajustement plutôt que comme un lancement à part entière. Les priorités affichées sont le codage sur des projets d’ingénierie complexes, l’orchestration agentique multi-outils (fonctionnalité « Cowork ») et la compréhension visuelle (lecture de graphiques, analyse de documents).
Quels sont les scores officiels de cette mise à jour ?
Sur le classement Code Arena WebDev, qui évalue la qualité de génération d’interfaces web, Qwen3.8-Max-0902 prend la première place :
| Modèle | Score Code Arena WebDev |
|---|---|
| Qwen3.8-Max-0902 | 1 691 |
| Claude Opus 5 (max) | 1 688 |
| Kimi K3 (max) | 1 674 |
| Qwen3.8-Max (version d’août, avant mise à jour) | 1 669 |
Sur les benchmarks de codage propres à Alibaba, la progression par rapport à la version d’août est nette :
| Benchmark | Avant (août) | Après (0902) |
|---|---|---|
| TerminalBench 3.0 | 11,3 | 29,0 |
| DeepSWE 1.1 | 56,6 % | 69,3 % |
| QwenSWEBench V2 | 55,1 % | 70,0 % |
| JobBench | 53,4 | 64,0 |
Une nuance mérite d’être soulignée : sur son propre tableau de comparaison, Alibaba reconnaît que Claude Opus 5 reste devant sur la majorité des lignes publiées (TerminalBench, DeepSWE, NL2Repo, ProgramBench, SWE-Marathon, CoWorkBench, JobBench, Toolathlon) — Qwen3.8-Max-0902 ne prend l’avantage que sur trois benchmarks spécifiques (MLS-Bench-Lite, SWE-Atlas QnA, QwenSWEBench V2) ainsi que sur WorkArena et deux évaluations multimodales. Autrement dit, la victoire sur Code Arena WebDev est réelle, mais elle ne se généralise pas à l’ensemble des tâches d’ingénierie logicielle.
Face à DeepSeek V4 Pro, l’autre poids lourd chinois
Qwen3.8-Max-0902 n’affronte pas seulement les modèles occidentaux : DeepSeek V4 Pro, sorti le 12 août 2026, reste son rival direct sur le marché chinois des modèles fermés haut de gamme. Selon les chiffres communiqués par chaque éditeur (attention, les protocoles de test ne sont pas nécessairement identiques), DeepSeek V4 Pro revendique 87,9 % sur Terminal-Bench 2.1 et 62,7 % sur DeepSWE, contre 86,6 % sur Terminal-Bench pour Qwen3.8-Max-0902 — un écart faible, à la limite de la marge d’erreur de mesure. La différence se joue surtout ailleurs : DeepSeek V4 Pro reste environ 78 % moins cher sur les tokens d’entrée et nettement plus rapide pour produire son premier token, ce qui en fait souvent le choix par défaut pour les usages à très fort volume où chaque fraction de centime compte.
Le positionnement des deux modèles diffère donc moins sur la performance brute que sur l’arbitrage coût/vitesse d’un côté, et polyvalence multimodale de l’autre : Qwen3.8-Max-0902 conserve un net avantage sur les tâches qui combinent code, agents et compréhension visuelle dans une même session, là où DeepSeek V4 Pro reste taillé pour un débit maximal sur des tâches plus ciblées.
Combien coûte Qwen3.8-Max-0902 et comment y accéder ?
Le tarif reste inchangé par rapport à la version précédente : 2 dollars par million de tokens en entrée, 6 dollars en sortie, avec un cache de lecture à 0,25 dollar. Le modèle est accessible exclusivement via l’API QwenCloud/DashScope — aucun poids ouvert n’a été publié pour ce checkpoint spécifique. Une discussion sur Hugging Face, restée sans réponse de l’équipe Qwen au 6 septembre, confirme qu’aucune date de publication des poids n’est annoncée. Le volet open weights de la famille Qwen3.8 reste pour l’instant limité au checkpoint du 12 août et à Qwen3.8-27B, un modèle dense distinct publié sous licence Apache 2.0.
Que dit la communauté technique de cette mise à jour ?
La réaction la plus relayée vient du compte X suivi par la communauté IA Chubby (kimmonismus), qui résume l’événement en observant qu’Alibaba a fait « presque atteindre à Qwen le niveau de Claude Fable 5 en benchmarks » sans changer de numéro de version majeure — soulignant la fréquence désormais élevée des gains de performance obtenus par simple post-entraînement chez les laboratoires chinois. Sur Hacker News, plusieurs commentaires notent que la mise à jour rapproche Qwen des modèles occidentaux de référence, et qu’en usage réel, les abonnements aux modèles chinois comme Qwen ou GLM offrent souvent un volume d’usage nettement supérieur aux abonnements Anthropic à coût comparable.
Les réserves exprimées portent sur deux points précis : l’absence de poids ouverts pour ce checkpoint, qui déçoit une partie de la communauté habituée aux publications Apache 2.0 d’Alibaba, et le choix des benchmarks mis en avant, jugé sélectif puisque Qwen ne publie que les catégories où il l’emporte face à Claude Opus 5. Aucun bug technique majeur ni régression n’a été signalé dans les sources consultées — un contraste net avec les critiques relevées sur Muse Spark 1.3 ou Gemini 3.8 Flash cette même semaine.
Faut-il basculer vers Qwen3.8-Max-0902 ?
- Si vous utilisez déjà l’API Qwen3.8-Max : la mise à jour est gratuite et automatique au même tarif, sans action requise — le gain de performance sur le codage web est net.
- Si vous cherchez des poids ouverts auto-hébergeables : ce checkpoint n’est pas pour vous ; tournez-vous vers Qwen3.8-27B ou le checkpoint d’août sous licence ouverte.
- Si votre priorité est l’ingénierie logicielle complexe multi-fichiers : les propres chiffres d’Alibaba montrent que Claude Opus 5 reste devant sur la plupart des benchmarks internes — ne basculez pas uniquement sur la base du score Code Arena WebDev.
- Si le coût prime : à 2 $ / 6 $ par million de tokens, le modèle reste nettement moins cher que Claude Opus 5 ou GPT-6 Astra, un point à mettre en balance avec l’écart de performance réel sur vos propres cas d’usage.
Quand Qwen3.8-Max-0902 est-il sorti ?
Qwen3.8-Max-0902 a été mis en production par Alibaba dans la nuit du 1er au 2 septembre 2026, annoncé via le compte X officiel @Alibaba_Qwen.
Qwen3.8-Max-0902 est-il un nouveau modèle ?
Non, c’est une mise à jour de post-entraînement du modèle Qwen3.8-Max lancé le 3 août 2026, sans changement d’architecture : toujours 2 400 milliards de paramètres au format MoE avec environ 95 milliards actifs par requête.
Qwen3.8-Max-0902 dépasse-t-il Claude Opus 5 ?
Il le devance sur le classement Code Arena WebDev (1 691 contre 1 688 points), mais Alibaba reconnaît elle-même que Claude Opus 5 reste devant sur la majorité de ses benchmarks internes de codage.
Les poids de Qwen3.8-Max-0902 sont-ils disponibles en open source ?
Non, ce checkpoint n’est accessible que via l’API QwenCloud. Aucune date de publication des poids ouverts n’a été annoncée par l’équipe Qwen au moment de la rédaction.
Combien coûte Qwen3.8-Max-0902 à l’usage ?
Le tarif est inchangé par rapport à la version précédente : 2 dollars par million de tokens en entrée et 6 dollars en sortie.
Sources
- @Alibaba_Qwen (1er-2 septembre 2026). Annonce officielle sur X. x.com
- QwenCloud. « Qwen3.8-Max-0902 — fiche modèle ». qwencloud.com
- Alibaba Cloud Community (3 août 2026). « Qwen3.8-Max: A New Bar for Coding and Cowork ». alibabacloud.com
- TechNode (2 septembre 2026). « Alibaba upgrades Qwen3.8-Max with a new 0902 snapshot ». technode.com
- CellCog (2026). « Qwen3.8-Max-0902: Same Price, Much Better at Coding and Office Work, Still Behind Opus 5 ». cellcog.ai
- Hugging Face (2026). Discussion communautaire sur la publication des poids. huggingface.co
Chiffres vérifiés le 8 septembre 2026. Certains scores comparatifs proviennent d’agrégateurs tiers dont la méthodologie n’a pas pu être recoupée avec une source Alibaba de premier rang ; ils sont signalés comme tels dans le texte.
