Alibaba a publié Qwen3.8-27B le 14 août 2026, un modèle dense de 27 milliards de paramètres sous licence Apache 2.0, présenté par la communauté comme le meilleur modèle local dense disponible à ce jour. Contrairement à Qwen3.8-Max, son grand frère à architecture MoE, ce modèle tient sur une seule carte graphique haut de gamme tout en visant les usages de codage professionnel et d’agents.

Des chiffres qui justifient l’attention

Qwen3.8-27B affiche 73,0 sur Terminal Bench 2.1 (Terminus) et 70,7 sur CoWorkBench, deux benchmarks qui mesurent respectivement les capacités de codage en environnement terminal et l’exécution de tâches agentiques de bout en bout. Sur la partie vision-langage, il obtient 84,3 sur OSWorld-Verified, preuve d’une compréhension multimodale native des images et des vidéos, pas seulement du texte.

Le modèle propose un contexte natif de 262 144 tokens, extensible jusqu’à 1 million, et un mode de raisonnement dont la profondeur est ajustable selon la tâche — un compromis directement pensé pour tourner en local sans sacrifier les capacités agentiques longue durée.

Face à la concurrence sur le segment local

Selon les comparatifs communautaires diffusés au lancement, Qwen3.8-27B devance nettement son prédécesseur Qwen3.6-27B, et se positionne également devant des modèles comme Muse Glimmer-30B de Meta sur les tâches d’ingénierie logicielle et d’agents multimodaux. Sa disponibilité en FP8 fine-grained (bloc de 128) réduit encore l’empreinte mémoire nécessaire à l’inférence, un argument de poids pour les développeurs qui veulent héberger le modèle sur leur propre machine plutôt que de dépendre d’une API.

Ce lancement confirme la stratégie d’Alibaba consistant à décliner Qwen sur plusieurs tailles et architectures en parallèle : le géant MoE Qwen3.8-Max pour les charges massives côté cloud, et cette version dense pour les développeurs qui veulent un modèle performant tournant hors ligne.

Disponibilité

Le modèle est publié en open weights sous licence Apache 2.0 sur Hugging Face, ce qui autorise un usage commercial sans restriction. Les poids FP8 sont disponibles immédiatement, aux côtés des versions non quantifiées pour les configurations disposant de davantage de mémoire GPU.

Fiche complète sur Hugging Face.

Qu’est-ce que Qwen3.8-27B ?

Qwen3.8-27B est un modèle de langage dense de 27 milliards de paramètres publié par Alibaba le 14 août 2026 sous licence Apache 2.0, optimisé pour le codage et les tâches agentiques en local.

Qwen3.8-27B peut-il tourner en local ?

Oui, c’est son principal argument : contrairement au modèle MoE Qwen3.8-Max, sa taille dense de 27 milliards de paramètres et sa version FP8 lui permettent de tourner sur une seule carte graphique haut de gamme.

Quelle licence pour Qwen3.8-27B ?

Le modèle est publié sous licence Apache 2.0, qui autorise un usage commercial sans restriction.

Share.
Exit mobile version