Le classement Artificial Analysis Index vient de bouger : Qwen3.8 Max, le dernier modèle d’Alibaba, y décroche un score de 56, contre 46 pour son prédécesseur Qwen3.7 Max — un bond de dix points en une génération. Selon les données rapportées le 6 août 2026 par The Decoder, ce score place Qwen3.8 Max au niveau de Claude Opus 4.8 d’Anthropic, pendant que Kimi K3 de Moonshot AI continue de dépasser les deux modèles, pour environ 25 % moins cher.
Trois modèles, trois logiques différentes
Ces trois modèles n’appliquent pas la même stratégie. Qwen3.8 Max, déjà couvert dans nos colonnes lors de son lancement fin de semaine dernière, mise sur l’échelle brute avec ses 2 400 milliards de paramètres. Claude Opus 4.8 reste la référence propriétaire d’Anthropic, pensée pour la fiabilité et le raisonnement long. Kimi K3, lui, poursuit la stratégie déjà observée avec ses versions précédentes : rester open-weights tout en visant le haut du classement, avec un rapport score/prix qui reste son principal argument de vente face aux modèles fermés.
Le prix, nouvel axe de bataille
L’écart de score entre Kimi K3 et Claude Opus 4.8 est resté stable, mais c’est l’écart de prix qui fait la différence pour beaucoup d’équipes techniques : à qualité égale ou supérieure, un modèle 25 % moins cher change le calcul économique d’une intégration à grande échelle, notamment pour les usages à fort volume d’appels API. C’est un argument que Moonshot AI met en avant depuis plusieurs mois, alors que l’entreprise vise actuellement une valorisation de 50 milliards de dollars portée par les performances de Kimi K3.
Ce que ça change pour les développeurs
Pour qui choisit un modèle en fonction du seul score sur un indice agrégé, l’écart entre les trois options s’est nettement resserré cette semaine. Le choix se déplace donc vers des critères secondaires : latence, disponibilité d’une API stable, écosystème d’outils (agents, function calling), et bien sûr le prix par token. Aucun des trois modèles ne domine sur tous les critères à la fois, ce qui explique pourquoi aucun ne parvient à s’imposer durablement en tête du classement.
Détails et méthodologie du classement dans l’article de The Decoder.
Quel score obtient Qwen3.8 Max sur l’Artificial Analysis Index ?
Qwen3.8 Max obtient un score de 56 sur l’Artificial Analysis Index, contre 46 pour Qwen3.7 Max, soit un gain de dix points en une génération.
Kimi K3 est-il meilleur que Claude Opus 4.8 ?
Selon l’Artificial Analysis Index rapporté début août 2026, Kimi K3 obtient un score supérieur à Claude Opus 4.8, tout en coûtant environ 25 % de moins à l’usage.
Qwen3.8 Max est-il un modèle open-weights ?
Contrairement à Kimi K3, Qwen3.8 Max n’est pas systématiquement diffusé en open-weights complet ; son positionnement mise avant tout sur l’échelle du modèle, avec 2 400 milliards de paramètres.

