Les modèles IA été 2026 se sont enchaînés à un rythme inédit entre mai et août : Grok 4.5, la famille Qwen 3.7, DeepSeek V4 Flash, Kimi K3 et plusieurs autres sorties ont redistribué les cartes en quelques semaines. Voici une synthèse pour ne rien avoir manqué, avec un lien vers notre dossier complet pour chaque modèle qui mérite d’aller plus loin.

Sommaire

Grok 4.5 : le rapport score-prix le plus agressif du marché

Grok 4.5 d’xAI ne cherche pas la première place du classement brut, mais le meilleur rapport entre le score et le prix : avec un score de 54 sur l’Artificial Analysis Intelligence Index (54, 9e sur 186 modèles suivis) pour un tarif de 2 $ / 6 $ par million de tokens en entrée et sortie, il revient à environ 0,11 $ par point d’intelligence — le meilleur ratio de tout le marché selon notre comparatif de prix des modèles IA 2026. xAI décrit explicitement Grok 4.5 comme une alternative « classe Opus » à une fraction du tarif des modèles premium, positionnement cohérent pour de l’automatisation à grand volume plutôt que pour les tâches qui exigent le raisonnement le plus poussé.

La famille Qwen 3.7 : Alibaba accélère la cadence

Alibaba a lancé Qwen3.7-Max puis, seulement deux semaines plus tard, Qwen3.7-Plus — une cadence d’itération qui a fait bondir le titre Alibaba de plus de 6 % à la Bourse de Hong Kong. Les deux modèles se répartissent les usages : Qwen3.7-Plus fusionne nativement vision et texte pour piloter des interfaces graphiques et des lignes de commande (5e rang mondial en vision sur LM Arena), tandis que Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd (13e mondial en capacités textuelles). Le détail complet est dans notre dossier Qwen3.7-Plus. Un successeur, Qwen 3.8 (2 400 milliards de paramètres), a depuis été officialisé par Alibaba mais reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — voir notre article sur Qwen 3.8.

Les autres sorties notables de l’été

Au-delà de Grok et Qwen, l’été 2026 a aussi vu la bascule en bêta publique de DeepSeek V4 Flash, avec un tarif d’entrée à 0,14 $ par million de tokens qui relance la guerre des prix face aux modèles occidentaux (détails dans notre dossier DeepSeek V4 Flash). Moonshot AI a de son côté musclé Kimi K3 avec la bibliothèque open source MoonEP pour le parallélisme d’experts, et Thinking Machines Lab a publié Inkling Small, un second modèle open-weights misant sur l’efficacité plutôt que la taille brute. Côté occidental, Google DeepMind a présenté Gemini Robotics 2.0 pour le raisonnement embarqué des robots, pendant qu’OpenAI répondait à la pression tarifaire chinoise par une baisse de 80 % sur GPT-5.6 Luna.

Vue d’ensemble

ModèleÉditeurCe qu’il faut retenir
Grok 4.5xAIMeilleur rapport score-prix du marché (0,11 $/point)
Qwen3.7-Plus / MaxAlibabaDuo spécialisé vision-interface (Plus) et codage autonome (Max)
Qwen 3.8Alibaba2 400 Mds de paramètres, encore en préversion non benchmarkée
DeepSeek V4 FlashDeepSeekBêta publique, tarif le plus bas du marché (0,14 $/M en entrée)
Kimi K3 + MoonEPMoonshot AIBibliothèque open source pour le parallélisme d’experts à grande échelle
Inkling SmallThinking Machines LabSecond modèle open-weights, misant sur l’efficacité

Ce que ça change concrètement

Pour les utilisateurs et les entreprises, la conséquence la plus concrète de cette vague de sorties est la pression continue sur les prix : la plupart des baisses tarifaires observées cet été (GPT-5.6 Luna, DeepSeek V4 Flash) répondent directement à la concurrence des modèles chinois plutôt qu’à une décision isolée d’un seul éditeur. Pour choisir un modèle aujourd’hui, mieux vaut se référer aux comparatifs déjà publiés sur un usage précis — comme notre comparatif Fable 5 vs GPT-5.6 Sol vs Mistral Medium 3.5 pour le codage — que de suivre chaque annonce isolément.

Comment suivre ces sorties sans s’y perdre

Face à un rythme de sortie aussi soutenu, la méthode la plus efficace n’est pas de suivre chaque annonce en temps réel, mais de se concentrer sur trois signaux qui séparent une sortie qui compte d’un simple effet d’annonce : un benchmark indépendant publié (pas seulement une revendication de l’éditeur), une disponibilité réelle en API ou en poids ouverts plutôt qu’une préversion fermée, et un prix communiqué publiquement plutôt qu’un tarif « sur devis ». Qwen 3.8, par exemple, ne coche encore aucun de ces trois critères à ce stade — ce qui justifie de le suivre sans encore l’intégrer à un choix de production.

Questions fréquentes

Quel est le meilleur rapport score-prix parmi les modèles sortis cet été ?

Grok 4.5 d’xAI, avec un coût d’environ 0,11 $ par point d’intelligence sur l’Artificial Analysis Intelligence Index, le meilleur ratio de tout le marché selon les données de prix disponibles mi-2026.

Quelle différence entre Qwen3.7-Plus et Qwen3.7-Max ?

Qwen3.7-Plus est spécialisé dans la fusion vision-texte pour piloter des interfaces graphiques et lignes de commande. Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd.

Qwen 3.8 est-il déjà disponible et comparable aux autres modèles ?

Non, Qwen 3.8 reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — il ne peut pas encore être intégré à un comparatif chiffré sérieux.

Pourquoi autant de baisses de prix chez les modèles IA cet été 2026 ?

La concurrence des modèles chinois (DeepSeek V4 Flash, Kimi K3, Qwen) exerce une pression tarifaire directe sur les éditeurs occidentaux, qui répondent par des baisses de prix, comme celle de 80 % sur GPT-5.6 Luna fin juillet 2026.

Share.
Exit mobile version