Les modèles IA été 2026 se sont enchaînés à un rythme inédit entre mai et août : Grok 4.5, la famille Qwen 3.7, DeepSeek V4 Flash, Kimi K3 et plusieurs autres sorties ont redistribué les cartes en quelques semaines. Voici une synthèse pour ne rien avoir manqué, avec un lien vers notre dossier complet pour chaque modèle qui mérite d’aller plus loin.
Sommaire
- Grok 4.5 : le rapport score-prix le plus agressif du marché
- La famille Qwen 3.7 : Alibaba accélère la cadence
- Les autres sorties notables de l’été
- Vue d’ensemble
- Ce que ça change concrètement
- Comment suivre ces sorties sans s’y perdre
- Questions fréquentes
Grok 4.5 : le rapport score-prix le plus agressif du marché
Grok 4.5 d’xAI ne cherche pas la première place du classement brut, mais le meilleur rapport entre le score et le prix : avec un score de 54 sur l’Artificial Analysis Intelligence Index (54, 9e sur 186 modèles suivis) pour un tarif de 2 $ / 6 $ par million de tokens en entrée et sortie, il revient à environ 0,11 $ par point d’intelligence — le meilleur ratio de tout le marché selon notre comparatif de prix des modèles IA 2026. xAI décrit explicitement Grok 4.5 comme une alternative « classe Opus » à une fraction du tarif des modèles premium, positionnement cohérent pour de l’automatisation à grand volume plutôt que pour les tâches qui exigent le raisonnement le plus poussé.
La famille Qwen 3.7 : Alibaba accélère la cadence
Alibaba a lancé Qwen3.7-Max puis, seulement deux semaines plus tard, Qwen3.7-Plus — une cadence d’itération qui a fait bondir le titre Alibaba de plus de 6 % à la Bourse de Hong Kong. Les deux modèles se répartissent les usages : Qwen3.7-Plus fusionne nativement vision et texte pour piloter des interfaces graphiques et des lignes de commande (5e rang mondial en vision sur LM Arena), tandis que Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd (13e mondial en capacités textuelles). Le détail complet est dans notre dossier Qwen3.7-Plus. Un successeur, Qwen 3.8 (2 400 milliards de paramètres), a depuis été officialisé par Alibaba mais reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — voir notre article sur Qwen 3.8.
Les autres sorties notables de l’été
Au-delà de Grok et Qwen, l’été 2026 a aussi vu la bascule en bêta publique de DeepSeek V4 Flash, avec un tarif d’entrée à 0,14 $ par million de tokens qui relance la guerre des prix face aux modèles occidentaux (détails dans notre dossier DeepSeek V4 Flash). Moonshot AI a de son côté musclé Kimi K3 avec la bibliothèque open source MoonEP pour le parallélisme d’experts, et Thinking Machines Lab a publié Inkling Small, un second modèle open-weights misant sur l’efficacité plutôt que la taille brute. Côté occidental, Google DeepMind a présenté Gemini Robotics 2.0 pour le raisonnement embarqué des robots, pendant qu’OpenAI répondait à la pression tarifaire chinoise par une baisse de 80 % sur GPT-5.6 Luna.
Vue d’ensemble
| Modèle | Éditeur | Ce qu’il faut retenir |
|---|---|---|
| Grok 4.5 | xAI | Meilleur rapport score-prix du marché (0,11 $/point) |
| Qwen3.7-Plus / Max | Alibaba | Duo spécialisé vision-interface (Plus) et codage autonome (Max) |
| Qwen 3.8 | Alibaba | 2 400 Mds de paramètres, encore en préversion non benchmarkée |
| DeepSeek V4 Flash | DeepSeek | Bêta publique, tarif le plus bas du marché (0,14 $/M en entrée) |
| Kimi K3 + MoonEP | Moonshot AI | Bibliothèque open source pour le parallélisme d’experts à grande échelle |
| Inkling Small | Thinking Machines Lab | Second modèle open-weights, misant sur l’efficacité |
Ce que ça change concrètement
Pour les utilisateurs et les entreprises, la conséquence la plus concrète de cette vague de sorties est la pression continue sur les prix : la plupart des baisses tarifaires observées cet été (GPT-5.6 Luna, DeepSeek V4 Flash) répondent directement à la concurrence des modèles chinois plutôt qu’à une décision isolée d’un seul éditeur. Pour choisir un modèle aujourd’hui, mieux vaut se référer aux comparatifs déjà publiés sur un usage précis — comme notre comparatif Fable 5 vs GPT-5.6 Sol vs Mistral Medium 3.5 pour le codage — que de suivre chaque annonce isolément.
Comment suivre ces sorties sans s’y perdre
Face à un rythme de sortie aussi soutenu, la méthode la plus efficace n’est pas de suivre chaque annonce en temps réel, mais de se concentrer sur trois signaux qui séparent une sortie qui compte d’un simple effet d’annonce : un benchmark indépendant publié (pas seulement une revendication de l’éditeur), une disponibilité réelle en API ou en poids ouverts plutôt qu’une préversion fermée, et un prix communiqué publiquement plutôt qu’un tarif « sur devis ». Qwen 3.8, par exemple, ne coche encore aucun de ces trois critères à ce stade — ce qui justifie de le suivre sans encore l’intégrer à un choix de production.
Questions fréquentes
Quel est le meilleur rapport score-prix parmi les modèles sortis cet été ?
Grok 4.5 d’xAI, avec un coût d’environ 0,11 $ par point d’intelligence sur l’Artificial Analysis Intelligence Index, le meilleur ratio de tout le marché selon les données de prix disponibles mi-2026.
Quelle différence entre Qwen3.7-Plus et Qwen3.7-Max ?
Qwen3.7-Plus est spécialisé dans la fusion vision-texte pour piloter des interfaces graphiques et lignes de commande. Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd.
Qwen 3.8 est-il déjà disponible et comparable aux autres modèles ?
Non, Qwen 3.8 reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — il ne peut pas encore être intégré à un comparatif chiffré sérieux.
Pourquoi autant de baisses de prix chez les modèles IA cet été 2026 ?
La concurrence des modèles chinois (DeepSeek V4 Flash, Kimi K3, Qwen) exerce une pression tarifaire directe sur les éditeurs occidentaux, qui répondent par des baisses de prix, comme celle de 80 % sur GPT-5.6 Luna fin juillet 2026.
