Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»Actualité IA»Modèles IA été 2026 : Grok 4.5, Qwen 3.7 et le reste
Circuit imprimé illustrant les nouveaux modèles IA de l'été 2026
Actualité IA

Modèles IA été 2026 : Grok 4.5, Qwen 3.7 et le reste

5 Mins Readaoût 1, 2026
Share
Twitter Email Copy Link

Les modèles IA été 2026 se sont enchaînés à un rythme inédit entre mai et août : Grok 4.5, la famille Qwen 3.7, DeepSeek V4 Flash, Kimi K3 et plusieurs autres sorties ont redistribué les cartes en quelques semaines. Voici une synthèse pour ne rien avoir manqué, avec un lien vers notre dossier complet pour chaque modèle qui mérite d’aller plus loin.

Sommaire

  • Grok 4.5 : le rapport score-prix le plus agressif du marché
  • La famille Qwen 3.7 : Alibaba accélère la cadence
  • Les autres sorties notables de l’été
  • Vue d’ensemble
  • Ce que ça change concrètement
  • Comment suivre ces sorties sans s’y perdre
  • Questions fréquentes

Grok 4.5 : le rapport score-prix le plus agressif du marché

Grok 4.5 d’xAI ne cherche pas la première place du classement brut, mais le meilleur rapport entre le score et le prix : avec un score de 54 sur l’Artificial Analysis Intelligence Index (54, 9e sur 186 modèles suivis) pour un tarif de 2 $ / 6 $ par million de tokens en entrée et sortie, il revient à environ 0,11 $ par point d’intelligence — le meilleur ratio de tout le marché selon notre comparatif de prix des modèles IA 2026. xAI décrit explicitement Grok 4.5 comme une alternative « classe Opus » à une fraction du tarif des modèles premium, positionnement cohérent pour de l’automatisation à grand volume plutôt que pour les tâches qui exigent le raisonnement le plus poussé.

La famille Qwen 3.7 : Alibaba accélère la cadence

Alibaba a lancé Qwen3.7-Max puis, seulement deux semaines plus tard, Qwen3.7-Plus — une cadence d’itération qui a fait bondir le titre Alibaba de plus de 6 % à la Bourse de Hong Kong. Les deux modèles se répartissent les usages : Qwen3.7-Plus fusionne nativement vision et texte pour piloter des interfaces graphiques et des lignes de commande (5e rang mondial en vision sur LM Arena), tandis que Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd (13e mondial en capacités textuelles). Le détail complet est dans notre dossier Qwen3.7-Plus. Un successeur, Qwen 3.8 (2 400 milliards de paramètres), a depuis été officialisé par Alibaba mais reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — voir notre article sur Qwen 3.8.

Les autres sorties notables de l’été

Au-delà de Grok et Qwen, l’été 2026 a aussi vu la bascule en bêta publique de DeepSeek V4 Flash, avec un tarif d’entrée à 0,14 $ par million de tokens qui relance la guerre des prix face aux modèles occidentaux (détails dans notre dossier DeepSeek V4 Flash). Moonshot AI a de son côté musclé Kimi K3 avec la bibliothèque open source MoonEP pour le parallélisme d’experts, et Thinking Machines Lab a publié Inkling Small, un second modèle open-weights misant sur l’efficacité plutôt que la taille brute. Côté occidental, Google DeepMind a présenté Gemini Robotics 2.0 pour le raisonnement embarqué des robots, pendant qu’OpenAI répondait à la pression tarifaire chinoise par une baisse de 80 % sur GPT-5.6 Luna.

Vue d’ensemble

ModèleÉditeurCe qu’il faut retenir
Grok 4.5xAIMeilleur rapport score-prix du marché (0,11 $/point)
Qwen3.7-Plus / MaxAlibabaDuo spécialisé vision-interface (Plus) et codage autonome (Max)
Qwen 3.8Alibaba2 400 Mds de paramètres, encore en préversion non benchmarkée
DeepSeek V4 FlashDeepSeekBêta publique, tarif le plus bas du marché (0,14 $/M en entrée)
Kimi K3 + MoonEPMoonshot AIBibliothèque open source pour le parallélisme d’experts à grande échelle
Inkling SmallThinking Machines LabSecond modèle open-weights, misant sur l’efficacité

Ce que ça change concrètement

Pour les utilisateurs et les entreprises, la conséquence la plus concrète de cette vague de sorties est la pression continue sur les prix : la plupart des baisses tarifaires observées cet été (GPT-5.6 Luna, DeepSeek V4 Flash) répondent directement à la concurrence des modèles chinois plutôt qu’à une décision isolée d’un seul éditeur. Pour choisir un modèle aujourd’hui, mieux vaut se référer aux comparatifs déjà publiés sur un usage précis — comme notre comparatif Fable 5 vs GPT-5.6 Sol vs Mistral Medium 3.5 pour le codage — que de suivre chaque annonce isolément.

Comment suivre ces sorties sans s’y perdre

Face à un rythme de sortie aussi soutenu, la méthode la plus efficace n’est pas de suivre chaque annonce en temps réel, mais de se concentrer sur trois signaux qui séparent une sortie qui compte d’un simple effet d’annonce : un benchmark indépendant publié (pas seulement une revendication de l’éditeur), une disponibilité réelle en API ou en poids ouverts plutôt qu’une préversion fermée, et un prix communiqué publiquement plutôt qu’un tarif « sur devis ». Qwen 3.8, par exemple, ne coche encore aucun de ces trois critères à ce stade — ce qui justifie de le suivre sans encore l’intégrer à un choix de production.

Questions fréquentes

Quel est le meilleur rapport score-prix parmi les modèles sortis cet été ?

Grok 4.5 d’xAI, avec un coût d’environ 0,11 $ par point d’intelligence sur l’Artificial Analysis Intelligence Index, le meilleur ratio de tout le marché selon les données de prix disponibles mi-2026.

Quelle différence entre Qwen3.7-Plus et Qwen3.7-Max ?

Qwen3.7-Plus est spécialisé dans la fusion vision-texte pour piloter des interfaces graphiques et lignes de commande. Qwen3.7-Max cible l’exécution autonome à long terme et le codage lourd.

Qwen 3.8 est-il déjà disponible et comparable aux autres modèles ?

Non, Qwen 3.8 reste en préversion à tarif préférentiel, sans benchmark indépendant publié ni poids ouverts disponibles à ce stade — il ne peut pas encore être intégré à un comparatif chiffré sérieux.

Pourquoi autant de baisses de prix chez les modèles IA cet été 2026 ?

La concurrence des modèles chinois (DeepSeek V4 Flash, Kimi K3, Qwen) exerce une pression tarifaire directe sur les éditeurs occidentaux, qui répondent par des baisses de prix, comme celle de 80 % sur GPT-5.6 Luna fin juillet 2026.

Grok 4.5 Qwen Qwen3.7-Max
Share. Twitter Email Copy Link
Previous ArticleGains productivité IA France 2026 : les chiffres réels
Next Article IA vocale Smallest.ai : la startup lève 13 millions $

Related Posts

News Actualité IA Amazon Perplexity

Perplexity Amazon : la justice autorise à nouveau l’agent shopping IA

Actualité IA

IA cybercriminalité Afrique : Interpol alerte sur 484 M$ de pertes

Actualité IA

Gemini Enterprise Plugins : Google préparerait des mini-apps IA

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}