Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»Actualité IA»GLM-5.3-Flash : Z.ai sort un modèle multimodal open source sous licence MIT
Logo officiel Z.ai pour GLM-5.3-Flash
Logo Z.ai
Actualité IA

GLM-5.3-Flash : Z.ai sort un modèle multimodal open source sous licence MIT

Updated:août 27, 20263 Mins Readaoût 27, 2026
Share
Twitter Email Copy Link

GLM-5.3-Flash est le nouveau modèle de Z.ai (Zhipu AI), lancé le 26 août 2026. Première version nativement multimodale de la famille GLM-5, il combine raisonnement visuel et textuel, poids ouverts sous licence MIT, et un coût d’inférence réduit. Disponible dès maintenant pour les utilisateurs du GLM Coding Plan, avec trois fois le quota de GLM-5.3.

Le modèle, un mixture-of-experts de 320 milliards de paramètres au total et 18 milliards actifs, se positionne comme une option plus économique pour le coding, les tâches agentiques et le raisonnement visuel. Z.ai indique qu’il surpasse GLM-5.2 sur plusieurs benchmarks internes tout en approchant Claude Opus 4.8 sur son test de coding.

Architecture et performances

Entraîné sur un corpus multimodal de 30 000 milliards de tokens, GLM-5.3-Flash mêle attention linéaire pour les dépendances locales et attention sparse pour le contexte global. À des longueurs de contexte allant jusqu’à un million de tokens, le mécanisme IndexPool compresse les vecteurs de clés pour limiter la latence et la mémoire. Z.ai rapporte trois fois moins de calcul d’attention et une réduction par 4,4 de la taille du KV cache par rapport à GLM-5.3.

Sur Artificial Analysis Intelligence Index v4.1.1, le modèle obtient un score de 57 pour un coût de 0,045 $ par tâche. Il atteint 63,4 sur DeepSWE v1.1 (contre 46,2 pour GLM-5.2) et 48,8 sur AutomationBench (contre 26,2). Les comparaisons restent dépendantes des harnesses et des réglages utilisés.

Raisonnement multimodal et déploiement local

Le raisonnement visuel est au cœur de cette version. Le modèle a été entraîné à inspecter des interfaces rendues, des parties de jeux ou des sorties 3D, puis à évaluer et réviser son travail à partir du retour visuel. La même approche s’applique aux documents, tableurs, présentations, tableaux de bord et supports de réunion.

Avant l’annonce officielle, le modèle est apparu anonymement sous le nom ox-alpha sur OpenCode et OpenRouter, où il est devenu le plus populaire de la semaine. Le trafic était servi sur des puces IA chinoises. Z.ai a développé une stack basée sur SGLang qui sépare encodage, prefill et decoding, avec un gain de performance end-to-end multiplié par trois.

Les poids sont disponibles sur Hugging Face. Le déploiement local est supporté via SGLang, vLLM et TokenSpeed. Les capacités multimodales sont accessibles dans ZCode via Browser Use et Computer Use.

Disponibilité et positionnement

GLM-5.3-Flash est désormais accessible à tous les abonnés du GLM Coding Plan, avec un quota multiplié par trois par rapport à GLM-5.3. Il s’inscrit dans la stratégie de Z.ai de proposer des modèles ouverts performants à coût maîtrisé, capables de rivaliser avec des solutions propriétaires sur des tâches concrètes de coding et d’agent.

Source : blog officiel Z.ai et couverture TestingCatalog.

GLM-5.3 MIT Open Weight Z.ai
Share. Twitter Email Copy Link
Previous ArticleNvidia aurait accepté de racheter Hugging Face pour 12,9 milliards
Next Article Google DeepMind lance les évaluations en double aveugle

Related Posts

Actualité IA

Faille NemoClaw : des agents IA locaux piratables

Actualité IA

Google DeepMind lance les évaluations en double aveugle

Breaking News Actualité IA Nvidia Open Weight Rumeurs

Nvidia aurait accepté de racheter Hugging Face pour 12,9 milliards

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}