Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Browsing: modèle open-weight
Ant Group publie Ling 3.0 Flash, un modèle open-weight sous licence MIT qui réduit fortement le taux d’hallucination et mise sur l’efficacité par rapport à sa taille.
Nvidia vise plus de 1 000 milliards de paramètres pour son futur modèle Nemotron 4, un seuil déjà dépassé par Kimi K3 (2,8T) et DeepSeek V4 Pro (1,6T), selon The Decoder.
Nvidia publie Nemotron 3.5 Lightning, un modèle open-weight de 31,6 milliards de paramètres optimisé pour la vitesse d’inférence, disponible sous licence permissive sur Hugging Face.
Meta a lancé Muse Glimmer, un modèle IA open-weight de 30 milliards de paramètres taillé pour tourner en local sur un seul GPU grand public, disponible sur Hugging Face.
Moonshot AI a rendu publics le 27 juillet 2026 les poids complets de Kimi K3, un modèle MoE de 2,8 billions de paramètres présenté comme le plus gros modèle ouvert au monde.
En signant la lettre « Open Weights and American AI Leadership », Microsoft défend les modèles ouverts tout en réduisant sa dépendance à OpenAI et Anthropic sur Azure.
Poolside lance Laguna S 2.1, un modèle de code open source à 118 milliards de paramètres qui dépasse des modèles bien plus lourds sur Terminal-Bench.
Alibaba officialise Qwen 3.8, futur modèle open weight de 2 400 milliards de paramètres. Qwen3.8-Max-Preview est déjà accessible via le Token Plan QwenCloud, dont toute la grille tarifaire vient d’être mise à jour.
xAI a publié le code source de Grok Build sur GitHub après la découverte d’une fuite massive de données de ses utilisateurs. Mais le mécanisme d’upload contesté reste techniquement présent dans le logiciel.
