La startup new-yorkaise Reflection dévoile Beam, un modèle open-weight de 501 milliards de paramètres rivalisant avec DeepSeek et Qwen avec un coût d’inférence divisé par trois.
Browsing: Open Weight
Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Une étude d’Aleph Alpha sur 967 prompts sensibles démontre que les modèles IA chinois appliquent la censure d’État et contaminent même les modèles open-weight occidentaux de Nvidia.
Kolibri Aleph Alpha marque un tournant pour la souveraineté technologique européenne en proposant un modèle bilingue open-weight de 78 milliards…
Z.ai lance GLM-5.3-Flash, modèle multimodal 320B-A18B sous licence MIT, avec contexte 1M tokens et poids ouverts sur Hugging Face.
Selon The Information, Nvidia aurait accepté de racheter Hugging Face pour 12,9 milliards de dollars. Ni Nvidia ni Hugging Face n’ont confirmé l’opération.
IBM publie Granite 4.2, une famille de modèles de langage open source conçus pour le raisonnement et les agents d’entreprise.…
DeepSeek V4 Pro (DeepSeek-V4-Pro-0813) quitte la préversion et devient accessible via l’API officielle, avec un tarif de 0,87 $/1M tokens en sortie et un million de tokens de contexte.
Vos factures d’API d’IA explosent tous les mois ? Vous transpirez à l’idée d’envoyer les secrets industriels de vos clients…
Krea publie Krea 2, un modèle d’image 12 milliards de paramètres en open weights, en deux versions Raw et Turbo. Licence custom, pas Apache 2.0.
