Google AI Edge Foresight débarque sur macOS pour transformer tes bribes de notes en comptes rendus structurés grâce au modèle…
Browsing: Open Weight
Le laboratoire français officialise Mistral Large 4, un modèle de fondation nativement multimodal culminant à 1 000 milliards de paramètres…
La startup new-yorkaise Reflection dévoile Beam, un modèle open-weight de 501 milliards de paramètres rivalisant avec DeepSeek et Qwen avec un coût d’inférence divisé par trois.
Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Une étude d’Aleph Alpha sur 967 prompts sensibles démontre que les modèles IA chinois appliquent la censure d’État et contaminent même les modèles open-weight occidentaux de Nvidia.
Kolibri Aleph Alpha marque un tournant pour la souveraineté technologique européenne en proposant un modèle bilingue open-weight de 78 milliards…
Z.ai lance GLM-5.3-Flash, modèle multimodal 320B-A18B sous licence MIT, avec contexte 1M tokens et poids ouverts sur Hugging Face.
Selon The Information, Nvidia aurait accepté de racheter Hugging Face pour 12,9 milliards de dollars. Ni Nvidia ni Hugging Face n’ont confirmé l’opération.
IBM publie Granite 4.2, une famille de modèles de langage open source conçus pour le raisonnement et les agents d’entreprise.…
DeepSeek V4 Pro (DeepSeek-V4-Pro-0813) quitte la préversion et devient accessible via l’API officielle, avec un tarif de 0,87 $/1M tokens en sortie et un million de tokens de contexte.
