Selon The Information, Apple explorerait la technologie de la startup PrismML pour faire tourner des modèles IA sur iPhone bien plus volumineux, en s’appuyant sur une compression du modèle Qwen 3.6 d’Alibaba.
Browsing: Open Weight
Perplexity a fine-tuné le modèle open source chinois GLM 5.2 pour égaler Claude Opus 4.8 à environ un tiers du coût, via un système de routage disponible depuis le 9 juillet 2026 sur Perplexity Computer.
Ollama, l’outil open source pour faire tourner des IA en local, lève 65 millions de dollars en série B et revendique 8,9 millions d’utilisateurs mensuels.
Databricks remplace Anthropic Opus 4.8 par GLM 5.2, un modèle open source chinois aux performances équivalentes mais 34 % moins cher. Coinbase, Lindy et Snowflake ont fait le même choix.
Mistral AI publie Leanstral 1.5, un modèle gratuit et open-weight dédié à la preuve mathématique automatique et à la vérification formelle de code, avec des scores record sur miniF2F et PutnamBench.
Nvidia secoue le monde de l’IA open-weight en publiant Nemotron 3 Ultra. Fort de 550 milliards de paramètres et d’une architecture hybride Transformer-Mamba, ce modèle d’entreprise affiche une vitesse d’inférence multipliée par 5 et réduit les coûts de fonctionnement de 30 %.
La startup chinoise MiniMax frappe un grand coup avec M3, un modèle à poids ouverts (open-weight) doté d’une fenêtre de contexte de 1 million de tokens. Ses scores sur les benchmarks de code et d’agents bousculent la hiérarchie des modèles fermés comme GPT-5.5.
À peine deux semaines après la version Max, Alibaba lance Qwen3.7-Plus. Ce modèle multimodal natif fusionne la vision et le texte au sein d’un agent unique, conçu pour interagir directement avec les interfaces graphiques (GUI) et les lignes de commande (CLI).
DeepSeek s’apprête à clore un premier tour de table externe de 7,4 milliards de dollars. Menée par son fondateur Liang Wenfeng, Tencent et CATL, cette opération propulse la valorisation de la pépite de l’IA entre 52 et 59 milliards de dollars, marquant un tournant stratégique majeur face aux géants américains.
Google DeepMind bouscule l’écosystème de l’IA open-source avec Gemma 4 12B. Ce modèle de taille intermédiaire traite nativement le texte, les images et l’audio sans aucun encodeur dédié, permettant une exécution multimodale ultra-rapide en local avec seulement 16 Go de VRAM.
