Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Browsing: IA locale
Intelligence artificielle exécutée localement sans dépendance au cloud
Perplexity lance Portable Computer, un agent IA qui tourne entièrement en local sur les machines Nvidia RTX et DGX Spark, sans coût par jeton pour les tâches traitées sur l’appareil.
Le nouveau Mac Studio M5 Ultra d’Apple propose jusqu’à 512 Go de mémoire unifiée, permettant de faire tourner de grands modèles de langage entièrement en local.
JetBrains lance Junie Local, un agent de codage IA basé sur Qwen 3.6 qui tourne entièrement sur Mac M5, sans cloud ni jetons.
Meta élargit son écosystème open source avec un modèle optimisé pour l’exécution locale sur PC. Une avancée majeure pour la confidentialité et l’autonomie des développeurs.
Liquid AI publie LFM2.5-2.6B, un modèle compact taillé pour faire tourner des agents IA en local, sur ordinateur comme sur smartphone.
PrismML publie Bonsai 27B, un modèle IA de raisonnement compressé à moins de 4 Go pour tourner directement sur un iPhone, avec Apple déjà en phase de test selon CNBC.
Google déploie Gemma 4 E2B for TPU sur les Pixel 10, un modèle IA local exécuté directement sur la puce Tensor G5 pour chat, reconnaissance d’image et transcription audio hors ligne.
Ollama, l’outil open source pour faire tourner des IA en local, lève 65 millions de dollars en série B et revendique 8,9 millions d’utilisateurs mensuels.
