La startup new-yorkaise Reflection dévoile Beam, un modèle open-weight de 501 milliards de paramètres rivalisant avec DeepSeek et Qwen avec un coût d’inférence divisé par trois.
Browsing: NVIDIA
Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Une étude d’Aleph Alpha sur 967 prompts sensibles démontre que les modèles IA chinois appliquent la censure d’État et contaminent même les modèles open-weight occidentaux de Nvidia.
Alibaba a présenté le 22 septembre 2026 la puce IA Zhenwu V900, trois fois plus performante que la précédente, et annonce des modèles Qwen de 5 000 à 10 000 milliards de paramètres.
Nvidia et Palantir s’associent pour piloter les chaînes d’approvisionnement avec l’IA, testée d’abord sur la propre logistique de Nvidia.
Le DOJ enquête sur l’accord de licence Nvidia-Groq, soupçonné d’avoir été structuré pour éviter le contrôle antitrust.
ML Intern, le nouvel assistant de Hugging Face, permet de lancer une expérience complète de machine learning en langage naturel, sans écrire de code.
Nvidia optimise ses puces pour Qwen, DeepSeek et GLM tout en avertissant, dans un document déposé auprès de la SEC, qu’une restriction de Washington sur les modèles chinois pourrait nuire à son activité.
Une faille critique (CVE-2026-65105) dans NemoClaw, l’outil de déploiement d’agents de Nvidia, permet à un site web malveillant de détourner des agents IA locaux via DNS rebinding, selon Oasis Security.
Amazon a confirmé le 26 août 2026 une commande de 2 millions de puces Nvidia supplémentaires pour AWS, livrables en 2027-2028, un triplement de l’accord signé cinq mois plus tôt.
