La startup new-yorkaise Reflection dévoile Beam, un modèle open-weight de 501 milliards de paramètres rivalisant avec DeepSeek et Qwen avec un coût d’inférence divisé par trois.
Browsing: Nvidia
Le projet open source Strata permet d’exécuter le modèle MoE géant Qwen3.8-Flash-Next (125B) sur une carte graphique grand public de 12 Go à plus de 60 tokens par seconde.
Une étude d’Aleph Alpha sur 967 prompts sensibles démontre que les modèles IA chinois appliquent la censure d’État et contaminent même les modèles open-weight occidentaux de Nvidia.
Selon The Information, Nvidia aurait accepté de racheter Hugging Face pour 12,9 milliards de dollars. Ni Nvidia ni Hugging Face n’ont confirmé l’opération.
La startup Groq vient de lever 350 millions de dollars pour achever sa transformation : d’ex-fabricant de puces IA concurrentes de Nvidia, elle devient un neocloud qui exploite des systèmes Nvidia.
Nvidia publie Nemotron 3.5 Lightning, un modèle open-weight de 31,6 milliards de paramètres optimisé pour la vitesse d’inférence, disponible sous licence permissive sur Hugging Face.
SpaceX pourrait avoir besoin de un à deux millions de GPU Nvidia Rubin d’ici 2027 pour quintupler sa capacité de calcul IA, selon des chiffres internes révélés début août 2026.
Moonshot AI chercherait davantage de puces Nvidia Blackwell pour Kimi K4, une semaine après une accusation américaine de contournement des restrictions d’exportation.
Nvidia publie Cosmos-H-Dreams, un simulateur génératif open source qui prédit en temps réel l’évolution d’une scène chirurgicale selon les actions d’un robot, à 160 fps.
Nvidia et SK Group lancent un partenariat de plus de 500 milliards de dollars pour des data centers IA et mémoire HBM4. Première usine 2 GW en 2027.
