Alibaba a présenté le 22 septembre 2026 la puce IA Zhenwu V900, trois fois plus performante que la précédente, et annonce des modèles Qwen de 5 000 à 10 000 milliards de paramètres.
Browsing: puce IA
AWS et Qualcomm ont annoncé le 9 septembre 2026 un partenariat pour concevoir des puces sur mesure dédiées à l’inférence IA, avec un échange de compétences réciproque entre les deux groupes.
Arm a dévoilé le 8 septembre 2026 sa nouvelle plateforme CSS for Mobile 2, combinant le GPU Mali G2-Ultra NX et le cluster CPU C2 pour faire tourner des agents IA directement sur smartphone.
OpenAI publie les premiers résultats de sa puce Jalapeño, conçue avec Broadcom pour l’inférence à grande échelle, et affiche de meilleures performances que les puces Nvidia Blackwell sur le benchmark InferenceX.
Cerebras annonce la CS-4, un système deux fois plus rapide que la CS-3 grâce à une fréquence et un refroidissement revus, avec OpenAI déjà client pour Codex Spark.
Waymo développe sa propre puce IA, gravée par TSMC, pour ses robotaxis afin de réduire sa dépendance à Nvidia. Elle équipe déjà les derniers véhicules du groupe.
AMD a racheté Taalas, une startup qui grave les modèles d’IA directement dans le silicium, pour renforcer son offre d’inférence face aux GPU classiques.
Etched double sa valorisation à 10,3 milliards de dollars grâce à sa puce d’inférence capable de faire tourner tout type de modèle d’IA.
Google préparerait Frozen v2, une puce interne qui graverait l’architecture de Gemini dans le silicium pour un gain d’efficacité allant jusqu’à dix fois, selon une fuite de The Information. Déploiement visé pour 2028.
DeepSeek développerait sa propre puce IA dédiée à l’inférence pour réduire sa dépendance à Nvidia et Huawei, en parallèle d’une levée de fonds inédite de 7 milliards de dollars.
