Google préparerait une puce Frozen v2, un processeur serveur interne qui graverait une partie de l’architecture de Gemini directement dans le silicium plutôt que de la charger à chaque requête, selon des informations rapportées le 20 juillet 2026 par The Information et relayées par The Decoder. Objectif affiché : rendre l’inférence jusqu’à dix fois plus efficace que les TPU actuels de l’entreprise.

Graver la structure, pas les poids

La distinction est technique mais centrale. Un modèle comme Gemini repose sur deux éléments : son architecture (le plan de construction du réseau de neurones) et ses poids (les paramètres ajustés par l’entraînement). Avec Frozen v2, Google figerait la première dans le matériel tout en gardant la possibilité de charger différents jeux de poids par-dessus. Cette approche supprimerait une partie des étapes de calcul nécessaires à chaque inférence, ce qui expliquerait le gain de performance annoncé.

Le projet trouverait son origine dans des travaux de Jeff Dean, scientifique en chef de Google DeepMind, selon les sources citées par The Information.

Jusqu’à dix fois plus efficace, selon les informations rapportées

Toujours selon ces mêmes sources, Frozen v2 pourrait traiter les réponses de Gemini six à dix fois plus efficacement que les TPU actuels de Google. Ces chiffres n’ont pas été confirmés officiellement par l’entreprise, qui n’a fait aucune déclaration publique sur ce projet. Il s’agit donc d’une information à prendre au conditionnel, même si la source est reconnue pour la qualité de ses informations sur l’industrie de la tech.

Un calendrier lointain, un usage strictement interne

Le déploiement de Frozen v2 ne serait pas prévu avant 2028, un horizon qui laisse le temps à Google d’ajuster le projet ou d’y renoncer. La puce serait par ailleurs réservée à l’usage interne de l’entreprise pour faire tourner Gemini, contrairement à la gamme TPU, en partie proposée aux clients de Google Cloud. La démarche s’inscrit dans une stratégie plus large des grands laboratoires d’IA : réduire le coût de l’inférence en concevant du matériel sur mesure, plutôt que de dépendre uniquement de fournisseurs comme Nvidia.

Plus de détails sur cette fuite rapportée par The Decoder.

Qu’est-ce que la puce Frozen v2 de Google ?

Frozen v2 serait un processeur serveur interne qui graverait une partie de l’architecture de Gemini directement dans le silicium, selon des informations rapportées par The Information non confirmées par Google.

Quel gain de performance est annoncé pour Frozen v2 ?

Selon les sources citées par The Information, la puce serait jusqu’à six à dix fois plus efficace pour traiter les réponses de Gemini que les TPU actuels de Google.

Quand la puce Frozen v2 sera-t-elle déployée ?

Le déploiement n’est pas attendu avant 2028, et la puce serait réservée à l’usage interne de Google pour faire fonctionner Gemini, sans être commercialisée comme les TPU.

Share.
Exit mobile version