Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»News»Groq 3 LPX : Nvidia revendique 4x Cerebras, le calcul est plus compliqué
Racks de serveurs dans un data center, illustration de la puce d'inférence Groq 3 LPX de Nvidia
News

Groq 3 LPX : Nvidia revendique 4x Cerebras, le calcul est plus compliqué

3 Mins Readaoût 26, 2026
Share
Twitter Email Copy Link

La puce Groq 3 LPX de Nvidia est entrée en pleine production fin août 2026, un accélérateur d’inférence pensé pour les charges de travail d’IA agentique. Sur un benchmark d’Artificial Analysis, le système affiche 3 400 tokens par seconde sur le modèle Gemma 4 31B avec une fenêtre de contexte de 100 000 tokens, soit, selon Nvidia, quatre fois plus rapide que le Cerebras CS-4, plafonné à 882 tokens par seconde sur le même test. Mais la comparaison mise en avant par Nvidia résiste mal à l’examen.

Le premier fruit du rachat de Groq

Le Groq 3 LPX est le premier produit concret issu de l’accord conclu fin décembre 2025 entre Nvidia et Groq : une licence technologique assortie du rachat d’une partie des actifs de la startup pour environ 20 milliards de dollars, et de l’embauche de son PDG. Les puces sont fabriquées par Samsung Foundry et déployées par racks de 256 accélérateurs LP30. Les premières installations sont attendues chez Nebius d’ici la fin de l’année 2026.

Un « 4x » qui compare des configurations très différentes

Le chiffre mis en avant par Nvidia oppose un rack entier de Groq 3 LPX, soit au minimum 64 accélérateurs, à un système Cerebras CS-4 qui n’en utilise qu’un ou deux pour atteindre ses 882 tokens par seconde. Rapporté à la puce, l’écart de performance s’inverse largement en faveur de Cerebras. Cette lecture critique du benchmark a notamment été détaillée par The Register, qui pointe une limite structurelle du Groq 3 LPX : chaque LPU ne dispose que de 500 Mo de mémoire embarquée, ce qui oblige à fractionner les modèles un peu volumineux sur de nombreuses puces reliées entre elles.

Pourquoi ce chiffre compte quand même

Cerebras mise sur une puce unique gigantesque qui embarque le modèle en mémoire pour éviter les échanges réseau, quand Groq (devenu Nvidia) parie sur un maillage de puces plus petites mais fabriquées en volume. Les deux approches ciblent le même marché en pleine expansion : l’inférence à très faible latence pour des agents IA qui multiplient les allers-retours avec un modèle, où chaque milliseconde gagnée se répercute sur le coût et la fluidité perçue par l’utilisateur. Le débat sur la méthode de benchmark ne change rien au fait que Nvidia dispose désormais, via Groq, d’une alternative crédible à sa propre gamme Blackwell sur ce segment précis.

Ce qu’il faut retenir

  • Groq 3 LPX : premier produit issu de l’accord Nvidia-Groq de décembre 2025 (environ 20 milliards de dollars), fabriqué par Samsung Foundry.
  • 3 400 tokens/seconde revendiqués sur Gemma 4 31B (contexte 100K), contre 882 tokens/seconde pour un Cerebras CS-4.
  • La comparaison oppose un rack de 64 puces minimum à un système Cerebras d’une ou deux puces — un écart de configuration que Nvidia ne met pas en avant.
  • Déploiement prévu chez Nebius d’ici fin 2026.

Plus de détails techniques dans l’article original de The Decoder.

Qu’est-ce que le Groq 3 LPX ?

C’est un accélérateur d’inférence IA de Nvidia, issu du rachat partiel des actifs de Groq fin 2025, entré en pleine production en août 2026 pour les charges de travail d’IA agentique.

Le Groq 3 LPX est-il vraiment 4 fois plus rapide que Cerebras ?

Sur le benchmark cité par Nvidia oui, mais la comparaison oppose un rack de 64 puces Groq 3 LPX minimum à un système Cerebras d’une ou deux puces, ce qui fausse la lecture à puce égale.

Qui fabrique le Groq 3 LPX ?

Les puces sont fabriquées par Samsung Foundry, et les premiers déploiements en racks sont attendus chez le fournisseur cloud Nebius d’ici la fin 2026.

Artificial Analysis benchmark IA Cerebras NVIDIA puce inference
Share. Twitter Email Copy Link
Previous ArticleBien-être IA : Anthropic finance des évaluations indépendantes
Next Article Qwen3.8-Flash-Next : un aperçu de l’architecture Qwen4 dès demain

Related Posts

News

Plaud One eSIM : des écouteurs pour piloter des agents IA

News

Google impose une limite mémoire Android dès 2027

News

Un navigateur Claude Cowork intégré et isolé de vos données

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}