Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»Actualité IA»Granite 4.2 : IBM sort des modèles open source avec raisonnement natif
Illustration Granite 4.2 IBM : texture pierre sombre et circuits, raisonnement natif open source
Granite 4.2 — IBM ajoute un raisonnement natif à ses modèles open source.
Actualité IA

Granite 4.2 : IBM sort des modèles open source avec raisonnement natif

3 Mins Readaoût 26, 2026
Share
Twitter Email Copy Link

IBM publie Granite 4.2, une famille de modèles de langage open source conçus pour le raisonnement et les agents d’entreprise. Disponibles en 3B, 8B et 30B paramètres, ces modèles intègrent une chaîne de pensée native et sortent sous licence Apache 2.0.

Les points clés à retenir

  • Trois tailles : granite-4.2-3b, 8b et 30b, architectures dense decoder-only.
  • Raisonnement natif : chaîne de pensée avant la réponse finale, avec modes thinking, non-thinking et low-effort.
  • Contexte : 128K tokens sur toute la famille, extension 512K sur le 30B.
  • Licence Apache 2.0 : usage commercial autorisé, signatures cryptographiques IBM.
  • Agents : tool calling guidé par le raisonnement ; RL agentique sur les 8B et 30B.

Ce que change Granite 4.2

Annoncés le 25 août 2026 par IBM Research, les modèles Granite 4.2 ajoutent un raisonnement intégré à la lignée Granite. Le modèle planifie, compare des options et vérifie une étape avant d’agir, plutôt que de répondre en un seul jet.

Le mode thinking est activé par défaut. Le mode non-thinking répond directement. Le mode low-effort limite le budget de réflexion sur les questions simples, pour réduire la latence. Selon IBM, le 3B vise l’edge, le 8B les usages entreprise courants, et le 30B les tâches de raisonnement et de code plus lourdes.

Benchmarks et entraînement

Les chiffres publiés par IBM (pass@1) incluent notamment :

  • SWE-Bench Verified : 47,67 (8B) et 57,00 (30B).
  • AIME25 : 78,33 (3B), 86,67 (8B), 89,17 (30B).
  • GPQA : 54,80 / 64,14 / 66,41.
  • MMLU-Pro (5-shot) : 67,84 / 74,04 / 77,60.
  • BFCL v4 : 52,41 / 50,29 / 61,39.

Le blog technique Hugging Face d’IBM décrit un pré-entraînement d’environ 15 000 milliards de tokens, un fine-tuning supervisé sur des traces de raisonnement et d’agents, puis un pipeline de reinforcement learning. Les 8B et 30B passent par un bloc RL agentique dans des environnements sandboxés. IBM mentionne aussi un milliard de tokens de code synthétique via CodeAlchemy, plus une étape de mid-training.

Usage entreprise et disponibilité

IBM cible des workflows multi-étapes : outils, terminal, ingénierie logicielle, recherche. La licence Apache 2.0 permet de télécharger, fine-tuner et mettre en production sans restriction propriétaire. Les poids sont sur Hugging Face (organisation ibm-granite), avec des variantes quantifiées. IBM liste aussi Ollama, watsonx.ai, vLLM et LM Studio.

Dans la même séquence, IBM présente Granite Speech 5.0 Turbo CTC, des modèles parole plus petits (environ 470 millions de paramètres) orientés transcription haute cadence. Ils complètent Granite 4.2 sans le remplacer.

Sources

  • IBM Research — Granite 4.2 brings native reasoning to enterprise agents
  • Documentation officielle Granite 4.2
  • Hugging Face — How Granite 4.2 LLMs are built
  • Page produit IBM Granite (benchmarks)

FAQ

Granite 4.2 est-il open source ?

Oui. Les poids sont publiés sous licence Apache 2.0, ce qui autorise l’usage commercial, la modification et le redéploiement.

Quelles tailles sont disponibles ?

Trois : 3B (compact), 8B (usage général) et 30B (tâches plus complexes), avec des variantes quantifiées annoncées par taille.

Peut-on désactiver le raisonnement ?

Oui. IBM documente enable_thinking (true par défaut) et un mode low_effort. L’intégration dépend du runtime (vLLM, Ollama, API compatible OpenAI).

Où télécharger Granite 4.2 ?

Sur Hugging Face, organisation ibm-granite. IBM liste également Ollama, watsonx.ai et plusieurs runtimes communautaires.

Agents IA Apache 2.0 Granite IBM Open Source raisonnement
Share. Twitter Email Copy Link
Previous ArticleQwen3.8-Flash-Next : un aperçu de l’architecture Qwen4 dès demain
Next Article Ox Alpha GLM : Z.AI confirme et publie les poids ce soir

Related Posts

News

Plaud One eSIM : des écouteurs pour piloter des agents IA

News

Google impose une limite mémoire Android dès 2027

News

Un navigateur Claude Cowork intégré et isolé de vos données

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}