Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»News»Soofi S : le modèle IA allemand qui bat les benchmarks européens
Illustration — Soofi S : le modèle IA allemand qui bat les benchmarks européens
News

Soofi S : le modèle IA allemand qui bat les benchmarks européens

4 Mins Readjuillet 25, 2026
Share
Twitter Email Copy Link

Un consortium de recherche allemand vient de publier Soofi S, un modèle IA allemand ouvert de 30 milliards de paramètres qui devance tous les modèles pleinement ouverts sur les benchmarks anglais comme allemands. Le projet, coordonné par la KI Bundesverband et financé par le ministère fédéral de l’Économie, mobilise Fraunhofer, le DFKI et plusieurs universités. Les poids, le code d’entraînement et l’inventaire des données sont publiés sur Hugging Face.

Un consortium académique et industriel

Soofi S 30B-A3B a été développé par un consortium réunissant les instituts Fraunhofer IAIS et IIS, le Centre allemand de recherche pour l’intelligence artificielle (DFKI), la TU Darmstadt, l’université de Würzburg, le L3S Research Center, la Berlin University of Applied Sciences, ainsi que les entreprises Ellamind et Merantix Momentum. L’entraînement s’est déroulé de mars à mai 2026 sur l’Industrial AI Cloud de Deutsche Telekom à Munich, avec jusqu’à 512 GPU Nvidia B200 mobilisés, pour un total d’environ 253 000 heures de calcul GPU.

Une architecture pensée pour l’allemand

Le modèle repose sur une architecture hybride Mamba-Transformer en mélange d’experts : 31,6 milliards de paramètres au total, dont seulement 3,2 milliards actifs par token. Sur environ 27 000 milliards de tokens d’entraînement répartis en trois phases, la part de données en allemand est passée de 7,2 % à 15,3 %, très au-dessus des 5 % habituels des modèles multilingues généralistes.

Des scores en tête des modèles ouverts

Sur l’agrégat anglais, Soofi S atteint 70,1 %, devançant OLMo 3 32B et Apertus 70B malgré une taille inférieure de 40 milliards de paramètres. En allemand, il grimpe à 79,1 %, devant toutes les références européennes, avec des scores de premier plan sur GLP-DE (88,8) et ARC-Challenge-DE (92,3). Il obtient aussi 73,8 % sur HumanEval et 84,2 % sur MBPP-DE. Le modèle affiche en revanche des faiblesses : 56 points sur Minerva MATH-DE contre 76,5 pour Qwen3.5 35B-A3B, une récupération factuelle plus faible sur NaturalQuestions, et une précision qui chute à environ 3 % au-delà de 32 000 tokens de contexte sur RULER.

Michael Fromm, responsable technique du projet, a répondu aux critiques de sur-entraînement : « De nouvelles recherches montrent que les anciennes lois d’échelle des modèles denses ne s’appliquent plus aux architectures en mélange d’experts. »

Licence ouverte, mais pas totalement

Soofi S respecte la définition Open Source AI Definition 1.0 de l’Open Source Initiative, avec environ 99 % des données d’entraînement reconstructibles de manière indépendante. Il ne remplit toutefois pas les standards européens les plus stricts sur l’ouverture des données, en raison d’un corpus commercial (Genios) représentant 1,3 % du total. La licence finale reste à préciser, et des variantes instruct et raisonnement sont en cours de test.

Le 24 juillet 2026, le consortium a aussi révélé qu’un incident de contamination avait été détecté : des questions du benchmark GPQA s’étaient glissées par erreur dans les données d’entraînement à cause d’un défaut d’étiquetage sur Hugging Face. Le modèle a été ré-entraîné et GPQA retiré des évaluations, sans changement dans le classement final — un épisode présenté par l’équipe comme une preuve des bénéfices de la transparence.

Qu’est-ce que Soofi S ?

Soofi S est un modèle de langage ouvert de 30 milliards de paramètres développé par un consortium de recherche allemand coordonné par la KI Bundesverband, avec le soutien du ministère fédéral de l’Économie.

Soofi S est-il meilleur que les autres modèles ouverts ?

Sur les benchmarks évalués, Soofi S devance les modèles pleinement ouverts comme OLMo 3 32B et Apertus 70B, en anglais comme en allemand, mais reste derrière certains modèles à poids ouverts comme Qwen3.5 sur les mathématiques.

Le modèle est-il disponible publiquement ?

Oui, les poids, le code d’entraînement et l’inventaire des données sont publiés sur Hugging Face, même si la licence finale du modèle reste encore à préciser.

Allemagne Hugging Face Modèles ouverts Souveraineté IA
Share. Twitter Email Copy Link
Previous ArticleFugu Ultra v1.1 : le routeur IA de Sakana qui affirme battre Fable 5
Next Article Nvidia et SK Group dévoilent une initiative IA de plus de 500 milliards de dollars

Related Posts

News

Suno watermark : la plateforme muscle sa lutte anti-spam

News ByteDance

SeedRealtime : ByteDance lance son IA audio-visuelle en temps réel

News Google

Prévision des cyclones : Google DeepMind franchit un cap avec WeatherNext

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}