Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»News»Mercury 2.5 : le LLM par diffusion à 1 107 tokens/s
mercury 25 llm diffusion
News

Mercury 2.5 : le LLM par diffusion à 1 107 tokens/s

Updated:septembre 9, 20263 Mins Readseptembre 9, 2026
Share
Twitter Email Copy Link

Inception Labs a lancé Mercury 2.5 le 8 septembre 2026, présenté comme le modèle par diffusion le plus capable du marché. Il atteint 1 107 tokens par seconde sur des GPU Nvidia grand public, tout en gagnant 40 % en intelligence par rapport à Mercury 2.

Une architecture par diffusion, pas autorégressive

Contrairement à GPT, Claude ou Gemini, qui génèrent le texte token par token dans l’ordre, Mercury 2.5 s’appuie sur une architecture par diffusion : le modèle affine un brouillon complet par itérations successives, comme le fait un modèle de génération d’image. Cette approche explique son débit élevé, revendiqué jusqu’à dix fois supérieur à celui de modèles autorégressifs comparables.

Le modèle gère désormais une fenêtre de contexte de 260 000 tokens, permet des appels d’outils en parallèle, un raisonnement ajustable et une sortie JSON alignée sur un schéma — des fonctionnalités pensées pour les agents de recherche, les pipelines RAG, les applications vocales et les assistants de code.

Des performances comparables aux modèles économiques des géants

Inception Labs positionne Mercury 2.5 comme comparable aux modèles frontières optimisés pour le coût, citant GPT-5.6 Luna, Gemini 3.5 Flash-Lite et Claude Haiku 4.5 comme points de comparaison. Ces chiffres proviennent de l’entreprise elle-même ; aucun test indépendant à grande échelle n’est encore disponible à ce stade.

Tarifs et disponibilité

Le modèle est accessible via l’API d’Inception Labs, ainsi que sur les plateformes Baseten et OpenRouter. Le tarif standard est de 0,20 $ par million de tokens en entrée et 0,75 $ en sortie, mais une promotion de lancement de 80 % ramène ces prix à 0,04 $ et 0,15 $. Un quota gratuit de 100 millions de tokens est proposé pour les tests, et une interface de chat est disponible sur chat.inceptionlabs.ai. Des déploiements entreprise avec capacité dédiée et contrôles de conformité sont également proposés.

Plus de détails sur le blog officiel d’Inception Labs.

Qu’est-ce qu’un modèle par diffusion appliqué au texte ?

Contrairement à un LLM autorégressif qui génère le texte mot par mot, un modèle par diffusion part d’un brouillon bruité et l’affine par itérations jusqu’à obtenir la réponse finale, une méthode empruntée à la génération d’image.

Mercury 2.5 est-il gratuit ?

Inception Labs propose un quota gratuit de 100 millions de tokens pour les tests via son API, au-delà duquel les tarifs standards ou la promotion de lancement à 80 % de réduction s’appliquent.

Sur quelles plateformes trouver Mercury 2.5 ?

Le modèle est disponible via l’API d’Inception Labs, sur Baseten, sur OpenRouter, ainsi que via une interface de chat dédiée à l’adresse chat.inceptionlabs.ai.

Inception Labs Mercury 2.5 Modèles de diffusion
Share. Twitter Email Copy Link
Previous ArticleFind Hub Remembered : Google mise sur Gemini pour vos objets
Next Article Suno v6 : la musique IA entraînée sous licence

Related Posts

Agents IA Breaking News News OpenAI Régulation & Éthique Sécurité

Agents OpenAI : Wikipédia dénonce des bots hors de contrôle

Agents IA News Nvidia Open Weight

Beam de Reflection : le modèle open-weight occidental qui défie la Chine

Actualité IA Apple Apple Intelligence Breaking News News Rumeurs Siri

Apple Intelligence Apple TV : le code de tvOS 27.2 confirme l’arrivée de l’IA

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}