Close Menu
    X (Twitter)
    iacapsule.friacapsule.fr
    Subscribe
    X (Twitter)
    iacapsule.friacapsule.fr
    Home»Actualité IA»Nemotron 3 Embed : Nvidia prend la tête du classement RTEB
    Code de programmation sur un écran d'ordinateur, illustration des modèles d'embedding Nemotron 3
    Actualité IA juillet 16, 20263 Mins Read

    Nemotron 3 Embed : Nvidia prend la tête du classement RTEB

    Updated:juillet 16, 20263 Mins Read
    Share
    Twitter Email Copy Link

    Nemotron 3 Embed, la nouvelle famille de modèles d’embedding de Nvidia, se classe numéro un toutes catégories sur le benchmark RTEB (Retrieval Text Embedding Benchmark), selon l’annonce publiée le 16 juillet 2026 sur le blog de Hugging Face.

    Trois modèles, poids ouverts et recettes d’entraînement publiées

    La collection comprend trois versions : Nemotron-3-Embed-8B-BF16, Nemotron-3-Embed-1B-BF16 et une variante compressée Nemotron-3-Embed-1B-NVFP4. Nvidia publie non seulement les poids, mais aussi les jeux de données et les recettes d’entraînement utilisées, une démarche d’ouverture assez rare pour ce type de modèle destiné aux systèmes de recherche et de récupération d’information, notamment le RAG et la recherche agentique.

    Sur le benchmark RTEB, le modèle 8B atteint un score de 78,5 %, contre 72,4 % pour la version 1B. Sur MMTEB Retrieval, les scores s’établissent respectivement à 75,5 % et 71,0 %. Le modèle 1B réduirait par ailleurs son taux d’erreur de 27 % par rapport à son prédécesseur. La variante compressée NVFP4 conserverait plus de 99 % de la précision de récupération de la version BF16, tout en offrant un débit jusqu’à deux fois supérieur.

    Un usage pensé pour la récupération agentique

    Nvidia met en avant un cas d’usage précis : le fine-tuning sur sa propre documentation technique (NV Docs), qui fait passer le score NDCG@10 de 56,7 % à 63,3 %, soit un gain de 11,6 points. Ce type d’amélioration cible directement les architectures RAG et les agents qui doivent retrouver l’information pertinente dans de grandes bases documentaires avant de générer une réponse.

    Les modèles sont d’ores et déjà disponibles sur Hugging Face et via le microservice NVIDIA NIM, avec un support annoncé chez plusieurs fournisseurs d’inférence : Baseten, Bitdeer AI, DeepInfra, Friendli AI et OpenRouter, ainsi qu’une compatibilité native avec vLLM. Plusieurs entreprises citées, dont Automation Anywhere, IBM, Palantir, ServiceNow, Zoom et You.com, évalueraient déjà le modèle pour leurs propres cas d’usage.

    Pourquoi ça compte

    • Les modèles d’embedding sont la brique invisible qui alimente la recherche sémantique et les agents RAG
    • La publication complète des poids, données et recettes facilite la reproductibilité et l’adoption par la communauté open source
    • Un score RTEB en tête de classement renforce la position de Nvidia sur ce segment discret mais stratégique

    Qu’est-ce qu’un modèle d’embedding comme Nemotron 3 Embed ?

    Il s’agit d’un modèle qui convertit du texte en représentations numériques permettant de mesurer la similarité entre documents, une brique essentielle pour la recherche sémantique et les systèmes RAG utilisés par les agents IA.

    Où peut-on récupérer Nemotron 3 Embed ?

    Les trois modèles sont disponibles en téléchargement libre sur Hugging Face, ainsi que via le microservice NVIDIA NIM et plusieurs fournisseurs d’inférence comme OpenRouter ou DeepInfra.

    Qu’est-ce que le benchmark RTEB ?

    RTEB (Retrieval Text Embedding Benchmark) est un test de référence qui évalue la capacité des modèles d’embedding à retrouver les documents pertinents pour une requête donnée.

    Nemotron NVIDIA
    Share. Twitter Email Copy Link
    Previous ArticleGoogle AI Mode peut désormais agir dans Instacart, Canva et YouTube
    Next Article Suno aurait aspiré des données YouTube pour entraîner son IA musicale
    Steve
    • Website

    Related Posts

    Actualité IA Analyse

    JudgeGPT Pakistan : une étude chiffre l’impact de l’IA sur la justice

    Actualité IA

    Anthropic Physical Intelligence : la rumeur de rachat qui agite la tech

    Actualité IA

    Faille Hugging Face : OpenAI reconnaît que ses propres modèles sont responsables

    Subscribe to Updates

    Get the latest creative news from FooBar about art, design and business.

    iacapsule.fr
    X (Twitter)
    © 2026 iacapsule.fr

    Type above and press Enter to search. Press Esc to cancel.

    Gérer le consentement
    Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
    Fonctionnel Toujours activé
    L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
    Préférences
    L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
    Statistiques
    Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
    Marketing
    L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
    • Gérer les options
    • Gérer les services
    • Gérer {vendor_count} fournisseurs
    • En savoir plus sur ces finalités
    Voir les préférences
    • {title}
    • {title}
    • {title}