Close Menu
    X (Twitter)
    iacapsule.friacapsule.fr
    Subscribe
    X (Twitter)
    iacapsule.friacapsule.fr
    Home»News»ZML LLMD : la start-up française qui veut casser le monopole Nvidia sur l’inférence
    Puce électronique sur circuit imprimé, illustration de l'inférence IA multi-puces
    News juillet 8, 20262 Mins Read

    ZML LLMD : la start-up française qui veut casser le monopole Nvidia sur l’inférence

    Updated:juillet 9, 20262 Mins Read
    Share
    Twitter Email Copy Link

    ZML LLMD est le nouveau serveur d’inférence gratuit publié en juillet 2026 par la start-up parisienne ZML, fondée par Steeve Morin, ancien vice-président ingénierie de Zenly, racheté par Snapchat pour neuf chiffres en 2017. L’outil permet de faire tourner de grands modèles de langage sur plusieurs architectures de puces à la fois, sans réécrire le code d’inférence pour chacune.

    Faire tourner un même modèle sur Nvidia, AMD, TPU ou Apple Metal

    ZML LLMD prend en charge les puces Nvidia, AMD, les TPU de Google, le Metal d’Apple et les puces Arc d’Intel. L’objectif affiché par l’équipe est de permettre aux entreprises de mélanger les fournisseurs de puces selon le coût ou la disponibilité, sans dépendre d’un seul écosystème matériel pour faire tourner leurs modèles à pleine vitesse, voire plus vite que sur certaines stacks propriétaires existantes.

    Steeve Morin résume l’intention : « L’idée est de redonner aux gens le pouvoir de créer leur propre système et d’obtenir de vrais gains d’efficacité. » ZML LLMD est gratuit, mais n’est pas publié en open source.

    Une équipe restreinte, des soutiens reconnus

    ZML a levé 20 millions de dollars auprès d’investisseurs dont 20VC, commit, AALVC, Drysdale Ventures, Kima Ventures, Kindred Capital, LocalGlobe et Puzzle Ventures. La start-up compte une vingtaine de personnes basées à Paris. Parmi les noms présents au capital figurent Solomon Hykes, fondateur de Docker et Dagger, ainsi que Clément Delangue et Julien Chaumond, cofondateurs de Hugging Face, et le lauréat du prix Turing Yann LeCun.

    Face aux plateformes d’inférence établies

    ZML se positionne face à des plateformes d’inférence comme Baseten, Inferact ou RadixArk, tout en misant sur le soutien aux fabricants de puces IA européens émergents. Pour un secteur où la dépendance à Nvidia reste un point de friction régulièrement cité par les entreprises qui déploient des modèles à grande échelle, ce type d’outil d’abstraction matérielle répond à une demande concrète du marché.

    Plus de détails sur TechCrunch.

    Qu’est-ce que ZML LLMD ?

    C’est un serveur d’inférence gratuit publié par la start-up française ZML, capable de faire tourner des modèles de langage sur plusieurs architectures de puces : Nvidia, AMD, TPU, Apple Metal et Intel Arc.

    ZML LLMD est-il open source ?

    Non, le logiciel est gratuit mais n’est pas publié en open source.

    Qui a fondé ZML ?

    ZML a été fondée par Steeve Morin, ancien vice-président ingénierie de Zenly, racheté par Snapchat en 2017.

    Intelligence artificielle
    Share. Twitter Email Copy Link
    Previous ArticleClaude Cowork arrive sur mobile et web pour les utilisateurs Max
    Next Article Muse Image : Meta lance son générateur d’images IA au cœur d’une polémique vie privée
    Steve
    • Website

    Related Posts

    News

    Samsung Mistral : discussions pour un investissement jusqu’à 1 milliard d’euros

    News

    Substack détection IA : la plateforme identifie le contenu généré par Pangram

    News Emploi

    France Travail IA : un algorithme pour cibler les chômeurs à contrôler

    Subscribe to Updates

    Get the latest creative news from FooBar about art, design and business.

    iacapsule.fr
    X (Twitter)
    © 2026 iacapsule.fr

    Type above and press Enter to search. Press Esc to cancel.

    Gérer le consentement
    Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
    Fonctionnel Toujours activé
    L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
    Préférences
    L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
    Statistiques
    Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
    Marketing
    L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
    • Gérer les options
    • Gérer les services
    • Gérer {vendor_count} fournisseurs
    • En savoir plus sur ces finalités
    Voir les préférences
    • {title}
    • {title}
    • {title}