Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

ZML : la startup parisienne qui veut libérer l'inférence IA de Nvidia lance un moteur gratuit

2 min de lecture · TechCrunch AI · 8 juil. 2026 · IA générative · Pertinence : élevée
Vérifié par la rédaction de laveille.ai le . Notre méthodologie

D'après TechCrunch - article original, relayé par TechCrunch AI

ZML : la startup parisienne qui veut libérer l'inférence IA de Nvidia lance un moteur gratuit

Rédigé à partir de la source originale; chaque fait est vérifié contre le texte source.

À retenir

  • LLMD fait tourner des modèles comme LLaMA, Gemma, Qwen et Mistral sur cinq écosystèmes de puces différents : Nvidia CUDA, AMD ROCm, Google TPU, Intel oneAPI et Apple Metal.
  • Le produit est gratuit mais n'est pas open source, contrairement à la pile logicielle ZML sous-jacente, publiée sur GitHub.
  • ZML a bouclé une ronde d'amorçage de 20 millions de dollars US, révélée le 8 juillet 2026 avec le lancement de LLMD, réunissant des fonds comme Kindred Capital, LocalGlobe et Kima Ventures, et des investisseurs individuels dont Yann LeCun et Solomon Hykes.
  • Le fondateur Steeve Morin, ex-vice-président ingénierie de Zenly (rachetée par Snap en 2017), dit vouloir réduire la dépendance des développeurs à l'écosystème CUDA de Nvidia sans se positionner contre l'entreprise.
  • ZML affirme vouloir d'abord mesurer l'adoption du produit gratuit avant de choisir où concentrer sa stratégie de monétisation.

Pourquoi ça compte

L'inférence IA (le calcul qui traite les requêtes des utilisateurs et génère les réponses) repose largement sur l'écosystème logiciel CUDA de Nvidia, ce qui limite la concurrence entre fabricants de puces et maintient des coûts élevés pour les entreprises qui déploient des modèles. Un outil capable de faire tourner efficacement un même modèle sur plusieurs architectures matérielles pourrait redonner du pouvoir de négociation aux acheteurs de calcul et réduire le coût de diffusion de l'IA.

Chiffre-clé

Le 8 juillet 2026, TechCrunch rapportait que ZML avait levé 20 millions de dollars US en financement d'amorçage au moment du lancement de LLMD.

Citation

« We have reached the point where we are co-designing silicon. » Steeve Morin, fondateur de ZML (cité par TechCrunch)

Action concrète

Les équipes techniques qui évaluent leurs coûts d'inférence IA peuvent tester l'image Docker de LLMD publiée par ZML pour comparer les performances sur leur propre matériel avant de s'engager auprès d'un seul fournisseur de puces.

Fondée sur la source originale

Sources

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !