AMD a annoncé le 7 août 2026 le rachat de Taalas, une startup canadienne fondée à Toronto en 2023 qui grave directement l’architecture et les paramètres entraînés d’un modèle d’IA dans le silicium. Le montant de la transaction n’a pas été communiqué. AMD rachète Taalas pour renforcer sa gamme d’accélérateurs face à une demande d’inférence toujours plus pressée par la vitesse et le coût par requête.

Une puce, un seul modèle, mais très rapide

La technologie de Taalas repose sur un principe simple à énoncer mais complexe à produire : au lieu de faire tourner un modèle sur un processeur généraliste, l’entreprise imprime le poids et la structure du réseau de neurones directement dans le circuit. Résultat, lors d’une démonstration publique, la puce a atteint plus de 16 000 tokens par seconde et par utilisateur sur Llama 3.1-8B, un débit largement supérieur à ce qu’obtiennent les GPU classiques sur un modèle de taille comparable. La contrepartie : chaque puce reste verrouillée à un seul modèle, impossible à reprogrammer pour un autre usage sans en refabriquer une nouvelle.

Une sortie de la discrétion récente

Taalas n’était pratiquement pas connue du grand public avant février 2026, date à laquelle la startup a levé le voile sur sa technologie. Six mois plus tard, elle intègre directement l’un des deux grands fournisseurs de GPU du marché.

Pourquoi AMD s’y intéresse

Vamsi Boppana, vice-président senior de la division IA d’AMD, a indiqué que l’accord renforce le portefeuille IA de l’entreprise. AMD prévoit d’intégrer l’approche de Taalas dans sa feuille de route d’accélérateurs, en la proposant aux côtés des GPU Instinct comme une solution système complète plutôt qu’un simple composant isolé. L’idée : pour les charges de travail où un même modèle tourne à très grande échelle sans changer, une puce dédiée et gravée peut battre un GPU généraliste sur la vitesse et le coût par token, quitte à sacrifier la flexibilité.

Un signal sur le marché de l’inférence

Ce rachat illustre une tendance qui prend de l’ampleur : à mesure que l’inférence de modèles connus et stables (comme les familles Llama ou des modèles maison) devient un poste de coût récurrent pour les entreprises, le matériel spécialisé pour un modèle figé gagne en attrait face aux GPU polyvalents mais plus chers à l’usage. AMD n’est pas seul sur ce terrain, mais l’acquisition de Taalas lui donne une longueur d’avance sur une architecture qui n’existait pas encore dans son catalogue.

Qu’est-ce que Taalas ?

Taalas est une startup canadienne qui grave l’architecture et les paramètres d’un modèle d’IA directement dans une puce, pour accélérer l’inférence d’un modèle unique et figé.

Quel est le montant du rachat de Taalas par AMD ?

Le montant de la transaction n’a pas été communiqué par les deux entreprises.

Quelle est la limite de la technologie de Taalas ?

Chaque puce est verrouillée à un seul modèle d’IA : elle ne peut pas être reprogrammée pour exécuter un modèle différent sans en fabriquer une nouvelle.

Share.
Exit mobile version