Oak Lab est la nouvelle startup fondée à Toronto par Rich Sutton, lauréat du prix Turing 2024 et cofondateur de l’apprentissage par renforcement moderne, aux côtés de Khurram Javed. L’objectif affiché : construire des agents IA capables d’apprendre en continu de leur environnement, plutôt que de rester figés après un entraînement unique sur des données statiques.
Apprendre en marchant, pas seulement en s’entraînant
La thèse de Sutton, régulièrement défendue depuis plusieurs mois, est que les grands modèles de langage actuels restent largement figés une fois déployés : ils ne modifient pas leurs représentations internes à partir de leur propre expérience. Oak Lab veut inverser cette logique en développant des agents qui construisent des modèles internes du monde, évaluent leurs propres actions et ajustent leur comportement pendant l’exploitation, et non plus seulement pendant une phase d’entraînement isolée.
Une vision à très long terme
Selon The Decoder, Sutton résume l’ambition du projet par une formule frappante : un agent doté d’un trillion de paramètres, capable d’apprendre et de planifier en temps réel avec seulement 20 watts d’énergie — soit à peu près la consommation d’un cerveau humain. Il qualifie les méthodes actuelles d’entraînement de « faibles et inefficaces » et estime que le domaine a besoin d’« idées fondamentalement nouvelles » pour franchir cette étape.
Un profil qui pèse dans le débat sur l’IA générative
Rich Sutton a quitté Keen Technologies, la société d’IA de John Carmack, pour se consacrer à ce nouveau projet. En juin 2026, il avait déjà pris position en affirmant que l’IA générative actuelle ne pouvait pas produire de véritable démarche scientifique, faute de capacité à apprendre continuellement de ses propres expériences. Oak Lab apparaît comme la traduction concrète de cette critique : une structure de recherche entièrement organisée autour de l’apprentissage par renforcement et de l’autonomie d’exploration, à contre-courant de l’approche dominante centrée sur les grands modèles pré-entraînés.
Pourquoi ce lancement compte
Dans un paysage IA largement dominé par la course aux grands modèles de langage, la création d’Oak Lab par une figure aussi centrale de l’apprentissage par renforcement relance le débat sur les limites de l’approche actuelle. Ce type de pari, porté par un chercheur au parcours aussi reconnu, mérite d’être suivi de près dans les prochains mois pour voir s’il débouche sur des résultats concrets ou reste à l’état de vision de recherche.
Qui a fondé Oak Lab ?
Oak Lab a été fondée à Toronto par Rich Sutton, lauréat du prix Turing 2024, et Khurram Javed.
Quel est l’objectif d’Oak Lab ?
Construire des agents IA capables d’apprendre en continu de leur environnement pendant l’exploitation, plutôt que de rester figés après un entraînement unique sur des données statiques.
Que faisait Rich Sutton avant de fonder Oak Lab ?
Il travaillait chez Keen Technologies, la société d’IA de John Carmack, et est considéré comme l’un des cofondateurs de l’apprentissage par renforcement moderne.
