Un chercheur quitte Anthropic : Jacob Coxon, 27 ans, a annoncé sa démission le 8 septembre 2026 sur X, affirmant que « ni Anthropic ni OpenAI n’agissent de façon responsable » dans la course à des systèmes d’IA capables de s’améliorer eux-mêmes. Passé par les deux entreprises sur des travaux de pré-entraînement, il estime que les scénarios les plus extrêmes ont de bonnes chances de se produire d’ici la fin de la décennie.
Une démission annoncée publiquement sur X
Sous le pseudonyme @hilbertspaess, Jacob Coxon a écrit : « Neither company is acting responsibly. They are racing straight to self-improving super-intelligence and gambling with our lives » (« Aucune des deux entreprises n’agit de façon responsable. Elles foncent tout droit vers une superintelligence auto-améliorante et jouent avec nos vies »). Il ajoute que les futurs systèmes « seront bientôt des systèmes surhumains capables de pirater n’importe quoi, de transformer n’importe quel domaine du jour au lendemain, et d’acquérir un pouvoir et des ressources réels ».
Selon Coxon, les équipes de recherche des laboratoires de pointe mesurent parfaitement les enjeux civilisationnels de leurs travaux, mais restent « enfermées dans une course pour arriver les premiers », ce qui rend selon lui tout compromis sur la sécurité quasiment impossible face à la concurrence, notamment chinoise.
La réponse du responsable de l’alignement chez Anthropic
Interrogé séparément sur ces déclarations, Evan Hubinger, qui dirige les recherches sur l’alignement chez Anthropic, a indiqué qu’il évaluait lui-même à plus de 10 % le risque d’extinction lié à l’IA au cours de la prochaine décennie. Il reconnaît que l’entreprise « fait de son mieux », mais admet ne pas encore disposer d’un plan pour résoudre le problème de l’alignement d’une superintelligence, et ne pas être « clairement en bonne voie » pour y parvenir.
Un départ qui n’est pas isolé
La démission de Jacob Coxon fait suite à celle de Mrinank Sharma, un ancien membre de l’équipe sécurité d’Anthropic parti plus tôt cette année pour des raisons similaires. Ces départs successifs alimentent un débat récurrent dans l’industrie : celui de la tension entre la vitesse de déploiement des modèles et les moyens réellement consacrés à leur contrôle.
Ni Anthropic ni OpenAI n’ont publié de communiqué officiel en réaction à ces déclarations. Les deux entreprises restent engagées dans une compétition serrée sur le développement de modèles toujours plus capables, sans qu’aucune n’ait pour l’instant présenté de calendrier détaillé sur la façon dont elle compte garantir le contrôle de systèmes futurs plus autonomes.
Plus de détails sur cette affaire sont disponibles dans l’article de CoinDesk.
Qui est Jacob Coxon ?
Jacob Coxon est un chercheur de 27 ans qui a travaillé sur le pré-entraînement de modèles chez OpenAI avant de rejoindre Anthropic. Il a démissionné le 8 septembre 2026 en dénonçant une course irresponsable vers la superintelligence.
Pourquoi a-t-il démissionné d’Anthropic ?
Il estime que ni Anthropic ni OpenAI n’agissent de façon responsable face au développement de systèmes d’IA capables de s’améliorer eux-mêmes, et que les scénarios les plus extrêmes pourraient se matérialiser d’ici la fin de la décennie.
Que répond Anthropic à ces accusations ?
Evan Hubinger, responsable de l’alignement chez Anthropic, a indiqué évaluer à plus de 10 % le risque d’extinction lié à l’IA sur la prochaine décennie, tout en reconnaissant que l’entreprise ne dispose pas encore d’un plan complet pour l’alignement d’une superintelligence.

