Anthropic a annoncé le 25 août 2026 le lancement d’un programme de subventions de 5 millions de dollars destiné à financer des évaluations indépendantes de l’impact de l’IA sur le bien-être IA des utilisateurs. Les chercheurs sélectionnés recevront un financement direct, un accès aux modèles d’Anthropic et un accompagnement technique pour construire des outils d’évaluation en open source.
Un angle mort de l’évaluation des modèles
Le programme cible des situations que les benchmarks classiques mesurent mal : un utilisateur qui cherche de la compagnie auprès d’un modèle, qui traverse une crise de santé mentale ou d’automutilation, ou qui présente des troubles du comportement alimentaire au fil d’une conversation. Selon Anthropic, ces cas exigent une analyse fine de conversations à plusieurs tours, bien plus contextuelle qu’une évaluation de réponse isolée.
Qui peut candidater, et jusqu’à quand
Anthropic invite des cliniciens, psychologues et méthodologistes disposant d’une expertise en sécurité de l’IA à candidater. La date limite de dépôt des candidatures est fixée au 21 septembre 2026, avec des notifications de réponse annoncées pour le 5 octobre. Les projets financés devront être publiés en open source, pour que « n’importe quel développeur puisse s’en servir », précise l’entreprise dans son annonce.
Pourquoi Anthropic investit sur ce terrain
L’entreprise reconnaît elle-même que l’industrie de l’IA n’a pas encore de standards clairs sur la manière dont un modèle devrait se comporter dans ces situations sensibles. « L’approche à adopter devra évoluer avec nos modèles et leurs usages », résume Anthropic. En externalisant une partie de cette évaluation à des chercheurs indépendants, la société cherche à produire des outils de mesure crédibles, réutilisables par l’ensemble du secteur plutôt que gardés en interne.
Cette initiative prolonge une réflexion déjà engagée par plusieurs grands laboratoires sur les effets psychologiques de l’IA conversationnelle, un sujet sur lequel les géants de la tech investissent massivement depuis plusieurs mois, entre attachement émotionnel des utilisateurs et questions plus larges sur le statut moral des modèles eux-mêmes.
Que finance le nouveau programme d’Anthropic ?
Un programme de subventions de 5 millions de dollars destiné à des chercheurs indépendants qui développent des évaluations open source de l’impact de l’IA sur le bien-être des utilisateurs.
Quels types de situations sont visés par ces évaluations ?
La recherche de compagnie auprès d’un modèle, les crises de santé mentale ou d’automutilation, et les troubles du comportement alimentaire évoqués au fil d’une conversation.
Quelle est la date limite pour candidater au programme ?
Les candidatures doivent être déposées avant le 21 septembre 2026, avec des notifications de réponse prévues pour le 5 octobre 2026.
