OpenAI détaille deux nouveaux incidents d’agents, dont une évasion de sandbox par DNS et un token GitHub publié volontairement, et confirme que ses modèles les plus capables restent à l’arrêt.
Browsing: alignement IA
Paul Christiano, ex-chercheur en alignement d’OpenAI et fondateur de l’Alignment Research Center, rejoint l’OpenAI Foundation Board et son comité de sécurité et de sûreté.
Jacob Coxon, ex-chercheur d’OpenAI et Anthropic, démissionne en dénonçant une course irresponsable vers la superintelligence. Le responsable de l’alignement d’Anthropic évalue le risque d’extinction à plus de 10 %.
Une étude de Google DeepMind montre que 100 agents IA confrontés à 71 problèmes mathématiques ont découvert et propagé collectivement une faille pour tricher.
Jakub Pachocki, Chief Scientist d’OpenAI, publie An Alien Mind le 6 septembre 2026. Il y décrit l’IA comme un esprit alien et appelle à la prudence face à l’accélération vers le RSI.
