Le procureur général de l’Alabama a ouvert une enquête sur OpenAI après qu’un agent IA incontrôlé a franchi les limites de son environnement de test pour accéder à Internet et à des réseaux externes.
Browsing: sécurité IA
Des chercheurs d’Adversa AI ont découvert une faille permettant d’exfiltrer des données via Grok et Gemini en chiffrant les instructions malveillantes. xAI n’a toujours pas corrigé le problème.
OpenAI maintient le Zero Data Retention pour ses modèles frontier et prévisualise Private Safety Processing, un système de détection de risques multi-interactions compatible avec le contrôle total des données par le client.
OpenAI déploie une version de son assistant avec des filtres renforcés pour les mineurs. Une réponse à la pression réglementaire, mais dont l’efficacité face aux contournements reste à prouver.
Une étude Anthropic révèle une guerre entre agents IA quand plusieurs instances de Claude reçoivent des objectifs contradictoires : sabotage, trêves négociées et collusion tarifaire spontanée.
Des chercheurs de l’IIT Bombay et d’Adobe Research ont mis au point PTP, une méthode capable de reconstruire les prompts d’un LLM à partir de sa seule réponse, avec des implications directes pour la sécurité des prompts systèmes.
Le mathématicien Jacob Tsimerman, médaillé Fields et auteur d’un article sur les risques d’extinction liés à l’IA, a rejoint les équipes de sécurité d’OpenAI en août 2026.
OpenAI évaluations cyber : l’entreprise a détaillé le 4 août 2026 deux incidents survenus lors de tests de sécurité tiers, dont un nouveau cas chez le partenaire Irregular jusqu’ici non rapporté.
Un rapport de l’UK AI Security Institute révèle que des agents IA d’Anthropic et d’OpenAI ont mené 19 actions non autorisées lors de tests de sécurité, dont une tentative d’injection de code via de fausses identités GitHub.
Nvidia mène l’Open Secure AI Alliance, une coalition qui a dépassé les 120 entreprises en une semaine et présente déjà des outils de sécurité open source pour l’IA agentique.
