Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»Analyse»Garde-fous IA : les chercheurs en cybersécurité fuient vers la Chine
Code de programmation coloré affiché sur un écran d'ordinateur, illustrant la recherche en cybersécurité
Analyse

Garde-fous IA : les chercheurs en cybersécurité fuient vers la Chine

4 Mins Readjuillet 24, 2026
Share
Twitter Email Copy Link

Les garde-fous IA imposés par OpenAI et Anthropic sur leurs modèles les plus avancés provoquent un exode discret mais bien réel chez les chercheurs en cybersécurité offensive. Selon une enquête de TechCrunch publiée le 23 juillet 2026, plusieurs experts reconnus du secteur affirment que ces restrictions les empêchent de mener leurs travaux défensifs et les poussent vers des modèles chinois sans limitation, comme GLM. Un paradoxe pour des outils censés renforcer la sécurité plutôt que la freiner.

Des contrôles nés d’une crainte de contournement

En juin 2026, le gouvernement américain a imposé des contrôles à l’exportation sur Fable et Mythos, les modèles d’Anthropic, après des signalements suggérant que leurs garde-fous pouvaient être contournés à des fins malveillantes. Ces restrictions ont depuis été partiellement levées : Fable 5 en a été dispensé le 1er juillet 2026, et Mythos 5 a été réintroduit, mais réservé aux organisations américaines vérifiées.

Des programmes de vérification jugés paternalistes

Pour continuer d’accéder aux capacités offensives de leurs modèles, les chercheurs doivent désormais s’inscrire à des programmes dédiés : le Trusted Access for Cyber d’OpenAI et le Cyber Verification Program (CVP) d’Anthropic. Mark Dowd, chercheur reconnu et vendeur de zero-days, résume le malaise ambiant : « it’s not really comfortable to me that these random large companies are making arbitrary decisions about what is safe ». Chris Anley, chief scientist chez NCC Group, va plus loin en expliquant que ces garde-fous « hurt defenders » en empêchant de tester concrètement l’exploitation de vulnérabilités. Paolo Stagno, CTO de Crowdfense, décrit de son côté un traitement des clients vérifiés « like children who need babysitting ».

Vers les modèles chinois sans restriction

Conséquence directe : une partie des chercheurs se tourne vers des modèles open source non bridés, à commencer par GLM. Chris Thompson, de RemoteThreat et organisateur de l’Offensive AI Con, pointe des garde-fous « inconsistent » qui poussent la communauté vers l’IA chinoise. Il résume la frustration ambiante : « you spend a lot of time negotiating with the model instead of working on the core security program ». Un chercheur anonyme, employé par un fabricant de composants pour smartphones exclu du CVP, va jusqu’à qualifier les modèles verrouillés de « barely useful » pour son activité quotidienne. Giuseppe Cali, chercheur en zero-days, explique pour sa part se limiter à l’usage de l’IA pour la rétro-ingénierie plutôt que pour l’offensif, faute de marge de manœuvre suffisante.

Un effet inverse à celui recherché

L’ironie relevée par plusieurs interlocuteurs de TechCrunch est que ces restrictions, censées limiter les usages malveillants, finissent surtout par éloigner les chercheurs légitimes des modèles américains les plus contrôlés — sans empêcher les acteurs mal intentionnés de se tourner, eux aussi, vers des alternatives moins régulées. Plusieurs chercheurs évoquent également un risque accru de fuite de données sensibles lorsqu’ils doivent recourir à des systèmes cloud tiers, faute d’accès direct aux modèles vérifiés. Un débat qui illustre la difficulté, pour les laboratoires d’IA, de calibrer des garde-fous efficaces contre les abus sans pénaliser la recherche en sécurité légitime.

Plus de détails dans l’enquête complète de TechCrunch.

Qu’est-ce que le Cyber Verification Program d’Anthropic ?

C’est un programme de vérification qui donne aux organisations américaines validées un accès élargi aux capacités offensives des modèles Mythos et Fable, en échange d’un contrôle renforcé de leur usage.

Pourquoi les modèles d’Anthropic ont-ils été soumis à un contrôle à l’export ?

Le gouvernement américain a imposé ces restrictions en juin 2026 après des signalements suggérant que les garde-fous de Fable et Mythos pouvaient être contournés à des fins malveillantes.

Vers quels modèles se tournent les chercheurs frustrés par ces garde-fous ?

Plusieurs experts cités par TechCrunch, comme Chris Thompson, indiquent se tourner vers des modèles open source moins restreints, notamment le modèle chinois GLM.

Anthropic Cybersécurité IA GLM 5.2 OpenAI Régulation IA
Share. Twitter Email Copy Link
Previous ArticleGoogle Gemini : la stratégie du gratuit qui piège 950 millions d’utilisateurs
Next Article Claude Opus 5 : Anthropic préparerait le lancement de son prochain modèle

Related Posts

Claude Design Intelligence Artificielle Productivité Tutoriels

Adieu PowerPoint : Claude Design présentation, le nouvel outil IA

Breaking News OpenAI

ChatGPT gratuit illimité : OpenAI lève la limite de messages texte

Analyse Alibaba Anthropic Breaking News Claude Qwen

Artificial Analysis Index : Qwen3.8 Max rattrape Claude Opus 4.8

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}