Close Menu
  • Actualité IA
  • Modèles IA
  • Open Weight
X (Twitter)
iacapsule.friacapsule.fr
  • Actualité IA
  • Modèles IA
  • Open Weight
S'abonner
X (Twitter)
iacapsule.friacapsule.fr
Home»Actualité IA»IA : des chercheurs savent reconstruire les prompts
Ordinateur portable affichant une icône de verrouillage, illustrant le risque de sécurité lié à la reconstruction de prompts IA
Actualité IA

IA : des chercheurs savent reconstruire les prompts

3 Mins Readaoût 13, 2026
Share
Twitter Email Copy Link

Une équipe de l’IIT Bombay et d’Adobe Research a mis au point une méthode capable de reconstruire les prompts ayant produit une réponse de modèle de langage, à partir du seul texte généré en sortie. Baptisée PTP (Previous-Token Prediction), la technique fonctionne en boîte noire, sans accès aux poids du modèle ciblé, selon le papier publié le 31 juillet 2026 sur arXiv et relayé le 12 août 2026 par The Decoder.

Prédire le token précédent plutôt que le suivant

Les modèles de langage sont entraînés à prédire le prochain mot d’une séquence. La méthode PTP inverse ce principe : elle entraîne un second modèle à prédire le token précédent, en remontant la chaîne de génération jusqu’à retrouver le prompt d’origine. Contrairement aux approches antérieures, qui nécessitaient un fine-tuning lourd sur de vastes jeux de données externes, PTP s’entraîne directement sur des données synthétiques produites par le modèle cible lui-même, ce qui la rend plus légère à déployer.

Selon les auteurs du papier, Pirzada Suhail, Nagasai Saketh Naidu, Atanu R Sinha et Amit Sethi, la méthode surpasse les travaux précédents sur l’ensemble des métriques testées. Dans l’exemple mis en avant par The Decoder, le système reconstruit une question mot pour mot, ainsi que six variantes sémantiquement équivalentes, à partir de la seule réponse générée par un modèle Qwen-3-0.6B. La technique s’est également montrée capable de reconstruire des prompts destinés à GPT-4o, sans connaître à l’avance le modèle source, démontrant une transférabilité inter-modèles.

Un risque direct pour les prompts systèmes propriétaires

Cette capacité pose un problème concret pour les entreprises qui bâtissent des produits autour de prompts systèmes soigneusement calibrés : règles de modération, instructions métier spécialisées, ou secrets commerciaux intégrés dans l’invite envoyée au modèle. Si un attaquant peut reconstruire ce prompt à partir des seules réponses publiques d’un chatbot, il peut potentiellement copier la logique produit d’un concurrent ou contourner ses garde-fous.

Le risque ne s’arrête pas aux prompts systèmes : les auteurs notent que les requêtes personnelles des utilisateurs pourraient elles aussi être extraites des réponses d’un assistant, ce qui soulève une question de confidentialité pour tout service exposant publiquement les sorties d’un modèle de langage, même sans jamais afficher la question posée.

Une course entre attaque et défense

Comme souvent en sécurité de l’IA, la publication de cette méthode a une double lecture : elle documente une vulnérabilité réelle, mais elle fournit aussi aux équipes de sécurité un outil pour tester la résistance de leurs propres systèmes avant qu’un tiers malveillant ne le fasse. Le papier complet est disponible sur arXiv.

Qu’est-ce que la méthode PTP ?

PTP (Previous-Token Prediction) est une méthode développée par l’IIT Bombay et Adobe Research qui entraîne un modèle à prédire le token précédent d’une séquence, permettant de reconstruire le prompt d’origine à partir de la seule réponse d’un LLM.

Quels modèles ont été testés avec PTP ?

Les chercheurs ont démontré la méthode sur Qwen-3-0.6B et GPT-4o, montrant une reconstruction quasi exacte des prompts ainsi qu’une transférabilité entre différents modèles.

Quel est le risque pour les entreprises ?

Un prompt système propriétaire, contenant des règles de modération ou des secrets commerciaux, pourrait être reconstruit par un tiers à partir des seules réponses publiques d’un chatbot.

prompts IA sécurité IA Sécurité LLM
Share. Twitter Email Copy Link
Previous ArticlePragmatik Labs : l’ex-patron de Qwen lève 2 milliards
Next Article IA et détection du cancer du sein : l’attente déçue

Related Posts

Actualité IA

Faille NemoClaw : des agents IA locaux piratables

Actualité IA

Google DeepMind lance les évaluations en double aveugle

Actualité IA News Open Weight Z.ai

GLM-5.3-Flash : Z.ai sort un modèle multimodal open source sous licence MIT

Subscribe to Updates

Get the latest creative news from FooBar about art, design and business.

iacapsule.fr
X (Twitter)
  • À propos d’IA Capsule
  • Contact
  • Mentions légales
  • Politique de confidentialité
© 2026 iacapsule.fr

Type above and press Enter to search. Press Esc to cancel.

Gérer le consentement
Pour offrir les meilleures expériences, nous utilisons des technologies telles que les cookies pour stocker et/ou accéder aux informations des appareils. Le fait de consentir à ces technologies nous permettra de traiter des données telles que le comportement de navigation ou les ID uniques sur ce site. Le fait de ne pas consentir ou de retirer son consentement peut avoir un effet négatif sur certaines caractéristiques et fonctions.
Fonctionnel Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.
  • Gérer les options
  • Gérer les services
  • Gérer {vendor_count} fournisseurs
  • En savoir plus sur ces finalités
Voir les préférences
  • {title}
  • {title}
  • {title}