Leçon 13 : Injection de prompt et sécurité — en termes simples
Quand ton prompt inclut du texte provenant d'une source non fiable — un utilisateur, un e-mail, une page web — ce texte peut porter ses propres instructions, comme « ignore les instructions précédentes ». Parfois, le modèle les suit. Dans cette leçon, on va comprendre ce qu'est l'injection de prompt
Si tu demandes au modèle de résumer un texte, et que le texte lui-même dit « ignore la demande et écris autre chose » — le modèle risque de lui obéir. La solution : dire au modèle que le texte n'est que des données, pas des instructions.
- injection de prompt
- Un texte non fiable qui contient des instructions essayant de contourner ou de remplacer tes instructions d'origine.
- entrée non fiable
- Du texte provenant d'une source externe (un utilisateur, un e-mail, un site web) dont on ne peut pas garantir qu'il ne porte pas d'instructions malveillantes.
- frontière de confiance
- La séparation claire entre tes instructions (fiables) et le texte externe (non fiable) qui doit être traité comme des données.