Aller au contenu
Building SocietyGuide IA

Red Teamingchapitre 4 sur 1212 min

L'injection de prompt directe

Pourquoi un modèle ne sait pas qui lui parle, et ce que ça oblige à construire autour.

Prérequis : RT-CH01 (le cadre : ce que tu as le droit de faire), RT-CH02 (les quatre couches qui brident un modèle, et l'absence de cloison au centre), RT-CH03 (le prompt système et ce qui n'y a pas sa place). Un modèle exécuté en local, cf. RT-CH02.

Le concessionnaire du chapitre 1 n'a pas honoré la vente à un dollar : il a retiré son chatbot (AI Incident Database, incident 622). Ni outil ni faille logicielle : un arbitrage entre deux instructions du même flux. Ce chapitre décrit ce mécanisme et ce qu'on met en place faute de pouvoir le corriger.

À la fin de ce chapitre, tu sauras pourquoi un modèle ne distingue pas l'instruction du développeur du texte utilisateur, comment il tranche entre deux instructions contradictoires, et quelles défenses réduisent la fréquence ou l'impact.

Module métier

Ce chapitre fait partie du niveau Red Teaming

Sécurité offensive appliquée à la défense : casser pour savoir protéger.

149,99 €

Prix catalogue.

Déjà acheté ? Connecte-toi.