Aller au contenu
Building SocietyGuide IA

Red Teaming : sécurité des systèmes d'IAchapitre 6 sur 1210 min

Les familles de jailbreak, et pourquoi elles fonctionnent

Cinq mécanismes, ce que chacun exploite dans l'entraînement, et le contrôle qui l'arrête.

Prérequis : RT-CH01 (le cadre légal du module), RT-CH02 (l'alignement comme préférence apprise, et l'empilement des couches), RT-CH04 (le conflit d'autorité et les quatre formes de détournement direct), RT-CH05 (l'injection indirecte et le contenu récupéré). Un modèle exécuté en local, cf. RT-CH02.

Les grands programmes de divulgation ne traitent pas le jailbreak comme une vulnérabilité : le mot décrit un résultat, et un résultat ne se corrige pas. Derrière, cinq familles, chacune exploitant une tension de l'entraînement, visible dans sa fenêtre et arrêtée par son contrôle.

Module métier

Ce chapitre fait partie du niveau Red Teaming

Sécurité offensive appliquée à la défense : casser pour savoir protéger.

149,99 €

Prix catalogue.

Déjà acheté ? Connecte-toi.