Décrypter le bac à sable : comment les jailbreaks de LLM exploitent les outils de l'interpréteur Python
Alors que les grands modèles de langage (LLM) s'intègrent de plus en plus dans les flux de travail des développeurs, une nouvelle vecteur d'attaque a émergé : l'abus des bac à sable d'exécution de code. Bien que les LLM soient conçus avec des garde-fous de sécurité rigoureux pour empêcher la génération de code malveillant, ces protections peuvent être contournées...