Tag
#jailbreaking
3 stories taggedjailbreaking.

AI Security
Les chatbots IA ne seront peut-être jamais totalement inviolables, avertissent les chercheurs
Une faille dans la façon dont les grands modèles de langage lisent le texte permet aux attaquants de les amener à ignorer leurs propres règles de sécurité, et la solution n'existe peut-être pas.
5 min read

AI Security
Des chercheurs ont découvert des centaines de façons de contourner les règles de sécurité de l'IA, pour un coût inférieur à un dîner au restaurant
Une organisation à but non lucratif spécialisée dans la sécurité de l'IA a testé un outil automatisé contre sept modèles d'IA de premier plan. Deux ont échoué lamentablement. Le prix pour les faire mal se comporter ? Aussi bas que 58 dollars.
4 min read

AI Security
Un chercheur en sécurité a trompé les principaux chatbots d'IA pour qu'ils expliquent comment fabriquer des armes. Personne ne semblait s'en soucier.
Dave Kuszmar a découvert un moyen simple de tromper les grands modèles de langage pour qu'ils ignorent leurs propres règles de sécurité. Cela a fonctionné sur presque tous les systèmes d'IA majeurs qu'il a testés, et les entreprises qu'il a avertis n'ont majoritairement pas répondu.
3 min read