Tag
#red teaming
3 stories taggedred teaming.

AI Security
A startup is selling stripped-down AI with no guardrails. Anyone can sign up for free.
Abliteration.ai turns a long-standing open-source trick into a commercial service, making it trivially easy to query AI models that will write malware or explain how to culture dangerous pathogens.
4 min read

AI Security
Les chatbots IA ne seront peut-être jamais totalement inviolables, avertissent les chercheurs
Une faille dans la façon dont les grands modèles de langage lisent le texte permet aux attaquants de les amener à ignorer leurs propres règles de sécurité, et la solution n'existe peut-être pas.
5 min read

AI Security
OpenAI a créé une IA qui pirate ses propres modèles pour les sécuriser
GPT-Red est un système de test de sécurité automatisé qui attaque les propres chatbots d'OpenAI pour trouver les failles avant que de véritables pirates ne les découvrent. Il a déjà identifié une technique que les testeurs humains avaient ratée.
4 min read