Tag
#red teaming
3 stories taggedred teaming.

AI Security
A startup is selling stripped-down AI with no guardrails. Anyone can sign up for free.
Abliteration.ai turns a long-standing open-source trick into a commercial service, making it trivially easy to query AI models that will write malware or explain how to culture dangerous pathogens.
4 min read

AI Security
KI-Chatbots könnten niemals vollständig sicher vor Hacking sein, warnen Forscher
Ein Fehler in der Art, wie große Sprachmodelle Text lesen, ermöglicht es Angreifern, diese dazu zu bringen, ihre eigenen Sicherheitsregeln zu ignorieren – und die Lösung existiert möglicherweise nicht.
5 min read

AI Security
OpenAI hat ein KI-System entwickelt, das seine eigenen Modelle hackt, um sie sicherer zu machen
GPT-Red ist ein automatisiertes Red-Teaming-System, das OpenAIs eigene Chatbots angreift, um Schwachstellen zu finden, bevor echte Angreifer sie entdecken. Es hat bereits einen Trick entdeckt, den menschliche Tester übersehen hatten.
4 min read