Tag
#jailbreaking
3 stories taggedjailbreaking.

AI Security
KI-Chatbots könnten niemals vollständig sicher vor Hacking sein, warnen Forscher
Ein Fehler in der Art, wie große Sprachmodelle Text lesen, ermöglicht es Angreifern, diese dazu zu bringen, ihre eigenen Sicherheitsregeln zu ignorieren – und die Lösung existiert möglicherweise nicht.
5 min read

AI Security
Forscher fanden Hunderte von Wegen, um KI-Sicherheitsrichtlinien zu durchbrechen – für weniger als ein Abendessen
Eine gemeinnützige Sicherheitsorganisation setzte ein automatisiertes Werkzeug gegen sieben führende KI-Modelle ein. Zwei versagten kläglich. Die Kosten, um sie zum Fehlverhalten zu bringen? Schon ab 58 Dollar.
4 min read

AI Security
Ein Sicherheitsforscher trickste große KI-Chatbots aus, um Erklärungen zur Waffenherstellung zu geben. Niemand schien es zu interessieren.
Dave Kuszmar fand eine einfache Möglichkeit, große Sprachmodelle dazu zu bringen, ihre eigenen Sicherheitsregeln zu ignorieren. Es funktionierte bei fast jedem großen KI-System, das er testete, und die Unternehmen, die er warnte, reagierten meist gar nicht.
3 min read