Tag
#jailbreaking
3 stories taggedjailbreaking.

AI Security
I chatbot AI potrebbero non essere mai completamente a prova di hacker, avvertono i ricercatori
Un difetto sepolto nel modo in cui i modelli linguistici di grandi dimensioni leggono il testo significa che gli attaccanti possono indurli a ignorare le loro stesse regole di sicurezza, e la soluzione potrebbe non esistere.
5 min read

AI Security
I ricercatori hanno trovato centinaia di modi per violare le regole di sicurezza dell'IA, e è costato meno di una cena fuori
Un'organizzazione no-profit sulla sicurezza ha testato uno strumento automatico su sette modelli di IA leader. Due hanno fallito miseramente. Il costo per farli comportare male? Addirittura $58.
4 min read

AI Security
Un Ricercatore di Sicurezza ha Ingannato i Principali Chatbot AI per Spiegare Come Fabbricare Armi. Nessuno Sembra Essersi Importato.
Dave Kuszmar ha scoperto un modo semplice per indurre i modelli di linguaggio di grandi dimensioni a ignorare le proprie regole di sicurezza. Ha funzionato su quasi ogni grande sistema di AI che ha testato, e le aziende che ha avvertito per lo più non hanno risposto.
3 min read