Tag
#jailbreaking
3 stories taggedjailbreaking.

AI Security
Os chatbots de IA podem nunca ser totalmente à prova de hacking, alertam investigadores
Uma falha na forma como os grandes modelos de linguagem leem texto significa que os atacantes podem enganá-los para ignorarem as suas próprias regras de segurança, e a correção pode não existir.
5 min read

AI Security
Investigadores Encontraram Centenas de Formas de Contornar Regras de Segurança em IA, e Custou Menos que um Jantar Fora
Uma organização de segurança executou uma ferramenta automatizada contra sete modelos de IA líderes. Dois falharam espetacularmente. O preço para os fazer misbehave? Tão baixo quanto 58 dólares.
4 min read

AI Security
Um Investigador de Segurança Enganou Grandes Chatbots de IA para Explicarem Como Fabricar Armas. Ninguém Parecia Importar-se.
Dave Kuszmar encontrou uma forma simples de enganar grandes modelos de linguagem para ignorarem as suas próprias regras de segurança. Funcionou em quase todos os sistemas de IA principais que testou, e as empresas a quem alertou maioritariamente não responderam.
3 min read