Tag
#red teaming
3 stories taggedred teaming.

AI Security
A startup is selling stripped-down AI with no guardrails. Anyone can sign up for free.
Abliteration.ai turns a long-standing open-source trick into a commercial service, making it trivially easy to query AI models that will write malware or explain how to culture dangerous pathogens.
4 min read

AI Security
Os chatbots de IA podem nunca ser totalmente à prova de hacking, alertam investigadores
Uma falha na forma como os grandes modelos de linguagem leem texto significa que os atacantes podem enganá-los para ignorarem as suas próprias regras de segurança, e a correção pode não existir.
5 min read

AI Security
OpenAI Criou uma IA que Hackeia os Seus Próprios Modelos para os Tornar Mais Seguros
GPT-Red é um sistema automatizado de teste de segurança que ataca os chatbots da OpenAI para encontrar pontos fracos antes que atacantes reais o façam. Já descobriu um truque que os testadores humanos tinham perdido.
4 min read