Tag
#red teaming
2 stories taggedred teaming.

AI Security
Los chatbots de IA podrían nunca ser completamente a prueba de hackeos, advierten investigadores
Un defecto en la manera en que los modelos de lenguaje grandes leen texto permite que los atacantes los engañen para que ignoren sus propias normas de seguridad, y la solución podría no existir.
5 min read

AI Security
OpenAI Creó una IA que Hackea sus Propios Modelos para Hacerlos Más Seguros
GPT-Red es un sistema automatizado de pruebas de seguridad que ataca los propios chatbots de OpenAI para encontrar vulnerabilidades antes que los atacantes reales. Ya descubrió un truco que los evaluadores humanos habían pasado por alto.
4 min read