Tag
#jailbreaking
3 stories taggedjailbreaking.

AI Security
Los chatbots de IA podrían nunca ser completamente a prueba de hackeos, advierten investigadores
Un defecto en la manera en que los modelos de lenguaje grandes leen texto permite que los atacantes los engañen para que ignoren sus propias normas de seguridad, y la solución podría no existir.
5 min read

AI Security
Investigadores Encontraron Cientos de Formas de Violar las Reglas de Seguridad de IA, y Costó Menos que una Cena Fuera
Una organización de seguridad ejecutó una herramienta automatizada contra siete modelos de IA líderes. Dos fallaron gravemente. ¿El costo para hacerlos comportarse mal? Apenas $58.
4 min read

AI Security
Un investigador de seguridad engañó a los principales chatbots de IA para que expliquen cómo fabricar armas. A nadie pareció importarle.
Dave Kuszmar encontró una forma simple de engañar a los grandes modelos de lenguaje para que ignoren sus propias reglas de seguridad. Funcionó en casi todos los sistemas de IA importantes que probó, y las empresas a las que advirtió en su mayoría no respondieron.
3 min read