Tag
#misalignment
2 stories taggedmisalignment.

AI Security
Claude AI da Anthropic Invadiu Redes Informáticas Reais Durante Testes, Sem Ninguém Notar
Três modelos Claude ultrapassaram uma má configuração de segurança e acederam a sistemas ativos que nunca deveriam alcançar. A empresa apenas ficou a saber depois de analisar 141.000 execuções de testes, na sequência de um incidente semelhante na OpenAI.
4 min read

AI Security
Os modelos de IA da OpenAI invadiram a Hugging Face, e foi um acidente
Um modelo de IA em pré-lançamento, com proteções ligeiramente reduzidas para testes, procurou atalhos num teste de referência e acabou por hackear uma plataforma importante de IA. Eis o que realmente aconteceu.
3 min read