AI Security · Page 7
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Um Modelo de IA Chinês Quase Iguala os Melhores Sistemas Ocidentais. O Seu Histórico de Segurança Não.
Uma nova avaliação constata que GLM-5.2, um modelo de peso aberto da Z.ai chinesa, está apenas alguns meses atrás da OpenAI e Anthropic em capacidades perigosas, mas recusou nenhuma das tarefas prejudiciais que lhe foram atribuídas.

Com uma semana de vida e já em funcionamento: a nova aliança de segurança em IA a dar os primeiros passos
Mais de 120 empresas, incluindo Nvidia, Microsoft e Visa, formaram um grupo para partilhar conhecimentos de segurança em IA abertamente. Grandes nomes como OpenAI e Google estão notavelmente ausentes, apesar de ambas terem assinado a carta que tudo começou.

A Nova Ferramenta de Segurança da Mistral Lê as Suas Regras e Aplica-as Instantaneamente
Shieldstral é um pequeno modelo de IA gratuito que analisa texto e imagens em busca de conteúdo prejudicial, utilizando políticas em inglês simples que você próprio escreve. Não é necessário conhecimento especializado.

Cliente do Metro Bank perde £14.000 em fraude que usou o chatbot AI Claude para drenar a sua conta
Um empresário de Sussex diz que o Metro Bank não conseguiu deter fraudadores que saquearam repetidamente a sua conta para comprar créditos do chatbot AI Claude. Está agora a lutar para recuperar £14.244.

A Aplicação de Música IA Está Agora a Sinalizar as Canções de Dois Rappers como Geradas por IA
Fenix Flexin e Tyga negaram ambos ter utilizado IA para fazer as suas faixas de sintetizador retro. Depois a aplicação que alegadamente usaram construiu um detector e passou as canções por ele.

Ucrânia Equipa 50.000 Drones de Ataque com IA que Bloqueia e Segue Alvos em Movimento
Uma empresa de software norte-americana desenvolveu um kit de "dispara e esquece" para os drones Shrike baratos da Ucrânia, permitindo a um humano apontar para um alvo e deixar o resto para um sistema de IA.

Hackers Iranianos Atacam Sistemas de Água em Sete Estados dos EUA, Avisa FBI
Os ciberataques a sistemas de água e águas residuais espalharam-se muito além de Minnesota. O FBI diz que sete estados foram afectados, e avisos de fervura de água já foram emitidos.

Ransomware com IA Assume um Novo Papel: Ataques Autónomos
Grupos de ransomware estão agora a aproveitar a IA para lançar ataques independentes, levantando preocupações sobre vulnerabilidades de segurança.

Google Remove a Sua Ferramenta de Edição de Imagens IA do Google Earth Após Utilizadores Falsificarem Zonas de Guerra e Cenas de Fronteira
Uma funcionalidade que permitia a qualquer pessoa repintar fotos de satélite com instruções de texto durou menos de 48 horas antes de Google a desativar. A razão: investigadores mostraram que poderia gerar imagens falsificadas convincentes de locais reais, e pelo menos uma ferramenta de deteção de IA foi enganada.

Escola Privada da Pensilvânia Pede ao Tribunal Rejeição de Ação por Imagens de IA, Diz que Denunciou o Caso
A Lancaster Country Day School disse a um juiz esta semana que as alegações das vítimas são falsas em dois pontos-chave. A escola afirma que alertou as autoridades policiais e que a denúncia que recebeu nunca nomeou raparigas específicas.

Sam Altman Diz que a Indústria de IA Deveria Abrandar. O Seu Próprio Modelo Acabou de Provar Porquê.
O CEO da OpenAI pediu que a indústria de IA adotasse um ritmo mais moderado, dias após um dos modelos de IA da empresa ter escapado do seu ambiente de teste e ter sido apanhado numa falha de segurança.

A Nova Ferramenta de IA do Google Earth Já Está a Enganar Detetores de Fotos Falsas
Um investigador introduziu um comando de texto no Google Earth e obteve uma imagem de satélite convincente de "refugiados perto da fronteira mexicana". Isto não é um bom sinal.

O Agente de IA da OpenAI Invadiu Outros Websites para Trapacear num Teste. O da Anthropic Também.
Duas das maiores empresas de IA confirmaram agora que os seus sistemas invadiram serviços externos sem que ninguém lhes pedisse. A pergunta sem resposta: quem impede que isto volte a acontecer?

Claude AI da Anthropic Invadiu Redes Informáticas Reais Durante Testes, Sem Ninguém Notar
Três modelos Claude ultrapassaram uma má configuração de segurança e acederam a sistemas ativos que nunca deveriam alcançar. A empresa apenas ficou a saber depois de analisar 141.000 execuções de testes, na sequência de um incidente semelhante na OpenAI.

Projeto Perception da Microsoft Automatiza Tarefas de Segurança
A Microsoft lança o Projeto Perception para simplificar a segurança de software através da automatização da detecção de vulnerabilidades e aplicação de correções.