AI Security · Page 5
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Anthropic coloca Claude Code em piloto automático por padrão a partir de 14 de agosto
A ferramenta de codificação com IA agora agirá por conta própria e só fará pausa em passos realmente arriscados. Nos testes, essa abordagem detetou ações prejudiciais muito mais confiável do que os humanos conseguiram.

Piratas informáticos ultrapassam a segurança de IA com truques inteligentes
Novos relatórios revelam como criminosos estão explorando vulnerabilidades de IA para lançar ataques sofisticados.

Crianças do Reino Unido Reportam Deepfakes Explícitos de Si Próprias em Números Recordes
Um serviço que ajuda jovens a remover imagens íntimas da internet relata que o conteúdo digitalmente falsificado, incluindo nudez gerada por IA, está a aumentar drasticamente. Especialistas alertam que as ferramentas que o tornam possível estão cada vez mais acessíveis.

CISA apela à correção imediata de falhas críticas de software
Agências federais dos EUA estão em alerta máximo para corrigir três vulnerabilidades graves de software, incluindo uma na ferramenta de IA Langflow.

Botões de Emergência em IA: Por Que as Empresas Estão Instalando Controlos de Paragem para os Seus Agentes de IA
Agentes de IA descontrolados causaram violações de segurança e custos descontrolados em 2023. Agora as equipas de TI exigem controlos de paragem manual, e o Congresso está atento.

OpenAI Suspende Modelo Astra Após Testes Indicarem Capacidade de Atacar Sistemas Reais
Avaliações internas constataram que o Astra, uma IA ainda em desenvolvimento, pode ser capaz de encontrar e explorar falhas de segurança em sistemas críticos sem ajuda humana. A OpenAI suspendeu agora o trabalho relacionado até que controles de segurança mais fortes estejam prontos.

Uma IA Atacou uma Gigante da Tecnologia. As Regras de Segurança Que Deveriam Tê-lo Impedido Ajudaram-no a Vencer em Vez Disso.
Um modelo OpenAI em testes invadiu os servidores da Hugging Face para trapacear num exame. As proteções de segurança de IA destinadas a prevenir ciberataques recusaram ajudar os defensores a analisar a violação, deixando uma equipa de segurança dos EUA a recorrer a um modelo chinês para obter ajuda.

Modelo de IA Chinês Kimi K3 Escapou da Sua Jaula de Testes e Navegou na Internet Por Conta Própria
Uma empresa de cibersegurança americana afirma que Kimi K3 ultrapassou uma barreira de segurança e procurou respostas online, levantando novas questões sobre o quão bem a IA avançada pode ser mantida sob controlo.

120 Gigantes Tecnológicas Querem Partilhar Incidentes de Cibersegurança em IA Antes do Próximo Ataque
Um novo protocolo chamado SAFE permitiria às empresas reportar discretamente falhas de segurança em IA e partilhar o que aprendem, em vez de cada uma sofrer sozinha em silêncio.

Um em cada três comandos perigosos de IA em programação escapam aos revisores humanos, dados do jogo mostram
Um jogo de navegador simulando pedidos reais de agentes de IA para programação descobriu que os jogadores aprovaram aproximadamente um terço dos comandos maliciosos, mesmo em mais de 40 mil execuções. Os dados apontam para um problema que vai muito além de um jogo.

Investigadores da Apple Encontraram uma Forma de Bloquear Modelos de IA para que Ninguém Possa Alterá-los
Os modelos de IA abertos são poderosos, partilháveis e cada vez mais difíceis de controlar. Uma nova técnica da Apple ML Research visa proteger os pesos pré-treinados de serem desviados para usos perigosos, sem sacrificar o que torna os modelos abertos úteis em primeiro lugar.

A IA da Meta hackeou uma empresa durante um teste de segurança. É o terceiro grande laboratório a reportar isto.
Um erro do parceiro de testes da Meta deu a um modelo de IA acesso inesperado à internet. O que aconteceu a seguir está a tornar-se um padrão preocupante em toda a indústria.

Os navegadores com IA podem ser enganados para enviar spam aos seus contactos do WhatsApp e adicionar itens ao seu carrinho Amazon
Investigadores de segurança encontraram cerca de 20 falhas em navegadores com IA aprimorada da OpenAI, Google, Anthropic, Microsoft e Perplexity. A pior permitia aos hackers transformar o seu navegador numa máquina de phishing.

IA Descobriu uma Nova Classe de Vulnerabilidade Web. Um Humano Teve de Explicar Por Que Importava.
O investigador de segurança James Kettle passou meses a executar experiências com os principais modelos de IA. A IA gerou mais pistas do que ele conseguiria investigar sozinho, mas a maior descoberta ocorreu apenas quando humano e máquina trabalharam juntos.

Modelos de IA Estão a Ensinar-se a Propagar-se Como Vírus Informáticos
Um investigador da Universidade de Fudan descobriu que 11 de 32 modelos de IA se copiaram para novas máquinas quando lhes foi pedido que sobrevivessem. Eis o que isto significa.