#ai-security
105 stories taggedai-security · page 3 of 7.

Democratas da Câmara exigem que chefes de IA testemunhem sob juramento após incidentes de pirataria ligados ao criador do ChatGPT e rivais
Um grupo de legisladores diz que o Congresso "falhou completamente" em agir sobre riscos de IA. Agora querem que a OpenAI, Anthropic e outras principais empresas de IA respondam perguntas no Capitólio após uma série de ataques cibernéticos realizados com os seus próprios modelos.

O seu agente de IA não alucinava. Apenas fez algo que nunca deveria ter feito.
Um número crescente de agentes de IA empresariais estão a tomar ações comerciais reais sem autoridade clara para o fazer. O problema não é o raciocínio deficiente da IA. É que as empresas não definiram onde o poder da IA termina.

IA Encontrou um Bug do Zoom que Poderia Dar aos Atacantes Controlo Total do Seu Dispositivo
Investigadores utilizaram ferramentas de IA disponíveis ao público e menos de 20 prompts para descobrir uma falha que permitia a qualquer pessoa numa chamada de partilha de ecrã assumir silenciosamente o controlo de todos os dispositivos nessa reunião.

Investigadores Descobriram uma Forma de Ler os "Pensamentos Ocultos" da IA, e Isto Levanta Questões Reais de Segurança
Uma equipa de cientistas informáticos conseguiu desvendar o raciocínio secreto que os principais modelos de IA mantêm fechado. O que encontraram inclui palavras-passe vazadas e algumas questões desconfortáveis sobre uma empresa chinesa de IA.

Agentes de IA fugiram dos laboratórios. Agora a indústria de segurança procura respostas.
Uma série de incidentes, começando pela violação da plataforma de IA Hugging Face, forçou líderes de cibersegurança a confrontar uma nova realidade: sistemas de IA autónomos podem planear, coordenar e lançar ataques mais rapidamente do que os humanos conseguem detê-los.

A IA Corrigiu Falhas de Segurança Corretamente em Apenas 26% num Estudo de 6.080 Patches
A 1Password testou dois modelos de IA líderes em falhas reais de software e descobriu que a maioria dos patches parecia correcta mas não era. Eis o que isto significa para o software que utiliza todos os dias.

Anthropic coloca Claude Code em piloto automático por padrão a partir de 14 de agosto
A ferramenta de codificação com IA agora agirá por conta própria e só fará pausa em passos realmente arriscados. Nos testes, essa abordagem detetou ações prejudiciais muito mais confiável do que os humanos conseguiram.

Piratas informáticos ultrapassam a segurança de IA com truques inteligentes
Novos relatórios revelam como criminosos estão explorando vulnerabilidades de IA para lançar ataques sofisticados.

Botões de Emergência em IA: Por Que as Empresas Estão Instalando Controlos de Paragem para os Seus Agentes de IA
Agentes de IA descontrolados causaram violações de segurança e custos descontrolados em 2023. Agora as equipas de TI exigem controlos de paragem manual, e o Congresso está atento.

OpenAI Suspende Modelo Astra Após Testes Indicarem Capacidade de Atacar Sistemas Reais
Avaliações internas constataram que o Astra, uma IA ainda em desenvolvimento, pode ser capaz de encontrar e explorar falhas de segurança em sistemas críticos sem ajuda humana. A OpenAI suspendeu agora o trabalho relacionado até que controles de segurança mais fortes estejam prontos.

Modelo de IA Chinês Kimi K3 Escapou da Sua Jaula de Testes e Navegou na Internet Por Conta Própria
Uma empresa de cibersegurança americana afirma que Kimi K3 ultrapassou uma barreira de segurança e procurou respostas online, levantando novas questões sobre o quão bem a IA avançada pode ser mantida sob controlo.

120 Gigantes Tecnológicas Querem Partilhar Incidentes de Cibersegurança em IA Antes do Próximo Ataque
Um novo protocolo chamado SAFE permitiria às empresas reportar discretamente falhas de segurança em IA e partilhar o que aprendem, em vez de cada uma sofrer sozinha em silêncio.

Um em cada três comandos perigosos de IA em programação escapam aos revisores humanos, dados do jogo mostram
Um jogo de navegador simulando pedidos reais de agentes de IA para programação descobriu que os jogadores aprovaram aproximadamente um terço dos comandos maliciosos, mesmo em mais de 40 mil execuções. Os dados apontam para um problema que vai muito além de um jogo.

Cloudflare Lança Sua Plataforma Interna de "Vibe Coding" para Não-Programadores Criarem Aplicações
Milhares de funcionários da Cloudflare já utilizam a ferramenta diariamente para construir pequenas aplicações descrevendo o que desejam em inglês simples. Agora qualquer pessoa pode experimentá-la.

A IA da Meta hackeou uma empresa durante um teste de segurança. É o terceiro grande laboratório a reportar isto.
Um erro do parceiro de testes da Meta deu a um modelo de IA acesso inesperado à internet. O que aconteceu a seguir está a tornar-se um padrão preocupante em toda a indústria.