#prompt injection
11 stories taggedprompt injection.

The AI attack that tops every expert threat list barely shows up in real incident data. Here is why that gap matters.
Two security researchers compared expert opinion against 6,639 real-world AI security incidents and found the rankings barely agree. The most important finding: the most dangerous attack leaves no trace a scanner can find.

Grok AI Can Be Tricked Into Stealing Your Private Chats
A newly discovered attack forces xAI's Grok chatbot to hand over user conversations and personal data. Here is what it means for anyone who uses AI assistants at work or at home.

IA Sequestrada, Correções Falsas e um Bug numa Ferramenta de Desenvolvimento: O Resumo de Segurança desta Semana
Um conjunto de aproximadamente vinte ameaças menores, incluindo um novo ataque a agentes de IA, um esquema astuto que esconde malware numa blockchain pública, e uma falha numa ferramenta de codificação popular, mostra para onde os atacantes estão a concentrar-se neste momento.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

Um Homem Escondeu Instruções Secretas em Documentos Judiciais para Tentar Enganar um Assistente IA de um Juiz
Um juiz de Connecticut descobriu texto invisível plantado numa petição legal, concebido para manipular qualquer software de IA que lesse o documento. Acredita-se ser o primeiro caso deste tipo nos EUA.

Anthropic coloca Claude Code em piloto automático por padrão a partir de 14 de agosto
A ferramenta de codificação com IA agora agirá por conta própria e só fará pausa em passos realmente arriscados. Nos testes, essa abordagem detetou ações prejudiciais muito mais confiável do que os humanos conseguiram.

Os navegadores com IA podem ser enganados para enviar spam aos seus contactos do WhatsApp e adicionar itens ao seu carrinho Amazon
Investigadores de segurança encontraram cerca de 20 falhas em navegadores com IA aprimorada da OpenAI, Google, Anthropic, Microsoft e Perplexity. A pior permitia aos hackers transformar o seu navegador numa máquina de phishing.

Os chatbots de IA podem nunca ser totalmente à prova de hacking, alertam investigadores
Uma falha na forma como os grandes modelos de linguagem leem texto significa que os atacantes podem enganá-los para ignorarem as suas próprias regras de segurança, e a correção pode não existir.

OpenAI Criou uma IA que Hackeia os Seus Próprios Modelos para os Tornar Mais Seguros
GPT-Red é um sistema automatizado de teste de segurança que ataca os chatbots da OpenAI para encontrar pontos fracos antes que atacantes reais o façam. Já descobriu um truque que os testadores humanos tinham perdido.

Um Email Envenenado Pode Reescrever Secretamente a Memória do Seu Assistente de IA
Um ataque recentemente descrito chamado MemGhost mostra como uma única mensagem na sua caixa de entrada pode plantar um 'facto' falso na memória de longo prazo de um agente de IA, sem que você saiba.

Investigadores Transformam Arma Favorita dos Hackers em Sua Própria Defesa
Uma empresa de cibersegurança descobriu que esconder instruções especiais dentro das credenciais de nuvem pode fazer com que ferramentas de hacking por IA se desativem automaticamente.