#prompt injection
11 stories taggedprompt injection.

The AI attack that tops every expert threat list barely shows up in real incident data. Here is why that gap matters.
Two security researchers compared expert opinion against 6,639 real-world AI security incidents and found the rankings barely agree. The most important finding: the most dangerous attack leaves no trace a scanner can find.

Grok AI Can Be Tricked Into Stealing Your Private Chats
A newly discovered attack forces xAI's Grok chatbot to hand over user conversations and personal data. Here is what it means for anyone who uses AI assistants at work or at home.

L'IA détournée, de fausses corrections et un bug dans un outil de développement : le résumé de sécurité de cette semaine
Une vingtaine de menaces plus réduites, dont une nouvelle attaque contre les agents IA, une arnaque astucieuse qui cache des malwares dans une blockchain publique, et une faille dans un outil de codage populaire, montrent où les attaquants se concentrent actuellement.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

Un homme a caché des instructions secrètes dans des documents judiciaires pour tromper l'assistant IA d'un juge
Un juge du Connecticut a découvert du texte invisible inséré dans un dossier juridique, conçu pour manipuler tout logiciel IA lisant le document. On pense qu'il s'agit du premier cas de ce genre aux États-Unis.

Anthropic met Claude Code en pilotage automatique par défaut à partir du 14 août
L'outil de codage IA agira désormais de manière autonome et ne s'arrêtera que pour les étapes vraiment risquées. Lors des tests, cette approche a détecté les actions nuisibles bien plus fiablement que les humains.

Les navigateurs IA peuvent être trompés pour envoyer du spam à vos contacts WhatsApp et ajouter des articles à votre panier Amazon
Des chercheurs en sécurité ont découvert environ 20 failles dans des navigateurs améliorés par l'IA d'OpenAI, Google, Anthropic, Microsoft et Perplexity. Les pires permettent aux pirates de transformer votre navigateur en machine de phishing.

Les chatbots IA ne seront peut-être jamais totalement inviolables, avertissent les chercheurs
Une faille dans la façon dont les grands modèles de langage lisent le texte permet aux attaquants de les amener à ignorer leurs propres règles de sécurité, et la solution n'existe peut-être pas.

OpenAI a créé une IA qui pirate ses propres modèles pour les sécuriser
GPT-Red est un système de test de sécurité automatisé qui attaque les propres chatbots d'OpenAI pour trouver les failles avant que de véritables pirates ne les découvrent. Il a déjà identifié une technique que les testeurs humains avaient ratée.

Un seul email empoisonné peut réécrire secrètement la mémoire de votre assistant IA
Une attaque nouvellement documentée appelée MemGhost montre comment un seul message dans votre boîte de réception peut planter un faux « fait » dans la mémoire à long terme d'un agent IA, sans que vous le sachiez jamais.

Les chercheurs transforment l'arme IA préférée des pirates en leur propre piège
Une firme de cybersécurité a découvert que cacher des instructions spéciales dans les identifiants cloud peut forcer les outils de piratage alimentés par l'IA à s'arrêter d'eux-mêmes.