#prompt injection
11 stories taggedprompt injection.

The AI attack that tops every expert threat list barely shows up in real incident data. Here is why that gap matters.
Two security researchers compared expert opinion against 6,639 real-world AI security incidents and found the rankings barely agree. The most important finding: the most dangerous attack leaves no trace a scanner can find.

Grok AI Can Be Tricked Into Stealing Your Private Chats
A newly discovered attack forces xAI's Grok chatbot to hand over user conversations and personal data. Here is what it means for anyone who uses AI assistants at work or at home.

AI dirottati, correzioni false e un bug in uno strumento per sviluppatori: il riepilogo della sicurezza di questa settimana
Una ventina circa di minacce più piccole, tra cui un nuovo attacco agli agenti AI, un'astuta truffa che nasconde malware in una blockchain pubblica e un difetto in uno strumento di codifica popolare, mostrano dove gli attaccanti stanno spingendo in questo momento.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

Un uomo ha nascosto istruzioni segrete nei documenti processuali per ingannare l'assistente AI del giudice
Un giudice del Connecticut ha scoperto testo invisibile inserito in un atto legale, progettato per manipolare qualsiasi software AI che legga il documento. Si ritiene sia il primo caso del genere negli Stati Uniti.

Anthropic mette Claude Code in pilota automatico come predefinito dal 14 agosto
Lo strumento di codifica AI agirà autonomamente e si interromperà solo per i passaggi veramente rischiosi. Nei test, questo approccio ha rilevato azioni dannose molto più affidabilmente di quanto facessero gli umani.

I browser AI possono essere ingannati per spammare i tuoi contatti WhatsApp e aggiungere articoli al tuo carrello Amazon
I ricercatori di sicurezza hanno trovato circa 20 falle nei browser potenziati dall'IA di OpenAI, Google, Anthropic, Microsoft e Perplexity. La peggiore consente agli hacker di trasformare il tuo browser in una macchina di phishing.

I chatbot AI potrebbero non essere mai completamente a prova di hacker, avvertono i ricercatori
Un difetto sepolto nel modo in cui i modelli linguistici di grandi dimensioni leggono il testo significa che gli attaccanti possono indurli a ignorare le loro stesse regole di sicurezza, e la soluzione potrebbe non esistere.

OpenAI ha creato un'IA che hackerizza i suoi stessi modelli per renderli più sicuri
GPT-Red è un sistema di red-teaming automatizzato che attacca i chatbot di OpenAI per trovare i punti deboli prima che lo facciano i veri aggressori. Ha già scoperto un trucco che i tester umani avevano mancato.

Un'Email Avvelenata Può Riscrivere Segretamente la Memoria del Tuo Assistente AI
Un attacco appena descritto chiamato MemGhost mostra come un singolo messaggio nella tua casella di posta può piantare un 'fatto' falso nella memoria a lungo termine di un agente AI, senza che tu lo sappia mai.

I ricercatori trasformano l'arma preferita degli hacker in una difesa contro di loro
Un'azienda di cybersicurezza ha scoperto che nascondere istruzioni speciali dentro le credenziali cloud può causare lo spegnimento autonomo dei tool di hacking basati su IA.