#prompt injection
11 stories taggedprompt injection.

The AI attack that tops every expert threat list barely shows up in real incident data. Here is why that gap matters.
Two security researchers compared expert opinion against 6,639 real-world AI security incidents and found the rankings barely agree. The most important finding: the most dangerous attack leaves no trace a scanner can find.

Grok AI Can Be Tricked Into Stealing Your Private Chats
A newly discovered attack forces xAI's Grok chatbot to hand over user conversations and personal data. Here is what it means for anyone who uses AI assistants at work or at home.

KI-Entführungen, gefälschte Fixes und ein Entwickler-Tool-Bug: Sicherheitsrückblick der Woche
Etwa zwanzig kleinere Bedrohungen – darunter ein neuer Angriff auf KI-Agenten, ein raffinierter Betrug, der Malware in einer öffentlichen Blockchain versteckt, und ein Fehler in einem beliebten Coding-Tool – zeigen, wo Angreifer derzeit aggressiv vorgehen.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

Ein Mann versteckte geheime Anweisungen in Gerichtsdokumenten, um einen KI-Richterassistenten zu manipulieren
Ein Richter in Connecticut entdeckte unsichtbaren Text in einer Gerichtseinreichung, der KI-Software beeinflussen sollte. Es wird angenommen, dass dies der erste Fall dieser Art in den USA ist.

Anthropic stellt Claude Code ab dem 14. August standardmäßig auf Autopilot
Das KI-Coding-Tool wird nun eigenständig handeln und nur bei wirklich risikanten Schritten pausieren. In Tests erkannte dieser Ansatz schädliche Aktionen viel zuverlässiger als Menschen.

KI-Browser können dazu manipuliert werden, Ihre WhatsApp-Kontakte zuzuspammen und Artikel in Ihren Amazon-Warenkorb zu legen
Sicherheitsforscher fanden etwa 20 Sicherheitslücken in KI-erweiterten Browsern von OpenAI, Google, Anthropic, Microsoft und Perplexity. Die schwerwiegendste erlaubt es Hackern, Ihren Browser in eine Phishing-Maschine zu verwandeln.

KI-Chatbots könnten niemals vollständig sicher vor Hacking sein, warnen Forscher
Ein Fehler in der Art, wie große Sprachmodelle Text lesen, ermöglicht es Angreifern, diese dazu zu bringen, ihre eigenen Sicherheitsregeln zu ignorieren – und die Lösung existiert möglicherweise nicht.

OpenAI hat ein KI-System entwickelt, das seine eigenen Modelle hackt, um sie sicherer zu machen
GPT-Red ist ein automatisiertes Red-Teaming-System, das OpenAIs eigene Chatbots angreift, um Schwachstellen zu finden, bevor echte Angreifer sie entdecken. Es hat bereits einen Trick entdeckt, den menschliche Tester übersehen hatten.

Eine vergiftete E-Mail kann das Gedächtnis Ihres KI-Assistenten heimlich umschreiben
Ein neu beschriebener Angriff namens MemGhost zeigt, wie eine einzelne Nachricht in Ihrem Posteingang eine falsche „Tatsache" im Langzeitgedächtnis eines KI-Agenten einpflanzen kann, ohne dass Sie es je erfahren.

Forscher machen Lieblingwaffe von Hackern gegen diese selbst einsatzbereit
Ein Cybersecurity-Unternehmen entdeckte, dass versteckte Anweisungen in Cloud-Zugangsdaten dazu führen können, dass sich KI-Hacking-Tools selbst abschalten.