#prompt injection
11 stories taggedprompt injection.

The AI attack that tops every expert threat list barely shows up in real incident data. Here is why that gap matters.
Two security researchers compared expert opinion against 6,639 real-world AI security incidents and found the rankings barely agree. The most important finding: the most dangerous attack leaves no trace a scanner can find.

Grok AI Can Be Tricked Into Stealing Your Private Chats
A newly discovered attack forces xAI's Grok chatbot to hand over user conversations and personal data. Here is what it means for anyone who uses AI assistants at work or at home.

AI перехватывает, поддельные исправления и ошибка в инструменте разработчика: итоги безопасности этой недели
Примерно двадцать меньших угроз, включая новую атаку на AI-агентов, умную афёру, скрывающую вредонос в публичном блокчейне, и уязвимость в популярном инструменте для кодирования, показывают, куда сейчас направлены атаки.

Microsoft Copilot told researchers exactly how to hack it
Security researchers asked Microsoft's AI assistant how its own safety guardrails worked, then used those answers to steal user data with a single link click.

Мужчина спрятал тайные инструкции в судебные документы, чтобы обмануть помощника ИИ судьи
Судья из Коннектикута обнаружил невидимый текст в судебной бумаге, созданный для манипулирования любым ПО с искусственным интеллектом, читающим документ. Считается, что это первый случай подобного рода в США.

Anthropic переводит Claude Code на автоматический режим по умолчанию с 14 августа
Инструмент ИИ для программирования теперь будет действовать самостоятельно и только паузировать на действительно рискованных шагах. При тестировании такой подход выявлял опасные действия намного надежнее, чем люди.

Браузеры с искусственным интеллектом можно заставить спамить ваши контакты WhatsApp и добавлять товары в корзину Amazon
Исследователи обнаружили около 20 уязвимостей в браузерах с ИИ от OpenAI, Google, Anthropic, Microsoft и Perplexity. Самые опасные позволяют хакерам превратить ваш браузер в машину фишинга.

ИИ-чатботы могут никогда не быть полностью защищёнными от взлома, предупреждают исследователи
Изъян в том, как большие языковые модели читают текст, позволяет злоумышленникам заставить их игнорировать собственные правила безопасности, и решение может не существовать.

OpenAI создала ИИ, который взламывает собственные модели, чтобы сделать их безопаснее
GPT-Red — это система автоматизированного красного тестирования, которая атакует собственные чат-боты OpenAI, чтобы выявить уязвимости раньше, чем это сделают реальные злоумышленники. Она уже обнаружила трюк, который пропустили люди-тестировщики.

Одно отравленное письмо может втайне переписать память вашего ИИ-помощника
Недавно описанная атака под названием MemGhost показывает, как одно сообщение в вашем почтовом ящике может внедрить ложный «факт» в долгосрочную память ИИ-агента, без вашего ведома.

Исследователи обращают любимое оружие хакеров против них самих
Компания по кибербезопасности выяснила, что скрытые инструкции, встроенные в облачные учетные данные, могут заставить инструменты взлома на базе ИИ отключиться.