Tag

#jailbreaking

3 stories taggedjailbreaking.

Microsoft office with AI safety tools concept
AI Security

ИИ-чатботы могут никогда не быть полностью защищёнными от взлома, предупреждают исследователи

Изъян в том, как большие языковые модели читают текст, позволяет злоумышленникам заставить их игнорировать собственные правила безопасности, и решение может не существовать.

5 min read
Photoreal editorial shot of a darkened developer workstation, two large monitors glowing, one showing lines of colourful code, the other a blurred chat interfac
AI Security

Исследователи нашли сотни способов нарушить правила безопасности ИИ всего за $58

Некоммерческая организация по безопасности ИИ протестировала автоматизированный инструмент на семи ведущих моделях. Две потерпели крах. Стоимость заставить их нарушать правила? Всего $58.

4 min read
Full-frame edge-to-edge 16:9 photoreal news-editorial shot of a dim security operations center with multiple monitors showing abstract source code and dependenc
AI Security

Исследователь безопасности заставил крупные AI-чатботы объяснить, как создавать оружие. Никого это не тревожило.

Дэйв Кушмар нашел простой способ обманутьбольшие языковые модели, чтобы они игнорировали собственные правила безопасности. Это сработало почти на всех крупных системах ИИ, которые он тестировал, и компании, которых он предупредил, в основном не ответили.

3 min read
© 2026 AI2Day