Tag
#red teaming
3 stories taggedred teaming.

AI Security
A startup is selling stripped-down AI with no guardrails. Anyone can sign up for free.
Abliteration.ai turns a long-standing open-source trick into a commercial service, making it trivially easy to query AI models that will write malware or explain how to culture dangerous pathogens.
4 min read

AI Security
ИИ-чатботы могут никогда не быть полностью защищёнными от взлома, предупреждают исследователи
Изъян в том, как большие языковые модели читают текст, позволяет злоумышленникам заставить их игнорировать собственные правила безопасности, и решение может не существовать.
5 min read

AI Security
OpenAI создала ИИ, который взламывает собственные модели, чтобы сделать их безопаснее
GPT-Red — это система автоматизированного красного тестирования, которая атакует собственные чат-боты OpenAI, чтобы выявить уязвимости раньше, чем это сделают реальные злоумышленники. Она уже обнаружила трюк, который пропустили люди-тестировщики.
4 min read