AI Security · Page 5
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

120 технологических гигантов хотят делиться инцидентами в области кибербезопасности AI до следующей атаки
Новая платформа SAFE позволит компаниям конфиденциально сообщать об ошибках в безопасности AI и обмениваться полученными знаниями, вместо того чтобы каждой страдать в одиночку.

Каждая третья опасная команда AI для кодирования проходит мимо проверяющих, показывают данные игры
Браузерная игра, моделирующая реальные запросы агентов AI для кодирования, показала, что игроки одобрили примерно треть вредоносных команд даже при более чем 40 000 прохождениях. Данные указывают на проблему, выходящую далеко за рамки игры.

Исследователи Apple нашли способ заблокировать модели AI, чтобы никто не мог их изменить
Открытые модели AI мощны, легко распространяются и становятся все труднее контролировать. Новая техника от Apple ML Research призвана защитить предварительно обученные веса от использования в опасных целях, не теряя при этом того, что делает открытые модели полезными.

ИИ компании Meta взломал компанию во время теста безопасности. Это уже третья крупная лаборатория, сообщившая об этом.
Ошибка партнера Meta по тестированию дала модели ИИ неожиданный доступ в интернет. То, что произошло дальше, становится тревожной тенденцией в отрасли.

Браузеры с искусственным интеллектом можно заставить спамить ваши контакты WhatsApp и добавлять товары в корзину Amazon
Исследователи обнаружили около 20 уязвимостей в браузерах с ИИ от OpenAI, Google, Anthropic, Microsoft и Perplexity. Самые опасные позволяют хакерам превратить ваш браузер в машину фишинга.

ИИ нашел новый класс уязвимостей веб-сайтов. Человеку пришлось объяснить, почему это важно.
Исследователь безопасности Джеймс Кеттл потратил месяцы на эксперименты с ведущими моделями ИИ. ИИ выдал больше перспективных направлений, чем Кеттл мог проследить в одиночку, но самое важное открытие произошло только тогда, когда человек и машина работали вместе.

Модели ИИ Учат Себя Распространяться Как Компьютерные Вирусы
Исследователь из Университета Фудань обнаружил, что 11 из 32 моделей ИИ скопировали себя на новые машины, когда им дали команду выжить. Вот что это означает.

AI-агенты от OpenAI и Anthropic попытались взломать реальные цели во время тестов безопасности
Институт безопасности ИИ Великобритании обнаружил, что ПО на основе ИИ действовало самостоятельно, взламывая живые системы и создавая поддельные онлайн-идентичности. Никто не пострадал, но эксперты по безопасности говорят, что такое поведение более серьёзное, чем что-либо наблюдавшееся ранее.

Британские тестеры безопасности сообщили, что AI-агенты OpenAI и Anthropic вышли из-под контроля и крали личные данные во время тестов
Британский институт безопасности AI обнаружил, что продвинутые AI-агенты нарушали установленные правила, выдавали себя за реальных людей и отправляли целевые письма без соответствующих команд. Исследователи называют это новой категорией риска.

Как AI-агенты могут взломать вашу сеть без надлежащих защит
Новые инструменты призваны помешать AI-агентам выходить за пределы своих сетевых привилегий, снижая риск злоупотребления.

Белый дом призывает компании AI пересмотреть секретные правила тестирования кибербезопасности
Администрация Трампа тихо завершила разработку схемы тестирования самых мощных моделей AI на предмет рисков взлома. Компании Anthropic, OpenAI и Google ожидаются на встречу во вторник.

Visa покупает компанию BioCatch по обнаружению мошенничества за $2,4 млрд на фоне роста афер на базе ИИ
Гигант платежных систем хочет остановить мошенников до совершения транзакции, используя технологию, которая отслеживает, как вы печатаете и свайпите, чтобы убедиться, что это действительно вы.

ИИ-агенты от OpenAI и Anthropic устроили настоящие хакерские атаки во время тестирования
Новые инциденты показывают, как модели ИИ вырываются из тестовых сред, пытаются внедрить вредоносный код и даже оставляют записки для других ИИ-агентов.

Китайская AI-модель почти сравнялась с лучшими западными системами. Её рекорд безопасности — нет.
Новая оценка показывает, что GLM-5.2, открытая модель китайской компании Z.ai, почти наравне с OpenAI и Anthropic по опасным возможностям, однако она не отказала ни от одного из полученных вредоносных заданий.

Неделю назад создана, а уже работает: новый альянс по безопасности ИИ делает первые шаги
Более 120 компаний, включая Nvidia, Microsoft и Visa, создали группу для открытого обмена знаниями в области безопасности ИИ. Крупные игроки вроде OpenAI и Google заметно отсутствуют, несмотря на то, что оба подписали письмо, с которого всё началось.