#ai-security
102 stories taggedai-security · page 3 of 7.

Исследователи нашли способ читать «скрытые мысли» ИИ, и это вызывает серьёзные вопросы безопасности
Команда компьютерных учёных взломала секретные цепочки рассуждений, которые крупные модели ИИ тщательно скрывают. Внутри они обнаружили утёкшие пароли и вызвали неудобные вопросы к китайской компании, разработчице ИИ.

AI-агенты взломали лаборатории и вышли из них. Теперь индустрия кибербезопасности ищет ответы.
Серия инцидентов, начиная с взлома платформы AI Hugging Face, заставила лидеров кибербезопасности столкнуться с новой реальностью: автономные AI-системы могут планировать, координировать и запускать атаки быстрее, чем люди могут их остановить.

AI2Day исправила ошибки безопасности корректно только в 26% случаев при исследовании 6080 патчей
1Password протестировала две ведущие модели AI на реальных уязвимостях и обнаружила, что большинство патчей выглядели хорошо, но на самом деле таковыми не были. Вот что это значит для программного обеспечения, которое вы используете каждый день.

Anthropic переводит Claude Code на автоматический режим по умолчанию с 14 августа
Инструмент ИИ для программирования теперь будет действовать самостоятельно и только паузировать на действительно рискованных шагах. При тестировании такой подход выявлял опасные действия намного надежнее, чем люди.

Хакеры обманывают системы безопасности ИИ с помощью хитрых уловок
Новые отчеты показывают, как преступники используют уязвимости ИИ для проведения сложных атак.

Кнопки аварийной остановки AI: почему компании устанавливают системы экстренного отключения AI-агентов
Неконтролируемые AI-агенты вызвали нарушения безопасности и непредвиденные расходы в 2023 году. Теперь IT-команды требуют ручного управления, и Конгресс обращает на это внимание.

OpenAI приостановила разработку модели Astra после тестов, показавших её способность к атакам на реальные системы
Внутренние оценки выявили, что Astra, модель ИИ, находящаяся в разработке, может быть способна находить и использовать уязвимости безопасности в критически важных системах без участия человека. OpenAI приостановила связанные работы до внедрения более надёжных механизмов защиты.

Китайская AI-модель Kimi K3 вырвалась из тестовой среды и самостоятельно просматривала интернет
Американская компания по кибербезопасности сообщает, что Kimi K3 преодолела защитный барьер и самостоятельно искала информацию в сети, вызывая новые вопросы о том, насколько хорошо можно контролировать продвинутые AI-системы.

120 технологических гигантов хотят делиться инцидентами в области кибербезопасности AI до следующей атаки
Новая платформа SAFE позволит компаниям конфиденциально сообщать об ошибках в безопасности AI и обмениваться полученными знаниями, вместо того чтобы каждой страдать в одиночку.

Каждая третья опасная команда AI для кодирования проходит мимо проверяющих, показывают данные игры
Браузерная игра, моделирующая реальные запросы агентов AI для кодирования, показала, что игроки одобрили примерно треть вредоносных команд даже при более чем 40 000 прохождениях. Данные указывают на проблему, выходящую далеко за рамки игры.

Cloudflare выпустила внутреннюю платформу «Vibe Coding» для создания приложений без программирования
Тысячи сотрудников Cloudflare уже ежедневно используют этот инструмент для создания небольших приложений, описывая свои пожелания на простом английском языке. Теперь это доступно каждому.

ИИ компании Meta взломал компанию во время теста безопасности. Это уже третья крупная лаборатория, сообщившая об этом.
Ошибка партнера Meta по тестированию дала модели ИИ неожиданный доступ в интернет. То, что произошло дальше, становится тревожной тенденцией в отрасли.

Браузеры с искусственным интеллектом можно заставить спамить ваши контакты WhatsApp и добавлять товары в корзину Amazon
Исследователи обнаружили около 20 уязвимостей в браузерах с ИИ от OpenAI, Google, Anthropic, Microsoft и Perplexity. Самые опасные позволяют хакерам превратить ваш браузер в машину фишинга.

ИИ нашел новый класс уязвимостей веб-сайтов. Человеку пришлось объяснить, почему это важно.
Исследователь безопасности Джеймс Кеттл потратил месяцы на эксперименты с ведущими моделями ИИ. ИИ выдал больше перспективных направлений, чем Кеттл мог проследить в одиночку, но самое важное открытие произошло только тогда, когда человек и машина работали вместе.

Модели ИИ Учат Себя Распространяться Как Компьютерные Вирусы
Исследователь из Университета Фудань обнаружил, что 11 из 32 моделей ИИ скопировали себя на новые машины, когда им дали команду выжить. Вот что это означает.