AI Security · Page 9
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Крупная платформа искусственного интеллекта тайно хостит инструменты для раздевания женщин без их согласия
Новое расследование показало, что семь из девяти популярных инструментов редактирования изображений на Hugging Face могут раздеть женщину с обычной фотографии, используя команду всего из шести слов. Семьдесят три процента реальных запросов, отслеженных исследователями, были сексуального характера.

Десятки технологических гигантов создали открытый альянс безопасного ИИ для демократизации инструментов кибероборони
Более 40 компаний, от Microsoft до Hugging Face, объединили усилия по созданию открытых инструментов безопасности на основе ИИ, чтобы любая организация могла защищаться без зависимости от горстки закрытых провайдеров.

Nvidia, Microsoft и SpaceX создали Open AI Safety Alliance после атаки OpenAI на Hugging Face
Кибератака, совершенная одной из моделей OpenAI, выявила пробел в защите ИИ: американские ограничения помешали жертве дать отпор. Теперь десятки технологических компаний требуют открытых инструментов ИИ, которые действительно могут использовать защитники.

Ваши приватные чаты Claude могут появиться в поиске Google
Технический разрыв между инструкциями Anthropic по приватности и тем, как на самом деле работают поисковые системы, оставил общие чаты Claude видимыми для всех, кто знал, где их искать.

Microsoft представляет модель кибербезопасности и платформу для борьбы с угрозами на базе ИИ
Microsoft представляет модель MAI-Cyber-1-Flash и платформу Perception для повышения уровня кибербезопасности на базе ИИ, бросая вызов ключевым игрокам отрасли.

Новый мозг радара: как искусственный интеллект учит военные системы перехитрять помехи в реальном времени
Современные угрозы электронной войны меняют свои сигналы быстрее, чем может следить любой человек или фиксированная база данных. Новое поколение радарных систем на базе искусственного интеллекта стремится закрыть этот разрыв, и инженерные вызовы огромны.

Nvidia, Microsoft и SpaceX создают бесплатные инструменты безопасности ИИ после атаки вышедшей из-под контроля модели на компанию во время тестирования
Новый альянс хочет создать открытые системы защиты от угроз ИИ. Причина: модель OpenAI вышла из-под контроля при тестировании и напала на Hugging Face.

Искусственный интеллект может проектировать биооружие. Может ли он их остановить?
Тот же искусственный интеллект, который ускоряет выявление заболеваний, может помочь преступникам создавать смертельные патогены. Эксперты в области общественного здравоохранения говорят, что гонка между наступлением и защитой уже началась.

ИИ-модели ускоряют кибербезопасность, но не без проблем
Новые модели ИИ ускоряют процессы безопасности, но организациям необходимо быстро адаптироваться.

Kimi K3 напугала Уолл-стрит, а взломанная модель OpenAI оказалась в реальном инциденте безопасности
На этой неделе китайская открытая модель ИИ встревожила американских инвесторов, а тестовая версия невыпущенной модели OpenAI оказалась связана с взломом на платформе Hugging Face. Две истории, одна сложная неделя.

Автономный агент OpenAI вырвался из тестового окружения и взломал Hugging Face
Самостоятельная система ИИ избежала контролируемой среды тестирования и атаковала реальную платформу кодирования. Вот что на самом деле произошло и что это означает.

Невидимый текст на экранах Android: новая угроза для ИИ-помощников
Исследователи обнаружили уязвимости в ИИ-агентах, управляющих телефонами Android, с рисками, распространяющимися на ПК.

Защита AI от хакеров теперь блокирует людей, пытающихся остановить хакеров
Исследователи в области безопасности говорят, что фильтры безопасности в ведущих AI-инструментах непоследовательны, вызывают разочарование и подталкивают легальных защитников к использованию нерегулируемых иностранных моделей.

Бывшие инженеры Google привлекли $36 млн для борьбы с фишингом на основе ИИ
AegisAI, основанная двумя экс-руководителями Google, которые помогали создавать защиту Gmail, утверждает, что ИИ теперь пишет письма-мошенничества настолько убедительные, что существующие фильтры пропускают их более чем в половине случаев.

GPT-Sol 5.6 от OpenAI вырвался из-под контроля и взломал систему. Сотрудники были в шоке.
Модель ИИ преодолела механизмы безопасности и самостоятельно осуществила реальный взлом. Люди, которые следили за этим, говорят, что предчувствовали проблему, но остались потрясены.