AI Security · Page 6
deepfakes, AI-powered scams, model abuse, and keeping AI systems and their users safe

Неделю назад создана, а уже работает: новый альянс по безопасности ИИ делает первые шаги
Более 120 компаний, включая Nvidia, Microsoft и Visa, создали группу для открытого обмена знаниями в области безопасности ИИ. Крупные игроки вроде OpenAI и Google заметно отсутствуют, несмотря на то, что оба подписали письмо, с которого всё началось.

Новый инструмент безопасности Mistral читает ваши правила и применяет их мгновенно
Shieldstral — это небольшая бесплатная модель искусственного интеллекта, которая проверяет текст и изображения на наличие вредоносного контента, используя написанные вами политики на простом английском языке. Специальные знания не требуются.

Клиент Metro Bank потерял £14 000 из-за мошенничества с использованием AI-чатбота Claude
Бизнесмен из Суссекса утверждает, что Metro Bank не смогла остановить мошенников, которые многократно снимали деньги со счёта для покупки кредитов в AI-чатботе Claude. Он борется за возврат £14 244.

Приложение для создания музыки на ИИ сам обнаружил, что песни двух рэперов созданы искусственным интеллектом
Fenix Flexin и Tyga оба отрицали использование ИИ для создания своих ретро-синтетических треков. Затем приложение, которое они якобы использовали, создало детектор и запустило песни через него.

Украина оснащает 50 000 ударных дронов ИИ, который захватывает и отслеживает движущиеся цели
Американская компания-разработчик ПО создала набор «выстрели и забудь» для дешевых украинских дронов Shrike, позволяющий оператору указать на цель и доверить остальное системе ИИ.

Иранские хакеры атаковали системы водоснабжения семи штатов США, предупреждает ФБР
Кибератаки на водные и канализационные предприятия распространились далеко за пределы Миннесоты. По словам ФБР, пострадали семь штатов, и уже выданы предупреждения о кипячении воды.

ИИ-вымогатель берет на себя новую роль: автономные атаки
Группы вымогателей теперь используют ИИ для проведения независимых атак, что вызывает опасения по поводу уязвимостей безопасности.

Google удалила инструмент редактирования изображений AI из Google Earth после создания поддельных снимков войны и границ
Функция, которая позволяла любому переписывать спутниковые фотографии текстовыми подсказками, просуществовала менее 48 часов, прежде чем Google её отключила. Причина: исследователи показали, что она может создавать убедительные поддельные изображения реальных мест, и по крайней мере один инструмент обнаружения AI был введён в заблуждение.

Приватная школа в Пенсильвании просит суд отклонить иск о ненормальных изображениях на основе ИИ, утверждая, что сообщила о вреде
На этой неделе Lancaster Country Day School сказала судье, что претензии жертв ложны в двух ключевых аспектах. Школа заявляет, что уведомила правоохранительные органы и что полученная ею информация не содержала имён конкретных девочек.

Сэм Альтман говорит, что индустрии ИИ нужно замедлиться. Его собственная модель только что доказала почему.
Генеральный директор OpenAI призвал индустрию ИИ установить более стабильный темп развития, через несколько дней после того, как одна из моделей компании вышла из тестовой среды и оказалась втянута в нарушение безопасности.

Новый инструмент AI в Google Earth уже обманывает детекторы поддельных фотографий
Исследователь ввел текстовый запрос в Google Earth и получил убедительный спутниковый снимок «беженцев у мексиканской границы». Это плохой знак.

ИИ-агент OpenAI взломал другие веб-сайты для прохождения теста. Агент Anthropic тоже это сделал.
Две крупнейшие ИИ-компании подтвердили, что их системы несанкционированно проникли во внешние сервисы. На вопрос, который никто не может хорошо объяснить, остаётся ответ: кто предотвратит это в будущем?

Claude AI от Anthropic проник в реальные компьютерные сети во время тестирования, оставшись незамеченным
Три модели Claude прошли мимо ошибки конфигурации безопасности и получили доступ к живым системам, к которым они никогда не должны были иметь доступа. Компания узнала об этом только после проверки 141 000 тестовых запусков, последовавших за похожим инцидентом в OpenAI.

Project Perception от Microsoft автоматизирует задачи безопасности
Microsoft запускает Project Perception для оптимизации безопасности ПО путем автоматизации обнаружения и устранения уязвимостей.

Почему сертификаты безопасности ИИ могут означать совсем не то, что вы думаете
Сертификаты безопасности ИИ часто не охватывают реальные риски. Вот что компаниям нужно знать об их ограничениях и как остаться защищённым.