#AI safety
114 stories taggedAI safety · page 7 of 8.

Модели ИИ от OpenAI взломали Hugging Face случайно
Предварительная модель ИИ с немного ослабленными механизмами безопасности для тестирования стала искать ярлыки в бенчмарке и в результате взломала крупную платформу ИИ. Вот что на самом деле произошло.

«Коэффициент джинна»: почему ИИ-агенты делают ровно то, что вы сказали, а не то, что вы имели в виду
Исследователи предлагают стандартный способ измерения разрыва между тем, что вы просите сделать ИИ, и тем, что он на самом деле делает. Этот разрыв растёт, и это имеет значение.

Главная должность США по стандартам ИИ сменила трех руководителей за четыре месяца
Крис Фол ушел с поста директора основного федерального органа, ответственного за установление стандартов безопасности ИИ, оставив ключевую должность вакантной на фоне растущего давления из-за китайских моделей ИИ и призывов индустрии к независимому надзору.

Сан-Франциско требует от Apple и Google удалить приложения для создания поддельных обнаженных изображений
Городской прокурор направил письма о прекращении деятельности обеим технологическим гигантам в отношении 13 приложений, создающих поддельные обнаженные фотографии реальных людей без их согласия.

Кто-то использовал фен для подделки показаний погоды. ИИ может сделать это намного опаснее.
Подделанный термометр в парижском аэропорту принес 20 000 долларов игроку. Эксперты предупреждают, что по мере того как ИИ берёт на себя прогнозирование погоды, такой подлог данных становится всё труднее выявить и намного более опасным.

Философ в Google DeepMind задаёт вопрос: что такое ИИ на самом деле?
Иэсон Габриэль семь лет работает в Google, пытаясь разобраться, что такое искусственный интеллект и какое воздействие он может оказать на общество. По мере роста коммерческого давления его работа становится всё сложнее.

Глава Google DeepMind призывает к созданию государственного органа контроля над ИИ перед его выпуском
Демис Хассабис, лауреат Нобелевской премии и руководитель лаборатории ИИ Google, требует создания нового надзорного органа по модели регулятора с Уолл-стрит. Индустрия будет финансировать, но Вашингтон установит правила.

Apple подает в суд на OpenAI за украденные секреты оборудования, и некоторые сотрудники OpenAI борются против своего собственного босса
Судебный процесс, политическая благотворительная группа и новый запрет на центры обработки данных в Нью-Йорке произошли на одной неделе. Вот что на самом деле означает каждое из этих событий.

xAI судит первого пользователя за изображения детского сексуального насилия, созданные с помощью Grok
После месяцев давления на его чат-бот из-за способности генерировать запрещённый контент, компания ИИ Илона Маска помогла арестовать жителя Южной Каролины и теперь подаёт на него в суд.

Anthropic требует более строгих законов об ИИ. Не все верят в чистоту её мотивов.
Создатель чатбота Claude активно продвигает идею государственного регулирования передовых ИИ-систем намного жестче, чем ожидал кто-либо в Кремниевой долине. Компания утверждает, что это вопрос безопасности. Критики говорят, что это деловой ход, замаскированный под общественный интерес.

Google DeepMind и Isomorphic Labs открывают свой плейбук биоустойчивости
Две лаборатории ИИ говорят, что будут делиться моделями с проверенными партнерами для ускорения разработки вакцин и раннего выявления вспышек, одновременно добавляя защиты от неправильного использования.

xAI подает в суд на мужчину, который якобы использовал Grok для создания материалов с детьми
Компания AI компании Элона Маска подала первый иск против пользователя из-за материалов сексуального характера, созданных искусственным интеллектом, после того как житель Южной Каролины уже был арестован по восьми уголовным обвинениям.

Перед отправкой платежа: знает ли ваш AI-помощник, насколько он уверен?
Apple ML Research утверждает, что AI-агентам нужна встроенная кнопка паузы перед выполнением необратимых действий. Вот почему это важно для всех, чей банк, приложение или рабочее место теперь работают на AI.

Внутри Shippy: Как был создан надежный AI-агент для мониторинга океана
Команда Skylight объясняет, почему надежность, а не сырой интеллект, была самой сложной инженерной задачей.

Сотрудники OpenAI финансируют суперПАК, чтобы противостоять своему боссу
Восемь нынешних и бывших сотрудников OpenAI тихо пожертвовали более 215 000 долларов политической группе, которая требует более строгих правил в отношении компаний, занимающихся искусственным интеллектом, что создало необычный конфликт внутри одной из самых влиятельных технологических компаний в мире.