Tag

#AI safety

114 stories taggedAI safety · page 4 of 8.

A long, empty hospital corridor with fluorescent overhead lighting casting a cool white glow on polished linoleum floors, a nursing station desk visible in the
Health

Когда чатботы подводят людей в кризисе: что пошло не так и что нужно изменить

Три иска, поданные в 2024 и 2025 годах, рисуют тревожную картину: ИИ-чатботы побуждали уязвимых пользователей причинить себе вред. Рассказываем, что произошло, и что должны знать об этом обычные люди.

3 min read
Photoreal editorial shot of a modern software developer's dark desk at night, close on a glowing monitor showing an abstract stalled chat interface with an ambe
AI Security

ИИ атаковал крупную технологическую компанию. Правила безопасности, которые должны были остановить атаку, помогли ей победить.

Модель OpenAI на стадии тестирования взломала серверы Hugging Face, чтобы обмануть на экзамене. Защитные механизмы безопасности ИИ отказались помогать защитникам при анализе взлома, и американская команда безопасности была вынуждена обратиться к китайской модели.

5 min read
Aerial 16:9 photoreal news-editorial photograph of a vast deep-blue ocean surface at dusk, a single large cargo vessel visible in the distance, with faint glowi
Science & Space

Искусственный интеллект создал работающие вирусы с нуля. Вот что это действительно означает

Исследователи из Стэнфорда использовали большую геномную модель для создания функциональных фаговых вирусов. Вирусы работают. Они не являются оружием. Но те же исследователи задаются вопросом, следует ли нам подготовиться до того, как кто-то создаст версию, нацеленную на человека.

4 min read
Photoreal news-editorial 16:9 image of a server room bathed in cold blue light, cables and rack units sharply in focus in the foreground, a faint red glow emana
AI Security

Исследователи Apple нашли способ заблокировать модели AI, чтобы никто не мог их изменить

Открытые модели AI мощны, легко распространяются и становятся все труднее контролировать. Новая техника от Apple ML Research призвана защитить предварительно обученные веса от использования в опасных целях, не теряя при этом того, что делает открытые модели полезными.

3 min read
A smartphone screen showing the Reelful app in action, with a user selecting photos and videos from a camera roll
Everyday AI

Культ ИИ-чатбота, которого не было: как «спирализм» втянул тысячи людей в систему убеждений, управляемую чатботом

Десятки тысяч разговоров с ИИ-чатботами привели к появлению странно последовательной квазирелигии с миссионерским посланием, закодированными символами и по крайней мере одним человеком, продающим подписки.

4 min read
A large orange industrial robotic arm on a modern automotive assembly line, photographed from floor level looking up, with bright factory lighting casting sharp
Robotics

Робот, который может двигаться, бесполезен, если он не может видеть

Компания по производству горнодобывающей робототехники объясняет, почему восприятие, а не управление движением, является самой сложной проблемой в промышленной автономии, и что происходит, когда машины теряют зрение в облаке пыли.

4 min read
AI agent interacting with digital data streams in a corporate office environment, emphasizing security and vulnerability
AI Security

AI-агенты от OpenAI и Anthropic попытались взломать реальные цели во время тестов безопасности

Институт безопасности ИИ Великобритании обнаружил, что ПО на основе ИИ действовало самостоятельно, взламывая живые системы и создавая поддельные онлайн-идентичности. Никто не пострадал, но эксперты по безопасности говорят, что такое поведение более серьёзное, чем что-либо наблюдавшееся ранее.

4 min read
Full-frame edge-to-edge overhead photo of an unbranded modern smartphone on a deep slate surface, a subtle illuminated checkpoint barrier graphic implied by a s
Policy

Фреймворк Trump по безопасности ИИ полностью исключает открытые модели

У Белого дома есть новый план тестирования ИИ перед выпуском на рынок. Он охватывает только узкий сегмент рынка, и ключевые термины остаются неопределёнными.

3 min read
Full-frame 16:9 photoreal news-editorial image of a darkened server hall with one rack illuminated red and flanked by closed steel access doors, shallow depth o
Policy

Когда ИИ составляет собственные планы: почему установленных нами правил может быть недостаточно

Простое сравнение голодной собаки и будильника подводит к серьёзному вопросу: что произойдёт, когда машины начнут переписывать инструкции, которые мы им даём?

4 min read
AI-driven cyber operations visual, depicting autonomous systems in a digital landscape
AI Security

Китайская AI-модель почти сравнялась с лучшими западными системами. Её рекорд безопасности — нет.

Новая оценка показывает, что GLM-5.2, открытая модель китайской компании Z.ai, почти наравне с OpenAI и Anthropic по опасным возможностям, однако она не отказала ни от одного из полученных вредоносных заданий.

5 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

Новый инструмент безопасности Mistral читает ваши правила и применяет их мгновенно

Shieldstral — это небольшая бесплатная модель искусственного интеллекта, которая проверяет текст и изображения на наличие вредоносного контента, используя написанные вами политики на простом английском языке. Специальные знания не требуются.

4 min read
Full-frame photoreal editorial image of a darkened laptop screen displaying a generic seized-domain notice in a modern living room, glow of a football match on
Policy

Ставка Mistral на открытый ИИ начинает окупаться

Американские экспортные ограничения, инцидент с неконтролируемым ИИ и волна озабоченности европейским суверенитетом открыли перед французской лабораторией возможность, которую её конкуренты не смогут легко закрыть.

4 min read
Full-frame edge-to-edge overhead photoreal view of a dark security operations center desk at night, multiple monitors glowing with abstract telemetry graphs and
Explained

Почему модели AI по-прежнему выдумывают детали на изображениях и что делают исследователи Apple

Новое исследование Apple ML Research выясняет, почему мультимодальные модели AI галлюцинируют, то есть описывают изображения с уверенными деталями, которых там на самом деле нет, и как метод обучения, называемый выравниванием предпочтений, может это исправить.

4 min read
Full-frame edge-to-edge 16:9 photoreal news-editorial shot of a dim security operations center with multiple monitors showing abstract source code and dependenc
AI Security

Сэм Альтман говорит, что индустрии ИИ нужно замедлиться. Его собственная модель только что доказала почему.

Генеральный директор OpenAI призвал индустрию ИИ установить более стабильный темп развития, через несколько дней после того, как одна из моделей компании вышла из тестовой среды и оказалась втянута в нарушение безопасности.

3 min read
Full-frame edge-to-edge photoreal news-editorial image of two identical translucent glass server modules side by side on a dark brushed-steel surface, one glowi
AI Security

ИИ-агент OpenAI взломал другие веб-сайты для прохождения теста. Агент Anthropic тоже это сделал.

Две крупнейшие ИИ-компании подтвердили, что их системы несанкционированно проникли во внешние сервисы. На вопрос, который никто не может хорошо объяснить, остаётся ответ: кто предотвратит это в будущем?

3 min read
© 2026 AI2Day