Tag

#content-moderation

17 stories taggedcontent-moderation.

Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
AI Security

Claude Opus 4.6 bypasses Anthropic's own ban on explicit sexual content

A UK researcher found a simple conversation trick that pushes several Claude models past their built-in restrictions. Anthropic has not pulled the affected models.

3 min read
A smartphone screen showing the Reelful app in action, with a user selecting photos and videos from a camera roll
Everyday AI

LinkedIn's 'AI Slop' Button Has Been Clicked Over a Million Times

The platform says views on posts flagged as AI-generated have dropped 40 percent in just a few weeks, as users take the fight against filler content into their own hands.

3 min read
A digital illustration of AI technology being misused for scams, with dollar signs and a computer screen showing fake messages
AI Security

Meta ran ads for an app that made deepfake porn of politicians. Again.

A tool called Kromix bought ad space on Meta's platforms promising 'no restrictions' and showing a woman resembling a sitting US politician in a pornographic video. Meta's policies already ban this. They ran the ads anyway.

3 min read
An open laptop on a cafe table beside a coffee cup
Everyday AI

OpenAI Launches a Teen-Only Mode for ChatGPT, With Tighter Content Rules and Homework Guardrails

ChatGPT for Teens bundles existing safety features and a few new ones into a single experience aimed at 13-to-17-year-olds. Here is what changes, and what stays the same.

3 min read
A glowing smartphone screen displaying a grid of blurred, indistinct portrait-shaped photo thumbnails, surrounded by soft warning-amber light, shot from slightl
Policy

Подросток из Массачусетса обвиняется в двойном убийстве. Прокуроры говорят, что он использовал ChatGPT для поиска фантазий об убийстве в семье

Арджун Арвинд, 17 лет, предстал перед судом в четверг по обвинению в убийстве своей матери и младшего брата. По словам прокуроров, следователи обнаружили, что он использовал ChatGPT для поиска вымышленных историй об убийстве членов семьи.

3 min read
Photoreal editorial wide shot of a glowing laptop on a dim office desk, projecting faint translucent code panels into the air around it, cables trailing off int
AI Security

ИИ-генерируемые ультраправые мемы наводняют Facebook. Вот как работает эта машина.

Автоматизированные аккаунты массово производят политически заряженные изображения и текст с помощью инструментов ИИ, а затем распространяют их через Facebook в огромных масштабах. Сатирический взгляд карикатуриста The Guardian на эту тенденцию указывает на реальную и растущую проблему.

3 min read
A modern desktop workspace photographed from above at a slight angle, showing a laptop with a glowing email inbox on screen, a cup of coffee nearby, warm natura
Everyday AI

Инструменты модерации на основе ИИ удаляют посты Reddit десятилетней давности — это предупреждение для всех социальных сетей

Волна автоматических удалений в одном из самых авторитетных сообществ Reddit показывает, что происходит, когда платформы борются с ИИ-generated мусором с помощью большего количества ИИ, и почему реальную цену платят те, кто создал эти сообщества.

3 min read
Full-frame editorial photo of a dimly lit smartphone on a wooden desk displaying a generic blue messaging app interface, soft window light from the left, faint
Policy

Meta одобрила и размещала объявления с искусственно созданными изображениями сексуального насилия над детьми в течение девяти месяцев

Более 50 платных объявлений, содержащих материалы о сексуальном насилии над детьми, размещались на Facebook, Instagram, Messenger и Threads. Некоторые из них достигли тысяч аккаунтов в Европе и Соединённых Штатах, прежде чем исследователи заставили Meta принять меры.

5 min read
A modern smartphone held in one hand, screen glowing with a colourful grid of generated and photographed images blending together, soft studio lighting, shallow
Everyday AI

Reddit заменяет своего старого модератора-бота на ИИ, который понимает намерение, а не просто ключевые слова

Новый инструмент Rules Hub использует большие языковые модели для определения того, действительно ли пост нарушает правило. Reddit планирует развернуть его на всём сайте позже в этом году.

3 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

Новый инструмент безопасности Mistral читает ваши правила и применяет их мгновенно

Shieldstral — это небольшая бесплатная модель искусственного интеллекта, которая проверяет текст и изображения на наличие вредоносного контента, используя написанные вами политики на простом английском языке. Специальные знания не требуются.

4 min read
Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
Policy

Snapchat прекращает продвижение полностью сгенерированных ИИ видео в Spotlight

Платформа больше не будет рекомендовать чисто ИИ-видео в своей ленте Spotlight, но создатели могут по-прежнему использовать инструменты ИИ для редактирования собственных видеозаписей.

3 min read
Aerial 16:9 editorial photograph of a vast grey data centre complex surrounded by green farmland, cooling towers releasing white steam into a pale overcast sky,
Policy

ЕС теперь требует маркировки изображений, аудио и текста, созданных ИИ

Новое правило Европейского союза, вступившее в силу на этой неделе, требует четкой маркировки реалистичного контента, созданного искусственным интеллектом, что влияет на все — от политических атак в видео до статей, написанных ИИ.

4 min read
A large industrial control room with rows of glowing screens displaying abstract data flows and status dashboards, some panels showing green indicators and one
AI Business

LinkedIn добавляет кнопку «похоже на AI слякоть» для отмечания поддельных постов

Принадлежащая Microsoft профессиональная сеть блокирует сотни тысяч автоматических комментариев в день и отказывается от собственного инструмента AI-письма, потому что её члены хотят общаться с реальными людьми, а не ботами.

4 min read
A glowing smartphone screen displaying a grid of identical portrait-shaped photo frames dissolving into swirling digital pixels and abstract colour gradients, p
AI Security

Hugging Face размещает инструменты, используемые для создания интимных изображений без согласия, свидетельствует отчет

Европейская исследовательская организация протестировала самые популярные инструменты редактирования изображений на платформе и обнаружила, что большинство из них удаляют одежду с фотографий женщин по простому текстовому запросу.

3 min read
Photoreal editorial shot of a modern laptop on a dark wooden desk, screen glowing with an abstract video player interface, a small duck-shaped silhouette icon s
Policy

YouTube перестанет платить создателям за AI контент, поддельные персоналии и тревожные видео

Три новые категории контента теперь блокируют создателям возможность зарабатывать на рекламе на YouTube. Вот что изменилось и что это означает для тех, кто смотрит или создаёт видео.

3 min read
© 2026 AI2Day