Tag

#content-moderation

17 stories taggedcontent-moderation.

Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
AI Security

Claude Opus 4.6 bypasses Anthropic's own ban on explicit sexual content

A UK researcher found a simple conversation trick that pushes several Claude models past their built-in restrictions. Anthropic has not pulled the affected models.

3 min read
A smartphone screen showing the Reelful app in action, with a user selecting photos and videos from a camera roll
Everyday AI

LinkedIn's 'AI Slop' Button Has Been Clicked Over a Million Times

The platform says views on posts flagged as AI-generated have dropped 40 percent in just a few weeks, as users take the fight against filler content into their own hands.

3 min read
A digital illustration of AI technology being misused for scams, with dollar signs and a computer screen showing fake messages
AI Security

Meta ran ads for an app that made deepfake porn of politicians. Again.

A tool called Kromix bought ad space on Meta's platforms promising 'no restrictions' and showing a woman resembling a sitting US politician in a pornographic video. Meta's policies already ban this. They ran the ads anyway.

3 min read
An open laptop on a cafe table beside a coffee cup
Everyday AI

OpenAI Launches a Teen-Only Mode for ChatGPT, With Tighter Content Rules and Homework Guardrails

ChatGPT for Teens bundles existing safety features and a few new ones into a single experience aimed at 13-to-17-year-olds. Here is what changes, and what stays the same.

3 min read
A glowing smartphone screen displaying a grid of blurred, indistinct portrait-shaped photo thumbnails, surrounded by soft warning-amber light, shot from slightl
Policy

Adolescente de Massachusetts acusado de duplo homicídio utilizou ChatGPT para pesquisar fantasias de morte familiar, dizem procuradores

Arjun Aravind, 17, foi presente em tribunal quinta-feira sob acusações de homicídio nas mortes de sua mãe e irmão mais jovem. Procuradores afirmam que investigadores descobriram que ele havia utilizado ChatGPT para pesquisar histórias ficcionais sobre matar membros da família.

3 min read
Photoreal editorial wide shot of a glowing laptop on a dim office desk, projecting faint translucent code panels into the air around it, cables trailing off int
AI Security

Memes de Extrema-Direita Gerados por IA Inundam Facebook. Eis Como a Máquina Funciona.

Contas automatizadas estão a produzir em massa imagens e textos politicamente carregados usando ferramentas de IA, depois a distribui-los pelo Facebook em larga escala. Uma interpretação satírica de um cartunista do The Guardian sobre a tendência aponta para um problema real e crescente.

3 min read
A modern desktop workspace photographed from above at a slight angle, showing a laptop with a glowing email inbox on screen, a cup of coffee nearby, warm natura
Everyday AI

As ferramentas de moderação com IA estão a remover posts do Reddit com uma década de idade, e isto é um aviso para todas as redes sociais

Uma enxurrada de eliminações automatizadas dentro de uma das comunidades mais respeitadas do Reddit mostra o que acontece quando plataformas combatem lixo gerado por IA com mais IA, e porque o custo real recai sobre as pessoas que construíram essas comunidades.

3 min read
Full-frame editorial photo of a dimly lit smartphone on a wooden desk displaying a generic blue messaging app interface, soft window light from the left, faint
Policy

Meta Aprovou e Exibiu Anúncios com Imagens de Abuso Sexual Infantil Geradas por IA Durante Nove Meses

Mais de 50 anúncios pagos contendo material de abuso sexual infantil foram exibidos no Facebook, Instagram, Messenger e Threads. Alguns chegaram a milhares de contas na Europa e nos Estados Unidos antes de investigadores forçarem a ação da Meta.

5 min read
A modern smartphone held in one hand, screen glowing with a colourful grid of generated and photographed images blending together, soft studio lighting, shallow
Everyday AI

Reddit Está a Substituir o Seu Antigo Bot de Moderação por IA que Lê a Intenção, Não Apenas Palavras-chave

Uma nova ferramenta chamada Rules Hub utiliza modelos de linguagem de grande dimensão para avaliar se uma publicação realmente viola uma regra. Reddit planeia implementá-la em todo o site mais tarde este ano.

3 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

A Nova Ferramenta de Segurança da Mistral Lê as Suas Regras e Aplica-as Instantaneamente

Shieldstral é um pequeno modelo de IA gratuito que analisa texto e imagens em busca de conteúdo prejudicial, utilizando políticas em inglês simples que você próprio escreve. Não é necessário conhecimento especializado.

4 min read
Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
Policy

Snapchat deixa de premiar vídeos totalmente gerados por IA no Spotlight

A plataforma deixará de recomendar vídeos feitos apenas por IA na sua secção Spotlight, embora os criadores possam continuar a usar ferramentas de IA para editar o seu próprio material.

3 min read
Aerial 16:9 editorial photograph of a vast grey data centre complex surrounded by green farmland, cooling towers releasing white steam into a pale overcast sky,
Policy

A UE Agora Exige Etiquetas em Imagens, Áudio e Texto Gerados por IA

Uma nova regra da União Europeia que entrou em vigor esta semana significa que conteúdo realista criado por inteligência artificial deve ser claramente marcado como tal, afetando tudo, desde vídeos de ataque político a artigos de notícias escritos por IA.

4 min read
A large industrial control room with rows of glowing screens displaying abstract data flows and status dashboards, some panels showing green indicators and one
AI Business

LinkedIn adiciona um botão "parece spam de IA" para os utilizadores sinalizarem posts falsos

A rede profissional pertencente à Microsoft está a bloquear centenas de milhares de comentários automatizados por dia e a descontinuar a sua própria ferramenta de escrita com IA, porque os seus membros querem ouvir pessoas reais, não bots.

4 min read
A glowing smartphone screen displaying a grid of identical portrait-shaped photo frames dissolving into swirling digital pixels and abstract colour gradients, p
AI Security

O Hugging Face está a Hospedar Ferramentas Utilizadas para Criar Imagens Íntimas Não Consensuais, Revela Relatório

Uma organização de investigação europeia testou as ferramentas de edição de imagens mais populares da plataforma e descobriu que a maioria delas removeria roupas de fotos de mulheres com um simples pedido em linguagem comum.

3 min read
Photoreal editorial shot of a modern laptop on a dark wooden desk, screen glowing with an abstract video player interface, a small duck-shaped silhouette icon s
Policy

YouTube deixará de pagar criadores por conteúdo IA genérico, personagens fictícios e vídeos perturbadores

Três novas categorias de conteúdo bloqueiam agora criadores de ganhar dinheiro com anúncios no YouTube. Veja o que mudou e o que significa para quem assiste ou cria vídeos.

3 min read
© 2026 AI2Day