Tag

#content-moderation

17 stories taggedcontent-moderation.

Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
AI Security

Claude Opus 4.6 bypasses Anthropic's own ban on explicit sexual content

A UK researcher found a simple conversation trick that pushes several Claude models past their built-in restrictions. Anthropic has not pulled the affected models.

3 min read
A smartphone screen showing the Reelful app in action, with a user selecting photos and videos from a camera roll
Everyday AI

LinkedIn's 'AI Slop' Button Has Been Clicked Over a Million Times

The platform says views on posts flagged as AI-generated have dropped 40 percent in just a few weeks, as users take the fight against filler content into their own hands.

3 min read
A digital illustration of AI technology being misused for scams, with dollar signs and a computer screen showing fake messages
AI Security

Meta ran ads for an app that made deepfake porn of politicians. Again.

A tool called Kromix bought ad space on Meta's platforms promising 'no restrictions' and showing a woman resembling a sitting US politician in a pornographic video. Meta's policies already ban this. They ran the ads anyway.

3 min read
An open laptop on a cafe table beside a coffee cup
Everyday AI

OpenAI Launches a Teen-Only Mode for ChatGPT, With Tighter Content Rules and Homework Guardrails

ChatGPT for Teens bundles existing safety features and a few new ones into a single experience aimed at 13-to-17-year-olds. Here is what changes, and what stays the same.

3 min read
A glowing smartphone screen displaying a grid of blurred, indistinct portrait-shaped photo thumbnails, surrounded by soft warning-amber light, shot from slightl
Policy

Un adolescente del Massachusetts accusato di omicidio doppio aveva usato ChatGPT per cercare fantasie di uccisione familiare, secondo i pubblici ministeri

Arjun Aravind, 17 anni, è comparso in tribunale giovedì con accuse di omicidio per la morte di sua madre e suo fratello minore. I pubblici ministeri affermano che gli investigatori hanno scoperto che aveva usato ChatGPT per cercare storie di fantasia su omicidi in famiglia.

3 min read
Photoreal editorial wide shot of a glowing laptop on a dim office desk, projecting faint translucent code panels into the air around it, cables trailing off int
AI Security

Meme di estrema destra generati da IA inondano Facebook. Ecco come funziona il meccanismo.

Account automatizzati stanno producendo in massa immagini e testi politicamente carichi utilizzando strumenti di IA, quindi li distribuiscono su Facebook su larga scala. Una parodia satirica di un vignettista del Guardian su questa tendenza evidenzia un problema reale e crescente.

3 min read
A modern desktop workspace photographed from above at a slight angle, showing a laptop with a glowing email inbox on screen, a cup of coffee nearby, warm natura
Everyday AI

Gli strumenti di moderazione AI stanno rimuovendo post di Reddit risalenti a dieci anni fa, e questo è un avvertimento per tutti i social media

Un'ondata di eliminazioni automatiche all'interno di una delle comunità più rispettate di Reddit mostra cosa accade quando le piattaforme combattono lo spam generato dall'AI con altra AI, e perché il vero costo ricade sulle persone che hanno costruito quelle comunità.

3 min read
Full-frame editorial photo of a dimly lit smartphone on a wooden desk displaying a generic blue messaging app interface, soft window light from the left, faint
Policy

Meta ha approvato e pubblicato annunci contenenti immagini di abusi sessuali su minori generate da IA per nove mesi

Più di 50 annunci pubblicitari contenenti materiale di abuso sessuale su minori sono stati pubblicati su Facebook, Instagram, Messenger e Threads. Alcuni hanno raggiunto migliaia di account in Europa e negli Stati Uniti prima che i ricercatori costringessero Meta ad agire.

5 min read
A modern smartphone held in one hand, screen glowing with a colourful grid of generated and photographed images blending together, soft studio lighting, shallow
Everyday AI

Reddit Sostituisce il Suo Vecchio Bot di Moderazione Con un'IA Che Legge le Intenzioni, Non Solo le Parole Chiave

Un nuovo strumento chiamato Rules Hub utilizza i modelli di linguaggio di grandi dimensioni per giudicare se un post viola effettivamente una norma. Reddit prevede di implementarlo in tutto il sito più avanti quest'anno.

3 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

Il nuovo strumento di sicurezza di Mistral legge le vostre regole e le applica istantaneamente

Shieldstral è un piccolo modello di IA gratuito che esamina testi e immagini alla ricerca di contenuti dannosi utilizzando politiche in linguaggio naturale che scrivi tu stesso. Non è richiesta alcuna conoscenza specialistica.

4 min read
Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
Policy

Snapchat smette di premiare i video completamente generati da IA su Spotlight

La piattaforma non farà più emergere i video interamente creati da IA nei consigli di Spotlight, anche se i creator possono ancora utilizzare strumenti di intelligenza artificiale per modificare i loro video.

3 min read
Aerial 16:9 editorial photograph of a vast grey data centre complex surrounded by green farmland, cooling towers releasing white steam into a pale overcast sky,
Policy

L'UE ora richiede etichette su immagini, audio e testi generati dall'IA

Una nuova norma dell'Unione Europea entrata in vigore questa settimana richiede che i contenuti realistici creati dall'intelligenza artificiale siano chiaramente contrassegnati come tali, influenzando tutto, dai video di attacco politico agli articoli di notizie scritti dall'IA.

4 min read
A large industrial control room with rows of glowing screens displaying abstract data flows and status dashboards, some panels showing green indicators and one
AI Business

LinkedIn aggiunge un pulsante "sembra AI slop" per permettere agli utenti di segnalare post fake

La rete professionale di proprietà di Microsoft sta bloccando centinaia di migliaia di commenti automatici al giorno e sta eliminando il suo stesso strumento di scrittura AI, perché i suoi membri vogliono sentire voci autentiche, non bot.

4 min read
A glowing smartphone screen displaying a grid of identical portrait-shaped photo frames dissolving into swirling digital pixels and abstract colour gradients, p
AI Security

Hugging Face ospita strumenti utilizzati per creare immagini intime non consensuali, secondo un rapporto

Un'organizzazione di ricerca europea ha testato i più popolari strumenti di editing di immagini della piattaforma e ha scoperto che la maggior parte di essi rimuoverebbe i vestiti dalle foto di donne con una semplice richiesta in linguaggio naturale.

3 min read
Photoreal editorial shot of a modern laptop on a dark wooden desk, screen glowing with an abstract video player interface, a small duck-shaped silhouette icon s
Policy

YouTube smetterà di pagare i creator per contenuti AI scadenti, personaggi falsi e video angoscianti

Tre nuove categorie di contenuti bloccano ora i creator dall'ottenere guadagni pubblicitari su YouTube. Ecco cosa è cambiato e cosa significa per chi guarda o produce video.

3 min read
© 2026 AI2Day