Tag

#content-moderation

17 stories taggedcontent-moderation.

Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
AI Security

Claude Opus 4.6 bypasses Anthropic's own ban on explicit sexual content

A UK researcher found a simple conversation trick that pushes several Claude models past their built-in restrictions. Anthropic has not pulled the affected models.

3 min read
A smartphone screen showing the Reelful app in action, with a user selecting photos and videos from a camera roll
Everyday AI

LinkedIn's 'AI Slop' Button Has Been Clicked Over a Million Times

The platform says views on posts flagged as AI-generated have dropped 40 percent in just a few weeks, as users take the fight against filler content into their own hands.

3 min read
A digital illustration of AI technology being misused for scams, with dollar signs and a computer screen showing fake messages
AI Security

Meta ran ads for an app that made deepfake porn of politicians. Again.

A tool called Kromix bought ad space on Meta's platforms promising 'no restrictions' and showing a woman resembling a sitting US politician in a pornographic video. Meta's policies already ban this. They ran the ads anyway.

3 min read
An open laptop on a cafe table beside a coffee cup
Everyday AI

OpenAI Launches a Teen-Only Mode for ChatGPT, With Tighter Content Rules and Homework Guardrails

ChatGPT for Teens bundles existing safety features and a few new ones into a single experience aimed at 13-to-17-year-olds. Here is what changes, and what stays the same.

3 min read
A glowing smartphone screen displaying a grid of blurred, indistinct portrait-shaped photo thumbnails, surrounded by soft warning-amber light, shot from slightl
Policy

Siebzehnjähriger aus Massachusetts wegen Doppelmordes angeklagt – Staatsanwälte sagen, er habe ChatGPT für Suche nach Fantasien über Familientötungen genutzt

Arjun Aravind, 17, wurde am Donnerstag wegen Mordvorwürfen im Zusammenhang mit den Todesfällen seiner Mutter und seines jüngeren Bruders angeklagt. Die Staatsanwaltschaft gibt an, dass Ermittler herausgefunden haben, dass er ChatGPT nutzte, um nach fiktiven Geschichten über das Töten von Familienmitgliedern zu suchen.

3 min read
Photoreal editorial wide shot of a glowing laptop on a dim office desk, projecting faint translucent code panels into the air around it, cables trailing off int
AI Security

Von KI generierte Rechtsextremisten-Memes überfluten Facebook. So funktioniert die Maschine.

Automatisierte Konten produzieren massenhaft politisch aufgeladene Bilder und Texte mit KI-Tools und verbreiten sie im großen Stil über Facebook. Ein satirischer Beitrag eines Guardian-Karikaturisten deutet auf ein echtes und wachsendes Problem hin.

3 min read
A modern desktop workspace photographed from above at a slight angle, showing a laptop with a glowing email inbox on screen, a cup of coffee nearby, warm natura
Everyday AI

KI-Moderationstools löschen jahrzehntealte Reddit-Beiträge – eine Warnung für alle sozialen Medien

Eine Flut automatisierter Löschungen in einer der angesehensten Communities von Reddit zeigt, was passiert, wenn Plattformen KI-generierte Inhalte mit noch mehr KI bekämpfen – und warum die echten Kosten diejenigen trifft, die diese Communities aufgebaut haben.

3 min read
Full-frame editorial photo of a dimly lit smartphone on a wooden desk displaying a generic blue messaging app interface, soft window light from the left, faint
Policy

Meta billigte und schaltete Anzeigen mit KI-generierten Bildern von Kindesmissbrauch neun Monate lang

Mehr als 50 bezahlte Anzeigen mit Material zur Ausbeutung von Kindern liefen über Facebook, Instagram, Messenger und Threads. Einige erreichten Tausende von Konten in Europa und den USA, bevor Forscher Meta zum Handeln zwangen.

5 min read
A modern smartphone held in one hand, screen glowing with a colourful grid of generated and photographed images blending together, soft studio lighting, shallow
Everyday AI

Reddit ersetzt seinen alten Moderations-Bot durch KI, die Absicht erkennt, nicht nur Schlüsselwörter

Ein neues Tool namens Rules Hub nutzt große Sprachmodelle, um zu beurteilen, ob ein Beitrag tatsächlich gegen eine Regel verstößt. Reddit plant, es später in diesem Jahr unternehmensübergreifend einzuführen.

3 min read
A glowing digital switchboard or routing diagram rendered in deep blues and amber, with branching pathways lit at different intensities diverging from a central
AI Security

Mistrals neues Sicherheitstool liest Ihre Regeln und wendet sie sofort an

Shieldstral ist ein kleines, kostenloses KI-Modell, das Text und Bilder auf schädliche Inhalte prüft – basierend auf Richtlinien in Klartext, die Sie selbst festlegen. Keine Spezialkennnisse erforderlich.

4 min read
Photoreal news-editorial style, 16:9 framing, full-frame edge-to-edge composition
Policy

Snapchat belohnt vollständig KI-generierte Videos auf Spotlight nicht mehr

Die Plattform wird rein KI-erstellte Videos nicht mehr in ihren Spotlight-Empfehlungen anzeigen, aber Ersteller können weiterhin KI-Tools zur Bearbeitung ihres eigenen Materials verwenden.

3 min read
Aerial 16:9 editorial photograph of a vast grey data centre complex surrounded by green farmland, cooling towers releasing white steam into a pale overcast sky,
Policy

Die EU verlangt nun Kennzeichnungen auf KI-generierten Bildern, Audio und Text

Eine neue Regelung der Europäischen Union, die diese Woche in Kraft trat, besagt, dass realistisch aussehende Inhalte, die von künstlicher Intelligenz erstellt wurden, deutlich als solche gekennzeichnet werden müssen. Dies betrifft alles von politischen Attackvideos bis hin zu von KI geschriebenen Nachrichtenartikeln.

4 min read
A large industrial control room with rows of glowing screens displaying abstract data flows and status dashboards, some panels showing green indicators and one
AI Business

LinkedIn fügt einen „Sieht wie KI-Spam aus"-Button hinzu, um Nutzer Fake-Posts kennzeichnen zu lassen

Das Microsoft-eigene Netzwerk blockiert täglich Hunderttausende automatisierte Kommentare und stellt sein eigenes KI-Schreibwerkzeug ein, weil Mitglieder von echten Menschen hören möchten, nicht von Bots.

4 min read
A glowing smartphone screen displaying a grid of identical portrait-shaped photo frames dissolving into swirling digital pixels and abstract colour gradients, p
AI Security

Hugging Face hostet Tools zur Erstellung von Bildern intimer Momente ohne Zustimmung, Bericht zeigt

Eine europäische Forschungsorganisation testete die beliebtesten Bildbearbeitungswerkzeuge der Plattform und stellte fest, dass die meisten davon Kleidung von Frauenfotos mit einer einfachen, klaren Anfrage entfernen würden.

3 min read
Photoreal editorial shot of a modern laptop on a dark wooden desk, screen glowing with an abstract video player interface, a small duck-shaped silhouette icon s
Policy

YouTube zahlt Creators nicht mehr für KI-Müll, gefälschte Personen und verstörendes Material

Drei neue Inhaltskategorien blockieren Creators jetzt davon, auf YouTube Geld mit Anzeigen zu verdienen. Hier ist, was sich geändert hat und was es für alle bedeutet, die Videos ansehen oder erstellen.

3 min read
© 2026 AI2Day