KI-Moderationstools löschen jahrzehntealte Reddit-Beiträge – eine Warnung für alle sozialen Medien
Eine Flut automatisierter Löschungen in einer der angesehensten Communities von Reddit zeigt, was passiert, wenn Plattformen KI-generierte Inhalte mit noch mehr KI bekämpfen – und warum die echten Kosten diejenigen trifft, die diese Communities aufgebaut haben.

Wichtige Punkte
- Im April 2025 wurden Dutzende von Beiträgen und Kommentaren aus r/AskHistorians, einer der sorgfältigsten moderierten Communities von Reddit, automatisch gelöscht – einige davon zehn Jahre alt.
- Moderatoren bemerkten das Problem zunächst, als ein Slack-Kanal, der zur Verfolgung von Moderationsmeldungen verwendet wird, mit unerwarteten Benachrichtigungen überflutet wurde.
- KI-Inhaltsmoderationstools, also Software, die Beiträge automatisch basierend auf KI-Beurteilung kennzeichnet oder löscht, statt dass eine Person sie liest, verbreiten sich über alle sozialen Medienplattformen.
- Forscher und Moderatoren warnen davor, dass die Verwendung von KI zur Bekämpfung von KI-generierten Spam auch echte, wertvolle Inhalte von Menschen erfassen kann.
Die Moderatoren von r/AskHistorians sind stolz darauf, eine der am strengsten kontrollierten Communities von Reddit zu betreiben. Historiker, Akademiker und Enthusiasten beantworten Fragen mit belegten, detaillierten Antworten. Die Standards sind hoch. Das Archiv reicht Jahre zurück.
Als der Slack-Kanal, den das Moderationsteam zur Verfolgung eingehender Moderationsmeldungen nutzt, im April plötzlich mit Hunderten von Benachrichtigungen gefüllt wurde, war klar, dass etwas schiefgelaufen war. Dutzende von Beiträgen und Kommentaren – einige fast zehn Jahre alt – waren automatisch gelöscht worden.
Diese Details wurden zuerst von Ars Technica berichtet.
Was ist schiefgelaufen?
Der Schuldige scheint die automatisierte Inhaltsmoderation zu sein: KI-Tools, die Beiträge scannen und alles löschen, das sie als problematisch einstufen, ohne dass eine Person die endgültige Entscheidung trifft. Plattformen greifen zunehmend auf diese Tools zurück, da die Menge an KI-generiertem Spam – auch „KI-Müll" genannt – und Hassinhalten gestiegen ist.
Die Logik ist verständlich. Menschliche Moderatoren können nicht alles lesen. KI kann Millionen von Beiträgen pro Minute verarbeiten.
Aber KI-Klassifizierer, der Teil des Systems, der entscheidet, ob ein Beitrag gut oder schlecht ist, machen Fehler. Sie haben keinen Kontext. Eine zehn Jahre alte Antwort eines ausgebildeten Historikers sieht für ein Musterkennungssystem wie frisch generierter Fülltext aus, wenn die Antwort lang und detailliert ist. Das System löscht beides.
Warum ist das für normale Nutzer wichtig?
Denken Sie an ein Forum, das Sie benutzt haben, um ein echtes Problem zu lösen: einen Thread, der ein medizinisches Symptom erklärte, eine Community, die Ihnen half, ein kaputtes Gerät zu reparieren, eine lokale Gruppe, in der Menschen teilten, was wirklich funktioniert.
Dieses Wissen existiert nicht auf einer offiziellen Website. Es existiert, weil bestimmte Menschen sich dafür entschieden haben, es aufzuschreiben und zu teilen. Das automatische Löschen löscht nicht nur einen Beitrag. Es löscht das Vertrauen, das jemanden überhaupt erst dazu bewogen hat, etwas zu schreiben.
Wenn fehlerhafte Löschungen wiederholt vorkommen, stellen Beitraggenießer ihre Mitarbeit ein. Die Community wird leer. Die Plattform endet mit weniger authentischen Inhalten als zu Beginn, was das Gegenteil dessen ist, was die Moderation erreichen sollte.
Was sollten Plattformen stattdessen tun?
Die ehrliche Antwort ist, dass noch niemand eine saubere Lösung hat. KI-Tools können menschlichen Moderatoren helfen, ihre Warteschlangen zu priorisieren, indem sie verdächtige Inhalte zur Überprüfung kennzeichnen, statt sie direkt zu löschen. Das behält eine Person im Prozess.
Plattformen könnten auch etablierten Beitraggebern eine Kulanzfrist geben, bevor automatische Maßnahmen wirksam werden, oder es einfach machen, eine Löschung schnell anzufechten.
Der Vorfall bei r/AskHistorians verdeutlicht ein einfaches Prinzip: Automatisierung, die nicht zwischen einem böswilligen Akteur und einem engagierten Community-Mitglied unterscheiden kann, ist kein Sicherheitsnetz. Es ist eine Falltür.
Häufig gestellte Fragen
Können gelöschte Beiträge wiederhergestellt werden?
Manchmal. Reddit-Moderatoren mit den richtigen Berechtigungen können automatisch gelöschte Beiträge wiederherstellen, aber nur, wenn sie den Fehler schnell bemerken und die eigenen Systeme der Plattform noch eine Kopie haben. Ältere Löschungen sind schwerer rückgängig zu machen.
Betrifft dies nur Reddit?
Nein. Jede Plattform, die automatisierte Inhaltsmoderation verwendet – was die meisten großen sozialen Netzwerke einschließt – steht vor dem gleichen Kompromiss zwischen Geschwindigkeit und Genauigkeit. Reddits offene Mod-Struktur machte diesen besonderen Fehler sichtbar; bei anderen könnte er unbemerkt bleiben.



