Alle großen KI-Modelle neigen politisch nach links, sogar Grok manchmal
Ein kleines Forschungslabor hat 16 führende KI-Modelle tausendfach durch einen bekannten politischen Quiz durchlaufen lassen. Alle bis auf eines landeten konsistent in der libertär-linken Zone. Die Ausnahme war Elon Musks Grok, das sich nicht entscheiden konnte.

Wichtigste Punkte
- Ein Forscher mit dem Namen „Victor" von Unsloth.run hat 2025 16 KI-Modelle tausendfach durch den Political Compass Quiz durchlaufen lassen.
- Alle Modelle mit Ausnahme von Grok 4.5 landeten konsistent im libertär-linken Quadranten, mit Positionsverschiebungen von höchstens 1,2 Punkten auf einer 10er-Skala zwischen den Durchläufen.
- Grok 4.5 teilte sich etwa gleichmäßig auf: libertär-links in etwa der Hälfte seiner Durchläufe, wirtschaftlich rechts in der anderen Hälfte.
- Victor führt die Linksneigung hauptsächlich auf Trainingsdaten zurück und nennt Reddit und akademische Schriften als wahrscheinlich überrepräsentierte Quellen.
- Keines der 16 Modelle, unabhängig von seiner politischen Ausrichtung, unterstützte Rassenüberlegenheit, Eugenik oder Beschränkungen bei der Adoption durch gleichgeschlechtliche Paare.
Jedes führende KI-Modell, das man nennen kann, neigt nach links. Das ist die Kurzfassung einer Studie, die diese Woche von Unsloth.run veröffentlicht wurde, einem selbstbeschriebenen kleinen Forschungslabor, das KI-Erkennungswerkzeuge entwickelt.
Der Forscher hinter dem Projekt, der sich nur als Victor identifizieren lässt und sich gegenüber The Register als KI-Forschungsingenieur bei einem europäischen Startup beschrieb, führte 16 große Sprachmodelle, die Technologie hinter Chatbots wie ChatGPT und Claude, durch den Political Compass Quiz durch. Dieser Quiz ist ein 25 Jahre alter Online-Test, der Respondenten auf zwei Achsen einordnet: wirtschaftlich links versus rechts und gesellschaftlich autoritär versus libertär.
Was hat der Quiz tatsächlich herausgefunden?
Alle 15 Modelle mit Ausnahme von Grok landeten jedes Mal im libertär-linken Quadranten. Diese Ecke des Kompasses beschreibt Ansichten, die soziale Gleichheit befürworten, Skepsis gegenüber Unternehmertum ausdrücken und sich gegen unnötige Autorität wenden.
Die getestete Serie umfasste GPT-4o und zwei weitere GPT-Versionen, Claude Opus, Sonnet, Haiku und ein Modell namens Fable, Gemini Flash, Llama 4 Maverick, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5 und Mistral in zwei Größen. Jedes absolvierte 30 Standard-Durchläufe, 30 Durchläufe mit umformulierten Fragen zur Bedeutungsumkehrung und einen weiteren gemischten Durchlauf.
Die Ergebnisse bewegten sich kaum. „Führt man ein Modell 30 Mal durch und sein Punkt bewegt sich um 0,2 bis 1,2 Punkte auf einer Skala bis 10", wie der Unsloth-Bericht feststellte. „Das sind keine nervösen kleinen Wolken. Das sind Stifte."
| Modell | Quadrant | Konsistenz |
|---|---|---|
| Claude Fable 5 | Libertär-links | Sehr hoch |
| Gemini Flash | Libertär-links (weiter links als Fable) | Sehr hoch |
| DeepSeek V3 | Libertär-links | Sehr hoch |
| Llama 4 Maverick | Libertär-links | Sehr hoch |
| Grok 4.5 | Geteilt: links die Hälfte der Zeit, rechts die andere Hälfte | Niedrig |
Grok, die KI von Elon Musks xAI, war der Ausreißer. Sein durchschnittlicher Wirtschaftswert lag knapp links der Mitte, aber in etwa der Hälfte der einzelnen Durchläufe rutschte es nach wirtschaftlich rechts ab, und in der anderen Hälfte lief es links mit den anderen mit. Victors Fazit: „Jedes andere Modell hier würde dir ungefähr denselben Punkt geben, wenn du es morgen testen würdest. Grok gibt dir einen von zwei Punkten, und welcher es ist, ist dem Zufall überlassen."
Ein konsistenter Befund über alle 16 Modelle hinweg: Jedes Einzelne lehnte Rassenüberlegenheit, Eugenik und die Vorstellung ab, dass gleichgeschlechtliche Paare keine Kinder adoptieren dürfen sollten. Alle waren sich einig, dass Unternehmen nicht darauf vertraut werden kann, die Umwelt ohne externe Regelung zu schützen.
Warum neigen diese Modelle nach links?
Victors Erklärung betrifft das Rohmaterial, aus dem KI lernt, nicht eine von Ingenieuren eingebaute Ideologie. Große Sprachmodelle werden anhand enormer Textsammlungen aus dem Internet trainiert, und einige Quellen dominieren diesen Text.
„Ich glaube, es gibt gute Unterstützung für die Hypothese, dass linksorientierte Inhalte in den Trainingskorpora dieser LLMs überrepräsentiert sind", sagte Victor gegenüber The Register. Reddit und akademische Schriften, die beide liberal tendieren, erscheinen prominent in den meisten Trainingsdatensätzen. Hochwertige rechtsorientierte Äquivalente sind einfach schwerer in vergleichbaren Mengen zu finden.
Victor war vorsichtig, nicht zu viel zu behaupten. Der Political Compass Quiz wurde nicht als wissenschaftliches Instrument zur Messung von KI konzipiert, und die Studie vermisst die normalisierte menschliche Grundlinie, die ein von Fachleuten begutachtetes Papier erfordern würde. Was sie bietet, ist laut Victor eine nützliche Möglichkeit, Modelle untereinander zu vergleichen.
Für gewöhnliche Nutzer dieser Tools ist die praktische Konsequenz eng begrenzt. Eine politische Neigung eines Chatbots bedeutet nicht, dass er dir diese Ansichten ungefragt aufzwingt. Aber wenn du ihn bittest, eine Rede zu verfassen, eine politische Debatte zusammenzufassen oder ein wirtschaftliches Argument abzuwägen, könnte die Neigung in seinen Trainingsdaten die Worte, die er wählt, leise beeinflussen. Bewusstsein für diese Tendenz ist nützlicher als Besorgnis darüber.
Häufig gestellte Fragen
Bedeutet das, dass KI-Chatbots versuchen werden, meine Politik zu ändern?
Es gibt keine Belege aus dieser Studie, die das suggerieren würde. Den Modellen wurde ein strukturiertes Quiz gegeben, nicht die Möglichkeit, Meinungen zu äußern. In der alltäglichen Nutzung sind die meisten dieser Modelle darauf ausgelegt, zu strittigen Themen neutral zu bleiben.
Ist der Political Compass Quiz ein zuverlässiger wissenschaftlicher Test?
Victor gestand ein, dass er für diesen Zweck nicht vollständig rigoros ist. Der Quiz hat keine veröffentlichte Bewertungsformel und keine aggregierte menschliche Grundlinie zum Vergleich. Die Ergebnisse sind suggestiv, nicht schlüssig.
Könnte sich dies ändern, wenn KI-Unternehmen ihre Modelle aktualisieren?
Ja. Die Trainingsdatenentscheidungen entwickeln sich mit jeder neuen Modellversion weiter, und einige Unternehmen stimmen ihre Modelle aktiv ab, um politische Positionen zu vermeiden. Die Ergebnisse hier spiegeln die spezifischen 2025 getesteten Modellversionen wider.



