Кожна провідна модель ШІ схиляється вліво в політиці, навіть Grok, половину часу
Невелика дослідницька лабораторія пропустила 16 провідних моделей ШІ через добре відомий політичний тест тисячі разів. Усі, крім однієї, постійно потрапили в лібертаріанську ліву зону. Виключенням була модель Илона Маска Grok, яка не могла визначитися.

Ключові моменти
- Дослідник під ім'ям "Victor" з Unsloth.run пропустив 16 моделей ШІ через тест Political Compass протягом тисяч запусків у 2025 році.
- Кожна модель, крім Grok 4.5, постійно потрапляла в лібертаріанськолівий квадрант, при цьому позиція змінювалася не більше ніж на 1,2 пункти на 10-бальній шкалі між запусками.
- Grok 4.5 розділився майже порівну: лібертаріанськолівий приблизно половину часу, економічно правий у іншу половину.
- Victor приписує ліву схильність передусім тренувальним даним, посилаючись на Reddit та академічні статті як джерела, які, ймовірно, надмірно представлені.
- Жодна з 16 моделей, незалежно від політичної позиції, не підтримувала расову перевагу, евгеніку або обмеження на всиновлення дітей одностатевими парами.
Кожна провідна модель ШІ, про яку ви можете згадати, схиляється вліво. Це коротка версія дослідження, опублікованого цього тижня Unsloth.run, лабораторією, яка називає себе невеликою дослідницькою установою, що розробляє інструменти виявлення ШІ.
Дослідник, який стоїть за цим проектом, і попросив бути ідентифікованим лише як Victor, описавши себе журналу The Register як інженер з досліджень ШІ на європейському стартапі, пропустив 16 великих мовних моделей, технологію, що лежить в основі чат-ботів на кшталт ChatGPT та Claude, через тест Political Compass. Цей тест — це 25-річний онлайн-тест, який розміщує респондентів на двох осях: економіка ліва проти правої та соціально авторитарна проти лібертаріанської.
Що насправді виявив тест?
Усі 15 моделей, крім Grok, потрапили в лібертаріанськолівий квадрант кожного разу. Цей кут компаса описує погляди, які сприяють соціальній рівності, скептицизму щодо влади корпорацій та опозиції до непотрібної влади.
Тестований набір включав GPT-4o та дві інші версії GPT, Claude Opus, Sonnet, Haiku та модель під назвою Fable, Gemini Flash, Llama 4 Maverick, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5 та Mistral двох розмірів. Кожна пройшла 30 стандартних запусків, 30 запусків із перефразованими запитаннями для зміни їхнього значення та ще один змішаний запуск.
Результати майже не змінилися. "Запустіть модель 30 разів, і її точка рухається на 0,2–1,2 пункти за шкалою, яка сягає 10", — зазначило звіт Unsloth. "Це не нервові маленькі хмари. Це шпильки."
| Модель | Квадрант | Послідовність |
|---|---|---|
| Claude Fable 5 | Лібертаріанськолівий | Дуже висока |
| Gemini Flash | Лібертаріанськолівий (далі ліворуч, ніж Fable) | Дуже висока |
| DeepSeek V3 | Лібертаріанськолівий | Дуже висока |
| Llama 4 Maverick | Лібертаріанськолівий | Дуже висока |
| Grok 4.5 | Розділ: ліворуч половину часу, праворуч — половину | Низька |
Grok, ШІ, розроблений компанією xAI Илона Маска, був винятком. Його середній економічний показник зміщувався трохи ліворуч від центру, але в приблизно половині окремих запусків він коливався в економічну право, а в іншій половині працював ліворуч, як решта. Висновок Victor: "Кожна інша модель тут дала б вам приблизно ту саму точку, якби ви її протестували завтра. Grok дає вам одну з двох точок, і яка саме — це питання монети."
Один послідовний висновок на основі всіх 16 моделей: кожна окремо відхилила расову перевагу, евгеніку та ідею про те, що одностатевим парам не слід дозволяти всиновлювати. Всі згодні, що корпорації не можна довіряти захисту навколишнього середовища без зовнішнього регулювання.
Чому ці моделі схиляються вліво?
Пояснення Victor стосується сировини, з якої навчається ШІ, а не ідеології, закладеної інженерами. Великі мовні моделі навчаються на величезних збірках тексту з Інтернету, і деякі джерела домінують у цьому тексті.
"Я дійсно вважаю, що є хорошої підтримки гіпотези про те, що ліворухий вміст надмірно представлений у тренувальних корпусах цих LLM," — сказав Victor журналу The Register. Reddit та академічні роботи, які обидва тяжіють до лібералізму, часто з'являються у більшості тренувальних наборів даних. Високоякісні правохідні еквіваленти просто важче знайти в порівнянних обсягах.
Victor був обережний, щоб не перевищити. Тест Political Compass був розроблений не як науковий інструмент для вимірювання ШІ, і дослідження не має нормалізованої людської базової лінії, яка потрібна для рецензованої роботи. Що це дає, так це, за словами Victor, корисний спосіб порівняння моделей одна з одною.
Для звичайних користувачів цих інструментів практичний висновок вузький. Політична схильність чат-бота не означає, що він буде нав'язувати вам ці погляди без запрошення. Але якщо ви попросите його написати промову, підсумувати дебати щодо політики або зважити економічний аргумент, нахил його тренувальних даних може непомітно вплинути на слова, які він виберає. Усвідомлення цієї тенденції більш корисне, ніж тривога з приводу цього.
Поширені питання
Це означає, що чат-боти ШІ спробують змінити мою політику?
Жодних доказів з цього дослідження такого не підтримують. Моделям було дано структурований тест, а не запропоновано волюнтарно висловлювати думки. У повсякденному використанні більшість цих моделей розроблені так, щоб залишатися нейтральними з метою оскарження.
Чи є тест Political Compass надійним науковим тестом?
Victor визнав, що він не повністю суворий для цієї мети. Тест не має опублікованої формули оцінки та не має агрегованої людської базової лінії для порівняння. Висновки є припущенням, а не остаточними.
Це може змінитися в міру оновлення компаніями ШІ своїх моделей?
Так. Вибір тренувальних даних розвивається з кожною новою версією моделі, і деякі компанії активно налаштовують свої моделі, щоб уникнути політичних позицій. Результати тут відображають конкретні версії моделей, протестовані в 2025 році.



