हर एक प्रमुख AI मॉडल राजनीति में बाईं ओर झुका हुआ है, यहां तक कि Grok भी, आधा समय
एक छोटी रिसर्च लैब ने 16 शीर्ष AI मॉडलों को एक प्रसिद्ध राजनीतिक क्विज से हजारों बार गुजारा। एक को छोड़कर सभी लगातार लिबर्टेरियन-लेफ्ट जोन में पहुंचे। अपवाद एलन मस्क का Grok था, जो अपना मन नहीं बना पाया।

मुख्य बिंदु
- Unsloth.run पर "विक्टर" नाम का एक शोधकर्ता ने 2025 में हजारों रन में 16 AI मॉडलों को Political Compass क्विज के माध्यम से परीक्षण किया।
- Grok 4.5 को छोड़कर हर मॉडल लगातार लिबर्टेरियन-लेफ्ट क्वाड्रंट में रहा, 10-पॉइंट स्केल पर रन के बीच स्थिति 1.2 पॉइंट से अधिक नहीं बदली।
- Grok 4.5 लगभग समान रूप से विभाजित हुआ: मोटे तौर पर आधे रन में लिबर्टेरियन-लेफ्ट, दूसरे आधे में आर्थिक रूप से दाईं ओर।
- विक्टर ने बाईं ओर झुकाव का कारण मुख्य रूप से प्रशिक्षण डेटा को बताया, Reddit और शैक्षणिक लेखन को संभावित रूप से अधिक प्रतिनिधित्व वाले स्रोत के रूप में उद्धृत किया।
- 16 मॉडलों में से कोई भी, राजनीतिक झुकाव की परवाह किए बिना, नस्लीय श्रेष्ठता, यूजेनिक्स, या समलैंगिक जोड़ों द्वारा गोद लेने पर प्रतिबंध का समर्थन नहीं करता था।
आप जिस भी प्रमुख AI मॉडल को नाम दे सकते हैं, वह बाईं ओर झुका हुआ है। यह Unsloth.run द्वारा इस हफ्ते प्रकाशित एक अध्ययन का संक्षिप्त संस्करण है, जो एक self-described छोटी रिसर्च लैब है जो AI डिटेक्शन टूल्स बनाती है।
इस परियोजना के पीछे का शोधकर्ता, जिन्होंने केवल विक्टर के रूप में पहचान कराने के लिए कहा और द रजिस्टर को एक यूरोपीय स्टार्टअप में एक AI रिसर्च इंजीनियर के रूप में वर्णित किया, ने 16 बड़े भाषा मॉडलों को Political Compass क्विज के माध्यम से चलाया। वह क्विज ChatGPT और Claude जैसे चैटबॉट के पीछे की तकनीक है। यह क्विज एक 25 साल पुरानी ऑनलाइन परीक्षा है जो उत्तरदाताओं को दो अक्षों पर रखती है: आर्थिक बाएं बनाम दाएं, और सामाजिक रूप से अधिनायकवादी बनाम लिबर्टेरियन।
क्विज ने वास्तव में क्या पाया?
Grok को छोड़कर सभी 15 मॉडल हर बार लिबर्टेरियन-लेफ्ट क्वाड्रंट में उतरे। कम्पास के इस कोने सामाजिक समानता, कॉर्पोरेट शक्ति के प्रति संदेह, और अनावश्यक प्राधिकार के विरोध को पसंद करने वाले विचारों का वर्णन करते हैं।
परीक्षण की गई लाइनअप में GPT-4o और दो अन्य GPT संस्करण, Claude Opus, Sonnet, Haiku, और Fable नामक एक मॉडल, Gemini Flash, Llama 4 Maverick, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5, और दो आकारों में Mistral शामिल थे। प्रत्येक ने 30 मानक रन, 30 रन किए जिनमें प्रश्नों को उनके अर्थ को पलटने के लिए पुनः तैयार किया गया, और एक आगे का फेरबदल रन।
परिणाम मुश्किल से हिले। "एक मॉडल को 30 बार चलाएं और इसका डॉट 10 तक चलने वाली स्केल पर 0.2 से 1.2 पॉइंट से आगे बढ़ता है," Unsloth रिपोर्ट में नोट किया गया। "ये घबराए हुए छोटे बादल नहीं हैं। ये पिन हैं।"
| मॉडल | क्वाड्रंट | स्थिरता |
|---|---|---|
| Claude Fable 5 | लिबर्टेरियन-लेफ्ट | बहुत अधिक |
| Gemini Flash | लिबर्टेरियन-लेफ्ट (Fable से अधिक बाईं ओर) | बहुत अधिक |
| DeepSeek V3 | लिबर्टेरियन-लेफ्ट | बहुत अधिक |
| Llama 4 Maverick | लिबर्टेरियन-लेफ्ट | बहुत अधिक |
| Grok 4.5 | विभाजित: आधा समय बाईं ओर, आधा दाईं ओर | कम |
Grok, एलन मस्क के xAI द्वारा निर्मित AI, अपवाद था। इसका औसत आर्थिक स्कोर केंद्र के बाईं ओर बैठा, लेकिन मोटे तौर पर आधे व्यक्तिगत रन में यह आर्थिक रूप से दाईं ओर झूल गया, और दूसरे आधे में यह बाकी के साथ बाईं ओर चला गया। विक्टर का निष्कर्ष: "यहाँ हर दूसरा मॉडल आपको मोटे तौर पर वही डॉट देगा यदि आप इसे कल परीक्षण करेंगे। Grok आपको दो डॉट्स में से एक देता है, और कौन सा एक सिक्के पर निर्भर है।"
सभी 16 मॉडलों में एक सुसंगत खोज: हर एक ने नस्लीय श्रेष्ठता, यूजेनिक्स, और यह विचार कि समलैंगिक जोड़ों को गोद लेने की अनुमति नहीं दी जानी चाहिए, को अस्वीकार कर दिया। सभी सहमत थे कि कॉर्पोरेशन बाहरी विनियमन के बिना पर्यावरण की रक्षा करने पर विश्वास नहीं किए जा सकते हैं।
ये मॉडल बाईं ओर क्यों झुके हुए हैं?
विक्टर की व्याख्या इंजीनियरों द्वारा सेंकी गई विचारधारा के बजाय कच्चे माल के बारे में है जो AI सीखता है। बड़े भाषा मॉडलों को इंटरनेट से पाठ के विशाल संग्रह पर प्रशिक्षित किया जाता है, और कुछ स्रोत उस पाठ पर हावी होते हैं।
"मुझे लगता है कि इस परिकल्पना के लिए अच्छा समर्थन है कि बाएं-पंथी सामग्री इन LLM के प्रशिक्षण corpora में अधिक प्रतिनिधित्व की गई है," विक्टर ने द रजिस्टर को बताया। Reddit और शैक्षणिक लेखन, दोनों जो उदार प्रवृत्ति के हैं, अधिकांश प्रशिक्षण डेटासेट में भारी दिखाई देते हैं। उच्च-गुणवत्ता वाली दाएं-पंथी समकक्षें तुलनीय मात्रा में खोजना बस अधिक कठिन है।
विक्टर ने अधिक दावा न करने के लिए सावधान रहे। Political Compass क्विज को AI को मापने के लिए एक वैज्ञानिक उपकरण के रूप में डिजाइन नहीं किया गया था, और अध्ययन में एक peer-reviewed पेपर के लिए आवश्यक सामान्यीकृत मानव baseline की कमी है। यह जो प्रदान करता है वह मॉडलों की तुलना एक दूसरे से करने का एक उपयोगी तरीका है।
इन टूलों के सामान्य उपयोगकर्ताओं के लिए, व्यावहारिक निष्कर्ष संकीर्ण है। एक चैटबॉट का राजनीतिक झुकाव इसका मतलब यह नहीं है कि यह बिना संकेत के आपको उन विचारों पर दबाव डालेगा। लेकिन यदि आप इससे एक भाषण का मसौदा तैयार करने, एक नीति बहस को सारांशित करने, या एक आर्थिक तर्क को तौलने के लिए कहते हैं, तो इसके प्रशिक्षण डेटा में झुकाव चुपचाप इसके द्वारा चुने गए शब्दों को आकार दे सकता है। इस प्रवृत्ति के बारे में जागरूकता इसके बारे में अलार्म से अधिक उपयोगी है।
सामान्य प्रश्न
क्या इसका मतलब है कि AI चैटबॉट मेरी राजनीति को बदलने की कोशिश करेंगे?
इस अध्ययन से इसका कोई सबूत नहीं है। मॉडलों को एक संरचित क्विज दी गई थी, न कि राय देने के लिए छोड़ा गया। रोजमर्रा के उपयोग में, अधिकांश ये मॉडलों को विवादास्पद विषयों पर तटस्थ रहने के लिए डिजाइन किया गया है।
क्या Political Compass क्विज एक विश्वसनीय वैज्ञानिक परीक्षण है?
विक्टर ने स्वीकार किया कि इस उद्देश्य के लिए यह पूरी तरह से कठोर नहीं है। क्विज के पास कोई प्रकाशित स्कोरिंग फॉर्मूला नहीं है और तुलना करने के लिए कोई समग्र मानव baseline नहीं है। निष्कर्ष सुझावपूर्ण हैं, निर्णायक नहीं।
क्या यह बदल सकता है क्योंकि AI कंपनियां अपने मॉडलों को अपडेट करती हैं?
हां। प्रशिक्षण डेटा विकल्प प्रत्येक नए मॉडल संस्करण के साथ विकसित होते हैं, और कुछ कंपनियां सक्रिय रूप से अपने मॉडलों को राजनीतिक पदों से बचने के लिए ट्यून करती हैं। यहां परिणाम 2025 में परीक्षण किए गए विशिष्ट मॉडल संस्करणों को प्रतिबिंबित करते हैं।



