Tous les grands modèles d'IA penchent à gauche en politique, même Grok, la moitié du temps
Un petit laboratoire de recherche a soumis 16 modèles d'IA de premier plan à un quiz politique bien connu des milliers de fois. Tous sauf un se sont retrouvés systématiquement dans la zone libertarienne-gauche. L'exception était Grok d'Elon Musk, qui ne pouvait pas se décider.

Points clés
- Un chercheur se faisant appeler « Victor » chez Unsloth.run a soumis 16 modèles d'IA au quiz Political Compass lors de milliers d'exécutions en 2025.
- Tous les modèles sauf Grok 4.5 se sont retrouvés systématiquement dans le quadrant libertarien-gauche, avec une position ne variant que de 1,2 points maximum sur une échelle de 10 points entre les exécutions.
- Grok 4.5 s'est divisé presque équitablement : libertarien-gauche dans environ la moitié de ses exécutions, économiquement de droite dans l'autre moitié.
- Victor attribue l'inclinaison vers la gauche principalement aux données d'entraînement, citant Reddit et les écrits académiques comme sources probablement surreprésentées.
- Aucun des 16 modèles, indépendamment de leur orientation politique, ne soutient la supériorité raciale, l'eugénisme ou les restrictions pour les couples homosexuels à adopter.
Chaque grand modèle d'IA que vous pouvez nommer penche à gauche. C'est la version courte d'une étude publiée cette semaine par Unsloth.run, un petit laboratoire de recherche selon ses propres termes qui crée des outils de détection d'IA.
Le chercheur derrière le projet, qui a demandé à être identifié uniquement comme Victor et s'est décrit auprès de The Register comme un ingénieur en recherche IA dans une startup européenne, a soumis 16 grands modèles de langage, la technologie derrière des chatbots comme ChatGPT et Claude, au quiz Political Compass. Ce quiz est un test en ligne vieux de 25 ans qui situe les répondants sur deux axes : économiquement gauche par rapport à droite, et socialement autoritaire par rapport à libertarien.
Qu'a réellement trouvé le quiz ?
Les 15 modèles sauf Grok se sont retrouvés dans le quadrant libertarien-gauche à chaque fois. Ce coin de la boussole décrit les opinions favorisant l'égalité sociale, le scepticisme envers le pouvoir des entreprises et l'opposition à l'autorité inutile.
La sélection testée comprenait GPT-4o et deux autres versions de GPT, Claude Opus, Sonnet, Haiku, et un modèle appelé Fable, Gemini Flash, Llama 4 Maverick, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5, et Mistral en deux tailles. Chacun a participé à 30 exécutions standard, 30 exécutions avec des questions reformulées pour inverser leur sens, et une exécution supplémentaire mélangée.
Les résultats ont à peine bougé. « Relancez un modèle 30 fois et son point se déplace de 0,2 à 1,2 points sur une échelle qui va jusqu'à 10 », a noté le rapport Unsloth. « Ce ne sont pas de petits nuages nerveux. Ce sont des épingles. »
| Modèle | Quadrant | Cohérence |
|---|---|---|
| Claude Fable 5 | Libertarien-gauche | Très élevée |
| Gemini Flash | Libertarien-gauche (plus à gauche que Fable) | Très élevée |
| DeepSeek V3 | Libertarien-gauche | Très élevée |
| Llama 4 Maverick | Libertarien-gauche | Très élevée |
| Grok 4.5 | Divisé : gauche la moitié du temps, droite l'autre moitié | Faible |
Grok, l'IA construite par xAI d'Elon Musk, était l'exception. Son score économique moyen se situait juste à gauche du centre, mais lors d'environ la moitié de ses exécutions individuelles, il a basculé vers la droite économique, et dans l'autre moitié, il s'est aligné sur le reste. La conclusion de Victor : « Chaque autre modèle ici vous donnerait à peu près le même point si vous le testiez demain. Grok vous donne l'un de deux points, et lequel dépend du hasard. »
Une découverte constante parmi les 16 modèles : chacun a rejeté la supériorité raciale, l'eugénisme et l'idée que les couples homosexuels ne devraient pas être autorisés à adopter. Tous ont convenu que les entreprises ne peuvent pas être fiées pour protéger l'environnement sans régulation externe.
Pourquoi ces modèles penchent-ils à gauche ?
L'explication de Victor porte sur la matière première à partir de laquelle l'IA apprend, non sur une idéologie intégrée par les ingénieurs. Les grands modèles de langage sont entraînés sur d'énormes collections de textes provenant d'Internet, et certaines sources dominent ce texte.
« Je pense vraiment qu'il existe de bonnes preuves à l'appui de l'hypothèse que le contenu de gauche est surreprésenté dans les corpus d'entraînement de ces LLM », a dit Victor à The Register. Reddit et les écrits académiques, qui ont tous deux une tendance libérale, apparaissent abondamment dans la plupart des ensembles de données d'entraînement. Les équivalents de qualité élevée penchant à droite sont simplement plus difficiles à trouver en volumes comparables.
Victor a été prudent de ne pas surévaluer. Le quiz Political Compass n'a pas été conçu comme un instrument scientifique pour mesurer l'IA, et l'étude manque de la ligne de base humaine normalisée qu'exigerait un article évalué par les pairs. Ce qu'il offre, selon Victor, c'est un moyen utile de comparer les modèles les uns aux autres.
Pour les utilisateurs ordinaires de ces outils, la conclusion pratique est limitée. L'inclinaison politique d'un chatbot ne signifie pas qu'il vous imposera ces opinions sans vous le demander. Mais si vous lui demandez de rédiger un discours, de résumer un débat politique ou d'évaluer un argument économique, l'inclinaison de ses données d'entraînement pourrait façonner silencieusement les mots qu'il choisit. La conscience de cette tendance est plus utile que l'alarme à ce sujet.
Questions fréquemment posées
Cela signifie-t-il que les chatbots d'IA vont essayer de changer ma politique ?
Aucune preuve de cette étude ne suggère cela. Les modèles ont reçu un quiz structuré, non libérés pour offrir leurs opinions. Dans l'utilisation quotidienne, la plupart de ces modèles sont conçus pour rester neutres sur les sujets contestés.
Le quiz Political Compass est-il un test scientifique fiable ?
Victor a reconnu qu'il n'est pas entièrement rigoureux pour ce but. Le quiz n'a pas de formule de notation publiée et aucune ligne de base humaine agrégée pour le comparer. Les résultats sont suggestifs, non concluants.
Cela pourrait-il changer à mesure que les entreprises d'IA mettent à jour leurs modèles ?
Oui. Les choix de données d'entraînement évoluent avec chaque nouvelle version de modèle, et certaines entreprises accordent activement leurs modèles pour éviter les positions politiques. Les résultats ici reflètent les versions de modèles spécifiques testées en 2025.



