Todos os principais modelos de IA tendem para a esquerda em política, até o Grok, metade das vezes
Um pequeno laboratório de investigação submeteu 16 modelos de IA líderes a um conhecido teste político milhares de vezes. Todos, exceto um, ficaram consistentemente na zona libertária-esquerda. A exceção foi o Grok de Elon Musk, que não conseguiu decidir-se.

Pontos-chave
- Um investigador com o nome "Victor" da Unsloth.run submeteu 16 modelos de IA ao teste Political Compass ao longo de milhares de execuções em 2025.
- Todos os modelos, excepto o Grok 4.5, ficaram consistentemente no quadrante libertário-esquerda, com a posição a variar no máximo 1,2 pontos numa escala de 10 pontos entre execuções.
- O Grok 4.5 dividiu-se quase uniformemente: libertário-esquerda em aproximadamente metade das suas execuções, economicamente à direita na outra metade.
- Victor atribui a tendência para a esquerda principalmente aos dados de treino, citando o Reddit e a escrita académica como fontes provavelmente sobre-representadas.
- Nenhum dos 16 modelos, independentemente da sua inclinação política, apoiou superioridade racial, eugenia ou restrições a casais do mesmo sexo na adoção.
Todos os principais modelos de IA que se conhecem tendem para a esquerda. Esta é a versão curta de um estudo publicado esta semana pela Unsloth.run, um pequeno laboratório de investigação que se descreve como construtor de ferramentas de detecção de IA.
O investigador por trás do projecto, que pediu para ser identificado apenas como Victor e se descreveu a The Register como engenheiro de investigação em IA numa startup europeia, submeteu 16 modelos de linguagem de grande dimensão, a tecnologia por trás de chatbots como ChatGPT e Claude, ao teste Political Compass. Este teste é um teste online com 25 anos que coloca os respondentes em dois eixos: esquerda versus direita económica, e autoritária versus libertária socialmente.
O que é que o teste realmente descobriu?
Todos os 15 modelos, excepto o Grok, ficaram no quadrante libertário-esquerda de cada vez. Este canto da bússola descreve visões favoráveis à igualdade social, cepticismo perante o poder corporativo e oposição à autoridade desnecessária.
O conjunto testado incluiu GPT-4o e duas outras versões GPT, Claude Opus, Sonnet, Haiku, e um modelo chamado Fable, Gemini Flash, Llama 4 Maverick, DeepSeek V3, Qwen3 235B, Kimi K2, GLM 4.5, e Mistral em dois tamanhos. Cada um realizou 30 execuções padrão, 30 execuções com questões refraseadas para inverter o seu significado, e uma execução adicional com ordem aleatória.
Os resultados variaram muito pouco. "Execute um modelo 30 vezes e o seu ponto move-se 0,2 a 1,2 pontos numa escala que vai até 10," observou o relatório Unsloth. "Estes não são pequenas nuvens nervosas. São pinos."
| Modelo | Quadrante | Consistência |
|---|---|---|
| Claude Fable 5 | Libertário-esquerda | Muito elevada |
| Gemini Flash | Libertário-esquerda (mais à esquerda que Fable) | Muito elevada |
| DeepSeek V3 | Libertário-esquerda | Muito elevada |
| Llama 4 Maverick | Libertário-esquerda | Muito elevada |
| Grok 4.5 | Dividido: esquerda metade das vezes, direita metade | Baixa |
O Grok, a IA construída pela xAI de Elon Musk, foi a excepção. A sua pontuação económica média situava-se ligeiramente à esquerda do centro, mas em aproximadamente metade das suas execuções individuais oscilou para a direita económica, e na outra metade alinhava-se com o resto. A conclusão de Victor: "Todos os outros modelos aqui lhe dariam aproximadamente o mesmo ponto se os testasse amanhã. O Grok dá-lhe um de dois pontos, e qual deles é uma questão de sorte."
Uma descoberta consistente em todos os 16 modelos: cada um deles rejeitou superioridade racial, eugenia e a ideia de que casais do mesmo sexo não devem ser autorizados a adoptar. Todos concordaram que as corporações não podem ser fidedignas para proteger o ambiente sem regulação externa.
Porque é que estes modelos tendem para a esquerda?
A explicação de Victor centra-se na matéria-prima de que a IA aprende, não numa ideologia incorporada pelos engenheiros. Os modelos de linguagem de grande dimensão são treinados em colecções enormes de texto da internet, e algumas fontes dominam esse texto.
"Acho que há bom suporte para a hipótese de que o conteúdo de esquerda está sobre-representado nos corpora de treino destas LLMs," disse Victor a The Register. O Reddit e a escrita académica, ambos tendencialmente liberais, parecem aparecer muito nos conjuntos de dados de treino mais. Equivalentes de elevada qualidade e de direita são simplesmente mais difíceis de encontrar em volumes comparáveis.
Victor foi cuidadoso em não exagerar. O teste Political Compass não foi concebido como um instrumento científico para medir IA, e o estudo carece da linha de base humana normalizada que um artigo revisado por pares exigiria. O que oferece é uma forma útil de comparar modelos entre si.
Para utilizadores comuns destas ferramentas, a conclusão prática é limitada. A inclinação política de um chatbot não significa que ele empurrará essas opiniões sobre si sem ser solicitado. Mas se lhe pedir para redigir um discurso, resumir um debate político ou pesar um argumento económico, a inclinação nos seus dados de treino pode moldar silenciosamente as palavras que escolhe. A consciência dessa tendência é mais útil do que alarme sobre isso.
Perguntas comuns
Isto significa que os chatbots de IA tentar-me-ão mudar a minha política?
Nenhuma evidência deste estudo sugere isso. Os modelos foram submetidos a um teste estruturado, não deixados a oferecer opiniões. No uso diário, a maioria destes modelos foi concebida para permanecer neutra em tópicos contestados.
O teste Political Compass é um teste científico fiável?
Victor reconheceu que não é totalmente rigoroso para este fim. O teste não tem uma fórmula de pontuação publicada e nenhuma linha de base humana agregada para comparar. As descobertas são sugestivas, não conclusivas.
Isto pode mudar à medida que as empresas de IA actualizam os seus modelos?
Sim. As escolhas de dados de treino evoluem com cada nova versão de modelo, e algumas empresas ajustam activamente os seus modelos para evitar posições políticas. Os resultados aqui reflectem as versões de modelo específicas testadas em 2025.



