As alegações de abertura da IA chinesa não resistem ao escrutínio

Uma ferramenta de IA em geociências promovida como "aberta" numa grande conferência global falha testes básicos de abertura genuína. Investigadores dizem que o mesmo problema é mais generalizado na China.

AI2Day Newsdesk3 min read
US Capitol building under a cloudy sky, symbolizing legislative deadlock on surveillance laws
Share

Pontos-chave

  • GeoGPT, um sistema de IA em geociências da China, foi apresentado na Conferência Mundial de IA em julho de 2025 como exemplo de IA aberta e governada conjuntamente.
  • Segundo o "modelo de abertura" aprovado num relatório recente da ONU, GeoGPT não se qualificaria como aberto.
  • Os pesos do modelo subjacente de GeoGPT baseiam-se principalmente em Qwen, da Alibaba, cujas licenças não cumprem a norma Open Systems Interconnection para verdadeira abertura.
  • Nem os dados de treino de GeoGPT nem o seu código-fonte de aplicação foram divulgados publicamente.
  • A sua comissão de governança reporta ao próprio Zhejiang Lab, não a um organismo independente.

Os laboratórios de IA da China genuinamente ofereceram ao mundo algumas ferramentas impressionantes e livremente disponíveis. Qwen, DeepSeek e Kimi, três grandes modelos de linguagem (a tecnologia que alimenta chatbots como ChatGPT), provêm de equipas chinesas e foram lançados de forma a permitir que programadores em todo o mundo os descarreguem e executem. Para investigadores no mundo em desenvolvimento que trabalham com computadores modestos, isso é muito importante.

Mas "lançado abertamente" e "verdadeiramente aberto" não são a mesma coisa. Essa distinção está no cerne de um debate que se desenrola nas páginas do The Guardian e além.

O que é GeoGPT e por que é importante?

GeoGPT é um sistema de IA construído para investigação em geociências pelo Zhejiang Lab, um instituto de investigação apoiado pelo Estado chinês. No mês passado, na Conferência Mundial de IA, foi apresentado como modelo de ciência aberta e governada conjuntamente. Governos do mundo em desenvolvimento foram convidados a tratá-lo como um recurso partilhado.

O problema: não cumpre a definição padrão de "aberto" que especialistas independentes e um relatório recente da ONU aprovaram.

Segundo o modelo de abertura, um sistema de IA genuinamente aberto deve divulgar os seus pesos de modelo (as configurações internas que fazem a IA funcionar), os seus dados de treino e o seu código-fonte. GeoGPT divulga apenas os pesos, e até esses vêm com ressalvas: assentam sobre o modelo Qwen da Alibaba, que utiliza licenças que não cumprem a norma Open Systems Interconnection, uma referência amplamente reconhecida para software aberto. Sem dados de treino. Sem código-fonte. E a comissão que supostamente governa o projeto responde ao próprio Zhejiang Lab.

Isto é menos "ciência aberta" e mais "mais ou menos aberta, nos nossos termos".

É apenas um problema da China?

Não, e os investigadores que levantam o alerta têm cuidado em afirmá-lo. Académicos que escrevem em resposta a um artigo do embaixador chinês no Reino Unido apontam que a diferença entre "aberto" como palavra de marketing e "aberto" como norma técnica existe em toda a indústria.

Muitos laboratórios ocidentais também divulgam pesos de modelo enquanto mantêm dados de treino fechados. O argumento para abertura genuína, incluindo normas partilhadas que qualquer IA de qualquer país deve cumprir para reclamar esse rótulo, é um que se aplica em todo o lado.

Para utilizadores comuns, a conclusão prática é simples. Quando uma ferramenta de IA é descrita como "aberta", vale a pena perguntar: aberta como? Pode alguém inspecionar os dados de que aprendeu? Pode alguém auditar quem a controla? Se as respostas não forem claras, a palavra "aberta" está a fazer muito trabalho.

Perguntas frequentes

Por que é importante se os dados de treino de IA são públicos?

Se ninguém fora do laboratório conseguir ver que dados uma IA aprendeu, ninguém pode verificar se contém enviesamentos, erros ou informações restritas. A transparência sobre dados de treino é uma das principais formas pelas quais investigadores e reguladores responsabilizam sistemas de IA.

O que é o modelo de abertura?

É uma norma para avaliar quão genuinamente aberto é um sistema de IA, abrangendo pesos, dados de treino, código-fonte e governança. Um relatório recente da ONU aprovouá como referência, o que significa que mais organismos internacionais estão a começar a utilizá-la ao avaliar ferramentas de IA promovidas para uso global.

© 2026 AI2Day