Pode a IA desvendar os sistemas de escrita antigos que intrigaram linguistas durante um século?
Dois dos scripts mais misteriosos da história, Linear A e Etrusco, resistiram a todas as tentativas de tradução. Investigadores estão agora a questionar-se se a IA consegue onde os humanos sozinhos não o conseguiram.

Pontos-chave
- Linear A, o sistema de escrita da civilização Minoica da Idade do Bronze em Creta, nunca foi decifrado e não tem ligação confirmada a nenhuma língua conhecida.
- Etrusco, falado em Itália antes do Império Romano, tem um vocabulário parcial, mas a sua gramática permanece desconhecida.
- A maioria dos antigos scripts foram decifrados usando textos bilingues como a Pedra de Roseta; nem Linear A nem Etrusco possuem um.
- Investigadores estão agora a testar se os grandes modelos de linguagem, a tecnologia de IA por trás de ferramentas como ChatGPT, conseguem encontrar padrões que os humanos não conseguiram identificar.
Todos os sistemas de escrita antigos já decifrados tinham algo em que se agarrar. Normalmente é um texto bilíngue, como a Pedra de Roseta, que mostrava o mesmo decreto em três scripts lado a lado. Por vezes é um primo linguístico próximo, uma língua conhecida suficientemente similar para ajudar a preencher as lacunas. Linear A, o sistema de escrita usado pela civilização Minoica na ilha grega de Creta há aproximadamente 3.500 anos, não possui nenhum dos dois.
Os linguistas chamam-lhe uma "língua isolada", significando que não tem ligação confirmada a nenhuma outra língua, viva ou morta. Um século de investigação não a conseguiu desvendar.
Etrusco, a língua falada na Itália central antes de Roma tomar o controlo, encontra-se numa situação ligeiramente melhor. As inscrições funerárias curtas, o equivalente antigo de texto em lápides, deram aos investigadores um vocabulário parcial. Mas a gramática e o significado mais profundo continuam em falta.
Porque é que estas duas línguas são tão difíceis de desvendar?
Sem uma âncora bilíngue ou uma língua relacionada, não há nada para verificar. É como tentar resolver uma palavras-cruzadas sem pistas e sem grelha.
Foram encontrados tabuletas de Linear A, mas a maioria são listas de inventário e registos contabilísticos, não os textos narrativos ricos que ajudaram a desvendar os hieróglifos egípcios. As inscrições etruscas tendem a ser curtas, repetitivas e formulaicas. Nenhuma delas fornece aos investigadores o volume e variedade de texto que os métodos tradicionais precisam.
Como reportado pela Ars Technica, linguistas estão agora a explorar se a IA, especificamente grandes modelos de linguagem treinados em quantidades vastas de texto humano, conseguem identificar padrões estruturais em milhares de inscrições fragmentárias mais rápido do que qualquer equipa humana conseguiria.
Será que a IA consegue realmente ter sucesso onde os humanos não o tiveram?
Possivelmente, para algumas partes do puzzle. A IA é muito boa a encontrar padrões estatísticos em grandes conjuntos de dados. Forneça-lhe todas as inscrições etruscas conhecidas e consegue mapear quais as palavras que se agrupam, quais as formas gramaticais que se repetem, quais os sons que aparecem no início ou fim das palavras. Este é um trabalho de base genuinamente útil.
Mas há um limite real. Um grande modelo de linguagem precisa de algo de que aprender. Com apenas alguns milhares de textos etruscos curtos e zero traduções confirmadas de Linear A, o modelo está a trabalhar com material escasso. Lixo dentro, resultado incerto.
Imagine pedir a um amigo que aprenda uma língua a partir de uma pilha de recibos de caixa e nada mais. Esta é aproximadamente a situação aqui.
O que isto significa para as pessoas comuns?
Nenhuma aplicação lhe fornecerá uma tradução de Linear A na próxima terça-feira. Esta é uma investigação de longo prazo. Mas importa: se a IA ajudar linguistas a reduzir as possibilidades para mesmo um destes scripts, reformula o que sabemos sobre o comércio, religião e cultura da Idade do Bronze no Mediterrâneo.
Questões frequentes
A IA conseguiu desvendar alguma linguagem antiga com sucesso antes?
Investigadores usaram aprendizagem automática, uma forma de IA que encontra padrões em dados, para ajudar a confirmar a relação entre a língua extinta Ugarítica e o Hebraico, e para assistir com glifos Maias. As decifras completas continuaram dependentes em grande medida da expertise humana juntamente com as ferramentas de IA.
Existe uma ferramenta gratuita que qualquer pessoa possa usar para explorar scripts antigos?
Não para trabalho sério de decifração. Projetos académicos e bases de dados universitárias detêm os registos de inscrições, e o acesso é principalmente para investigadores. Os chatbots de IA geral conseguem explicar scripts conhecidos mas não conseguem desvendar scripts desconhecidos.
O que seria necessário para finalmente desvendar Linear A?
Uma inscrição bilíngue mostrando Linear A juntamente com uma língua conhecida seria a rota mais rápida. Na falta disso, um corpo muito maior de texto variado ajudaria enormemente. Nenhum destes apareceu ainda.


