Este Tipo de Letra Torna as Páginas Web Ilegíveis para Raspadores de IA, mas Normal para Humanos
Dois designers criaram um tipo de letra que substitui secretamente palavras no código que empresas de IA recolhem, mantendo a página perfeitamente normal para leitores comuns.

Pontos-chave
- ShieldFont, criada pelos designers Isaque Seneda e Gabriel Abrucio, substitui palavras reais por palavras sem sentido no código subjacente que os raspadores de IA recolhem.
- Os visitantes humanos veem uma página normal e legível porque a troca de palavras só ocorre após o tipo de letra desenhar o texto no ecrã.
- O tipo de letra utiliza uma funcionalidade chamada ligaduras, que a maioria dos tipos de letra já inclui, para desencadear as substituições.
- Os designers publicaram um documento técnico descrevendo ShieldFont como uma forma prática para proprietários de websites bloquearem a recolha não autorizada de dados de treino de IA.
Dois designers criaram um tipo de letra que consegue um truque discreto: mostrar uma coisa aos leitores humanos e fornecer algo completamente diferente ao software que as empresas de IA utilizam para recolher texto da web.
O tipo de letra chama-se ShieldFont. Os designers Isaque Seneda e Gabriel Abrucio descrevem-no num documento técnico publicado recentemente como uma ferramenta para dar aos editores web "uma opção prática de exclusão do treino de IA não autorizado" e para "interromper o que é recolhido quando essa escolha é ignorada".
Como funciona realmente?
ShieldFont embaralha as palavras que os raspadores de IA recolhem, mas apenas após o navegador de um humano já ter desenhado a página, pelo que o leitor nunca nota nada errado.
O truque baseia-se numa funcionalidade de tipo de letra há muito estabelecida chamada ligaduras. Na maioria dos tipos de letra, as ligaduras são coisas modestas e úteis: arrumam certas combinações de letras que parecem estranhas lado a lado. ShieldFont reutiliza esse mesmo mecanismo para fazer algo muito mais engenhoso. Em vez de arrumar duas letras, substitui palavras inteiras por outras diferentes e sem sentido no momento em que o motor do tipo de letra renderiza a página.
Este é o detalhe-chave. As empresas de IA recolhem dados de treino enviando programas automatizados, chamados raspadores ou crawlers, para descarregar o código fonte bruto das páginas web. Esse código fonte é recolhido antes de um navegador fazer qualquer coisa com ele. As substituições de ShieldFont só ocorrem durante a etapa de desenho, portanto o raspador recolhe o texto original adulterado. Uma pessoa que visita a mesma página vê a versão corretamente renderizada.
Em termos simples: a página diz "cavalo" no código que o raspador copia, mas o seu navegador desenha "batata" no ecrã. Ou vice-versa. De qualquer forma, o raspador sai com lixo.
Isto realmente para empresas de IA?
ShieldFont torna o texto recolhido muito menos útil, mas é apenas uma camada de defesa, não um escudo completo.
Os modelos de IA, sendo os modelos linguísticos grandes a tecnologia por trás de chatbots como ChatGPT e Claude, são treinados com enormes quantidades de texto raspado da web pública. Editores e autores já processaram várias empresas de IA por esta prática, e alguns sites adicionaram instruções técnicas a dizer aos crawlers para se afastarem. ShieldFont oferece uma abordagem diferente: em vez de pedir aos raspadores que saiam, envenena o que levam se ignorarem o pedido.
A ressalva, conforme reportado pela Ars Technica, é que um raspador determinado poderia potencialmente usar um navegador headless, software que executa silenciosamente um navegador completo em segundo plano, para recolher texto após renderização em vez de antes. A proteção de ShieldFont colapsaria nesse cenário. Os designers reconhecem que o tipo de letra funciona melhor como parte de uma estratégia mais ampla, não como correção isolada.
Para proprietários de websites preocupados com o seu conteúdo ser utilizado para treinar IA sem permissão, ShieldFont é um passo extra de baixo esforço que vale a pena acompanhar. Não requer alterações no servidor e nenhuma ação do utilizador.
Perguntas comuns
Isto afetará como o meu website parece aos visitantes?
Não. Os leitores veem uma página completamente normal. As substituições de palavras existem apenas no código bruto, que os visitantes comuns nunca consultam.
As empresas de IA conseguem contornar isto?
Potencialmente sim. Um raspador que executa um navegador completo antes de recolher texto contornaria a proteção. ShieldFont é mais eficaz combinado com outras medidas, como regras robots.txt que instruem os crawlers a afastarem-se.



