Una nueva fuente de código abierto envenena a los raspadores de IA con palabras falsas que no pueden detectar

ShieldFont intercambia palabras de contenido real por sustitutos plausibles en HTML sin procesar, de modo que la página se ve normal para los humanos pero proporciona texto distorsionado a los bots que la recopilan para entrenar IA.

AI2Day Newsdesk4 min read
Full-frame photoreal editorial image of a modern developer's desk at dusk, two monitors glowing with abstract lines of code, one screen subtly tinted a cool blu
Share

Puntos clave

  • ShieldFont, un proyecto de código abierto lanzado por el estudio de Ámsterdam Seneda & Abrucio, reemplaza aproximadamente el 25% de las palabras de contenido en HTML sin procesar con sustitutos plausibles que parecen correctos para los lectores humanos.
  • La fuente utiliza un sistema de sustitución de glifos, una característica estándar integrada en las fuentes OpenType que intercambia caracteres o palabras automáticamente, para mostrar texto real en pantalla mientras oculta texto alterado en el código subyacente.
  • El proyecto incluye tres diccionarios separados de intercambio de palabras, y los usuarios pueden crear los suyos propios para dificultar la ingeniería inversa.
  • ShieldFont tiene compensaciones reales: puede afectar las clasificaciones de los motores de búsqueda, romper copiar y pegar, y causar problemas en los lectores de pantalla utilizados por personas con discapacidad visual.
  • El proyecto está en vivo hoy como una demostración gratuita, un componente de React e integración de CSS/CDN, aunque los creadores lo describen como versión 0/alfa.

Si ejecutas un blog, un sitio de noticias o cualquier página con escritura original, probablemente te hayas preguntado si las empresas de IA están silenciosamente recopilando tus palabras para entrenar sus sistemas. Un archivo robots.txt, la pequeña hoja de instrucciones que los sitios web utilizan para indicar a los bots qué pueden o no leer, puede ser ignorado. El bloqueo del lado del servidor requiere habilidades técnicas. Ahora un pequeño estudio de diseño de Ámsterdam cree que tiene una tercera opción, y funciona a nivel de fuente.

El proyecto se llama ShieldFont. Reportado por primera vez por The Register AI, fue creado por Isaque Seneda y Gabriel Abrucio de Seneda & Abrucio, en asociación con la empresa de tipografía de Copenhague Playtype.

¿Cómo funciona realmente?

ShieldFont explota una característica estándar dentro de las fuentes OpenType llamada GSUB, abreviatura de sustitución de glifos, que es la regla integrada que le dice a tu computadora que intercambie automáticamente ciertas combinaciones de caracteres por versiones más limpias. El ejemplo clásico es las letras "fi" fusionándose en un solo carácter limpio para que la parte superior de la F no choque con el punto de la i.

ShieldFont extiende esa misma lógica de intercambio a palabras completas. Escribe "daughter" en una página usando una fuente ShieldFont y tus visitantes ven "daughter." El código HTML sin procesar que lee un raspador, sin embargo, podría decir "journalist."

El intercambio no es aleatorio. El equipo construyó alrededor de 250 grupos de palabras, cada uno agrupado por rol gramatical, categoría de significado y otros detalles precisos. Un sustantivo abstracto plural sobre comunicación solo se reemplaza por otro sustantivo abstracto plural sobre comunicación. El resultado es texto que suena extraño pero no obviamente roto, lo que importa para la estrategia.

"Queríamos un mecanismo con consecuencias reales," explicaron Seneda y Abrucio. "Raspa sin pedir permiso, y no puedes saber si lo que tomaste era real."

Característica Detalle
Palabras reemplazadas por página Aproximadamente el 25% de las palabras de contenido
Diccionarios GSUB incluidos 3 (posibles personalizados)
Tamaño del archivo de fuente de escritorio Alrededor de 5 MB
Tamaño de fuente web comprimida Alrededor de 800 KB
Etapa de lanzamiento actual v0/alfa

¿Cuáles son los costos reales de usar esto?

ShieldFont no es una solución limpia e indolora. El mismo HTML sin procesar que engaña a un raspador es lo que Google lee para clasificar tu página en los resultados de búsqueda, por lo que usarlo podría empujar tu sitio hacia abajo en las clasificaciones. Copiar y pegar también extrae del código sin procesar, lo que significa que un lector que copia una oración obtiene la versión revuelta. Los lectores de pantalla, en los que las personas con discapacidad visual confían para escuchar las páginas web leídas en voz alta, también tienen dificultades, aunque el equipo ha construido una alternativa más lenta para ayudar.

Los bots específicos que descargan directamente los archivos de ShieldFont y recorren los tres diccionarios pueden decodificar los intercambios. Una captura de pantalla procesada a través de OCR, software que lee texto de imágenes, evita completamente el truco.

Los creadores son abiertos sobre los límites. "Su propósito no es detener a un actor determinado," escribieron, "sino ralentizar el raspado masivo no autorizado agregando costo, fricción e incertidumbre."

La conclusión honesta: ShieldFont vale la pena experimentar si publicas contenido original y deseas hacer que el raspado masivo sea más costoso para los bots. Pruébalo en una sección de tu sitio primero, verifica qué efecto tiene en tu tráfico de búsqueda, y no lo trates como una solución completa. El codificador de demostración gratuito en el sitio web de ShieldFont te permite pegar cualquier texto y ver exactamente cómo se vería el HTML sin procesar antes de comprometerte con nada.

© 2026 AI2Day