Google sigue luchando contra los raspadores de IA después de perder en la corte. Aquí te explicamos por qué importa.
Google demandó a una empresa llamada SerpApi por vender resultados de búsqueda que había raspado de Google. Un juez le asestó un golpe a Google la semana pasada. Google dice que continuará de todas formas, y Reddit se ha unido silenciosamente a la batalla.

Puntos clave
- Google presentó una demanda contra SerpApi en diciembre de 2023, acusando a la empresa de raspar y revender sus resultados de búsqueda.
- Google invocó la DMCA, la Ley de Derechos de Autor del Milenio Digital, una ley que generalmente se utiliza para proteger la música y las películas de la piratería, para argumentar que SerpApi rompió sus defensas contra el raspado.
- Un tribunal le asestó a Google un golpe significativo la semana pasada, pero Google confirmó que no abandonará el caso.
- Reddit está involucrado como parte nombrada con interés en bloquear el raspado no autorizado de su contenido.
- El resultado podría afectar cómo cualquier empresa de IA recopila los datos que necesita para entrenar sus sistemas.
Google recibió un golpe en la corte la semana pasada. Un juez falló en su contra en una demanda que había presentado contra una empresa llamada SerpApi, que vende un servicio que extrae datos de los resultados de búsqueda de Google y los empaqueta para que las empresas los utilicen. Google dice que eso es robo. SerpApi dice que simplemente está leyendo páginas web públicamente disponibles.
A pesar de la pérdida, Google confirmó que seguirá luchando.
¿Qué exactamente hizo SerpApi?
SerpApi creó un producto que comercializó como una "API de búsqueda de Google", un software que permite a los clientes que pagan consultar automáticamente los resultados de búsqueda de Google, a escala, sin pasar directamente por Google. El problema, según Google, es que SerpApi rompió las barreras técnicas que Google había construido para evitar exactamente ese tipo de recopilación automatizada.
Google presentó la demanda bajo la DMCA, la Ley de Derechos de Autor del Milenio Digital, una ley aprobada en 1998 que hace ilegal eludir sistemas de protección de derechos de autor. La ley se usa más frecuentemente contra personas que descifran el cifrado de DVD o que pirateaban servicios de transmisión. Google argumentó que su tecnología anti-raspado cuenta como ese tipo de protección.
El contenido en cuestión no son solo enlaces azules. Google destacó sus "paneles de conocimiento", los cuadros de información que aparecen cuando buscas a una persona o empresa bien conocida. Parte de esa información tiene licencia de terceros titulares de derechos que pagan para que sus datos aparezcan en los resultados de Google. Google argumentó que el raspado de SerpApi amenazaba esos acuerdos de licencia.
Reddit, que también licencia su contenido y tiene sus propias preocupaciones sobre el raspado, se unió al caso como parte interesada.
¿Por qué se aplica una ley de derechos de autor diseñada para DVD aquí?
Eso es exactamente lo que cuestionó la corte. Usar la DMCA contra un raspador web es un movimiento legal inusual, y el escepticismo del juez la semana pasada refleja lo poco probado que es esta teoría. Google esencialmente le pide a un tribunal que acuerde que el software anti-bots cuenta como un sistema de protección de copia de la misma manera que hace el cifrado de DVD. Ningún tribunal ha dicho claramente que sí a eso todavía.
Si Google eventualmente gana ese argumento, le daría a cada sitio web importante una herramienta nueva y poderosa para bloquear a las empresas de IA de entrenar con su contenido sin permiso.
¿Qué significa esto para ti?
Para la mayoría de las personas, nada cambia hoy. Pero el caso se sitúa en el centro de una batalla que moldeará cómo se construirán las herramientas de IA mañana. Los modelos de IA, los motores de software detrás de herramientas como ChatGPT y Gemini de Google, aprenden procesando enormes cantidades de texto raspado de la web. Si los tribunales deciden que raspar resultados de búsqueda, o eventualmente cualquier sitio web, infringe la ley de derechos de autor, el costo de construir esas herramientas aumenta considerablemente.
Los costos más altos para las empresas de IA tienden a fluir hacia abajo: actualizaciones de productos más lentas, suscripciones más caras, o simplemente menos jugadores que permanezcan en pie.
Como informó Ars Technica en primer lugar, este caso es uno de varios que se están desarrollando en este momento sobre quién posee los datos que entrenan la IA.
La conclusión honesta: si diriges un sitio web o creas contenido profesionalmente, sigue este caso. Está construyendo lentamente el marco legal que decidirá si las empresas de IA tienen que pagar por los datos que utilizan.



