Google Sigue Luchando Contra Raspadores de IA Después de Derrota Judicial. Por Qué Importa.
Google demandó a SerpApi por raspar y revender sus resultados de búsqueda. Un juez le dio un revés a Google la semana pasada, y Google dice que seguirá adelante de todas formas, con Reddit silenciosamente en el mismo bando.

Puntos clave
- Google presentó una demanda contra SerpApi en diciembre de 2023, acusándola de raspar y revender resultados de búsqueda de Google.
- Google utilizó la DMCA, la Ley de Derechos de Autor del Milenio Digital, una ley normalmente dirigida a piratas de DVD y hackers de transmisión, para argumentar que SerpApi eludió sus defensas contra raspado.
- Un tribunal falló en contra de Google la semana pasada, pero Google confirmó que no abandonará el caso.
- Reddit se unió como parte nombrada con su propio interés en bloquear el raspado no autorizado.
- El resultado podría remodelar cómo las empresas de IA recopilan datos de entrenamiento, y quién paga por ello.
Google recibió un golpe en el tribunal la semana pasada. Un juez falló en su contra en una demanda contra SerpApi, una empresa que extrae datos de los resultados de búsqueda de Google y los empaqueta para que las empresas los utilicen automáticamente, a escala, sin pasar por Google directamente. Google lo llama robo. SerpApi lo llama leer páginas web públicas.
Google confirmó que no se alejará.
¿Exactamente qué hizo SerpApi?
SerpApi vendía lo que comercializaba como una "API de Búsqueda de Google", software que permitía a los clientes que pagan consultar resultados de Google sin la participación o permiso de Google. Google argumentó que SerpApi eludió las barreras técnicas que había construido para detener la cosecha automatizada de exactamente ese tipo.
La demanda se presentó bajo la DMCA, una ley de 1998 que hace ilegal eludir sistemas de protección de derechos de autor. Los tribunales la han aplicado al cifrado de DVD y transmisión pirateada. Google argumentó que su tecnología anti-raspado merece la misma protección.
El contenido en juego va más allá de enlaces azules. Google señaló sus "paneles de conocimiento", los cuadros de información que aparecen en los resultados de personas o empresas conocidas, algunos de los cuales se construyen a partir de contenido con licencia de titulares de derechos de terceros. El raspado de SerpApi, según Google, amenazaba esas relaciones de licencia.
Reddit, que licencia su propio contenido y enfrenta sus propias presiones de raspado, se unió al caso como parte interesada.
¿Por qué se aplica una ley de derechos de autor diseñada para DVD aquí?
Exactamente lo que cuestionó el tribunal. Aplicar la DMCA a un raspador web es inusual, y el escepticismo del juez la semana pasada muestra lo poco probado que sigue siendo la teoría. Google está pidiendo a un tribunal que trate el software anti-bot de la misma manera que el cifrado de DVD. Ningún tribunal ha estado firmemente de acuerdo con eso todavía.
Si Google eventualmente gana, cada sitio web importante ganaría una herramienta legal poderosa para detener que las empresas de IA se entrenen con su contenido sin permiso. Cubrimos la presión relacionada que se acumula en los editores en nuestra historia del 24 de julio sobre qué significa el retroceso de tráfico de Google para la web.
¿Qué significa esto para ti?
Nada cambia para la mayoría de las personas hoy. Pero este caso se sitúa en el centro de una lucha que determina cómo se construyen las herramientas de IA. Los modelos de IA aprenden procesando vastas cantidades de texto raspado de la web. Si los tribunales deciden que raspar resultados de búsqueda infringe la ley de derechos de autor, construir esas herramientas se vuelve significativamente más costoso.
Los costos más altos para las empresas de IA tienden a trasladarse a los usuarios: actualizaciones más lentas, suscripciones más caras, menos competidores. El acuerdo de derechos de autor de Anthropic que reportamos el 21 de julio, pagando a autores $3,000 por libro, es un punto de datos inicial sobre cuál podría ser esa factura.
Como reportó primero Ars Technica, este caso es una de varias pruebas activas sobre quién es dueño de los datos que entrenan la IA.
Mi lectura: el ángulo de la DMCA es un tiro largo, y Google lo sabe. Lo que Google realmente está haciendo es hacer que raspar sea costoso de litigar, lo que puede desalentar a los competidores incluso sin una victoria legal limpia. Si publicas contenido profesionalmente, observa específicamente el argumento del panel de conocimiento. Ese es el hilo más probable que pueda desprenderse.



