Google Continua a Lutar Contra Web Scrapers de IA Após Derrota Judicial. Eis o Porquê Isso Importa.

Google processou a SerpApi por raspar e revender os seus resultados de pesquisa. Um juiz deu à Google um revés na semana passada, e a Google diz que está a prosseguir de qualquer forma, com o Reddit silenciosamente ao seu lado.

AI2Day NewsdeskUpdated Editor: Lee Brown3 min read
Full-frame edge-to-edge photoreal news-editorial image of an unbranded modern smartphone lying face up on a polished dark wooden desk, screen showing a generic
Share

Pontos-chave

  • Google apresentou uma ação judicial contra a SerpApi em dezembro de 2023, acusando-a de raspar e revender resultados de pesquisa do Google.
  • Google usou a DMCA, a Lei de Direitos de Autor do Milénio Digital, uma lei normalmente orientada para piratas de DVDs e hackers de streaming, para argumentar que a SerpApi contornou as suas defesas anti-raspar.
  • Um tribunal decidiu contra o Google na semana passada, mas o Google confirmou que não desistirá do caso.
  • O Reddit aderiu como parte nomeada com o seu próprio interesse em bloquear a raspadela não autorizada.
  • O resultado pode remodelar a forma como as empresas de IA recolhem dados de treino, e quem paga por isso.

Google sofreu um golpe no tribunal na semana passada. Um juiz decidiu contra a empresa numa ação judicial contra a SerpApi, uma empresa que extrai dados dos resultados de pesquisa do Google e os embrulha para as empresas usarem automaticamente, em grande escala, sem passar pelo Google diretamente. Google chama isso de roubo. SerpApi chama isso de leitura de páginas web públicas.

Google confirmou que não vai recuar.

O que exatamente fez a SerpApi?

A SerpApi vendia o que comercializava como uma "API de Pesquisa do Google", software que permitia aos clientes que pagavam consultar resultados do Google sem o envolvimento ou permissão do Google. Google argumentou que a SerpApi contornou as barreiras técnicas que tinha construído para impedir a colheita automatizada exatamente desse tipo.

A ação foi apresentada sob a DMCA, uma lei de 1998 que torna ilegal contornar sistemas de proteção de cópias. Os tribunais aplicaram-na a encriptação de DVDs e streaming pirateado. Google argumentou que a sua tecnologia anti-raspar merece a mesma proteção.

O conteúdo em jogo vai além de ligações azuis. Google apontou para os seus "painéis de conhecimento", as caixas de informação que aparecem nos resultados para pessoas ou empresas bem conhecidas, algumas das quais são construídas a partir de conteúdo licenciado de proprietários de direitos de terceiros. A raspadela da SerpApi, disse Google, ameaçava essas relações de licenciamento.

Reddit, que licencia o seu próprio conteúdo e enfrenta as suas próprias pressões de raspadela, aderiu ao caso como parte interessada.

Por que uma lei de direitos de autor concebida para DVDs se aplica aqui?

É exatamente o que o tribunal questionou. Aplicar a DMCA a um web scraper é inusitado, e o ceticismo do juiz na semana passada mostra como a teoria permanece testada. Google está a pedir a um tribunal que trate software anti-bot da mesma forma que trata encriptação de DVDs. Nenhum tribunal concordou firmemente com isso ainda.

Se o Google eventualmente ganhar, cada site importante ganharia uma ferramenta legal poderosa para impedir que empresas de IA treinem o seu conteúdo sem permissão. Cobrimos a pressão relacionada a acumular-se sobre editores no nosso artigo de 24 de julho sobre o que a retirada de tráfego do Google significa para a web.

O que isto significa para você?

Nada muda para a maioria das pessoas hoje. Mas este caso está no centro de uma luta que molda a forma como as ferramentas de IA são construídas. Os modelos de IA aprendem processando vastas quantidades de texto raspado da web. Se os tribunais decidirem que raspar resultados de pesquisa viola a lei de direitos de autor, construir essas ferramentas fica significativamente mais caro.

Custos mais altos para empresas de IA tendem a fluir para os utilizadores: atualizações mais lentas, subscrições mais caras, menos concorrentes. O acordo de direitos de autor da Anthropic que reportámos em 21 de julho, pagando aos autores $3.000 por livro, é um ponto de dados antecipado sobre qual poderá ser essa conta.

Como a Ars Technica reportou primeiro, este caso é um dos vários testes em direto sobre quem é proprietário dos dados que treinam a IA.

Minha leitura: o ângulo DMCA é um tiro ao alvo, e Google o sabe. O que Google está realmente a fazer é tornar a raspadela cara de litigar, o que pode desestimular concorrentes mesmo sem uma vitória legal clara. Se publica conteúdo profissionalmente, observe especificamente o argumento do painel de conhecimento. Esse é o fio mais provável de puxar algo.

© 2026 AI2Day