Google continua a combattere i scraper web di AI dopo la sconfitta in tribunale. Ecco perché è importante.
Google ha citato in giudizio SerpApi per aver raschiato e rivenduto i suoi risultati di ricerca. Un giudice ha inflitto a Google una battuta d'arresto la scorsa settimana, e Google dice che andrà avanti comunque, con Reddit silenziosamente al suo fianco.

Punti chiave
- Google ha intentato una causa contro SerpApi nel dicembre 2023, accusandola di raschiare e rivendere i risultati di ricerca di Google.
- Google ha utilizzato il DMCA, il Digital Millennium Copyright Act, una legge normalmente rivolta ai pirati di DVD e agli hacker di streaming, per sostenere che SerpApi ha violato le sue difese anti-scraping.
- Un tribunale ha emesso un verdetto contrario a Google la scorsa settimana, ma Google ha confermato che non abbandonerà il caso.
- Reddit si è unito come parte interessata con il suo interesse nel bloccare lo scraping non autorizzato.
- L'esito potrebbe rimodellare il modo in cui le aziende di AI raccolgono i dati di addestramento, e chi li paga.
Google ha subito una sconfitta in tribunale la scorsa settimana. Un giudice ha emesso un verdetto contrario a Google in una causa contro SerpApi, un'azienda che estrae dati dai risultati di ricerca di Google e li confeziona affinché le aziende li utilizzino automaticamente, su larga scala, senza passare direttamente per Google. Google lo chiama furto. SerpApi lo chiama leggere pagine web pubbliche.
Google ha confermato che non si tirerà indietro.
Cosa esattamente ha fatto SerpApi?
SerpApi ha venduto quella che commercializzava come una "Google Search API", software che permetteva ai clienti paganti di interrogare i risultati di Google senza il coinvolgimento o il permesso di Google. Google ha sostenuto che SerpApi ha violato le barriere tecniche che aveva costruito per fermare la raccolta automatica di esattamente quel tipo di dati.
La causa è stata intentata secondo il DMCA, una legge del 1998 che rende illegale aggirare i sistemi di protezione dei diritti d'autore. I tribunali l'hanno applicata alla crittografia dei DVD e allo streaming piratato. Google ha sostenuto che la sua tecnologia anti-scraping merita la stessa protezione.
Il contenuto in gioco va oltre i semplici link blu. Google ha puntato ai suoi "knowledge panel", le caselle informative che compaiono nei risultati per persone o aziende note, alcune delle quali costruite da contenuti concessi in licenza da detentori di diritti terzi. Lo scraping di SerpApi, ha affermato Google, minaccia queste relazioni di licenza.
Reddit, che concede in licenza i propri contenuti e affronta le sue stesse pressioni di scraping, si è unito al caso come parte interessata.
Perché una legge sul diritto d'autore progettata per i DVD si applica qui?
È esattamente quello che il tribunale ha messo in discussione. L'applicazione del DMCA a uno scraper web è inusuale, e lo scetticismo del giudice la scorsa settimana mostra quanto la teoria rimane ancora non testata. Google sta chiedendo a un tribunale di trattare il software anti-bot nello stesso modo in cui tratta la crittografia dei DVD. Nessun tribunale ha ancora concordato fermamente con questo.
Se Google alla fine vince, ogni grande sito web otterrebbe uno strumento legale potente per fermare le aziende di AI che si allenano sui loro contenuti senza permesso. Abbiamo coperto la pressione correlata che si accumula sui publisher nella nostra storia del 24 luglio su cosa significa il ritiro del traffico di Google per il web.
Cosa significa questo per te?
Nulla cambia per la maggior parte delle persone oggi. Ma questo caso si trova al centro di una lotta che modella il modo in cui gli strumenti di AI vengono costruiti. I modelli di AI imparano elaborando vaste quantità di testo raschiato dal web. Se i tribunali decidono che raschiare i risultati di ricerca viola il diritto d'autore, costruire questi strumenti diventa significativamente più costoso.
I costi più elevati per le aziende di AI tendono a ricadere sugli utenti: aggiornamenti più lenti, abbonamenti più cari, meno concorrenti. L'accordo sulla proprietà intellettuale di Anthropic che abbiamo riferito il 21 luglio, pagando agli autori 3.000 dollari per libro, è un primo indicatore di quale potrebbe essere questo conto.
Come ha riferito per primo Ars Technica, questo caso è uno di diversi test attivi su chi possiede i dati che addestrano l'AI.
La mia lettura: l'angolo DMCA è un colpo lungo, e Google lo sa. Quello che Google sta veramente facendo è rendere il scraping costoso da contenzioso, il che potrebbe scoraggiare i concorrenti anche senza una vittoria legale netta. Se pubblichi contenuti professionalmente, osserva specificamente l'argomento del knowledge panel. Questo è il filo più probabile che potrebbe tirare qualcosa.



