Google continue à combattre les racleurs de données IA après sa défaite judiciaire. Voici pourquoi c'est important.

Google a poursuivi SerpApi pour avoir raclé et revendu ses résultats de recherche. Un juge a infligé un revers à Google la semaine dernière, et Google affirme qu'il poursuivra malgré tout, Reddit se joignant discrètement à l'affaire.

AI2Day NewsdeskUpdated Editor: Lee Brown3 min read
Full-frame edge-to-edge photoreal news-editorial image of an unbranded modern smartphone lying face up on a polished dark wooden desk, screen showing a generic
Share

Points clés

  • Google a poursuivi SerpApi en décembre 2023, l'accusant de racler et de revendre les résultats de recherche Google.
  • Google a invoqué la DMCA, la Loi sur le droit d'auteur du millénaire numérique, une loi normalement destinée aux pirates de DVD et aux pirates du streaming, pour affirmer que SerpApi avait contourné ses défenses anti-raclage.
  • Un tribunal a statué contre Google la semaine dernière, mais Google a confirmé qu'il n'abandonnerait pas l'affaire.
  • Reddit s'est joint en tant que partie nommée avec son propre intérêt à bloquer le raclage non autorisé.
  • L'issue pourrait remodeler la manière dont les entreprises d'IA collectent les données d'entraînement, et qui paie pour cela.

Google a essuyé un revers judiciaire la semaine dernière. Un juge a statué contre lui dans une action en justice contre SerpApi, une entreprise qui extrait les données des résultats de recherche Google et les réempaquet pour les entreprises afin qu'elles les utilisent automatiquement, à grande échelle, sans passer directement par Google. Google appelle cela du vol. SerpApi appelle cela lire des pages web publiques.

Google a confirmé qu'il n'abandonnerait pas.

Qu'exactement SerpApi a-t-il fait ?

SerpApi a vendu ce qu'il commercialisait comme une « API Google Search », un logiciel permettant aux clients payants d'interroger les résultats Google sans l'implication ou la permission de Google. Google a soutenu que SerpApi avait contourné les barrières techniques qu'il avait construites pour empêcher la moisson automatisée de ce type exactement.

La action a été intentée en vertu de la DMCA, une loi de 1998 qui rend illégal de contourner les systèmes de protection des droits d'auteur. Les tribunaux l'ont appliquée au chiffrement des DVD et à la piraterie du streaming. Google a soutenu que sa technologie anti-raclage mérite la même protection.

Le contenu en jeu dépasse les simples liens bleus. Google a pointé ses « panneaux de connaissances », les boîtes d'information apparaissant dans les résultats pour les personnes ou les entreprises bien connues, dont certaines sont construites à partir de contenu sous licence auprès de tiers détenteurs de droits. Le raclage de SerpApi, a dit Google, menaçait ces relations de licence.

Reddit, qui accorde des licences de son propre contenu et fait face à ses propres pressions de raclage, s'est joint à l'affaire en tant que partie intéressée.

Pourquoi une loi sur le droit d'auteur conçue pour les DVD s'applique-t-elle ici ?

C'est exactement ce que le tribunal a remis en question. Appliquer la DMCA à un racleur web est inhabituel, et le scepticisme du juge la semaine dernière montre à quel point la théorie reste inexpérimentée. Google demande à un tribunal de traiter les logiciels anti-bot de la même manière qu'il traite le chiffrement des DVD. Aucun tribunal n'a fermement accepté cela jusqu'à présent.

Si Google finit par gagner, chaque grand site web disposerait d'un outil juridique puissant pour empêcher les entreprises d'IA d'entraîner sur son contenu sans permission. Nous avons couvert les pressions connexes s'accumulant sur les éditeurs dans notre reportage du 24 juillet sur ce que le repli du trafic Google signifie pour le web.

Que signifie cela pour vous ?

Rien ne change pour la plupart des gens aujourd'hui. Mais cette affaire se situe au centre d'une lutte qui façonne la manière dont les outils d'IA sont construits. Les modèles d'IA apprennent en traitant de vastes quantités de texte raclé sur le web. Si les tribunaux décident que le raclage des résultats de recherche viole le droit d'auteur, la construction de ces outils devient beaucoup plus coûteuse.

Les coûts plus élevés pour les entreprises d'IA ont tendance à être répercutés sur les utilisateurs : mises à jour plus lentes, abonnements plus chers, moins de concurrents. Le règlement de droits d'auteur Anthropic que nous avons signalé le 21 juillet, payant aux auteurs 3 000 dollars par livre, est un point de données précoce sur ce que cette facture pourrait ressembler.

Comme Ars Technica l'a d'abord signalé, cette affaire est l'un de plusieurs tests en cours sur qui possède les données qui entraînent l'IA.

Mon interprétation : l'approche DMCA est un long tir, et Google le sait. Ce que Google fait réellement, c'est rendre le raclage coûteux à contester judiciairement, ce qui peut dissuader les concurrents même sans une victoire juridique claire. Si vous publiez du contenu professionnellement, surveillez spécifiquement l'argument du panneau de connaissances. C'est le fil le plus susceptible de dénouer quelque chose.

© 2026 AI2Day