Google продолжает бороться с веб-скреперами AI после судебного поражения. Вот почему это важно.
Google подал в суд на компанию SerpApi за продажу результатов поиска, которые она снимала с Google. На прошлой неделе судья нанес Google значительный удар. Google заявляет, что продолжит борьбу, и Reddit тихо присоединился к процессу.

Ключевые моменты
- Google подал в суд на SerpApi в декабре 2023 года, обвинив компанию в скрейминге и перепродаже результатов своего поиска.
- Google ссылался на DMCA, Закон об авторском праве в цифровую эпоху, закон, обычно используемый для защиты музыки и фильмов от пиратства, утверждая, что SerpApi преодолела его противоскреймовые защиты.
- Суд нанес Google значительный удар на прошлой неделе, но Google подтвердил, что не откажется от иска.
- Reddit участвует как заинтересованная сторона в блокировании несанкционированного скрейминга своего контента.
- Исход дела может повлиять на то, как любая компания AI собирает данные, необходимые для обучения своих систем.
Google потерпел поражение в суде на прошлой неделе. Судья вынес решение против компании в иске, поданном ею против компании SerpApi, которая продает услугу по извлечению данных из результатов поиска Google и упаковывает их для использования предприятиями. Google говорит, что это кража. SerpApi говорит, что просто читает общедоступные веб-страницы.
Несмотря на поражение, Google подтвердил, что будет продолжать борьбу.
Что именно сделала SerpApi?
SerpApi создала продукт, который она позиционировала как "Google Search API", программный инструмент, позволяющий платным клиентам автоматически и в большом масштабе запрашивать результаты поиска Google без прямого контакта с Google. Проблема, по словам Google, в том, что SerpApi преодолела технические барьеры, которые Google создала, чтобы остановить именно такой автоматизированный сбор данных.
Google подал иск в соответствии с DMCA, Законом об авторском праве в цифровую эпоху, законом, принятым в 1998 году, который запрещает обход систем защиты авторских прав. Закон чаще всего используется против людей, которые взламывают шифрование DVD или пиратят потоковые сервисы. Google утверждал, что его технология защиты от скрейминга подпадает под этот вид защиты.
Контент, о котором идет речь, — это не просто синие ссылки. Google выделил свои "информационные панели", информационные поля, которые появляются при поиске известного человека или компании. Часть этой информации лицензирована от владельцев третьих сторон, которые платят за появление своих данных в результатах Google. Google утверждал, что скрейминг SerpApi угрожает этим лицензионным сделкам.
Reddit, который также лицензирует свой контент и имеет собственные проблемы со скреймингом, присоединился к делу как заинтересованная сторона.
Почему закон об авторском праве, разработанный для DVD, применяется здесь?
Именно это и поставил под сомнение суд. Использование DMCA против веб-скреймера — это необычный юридический ход, и скептицизм судьи на прошлой неделе отражает, насколько неопробована эта теория. Google по сути просит суд согласиться с тем, что программное обеспечение против ботов подпадает под систему защиты копий так же, как DVD-шифрование. Ни один суд пока не дал четкого согласия на это.
Если Google в конечном итоге выиграет этот спор, это даст каждому крупному веб-сайту мощный новый инструмент для блокирования компаний AI от обучения на его контенте без разрешения.
Что это означает для вас?
Для большинства людей сегодня ничего не меняется. Но это дело находится в центре борьбы, которая будет определять, как будут строиться инструменты AI завтра. Модели AI, программные системы, стоящие за такими инструментами, как ChatGPT и Gemini от Google, обучаются путем обработки огромных объемов текста, снятого с веб-сайтов. Если суды решат, что скрейминг результатов поиска или в конечном итоге любого веб-сайта нарушает закон об авторском праве, стоимость создания этих инструментов резко возрастает.
Более высокие затраты для компаний AI обычно передаются дальше: медленные обновления продуктов, дорогие подписки или просто меньше оставшихся игроков.
Как первым сообщила Ars Technica, это дело — одно из нескольких испытаний, которые сейчас разворачиваются относительно того, кому принадлежат данные, которые обучают AI.
Честный вывод: если вы управляете веб-сайтом или профессионально создаете контент, следите за этим делом. Он медленно строит правовую базу, которая решит, должны ли компании AI платить за используемые ими данные.



