Google продовжує боротися з AI веб-скреперами після судового програшу. Ось чому це важливо.
Google подав в суд на компанію SerpApi за продаж результатів пошуку, які вона скреймила з Google. Суддя нанес Google значну поразку минулого тижня. Google заявляє, що продовжує боротися, а Reddit тихо приєднався до цієї боротьби.

Ключові моменти
- Google подав позов проти SerpApi у грудні 2023 року, звинувативши компанію у скреймингу та перепродажу результатів пошуку.
- Google посилався на DMCA, Закон про авторське право тисячоліття, закон, який зазвичай використовується для захисту музики та фільмів від піратства, стверджуючи, що SerpApi порушила його антискреймінгові захисти.
- Суд нанес Google значну поразку минулого тижня, але Google підтвердила, що не відмовиться від справи.
- Reddit залучена як зацікавлена сторона з правом блокувати несанкціонований скреймінг її контенту.
- Результат може вплинути на те, як будь-яка AI компанія збирає дані, необхідні їй для навчання своїх систем.
Google отримала удар в суді минулого тижня. Суддя виніс рішення проти неї в позові, поданому проти компанії SerpApi, яка продає послугу, що витягує дані з результатів пошуку Google та пакує їх для використання бізнесом. Google стверджує, що це крадіжка. SerpApi стверджує, що це просто читання публічно доступних веб-сторінок.
Незважаючи на програш, Google підтвердила, що продовжить боротьбу.
Що саме зробила SerpApi?
SerpApi розробила продукт, який вона позиціонувала як "Google Search API", програмне забезпечення, яке дозволяє платним клієнтам автоматично, в масштабах, запитувати результати пошуку Google без прямого звернення до Google. Проблема, за словами Google, полягає в тому, що SerpApi порушила технічні бар'єри, які Google встановила, щоб запобігти саме такому автоматизованому збиранню даних.
Google подав позов на підставі DMCA, Закону про авторське право тисячоліття, закону, прийнятого в 1998 році, який забороняє обходити системи захисту від копіювання. Закон найчастіше використовується проти людей, які зламують шифрування DVD або займаються піратством потокових сервісів. Google стверджувала, що її антискреймінгові технології відповідають цьому виду захисту.
На карту поставлено не просто сині посилання. Google висвітлила свої "панелі знань", інформаційні вікна, які з'являються при пошуку добре відомої особи або компанії. Деяка з цієї інформації ліцензується від власників прав третіх сторін, які платять за те, щоб їхні дані з'являлися в результатах пошуку Google. Google стверджувала, що скреймінг SerpApi загрожує цим угодам про ліцензування.
Reddit, який також ліцензує свій контент і має власні проблеми зі скреймінгом, приєднався до справи як зацікавлена сторона.
Чому закон про авторське право, розроблений для DVD, застосовується тут?
Саме це і поставило під сумнів суд. Використання DMCA проти веб-скреймера — це незвичайний юридичний крок, а скептицизм судді на минулому тижні відображає те, наскільки невипробуваною є ця теорія. Google по суті просить суд погодитися, що антибот-софт входить до категорії систем захисту від копіювання так само, як і шифрування DVD. Жодний суд дотепер чітко на це не погодився.
Якщо Google врешті переможе у цьому аргументі, це дасть кожному великому веб-сайту потужний новий інструмент для блокування AI компаній від навчання на їхньому контенті без дозволу.
Що це означає для вас?
Для більшості людей сьогодні нічого не змінюється. Але справа перебуває в центрі боротьби, яка визначатиме, як будуватимуться AI інструменти завтра. AI моделі, програмні двигуни інструментів на кшталт ChatGPT та Gemini від Google, навчаються шляхом обробки величезних обсягів тексту, скребленого з веб-сайтів. Якщо суди вирішать, що скреймінг результатів пошуку або, врешті-решт, будь-якого веб-сайту порушує авторське право, вартість розробки цих інструментів значно зростає.
Вищі витрати для AI компаній зазвичай переходять далі: повільніші оновлення продуктів, дорожчі підписки або просто менше гравців, які залишаються на ринку.
За даними Ars Technica, ця справа — одна з кількох випробувань, які сьогодні розгортаються щодо того, кому належать дані, які навчають AI.
Чесна висновок: якщо ви керуєте веб-сайтом або професійно створюєте контент, спостерігайте за цією справою. Вона повільно будує юридичну базу, яка визначатиме, чи повинні AI компанії платити за дані, які вони використовують.



