Google построила себя на скрейпинге. Суд разрешил скрейпить Google
Суд отклонил DMCA-иск Google против скрейпера SerpApi. «Google и Reddit не владеют интернетом» — отвечает компания. Что это значит для войн за данные.

Есть особый сорт иронии в том, что компания, построившая триллионный бизнес на сканировании чужого контента без спроса, идёт в суд жаловаться на скрейпинг. На этой неделе ирония материализовалась в судебное решение: иск Google против SerpApi по закону DMCA практически развалился, и теперь скрейпер празднует победу фразой, которая явно метит в заголовки: «Google и Reddit не владеют интернетом».
Суть спора
SerpApi делает ровно одну вещь: скрейпит результаты поиска Google и продаёт их разработчикам как структурированные данные через неофициальный «Google Search API». Google обвинила компанию в обходе своих анти-скрейпинговых технологий и незаконной перепродаже контента, назвав иск «крайней мерой» против «злонамеренного скрейпинга».
Проблема в том, что Google выбрала для атаки закон об авторском праве — DMCA. И судья указал на очевидное: у Google нет права подавать такой иск, потому что контент в поисковой выдаче ей не принадлежит. Google не автор этих текстов, не эксклюзивный лицензиат и не показала, что действует от имени правообладателей. Иск может продолжиться лишь по очень ограниченным претензиям.
SerpApi формулирует это жёстче: Google и Reddit «пытаются использовать DMCA как оружие, чтобы отгородить открытый интернет, задним числом объявляя контроль над контентом, который они не создавали и которым не владеют».
Reddit следующий — и у него всё плохо
История началась не с Google. Ещё в октябре Reddit подал почти идентичный иск против SerpApi и Perplexity — за скрейпинг реддитовского контента, который появляется в результатах поиска Google. Google прямо ссылалась на этот прецедент, когда объявляла собственный иск.
Теперь конструкция работает против её создателей. Мередит Роуз, старший юрист по вопросам DMCA в некоммерческой Public Knowledge, отмечает: решение по делу Google — плохой знак для Reddit, потому что Reddit тем более не является ни владельцем, ни эксклюзивным лицензиатом контента в чужой поисковой выдаче. «Reddit — ничто из этого», — резюмирует она. Сам контент на Reddit, напомним, пишут пользователи бесплатно.
SerpApi добавляет обвинение по существу: Reddit готовился стать «сборщиком пошлин», требуя платы за скрейпинг того, чем не владеет. «Reddit не защищает своих пользователей — Reddit расчищает путь к их эксплуатации».
Почему все вдруг полюбили DMCA
За частным спором стоит структурный сдвиг. Три года взрывного роста AI-скрейпинга поставили платформы в положение, для которого у американского права просто нет готового инструмента. Роуз описывает происходящее как хватание «за любой инструмент, какой есть в ящике»: DMCA писали в 1998 году про пиратские копии фильмов, а не про ботов, собирающих обучающие данные.
При этом сама Google играет на обеих сторонах доски. Как ехидно замечает The Next Web, компания, отсканировавшая весь веб без разрешения, теперь узнала от суда, что другие могут сканировать её саму. Reddit тем временем продаёт данные своих пользователей OpenAI и Google по официальным контрактам — и одновременно судится с теми, кто берёт то же самое бесплатно.
Для AI-индустрии решение суда — редкая хорошая новость с фронта данных. Мы недавно писали, как лаборатории от отчаяния скупают и уничтожают редкие книги ради чистых обучающих данных. Если бы платформы получили право через DMCA огораживать всё, что проходит через их выдачу, стена вокруг открытого веба выросла бы мгновенно. Пока суд сказал: чтобы что-то огородить, надо сначала этим владеть. В эпоху, когда данные — главная валюта AI, это заявление куда весомее, чем кажется.


