Назад к блогу

Google проиграл суд о скрапинге выдачи: дело SerpApi и что оно меняет

20 июля 2026 года федеральный суд Калифорнии отклонил иск Google против SerpApi: антибот-система SearchGuard не защищает авторские права, когда за ней лежат обычные результаты поиска — URL, сниппеты и факты индекса. Разбираем детали решения, что осталось за его рамками и как это влияет на практику сбора SERP-данных.

📅24 июля 2026 г.
Google проиграл суд о скрапинге выдачи: дело SerpApi и что оно меняет

20 июля 2026 года федеральный суд Северного округа Калифорнии отклонил иск Google против SerpApi — компании, которая продаёт доступ к результатам поисковой выдачи через API. Google пыталась применить к скрапингу SERP антиобходные нормы DMCA — те самые, что писались против взлома защиты DVD. Суд ответил: технические барьеры вокруг данных, которые не защищены авторским правом, законом об авторском праве не защищаются. Разбираем, что реально решил суд, чего он не решил, и что из этого следует для всех, кто собирает данные из выдачи.

Что произошло: хронология дела

Google подала иск 19 декабря 2025 года (дело 25-cv-10826-YGR, Северный округ Калифорнии). Ответчик — SerpApi, сервис, который отдаёт результаты Google Поиска в структурированном виде через API. Его данными живёт заметная часть SEO-индустрии: трекеры позиций, инструменты подбора ключевых слов, дашборды конкурентной разведки.

Ключевые факты по материалам дела:

  • SearchGuard — антискрапинговая система, запущенная Google в январе 2025 года. Отправляет JavaScript-челленджи запросам из неопознанных источников и требует подтвердить, что за браузером человек. Автоматика такие проверки обычно не проходит и получает отказ.
  • По утверждению Google, SerpApi генерировала «сотни миллионов искусственных поисковых запросов в день», а объём запросов вырос примерно на 25 000% за два года.
  • Google требовала статутные убытки — от $200 до $2500 за каждый акт обхода. При миллионах запросов сумма кратно превышала годовую выручку SerpApi, которая измеряется единицами миллионов долларов. Иными словами, иск в случае успеха просто закрывал бы компанию.
  • SerpApi подала ходатайство об отклонении в феврале 2026 года. Решение вынесла главный судья округа Ивонн Гонсалес Роджерс 20 июля 2026 года.

Почему DMCA не сработал

Раздел 1201 DMCA запрещает обходить технические средства, которые «эффективно контролируют доступ к произведению, охраняемому законом об авторском праве». Логика Google: SearchGuard — это техническое средство защиты, SerpApi его обходит, значит нарушение налицо.

Суд разобрал конструкцию по частям. Обычная выдача — URL, сниппеты, фактические данные индекса, позиции — это общедоступные факты, а не «произведение, охраняемое законом об авторском праве». Значит, SearchGuard в этой части «нельзя считать эффективно контролирующим доступ к охраняемому произведению». Претензии, опирающиеся на некопирайтные результаты, отклонены с prejudice — без права переподачи.

Google указывала, что страница выдачи — это «смесь» охраняемого и неохраняемого контента, и приводила в пример лицензионные изображения в Knowledge Panel. Здесь суд занял более мягкую позицию: эти претензии отклонены с правом исправить иск. Но с условием — Google должна показать факты, из которых следует, что SearchGuard защищает копирайтные элементы с санкции самих правообладателей. Просто разместить чужую лицензионную картинку у себя на странице и объявить свой антибот её защитой не получится. На подачу исправленного иска у Google 21 день.

Формулировка блога SerpApi по итогу: суд «отклонил попытки Google расширить DMCA до контроля над доступом к публичным страницам». Гендиректор компании Жюльен Халеги называет решение защитой «открытого доступа к публичным данным».

Почему это дело крупнее, чем спор двух компаний

Контекст последних полутора лет объясняет, зачем Google вообще пошла в суд. Технически она давила на рынок SERP-данных и до этого:

  • В сентябре 2025 года Google убрала параметр num=100, который позволял получать сотню результатов одним запросом. Стоимость полного съёма выдачи для инструментов выросла примерно в десять раз.
  • Когда DataForSEO выкатила обходное решение, снижавшее издержки примерно на 80%, Google заблокировала его за пять дней.

То есть по технической линии Google уже выигрывала. Иск был попыткой добавить к этому юридический рычаг: превратить обход антибота в правонарушение с фиксированными штрафами за каждый запрос. Вот это суд и не пропустил. Если бы прошло, любая CAPTCHA или JS-челлендж на публичной странице автоматически становились бы «технической защитой произведения» — и любой парсер публичных данных превращался бы в нарушителя DMCA по умолчанию.

Экономика вопроса: почему за SERP-данные идёт война

Результаты поиска — это не просто «ещё один источник данных». На них построена целая индустрия: отслеживание позиций, анализ конкурентов, мониторинг цен, обучающие выборки для ИИ-моделей. Google при этом оказывается в двойственном положении: сама компания построила поиск на массовом сборе чужого контента, но доступ к агрегированному результату хочет контролировать полностью.

Отдельный слой — искусственный интеллект. Поисковая выдача стала для языковых моделей быстрым способом получить свежую картину интернета без собственного краулера. Именно поэтому в исках последнего года рядом с классическими скрапинг-сервисами всё чаще стоят ИИ-компании. Аргумент «мы просто читаем публичные страницы» звучит одинаково и у SEO-инструмента, и у ИИ-ассистента, а суды только начинают разбираться, где между ними проходит граница. Дело SerpApi даёт внятный ответ хотя бы по одному вопросу: авторское право не растягивается на факты только потому, что они лежат за капчей.

Решение продолжает линию, знакомую по делу hiQ Labs против LinkedIn: сбор общедоступных данных сам по себе не превращается в преступление только потому, что владельцу площадки это не нравится. Разница в том, что hiQ касалось CFAA (несанкционированный доступ), а здесь закрыт другой обходной путь — авторско-правовой.

Чего это решение НЕ отменяет

Здесь важно не перепутать победу в одном эпизоде с индульгенцией. Что осталось на месте:

  1. Технические блокировки никуда не делись. SearchGuard работает ровно так же, как работал 19 июля. Судебное решение не открывает доступ — оно лишь убирает конкретный вид юридической ответственности. Парсить выдачу по-прежнему технически сложно и дорого.
  2. Договорные претензии и ToS. Нарушение пользовательского соглашения — отдельная правовая плоскость, DMCA-решение её не затрагивает.
  3. Копирайт на конкретные элементы. Именно ту дверь суд оставил приоткрытой. Фактическая выдача — факты; изображения в Knowledge Panel, лицензионный контент, фотографии, пользовательские отзывы — уже нет. Собирать «всё подряд со страницы» и собирать позиции и сниппеты — юридически разные действия.
  4. Параллельные процессы. В октябре 2025 года Reddit подала иск в Южный округ Нью-Йорка против Perplexity AI, SerpApi, Oxylabs и AWMProxy, обвинив их в обходе защиты и сборе данных для ИИ; уточнённая жалоба подана 6 февраля 2026 года, дело на стадии рассмотрения ходатайств об отклонении. Плюс SerpApi отбивается от иска SearchApi в Техасе. Юридический ландшафт остаётся спорным.

И главное: это решение окружного суда первой инстанции, а не апелляционный прецедент. Google может исправить иск в части лицензионного контента, а затем обжаловать. Ставить на то, что вопрос закрыт навсегда, преждевременно.

Что из этого следует практически

Если вы собираете данные из поисковой выдачи или планируете это делать, разумная реакция на решение — не «теперь можно всё», а уточнение рабочих правил.

  1. Разделяйте факты и охраняемый контент на уровне парсера. URL, заголовки, сниппеты, позиции, наличие блоков — это фактический слой, вокруг него позиция суда сильнее всего. Изображения, встроенные лицензионные материалы, полные тексты отзывов — зона риска. Технически это означает белый список полей в экстракторе, а не «сохраняем весь HTML на всякий случай».
  2. Не путайте юридический риск с операционным. Ваша основная проблема при съёме SERP — не суд, а блокировки, капчи и качество IP. Рынок ужесточился: после отмены num=100 тот же объём данных стоит в разы дороже по запросам. Практическую сторону — какие блоки как снимать и почему сессии рвутся — мы разбирали в гайде по скрапингу Google SERP и AI Overviews.
  3. Соблюдайте адекватную нагрузку. Цифра «25 000% роста запросов» звучала в иске не случайно: агрессивный объём сам по себе становится аргументом против вас — и в суде, и в глазах антибота. Разумные интервалы, приоритетные запросы вместо тотального съёма и кэширование результатов снижают оба вида риска сразу.
  4. Держите гео и тип IP под задачу. Выдача персонализируется по региону, и данные, снятые «откуда попало», просто некорректны. Для гео-точных и устойчивых сессий чаще всего берут резидентные прокси; для больших объёмов однотипных технических запросов, где чувствительность к детекту ниже, дешевле выходят датацентр-прокси.
  5. Фиксируйте, что и зачем вы собираете. Внутренний документ на полстраницы — источники, поля, частота, срок хранения — стоит недорого, а при любом разбирательстве отличает исследовательский сбор от бесконтрольного вычерпывания. Смежные правовые нюансы разобраны в материале про легальное использование прокси.

Вывод

Решение от 20 июля 2026 года — заметная точка в споре о том, чем является скрапинг публичной выдачи. Суд отказался считать антибот-систему «защитой произведения», когда за ней лежат факты, а не творческий контент, и закрыл эту претензию окончательно. Одновременно он оставил Google 21 день на попытку зайти со стороны лицензионных элементов страницы.

Практический смысл для рынка данных простой: правовое давление на сбор фактов из выдачи ослабло, а техническое — нет и не собирается. Инструменты SEO-аналитики, конкурентной разведки и мониторинга цен продолжают работать в том же режиме, что и раньше: качественная инфраструктура доступа, аккуратная нагрузка и чёткое понимание, какие именно поля вы забираете со страницы.