Назад к блогу

Суд оставил иск Reddit к Perplexity: два решения о скрапинге за 11 дней

31 июля 2026 судья Энгельмайер (SDNY) отказался закрыть иск Reddit к Perplexity AI и SerpApi: антиобходные претензии по DMCA устояли. За 11 дней до этого суд в Калифорнии отклонил почти такой же иск Google к тому же ответчику. Почему один и тот же обход получил противоположные оценки, при чём тут прокси-провайдеры Oxylabs и AWMProxy и что из этого следует.

📅3 августа 2026 г.
Суд оставил иск Reddit к Perplexity: два решения о скрапинге за 11 дней

31 июля 2026 года федеральный судья Пол Энгельмайер (Южный округ Нью-Йорка) отказался закрыть иск Reddit против Perplexity AI и агрегатора поисковой выдачи SerpApi. Ключевые претензии по антиобходной статье DMCA § 1201(a) устояли — дело идёт дальше. За одиннадцать дней до этого другой федеральный судья, в Северной Калифорнии, отправил в корзину почти идентичный иск Google к тому же SerpApi. Один и тот же технический барьер, один и тот же ответчик — и два противоположных исхода.

Это не противоречие судов. Это чёткий сигнал о том, где на самом деле проходит юридическая граница в скрапинге 2026 года. И она проходит не там, где привыкли её искать инженеры.

Что именно решил суд 31 июля

Дело Reddit, Inc. v. SerpApi LLC et al. (№ 1:25-cv-08736) Reddit подал 22 октября 2025 года, в феврале 2026-го расширил жалобу. Ответчиков четверо, и состав важен: AI-компания Perplexity AI, агрегатор выдачи SerpApi и два прокси-провайдера — Oxylabs UAB и AWMProxy.

Логика обвинения такая: посредники в промышленных масштабах вытаскивали контент Reddit не с серверов самого Reddit, а из результатов поиска Google, маскируя своё происхождение, чтобы обойти защиту; Perplexity покупала эти данные и подавала их в свой AI-движок.

Судья Энгельмайер разделил претензии:

  • Устояло: основная претензия по DMCA § 1201(a) — обход технической меры контроля доступа. Суд признал, что защитный механизм Google SearchGuard квалифицируется как мера контроля доступа в смысле закона, а сам Reddit находится «в зоне интересов» антиобходных норм DMCA. По формулировке судьи, площадка «воплощает тот самый глобальный цифровой рынок охраняемых произведений», ради развития которого DMCA и принимался.
  • Отклонено: претензия о «трафикинге» по § 1201(b) против SerpApi, а также иски о недобросовестной конкуренции и неосновательном обогащении против обоих ответчиков.

Важная оговорка: это решение по ходатайству об отклонении иска, а не вердикт по существу. Суд лишь сказал, что дело имеет право дожить до разбирательства. Но именно на этой стадии обычно и умирают слабые иски против скраперов — этот не умер.

Почему Google проиграл, а Reddit прошёл фильтр

20 июля 2026 года председательствующий судья Ивонн Гонсалес Роджерс в Северном округе Калифорнии отклонила иск Google к SerpApi по DMCA — без права переподачи в прежнем виде. Мы подробно разбирали это решение: суд согласился, что подмена браузерных отпечатков, ротация IP и решение капчи — это технически обход, но обход сам по себе не противоправен, если за барьером не стоят охраняемые авторским правом произведения.

Google на этом и споткнулся. Компания не заявила, что результаты её поиска охраняются Законом об авторском праве, и не показала, что внедрила SearchGuard «с разрешения правообладателя», как требует 17 U.S.C. § 1201(a)(3)(B). Барьер защищал рекламную выручку — а DMCA защищает не выручку, а копирайт.

Reddit зашёл с другой стороны. За тем же самым SearchGuard, по версии Reddit, лежат не «плоские нерелевантные результаты», а пользовательские посты — тексты живых людей, права на которые Reddit лицензирует, в том числе по денежным сделкам с Google и OpenAI. Разница не в технике обхода. Разница в том, что именно находится за барьером.

Вывод, который стоит зафиксировать инженерам и владельцам данных: техническая идентичность действий не означает юридическую идентичность последствий. Один и тот же скрипт с ротацией резидентных IP в одном деле — законная работа с публичными фактами, в другом — обход защиты охраняемого произведения.

Где в этом деле прокси

Для нашей отрасли самое интересное в деле — не Perplexity, а два других имени в списке ответчиков. Oxylabs и AWMProxy привлечены не как свидетели и не как «инструмент третьих лиц», а как соответчики: истец считает, что инфраструктура анонимизации была частью схемы обхода.

Ходатайство Oxylabs об отклонении иска суд приостановил — из-за существенного пересечения её аргументов с доводами SerpApi и Perplexity брифинг заморозили до разрешения ходатайств соответчиков. Эти ходатайства теперь разрешены, причём базовая антиобходная теория выжила. То есть очередь дошла до прокси-провайдера, и он подходит к ней в заметно худшей переговорной позиции, чем полгода назад.

Ещё две детали из материалов дела, которые многое говорят о масштабе и о методах доказывания:

  • По данным, полученным по судебному запросу, SerpApi за две недели июля 2025 года обратился примерно к 1,8 млрд страниц поисковой выдачи Google, содержавших данные Reddit.
  • Reddit применил классическую ловушку: разместил контент, видимый только краулеру Google, а затем обнаружил его в ответах Perplexity. Это тот самый тип доказательства, который превращает абстрактное «они где-то берут данные» в конкретную цепочку поставки.

Приём с «отравленной приманкой» стоит запомнить и по другой причине. Он показывает, что крупные площадки давно перешли от блокировок к сбору доказательств: маркированный контент, honeypot-страницы, уникальные сниппеты. Ваша аккуратность на уровне сети не спасает, если контент сам по себе помечен.

Слабые места иска, о которых редко пишут

Reddit прошёл первый фильтр, но его позиция далеко не безупречна, и защита бьёт в две болевые точки.

Первая — кто вообще владеет постами. Пользовательское соглашение Reddit оставляет права на публикации за авторами, а платформе достаётся неисключительная лицензия. SerpApi настаивает, что этот разрыв «фатален для каждого пункта» жалобы: нельзя защищать по копирайту то, чем не владеешь. Тот же аргумент против Google не работал вовсе — там спор шёл о собственной выдаче.

Вторая — охраноспособность конкретных примеров. В расширенной жалобе Reddit привёл образцы материала, который считает своим авторским: фрагмент политики конфиденциальности, перечень фильмов, дата и адрес джаз-клуба. Защита резонно отвечает, что списки, факты и короткие фрагменты не дотягивают до порога охраны. Плюс отдельный аргумент: SearchGuard не является «эффективной мерой контроля доступа», раз человек проходит его бесшовно — один маршрут доступа остаётся открытым всегда.

Эти доводы никуда не делись — они просто отложены до стадии по существу. Так что «Reddit победил» — сильное упрощение. Правильнее: антиобходная теория против скраперов и покупателей данных получила право на жизнь в нью-йоркском суде. В США решение одного округа не связывает другой, и мы наблюдаем раскол практики в реальном времени.

Что это значит практически

Если вы собираете данные для бизнеса, из решения 31 июля следуют вполне приземлённые вещи.

  1. Оценивайте не барьер, а контент за ним. Обход капчи на странице с прайсом, расписанием или адресами — это одна история риска. Обход того же барьера ради текстов, фотографий и отзывов, права на которые кому-то принадлежат, — принципиально другая. Юридическая экспозиция задаётся объектом, а не инструментом.
  2. Покупатель данных перестал быть в безопасности. Perplexity строила защиту на том, что она лишь конечный приобретатель и «резюмирует публичные обсуждения». Суд не счёл этот аргумент достаточным для закрытия дела. Это прямой сигнал всем, кто закупает готовые датасеты: происхождение данных придётся уметь объяснять.
  3. Договор и ToS живут отдельно от DMCA. Даже там, где копирайт-теория рассыпается, остаётся нарушение условий использования как самостоятельное основание. Проигрыш площадки по DMCA не означает, что скрапинг «разрешён судом».
  4. Инфраструктурный слой стал видимым для истцов. Когда прокси-провайдеры попадают в число ответчиков, вопрос «а что мой поставщик знает и логирует о моём трафике» перестаёт быть параноидальным. Выбирайте провайдера, у которого понятны источники пула, есть внятная политика допустимого использования и KYC — это ровно та скучная бумажная часть, которая отличает инфраструктурного партнёра от участника чужой схемы. О критериях мы писали в разборе законных практик сбора данных через прокси.
  5. Разделяйте задачи по уровню риска. Мониторинг цен, проверка выдачи, контроль доступности собственных ресурсов и гео-тестирование — типовые сценарии с предсказуемым правовым профилем; для них подходят резидентные прокси или дешёвые датацентровые адреса, если площадка не требует «жилого» происхождения. Массовое извлечение чужого авторского контента для обучения моделей — сценарий, который сейчас переезжает в залы суда, и решать его нужно лицензией, а не ротацией IP.

Коротко

Два федеральных суда за одиннадцать дней разошлись в оценке одного и того же обхода одного и того же барьера. Калифорния: обход поисковой защиты без копирайта за ней — не нарушение DMCA. Нью-Йорк: если за барьером лежит охраняемый пользовательский контент, антиобходная претензия имеет право на рассмотрение, а вместе с ней — претензии к посредникам и к покупателю данных.

Для тех, кто работает с данными профессионально, вывод один: техническая сторона сбора перестала быть главным фактором риска. Главным стал вопрос о правах на то, что вы забираете, и о прозрачности цепочки, по которой эти данные к вам пришли. Следующая веха в деле — ходатайство Oxylabs, которое суд разморозил после решения по соответчикам.