بازگشت به وبلاگ

دادگاه شکایت Reddit از Perplexity را رد کرد: دو تصمیم درباره اسکرپینگ در ۱۱ روز

۳۱ ژوئیه ۲۰۲۶ قاضی انگلمایر (SDNY) از بسته شدن شکایت Reddit علیه Perplexity AI و SerpApi خودداری کرد: ادعاهای ضد دور زدن بر اساس DMCA برقرار ماند. ۱۱ روز قبل از این، دادگاه در کالیفرنیا تقریباً همان شکایت Google علیه همان متهم را رد کرد. چرا یک دور زدن مشابه ارزیابی‌های متضادی دریافت کرد، ارتباط پروکسی‌ ارائه‌دهندگان Oxylabs و AWMProxy چیست و نتیجه‌اش چه خواهد بود؟

📅۱۲ مرداد ۱۴۰۵
دادگاه شکایت Reddit از Perplexity را رد کرد: دو تصمیم درباره اسکرپینگ در ۱۱ روز
```html

در تاریخ 31 ژوئیه 2026، قاضی فدرال پل انگلمایر (منطقه جنوبی نیویورک) از بسته شدن شکایت Reddit علیه Perplexity AI و aggregator جستجوی SerpApi خودداری کرد. ادعاهای کلیدی در مورد ماده ضد دور زدن DMCA § 1201(a) پابرجا ماندند - پرونده به جلو می‌رود. یازده روز قبل از این، قاضی فدرال دیگری در کالیفرنیای شمالی تقریباً شکایت مشابهی از Google علیه همان SerpApi را رد کرد. همان مانع فنی، همان متهم - و دو نتیجه متضاد.

این تناقض در دادگاه‌ها نیست. این یک سیگنال روشن است که مرز قانونی واقعی در اسکرپینگ سال 2026 کجاست. و این مرز در جایی نیست که مهندسان عادت دارند آن را جستجو کنند.

قضیه‌ای که دادگاه در 31 ژوئیه تصمیم گرفت

پرونده Reddit, Inc. v. SerpApi LLC et al. (شماره 1:25-cv-08736) در تاریخ 22 اکتبر 2025 توسط Reddit ارائه شد و در فوریه 2026 شکایت را گسترش داد. چهار متهم وجود دارند و ترکیب آن‌ها مهم است: شرکت AI Perplexity AI، aggregator جستجو SerpApi و دو ارائه‌دهنده پروکسی - Oxylabs UAB و AWMProxy.

منطق اتهام این است: واسطه‌ها به طور صنعتی محتوای Reddit را نه از سرورهای خود Reddit، بلکه از نتایج جستجوی Google استخراج می‌کردند و منبع خود را پنهان می‌کردند تا از حفاظت عبور کنند؛ Perplexity این داده‌ها را خریداری کرده و آن‌ها را به موتور AI خود ارائه می‌داد.

قاضی انگلمایر ادعاها را تقسیم کرد:

  • پابرجا ماند: ادعای اصلی در مورد DMCA § 1201(a) - دور زدن تدابیر کنترل دسترسی فنی. دادگاه تأیید کرد که مکانیزم حفاظتی Google SearchGuard به عنوان یک تدبیر کنترل دسترسی در معنای قانون واجد شرایط است و خود Reddit در "حوزه منافع" قوانین ضد دور زدن DMCA قرار دارد. به گفته قاضی، این پلتفرم "بازار دیجیتال جهانی آثار محافظت شده" را تجسم می‌بخشد که به خاطر توسعه آن DMCA تصویب شده است.
  • رد شد: ادعای "ترافیک" بر اساس § 1201(b) علیه SerpApi و همچنین شکایات مربوط به رقابت ناعادلانه و غنی‌سازی بدون دلیل علیه هر دو متهم.

تذکر مهم: این تصمیم در مورد درخواست رد شکایت است، نه حکم در مورد ماهیت پرونده. دادگاه فقط گفت که پرونده حق دارد تا رسیدگی ادامه یابد. اما در این مرحله معمولاً شکایات ضعیف علیه اسکرپرها از بین می‌روند - این یکی از بین نرفته است.

چرا Google شکست خورد و Reddit فیلتر را گذراند

در تاریخ 20 ژوئیه 2026، قاضی رئیس ایوان گونزالس راجرز در منطقه شمالی کالیفرنیا شکایت Google علیه SerpApi بر اساس DMCA را رد کرد - بدون حق تجدید نظر به شکل قبلی. ما این تصمیم را به تفصیل بررسی کردیم: دادگاه موافقت کرد که تغییر اثر انگشت مرورگر، چرخش IP و حل کپچا - این‌ها به طور فنی دور زدن هستند، اما خود دور زدن غیرقانونی نیست، اگر پشت مانع آثار محافظت شده توسط حق چاپ وجود نداشته باشد.

Google در اینجا به مشکل برخورد. این شرکت ادعا نکرد که نتایج جستجوی آن تحت حفاظت قانون حق چاپ قرار دارد و نشان نداد که SearchGuard را "با اجازه صاحب حق" پیاده‌سازی کرده است، همانطور که 17 U.S.C. § 1201(a)(3)(B) نیاز دارد. این مانع درآمد تبلیغاتی را محافظت می‌کرد - و DMCA نه درآمد را بلکه حق چاپ را محافظت می‌کند.

Reddit از طرف دیگری وارد شد. به گفته Reddit، پشت همان SearchGuard، نه "نتایج بی‌ربط و مسطح"، بلکه پست‌های کاربران وجود دارد - متون افراد زنده که Reddit حقوق آن‌ها را مجوز می‌دهد، از جمله از طریق معاملات مالی با Google و OpenAI. تفاوت در تکنیک دور زدن نیست. تفاوت در این است که چه چیزی پشت مانع قرار دارد.

نتیجه‌ای که باید برای مهندسان و صاحبان داده‌ها ثبت شود: هویت فنی اقدامات به معنای هویت قانونی عواقب نیست. یک اسکریپت مشابه با چرخش IP های مقیم در یک پرونده - کار قانونی با حقایق عمومی، در دیگری - دور زدن حفاظت اثر محافظت شده.

جایگاه پروکسی در این پرونده

برای صنعت ما، جالب‌ترین جنبه پرونده، نه Perplexity، بلکه دو نام دیگر در فهرست متهمان است. Oxylabs و AWMProxy به عنوان متهمان معرفی شده‌اند، نه به عنوان شاهد و نه به عنوان "ابزار اشخاص ثالث": شاکی معتقد است که زیرساخت ناشناس‌سازی بخشی از طرح دور زدن بوده است.

درخواست Oxylabs برای رد شکایت توسط دادگاه معلق شد - به دلیل تداخل قابل توجهی که استدلال‌های آن با دلایل SerpApi و Perplexity داشت، جلسه بررسی تا حل درخواست‌های متهمان متوقف شد. این درخواست‌ها اکنون حل شده‌اند و نظریه ضد دور زدن پایه‌ای زنده مانده است. به این معنی که نوبت به ارائه‌دهنده پروکسی رسیده و او در موقعیت مذاکره‌ای به مراتب بدتر از شش ماه پیش قرار دارد.

دو جزئیات دیگر از مواد پرونده که درباره مقیاس و روش‌های اثبات چیزهای زیادی می‌گویند:

  • بر اساس داده‌های به دست آمده از طریق درخواست قضایی، SerpApi در طی دو هفته ژوئیه 2025 به حدود 1.8 میلیارد صفحه نتایج جستجوی Google که شامل داده‌های Reddit بود، مراجعه کرده است.
  • Reddit تله کلاسیکی را به کار گرفت: محتوایی را منتشر کرد که فقط برای خزنده Google قابل مشاهده بود و سپس آن را در پاسخ‌های Perplexity کشف کرد. این همان نوع مدرکی است که "آن‌ها از جایی داده‌ها را می‌گیرند" را به یک زنجیره تأمین خاص تبدیل می‌کند.

روش "طعمه آلوده" را باید به خاطر سپرد و به دلیل دیگری. این نشان می‌دهد که پلتفرم‌های بزرگ مدت‌هاست که از مسدودسازی به جمع‌آوری شواهد منتقل شده‌اند: محتوای علامت‌گذاری شده، صفحات honeypot، و اسنیپت‌های منحصر به فرد. دقت شما در سطح شبکه نجات‌دهنده نیست، اگر محتوای خود به خود علامت‌گذاری شده باشد.

نقاط ضعف شکایت که به ندرت نوشته می‌شوند

Reddit فیلتر اول را گذراند، اما موقعیت آن به هیچ وجه بی‌نقص نیست و دفاع در دو نقطه حساس ضربه می‌زند.

نخست - چه کسی اصلاً مالک پست‌هاست. توافق‌نامه کاربری Reddit حقوق انتشار را برای نویسندگان حفظ می‌کند و به پلتفرم یک مجوز غیر انحصاری می‌دهد. SerpApi اصرار دارد که این شکاف "برای هر بند" شکایت فاجعه‌بار است: نمی‌توان بر اساس حق چاپ چیزی را که مالک آن نیستید، محافظت کرد. همان استدلال علیه Google کاملاً کارساز نبود - در آنجا دعوا بر سر نتایج خودشان بود.

دوم - قابلیت حفاظت نمونه‌های خاص. در شکایت گسترش‌یافته، Reddit نمونه‌هایی از محتوایی که آن را متعلق به خود می‌داند ارائه داده است: بخشی از سیاست حفظ حریم خصوصی، فهرست فیلم‌ها، تاریخ و آدرس یک کلوپ جاز. دفاع به درستی پاسخ می‌دهد که فهرست‌ها، حقایق و قطعات کوتاه به آستانه حفاظت نمی‌رسند. به علاوه، یک استدلال جداگانه: SearchGuard "تدبیر مؤثری برای کنترل دسترسی" نیست، زیرا فرد به راحتی از آن عبور می‌کند - یک مسیر دسترسی همیشه باز می‌ماند.

این استدلال‌ها به هیچ وجه از بین نرفته‌اند - آن‌ها فقط به مرحله ماهیت پرونده موکول شده‌اند. بنابراین "Reddit پیروز شد" - یک ساده‌سازی قوی است. درست‌تر این است که: نظریه ضد دور زدن علیه اسکرپرها و خریداران داده‌ها حق حیات در دادگاه نیویورک را پیدا کرد. در ایالات متحده، تصمیم یک منطقه دیگری را ملزم نمی‌کند و ما شاهد شکاف در عمل در زمان واقعی هستیم.

این به چه معناست به طور عملی

اگر شما داده‌ها را برای کسب و کار جمع‌آوری می‌کنید، از تصمیم 31 ژوئیه نتایج کاملاً عملی می‌گیرد.

  1. محتوا را نه مانع، بلکه ارزیابی کنید. دور زدن کپچا در صفحه‌ای با قیمت، برنامه یا آدرس‌ها - یک داستان ریسک است. دور زدن همان مانع برای متون، عکس‌ها و نظراتی که حقوق آن‌ها متعلق به کسی است - به طور اصولی متفاوت است. قرار گرفتن در معرض قانونی توسط شیء تعیین می‌شود، نه ابزار.
  2. خریدار داده‌ها دیگر در امنیت نیست. Perplexity دفاع خود را بر این اساس بنا کرد که او تنها خریدار نهایی است و "بحث‌های عمومی را خلاصه می‌کند". دادگاه این استدلال را برای بسته شدن پرونده کافی ندانست. این یک سیگنال مستقیم به همه کسانی است که دیتاست‌های آماده خریداری می‌کنند: باید بتوانید منبع داده‌ها را توضیح دهید.
  3. قرارداد و ToS جدا از DMCA زندگی می‌کنند. حتی در جایی که نظریه حق چاپ از بین می‌رود، نقض شرایط استفاده به عنوان یک مبنای مستقل باقی می‌ماند. شکست پلتفرم در DMCA به این معنا نیست که اسکرپینگ "توسط دادگاه مجاز است".
  4. لایه زیرساختی برای شاکیان قابل مشاهده شده است. وقتی ارائه‌دهندگان پروکسی به فهرست متهمان می‌پیوندند، سؤال "پروایدر من چه می‌داند و درباره ترافیک من چه ثبت می‌کند" دیگر پارانوئید نیست. ارائه‌دهنده‌ای را انتخاب کنید که منابع استخر آن مشخص باشد، سیاست استفاده قابل قبول واضحی داشته باشد و KYC داشته باشد - این دقیقاً همان بخش کسل‌کننده کاغذی است که شریک زیرساختی را از شرکت‌کننده در طرح دیگر متمایز می‌کند. درباره معیارها در تحلیل روش‌های قانونی جمع‌آوری داده‌ها از طریق پروکسی نوشتیم.
  5. وظایف را بر اساس سطح ریسک تفکیک کنید. نظارت بر قیمت‌ها، بررسی نتایج، کنترل در دسترس بودن منابع خود و تست جغرافیایی - سناریوهای استاندارد با پروفایل حقوقی قابل پیش‌بینی؛ برای آن‌ها پروکسی‌های مقیم یا آدرس‌های دیتاسنتر ارزان مناسب هستند، اگر پلتفرم به "منشأ مسکونی" نیاز نداشته باشد. استخراج انبوه محتوای حق چاپ دیگران برای آموزش مدل‌ها - سناریویی است که اکنون به دادگاه‌ها منتقل می‌شود و باید با مجوز حل شود، نه با چرخش IP.

خلاصه

دو دادگاه فدرال در یازده روز در ارزیابی یک دور زدن یکسان از یک مانع یکسان اختلاف نظر داشتند. کالیفرنیا: دور زدن حفاظت جستجو بدون حق چاپ در پشت آن - نقض DMCA نیست. نیویورک: اگر پشت مانع محتوای کاربر محافظت شده وجود داشته باشد، ادعای ضد دور زدن حق بررسی دارد، و به همراه آن - ادعاهایی علیه واسطه‌ها و خریداران داده‌ها.

برای کسانی که به طور حرفه‌ای با داده‌ها کار می‌کنند، نتیجه یکی است: جنبه فنی جمع‌آوری دیگر عامل اصلی ریسک نیست. سؤال اصلی درباره حقوق آنچه که می‌گیرید و شفافیت زنجیره‌ای است که این داده‌ها به شما رسیده‌اند. مرحله بعدی در پرونده - درخواست Oxylabs است که پس از تصمیم‌گیری درباره متهمان دوباره فعال شده است.

```