2026年7月31日、連邦裁判官ポール・エンゲルマイヤー(ニューヨーク南部地区)は、RedditがPerplexity AIおよび検索結果の集約サービスSerpApiに対して提起した訴訟を却下しませんでした。DMCA § 1201(a)の回避に関する主要な主張は維持され、事件は進行中です。この11日前、カリフォルニア北部の別の連邦裁判官は、同じSerpApiに対するGoogleのほぼ同一の訴訟を却下しました。同じ技術的障壁、同じ被告、そして二つの対照的な結果です。
これは裁判所の矛盾ではありません。2026年のスクレイピングにおける法的境界が実際にどこにあるのかを示す明確な信号です。そして、それはエンジニアたちが慣れ親しんでいる場所ではありません。
7月31日に裁判所が決定したこと
Reddit, Inc. v. SerpApi LLC et al.(番号1:25-cv-08736)という事件は、2025年10月22日にRedditによって提起され、2026年2月に訴状が拡張されました。被告は4人で、その構成が重要です:AI企業Perplexity AI、集約サービスSerpApi、および二つのプロキシプロバイダーOxylabs UABとAWMProxyです。
告発の論理は次の通りです:仲介者たちは、Redditのサーバーからではなく、Googleの検索結果からRedditのコンテンツを大規模に引き出し、その出所を隠して保護を回避しました;Perplexityはこれらのデータを購入し、自社のAIエンジンに提供しました。
エンゲルマイヤー裁判官は主張を分けました:
- 維持された:DMCA § 1201(a)に関する主要な主張 — 技術的なアクセス制御手段の回避。裁判所は、Google SearchGuardの保護メカニズムが法律上のアクセス制コントロール手段として分類されると認定し、Reddit自体がDMCAの回避規定の「関心の範囲内」にあるとしました。裁判官の表現によれば、プラットフォームは「保護された作品のためのグローバルなデジタル市場を具現化している」とされ、DMCAが制定された目的に沿っています。
- 却下された:SerpApiに対する§ 1201(b)に基づく「トラフィッキング」に関する主張、および両被告に対する不正競争および不当利得に関する訴訟。
重要な留意点:これは訴訟却下の申し立てに関する決定であり、実体に関する評決ではありません。裁判所は、事件が審理に進む権利があると述べただけです。しかし、この段階で通常は弱い訴訟が死ぬことが多いのですが、これは死にませんでした。
なぜGoogleが敗れ、Redditがフィルターを通過したのか
2026年7月20日、カリフォルニア北部地区の主審裁判官イボンヌ・ゴンザレス・ロジャースは、DMCAに基づくGoogleのSerpApiに対する訴訟を却下しました — 以前の形での再提出は許可されませんでした。私たちはこの決定を詳しく分析しました:裁判所は、ブラウザフィンガープリンティングの置き換え、IPのローテーション、キャプチャの解決は技術的な回避であると認めましたが、回避自体は違法ではないとしました。なぜなら、障壁の向こうに著作権で保護された作品が存在しないからです。
Googleはここでつまずきました。企業は、自社の検索結果が著作権法によって保護されていると主張せず、SearchGuardを「権利者の許可を得て」実装したことを示しませんでした。障壁は広告収入を保護していましたが、DMCAは収入ではなく著作権を保護します。
Redditは別の側面からアプローチしました。同じSearchGuardの背後には、「無関係な平面的な結果」ではなく、ユーザーの投稿 — 生きた人々のテキストがあり、Redditはそれに対してGoogleやOpenAIとの金銭的取引を通じてライセンスを取得しています。違いは回避技術ではなく、障壁の向こうに何があるかです。
エンジニアやデータ所有者が記録すべき結論:行動の技術的同一性は法的結果の同一性を意味しない。同じスクリプトでの居住者IPのローテーションが一つの事件では公的事実の合法的な取り扱いであり、別の事件では著作権で保護された作品の保護回避となります。
この事件におけるプロキシの位置づけ
私たちの業界にとって、この事件で最も興味深いのはPerplexityではなく、被告リストにある他の二つの名前です。OxylabsとAWMProxyは証人としてではなく、「第三者のツール」としてではなく、共同被告として引き合いに出されています:原告は、匿名化インフラが回避のスキームの一部であったと考えています。
Oxylabsの訴訟却下の申し立ては、SerpApiおよびPerplexityの主張と重要な重複があるため、裁判所は一時停止しました。これらの申し立ては現在解決され、基本的な回避理論は生き残りました。つまり、プロキシプロバイダーの順番が回ってきており、彼は6ヶ月前よりも明らかに悪い交渉ポジションにいます。
事件の資料からのもう二つの詳細は、規模や証明方法について多くを語ります:
- 裁判所の要求によって得られたデータによると、SerpApiは2025年7月の2週間で約18億ページのGoogle検索結果にアクセスし、Redditのデータを含んでいました。
- Redditは古典的な罠を用いました:Googleのクローラーにのみ見えるコンテンツを配置し、その後Perplexityの応答でそれを発見しました。これは「彼らがどこかでデータを取得している」という抽象的な証拠を具体的な供給チェーンに変えるタイプの証拠です。
この「毒入り餌」の手法は、別の理由でも記憶に留めておくべきです。それは、大規模なプラットフォームがブロックから証拠収集に移行していることを示しています:マークされたコンテンツ、ハニーポットページ、ユニークなスニペット。ネットワークレベルでのあなたの注意深さは、コンテンツ自体がマークされている場合には救いになりません。
訴訟の弱点、あまり書かれないこと
Redditは最初のフィルターを通過しましたが、その立場は決して完璧ではなく、防御は二つの痛点を攻撃しています。
第一 — 誰が投稿を所有しているのか。 Redditの利用規約は、投稿の権利を著者に留保し、プラットフォームには非独占的ライセンスが与えられます。SerpApiは、このギャップが「各項目にとって致命的である」と主張しています:所有していないものを著作権で保護することはできません。同じ主張がGoogleに対してはまったく機能しませんでした — そこでは自社の検索結果に関する争いがありました。
第二 — 特定の例の保護能力。 Redditは、著作権を主張する資料のサンプルを拡張された訴状に示しました:プライバシーポリシーの一部、映画のリスト、ジャズクラブの日時と住所。防御は合理的に反論し、リスト、事実、短いフラグメントは保護の閾値に達しないと述べています。さらに別の主張:SearchGuardは「効果的なアクセス制御手段」ではなく、人がシームレスにそれを通過する場合 — 一つのアクセス経路は常に開いています。
これらの主張はどこにも消えていません — ただ単に実体の段階まで延期されています。したがって、「Redditが勝った」というのは強い単純化です。より正確には:スクレイパーおよびデータ購入者に対する回避理論がニューヨークの裁判所で生き残る権利を得たということです。アメリカでは、ある地区の決定が別の地区を拘束することはなく、私たちはリアルタイムで実務の分裂を目の当たりにしています。
実際的な意味
ビジネスのためにデータを収集している場合、7月31日の決定からは非常に現実的なことが導かれます。
- 障壁ではなく、その背後のコンテンツを評価してください。 価格、スケジュール、または住所のページでのキャプチャ回避はリスクの一つの物語です。同じ障壁を越えて、誰かの権利があるテキスト、写真、レビューを取得することは、根本的に異なります。法的な露出は、ツールではなく対象によって決まります。
- データ購入者は安全ではなくなりました。 Perplexityは、自社が単なる最終購入者であり「公の議論を要約している」として防御を構築しました。裁判所はこの主張を事件を閉じるには不十分と見なしました。これは、データセットを購入するすべての人への直接的な信号です:データの出所を説明できる必要があります。
- 契約とToSはDMCAとは別に存在します。 著作権理論が崩れる場所でも、利用規約違反が独立した根拠として残ります。DMCAでのプラットフォームの敗北は、スクレイピングが「裁判所によって許可された」ことを意味しません。
- インフラ層が原告にとって見えるようになりました。 プロキシプロバイダーが被告に加わると、「私のプロバイダーは私のトラフィックについて何を知っていて、何をログに記録しているのか」という質問はもはや偏執的ではなくなります。プールの出所が明確で、許可された使用に関する明確なポリシーとKYCがあるプロバイダーを選んでください — これはインフラパートナーを他のスキームの参加者から区別する退屈な書類の部分です。基準については、プロキシを通じたデータ収集の合法的な実践の分析で書きました。
- リスクレベルに応じてタスクを分けてください。 価格の監視、検索結果の確認、自社リソースの可用性の監視、地理的テスト — 予測可能な法的プロファイルを持つ典型的なシナリオです;これらには、居住用プロキシや安価なデータセンターアドレスが適しています。プラットフォームが「居住用」の出所を要求しない場合です。他人の著作権コンテンツをモデルのトレーニングのために大量に抽出することは、現在法廷に持ち込まれるシナリオであり、これを解決するにはIPのローテーションではなくライセンスが必要です。
要約
11日間で二つの連邦裁判所が同じ障壁の回避に対する評価で意見が分かれました。カリフォルニア:著作権のない検索保護の回避はDMCAの違反ではない。ニューヨーク:障壁の向こうに保護されたユーザーコンテンツがある場合、回避の主張は審理される権利があり、それに伴い仲介者やデータ購入者に対する主張もあります。
データを専門的に扱う人々にとっての結論は一つです:収集の技術的側面はリスクの主な要因ではなくなりました。主な問題は、あなたが取得するものの権利と、それらのデータがどのようにあなたの元に来たかの透明性です。事件の次の節目は、共同被告に関する決定後に裁判所が凍結を解除したOxylabsの申し立てです。
