블로그로 돌아가기

법원이 Reddit의 Perplexity에 대한 소송을 유지: 11일 만에 두 가지 스크래핑 결정

2026년 7월 31일, 에겔마이어 판사는 Reddit의 Perplexity AI 및 SerpApi에 대한 소송을 기각하지 않았습니다: DMCA에 따른 우회 금지 주장들이 유지되었습니다. 그로부터 11일 전, 캘리포니아의 법원은 동일한 피고에 대한 Google의 거의 동일한 소송을 기각했습니다. 왜 동일한 우회가 상반된 평가를 받았는지, Oxylabs 및 AWMProxy와 같은 프록시 제공업체는 어떤 관련이 있으며, 이로 인해 무엇이 발생하는지에 대한 질문이 남습니다.

📅2026년 8월 3일
법원이 Reddit의 Perplexity에 대한 소송을 유지: 11일 만에 두 가지 스크래핑 결정
```html

2026년 7월 31일, 연방 판사 폴 엥겔마이어(뉴욕 남부 지구)는 Reddit이 Perplexity AI와 검색 결과 집계기 SerpApi를 상대로 제기한 소송을 기각하지 않기로 결정했습니다. DMCA § 1201(a)의 우회 조항에 대한 주요 주장들은 유지되었으며, 사건은 계속 진행됩니다. 이 사건의 11일 전, 북부 캘리포니아의 또 다른 연방 판사는 거의 동일한 Google의 SerpApi에 대한 소송을 기각했습니다. 동일한 기술적 장벽과 동일한 피고인 — 그리고 두 가지 상반된 결과입니다.

이는 법원의 모순이 아닙니다. 이는 2026년 스크래핑에서 실제로 법적 경계가 어디에 있는지를 명확히 알리는 신호입니다. 그리고 그 경계는 엔지니어들이 일반적으로 찾는 곳에 있지 않습니다.

7월 31일 법원이 결정한 내용

Reddit, Inc. v. SerpApi LLC et al. 사건(사건 번호 1:25-cv-08736)은 2025년 10월 22일 Reddit이 제기하였으며, 2026년 2월에 고소장을 확장했습니다. 피고인은 네 명이며, 구성은 중요합니다: AI 회사 Perplexity AI, 검색 결과 집계기 SerpApi, 그리고 두 개의 프록시 제공업체인 Oxylabs UABAWMProxy입니다.

주장의 논리는 다음과 같습니다: 중개자들은 산업 규모로 Reddit의 콘텐츠를 Reddit의 서버가 아닌 Google 검색 결과에서 추출하여 출처를 숨기고 보호 장치를 우회했습니다; Perplexity는 이러한 데이터를 구매하여 자신의 AI 엔진에 제공했습니다.

엥겔마이어 판사는 주장을 분리했습니다:

  • 유지됨: DMCA § 1201(a)에 대한 주요 주장 — 기술적 접근 통제 수단의 우회. 법원은 Google SearchGuard의 보호 메커니즘이 법의 의미에서 접근 통제 수단으로 분류되며, Reddit이 DMCA의 우회 규정의 "관심 영역"에 있다고 인정했습니다. 판사의 표현에 따르면, 이 플랫폼은 DMCA가 제정된 이유인 "보호된 작품의 글로벌 디지털 시장"을 구현하고 있습니다.
  • 기각됨: SerpApi에 대한 § 1201(b)의 "트래픽킹" 주장과 두 피고에 대한 불공정 경쟁 및 부당 이득에 대한 소송.

중요한 주의 사항: 이는 소송 기각 신청에 대한 결정이지 본질에 대한 평결이 아닙니다. 법원은 사건이 심리될 권리가 있다고만 말했습니다. 그러나 이 단계에서 일반적으로 약한 소송이 사라지는데 — 이 사건은 사라지지 않았습니다.

왜 Google은 패배하고 Reddit은 통과했는가

2026년 7월 20일, 북부 캘리포니아의 주심 판사 이본 곤살레스 로저스는 DMCA에 따른 Google의 SerpApi에 대한 소송을 기각했습니다 — 이전 형태로 재제출할 권리가 없습니다. 우리는 이 결정을 자세히 분석했습니다: 법원은 브라우저 지문 변경, IP 회전 및 CAPTCHA 해결이 기술적으로 우회라고 동의했지만, 우회 자체가 불법이 아니라고 판단했습니다. 보호 장치 뒤에 저작권으로 보호되는 작품이 없다면 말입니다.

Google은 이 점에서 실수했습니다. 회사는 검색 결과가 저작권법에 의해 보호된다고 주장하지 않았고, 17 U.S.C. § 1201(a)(3)(B)가 요구하는 대로 권리자의 허가를 받아 SearchGuard를 구현했다고 보여주지 않았습니다. 이 장치는 광고 수익을 보호했으며 — DMCA는 수익이 아니라 저작권을 보호합니다.

Reddit은 다른 측면에서 접근했습니다. Reddit의 주장에 따르면, 동일한 SearchGuard 뒤에는 "평면적이고 관련 없는 결과"가 아닌 사용자 게시물이 있습니다 — 살아있는 사람들의 텍스트로, Reddit은 Google 및 OpenAI와의 금전 거래를 포함하여 그 권리를 라이센스합니다. 차이는 우회 기술이 아닙니다. 차이는 무엇이 장벽 뒤에 있는가입니다.

엔지니어와 데이터 소유자가 기억해야 할 결론: 행위의 기술적 동일성이 법적 결과의 동일성을 의미하지 않는다. 동일한 스크립트가 한 사건에서는 공개 사실에 대한 합법적인 작업으로, 다른 사건에서는 보호된 작품의 보호를 우회하는 것으로 간주됩니다.

이 사건에서 프록시의 역할

우리 산업에서 이 사건의 가장 흥미로운 점은 Perplexity가 아니라 피고 목록의 두 다른 이름입니다. Oxylabs와 AWMProxy는 증인으로서가 아니라 "제3자의 도구"로서가 아니라 공동 피고로서 소환되었습니다: 원고는 익명화 인프라가 우회 계획의 일부라고 주장합니다.

Oxylabs의 소송 기각 신청은 법원이 보류했습니다 — 그 주장이 SerpApi와 Perplexity의 주장을 상당히 겹치기 때문에 브리핑이 피고의 신청이 해결될 때까지 동결되었습니다. 이 신청들은 이제 해결되었으며, 기본적인 우회 이론은 살아남았습니다. 즉, 프록시 제공업체의 차례가 되었고, 그들은 6개월 전보다 훨씬 열악한 협상 위치에 있습니다.

사건 자료에서 두 가지 세부 사항이 있습니다. 이는 규모와 증명 방법에 대해 많은 것을 말해줍니다:

  • 법원 요청을 통해 얻은 데이터에 따르면, SerpApi는 2025년 7월 2주 동안 약 18억 개의 Google 검색 결과 페이지에 접근했습니다. 이 페이지에는 Reddit의 데이터가 포함되어 있었습니다.
  • Reddit은 고전적인 함정을 사용했습니다: Google 크롤러에게만 보이는 콘텐츠를 게시한 후, Perplexity의 응답에서 이를 발견했습니다. 이는 "그들이 어딘가에서 데이터를 가져온다"는 추상적인 주장을 구체적인 공급망으로 전환하는 증거의 유형입니다.

"오염된 미끼" 기법은 다른 이유로도 기억할 가치가 있습니다. 이는 대형 플랫폼이 차단에서 증거 수집으로 전환했음을 보여줍니다: 마킹된 콘텐츠, 허니팟 페이지, 고유한 스니펫. 네트워크 수준에서의 주의는 콘텐츠 자체가 마킹되어 있다면 구제되지 않습니다.

소송의 약점, 잘 다루어지지 않는 부분

Reddit은 첫 번째 필터를 통과했지만, 그 입장은 결코 완벽하지 않으며, 방어는 두 가지 약점에 집중하고 있습니다.

첫 번째 — 누가 게시물을 소유하는가. Reddit의 사용자 계약은 게시물에 대한 권리를 저자에게 남기고, 플랫폼은 비독점 라이센스를 받습니다. SerpApi는 이 간극이 "각 주장에 치명적"이라고 주장합니다: 소유하지 않는 것을 저작권으로 보호할 수는 없습니다. Google에 대한 동일한 주장은 전혀 작동하지 않았습니다 — 그곳에서는 자체 결과에 대한 논쟁이었습니다.

두 번째 — 특정 예시의 보호 가능성. Reddit은 확장된 고소장에서 자신이 저작권을 주장하는 자료의 샘플을 제시했습니다: 개인정보 보호 정책의 일부, 영화 목록, 재즈 클럽의 날짜와 주소. 방어 측은 목록, 사실 및 짧은 조각이 보호 기준에 미치지 못한다고 합리적으로 반박합니다. 게다가 별도의 주장: SearchGuard는 사람이 매끄럽게 통과할 수 있으므로 "효과적인 접근 통제 수단"이 아닙니다 — 하나의 접근 경로는 항상 열려 있습니다.

이 주장은 어디에도 사라지지 않았습니다 — 단지 본질 단계까지 연기되었습니다. 따라서 "Reddit이 승리했다"는 강한 단순화입니다. 더 정확하게 말하면: 스크래퍼 및 데이터 구매자에 대한 우회 이론이 뉴욕 법원에서 생존할 권리를 얻었다. 미국에서는 한 지구의 결정이 다른 지구를 구속하지 않으며, 우리는 실시간으로 관행의 분열을 목격하고 있습니다.

실질적으로 이것이 의미하는 바

비즈니스를 위해 데이터를 수집하는 경우, 7월 31일의 결정에서 몇 가지 실질적인 사항이 도출됩니다.

  1. 장벽이 아닌 그 뒤의 콘텐츠를 평가하십시오. 가격, 일정 또는 주소가 있는 페이지에서 CAPTCHA를 우회하는 것은 위험의 한 가지 이야기입니다. 동일한 장벽을 우회하여 누군가의 권리가 있는 텍스트, 사진 및 리뷰를 얻는 것은 근본적으로 다릅니다. 법적 노출은 도구가 아니라 객체에 의해 결정됩니다.
  2. 데이터 구매자는 더 이상 안전하지 않습니다. Perplexity는 자신이 단지 최종 구매자이며 "공식적인 논의를 요약한다"고 주장했습니다. 법원은 이 주장을 사건을 종결하기에 충분하다고 보지 않았습니다. 이는 준비된 데이터 세트를 구매하는 모든 사람에게 직접적인 신호입니다: 데이터의 출처를 설명할 수 있어야 합니다.
  3. 계약 및 ToS는 DMCA와 별개로 존재합니다. 저작권 이론이 무너지는 곳에서도 사용 조건 위반은 독립적인 근거로 남아 있습니다. DMCA에서 플랫폼의 패배는 스크래핑이 "법원에 의해 허용된다"는 것을 의미하지 않습니다.
  4. 인프라 계층이 원고에게 가시화되었습니다. 프록시 제공업체가 피고 목록에 포함될 때, "내 공급자가 내 트래픽에 대해 무엇을 알고 기록하는가"라는 질문은 더 이상 편집증적이지 않습니다. 출처가 명확하고 허용 가능한 사용 정책과 KYC가 있는 공급자를 선택하십시오 — 이는 인프라 파트너를 다른 사람의 계획의 참가자와 구별하는 지루한 문서 부분입니다. 우리는 프록시를 통한 데이터 수집의 합법적인 관행에 대한 분석에서 기준에 대해 썼습니다.
  5. 위험 수준에 따라 작업을 분리하십시오. 가격 모니터링, 결과 확인, 자체 리소스의 가용성 제어 및 지리적 테스트 — 예측 가능한 법적 프로필을 가진 전형적인 시나리오입니다; 이들은 주거용 프록시 또는 저렴한 데이터 센터 주소에 적합합니다, 만약 플랫폼이 "주거" 출처를 요구하지 않는다면. 타인의 저작권 콘텐츠를 대량으로 추출하여 모델을 교육하는 것은 현재 법정으로 넘어가는 시나리오이며, 이는 IP 회전이 아니라 라이센스로 해결해야 합니다.

요약

11일 만에 두 개의 연방 법원이 동일한 장벽의 동일한 우회를 평가하는 데 있어 의견이 달라졌습니다. 캘리포니아: 저작권이 없는 검색 보호 우회 — DMCA 위반이 아닙니다. 뉴욕: 장벽 뒤에 보호되는 사용자 콘텐츠가 있다면, 우회 주장은 심리될 권리가 있으며, 그와 함께 중개인 및 데이터 구매자에 대한 주장도 있습니다.

데이터를 전문적으로 다루는 사람들에게는 한 가지 결론이 있습니다: 수집의 기술적 측면이 더 이상 주요 위험 요소가 아닙니다. 주요 질문은 당신이 가져가는 것에 대한 권리와 그 데이터가 당신에게 오는 투명한 공급망에 대한 것입니다. 사건의 다음 이정표는 피고에 대한 결정 이후 법원이 동결을 해제한 Oxylabs의 신청입니다.

```