블로그로 돌아가기

구글, 스크래핑 소송에서 패소: SerpApi 사건과 그 변화

2026년 7월 20일, 캘리포니아 연방 법원은 Google의 SerpApi에 대한 소송을 기각했습니다: 안티봇 시스템 SearchGuard는 일반 검색 결과인 URL, 스니펫 및 인덱스 사실이 있을 때 저작권을 보호하지 않습니다. 결정의 세부 사항을 분석하고, 그 범위를 벗어난 내용과 SERP 데이터 수집 관행에 미치는 영향을 살펴봅니다.

📅2026년 7월 24일
구글, 스크래핑 소송에서 패소: SerpApi 사건과 그 변화
```html

2026년 7월 20일, 캘리포니아 북부 연방 법원이 SerpApi에 대한 Google의 소송을 기각했습니다. SerpApi는 API를 통해 검색 결과에 대한 접근을 판매하는 회사입니다. Google은 SERP 스크래핑에 대해 DMCA의 우회 금지 규정을 적용하려 했습니다. 이는 DVD 보호 해킹에 대해 작성된 규정입니다. 법원은 저작권으로 보호되지 않는 데이터에 대한 기술적 장벽은 저작권법에 의해 보호되지 않는다고 답변했습니다. 법원이 실제로 무엇을 결정했는지, 무엇을 결정하지 않았는지, 그리고 데이터 수집자에게 어떤 의미가 있는지 살펴보겠습니다.

무슨 일이 있었나: 사건의 연대기

Google은 2025년 12월 19일 소송을 제기했습니다(사건 번호 25-cv-10826-YGR, 캘리포니아 북부). 피고는 API를 통해 구조화된 형태로 Google 검색 결과를 제공하는 SerpApi입니다. 이 데이터는 SEO 산업의 상당 부분에서 사용됩니다: 순위 추적기, 키워드 도구, 경쟁 정보 대시보드 등이 있습니다.

사건 자료의 주요 사실:

  • SearchGuard — Google이 2025년 1월에 시작한 안티 스크래핑 시스템입니다. 이는 식별되지 않은 출처의 요청에 JavaScript 챌린지를 보내고 브라우저 뒤에 사람이 있음을 확인하도록 요구합니다. 자동화된 시스템은 이러한 검사를 일반적으로 통과하지 못하고 거부됩니다.
  • Google에 따르면, SerpApi는 “하루에 수억 개의 인위적인 검색 요청을 생성했다” 고 주장하며, 요청량이 약 25,000% 증가했다고 합니다.
  • Google은 법정 손해배상을 요구했습니다 — 우회 행위마다 $200에서 $2500까지. 수백만 건의 요청으로 인해 이 금액은 SerpApi의 연간 수익을 훨씬 초과했습니다. 다시 말해, 소송이 성공한다면 회사는 사실상 문을 닫게 됩니다.
  • SerpApi는 2026년 2월에 기각 신청을 했습니다. 결정은 이본 곤잘레스 로저스 주심 판사가 2026년 7월 20일에 내렸습니다.

왜 DMCA가 작동하지 않았는가

DMCA의 섹션 1201은 “저작권법으로 보호되는 작품에 대한 접근을 효과적으로 통제하는 기술적 수단을 우회하는 것을 금지합니다.” Google의 논리는 SearchGuard가 기술적 보호 수단이고, SerpApi가 이를 우회하므로 위반이 성립한다는 것입니다.

법원은 이 구조를 부분별로 분석했습니다. 일반적인 검색 결과 — URL, 스니펫, 실제 인덱스 데이터, 순위 — 는 공개된 사실이지 “저작권으로 보호되는 작품”이 아닙니다. 따라서 이 부분에서 SearchGuard는 “저작권으로 보호되는 작품에 대한 접근을 효과적으로 통제하는 것으로 간주될 수 없다”고 판단했습니다. 저작권이 없는 결과에 근거한 주장은 prejudice 없이 기각되었습니다.

Google은 검색 결과 페이지가 보호된 콘텐츠와 비보호 콘텐츠의 “혼합물”이라고 주장하며 Knowledge Panel의 라이센스 이미지 예를 들었습니다. 여기서 법원은 더 부드러운 입장을 취했습니다: 이러한 주장은 수정된 소송을 제출할 권리와 함께 기각되었습니다. 단, Google은 SearchGuard가 저작권 요소를 저작권 소유자의 허가로 보호하고 있다는 사실을 보여주어야 합니다. 단순히 다른 사람의 라이센스 이미지를 페이지에 게시하고 이를 자신의 안티봇 보호로 선언하는 것은 허용되지 않습니다. 수정된 소송을 제출할 수 있는 기간은 Google에게 21일입니다.

결국 SerpApi 블로그의 공식 입장은: 법원은 “Google이 DMCA를 공공 페이지에 대한 접근 통제에 확대하려는 시도를 기각했다”고 밝혔습니다. 회사의 CEO인 줄리앙 할레기는 이 결정을 “공공 데이터에 대한 개방적 접근의 보호”라고 부릅니다.

왜 이 사건은 두 회사 간의 논쟁보다 더 큰가

지난 1년 반의 맥락은 Google이 왜 소송을 제기했는지를 설명합니다. 기술적으로 Google은 SERP 데이터 시장에 압박을 가해왔습니다:

  • 2025년 9월, Google은 한 번의 요청으로 100개의 결과를 받을 수 있는 num=100 매개변수를 제거했습니다. 도구를 위한 전체 검색 결과의 비용이 약 10배 증가했습니다.
  • DataForSEO가 비용을 약 80% 줄이는 우회 솔루션을 출시했을 때, Google은 5일 만에 이를 차단했습니다.

즉, 기술적인 측면에서 Google은 이미 승리하고 있었습니다. 소송은 이를 법적으로 강화하려는 시도였습니다: 안티봇 우회를 법 위반으로 전환하고 각 요청에 대해 고정된 벌금을 부과하는 것입니다. 법원은 이를 허용하지 않았습니다. 만약 통과되었다면, 공공 페이지의 모든 CAPTCHA나 JS 챌린지는 자동으로 “작품의 기술적 보호”가 되어, 모든 공개 데이터 파서는 기본적으로 DMCA 위반자가 되었을 것입니다.

문제의 경제학: 왜 SERP 데이터에 대한 전쟁이 벌어지는가

검색 결과는 단순히 “또 다른 데이터 소스”가 아닙니다. 이로 인해 전체 산업이 형성되었습니다: 순위 추적, 경쟁 분석, 가격 모니터링, AI 모델을 위한 교육 샘플 등이 있습니다. Google은 이와 동시에 이중적인 입장에 처해 있습니다: 회사는 대량의 타인의 콘텐츠 수집을 기반으로 검색을 구축했지만, 집계된 결과에 대한 접근을 완전히 통제하고 싶어합니다.

별도의 층은 인공지능입니다. 검색 결과는 언어 모델에게 신속하게 인터넷의 최신 모습을 얻을 수 있는 방법이 되었습니다. 이 때문에 최근의 소송에서 전통적인 스크래핑 서비스와 함께 AI 회사들이 자주 등장하고 있습니다. “우리는 단순히 공개 페이지를 읽고 있다”는 주장은 SEO 도구와 AI 어시스턴트 모두에게 동일하게 들리며, 법원은 이들 사이의 경계가 어디에 있는지를 이해하기 시작했습니다. SerpApi 사건은 적어도 한 가지 질문에 대한 명확한 답변을 제공합니다: 저작권은 사실에 대해 캡차 뒤에 있다고 해서 확대되지 않습니다.

이 결정은 hiQ Labs와 LinkedIn 간의 사건에서 알려진 경향을 계속 이어갑니다: 공개 데이터 수집 자체가 플랫폼 소유자가 싫어한다고 해서 범죄로 간주되지 않습니다. 차이점은 hiQ가 CFAA(무단 접근)에 관한 것이었고, 여기서는 다른 우회 경로인 저작권법이 차단되었다는 것입니다.

이 결정이 무엇을 취소하지 않는가

여기서 한 에피소드의 승리를 면죄부로 혼동하지 않는 것이 중요합니다. 여전히 남아 있는 것들:

  1. 기술적 차단은 여전히 존재합니다. SearchGuard는 7월 19일과 동일하게 작동합니다. 법원 결정은 접근을 열어주지 않으며, 특정 유형의 법적 책임만 제거합니다. 여전히 검색 결과를 파싱하는 것은 기술적으로 어렵고 비용이 많이 듭니다.
  2. 계약적 주장 및 ToS. 사용자 계약 위반은 별개의 법적 영역이며, DMCA 결정은 이를 다루지 않습니다.
  3. 특정 요소에 대한 저작권. 법원이 열어둔 문은 바로 이 부분입니다. 실제 검색 결과는 사실입니다; Knowledge Panel의 이미지, 라이센스 콘텐츠, 사진, 사용자 리뷰는 이미 아닙니다. “페이지에서 모든 것을 수집하는 것”과 “순위와 스니펫을 수집하는 것”은 법적으로 다른 행위입니다.
  4. 병행 절차. 2025년 10월, Reddit은 Perplexity AI, SerpApi, Oxylabs 및 AWMProxy를 상대로 뉴욕 남부에서 소송을 제기하여 그들이 보호를 우회하고 AI를 위한 데이터를 수집했다고 주장했습니다; 수정된 불만은 2026년 2월 6일 제출되었으며, 사건은 기각 신청 심리 단계에 있습니다. 또한 SerpApi는 텍사스에서 SearchApi의 소송에 대응하고 있습니다. 법적 환경은 여전히 논란의 여지가 있습니다.

그리고 가장 중요한 것은: 이것은 1심 지방법원의 결정이지 항소 선례가 아닙니다. Google은 라이센스 콘텐츠에 대한 소송을 수정한 후 항소할 수 있습니다. 이 문제가 영원히 닫혔다고 단정하기는 이릅니다.

이로부터 실질적으로 무엇을 의미하는가

검색 결과에서 데이터를 수집하거나 이를 계획하고 있다면, 이 결정에 대한 합리적인 반응은 “이제 모든 것이 가능하다”가 아니라 작업 규칙을 명확히 하는 것입니다.

  1. 파서 수준에서 사실과 보호된 콘텐츠를 구분하십시오. URL, 제목, 스니펫, 순위, 블록의 존재는 사실적 층이며, 이 부분에서 법원의 입장이 가장 강합니다. 이미지, 내장된 라이센스 자료, 전체 리뷰 텍스트는 위험 영역입니다. 기술적으로 이는 추출기에서 필드의 화이트리스트를 의미하며, “모든 HTML을 저장하는 것이 아니라”는 의미입니다.
  2. 법적 위험과 운영 위험을 혼동하지 마십시오. SERP 수집 시 주요 문제는 법원이 아니라 차단, CAPTCHA 및 IP 품질입니다. 시장은 더욱 엄격해졌습니다: num=100이 제거된 이후 동일한 데이터 양은 요청당 훨씬 더 비쌉니다. 실질적인 측면 — 어떤 블록을 어떻게 수집할지, 세션이 왜 끊어지는지 — 는 Google SERP 및 AI 개요 스크래핑 가이드에서 다루었습니다.
  3. 적절한 부하를 유지하십시오. “요청량 25,000% 증가”라는 숫자는 소송에서 우연히 언급된 것이 아닙니다: 공격적인 양 자체가 법원과 안티봇의 반대 증거가 됩니다. 합리적인 간격, 전체 수집 대신 우선 요청 및 결과 캐싱은 두 가지 위험을 동시에 줄입니다.
  4. 지리적 위치와 IP 유형을 작업에 맞추십시오. 검색 결과는 지역에 따라 개인화되며, “어디서든” 수집된 데이터는 단순히 부정확합니다. 지리적으로 정확하고 안정적인 세션을 위해서는 일반적으로 주거용 프록시를 사용하며; 대량의 유사한 기술 요청에서는 감지에 대한 민감도가 낮아 데이터 센터 프록시가 더 저렴합니다.
  5. 수집하는 것과 그 이유를 기록하십시오. 내부 문서 한 페이지 반 분량 — 출처, 필드, 빈도, 보관 기간 — 는 비용이 저렴하며, 어떤 분쟁에서도 연구 수집과 무분별한 수집을 구분합니다. 관련 법적 뉘앙스는 프록시의 합법적 사용에 대한 자료에서 다루었습니다.

결론

2026년 7월 20일의 결정은 공개 검색 결과 스크래핑이 무엇인지에 대한 논쟁에서 중요한 지점입니다. 법원은 사실이 존재하는 경우 안티봇 시스템을 “작품의 보호”로 간주하는 것을 거부하고, 이 주장을 최종적으로 기각했습니다. 동시에 Google에게는 페이지의 라이센스 요소 측면에서 접근할 수 있는 21일이 주어졌습니다.

데이터 시장에 대한 실질적인 의미는 간단합니다: 검색 결과에서 사실을 수집하는 것에 대한 법적 압박이 약해졌지만, 기술적 압박은 여전히 존재하며 사라지지 않을 것입니다. SEO 분석, 경쟁 정보 및 가격 모니터링 도구는 이전과 동일한 방식으로 계속 작동합니다: 품질 높은 접근 인프라, 신중한 부하 및 페이지에서 어떤 필드를 수집하는지에 대한 명확한 이해가 필요합니다.

```