返回博客

谷歌在抓取搜索结果的诉讼中败诉:SerpApi案件及其影响

2026年7月20日,加利福尼亚联邦法院驳回了谷歌对SerpApi的诉讼:反机器人系统SearchGuard在普通搜索结果(如URL、摘要和索引事实)背后并不保护版权。我们来分析裁决的细节,哪些内容被排除在外,以及这对SERP数据收集实践的影响。

📅2026年7月24日
谷歌在抓取搜索结果的诉讼中败诉:SerpApi案件及其影响

2026年7月20日,加利福尼亚北区联邦法院驳回了谷歌对SerpApi的诉讼——这是一家通过API出售搜索结果访问权限的公司。 谷歌试图将DMCA的反爬虫条款应用于SERP抓取——这些条款最初是针对破解DVD保护而制定的。法院回应称,围绕未受版权保护的数据的技术障碍不受版权法保护。我们来分析一下法院实际裁定了什么,未裁定什么,以及这对所有从搜索结果中收集数据的人意味着什么。

发生了什么:案件时间线

谷歌于2025年12月19日提起诉讼(案件编号25-cv-10826-YGR,加利福尼亚北区)。被告是SerpApi,这是一项通过API以结构化形式提供谷歌搜索结果的服务。其数据支撑着相当一部分SEO行业:排名跟踪器、关键词工具、竞争情报仪表盘。

案件材料的关键事实:

  • SearchGuard——谷歌于2025年1月推出的反爬虫系统。它向来自未知来源的请求发送JavaScript挑战,并要求确认浏览器背后是人类。自动化程序通常无法通过这些检查并会被拒绝。
  • 谷歌声称,SerpApi每天生成“数亿个虚假搜索请求”,而请求量在两年内增长了大约25,000%
  • 谷歌要求法定赔偿——每次绕过行为的赔偿在200美元到2500美元之间。在数百万请求的情况下,赔偿金额远远超过了SerpApi的年收入,后者以数百万美元计量。换句话说,如果诉讼成功,谷歌将直接关闭这家公司。
  • SerpApi于2026年2月提出驳回申请。裁决由地区首席法官伊冯娜·冈萨雷斯·罗杰斯于2026年7月20日作出。

为什么DMCA没有奏效

DMCA第1201条禁止绕过“有效控制版权作品访问的技术手段”。谷歌的逻辑是:SearchGuard是一种保护技术,SerpApi绕过了它,因此存在侵权。

法院逐一分析了这一构造。普通搜索结果——URL、摘要、实际索引数据、排名——是公开事实,而不是“受版权保护的作品”。因此,在这一部分,SearchGuard“不能被视为有效控制对受保护作品的访问”。基于非版权结果的索赔被驳回且不允许重新提交

谷歌指出,搜索结果页面是“受保护和未受保护内容的‘混合’”,并举例说明知识面板中的许可图像。在这里,法院采取了更温和的立场:这些索赔被驳回但允许修正诉讼。但前提是——谷歌必须提供证据,证明SearchGuard保护了受版权保护的元素并获得了权利持有者的授权。仅仅将他人的许可图像放在自己的页面上并声称自己的反机器人系统是其保护措施是不可行的。谷歌有21天的时间提交修正后的诉讼。

SerpApi博客的最终表述:法院“驳回了谷歌试图将DMCA扩展到对公共页面访问控制的尝试”。公司的首席执行官朱利安·哈莱吉称这一裁决为“对公共数据开放访问的保护”。

为什么这个案件比两家公司之间的争端更重要

过去一年半的背景解释了谷歌为何会提起诉讼。从技术上讲,谷歌在SERP数据市场上施加了压力:

  • 2025年9月,谷歌移除了参数num=100,该参数允许一次请求获取100个结果。工具的完整抓取成本大约增加了十倍
  • 当DataForSEO推出了一种绕过解决方案,降低了约80%的成本时,谷歌在五天内将其封锁。

也就是说,从技术层面上讲,谷歌已经在获胜。诉讼是试图为此增加法律杠杆:将绕过反机器人系统的行为转变为每个请求都有固定罚款的违法行为。法院对此并未通过。如果通过,任何公共页面上的CAPTCHA或JS挑战将自动成为“作品的技术保护措施”——任何公共数据解析器将默认成为DMCA的违法者。

经济问题:为什么SERP数据之争如此激烈

搜索结果不仅仅是“另一个数据源”。它们构成了一个完整的行业:排名跟踪、竞争分析、价格监测、用于AI模型的训练数据集。在此过程中,谷歌处于矛盾的境地:公司本身是基于大量收集他人内容建立搜索的,但希望完全控制聚合结果的访问。

另一个层面是人工智能。搜索结果成为语言模型快速获取互联网新图景的便捷方式,而无需自己的爬虫。这就是为什么在过去一年的诉讼中,除了传统的爬虫服务外,AI公司也越来越多地出现在其中。“我们只是阅读公共页面”的论点在SEO工具和AI助手中听起来都是一样的,而法院才刚刚开始厘清它们之间的界限。SerpApi的案件至少在一个问题上给出了明确的答案:版权法不会因为事实被放在CAPTCHA后面而扩展。

这一裁决延续了在hiQ Labs诉LinkedIn案件中熟悉的思路:收集公开数据本身并不会因为平台所有者的不满而变成犯罪。不同之处在于,hiQ涉及CFAA(未经授权的访问),而这里关闭了另一条绕过途径——版权法。

这一裁决并未取消的内容

在这里,重要的是不要将一个事件的胜利与特赦混淆。仍然存在的内容包括:

  1. 技术封锁依然存在。 SearchGuard的运作方式与7月19日时完全相同。法院裁决并未开放访问——它仅仅消除了特定类型的法律责任。抓取搜索结果在技术上依然困难且昂贵。
  2. 合同索赔和服务条款。 违反用户协议是一个单独的法律领域,DMCA裁决并未涉及。
  3. 特定元素的版权。 法院确实留了一扇门开着。实际搜索结果——事实;知识面板中的图像、许可内容、照片、用户评论——则不在此列。收集“页面上的所有内容”和收集排名及摘要是法律上不同的行为。
  4. 并行诉讼。 2025年10月,Reddit在纽约南区对Perplexity AI、SerpApi、Oxylabs和AWMProxy提起诉讼,指控他们绕过保护并收集数据用于AI;修正后的投诉于2026年2月6日提交,案件正在审理驳回申请。此外,SerpApi还在德克萨斯州对SearchApi进行反诉。法律环境仍然存在争议。

最重要的是:这是初审法院的裁决,而非上诉先例。谷歌可以在许可内容部分修正诉讼,然后进行上诉。认为问题已永久解决为时尚早。

这对实践的意义

如果您从搜索结果中收集数据或计划这样做,对这一裁决的合理反应不是“现在可以做任何事”,而是明确工作规则。

  1. 在解析器层面区分事实和受保护内容。 URL、标题、摘要、排名、块的存在——这是事实层面,法院在这一点上的立场最强。图像、嵌入的许可材料、完整的评论文本——属于风险区。这在技术上意味着在提取器中使用白名单字段,而不是“为了保险起见保存所有HTML”。
  2. 不要混淆法律风险与操作风险。 您在抓取SERP时的主要问题不是诉讼,而是封锁、验证码和IP质量。市场已经收紧:在取消num=100后,同样的数据量的请求成本高得多。我们在关于抓取谷歌SERP和AI概述的指南中讨论了实际方面——如何抓取哪些块以及为什么会断开会话。
  3. 保持合理的负载。 “请求增长25,000%”这一数字在诉讼中并非偶然:激进的请求量本身就成为对您不利的论据——无论是在法庭上还是在反机器人系统面前。合理的间隔、优先请求而非全面抓取以及结果缓存可以同时降低这两种风险。
  4. 根据任务保持地理位置和IP类型。 搜索结果根据地区个性化,而从“随便哪个地方”抓取的数据是完全不准确的。对于地理精确和稳定的会话,通常会使用住宅代理;对于大量同类技术请求,检测敏感度较低的情况下,使用数据中心代理更便宜。
  5. 记录您收集的内容及其目的。 一份半页的内部文件——来源、字段、频率、存储期限——成本不高,而在任何争议中可以区分研究收集与无控制的提取。相关的法律细节在关于合法使用代理的材料中进行了讨论。

结论

2026年7月20日的裁决是关于公共搜索结果抓取的争议中的一个重要节点。法院拒绝将反机器人系统视为“作品的保护”,当其背后是事实而非创意内容时,并最终驳回了这一索赔。同时,法院给谷歌留下了21天的时间,尝试从页面的许可元素方面入手。

对数据市场的实际意义很简单:对搜索结果中事实收集的法律压力减弱了,而技术压力则没有,也不会减弱。SEO分析、竞争情报和价格监测工具继续以与之前相同的方式运作:高质量的访问基础设施、谨慎的负载和清晰的理解您从页面上提取的具体字段。