SerpApi DMCA 裁决:Reddit 与 Google 两案意味着什么

2026 年 7 月 20 日,Google 诉 SerpApi 的 DMCA 案被驳回;7 月 31 日,Reddit 诉 SerpApi 和 Perplexity 案挺过了驳回动议。本文解释两家法院为何结论不同,以及这对采集团队意味着什么。

The SerpApi DMCA Rulings: What Reddit's and Google's Cases Mean
本文目录

2026 年 7 月的两项 SerpApi DMCA 裁决指向不同方向,但都不是最终判决。7 月 20 日,加州一家法院驳回了 Google 针对 SerpApi 的反规避诉请,理由是大多数搜索结果不包含受版权保护的作品;而对于包含此类作品的部分,Google 没有主张版权所有者授权了它的 SearchGuard 防护。7 月 31 日,纽约一家法院则允许 Reddit 针对 SerpApi 和 Perplexity 提出的几乎相同的诉请继续推进,因为 Reddit 做了这项主张。对采集团队来说,两家法院传递的实际信息是一样的:采集公开页面是一回事,突破守护授权内容的具名反爬系统是另一回事,而 DMCA 可以管到后者。

以下内容截至 2026 年 10 月初。两案都处于起诉状审查阶段。没有任何法院认定有人违反了 DMCA,本文所述也都不是实体裁决。

一张表看懂 SerpApi DMCA 裁决

Google 的案件被部分驳回但允许修改,之后已重新提交。Reddit 的案件大部分挺过了驳回动议,目前处于证据开示阶段。

Google 诉 SerpApiReddit 诉 SerpApi、Perplexity 等
法院 / 案号加州北区联邦地区法院,No. 4:25-cv-10826-YGR纽约南区联邦地区法院,No. 1:25-cv-08736-PAE
起诉日期2025 年 12 月 19 日2025 年 10 月 22 日
法官首席法官 Yvonne Gonzalez Rogers法官 Paul A. Engelmayer
裁决2026 年 7 月 20 日:批准驳回动议2026 年 7 月 31 日:驳回动议“大部分”被拒
诉请§1201(a)(1)(A) 规避;§1201(a)(2) 交易§1201(a)(1)(A)、§1201(a)(2)、§1201(b)、民事共谋、不当得利、不正当竞争
保留下来的原起诉状中无一保留;2026 年 8 月 10 日提交修改后的起诉状针对 SerpApi 和 Perplexity 的 (a)(1)(A) 及民事共谋;针对 SerpApi 的 (a)(2)
被驳回的不含受版权保护内容的结果:驳回且不允许修改。含受版权保护成分的结果:驳回但允许修改§1201(b);不当得利和不正当竞争(被《版权法》优先适用排除)
现状SerpApi 于 8 月下旬申请驳回修改后的起诉状;截至 10 月 3 日待决;证据开示暂停证据开示进行中;Oxylabs 单独提出的驳回动议待决;SerpApi 已依据反垄断法对 Reddit 提起反诉

SearchGuard 是什么,SerpApi 被指控做了什么

SearchGuard 是 Google 于 2025 年 1 月在搜索上推出的反抓取层。根据 7 月 20 日裁定中对 Google 起诉状的概述,它会向来源不明的查询下发一段 JavaScript “挑战”。浏览器必须运行这段代码,并回传关于自身和用户的信息。真实浏览器会在后台无感完成这一步,而高频自动化客户端通常做不到,于是拿不到结果。

Google 指控 SerpApi 通过两种方式绕过了它。一是“谎报发送查询的设备、软件或位置”,以掩饰自动化查询。二是只解一次挑战,然后把得到的授权分发给其他从未解过挑战的浏览器。Reddit 的起诉状点名了同样的手法。Loeb & Loeb 对 Reddit 案意见书的总结引用了关于“代理、伪造的 user-agent 字符串和‘荒唐速度’(ludicrous speed)功能”的指控。

Reddit 的案件还多了一个环节。Reddit 称,SerpApi、Oxylabs 和 AWMProxy 抓取 Google 搜索结果页来收集 Reddit 帖子,而 Perplexity 使用了这些产出。其关键证据(MediaPost 在起诉时报道过)是一篇只有 Google 爬虫才能索引的测试帖。Reddit 称,这篇帖子的内容在几小时内就出现在了 Perplexity 的回答里。这些都只是指控,法院仅为审理动议之目的将其视为真实。

用大白话讲 DMCA §1201

《版权法》第 1201 条规定,破解受版权保护作品上的技术锁,或出售用于破解的工具,均属违法,即使你从未复制任何东西。这里涉及三项条款(17 U.S.C. §1201):

条款禁止什么措施类型针对谁
§1201(a)(1)(A)规避“有效控制”受保护作品访问的措施的行为访问控制(一道门)规避者
§1201(a)(2)制造、提供或以“其他方式交易”主要用于规避访问控制的技术或服务访问控制工具和服务提供者
§1201(b)(1)交易用于规避保护“版权所有者权利”(复制、发行)之措施的工具复制/权利控制仅限工具提供者;对规避行为本身没有相应禁令

大多数争议取决于两个定义。根据 §1201(a)(3)(A),“规避”是指“未经版权所有者授权,避开、绕过、移除、停用或削弱技术措施”。根据 §1201(a)(3)(B),如果一项措施“在版权所有者授权下,要求应用某种信息、程序或处理才能访问作品”,它就“有效控制访问”。“在版权所有者授权下”这几个字,正是两家法院分歧所在。

利害关系来自 §1203。“任何受损害的人”都可以起诉,法定赔偿为“每次规避行为、每件设备、产品、组件、要约或服务提供” 200 至 2,500 美元。当被指控的行为以数十亿次查询计时,正是这种按次计算的公式让此类案件对被告极其危险。

两家法院为何结论不同

两家法院在法律上大体一致,分歧在于各原告就版权所有者授权主张了什么。

Google:要么没有受版权保护的作品,要么没有授权证据

Gonzalez Rogers 法官驳回了 SerpApi 的若干论点。Google 具有诉讼资格:§1203 中的“任何受损害的人”并不限于版权所有者。一项措施也不必只保护受版权保护的材料。而且 Google 关于掩饰身份和分发 token 的指控足以构成对规避的主张。但她仍然驳回了起诉,理由有二:

  • 不含受版权保护内容的搜索结果。Google 把搜索结果描述为“公开信息的汇编”。如果一个结果页里没有任何受版权保护的内容,SearchGuard 就不可能是在控制对“受本法保护的作品”的访问。这部分被驳回且不允许修改。
  • 含受版权保护成分的结果(例如知识面板中的授权图片)。Google 没有提出事实表明 SearchGuard “是在版权所有者授权下实施并用于控制对受版权保护成分的访问”。仅称自己持有许可,而不提供许可条款,是不够的。这部分被驳回但允许修改。

Google 于 8 月 10 日重新提交起诉状。据 Search Engine Journal 报道,修改后的起诉状补充了许可条款:一项合作协议要求采取“商业上合理的努力”保护授权内容,而它与 Reddit 的协议限制第三方提取和转售。SerpApi 再次申请驳回,理由之一是 Google 没有把这些协议提交给法院。

Reddit:主张了具体的限制条款

Reddit 能主张 Google 最初没有主张的内容。根据 Loeb & Loeb 对这份 63 页意见书的总结,Engelmayer 法官认为,§1201 只要求版权持有人“概括地授权实施措施”,而不要求他们批准某项具体技术。Reddit 援引了其用户协议以及与 Google 的合作关系,后者包含“具体的使用限制和防止未经授权访问的要求”。这就足够了。意见书中的其他要点(据总结):

  • SearchGuard 属于访问控制,即便人类可以自由通过。意见书把它比作“一种人脸识别技术,被设定为给住户开门,却不给其他访客开门”。放人通过、拦住机器人并不是漏洞,这正是这道门的工作方式。
  • Perplexity 可能是直接规避者。据称它设定了抓取参数,并通过 SerpApi 执行查询,因此 (a)(1)(A) 诉请对它同样继续推进。
  • §1201(b) 不成立,因为 SearchGuard “阻止对内容的访问,但不控制用户获得内容之后如何使用”。它是一道门,而不是复制控制。
  • 州法诉请。不当得利和不正当竞争被优先适用排除,因为它们实质上等同于未经授权的复制。民事共谋针对 SerpApi 和 Perplexity 均得以保留,因为共谋规避的约定是一个额外要件。
  • 诉讼资格。Reddit 合理地主张了对“数以万计的帖子和评论”的版权利益、损失的许可收入以及声誉损害(包括其内容删除功能被规避所造成的损害)。

据 Law360 报道,SerpApi 的律师表示“事实站在我们这边”。Perplexity 则主张此案关乎“公开信息”。

此后 SerpApi 转守为攻。在 8 月 28 日提交的答辩和反诉中,它依据《谢尔曼法》第 2 条指控 Reddit 垄断和企图垄断,称自 2024 年 7 月起,Reddit 的爬虫规则允许 Google 进入,却把 Bing、DuckDuckGo 等搜索引擎拒之门外,并援引了据报道 Reddit 与 Google 每年 6,000 万美元的许可协议。据 PPC Land 报道,它还请求法院作出缩小 DMCA 诉请范围的宣告。Reddit 于 9 月 25 日申请驳回反诉,称 SerpApi 是“搭便车者”(MLex);10 月 2 日,Engelmayer 法官暂停了反诉的证据开示,直到该动议作出裁决。Reddit 自身诉请的证据开示(包括其与 Google 的协议)仍在继续。

与 hiQ 诉 LinkedIn 案和 Van Buren 案有何不同

CFAA 案件问的是你是否被授权使用一台计算机。第 1201 条问的是你是否突破了守护受版权保护作品的措施。“公开”对第一个问题有帮助,但到目前为止对第二个问题没有。

  • Van Buren 诉美国案(2021 年)把《计算机欺诈和滥用法》中的“超越授权访问”收窄为一个“门开还是门关”的问题:你是否有权进入系统的那一部分?出于不当目的使用你本已拥有的访问权限,并不构成“超越授权访问”。
  • hiQ Labs 诉 LinkedIn 案(第九巡回法院,2022 年 4 月)沿用了这一观点:抓取任何人无需登录即可查看的页面,很可能不构成 CFAA 下的“未经授权”访问。但 hiQ 后来在违约问题上败诉(其抓取行为和虚假的 “turker” 账号违反了 LinkedIn 用户协议),并于 2022 年 12 月和解,支付 50 万美元并接受永久禁令。

SerpApi 援引了这两个案件。Gonzalez Rogers 法官认为它们不适用,因为它们解释的是 CFAA,而不是 DMCA。对于那些把采集的法律模型理解为“hiQ 案之后公开数据随便抓”的人来说,这是最主要的教训。按两家法院的理解,DMCA 不取决于页面是否公开,而取决于你和受版权保护的作品之间是否隔着一项措施,以及你是否绕过了它。

如果想从法律和技术两方面更全面地了解单个平台,我们的 LinkedIn 采集指南更详细地梳理了 hiQ 案的来龙去脉。

哪些已经确定,哪些还没有

确定下来的很少。驳回动议只审查起诉状在假定为真的前提下是否构成诉请。

  • 尚未确定:SerpApi 或 Perplexity 是否真的规避了任何措施,摘要内容是否以有意义的方式受版权保护,是否适用合理使用之类的抗辩或其他抗辩,以及应否赔偿、赔偿多少。
  • 暂时确定,且仅限起诉状审查阶段:在加州北区,围绕不受版权保护之事实的关卡不构成 §1201 访问控制。在纽约南区,只拦机器人的关卡如果经版权所有者授权,就可以构成访问控制。地区法院的裁决对其他法院没有约束力,二者都可能在上诉中被重新审视。
  • 仍有可能:和解、简易判决、庭审、上诉。据 Inner City Press 报道,在 10 月 1 日的庭前会议上,Engelmayer 法官表示 Oxylabs 的动议不太可能获批,并提出可由治安法官协助和解。

对采集团队的实际影响

这些案件发出的风险信号不是“采集”或“代理”,而是一种特定模式:突破守护授权内容的具名技术措施,通常是为了转售其背后的内容。常见做法与这一模式的对应关系如下:

做法这些案件发出的风险信号风险较低的替代方案
破解或重放网站的反爬挑战 token(例如把一个已解的会话分发给许多客户端)高。法院认定 Google 关于 token 分发的指控足以构成规避主张,Reddit 案法院把只拦机器人的关卡视为访问控制不要把业务建立在突破具名访问控制之上;使用服务方的官方 API 或获取许可
专门为了通过挑战而伪造设备、软件或位置高。两家法院都将其列为符合“避开、绕过……或削弱”的情形如实标识你的爬虫;遇到挑战拦截时,把它当作“不行”
转售从第三方结果页抓取的数据(SERP 即服务模式)高。§1201(a)(2) 涵盖提供服务,针对 SerpApi 的交易诉请得以保留获取数据许可,或按原始发布者的条款从其处采集
从此类厂商购买抓取数据,并决定其抓取内容中到高。Perplexity 作为被指控的直接规避者被列入此案,因为据称是它设定了参数要求厂商以书面形式说明数据来源和许可;优先使用授权数据源
以克制的速率采集无需登录、没有挑战的公开页面在 §1201 下风险低(没有规避任何措施);合同法、版权法和隐私法仍然适用在对你有约束力时遵守 robots.txt 和服务条款;限定字段范围;避免采集不需要的个人数据
抓取关卡后面没有受版权保护内容的事实信息(价格、排名、URL)Google 案裁决后在 §1201 下风险较低,但该认定仅约束该案仍应优先使用官方 API;不要依赖某一家地区法院的观点
使用官方 API 或数据许可在这些理论下风险极小任何关键业务的基本做法

关于代理,既然它出现在指控中,这里补充一点。通过住宅 IP 或地理定位 IP 路由请求,是从正确市场采集公开数据的标准做法。我们的 SERP 采集指南和 Google 搜索结果采集教程介绍了这方面的内容。诉状描述的是另一回事:IP 与虚假身份和 token 重放一起被用来突破一道特定的关卡。使用 USERNAME-country-US 的 ProxyHat 网关能给你一个美国的访问视角,但它不是许可,也不会改变上述法律分析。如果你的场景专门针对 Reddit 数据,请先查看 Reddit 自己的 API 条款。我们的 Reddit 采集指南讨论了这条路径。

接下来值得关注什么

  • Google 案中对 SerpApi 第二次驳回动议的裁决。它将表明 Gonzalez Rogers 法官是否认为补充主张的许可条款已经足够,若是如此,两家法院的立场将更加接近。
  • Reddit 案中 Oxylabs 的动议、Reddit 驳回 SerpApi 反垄断反诉的动议,以及 AWMProxy 那部分案情是否会有任何进展。
  • 针对“版权所有者授权”问题的任何中间上诉。上诉法院的裁决将比任何一项地区法院裁定都重要得多。

本文为工程师总结公开的法院文件和相关报道,不构成法律意见。如果你的采集依赖于绕过网站的技术控制,请在投入建设之前咨询在相关司法管辖区执业的律师。

常见问题

在 Google 诉 SerpApi 案中,法院是否裁定抓取 Google 合法?

没有。2026 年 7 月 20 日,法院在起诉状审查阶段驳回了 Google 的 DMCA 诉请,部分原因是不含受版权保护内容的搜索结果不属于受保护作品,部分原因是 Google 未主张版权所有者授权了 SearchGuard。Google 于 2026 年 8 月 10 日提交了修改后的起诉状,案件仍在审理中。

Reddit 诉 SerpApi 和 Perplexity 案结果如何?

2026 年 7 月 31 日,纽约南区法院的 Paul Engelmayer 法官基本驳回了被告的驳回动议。针对 SerpApi 和 Perplexity 的 DMCA §1201(a)(1)(A) 规避诉请、针对 SerpApi 的 §1201(a)(2) 交易诉请得以继续,纽约州民事共谋诉请也得以保留;§1201(b) 诉请以及不当得利和不正当竞争诉请被驳回。案件尚未作出任何实体判决。

DMCA 1201(a) 和 1201(b) 有什么区别?

第 1201(a) 条针对访问控制措施:(a)(1)(A) 禁止规避行为本身,(a)(2) 禁止交易用于规避的工具或服务。第 1201(b) 条针对保护版权所有者权利的措施(例如复制控制),只禁止交易规避工具,不禁止规避行为本身。

hiQ 诉 LinkedIn 案能让抓取公开数据免于 DMCA 诉请吗?

单凭它不行。hiQ 案(第九巡回法院,2022 年)涉及的是《计算机欺诈和滥用法》(CFAA),Google 诉 SerpApi 案的法院认为它不适用于 DMCA。DMCA 的问题是你是否规避了控制受版权保护作品访问的技术措施,即便人类可以自由查看页面,这一点也可能成立。

用代理做数据采集违反 DMCA 吗?

使用代理本身并不违反 DMCA,这些裁决也没有这么说。诉状中的指控是把代理与虚假身份和 token 重放结合起来,用于突破一项特定的访问控制措施 SearchGuard。在不绕过此类措施的情况下采集公开页面是另一回事,但合同、版权和隐私规则依然适用。

抓取时你的代理被封了吗?

免费检测代理 — 几秒内查看封锁率、速度和匿名性。无需注册。

免费检测我的代理
← 返回博客