2026 年 7 月的两项 SerpApi DMCA 裁决指向不同方向,但都不是最终判决。7 月 20 日,加州一家法院驳回了 Google 针对 SerpApi 的反规避诉请,理由是大多数搜索结果不包含受版权保护的作品;而对于包含此类作品的部分,Google 没有主张版权所有者授权了它的 SearchGuard 防护。7 月 31 日,纽约一家法院则允许 Reddit 针对 SerpApi 和 Perplexity 提出的几乎相同的诉请继续推进,因为 Reddit 做了这项主张。对采集团队来说,两家法院传递的实际信息是一样的:采集公开页面是一回事,突破守护授权内容的具名反爬系统是另一回事,而 DMCA 可以管到后者。
以下内容截至 2026 年 10 月初。两案都处于起诉状审查阶段。没有任何法院认定有人违反了 DMCA,本文所述也都不是实体裁决。
一张表看懂 SerpApi DMCA 裁决
Google 的案件被部分驳回但允许修改,之后已重新提交。Reddit 的案件大部分挺过了驳回动议,目前处于证据开示阶段。
| Google 诉 SerpApi | Reddit 诉 SerpApi、Perplexity 等 | |
|---|---|---|
| 法院 / 案号 | 加州北区联邦地区法院,No. 4:25-cv-10826-YGR | 纽约南区联邦地区法院,No. 1:25-cv-08736-PAE |
| 起诉日期 | 2025 年 12 月 19 日 | 2025 年 10 月 22 日 |
| 法官 | 首席法官 Yvonne Gonzalez Rogers | 法官 Paul A. Engelmayer |
| 裁决 | 2026 年 7 月 20 日:批准驳回动议 | 2026 年 7 月 31 日:驳回动议“大部分”被拒 |
| 诉请 | §1201(a)(1)(A) 规避;§1201(a)(2) 交易 | §1201(a)(1)(A)、§1201(a)(2)、§1201(b)、民事共谋、不当得利、不正当竞争 |
| 保留下来的 | 原起诉状中无一保留;2026 年 8 月 10 日提交修改后的起诉状 | 针对 SerpApi 和 Perplexity 的 (a)(1)(A) 及民事共谋;针对 SerpApi 的 (a)(2) |
| 被驳回的 | 不含受版权保护内容的结果:驳回且不允许修改。含受版权保护成分的结果:驳回但允许修改 | §1201(b);不当得利和不正当竞争(被《版权法》优先适用排除) |
| 现状 | SerpApi 于 8 月下旬申请驳回修改后的起诉状;截至 10 月 3 日待决;证据开示暂停 | 证据开示进行中;Oxylabs 单独提出的驳回动议待决;SerpApi 已依据反垄断法对 Reddit 提起反诉 |
SearchGuard 是什么,SerpApi 被指控做了什么
SearchGuard 是 Google 于 2025 年 1 月在搜索上推出的反抓取层。根据 7 月 20 日裁定中对 Google 起诉状的概述,它会向来源不明的查询下发一段 JavaScript “挑战”。浏览器必须运行这段代码,并回传关于自身和用户的信息。真实浏览器会在后台无感完成这一步,而高频自动化客户端通常做不到,于是拿不到结果。
Google 指控 SerpApi 通过两种方式绕过了它。一是“谎报发送查询的设备、软件或位置”,以掩饰自动化查询。二是只解一次挑战,然后把得到的授权分发给其他从未解过挑战的浏览器。Reddit 的起诉状点名了同样的手法。Loeb & Loeb 对 Reddit 案意见书的总结引用了关于“代理、伪造的 user-agent 字符串和‘荒唐速度’(ludicrous speed)功能”的指控。
Reddit 的案件还多了一个环节。Reddit 称,SerpApi、Oxylabs 和 AWMProxy 抓取 Google 搜索结果页来收集 Reddit 帖子,而 Perplexity 使用了这些产出。其关键证据(MediaPost 在起诉时报道过)是一篇只有 Google 爬虫才能索引的测试帖。Reddit 称,这篇帖子的内容在几小时内就出现在了 Perplexity 的回答里。这些都只是指控,法院仅为审理动议之目的将其视为真实。
用大白话讲 DMCA §1201
《版权法》第 1201 条规定,破解受版权保护作品上的技术锁,或出售用于破解的工具,均属违法,即使你从未复制任何东西。这里涉及三项条款(17 U.S.C. §1201):
| 条款 | 禁止什么 | 措施类型 | 针对谁 |
|---|---|---|---|
| §1201(a)(1)(A) | 规避“有效控制”受保护作品访问的措施的行为 | 访问控制(一道门) | 规避者 |
| §1201(a)(2) | 制造、提供或以“其他方式交易”主要用于规避访问控制的技术或服务 | 访问控制 | 工具和服务提供者 |
| §1201(b)(1) | 交易用于规避保护“版权所有者权利”(复制、发行)之措施的工具 | 复制/权利控制 | 仅限工具提供者;对规避行为本身没有相应禁令 |
大多数争议取决于两个定义。根据 §1201(a)(3)(A),“规避”是指“未经版权所有者授权,避开、绕过、移除、停用或削弱技术措施”。根据 §1201(a)(3)(B),如果一项措施“在版权所有者授权下,要求应用某种信息、程序或处理才能访问作品”,它就“有效控制访问”。“在版权所有者授权下”这几个字,正是两家法院分歧所在。
利害关系来自 §1203。“任何受损害的人”都可以起诉,法定赔偿为“每次规避行为、每件设备、产品、组件、要约或服务提供” 200 至 2,500 美元。当被指控的行为以数十亿次查询计时,正是这种按次计算的公式让此类案件对被告极其危险。
两家法院为何结论不同
两家法院在法律上大体一致,分歧在于各原告就版权所有者授权主张了什么。
Google:要么没有受版权保护的作品,要么没有授权证据
Gonzalez Rogers 法官驳回了 SerpApi 的若干论点。Google 具有诉讼资格:§1203 中的“任何受损害的人”并不限于版权所有者。一项措施也不必只保护受版权保护的材料。而且 Google 关于掩饰身份和分发 token 的指控足以构成对规避的主张。但她仍然驳回了起诉,理由有二:
- 不含受版权保护内容的搜索结果。Google 把搜索结果描述为“公开信息的汇编”。如果一个结果页里没有任何受版权保护的内容,SearchGuard 就不可能是在控制对“受本法保护的作品”的访问。这部分被驳回且不允许修改。
- 含受版权保护成分的结果(例如知识面板中的授权图片)。Google 没有提出事实表明 SearchGuard “是在版权所有者授权下实施并用于控制对受版权保护成分的访问”。仅称自己持有许可,而不提供许可条款,是不够的。这部分被驳回但允许修改。
Google 于 8 月 10 日重新提交起诉状。据 Search Engine Journal 报道,修改后的起诉状补充了许可条款:一项合作协议要求采取“商业上合理的努力”保护授权内容,而它与 Reddit 的协议限制第三方提取和转售。SerpApi 再次申请驳回,理由之一是 Google 没有把这些协议提交给法院。
Reddit:主张了具体的限制条款
Reddit 能主张 Google 最初没有主张的内容。根据 Loeb & Loeb 对这份 63 页意见书的总结,Engelmayer 法官认为,§1201 只要求版权持有人“概括地授权实施措施”,而不要求他们批准某项具体技术。Reddit 援引了其用户协议以及与 Google 的合作关系,后者包含“具体的使用限制和防止未经授权访问的要求”。这就足够了。意见书中的其他要点(据总结):
- SearchGuard 属于访问控制,即便人类可以自由通过。意见书把它比作“一种人脸识别技术,被设定为给住户开门,却不给其他访客开门”。放人通过、拦住机器人并不是漏洞,这正是这道门的工作方式。
- Perplexity 可能是直接规避者。据称它设定了抓取参数,并通过 SerpApi 执行查询,因此 (a)(1)(A) 诉请对它同样继续推进。
- §1201(b) 不成立,因为 SearchGuard “阻止对内容的访问,但不控制用户获得内容之后如何使用”。它是一道门,而不是复制控制。
- 州法诉请。不当得利和不正当竞争被优先适用排除,因为它们实质上等同于未经授权的复制。民事共谋针对 SerpApi 和 Perplexity 均得以保留,因为共谋规避的约定是一个额外要件。
- 诉讼资格。Reddit 合理地主张了对“数以万计的帖子和评论”的版权利益、损失的许可收入以及声誉损害(包括其内容删除功能被规避所造成的损害)。
据 Law360 报道,SerpApi 的律师表示“事实站在我们这边”。Perplexity 则主张此案关乎“公开信息”。
此后 SerpApi 转守为攻。在 8 月 28 日提交的答辩和反诉中,它依据《谢尔曼法》第 2 条指控 Reddit 垄断和企图垄断,称自 2024 年 7 月起,Reddit 的爬虫规则允许 Google 进入,却把 Bing、DuckDuckGo 等搜索引擎拒之门外,并援引了据报道 Reddit 与 Google 每年 6,000 万美元的许可协议。据 PPC Land 报道,它还请求法院作出缩小 DMCA 诉请范围的宣告。Reddit 于 9 月 25 日申请驳回反诉,称 SerpApi 是“搭便车者”(MLex);10 月 2 日,Engelmayer 法官暂停了反诉的证据开示,直到该动议作出裁决。Reddit 自身诉请的证据开示(包括其与 Google 的协议)仍在继续。
与 hiQ 诉 LinkedIn 案和 Van Buren 案有何不同
CFAA 案件问的是你是否被授权使用一台计算机。第 1201 条问的是你是否突破了守护受版权保护作品的措施。“公开”对第一个问题有帮助,但到目前为止对第二个问题没有。
- Van Buren 诉美国案(2021 年)把《计算机欺诈和滥用法》中的“超越授权访问”收窄为一个“门开还是门关”的问题:你是否有权进入系统的那一部分?出于不当目的使用你本已拥有的访问权限,并不构成“超越授权访问”。
- hiQ Labs 诉 LinkedIn 案(第九巡回法院,2022 年 4 月)沿用了这一观点:抓取任何人无需登录即可查看的页面,很可能不构成 CFAA 下的“未经授权”访问。但 hiQ 后来在违约问题上败诉(其抓取行为和虚假的 “turker” 账号违反了 LinkedIn 用户协议),并于 2022 年 12 月和解,支付 50 万美元并接受永久禁令。
SerpApi 援引了这两个案件。Gonzalez Rogers 法官认为它们不适用,因为它们解释的是 CFAA,而不是 DMCA。对于那些把采集的法律模型理解为“hiQ 案之后公开数据随便抓”的人来说,这是最主要的教训。按两家法院的理解,DMCA 不取决于页面是否公开,而取决于你和受版权保护的作品之间是否隔着一项措施,以及你是否绕过了它。
如果想从法律和技术两方面更全面地了解单个平台,我们的 LinkedIn 采集指南更详细地梳理了 hiQ 案的来龙去脉。
哪些已经确定,哪些还没有
确定下来的很少。驳回动议只审查起诉状在假定为真的前提下是否构成诉请。
- 尚未确定:SerpApi 或 Perplexity 是否真的规避了任何措施,摘要内容是否以有意义的方式受版权保护,是否适用合理使用之类的抗辩或其他抗辩,以及应否赔偿、赔偿多少。
- 暂时确定,且仅限起诉状审查阶段:在加州北区,围绕不受版权保护之事实的关卡不构成 §1201 访问控制。在纽约南区,只拦机器人的关卡如果经版权所有者授权,就可以构成访问控制。地区法院的裁决对其他法院没有约束力,二者都可能在上诉中被重新审视。
- 仍有可能:和解、简易判决、庭审、上诉。据 Inner City Press 报道,在 10 月 1 日的庭前会议上,Engelmayer 法官表示 Oxylabs 的动议不太可能获批,并提出可由治安法官协助和解。
对采集团队的实际影响
这些案件发出的风险信号不是“采集”或“代理”,而是一种特定模式:突破守护授权内容的具名技术措施,通常是为了转售其背后的内容。常见做法与这一模式的对应关系如下:
| 做法 | 这些案件发出的风险信号 | 风险较低的替代方案 |
|---|---|---|
| 破解或重放网站的反爬挑战 token(例如把一个已解的会话分发给许多客户端) | 高。法院认定 Google 关于 token 分发的指控足以构成规避主张,Reddit 案法院把只拦机器人的关卡视为访问控制 | 不要把业务建立在突破具名访问控制之上;使用服务方的官方 API 或获取许可 |
| 专门为了通过挑战而伪造设备、软件或位置 | 高。两家法院都将其列为符合“避开、绕过……或削弱”的情形 | 如实标识你的爬虫;遇到挑战拦截时,把它当作“不行” |
| 转售从第三方结果页抓取的数据(SERP 即服务模式) | 高。§1201(a)(2) 涵盖提供服务,针对 SerpApi 的交易诉请得以保留 | 获取数据许可,或按原始发布者的条款从其处采集 |
| 从此类厂商购买抓取数据,并决定其抓取内容 | 中到高。Perplexity 作为被指控的直接规避者被列入此案,因为据称是它设定了参数 | 要求厂商以书面形式说明数据来源和许可;优先使用授权数据源 |
| 以克制的速率采集无需登录、没有挑战的公开页面 | 在 §1201 下风险低(没有规避任何措施);合同法、版权法和隐私法仍然适用 | 在对你有约束力时遵守 robots.txt 和服务条款;限定字段范围;避免采集不需要的个人数据 |
| 抓取关卡后面没有受版权保护内容的事实信息(价格、排名、URL) | Google 案裁决后在 §1201 下风险较低,但该认定仅约束该案 | 仍应优先使用官方 API;不要依赖某一家地区法院的观点 |
| 使用官方 API 或数据许可 | 在这些理论下风险极小 | 任何关键业务的基本做法 |
关于代理,既然它出现在指控中,这里补充一点。通过住宅 IP 或地理定位 IP 路由请求,是从正确市场采集公开数据的标准做法。我们的 SERP 采集指南和 Google 搜索结果采集教程介绍了这方面的内容。诉状描述的是另一回事:IP 与虚假身份和 token 重放一起被用来突破一道特定的关卡。使用 USERNAME-country-US 的 ProxyHat 网关能给你一个美国的访问视角,但它不是许可,也不会改变上述法律分析。如果你的场景专门针对 Reddit 数据,请先查看 Reddit 自己的 API 条款。我们的 Reddit 采集指南讨论了这条路径。
接下来值得关注什么
- Google 案中对 SerpApi 第二次驳回动议的裁决。它将表明 Gonzalez Rogers 法官是否认为补充主张的许可条款已经足够,若是如此,两家法院的立场将更加接近。
- Reddit 案中 Oxylabs 的动议、Reddit 驳回 SerpApi 反垄断反诉的动议,以及 AWMProxy 那部分案情是否会有任何进展。
- 针对“版权所有者授权”问题的任何中间上诉。上诉法院的裁决将比任何一项地区法院裁定都重要得多。
本文为工程师总结公开的法院文件和相关报道,不构成法律意见。如果你的采集依赖于绕过网站的技术控制,请在投入建设之前咨询在相关司法管辖区执业的律师。






