2026 年 9 月初,我们把 1 GB 住宅流量交给了独立代理基准测试平台 ProxyVero,除了请他们公布测到的结果之外没有提任何要求。他们针对六个真实目标连续跑了十二天自动化测试,并把结果发布在一个公开页面上。这篇文章就是那个页面的诚实解读:好看的数字、一般的数字,以及我们明显不及格的那一项。
为什么要公布别人给我们的成绩单? 因为供应商自己发布的基准测试毫无价值,这个行业里人人都清楚。由我们自己生成、在我们自己挑的目标上、用我们自己写的成功规则得出的数字,那叫广告。唯一值得读的代理性能数据,是供应商无法左右的数据——这意味着即便数字难看,也要愿意把它摆出来。
我们控制了什么,没控制什么
把这一点讲清楚,比数字本身更重要。
我们提供的:普通账户上的 1 GB 住宅流量,不设有效期,没有特殊路由,没有单独的 IP 池。与所有客户相同的网关——gate.proxyhat.com:8080——前面挂着同一套 AI IP 过滤。我们还为他们的评测页面确认了公开价格。
我们没有得到的:对测试目标、时间安排、成功规则、措辞或结论的任何发言权。基准测试页面上线时我们才看到,和所有人同一时间。我们没有要求任何修改,也没有任何修改发生。
关于他们你应该知道的:ProxyVero 使用联盟链接,并在每个页面上披露这一点。他们的方法论页面写明,联盟关系不会改变成功率、延迟或流量的测量方式。这是他们的声明,核实并不由我们来做——但下面这些数字显然不像是供应商会花钱买来的数字。
结果:六个场景,745 次请求,十二天
测试周期为 2026 年 9 月 2 日至 13 日,仅使用住宅代理,最后更新时间为 9 月 13 日 18:00 UTC。
| 场景 | 成功率 | 平均延迟 | 请求数 | 封禁率 |
|---|---|---|---|---|
| 通用 HTTPS(ipify) | 100.0% | 605 毫秒 | 120 | 0.0% |
| TikTok(个人主页) | 99.2% | 3030 毫秒 | 125 | 0.0% |
| Nike(商品页) | 97.6% | 1756 毫秒 | 125 | 0.0% |
| Instagram(个人主页) | 90.4% | 1145 毫秒 | 125 | 8.0% |
| Google(搜索结果,美国) | 88.8% | 587 毫秒 | 125 | 11.2% |
| Amazon(商品页) | 83.2% | 2455 毫秒 | 125 | 16.0% |
所有场景合计:成功率 93.2%,平均延迟 1603 毫秒,95 分位延迟 3543 毫秒,封禁率 5.9%。
我们输在哪里
Amazon 是我们最差的目标,而且差距明显:成功率 83.2%,封禁率 16%,125 次请求中有 20 次被封。倒数第二是 Google,88.8%,14 次被封。Instagram 为 90.4%,10 次。
这三个数字就是住宅网络面对强硬的电商与搜索目标时的真实形态,与其让你在项目第三天从自己的日志里发现,不如在这里先读到。如果你的业务是大量抓取 Amazon 商品页,请按轮换住宅池中大约每六次请求有一次被封来规划,并为重试留出预算。真正重要的数字是每次成功请求的成本——不是每 GB 的价格,也不是标题上的成功率。
同时也请注意哪些环节没有出问题:所有场景的超时次数均为零,通用 HTTPS 端点返回 100%。连通性和认证不是问题,特定目标上的反爬系统才是。
16% 的封禁率实际要付多少钱
把成功率换算成"每次成功所需的尝试次数",价格这件事就简单了。在 83.2% 下,你需要 1 ÷ 0.832 = 每个成功的 Amazon 页面 1.20 次尝试,也就是说每次成功的实际成本比每次请求的成本高出 20%。Google 在 88.8% 下额外增加 12.6%。Instagram 在 90.4% 下增加 10.6%。通用 HTTPS 端点在 100% 下不增加任何成本。
这才是拿去做供应商比较的数字。每 GB 便宜 15%、但在你的目标上封禁率高一倍的池子,实际更贵,再多关于池子规模的宣传也改不了这道算术。在你决定绑定任何一家之前——包括我们——请在自己的目标上把这道乘法做一遍。
总体数字是整页上最没用的一个
ProxyVero 自己就在汇总表下方的注释里说了这一点:总体数值把难度差异极大的场景混在一起,而他们的阈值是绝对参考区间,而不是按场景归一化的评级。一家主要在简单端点上受测的供应商,会比在 Amazon 和 Google 上受测的供应商得分更高,尽管在你真正关心的任何方面都并不更好。
能把这一点讲清楚的对比是:在同一套场景下,他们榜单上相邻的供应商得分为 93.1%、93.1% 和 93.3%。我们是 93.2%。四家供应商挤在 0.2 个百分点之内,这不是排名,而是一次告诉你"在这个水平上总体数字已经失去区分力"的测量。请改看分场景的那几行。
我们不及格的那一项
对照 ProxyVero 自己的参考区间,我们的结果是这样落位的:
| 指标 | 我们的结果 | 他们的 "good" 区间 | 评级 |
|---|---|---|---|
| 成功率 | 93.2% | > 95% | Fair |
| 平均延迟 | 1603 毫秒 | < 500 毫秒 | Poor |
| P95 延迟 | 3543 毫秒 | < 800 毫秒 | Poor |
| 封禁率 | 5.9% | < 2% | Poor |
| 样本量 | 745 | ≥ 1000 | Fair |
延迟这一行我们不打算辩解。住宅代理要经过真实的家庭宽带,经由雅加达一条家用线路的端到端延迟,不可能像数据中心往返那样漂亮——同一次测试里 TikTok 的 3030 毫秒和 Google 的 587 毫秒,是同一张网络在不同目标上的表现。但把"低于 500 毫秒"这条线套在住宅流量上,就是我们跨不过去的门槛,假装不是这样,公布这些数据也就失去了意义。如果你的业务对延迟敏感而不是对检测敏感,静态 ISP 代理才是更合适的产品,我们宁愿在你买流量之前就告诉你。
样本量那一行同样值得点出来:十二天 745 次请求足以看出大致形态,不足以裁定细微差别。在这份数据上,供应商之间小于几个百分点的差距都应当视为噪声。
这次测试无法告诉你的事
一处需要坦白的空白:我们宣传的 AI IP 质量过滤会在流量发出之前对线路评分,而这次基准测试无法单独衡量它的作用。这里没有对照组——没有关闭过滤器的平行运行——所以结果显示的是过滤器开启时网络的表现,对关闭后会如何则毫无说明。ProxyVero 的评测把该过滤器标注为"供应商声明",这样标注是对的。如果有人告诉你单一供应商的基准测试能验证某项具体的内部机制,那是过度解读。
同样的谨慎也适用于地域。六个场景全部针对面向美国的目标。那个页面上的任何内容都不能告诉你这张网络从巴西、越南或尼日利亚出去时表现如何,我们也不会那样宣称。
在扩量之前该怎么读一个基准测试页面
无论你在评估哪家供应商,包括我们在内,都适用同样的四项检查:
- 在分场景表格里找到你自己的目标。如果测过的场景不是你真正要访问的站点,总体数字对你的业务毫无意义。
- 检查样本量和时间窗。40 次请求得出的 99% 成功率只是传闻。要找的是至少一周内数百次请求。
- 把封禁和超时分开。封禁意味着反爬系统识别出了流量;超时意味着网络本身失败了。两者的解决办法完全不同,而只有后者才是供应商自己能独立解决的。
- 换算成每次成功请求的成本。更便宜但封禁率高一倍的 GB,实际上更贵。在比较任何东西之前,先用每 GB 价格乘以你自己目标上的预期重试率。
ProxyHat 在 ProxyVero 上的页面在这里:基准测试提供持续更新的实测数据,档案页介绍我们提供什么,评测是他们对价格与适用场景的看法。会持续更新的是基准测试页面。
我们打算怎么处理
Amazon 的 83.2% 是我们想要抬上去的那一行,而抬上去是路由和 IP 质量的问题,不是营销的问题。下一个测试周期会说明我们有没有做到,而它怎么说我们没有一票。这份安排的全部价值就在这里。
自己测一遍
独立基准测试是起点,不能替代你自己的数字。向你真正的目标发几百次请求,统计成功次数而不是响应次数,然后在你考虑的所有供应商之间比较每次成功请求的成本。按量付费流量从 5 美元起,余额不过期,要弄清楚这一点也不需要任何订阅。
另外,如果你运营一家独立测试平台并想测我们:我们提供流量,回答关于网络的问题,并且不会要求提前看结果。






