Comparison map

对比图谱

11 分钟阅读View as markdown ↗

这套文档把 URnetwork 与另外二十一张网络逐一对比,每个产品一份文档。本页是总览:那些对比里的每一个产品,加上 URnetwork 自己,各成为一张双轴地图上的一个点,评分所依据的正是各页所引用的同一批证据。横轴是可验证匿名化指数。它问的是这项服务能看到什么、你又如何得知:是否存在某个单独一方同时握有你是谁和你在做什么,"无日志"是可验证的还是只是被承诺的,加密是穿过这项服务还是只到它为止,以及密钥交换是否抵抗先收割后解密的攻击。纵轴是连接质量指数。它问的是这条连接好不好到可以长住其上:延迟、吞吐、出网质量、可用性,以及进入的方式。

每条轴都是若干 0–10 分项得分的加权和,这些分项对照的锚点在任何产品被评分之前就已固定。方法写在评分方法页,完整的锚点阶梯写在得分页,所以这里的任何一个坐标都可以被重新算出来,而不必凭信任接受。

22 张网络的双轴地图:可验证匿名化指数对连接质量指数,两轴交叉于量表中心。URnetwork、Obscura、Mullvad 和 IVPN 占据右上象限,Obscura 正好落在水平线上;主流 VPN 的一群位于左上;Tor 和 NymVPN 在最右侧、质量较低处;各家 dVPN 和 Hola 位于左下;Apple Private Relay 位于两轴交叉点,落在两条线的噪声范围之内
这些位置是 URnetwork 对这套文档背后已公开证据的加权评分,不是一次独立测量,绘制在 0–10 的指数上,两轴交叉于固定的量表中心 (5, 5)。

四个象限

两轴交叉于 (5.00, 5.00),即 0–10 量表的固定中心,而不是这一群产品的平均值:一个位置的含义不因图上还有谁而改变,增加或移除产品也不会挪动任何人。一条阅读规则:任何落在距某条线四分之一分以内的东西,都算在线上,而不是有把握地落在它的某一侧。

可验证的下一代,右上,指的是在两条轴上都明确越过量表中心:隐私结构可以被查证而不只是被承诺,连接质量也在中点之上。四个产品:URnetwork (7.30, 6.20);Obscura (6.60, 5.10),它正好落在质量线上,而不是明确越过它;Mullvad (6.00, 6.20);以及 IVPN (5.70, 5.85)。这一组身后的空档是真实的:可验证轴上接下来的分数是 Apple Private Relay 正好落在线上的 5.10 和 Windscribe 的 4.60,那是一片清水,不是四舍五入。Mullvad 拥有业内被验证得最充分的行为记录,包括 2023 年那次一无所获的瑞典警方搜查,以及实测 0% 的位置不符;如果外部验证是你的标准,它那一页推荐的就是 Mullvad。Obscura 的入口跳在任何平台上都读不了任何用户的流量,而且根本没有相关设置;它的客户端是源码可见而非开源,后端未公开,也不提供后量子加密。IVPN 是这个象限里最边缘的成员,越过了两条线,但离它们最近。

基于信任的当代,左上,是商业 VPN 行业大多数产品的落点:十一个单公司设计,运营者终止隧道、可能什么都看得到,而连接质量在中点或中点之上。它们全都落在垂直线的左侧,原因是同一个结构性的:把流量加密到一家会把一切解密的公司那里,无论它经营得多好,都不是穿过它的加密。这个象限内部的行为差异极大;逐个产品的页面承载着各自的记录:Windscribe (4.60, 6.80) 最接近可验证线,它有开源的应用、2025 年的一次法庭撤诉,以及 2026 年一次只发现服务器纯在内存中运行的扣押;Tailscale (3.70, 7.25) 在自己的本职工作,也就是你自己机器之间的直连网状网络上,拿到了全图最高的质量分,而它默认并不是一个出网隐私产品;Hotspot Shield (1.70, 5.50) 坐在最远的边缘,它免费档的广告合作方就写在自家政策里。

学术 / 研究,右下,容纳的是以真实的日常使用成本换来的最强匿名化。Tor (9.40, 3.30) 是参照标准,也是匿名化轴上遥遥领先的最高分;它的代价由它自己的社区记录在案:中继链条的延迟,以及被大半个网络封锁或质询的公开出口清单。面对最强可至国家级的对手,它那一页和专家们的意见一致:用 Tor。NymVPN (7.50, 4.00) 拿出了商业 VPN 里最强的匿名设计,一个在线的 5 跳混合网络,带掩护流量、付款不可关联性,以及一份针对协议本身的、公开发表的独立审计,而那是 URnetwork 所没有的。默认的快速模式是一条没有掩护流量的双跳隧道;Nym 自己的文档写明了混合网络的延迟代价。

传统,左下,指的是在两条轴上都低于量表中心。这个标签描述的是位置,不是年头:Orchid (3.40, 3.90)、Mysterium (2.70, 4.90) 和 Sentinel (2.40, 4.80) 都是年轻的项目,落在这里是因为验证单薄,后两者还落在质量线的噪声范围之内。只有对 Hola (0.25, 4.85) 来说,这个名字才带着它的全部分量:匿名化轴的地板,它自己的隐私政策声明会收集浏览历史、保留期最长 12 个月,而免费用户的设备被登记为一门商业代理生意的容量。

有一个产品不属于任何象限。Apple Private Relay (5.10, 4.95) 位于两轴的交叉点,落在两条线的噪声范围之内。按 Apple 自己的架构概述,它的两跳分割由加密来执行;把它按在可验证轴中部的,是它闭源的实现、是那种属于公司安排而非数学的不合谋,以及全图最窄的覆盖范围:Apple 硬件上的 Safari 和 DNS,没有位置选择。本页的一个早先版本因为对它架构的错误描述而把它放进了传统象限;这次经过披露的重新评分写在得分推导页。

URnetwork 落在哪里

URnetwork 的点在 (7.30, 6.20),位于右上象限。没有任何单独一方同时握有你是谁和你在做什么:提供者永远不知道你是谁,运营方中继的是它读不了的字节,两者在发布时都是默认状态。整个技术栈都是开源的,包括运营方的服务器代码。出网是住宅的,可以瞄准到城市,位置由网络观察到的连接推导而来。

有两条注意事项框住了整张地图。这些位置是 URnetwork 自己对已公开证据的评分,不是一次独立测量。而且没有人从外部测量过 URnetwork:IPinfo 测量了 20 家商业厂商约 15 万个出口 IP,发现只有 Mullvad、IVPN 和 Windscribe 的位置不符为零,而 URnetwork 那种住宅的、由在场推导出来的位置,是一套你可以在代码里查证的机制,不是一个第三方得出的结果。

URnetwork 是按与所有人相同的评分标准打分的,而它的代价印在这里,而不是塞进脚注:

  • 尚无独立审计覆盖协议、连接引擎或运营方的服务器代码。这把它的可验证性分项按在 6 分,低于 Mullvad 的 9 分和 PIA 的 8 分。2025 年的两项第三方评估覆盖其他层面,一次是对 Web 应用和 API 的渗透测试,一次是对 Android 应用的 Leviathan MASA AL2 评估并通过,而 Leviathan 自己界定它不是一次整体性的安全评估;两者都没有检查日志、留存或数据路径,也都没有挪动任何分数。
  • 密封会话的两项完整性修复仍在发布前落地中。今天,一次失败的握手会让流量以未密封的状态继续流动,且没有任何可见的提示;而那项本可以抓住运营方替换提供者密钥的密钥交叉核对,做的是记录而不是拒绝;威胁模型对两者都有记载。浏览器扩展则根本没有密封会话。
  • 延迟和速度这两个分项是结构性判断,都打了 5 分。关于 URnetwork 的延迟或吞吐,任何方向上都不存在外部测量;这套语料里唯一的数字是 URnetwork 自己给出的 40 Mbps+ 平均流媒体速度,而它随承载你的那些成员变化。
  • 它不是一个种子下载产品。引擎按设计在提供者的边缘丢弃 BitTorrent 类流量。

什么会改变这幅图景

这里的每一条排序主张都建立在两项稳定性检验之上,这套设计取自独立的同行评审:在冻结分项得分的前提下均匀采样各轴权重,以及在已发布的权重下把每个分项得分扰动 ±1 分。设计、随机种子、精确分数和一份可复现脚本都在敏感性分析页。主要结果:

  1. 对 Mullvad 的领先是一项加权判断,不是一个已成定论的事实。在约 74% 的采样权重下,URnetwork 在可验证轴上领先 Mullvad(精确地说是权重空间的 71/96)。一位把审计和法庭证据的权重定在整条轴一半左右的读者,会得到 Mullvad 排第一,那是一种合理的读法,不是错误。在已发布权重下的 ±1 得分噪声中,URnetwork 在 99.9% 的抽样中领先。在那次把 URnetwork 的密封会话记为默认开启的、经过披露的重新评分之前,同一项检验的读数是 55.55%,也就是掷硬币。
  2. 与 Obscura 的差距只有一个分项那么宽。URnetwork 和 Obscura 在两个结构分项上 16–16 打平,可验证性上同为 6 分;URnetwork 全部 0.70 的领先都来自后量子分项,7 分对 Obscura 的 0 分。这个结构上的平局是以不同方式挣来的:Obscura 入口跳的盲视来自构造本身,URnetwork 的密封是一个已发布的默认设置,而它的完整性修复仍在落地中。任何给了后量子哪怕一点权重的加权都会保持这个顺序,那说的是这个差异的形状,而不是它的稳健性;有信息量的检验是得分噪声,在其中 URnetwork 在 93.9% 的抽样中保住领先。真正会让这一对拉平的,是 Obscura 发布后量子。
  3. NymVPN 在可验证轴上领先 0.20,而这一对没有定论。在 67% 的采样权重下 URnetwork 超过它(这个顺序完全取决于后量子的权重是否超过八分之一),而在得分噪声下,NymVPN 在约 69% 的抽样中保住领先。
  4. 质量轴是宽松的那一条。在采样权重下,URnetwork 的质量排名在 22 个产品中从第 1 到第 15,在得分噪声下是第 4 到第 11,而它的点估计得分对应的是并列第 5;在同一片权重空间里,它在可验证轴上的排名始终在 1–4 之间。此前有一条主张称没有任何重新加权能把 URnetwork 的质量分压到中心之下,该主张因循环论证而被撤回(每个质量分项都被打了至少 5 分,所以那个下界是从输入直接推出来的);这次撤回记录在敏感性分析页。
  5. 两条线承载的置信度不同。只有 Apple Private Relay 落在垂直线的噪声范围之内;没有别的产品比 0.40 更靠近它,所以任何站得住脚的单点重新评分都无法把其他任何人挪过这条线。水平线才是有噪声的那一条:Obscura 在它上方十分之一分处,Apple、Mysterium、Hola 和 Sentinel 在它下方四分之一分以内,而 TunnelBear、IPVanish 和 Hotspot Shield 在它上方半分以内。这些都要读得宽松些;住在角落里的那几位,Tor、NymVPN、URnetwork 和 Mullvad,不会挪动。

那些分数

地图上的那些点,每个产品一行,各自链接到它的一对一对比页。排名两列是区间而不是点值,这是有意的:在 ±1 得分噪声检验下,每个产品排名(1 = 最高)的第 5–95 百分位。在重新加权下的范围还要更宽;两组数据都在敏感性分析页,而完整的分项得分矩阵在得分推导页。

产品XYX 排名Y 排名象限
Tor9.403.30121–22学术 / 研究
NymVPN7.504.002–320–21学术 / 研究
URnetwork7.306.202–44–11可验证的下一代
Obscura6.605.103–512–19可验证的下一代
Mullvad6.006.204–64–11可验证的下一代
IVPN5.705.855–76–13可验证的下一代
Apple Private Relay5.104.956–813–19同时位于两条线上
Windscribe4.606.807–101–5基于信任的当代
PIA4.205.758–137–14基于信任的当代
ExpressVPN4.206.108–134–11基于信任的当代
Proton VPN3.906.709–151–6基于信任的当代
NordVPN3.906.109–154–11基于信任的当代
Tailscale3.707.2510–161–3基于信任的当代
Cloudflare WARP3.556.7011–161–6基于信任的当代
Surfshark3.506.0011–175–12基于信任的当代
Orchid3.403.9012–1720–22传统
Mysterium2.704.9016–2014–19传统
TunnelBear2.655.4516–209–16基于信任的当代
Sentinel2.404.8017–2015–19传统
IPVanish2.355.4517–219–16基于信任的当代
Hotspot Shield1.705.5020–219–16基于信任的当代
Hola0.254.852214–19传统

† 距水平线四分之一分以内:把 Mysterium、Sentinel 和 Hola 读作从下方贴着它,Obscura 从上方贴着它。

‡ 同时落在两条线的噪声范围之内:把 Apple Private Relay 读作位于两轴交叉点,不属于任何象限。

局限

两条轴装不下一切。价格、设备数量限制、种子下载政策、端口转发、管辖权和所有权,都是选择一个产品的真实理由,而它们没有一个在这张图上。逐个产品的页面承载着它们。

评分开始之后没有调整过任何权重或轴,也没有为了得到某个位置而挑选任何分数。评分之后的三次改动都在下列页面上带着完整的重新推导公开:Apple Private Relay 在同行评审指出证据基础错误描述了它的架构之后被重新评分,而那处错误此前一直有利于 URnetwork;URnetwork 在它的密封会话被裁定为发布时默认开启之后被重新评分,这一次同样有利于 URnetwork,并已如实标注;而 Obscura,那个架构上最接近的竞争对手,于 2026-08-07 被加入,所有排名区间当天重算。这条长期规则同样适用于 URnetwork 自己:如果有新证据落地,一次独立审计、一次外部测量、一个发布了可验证结构性分离的竞争对手,那么该做的是重新评分并重新发布,按这个顺序。

本页所推迟的深度内容住在三个地方:

  • 评分方法:各轴权重、对比对象选取规则、变更台账,以及这张地图是怎么搭起来的。
  • 得分推导:每个产品的分项得分、它们所对照的锚点阶梯、每个数字背后的证据与推理,以及那些经过披露的重新评分。
  • 敏感性分析:蒙特卡洛的设计与随机种子、两项检验下的排名区间、那条被撤回的主张,以及可复现脚本。

上面链接的每一份单独对比都写明了对方产品在哪里胜出,因为它们全都在某处胜出。更多问题在 FAQ 有答案。