# Wie die Vergleichskarte bewertet wird

Die [Vergleichskarte](/docs/comparison) platziert zweiundzwanzig Netzwerke,
URnetwork und jedes Produkt aus den einundzwanzig Direktvergleichsseiten,
auf zwei Indizes von 0–10: **verifizierbare Anonymisierung** in der Breite,
**Verbindungsqualität** in der Höhe. Diese Seite ist die Methode: was die
beiden Indizes messen, die Regel dafür, welche Produkte überhaupt auf der
Karte sind, die Gewichte und warum sie sind, was sie sind, wie die
Ankerleitern funktionieren, die datierte Akte jeder Änderung, seit das
Bewertungsschema eingefroren wurde, und die Grenzen, die eine Leserin gegen
all das halten sollte. Die Absicht: Wer irgendeine Koordinate bezweifelt,
kann sie nachrechnen — und sieht dort, wo eine Wertung ein Ermessensurteil
statt eines belegten Fakts ist, genau das ausgewiesen.

Die Rechenwege stehen in zwei Anhängen. Die
[Wertungsseite](/docs/comparison-scores) hält die vollständige Matrix: alle
198 Teilwertungen, die Ankerleitern, gegen die sie vergeben wurden, die
Begründung pro Produkt für jede Zahl und die offengelegten Neubewertungen.
Die [Sensitivitätsseite](/docs/comparison-sensitivity) hält die
Monte-Carlo-Akte: Rangintervalle unter Gewichts- und Wertungsunsicherheit,
die Kreuzungsstatistiken der Direktvergleiche, eine zurückgezogene
Behauptung und ein Reproduktionsskript. Der Prüfpfad hinter allen dreien
liegt im Dokumentations-Repository unter `review/index/`: `METHOD.md` (das
Bewertungsschema, eingefroren, bevor irgendein Produkt bewertet wurde),
`SCORES.md` (die nachrechenbare Matrix) und `NOTES.md` (die Begründung pro
Wertung mit Zitaten). Die veröffentlichten Seiten und diese Akte werden in
Übereinstimmung gehalten; widersprechen sie sich je, hat eine von beiden
einen Fehler, und das Ende dieser Seite sagt, wo er zu melden ist.

## Das Änderungsregister

Ein bewerteter Vergleich, der sich nie ändert, ist abgestanden, und einer,
der sich still ändert, ist wertlos. Das ist das datierte Register jeder
Änderung an der Methode oder an ihren veröffentlichten Aussagen, seit das
Bewertungsschema am 2026-08-07 eingefroren wurde, jede markiert mit der
Richtung, in die sie schneidet — denn wer einen selbst bewerteten Index
prüft, soll auf einen Blick sehen können, ob die Korrekturen immer wieder
zugunsten des Bewerters ausfallen.

| Datum | Änderung | Richtung |
|---|---|---|
| 2026-08-07 | IVPNs Latenz-Teilwertung während der Bewertung von 6→7 normalisiert, passend zu jedem anderen Rechenzentrums-VPN mit einem Hop (Offenlegung 1 unter „Das Einfrieren“) | zugunsten von IVPN; neutral gegenüber URnetwork |
| 2026-08-07 | Ursprung vom Produktverantwortlichen vom Feld-Schwerpunkt auf die feste Skalenmitte korrigiert (Offenlegung 2) | neutral; verschiebt die Linien, nicht die Punkte |
| 2026-08-07 | Apple Private Relay nach unabhängigem Peer Review neu bewertet: E 5→7, S 6→7, X 4.25→5.10 (Offenlegung 3) | **gegen unser Interesse**; korrigiert einen Fehler, der zu URnetworks Gunsten gelaufen war |
| 2026-08-07 | Die Behauptung, keine Neugewichtung könne URnetworks Y unter 5.00 drücken, **als zirkulär zurückgezogen** (verzeichnet auf der [Sensitivitätsseite](/docs/comparison-sensitivity)) | **gegen unser Interesse**; eine veröffentlichte Stabilitätsaussage über uns selbst, zurückgenommen |
| 2026-08-07 | Monte-Carlo-Rangintervalle veröffentlicht; die Sensitivitätsprüfung mit einer einzelnen Alternativgewichtung ersetzt | **gegen unser Interesse**; druckt einen X-Vorsprung nahe am Münzwurf und einen instabilen Y-Rang |
| 2026-08-07 | URnetworks S-Begründung korrigiert: die veraltete Strafe „Anmelde-IP roh 180 Tage aufbewahrt“ nach Abgleich mit dem aktuellen Server-Quellcode entfernt; die Wertung neu aus der Leiter hergeleitet und **unverändert bei 8** | zu unseren Gunsten der Absicht nach, ohne Wertungseffekt; markiert, weil es die schmeichelhafte Richtung ist |
| 2026-08-07 | Auswahlregel für Vergleichsprodukte veröffentlicht; zwei qualifizierte Produkte benannt, die wir noch nicht vergleichen | **gegen unser Interesse**; verzeichnet unsere eigenen Auslassungen |
| 2026-08-07 | Das im Korpus wiederholte „URnetwork hat kein unabhängiges Audit“ korrigiert: Es existieren zwei Prüfungen dritter Parteien, ein Penetrationstest der Web-Anwendung und der API durch eine dritte Partei (April–Mai 2025) und eine bestandene MASA-AL2-Prüfung der Android-App durch die Leviathan Security Group (Mai 2025). Keine von beiden deckt das Protokoll, die Connect-Engine oder den Server-Code des Operators ab. V neu aus der Leiter hergeleitet und **unverändert bei 6** | **zu unseren Gunsten**; die Dokumentation hatte uns an etwa dreißig Stellen untertrieben dargestellt, und der Produktverantwortliche lieferte die Berichte. Markiert, weil es die schmeichelhafte Richtung ist, und aus genau diesem Grund mit null bepreist |
| 2026-08-07 | **Obscura bewertet und aufgenommen**, das einundzwanzigste verglichene Produkt, eingetreten über Auswahlhürde (d) als der nächste architektonische Konkurrent — die Auslassung, mit der das Peer Review belegte, dass die alte Ad-hoc-Auswahl versagt hatte. Streng aus den eingefrorenen Leitern bewertet; keine Teilwertung eines anderen Produkts angetastet. Es landet bei (6.60, 5.10): Vierter auf der X-Achse, 0.25 hinter URnetwork nach der damaligen Bewertung, und AUF der Y-Linie (+0.10, im Rauschen). Alle Rangintervalle noch am selben Tag über das Feld von 22 Produkten neu berechnet | **gegen unser Interesse**; setzt einen Konkurrenten neben uns in die Zelle oben rechts, der URnetwork bei den Struktur-Komponenten nach der damaligen Bewertung überholt (16 gegen 15 über E+S; seine dauerhaft aktive Eintritts-Blindheit schlägt unser damaliges Opt-in bei E), uns bei V gleichzieht und nur bei Post-Quanten zurückliegt; unter ±1 Wertungsrauschen hält URnetwork den X-Vorsprung nur in 69,5 % der Fälle, und all das steht gedruckt statt geglättet |
| 2026-08-07 | **URnetwork neu bewertet: Die versiegelte Sitzung ist zum Start standardmäßig an.** Eine Entscheidung des Produktverantwortlichen (festgehalten im Prozess-Spickzettel der Arbeitsakte und in `verify/BEFORELAUNCH.md`, Punkt 7) kehrte die Opt-in-Rahmung um, gegen die drei von URnetworks vier X-Teilwertungen hergeleitet worden waren. Neu hergeleitet aus den unveränderten eingefrorenen Leitern: E 7→8 (strukturelle Operator-Blindheit mit Standard an nimmt die Spitze des Bandes, dieselbe Lesart, die Obscuras dauerhaft aktive 8 setzte; die Browser-Erweiterung hat weiterhin keine versiegelte Sitzung, und die zwei fortbestehenden Integritätsdefekte der Versiegelung vor dem Start — stiller Fail-Open und ein vom Operator austauschbarer Provider-Schlüssel — stehen neben der Wertung gedruckt als die Latte für 9–10, nicht erlassen), PQ 5→7 (die Sprosse für ein Flaggschiff mit Standard an, an ihrem Boden), S neu hergeleitet und **unverändert bei 8** (die Sprosse 9–10 scheitert weiterhin an Mehr-Parteien-durch-Konstruktion und an keinem identifizierenden Konto), V unangetastet bei 6. X 6.85→**7.30**; Y unberührt. Rangintervalle und jede Direktvergleichs-Sensitivität noch am selben Tag über das Feld neu berechnet | **zu unseren Gunsten**; die dritte am 2026-08-07 verarbeitete Korrektur zu unseren Gunsten und die erste, die eine Zahl bewegt. Die früheren zwei (die veraltete Strafe für rohe IP-Aufbewahrung, aus S gestrichen, und die Korrektur der Audit-Akte bei V) durchliefen dieselbe Neuherleitung an der Leiter und ergaben korrekterweise nichts, was der Beleg dafür ist, dass die Disziplin beißt statt zu schmücken. Diese hier bewegt etwas, weil sie eine echte Fähigkeitsänderung ist, entschieden vom Produktverantwortlichen, keine veraltete Strafe, und die Integritäts-Vorbehalte, die sie dämpfen, stehen mit der Wertung gedruckt |

Was sich nicht geändert hat: kein Gewicht, kein Anker und keine Teilwertung
außer den beiden offengelegten Neubewertungen, der von Apple Private Relay
und URnetworks eigener, als seine versiegelte Sitzung standardmäßig an
wurde.

Das stehende Urteil, unter dem dieses Register arbeitet, ist das des Peer
Reviews: Der Index ist „transparent, aber nicht validiert“. Transparenz ist
das, was diese Seite immer verkauft hat: jedes Gewicht, jeder Anker und jede
Teilwertung veröffentlicht, damit eine widersprechende Leserin nachrechnen
kann. Und der erste ernsthafte Leser, der tatsächlich nachrechnete, fand
eine zirkuläre Robustheitsaussage und einen für die Klassifikation
maßgeblichen Sachfehler. Transparenz ist nicht Validität. Der Index bleibt
eine Übung mit einem einzigen Bewerter und erklärtem Interessenkonflikt, die
ordinale Urteile aggregiert, als wären sie Intervallmessungen, validiert
gegen keine Messung von URnetwork von außen. Kein unabhängiges Audit deckt
URnetworks Protokoll, seine Connect-Engine oder den Server-Code des
Operators ab, und das ist die Schicht, auf der das ganze Argument ruht.
(Zwei Prüfungen dritter Parteien existieren sehr wohl, zu anderen Flächen:
ein Penetrationstest der Web-Anwendung und der API durch eine dritte Partei
im April–Mai 2025 und eine Prüfung der Android-App durch die Leviathan
Security Group im Rahmen des MASA-Programms der App Defense Alliance von
Google auf Assurance-Level AL2, abgeschlossen im Mai 2025, die sie bestand
und die Leviathan selbst als keine ganzheitliche Sicherheitsbewertung
eingrenzt. Keine von beiden untersuchte Logging, Aufbewahrung oder den
Datenpfad.) Was das Ansehen des Index heben würde, ist bekannt, und nichts
davon ist Schreiben: unabhängige Bewerter mit veröffentlichter
Interrater-Übereinstimmung, eine Messkampagne von außen, ein Audit des
Protokolls und des Servers. Bis dahin lies die Karte als unser Argument,
überprüfbar gemacht, nicht als Messung.

## Was die beiden Indizes messen

**X, verifizierbare Anonymisierung.** Die erste Frage des ganzen Korpus: Was
kann der Dienst über dich sehen, und woher wüsstest du es? Die Achse belohnt
zwei Dinge, bewusst in dieser Reihenfolge. *Struktur*: ein Design, in dem
keine einzelne Partei deine Identität und deine Aktivität zusammen halten
oder deinen Datenverkehr unterwegs lesen kann. Und *Verifikation*: die
Belege, mit denen ein Außenstehender die Aussage prüfen kann, also Open
Source, unabhängige Audits, Ergebnisse aus Gerichtsverfahren und
Durchsuchungen sowie Messungen von außen. Die Quadrantennamen auf der Karte
sagen dieselbe Unterscheidung: rechts der Linie lässt sich die Aussage,
nichts sehen zu können, prüfen; links davon ruht sie auf Vertrauen, wie gut
sich der Operator auch verhält.

**Y, Verbindungsqualität.** Die zweite Frage: Ist die Verbindung gut genug,
um darauf zu leben? Latenz- und Durchsatzklasse, ob der Exit den Standort
tatsächlich liefert, den er behauptet, wie viele Wege hinein es gibt, wenn
Netze feindselig sind, und ob du den Dienst überhaupt bekommen und behalten
kannst.

**Warum diese Komponenten und keine anderen.** Die X-Komponenten sind die
vier Eigenschaften, die unmittelbar auf „wer kann sehen, und woher wüsstest
du es“ zielen; alles andere würde die Achse mit Stellvertretern verwässern.
Rechtsraum und Eigentümerschaft, das übliche Kürzel des VPN-Marketings, sind
bewusst ausgeschlossen: Sie sind Vorannahmen über künftiges Verhalten, keine
verifizierbaren Eigenschaften des Systems, und sie widersetzen sich einer
Verankerung auf 0–10 (die Seiten pro Produkt tragen sie als Prosa, mit
Daten und benannten Eigentümern). Reine RAM-Flotten, Kill Switches und der
Feinschliff der Apps sind ebenso real, gehören aber in Produkttests, nicht
in einen Anonymisierungs-Index. Auf Y sind Preis und Gerätelimits
ausgeschlossen, weil sie Kauffaktoren sind, keine Eigenschaften der
Verbindung; Torrenting-Richtlinie und Portweiterleitung tauchen nur insoweit
auf, als sie Ausgangsbeschränkungen sind, und das erste davon kostet
URnetwork auf der [Wertungsseite](/docs/comparison-scores) einen Teil eines
Punkts. Zwei Achsen können nicht alles fassen, und diese beiden versuchen es
nicht.

## Welche Produkte auf der Karte sind: die Auswahlregel

Die ursprünglichen zwanzig Vergleichsprodukte wurden ad hoc gewählt —
Marktanteil plus der Wunsch, jede Architekturklasse abzudecken —, und es
wurde keine Aufnahmeregel veröffentlicht. Ein unabhängiges Peer Review hat
das benannt und den Beweis mitgeliefert, warum es zählt: Obscura, der
nächste architektonische Konkurrent zu URnetwork, fehlte, bis ein Reviewer
es nannte. „Wir haben es bemerkt“ ist keine Methode. Die Regel unten
existiert, damit die nächste Auslassung ein Regelversagen ist, auf das jeder
zeigen kann, und kein Urteil, das niemand einsehen kann.

**Ein Produkt qualifiziert sich, wenn es alle drei Bedingungen erfüllt:**

1. **Es ist ein betriebener Vermittlungsdienst.** Ein ausgelieferter Dienst,
   den eine gewöhnliche Verbraucherin heute beziehen kann und dessen
   Kernfunktion darin besteht, einen betriebenen Vermittler zwischen Nutzer
   und Ziel zu stellen, für Privatsphäre, Anonymität oder Standortwechsel:
   kommerzielle VPNs, Plattform-Relays, Onion- und Mix-Netzwerke, dVPNs,
   Proxy-Netzwerke. Selbst gehostete Software, bei der der Nutzer der
   Operator ist (ein nackter WireGuard-Server, Outline), liegt außerhalb des
   Geltungsbereichs. Es gibt keine zweite Partei, deren Sicht in Frage
   steht, und genau das ist die Frage, die beide Achsen bewerten.
2. **Es nimmt mindestens eine von vier Reichweite-oder-Relevanz-Hürden:**
   - **(a) Verbreitung**: oberste Stufe der Verbreitung von Consumer-VPNs
     nach Installationen oder Marktanteil in aktuellen, datierten
     öffentlichen Marktdaten;
   - **(b) Archetyp-Flaggschiff**: das Flaggschiff oder die am stärksten
     verbreitete Implementierung einer eigenen Architekturklasse
     (Onion-Routing: Tor; Mixnet: NymVPN; Plattform-Relay: Apple Private
     Relay; Edge-Relay: Cloudflare WARP; Mesh-Overlay: Tailscale;
     dVPN-Marktplatz: Orchid, Mysterium, Sentinel; Privatanschluss-P2P-Proxy:
     Hola);
   - **(c) Empfehlung eines Prüfers**: eine aktuelle Empfehlung eines großen
     unabhängigen Privacy-Prüfers. Das ist die Hürde, über die IVPN
     hereinkommt: Sein Marktanteil ist eine Nische, aber unabhängige Prüfer
     heben es für seine Verifikationsbilanz hervor, und genau die bewertet
     die X-Achse;
   - **(d) architektonischer Konkurrent**: eine Aussage über aufgeteiltes
     Vertrauen oder über keine einzelne Partei, vergleichbar mit URnetworks
     eigener Kernaussage. Das ist die Hürde, über die Obscura hereinkommt,
     und die Hürde, gegen die jede Nominierung durch Reviewer oder Leser
     zuerst geprüft wird.
3. **Es ist bewertbar.** Es existieren genug öffentliche Belege, in
   Dokumentation, Audits, Messungen und Richtlinien, um alle neun
   Teilwertungen gegen die eingefrorenen Leitern zu vergeben. Ein Produkt,
   das sich über die Reichweite qualifiziert, aber aus diesen Belegen nicht
   bewertet werden kann, wird als ausstehend gelistet, nicht nach Eindruck
   bewertet.

**Ausschlussgründe:** eingestellte oder nicht beziehbare Produkte (Google
One VPN); reine Enterprise-Angebote, die eine Einzelperson nicht kaufen
kann; White-Label-Umetikettierungen eines bereits aufgenommenen Stacks
(Betternet wird nicht bewertet, weil Hotspot Shield den Hydra-Stack schon
vertritt); und selbst gehostete Werkzeuge nach Bedingung 1.

**Wie der Satz überprüft wird.** Die Qualifikations-Checkliste wird bei
jeder Revision des Korpus und mindestens alle sechs Monate gegen datierte
Marktdaten neu durchlaufen. Auslöser außerhalb des Zyklus, jeder davon
erzwingt eine sofortige Prüfung: Ein Produkt liefert ein Design ohne
einzelne Partei aus (Hürde d); ein Produkt überschreitet eine
Verbreitungshürde; ein Reviewer oder Leser nennt einen Kandidaten. Die
Nominierung, das Datum und das Ergebnis werden verzeichnet, ob der Kandidat
besteht oder nicht — so ist Obscuras Eintritt verzeichnet. Produkte, die
nicht mehr ausgeliefert werden, werden mit dem Datum ihrer letzten Wertung
archiviert, nie still entfernt.

**Die Regel, angewandt auf den aktuellen Satz (2026-08-07).** Alle
zweiundzwanzig Mitglieder qualifizieren sich: Windscribe, PIA, ExpressVPN,
Proton VPN, NordVPN, Surfshark, TunnelBear, IPVanish, Hotspot Shield und
Hola unter (a); Tor, NymVPN, Apple Private Relay, Cloudflare WARP,
Tailscale, Orchid, Mysterium und Sentinel unter (b); IVPN unter (c); Mullvad
unter (a) und (c); URnetwork und Obscura, letzteres am 2026-08-07 bewertet,
am selben Tag, an dem seine Vergleichsseite veröffentlicht wurde, unter (d).
Ein Grenzfall wird benannt statt überspielt: Orchid ist das Mitglied, das
dem Ausschlussgrund „eingestellt“ am nächsten kommt (seine mobilen Apps sind
Jahre alt), bleibt, solange seine ausgelieferten Clients noch funktionieren,
und ist die erste Zeile, die die Überprüfungsregel archivieren würde.

**Was die Regel sagt, dass uns fehlt.** Eine Auswahlregel, die nie eine
Lücke benennt, ist Dekoration. Dieselben Hürden heute angelegt, benennen
zwei Produkte, die dieser Korpus nicht vergleicht:

- **CyberGhost** nimmt (a) ohne Weiteres: Es gehört nach behaupteter
  Nutzerzahl zu den größten Consumer-VPN-Marken, und unsere eigene
  Belegbasis vermisst es bereits (die IPinfo-Standortstudie hinter den
  Ausgangswertungen schließt CyberGhost ein, und die Bewertungsnotizen
  zitieren sein Ergebnis). Es gibt keinen prinzipiellen Grund, warum es
  fehlt, während jeder Große vergleichbarer Größenordnung dabei ist.
- **Psiphon** nimmt (b) als der am weitesten verbreitete dedizierte Dienst
  zur Zensurumgehung außerhalb von Tor, mit dokumentierter Massenverbreitung
  während nationaler Blockade-Ereignisse. Die Komponente Verfügbarkeit und
  Anti-Zensur der Y-Achse ist sein Heimspiel, was die Auslassung schlimmer
  macht, nicht besser.

Beide sind als Auswahlschuld verbucht: Sie qualifizieren sich, und solange
ihre Seiten und Wertungen nicht existieren, ist das Feld dieser Karte nach
ihrer eigenen veröffentlichten Regel unvollständig.

## Die Gewichte, und warum

Jeder Index ist eine gewichtete Summe seiner Komponenten; die Gewichte
summieren sich je Achse auf 1.00.

### X: Index der verifizierbaren Anonymisierung

| Komponente | Gewicht | Warum dieses Gewicht |
|---|---|---|
| **S**, Trennung von Identität und Aktivität | 0.35 | Das Herz der Anonymisierung: Hält irgendeine einzelne Partei zugleich, wer du bist und was du tust, einschließlich der Konto- und Zahlungsidentität, die es braucht, um den Dienst zu nutzen? Hält eine Partei beides, ist alles andere Schadensbegrenzung, also ist das die schwerste Komponente. |
| **V**, „keine Logs“ verifizierbar statt versprochen | 0.30 | Die Achse heißt *verifizierbar*. Open Source, unabhängige Audits, Belege aus Gerichtsverfahren und Durchsuchungen und Messungen von außen bewegen diese Wertung; ein bloßes Versprechen liegt nahe null, so aufrichtig es auch gemeint ist. |
| **E**, Ende-zu-Ende-Verschlüsselung durch den Dienst hindurch | 0.25 | Ob der Operator strukturell außerstande ist, deinen Datenverkehr zu lesen, oder es bloß verspricht. Verschlüsselung *zu* einem Unternehmen, das alles entschlüsselt, ist keine Verschlüsselung *durch* es hindurch. Nur der Trennung nachgeordnet, weil es die andere strukturelle Hälfte von „kann nicht sehen“ ist. |
| **PQ**, Post-Quanten-Verschlüsselung | 0.10 | Ob der Schlüsselaustausch Angriffen nach dem Muster „heute ernten, später entschlüsseln“ standhält. Ein echtes, vorausschauendes Unterscheidungsmerkmal, aber für die heutige Anonymität noch nicht entscheidend, daher das kleinste Gewicht. |

Die bewusste Haltung in diesen Zahlen: Struktur (S + E = 0.60) wiegt
schwerer als Verifikation (V = 0.30), mit der Begründung, dass die Struktur
das ist, wozu Verifikation überhaupt da ist. Ein auditiertes Versprechen ist
immer noch ein Versprechen, während ein Design, das die Fähigkeit zu sehen
entfernt, weniger Vertrauen braucht. Wer die Belegakte über die Architektur
stellt, ordnet die Spitze der Achse neu, und die
[Sensitivitätsseite](/docs/comparison-sensitivity) arbeitet diese
Alternative durch, statt sie zu verstecken.

### Y: Index der Verbindungsqualität

| Komponente | Gewicht | Warum dieses Gewicht |
|---|---|---|
| **L**, Latenz | 0.30 | Die für Nutzer am stärksten spürbare Eigenschaft einer Verbindung und die, die am stärksten von der Architektur bestimmt wird: Anzahl der Hops, Pfadlänge, Nähe zum Rand. Als strukturelle Klasse bewertet; kein Produkt hier hat Latenzzahlen veröffentlicht, die der Korpus akzeptiert, also stehen in dieser Bewertung nirgends Millisekunden. |
| **T**, Geschwindigkeit / Durchsatz | 0.25 | Die zweitstärkste spürbare Eigenschaft. Ebenfalls strukturell (Rechenzentrum mit einem Hop, durch Privatanschlüsse begrenzt, Relay-Kette) plus die eigene veröffentlichte Positionierung jedes Anbieters. Die eine Durchsatzzahl im ganzen Korpus ist URnetworks eigene, URnetwork zugeschrieben: 40 Mbps+ durchschnittliche Streaming-Geschwindigkeit. |
| **Eg**, Ausgangsqualität | 0.20 | Ob der Exit liefert, was er behauptet: gemessene Standort-Wahrheit (die IPinfo-Studie), als Hosting markierter gegenüber Privatanschluss-Adressraum und wie fein du wählen kannst, wo du erscheinst. An dritter Stelle gewichtet, weil ein schneller Tunnel zu einem Exit, der blockiert ist oder woanders liegt als behauptet, für die Person, die ihn gewählt hat, keine funktionierende Verbindung ist. |
| **A**, Verfügbarkeit / Anti-Zensur | 0.15 | Ob du es bekommen und am Laufen halten kannst: kostenloser Zugang, Plattform-Breite, Verhalten in feindseligen Netzen, regionaler Rückzug. |
| **In**, Zugangsoptionen | 0.10 | Die Wege hinein: Protokolle, verschleierte Transporte, von Freiwilligen betriebene Eintrittspfade. Das kleinste Gewicht, weil es für manche Nutzer enorm zählt und für die meisten gar nicht. |

### Das Einfrieren

Die Gewichte und die Ankerleitern wurden am 2026-08-07 aufgeschrieben und
eingefroren, **bevor irgendein Produkt bewertet wurde**, und danach nicht
mehr angepasst. Das ist das Erste, was eine Skeptikerin prüfen sollte, und
der eingefrorene Text des Bewertungsschemas mit seinem Datum liegt im
Repository unter `review/index/METHOD.md`. Das Bewertungsschema hat sich
außerdem schriftlich auf die Ergebnisse vorab festgelegt, die am meisten zum
Weichspülen verlocken: URnetworks Verifizierbarkeits-Wertung muss dafür
bestraft werden, dass es kein Audit einer dritten Partei gibt; seine
versiegelte Sitzung muss als das Opt-in bewertet werden, das sie damals war;
und Mullvad, IVPN, Tor und NymVPN bewerten sich so, wie die Belege es
sagen, auch dort, wo sie das über URnetwork stellt oder, bei Mullvad und
IVPN, in denselben Quadranten. Die eingefrorene Formulierung zum ersten
dieser Punkte bleibt stehen, wie sie geschrieben wurde, und sie war
sachlich falsch, zu unseren eigenen Ungunsten: Zwei Prüfungen dritter
Parteien existierten damals (die Registerzeile oben und die V-Begründung auf
der [Wertungsseite](/docs/comparison-scores)). Die Strafe, die sie
verlangte, gilt weiterhin, weil keine der beiden Prüfungen die Schicht
berührt, die die Achse misst, und die Wertung wurde neu hergeleitet statt
angepasst. Die zweite Vorab-Festlegung endete durch Entscheidung statt durch
Fehler: Am 2026-08-07 entschied der Produktverantwortliche, dass die
versiegelte Sitzung zum Start standardmäßig an ist, die Opt-in-Prämisse
beschreibt also einen Zustand, den das Produkt verlassen hat. Die
betroffenen Teilwertungen wurden aus den unveränderten Ankern neu
hergeleitet statt angepasst; das Register führt die Änderung mit ihrer
Richtung, und der eingefrorene Text steht erneut, wie er geschrieben wurde.

Vier Dinge haben sich geändert, nachdem die Bewertung begonnen hatte, und
alle sind offengelegt statt glattgebügelt:

1. **Eine Teilwertung wurde während der Bewertung normalisiert.** IVPNs
   Latenz-Komponente wurde zuerst mit 6 bewertet, wegen seiner kleineren
   Flotte, dann auf 7 normalisiert, passend zu jedem anderen
   Rechenzentrums-VPN mit einem Hop. Der Korpus verzeichnet keine
   Latenzdefizite pro Anbieter, und einem Anbieter ohne Messungen Punkte für
   die Flottengröße abzuziehen wäre erfundene Präzision gewesen. Die
   Arbeitsakte hält den ursprünglichen Wert fest, und IVPNs Eintrag auf der
   [Wertungsseite](/docs/comparison-scores) druckt die Wirkung in beide
   Richtungen.
2. **Die Definition des Ursprungs wurde nach der Bewertung korrigiert**, vom
   Produktverantwortlichen, und sie ist die einzige Änderung an der Methode
   nach der Bewertung. Der nächste Abschnitt erklärt sie.
3. **Apple Private Relay wurde nach unabhängigem Peer Review neu bewertet**,
   am selben Tag wie die erste Bewertung: Die Belegbasis selbst, und jede
   darauf gebaute Seite, hatte Apples Aufteilung als vertraglich gehalten
   beschrieben, während Apples eigener Überblick sie als durch geschichtete
   Verschlüsselung durchgesetzt beschreibt. E 5→7 und S 6→7 gegen die
   unveränderten eingefrorenen Anker, X 4.25→5.10, was Apple aus dem
   Quadranten Alte Generation auf die X-Linie selbst bewegt. Der Fehler war
   zu URnetworks Gunsten gelaufen, und das ist die Richtung, die wir am
   nötigsten fangen müssen; die Wertungen keines anderen Produkts wurden
   angetastet. Die vollständige Neuherleitung steht in Apples Eintrag auf
   der [Wertungsseite](/docs/comparison-scores).
4. **URnetwork wurde neu bewertet, nachdem der Produktverantwortliche seine
   versiegelte Sitzung zum Start als standardmäßig an entschieden hatte**:
   die zweite Neubewertung nach der Bewertung und die eine, die unseren
   eigenen Punkt bewegt. E 7→8 und PQ 5→7 gegen die unveränderten
   eingefrorenen Anker, S neu hergeleitet und unverändert bei 8, V
   unangetastet bei 6; X 6.85→7.30. Die Neuherleitung in URnetworks Eintrag
   auf der [Wertungsseite](/docs/comparison-scores) enthält die explizite
   Entscheidung, dass die höhere Sprosse der Verschlüsselungs-Leiter den
   Standard verlangt, aber noch nicht die volle Integrität, und druckt die
   fortbestehenden Defekte der Versiegelung — Fail-Open und
   Schlüsselaustausch — neben die Wertung, statt sie zu erlassen.

Diese vier sind die Änderungen auf Wertungs- und Ursprungsebene. Das
vollständige datierte Register, einschließlich der Methodenänderungen nach
dem Review mit der Richtung, in die jede schneidet, steht weiter oben auf
dieser Seite.

## Warum sich die Achsen bei (5, 5) kreuzen

Die Achsen kreuzen sich bei **(5.00, 5.00), der festen Mitte der Skala
0–10**. Eine Position ist damit absolut gegenüber den Ankern des
Bewertungsschemas: Eine Achsenlinie zu überqueren heißt, die Mitte der Skala
zu überqueren, wie der Rest des Feldes auch aussieht.

Der erste Entwurf des Bewertungsschemas definierte den Ursprung anders, als
Schwerpunkt der Mitte des Feldes (das Mittel der mittleren elf Produkte je
Achse, was auf diesen Wertungen (3.81, 5.66) ergibt). Diese Definition wurde
nach der Bewertung ersetzt, weil ein Schwerpunkt-Ursprung relativ zu dem
ist, wer gerade im Diagramm steht: Füge drei schwache Produkte hinzu, und
jedes andere Produkt wandert nach rechts über die Quadrantenlinien, ohne
dass sich an ihm irgendetwas geändert hätte. Eine feste Skalenmitte ist
unter jeder Änderung des Feldes stabil und erlaubt es, über eine Position
nachzudenken, ohne zu wissen, wer sonst bewertet wurde. Die Korrektur
änderte nur, wo sich die Achsenlinien kreuzen, und damit, welchen
Quadrantennamen manche Produkte tragen; kein Gewicht, kein Anker und keine
Teilwertung wurde mit ihr geändert, und danach wurde nichts neu bewertet.
Beide Definitionen des Ursprungs und das Datum der Korrektur sind in der
Arbeitsakte erhalten.

Eine Leseregel folgt aus der Arithmetik. Weil Teilwertungen ganze Zahlen
sind, bewegt eine Änderung um einen Punkt bei einer mittelgewichtigen
Komponente einen Index um etwa 0.25 — deshalb wird auf diesen Seiten
durchgehend ein Produkt innerhalb von ±0.25 einer Achsenlinie so gelesen,
dass es auf der Linie sitzt, statt mit Sicherheit auf einer ihrer Seiten.
Welche Produkte in diesem Band sitzen, ist zusammen mit den Koordinaten auf
der [Wertungsseite](/docs/comparison-scores) tabelliert, und was
Neubewertungen um einen einzelnen Punkt bewegen würden, ist auf der
[Sensitivitätsseite](/docs/comparison-sensitivity) durchgearbeitet.

## Die Skala: wie die Ankerleitern funktionieren

Jede Teilwertung ist eine ganze Zahl von 0–10, vergeben gegen eine
Ankerleiter, die geschrieben wurde, bevor irgendein Produkt bewertet wurde:
eine Tabelle von Sprossen, die benennt, welche Klasse von Design oder Beleg
jedes Wertungsband bedeutet. Eine ganze Zahl, die zwischen zwei Sprossen
fällt, heißt, dass das Produkt zwischen diesen Klassen sitzt. Als
Kalibrierung über alle neun Komponenten: Eine Wertung um **2** heißt, die
Eigenschaft fehlt im Wesentlichen oder existiert nur als Worte; um **5**
vorhanden, aber teilweise, begrenzt oder durch Vertrag und Richtlinie statt
durch Struktur gehalten; um **9** durch Konstruktion vorhanden,
standardmäßig an, mit den stärksten Belegen im Feld. Die neun Leitern stehen
vollständig zusammen mit der Matrix auf der
[Wertungsseite](/docs/comparison-scores), und die eingefrorenen Originale
liegen in `review/index/METHOD.md`.

## Die Grenzen

Das ist der Teil der Seite, der den Rest verdient, also ist nichts davon
weichgespült.

1. **Das sind Wertungen veröffentlichter Belege, keine Messungen.** Die
   Eingaben sind die einundzwanzig Vergleichsseiten, die eigenen
   Offenlegungsseiten der Anbieter, Audit- und Gerichtsakten und die
   IPinfo-Messstudie. Wo Messungen von außen existieren, haben sie Wertungen
   bewegt; die Ausgangsspalte stützt sich unmittelbar auf IPinfos
   Ergebnisse. Jede Latenz- und Durchsatzwertung auf der Karte ist ein
   Urteil über eine strukturelle Klasse, weil der Korpus erfundene
   Leistungszahlen verbietet. Eine echte Messkampagne könnte die Mitte der
   Qualitätsachse neu ordnen, und nichts auf dieser Seite sollte für eine
   solche gehalten werden.
2. **Niemand hat URnetwork von außen vermessen.** IPinfo maß Mullvad, IVPN
   und Windscribe bei 0 % Standort-Abweichung; keine entsprechende Studie
   wurde an URnetworks Exits, Latenz oder Durchsatz durchgeführt, in keine
   Richtung. Sein Eg 8 ruht auf einem Mechanismus, den du im Code prüfen
   kannst, und auf den strukturellen Eigenschaften von
   Privatanschluss-Adressraum, nicht auf einem Ergebnis einer dritten
   Partei, und sein L 5 und T 5 sind ungemessene strukturelle Anker. Die
   Asymmetrie steht hier, weil sie gegen das Produkt schneidet, zu dem diese
   Dokumentation gehört.
3. **Kein unabhängiges Audit deckt URnetworks Protokoll, seine
   Connect-Engine oder seinen Server-Code ab, und die Achse heißt
   *verifizierbar*.** Diese Abwesenheit ist eingepreist, V 6 gegen Mullvads
   9, IVPNs 8 und PIAs 8, und sie ist die größte einzelne Kritik an
   URnetwork, die dieser Korpus verzeichnet: Open Source über den ganzen
   Stack ist fortlaufende Verifizierbarkeit des Designs, aber keine
   unabhängige Prüfung der Schicht, auf der die Aussage ruht, keine
   gerichtliche Prüfung und keine Messung von außen ist ein echtes Loch in
   einer Behauptung von Verifizierbarkeit, und es kostet echte Punkte auf
   der Achse, die den Quadrantennamen des Produkts trägt. Die zwei
   Prüfungen dritter Parteien, die es gibt, decken andere Flächen ab und
   bewegten nichts; das Register oben und die V-Begründung auf der
   [Wertungsseite](/docs/comparison-scores) tragen sie. Bis 2026-08-07 sagte
   dieser Korpus rundheraus, es gebe keine; das war falsch, und es zu
   korrigieren änderte den Satz, nicht die Wertung.
4. **Eine Regel für Standardwerte gegenüber Fähigkeiten, in beide
   Richtungen angewandt, deren Eingaben einmal durch Entscheidung
   aktualisiert wurden.** Die Regel: Ein Produkt wird nach seinem
   ausgelieferten Standard bewertet, und eine Kernfähigkeit im Opt-in wird
   als bedingte Struktur angerechnet, nicht als der Standard. Unter ihr
   bewertete sich URnetworks damals im Opt-in liegende versiegelte Sitzung
   mit E 7, während NymVPNs Opt-in-Mixnet sein E bei 9 statt bei 10 hielt.
   Als der Produktverantwortliche URnetworks Sitzung zum Start als
   standardmäßig an entschied (2026-08-07, im Register offengelegt), bewegte
   dieselbe Regel URnetwork auf E 8. Die Fakten änderten sich, nicht die
   Regel, während Nyms Mixnet weiterhin als die Opt-in-Fähigkeit angerechnet
   wird, die es immer noch ist. Wer nur ausgelieferte Standards bewertet,
   sollte Nyms E ebenfalls senken; wer nur Fähigkeiten bewertet, sollte es
   heben. Nicht vertretbar ist, das eine ohne das andere zu tun.
5. **Manche Platzierungen sitzen im Rauschen, und manche Reihenfolgen sind
   Gewichtungsurteile.** Apple Private Relay sitzt zugleich im Rauschen
   beider Achsenlinien; Obscura sitzt auf der Qualitätslinie; Mysterium,
   Hola und Sentinel sitzen im Rauschen darunter; und vertretbare
   Neugewichtungen ordnen die Spitze der X-Achse neu, auch gegen URnetwork.
   Die benannte Liste, die Arithmetik einzelner Punkte und die
   durchgerechneten Neugewichtungen stehen auf der
   [Sensitivitätsseite](/docs/comparison-sensitivity), neben der
   Monte-Carlo-Akte, zu der sie gehören.
6. **Der Bewerter hat einen Interessenkonflikt.** URnetwork hat dieses Feld
   bewertet, und URnetwork steht auf der Karte. Die Abmilderungen sind die
   auf dieser Seite und in ihren Anhängen: Gewichte und Anker eingefroren
   vor der Bewertung, jede Teilwertung mit ihrer Begründung veröffentlicht,
   Ermessensurteile als solche ausgewiesen, die Neugewichtung, die URnetwork
   herabstuft, gedruckt statt vergraben. Keine davon ersetzt einen Bewerter
   von außen. Die Matrix ist bewusst vollständig genug, dass du dieser
   Bewerter sein kannst: Ändere die Gewichte oder jede Teilwertung, die du
   aus Belegen begründen kannst, und die Karte ist deine, um sie neu zu
   zeichnen.

## Wenn sich das Bild ändert

Landen neue Belege — ein unabhängiges Audit von URnetworks Protokoll oder
des Server-Codes des Operators, eine Messung seines Netzwerks von außen oder
ein Konkurrent, der verifizierbare strukturelle Trennung ausliefert —, ist
die stehende Regel, neu zu bewerten und neu zu veröffentlichen, in dieser
Reihenfolge, und das Register oben bekommt eine Zeile mit markierter
Richtung. Wenn eine Zahl auf dieser Seite oder in ihren Anhängen sich nicht
nachrechnen lässt oder eine Seite von der Arbeitsakte in `review/index/`
abdriftet, melde es wie jeden anderen Dokumentationsfehler: Issues in den
Repositories (github.com/urnetwork) oder Feedback in den Apps.
