Zum Inhalt springen
Galerien einer mehrstöckigen Einkaufspassage von unten gesehen, Geländer aus Glas und Lichtbänder ziehen sich über mehrere Ebenen.

Standorte vergleichen: der ehrliche Nenner - und warum ein Ranking ohne ihn schlechter ist als keines

Ein Ranking, das Öffnungstage und Sensorausfälle vermischt, ist schlechter als gar kein Ranking. Gar keines verleitet zu nichts. Ein falsches verleitet dazu, den falschen Standort zu besuchen, den falschen Filialleiter anzurufen und den falschen Umbau zu budgetieren.

Der Fehler liegt dabei selten in den Rohdaten. Er liegt in einer Frage, die kaum jemand stellt, bevor er eine Rangliste liest: Wodurch wurde geteilt?

Dieser Beitrag geht durch, warum Standortvergleiche schwerer sind, als sie aussehen, welche Nenner es gibt und welche Frage jeder davon beantwortet. Er baut auf Belegung messen auf, wo es um Tagesgrenzen und Zeitzonen ging, und auf Der halbe Ausfall, wo steht, wie ein beschädigter Tag erkannt wird.

Drei Arten, einen Standortvergleich unbrauchbar zu machen

Wer eine Kette mit fünfzig oder zweihundert Standorten führt, vergleicht zwangsläufig. Ab dieser Grösse ist Vergleichbarkeit nicht mehr eine Frage unter vielen, sondern die Frage.

Drei Effekte machen einen Vergleich dabei unbrauchbar, und keiner hat mit Leistung zu tun:

  • Der Öffnungstag. Ein Standort mit sechs Öffnungstagen, sieben Tage im Nenner: Er wirkt schwächer, als er ist. Teilt man nur durch die Tage mit Zahlen, wirkt er stärker. Dieselben Rohdaten, zwei gegenläufige Verzerrungen - je nachdem, wodurch geteilt wird.
  • Der stille Sensor. Zwei Tage Ausfall sehen in einer Tagesreihe genauso aus wie zwei Tage ohne Besucher. Wer die Lücke mit null füllt, erfindet einen Einbruch und rechnet ihn anschliessend in den Durchschnitt hinein.
  • Die gemischte Rangbasis. Eine Seite rankt je Berichtstag, die nächste je Standort, die dritte nach Rohsumme. Nebeneinandergelegt, ohne dass die Basis dabeisteht, vergleicht man Antworten auf verschiedene Fragen.

Ein Rechenbeispiel zeigt, wie gross der erste Effekt ist. Zwei Standorte haben an jedem Öffnungstag genau 1'000 Besucher. Standort A hat sieben Tage offen, Standort B sechs.

NennerStandort AStandort BWie es aussieht
Kalendertage (7)1'000857B ist 14 Prozent schwächer
Berichtstage (7 bzw. 6)1'0001'000beide gleich stark

Beide Zeilen sind richtig gerechnet. Sie beantworten nur verschiedene Fragen - und wer nur eine davon sieht, zieht aus einem Sonntag Ruhetag den Schluss, dass eine Filiale schlecht läuft.

Zwei Nenner, zwei Fragen

Die Lösung ist nicht, den richtigen Nenner zu wählen. Es gibt ihn nicht. Die Lösung ist, beide auszuweisen und jeden an die Frage zu binden, die er beantwortet:

KennzahlNennerBeantwortet die Frage
Ø Besucher pro Tagalle Kalendertage im FensterWie viel Frequenz fiel pro Kalendertag an?
Ø Besucher je BerichtstagTage mit einer Zahl über nullWie stark ist der Standort, wenn er meldet?
AbdeckungBerichtstage geteilt durch KalendertageAuf wie vielen Tagen beruht die Zahl?
Abweichung vom MittelMittel der Werte je Berichtstag im ClusterWo steht der Standort in seiner Gruppe?
GleichmässigkeitStandardabweichung geteilt durch MittelLäuft die Gruppe gleichmässig, oder trägt sie ein Gefälle?

Die Übersicht zeigt den Kalendertag, weil sie die Frage nach dem Volumen beantwortet. Rangfolge und Bewertung rechnen je Berichtstag, weil sie die Frage nach der Stärke beantworten. Ein geschlossener Sonntag drückt die Rangfolge damit nicht nach unten - und er verschwindet trotzdem nicht aus dem Volumen.

Derselbe Gedanke steht schon in Verweildauer messen: Dort teilt der Spitzenfaktor einer Zone durch die Tage mit Daten, weil datenlose Tage jede Spitze künstlich aufblähen würden. Es ist dieselbe Regel an einer anderen Stelle. Der Nenner folgt der Frage, nicht der Gewohnheit.

Abdeckung: auf wie vielen Tagen die Zahl beruht

Die dritte Zeile der Tabelle ist die, die in den meisten Ranglisten fehlt, und die wichtigste. Ein Standort, der auf sieben von vierzehn Tagen gemeldet hat, kann einen hervorragenden Wert je Berichtstag haben. Die Frage ist, ob man ihm glaubt.

Deshalb trägt jede Zeile im Ranking ihre Abdeckung als eigene Spalte, und unter 70 Prozent erscheint eine Warnung. Die Zahl bleibt sichtbar - sie ist ja nicht falsch -, aber sie trägt ein Zeichen, dass sie auf dünner Grundlage steht.

Richtig lesen lässt sich die Abdeckung nur mit den Öffnungszeiten daneben. Ein Standort mit Sonntag Ruhetag hat über zwei Wochen eine Abdeckung von zwölf aus vierzehn Tagen, und das ist sein Normalzustand. Wer die Öffnungszeiten je Standort pflegt, liest diese Zahl als normal statt als Ausfall.

Wann eine Auswertung lieber keine Zahl zeigt

Es gibt Situationen, in denen die ehrlichste Ausgabe keine Zahl ist. Eine gute Auswertung erkennt sie und sagt es, statt eine Position, einen Trend oder eine Abweichung zu erfinden:

SituationSchwelleWas stattdessen steht
Zu wenige Standorteunter 4 meldenden Standortenkein Perzentilrang
Trendbasis zu kurzweniger als 8 Tage mit Daten„nicht ausreichend“ statt steigend oder fallend
Trendbasis zu lückenhaftunter der Hälfte der Tage mit Daten„nicht ausreichend“
Kein tragfähiges MittelMittel null oder kleinerkeine Abweichung statt 0 Prozent
Tag ohne Meldungkein Datensatzdie Linie bricht sichtbar ab

Die erste Zeile verdient ein Beispiel. Ein Perzentilrang bei drei Standorten sagt: „Standort B liegt im 50. Perzentil.“ Das klingt nach Statistik und heisst nur, dass er in der Mitte von dreien steht. Eine unterdrückte Zahl ist selbst eine Aussage: Dafür reicht die Datenlage nicht.

„Hat nicht gemeldet“ ist kein schlechtes Ergebnis

Das ist die Unterscheidung, um die sich der ganze Vergleich dreht. Ein Standort, dessen Sensor in der Berichtsperiode geschwiegen hat, ist nicht schwach. Er ist unbekannt.

Was ein Vergleich üblicherweise daraus macht: Er zählt die fehlenden Tage als null, führt den Standort im selben Ranking wie alle anderen, und dort landet er unten - neben den echten Problemfällen. Der Filialleiter bekommt einen Anruf wegen eines Sensorkabels.

Richtig ist das Gegenteil, in drei Schritten:

  1. Ein fehlender Tag bleibt ein fehlender Tag - leer, nicht null.
  2. Standorte, die in der Periode nicht gemeldet haben, stehen in einer eigenen Liste neben dem Ranking, nicht darin.
  3. Die Tagesreihe bricht an der Lücke ab, statt eine Linie durchzuziehen, als wäre nichts gewesen.

Beschädigte, aber nicht leere Tage sind ein eigener Fall. Wie sie erkannt und aus Tagesstatistiken entfernt werden, steht in Der halbe Ausfall.

Im Cluster: Mittel, Median und Gefälle

Ein Durchschnitt über alle Standorte einer Kette sagt wenig, weil eine Innenstadtfiliale und ein Standort an der Autobahnausfahrt nichts miteinander zu tun haben. Verglichen wird deshalb in Clustern: Gruppen vergleichbarer Standorte, von Hand zusammengestellt, weil nur jemand, der die Standorte kennt, weiss, was vergleichbar ist.

Ein Cluster aus Ungleichem liefert korrekte Zahlen zu einer falschen Frage. Das ist die eine Entscheidung, die kein System abnimmt.

Innerhalb eines Clusters tragen vier Werte am meisten:

  • Median mit P25 und P75. Der Median ist gegen den einen Ausreisser immun, der den Mittelwert zieht. P25 und P75 zeigen, wie breit die Mitte ist.
  • Abweichung vom Mittel. Ab 20 Prozent unter dem Mittel erscheint ein Hinweis - er nennt genau die Standorte, die eine Erklärung brauchen, und keine anderen.
  • Gleichmässigkeit. Ein einziger Wert für die Frage, ob eine Gruppe gleichmässig läuft oder ein Gefälle trägt: die Standardabweichung geteilt durch das Mittel. Zwei Cluster mit demselben Durchschnitt können völlig verschieden aussehen - einer mit zehn ähnlichen Standorten, einer mit fünf starken und fünf schwachen.
  • Leistungsstufen sowie die stärksten und schwächsten Standorte, damit eine lange Liste lesbar wird.

Grösse gegen Stärke: die Sicht über Länder

Wer in mehreren Ländern betreibt, bekommt entweder eine Gesamtsumme, in der die Struktur verschwindet, oder eine Standortliste, die niemand überblickt. Und ein Land mit vielen Standorten schlägt in jedem Total ein Land mit wenigen - ohne dass das etwas über die Standorte sagt.

Die Lösung sind zwei Lesarten derselben Länderzahl. Total zeigt Gewicht, pro Standort zeigt Stärke. Die Normierung teilt dabei durch die Standorte, die gemeldet haben, nicht durch alle, die angelegt sind - ein stiller Standort verwässert den Landeswert nicht.

Länder lassen sich zu Regionen zusammenfassen und bis auf die Standorte aufschlüsseln, und die Tagesreihe zeigt Lücken als Lücken. Fehlen Daten, erscheint ein Fehler statt einer Reihe selbstsicherer Nullen.

Ein Hinweis zur Lesart, damit zwei Prozentwerte nicht verwechselt werden: Im Clustervergleich rechnet die Abweichung je Berichtstag, im Ländervergleich je meldendem Standort. Beide sind korrekt. Sie beantworten verschiedene Fragen.

Die letzten sieben Tage: ein Ranking mit festem Fenster

Die dritte Sicht ist die schnellste: Wer lag in den letzten sieben Tagen vorn, wer hinten? Sie rechnet bewusst anders als der Cluster, und genau das muss man wissen.

Hier ist der Divisor immer das volle Fenster - sieben Tage, nie die Tage mit Daten. Der Durchschnitt pro Tag ist das Total geteilt durch sieben. Das ist genau umgekehrt zum Cluster, und es ist richtig so: Die Frage lautet nicht „wie stark, wenn offen“, sondern „wie viel in dieser Woche“.

Zwei Eigenschaften machen das Ranking belastbar. Die Vergleichsperiode ist gleich lang und schliesst lückenlos an: die sieben Tage gegen die sieben davor, nicht gegen einen Monatsdurchschnitt. Und der Trend über alle Standorte ist besuchergewichtet - nicht das Mittel der Prozente je Standort, bei dem eine kleine Filiale mit +40 Prozent so viel zählt wie das Flaggschiff mit −5.

Jeder Standort wird dabei in seiner eigenen Zeitzone in Tage geschnitten. Spitze und Ende der Liste entstehen nur aus Standorten mit tatsächlichen Datentagen, und wer nicht gemeldet hat, steht - wie im Cluster - in der eigenen Liste daneben.

Vergleichbar wird, was gleich eingerichtet ist

Ein letzter Effekt entsteht nicht in der Auswertung, sondern bei der Einrichtung. Wer jeden Monat eine Filiale eröffnet, richtet dieselbe Konfiguration immer wieder von Hand ein. Bei jeder Wiederholung entsteht ein anderer Schwellenwert, eine andere Zone, ein anderer Alarmempfänger - und der Vergleich vergleicht danach verschieden eingerichtete Standorte.

Dagegen hilft, einen eingerichteten Standort zu klonen, statt jeden neu aufzusetzen. Übernommen werden Zonen mit Kapazität und Warnstufe, Schwellen, Alarmempfänger und Kanäle, Öffnungszeiten und der Berichtsplan - nach einer festgelegten Liste, die vorher offenliegt. Anzeigeschlüssel werden dabei neu ausgestellt statt mitkopiert; ein geklonter Standort erbt keinen öffentlichen Zugang.

Der zwölfte Standort ist damit genauso eingerichtet wie der erste - und damit überhaupt erst mit ihm vergleichbar.

Fünf Festlegungen, bevor der erste Vergleich trägt

  1. Land je Standort. Einmal festgelegt, trägt es den gesamten Länder- und Regionenvergleich.
  2. Zeitzone je Standort. Steht sie falsch, verschiebt sich der Tagesschnitt gegen die Nachbarn.
  3. Öffnungszeiten. Mit ihnen liest man eine Abdeckung von sechs aus sieben als normal statt als Ausfall.
  4. Cluster-Mitgliedschaft. Vergleichbares zusammen, Unvergleichbares getrennt.
  5. Die Vergleichsauswertungen. Cluster- und Ländervergleich schalten wir bei der Einführung frei.

Alle fünf werden einmal festgelegt und danach kaum wieder angefasst. Sie entscheiden aber, ob jede spätere Rangliste eine Aussage ist oder eine Behauptung.

Wie wir das machen

Das ANALYSIT Counting System vergleicht Standorte in Clustern mit zwei offengelegten Nennern: Ø Besucher pro Kalendertag in der Übersicht, Ø je Berichtstag in Rangfolge, Leistungsstufen und Abweichung. Jede Ranking-Zeile trägt ihre Abdeckung, unter 70 Prozent mit Warnung; ab 20 Prozent unter dem Mittel erscheint ein Hinweis. Dazu Median mit P25, P75 und P90, Gleichmässigkeit und Export als CSV und XLSX.

Unter vier meldenden Standorten entfällt der Perzentilrang, unter acht Tagen oder halber Abdeckung der Trend. Standorte ohne Meldung stehen in einer eigenen Liste, Tagesreihen brechen an Lücken ab.

Der Ländervergleich fasst Standorte zu Ländern und Regionen zusammen, wahlweise als Total oder normiert je meldendem Standort. Das 7-Tage-Ranking rechnet Rohsummen über ein festes Fenster gegen die gleich lange Vorperiode, mit besuchergewichtetem Trend. Eingerichtete Standorte lassen sich als Vorlage klonen.

Wenn deine Ranglisten heute durch Kalendertage teilen, ohne es zu sagen, sprich mit uns. Meistens reicht ein Standort mit Ruhetag, um den Unterschied zu sehen.