Methode
So messen wir. Offen gelegt.
- Gemessen, nicht behauptet
- Der Status entsteht aus automatischen Prüfungen: Erreichbarkeit der Seiten, unser Health-Endpunkt /api/health mit Datenbank und Anmeldung, und bei Bedarf externe Monitore. Niemand schaltet ihn von Hand auf „betriebsbereit“.
- Kein Alarm aus einem Fehler
- Eine Prüfung gilt erst nach drei Fehlschlägen in Folge als gestört und erst nach zwei Erfolgen in Folge wieder als gesund. Einzelne Aussetzer lösen keine öffentliche Störung aus.
- Vom Check zum Dienst
- Fällt die Erreichbarkeit eines Dienstes aus oder zwei kritische Prüfungen gleichzeitig, ist das ein größerer Ausfall. Eine kritische Prüfung allein ist ein Teilausfall, weniger wichtige Prüfungen oder langsame Antworten bedeuten eingeschränkte Leistung.
- Verfügbarkeit
- Verfügbar ist die Zeit, in der ein Dienst betriebsbereit oder nur eingeschränkt war, geteilt durch die gemessene Zeit. Teil- und größere Ausfälle zählen als Ausfallzeit. Geplante Wartung wird separat ausgewiesen und nicht als Ausfall gezählt.
- Keine erfundene Historie
- Vor dem ersten Check gibt es keine Werte. Fehlen Messungen, etwa weil der Messdienst nicht lief, zählt diese Zeit weder als verfügbar noch als Ausfall; im Verlauf erscheint sie grau.
- Zeiträume
- 24 Stunden aus dem laufenden Verlauf, 7, 30 und 90 Tage, ein Jahr und die Zeit seit Messbeginn aus dem Tagesjournal (Kalendertage in UTC, heute eingeschlossen). Das Tagesjournal wird dauerhaft gespeichert, einzelne Checks 90 Tage.
- Eingriffe von Hand
- Menschen schreiben Vorfälle und Wartungen und können einen gemessenen Status mit Begründung korrigieren, etwa bei einem Fehlalarm. Jede solche Änderung wird protokolliert.
