Uptimeify Docs

Policies

Eine Eskalationsrichtlinie ist die geordnete Menge an Stufen, die entscheidet, wer beim Öffnen eines Incidents alarmiert wird, wie oft, und wann zur nächsten Stufe übergegangen wird.

Eine Eskalationsrichtlinie (Escalation Policy) gehört zu genau einem Team und entscheidet, was passiert, wenn einer der Incidents dieses Teams geöffnet wird: Wer wird alarmiert, in welcher Reihenfolge, und wann gibt die Engine das Warten auf und eskaliert weiter.

Stufen (Tiers)

Eine Richtlinie ist eine geordnete Liste von Stufen (tierOrder). Stufe 1 feuert nach ihrer eigenen delayMinutes ab dem Öffnen des Incidents (0 bedeutet sofort); reagiert niemand rechtzeitig, geht die Engine zu Stufe 2 weiter, dann Stufe 3, und so fort.

Jede Stufe hat:

FeldBedeutung
delayMinutesWie lange ab dem Feuern der vorherigen Stufe gewartet wird, bevor diese Stufe feuert.
targetTypeWas diese Stufe alarmiert: schedule (wer gerade für einen bestimmten Schedule Bereitschaft hat), user (eine bestimmte Person), team (jedes Mitglied eines Teams) oder channel (ein Notification-Channel, z. B. ein Slack-Webhook).
repeatCount / repeatIntervalMinutesWie oft und wie häufig diese Stufe ihr Ziel erneut alarmiert, bevor weiter eskaliert wird — eine Wiederholung ist ein zweiter (oder dritter) Versuch auf derselben Stufe, keine neue.
conditionsEine optionale Zeitfenster-Restriktion (wiederkehrend, uhrzeitbasiert, zeitzonenbewusst) — eine Stufe kann so eingeschränkt werden, dass sie nur zu bestimmten Uhrzeiten oder Wochentagen feuert, ausgewertet im Moment, in dem sie feuern würde. null bedeutet, die Stufe feuert immer.

Standardrichtlinien

Ein Team kann eine Richtlinie als isDefault: true markieren. Ein Incident, der ohne explizite Richtlinie erstellt wird — egal ob aus einer Alert-Source eingespeist oder manuell angelegt — löst zur Standardrichtlinie des Teams auf. Ein Team ohne konfigurierte Standardrichtlinie alarmiert niemanden, bis eine gesetzt oder pro Incident explizit ausgewählt wird.

Bestätigungs-Timeout und Erinnerungen

Zwei Einstellungen auf Richtlinien-Ebene prägen, was nach Beginn der Alarmierung passiert:

  • ackTimeoutMinutes — falls gesetzt, nimmt ein bestätigter Incident, bei dem so lange kein weiterer Fortschritt zu sehen ist, die Eskalation ab der aktuellen Stufe wieder auf, statt unbegrenzt still zu bleiben, nur weil jemand auf „Bestätigen" getippt und sich dann abgewendet hat.
  • reminderIntervalMinutes — falls gesetzt, erhält ein ungelöster Incident in diesem Intervall eine wiederkehrende Erinnerungsbenachrichtigung, unabhängig von der Stufen-Kette, damit ein lange offener Incident nicht aus dem Blick gerät.

Beide sind standardmäßig null (aus), sofern nicht konfiguriert.

Kontingent-bewusste Alarmierung

SMS- und Anruf-Stufen unterliegen dem gemeinsamen SMS-/Anruf-Kontingent der Organisation. Ist dieses Kontingent erschöpft, wird eine kostenpflichtige Stufe sofort zugunsten der nächsten Stufe übersprungen, statt ihre Verzögerung abzuwarten, und kostenlose Kanäle (Push, E-Mail) alarmieren unabhängig davon weiter.

Auf dieser Seite