Policies
Eine Eskalationsrichtlinie ist die geordnete Menge an Stufen, die entscheidet, wer beim Öffnen eines Incidents alarmiert wird, wie oft, und wann zur nächsten Stufe übergegangen wird.
Eine Eskalationsrichtlinie (Escalation Policy) gehört zu genau einem Team und entscheidet, was passiert, wenn einer der Incidents dieses Teams geöffnet wird: Wer wird alarmiert, in welcher Reihenfolge, und wann gibt die Engine das Warten auf und eskaliert weiter.
Stufen (Tiers)
Eine Richtlinie ist eine geordnete Liste von Stufen (tierOrder). Stufe 1 feuert nach ihrer eigenen delayMinutes ab dem Öffnen des Incidents (0 bedeutet sofort); reagiert niemand rechtzeitig, geht die Engine zu Stufe 2 weiter, dann Stufe 3, und so fort.
Jede Stufe hat:
| Feld | Bedeutung |
|---|---|
delayMinutes | Wie lange ab dem Feuern der vorherigen Stufe gewartet wird, bevor diese Stufe feuert. |
targetType | Was diese Stufe alarmiert: schedule (wer gerade für einen bestimmten Schedule Bereitschaft hat), user (eine bestimmte Person), team (jedes Mitglied eines Teams) oder channel (ein Notification-Channel, z. B. ein Slack-Webhook). |
repeatCount / repeatIntervalMinutes | Wie oft und wie häufig diese Stufe ihr Ziel erneut alarmiert, bevor weiter eskaliert wird — eine Wiederholung ist ein zweiter (oder dritter) Versuch auf derselben Stufe, keine neue. |
conditions | Eine optionale Zeitfenster-Restriktion (wiederkehrend, uhrzeitbasiert, zeitzonenbewusst) — eine Stufe kann so eingeschränkt werden, dass sie nur zu bestimmten Uhrzeiten oder Wochentagen feuert, ausgewertet im Moment, in dem sie feuern würde. null bedeutet, die Stufe feuert immer. |
Standardrichtlinien
Ein Team kann eine Richtlinie als isDefault: true markieren. Ein Incident, der ohne explizite Richtlinie erstellt wird — egal ob aus einer Alert-Source eingespeist oder manuell angelegt — löst zur Standardrichtlinie des Teams auf. Ein Team ohne konfigurierte Standardrichtlinie alarmiert niemanden, bis eine gesetzt oder pro Incident explizit ausgewählt wird.
Bestätigungs-Timeout und Erinnerungen
Zwei Einstellungen auf Richtlinien-Ebene prägen, was nach Beginn der Alarmierung passiert:
ackTimeoutMinutes— falls gesetzt, nimmt ein bestätigter Incident, bei dem so lange kein weiterer Fortschritt zu sehen ist, die Eskalation ab der aktuellen Stufe wieder auf, statt unbegrenzt still zu bleiben, nur weil jemand auf „Bestätigen" getippt und sich dann abgewendet hat.reminderIntervalMinutes— falls gesetzt, erhält ein ungelöster Incident in diesem Intervall eine wiederkehrende Erinnerungsbenachrichtigung, unabhängig von der Stufen-Kette, damit ein lange offener Incident nicht aus dem Blick gerät.
Beide sind standardmäßig null (aus), sofern nicht konfiguriert.
Kontingent-bewusste Alarmierung
SMS- und Anruf-Stufen unterliegen dem gemeinsamen SMS-/Anruf-Kontingent der Organisation. Ist dieses Kontingent erschöpft, wird eine kostenpflichtige Stufe sofort zugunsten der nächsten Stufe übersprungen, statt ihre Verzögerung abzuwarten, und kostenlose Kanäle (Push, E-Mail) alarmieren unabhängig davon weiter.
Incident Management
Incident Management (IM) ist Uptimeifys Bereitschafts- und Incident-Response-Ebene: Teams, On-Call-Schedules, Eskalationsrichtlinien und Alarm-Annahme aus deinen eigenen Tools — getrennt vom kundenseitigen Monitoring.
Kontingent & Overage
SMS- und Anruf-Alarmierung in Incident Management laufen über dasselbe monatliche Kontingent wie deine kundenseitigen SMS-Alerts. Hier steht genau, was passiert, wenn es aufgebraucht ist.