Website-Überwachung mit PagerDuty-Warnungen
Uptimia prüft Ihre Websites, Zertifikate und Checkout-Abläufe von außerhalb Ihres Netzwerks und löst für jeden bestätigten Fehler einen Incident in PagerDuty aus. Ihre Eskalationsrichtlinie übernimmt ab hier – ein Telefon klingelt, dann das nächste, wenn niemand abnimmt, bis sich jemand darum kümmert.
Overview
Last 7 DaysWarnungen brauchen einen Verantwortlichen, kein Publikum
Eine Chat-Warnung ist ein Rundruf: Alle sehen sie, also gehört sie niemandem. PagerDuty macht aus demselben Fehler eine Zuweisung – ein Name, ein Countdown, und der nächste Name, wenn der Countdown abgelaufen ist.
Von allen gesehen, von niemandem verantwortet
Jeder, der die Nachricht sieht, denkt, ein Kollege näher an der Tastatur kümmert sich schon – und sonntags schläft der ganze Raum gleichzeitig. Ein Kanal weiß nicht, wessen Wochenende gerade ist.
Ein Name, ein Timer, dann ein Telefon
PagerDuty weiß längst, wessen Woche gerade läuft, welche Nummer es wählen muss und was zu tun ist, wenn niemand abnimmt. Nur eines fehlt: der Auslöser selbst – der Nachweis von außerhalb Ihres Netzwerks, dass ein echter Besucher die Seite nicht laden konnte.
Ein Ausfall, ein Anruf
Ein einzelner Fehler in Ihrer Infrastruktur kann neun Prüfungen gleichzeitig rot färben – Checkout, API, Login, alles in derselben Minute. Uptimia fasst sie zu einem Incident zusammen, und PagerDuty ruft ein Telefon an: das der Rufbereitschaft dieser Woche.
PagerDuty in drei Schritten verbinden
Legen Sie in PagerDuty einen Service an, kopieren Sie den erhaltenen Schlüssel und fügen Sie ihn in Uptimia ein. Keine App zu autorisieren, nichts selbst am Laufen zu halten.
Schlüssel aus PagerDuty kopieren
Legen Sie in PagerDuty einen Service an – der angezeigte Schlüssel ist alles, was Uptimia braucht.
In Uptimia einfügen
Speichern Sie den Schlüssel – ein Testereignis beweist das Routing auf der Stelle.
PagerDuty die Eskalation übernehmen lassen
Ihre Dienstpläne, Vertretungen und Anrufe bleiben in PagerDuty – Uptimia löst den Incident aus und zieht sich zurück.
PagerDuty mit Uptimia verbinden
Jeder Schritt, im Hilfecenter: den Service in PagerDuty anlegen, den Schlüssel kopieren und ihn Ihren Monitoren zuweisen.
Jede Ihrer Prüfungen kann Sie alarmieren
Ein Ping an die Homepage sagt Ihnen nur etwas über die Homepage. Uptimia geht dagegen einen Login Schritt für Schritt durch, verfolgt eine API-Kette, die beim dritten Aufruf abbricht, und bemerkt, wenn sich ein geplanter Job nie zurückgemeldet hat – und jede dieser Prüfungen kann die Warnung auslösen.
Ordnen Sie jedes System dem zuständigen Team zu
Alarmieren Sie eine Rotation für alles, oder geben Sie jedem System seinen eigenen Service – den Checkout ans Storefront-Team, die Server ans Plattform-Team und die harmlosen Funde an einen Kanal, der auf den Morgen wartet.
Kanäle werden gelesen.Pager bekommen Antwort.
Die ganze Plattform in der Testphase – jede Art von Prüfung, ein Schlüssel, und ein Incident, sobald ein Fehler bestätigt ist.
Auslöser in PagerDuty, Nachweise in Uptimia
Das Ereignis sagt, was kaputtging und wie schlimm – alles, was ein Bearbeiter braucht. Das Prüfstandort-Urteil, das Antwortzeit-Diagramm und die Vorfall-Timeline warten in Uptimia auf denjenigen, der das Follow-up schreibt.
Was das Ereignis tatsächlich enthält
Jeder Auslöser ist dasselbe JSON an die Events API v2: eine Zusammenfassung dessen, was kaputtging, source uptimia.com, ein Schweregrad und eine Komponente, die die Art der Prüfung nennt – oder Incident group, sobald eine Eskalationsrichtlinie ihn ausgelöst hat. Nichts zuzuordnen und nichts zu parsen.
Bestätigt, bevor es alarmiert
Ein einzelner unglücklicher Prüfknoten weckt niemanden. Bei Verfügbarkeits-, Geschwindigkeits-, Zertifikats- und Transaktionsprüfungen legen Sie fest, wie viele unabhängige Regionen übereinstimmen müssen – bis zu drei – bevor ein Ereignis gesendet wird.
Ein Sturm, ein Incident
Monitore, die sich eine Eskalationsrichtlinie teilen und gemeinsam ausfallen, werden zu einem Uptimia-Incident zusammengefasst – PagerDuty erhält ein einziges Ereignis, das ihn benennt.
Wartung bleibt still
Geplante Fenster unterdrücken die Alarmierung, damit ein Deploy um 23:00 nie zu einem Telefonanruf wird.
Reaktionszeit protokolliert
Bei einer Eskalationsrichtlinie versieht Uptimia seine eigenen Bestätigungen mit Zeitstempeln – der Incident zeigt, wer übernommen hat und wie viele Minuten es dauerte.
Nur Fakten – mit Absicht
Chat-Kanäle bekommen einen Bestätigungslink; PagerDuty- und Webhook-Payloads nie – ein maschineller Feed aus Log-Pipelines darf niemals eine Eskalation zum Verstummen bringen. Bestätigen Sie entweder in PagerDuty oder in Uptimia, jedes für sein eigenes System.
So funktionieren Warnungen an PagerDuty
Uptimia prüft Ihre Websites von 171+ externen Standorten und löst bei einer fehlgeschlagenen Prüfung einen Incident in PagerDuty aus – Ihre Eskalationsrichtlinie ruft die Rufbereitschaft an und macht weiter, bis jemand bestätigt. Der Incident nennt den Monitor, was schiefgelaufen ist und wie schwer es wiegt; erholt sich die Prüfung, trägt ein zweites Ereignis die Entwarnung in denselben Service.
Die Erholung ist ein Ereignis, kein Beheben
Jedes Ereignis, das Uptimia sendet, ist ein Auslöser, nie ein Beheben – eine Prüfung, die wieder hochkommt, ist kein Incident, den jemand bearbeitet hätte. Die Entwarnung kommt als eigenes warning-Ereignis, das die zurückgekehrten Monitore nennt; der Bearbeiter schließt den Incident in PagerDuty.
Draußen erkannt, drinnen eskaliert
Ein hausinterner Health-Check teilt Ihre Region, Ihren Load Balancer und Ihren schlechten Tag – und verstummt mit ihnen. Prüfstandorte in 70+ Ländern fallen unabhängig von Ihnen aus – der einzige Nachweis, für den es sich lohnt, einen Kollegen um 4 Uhr morgens zu wecken.
Sieben Ereignisse, ein Routing-Key
Jede Zeile ist ein einzelner POST an die Events API v2 – keine Templates zu pflegen, keine Felder zuzuordnen, nichts, was Sie selbst betreiben müssen.
Alle 12 Benachrichtigungskanäle vergleichen →| Ereignis | Schweregrad | Was die Zusammenfassung sagt |
|---|---|---|
| Bestätigter Ausfall | critical | Der Name des Monitors, markiert als DOWN |
| Sturm-Zusammenfassung | critical | „9 Monitore down — Signing API +8 weitere (Uptimia-Incident #482)“ |
| Update: weitere Monitore | critical | Wie viele weitere Monitore demselben Incident beitraten |
| Erinnerung: weiterhin down | critical | „Weiterhin down: 3 von 9 Monitoren“, wenn eine spätere Eskalationsstufe auslöst |
| Server-Schwellenwert | warning | CPU, Arbeitsspeicher, Festplatte oder Last jenseits Ihres Grenzwerts |
| Wiederherstellung | warning | Wieder erreichbar – ein einzelner Monitor meldet auch die Dauer |
| Testereignis | info | Ein Hallo von Uptimia, gesendet, wenn Sie auf „Test senden“ drücken |
FAQ zur PagerDuty-Integration
01Was brauche ich auf PagerDuty-Seite?+
02Löst Uptimia den Incident, wenn die Site wieder da ist?+
03Alarmiert mich ein einziger Ausfall neunmal?+
04Wessen Eskalation gilt – die von Uptimia oder die von PagerDuty?+
05Bestätigt eine Bestätigung in PagerDuty auch die in Uptimia?+
06Welche Monitore können einen Incident auslösen?+
07Wie werden die Schweregrade zugeordnet?+
08Können verschiedene Monitore verschiedene Services alarmieren?+
09Was passiert, wenn der Schlüssel falsch ist oder PagerDuty nicht erreichbar ist?+
10Ist PagerDuty in jedem Tarif enthalten?+
Ausfallwarnungen, direkt an Ihre Rufbereitschaft
Verbinden Sie PagerDuty mit einem Schlüssel, und jeder bestätigte Ausfall erreicht sofort die Rufbereitschaft – mit den Nachweisen, die bereits in Uptimia warten, wenn sie dort ankommt.