Zum Inhalt springen

Website-Überwachung mit PagerDuty-Warnungen

Uptimia prüft Ihre Websites, Zertifikate und Checkout-Abläufe von außerhalb Ihres Netzwerks und löst für jeden bestätigten Fehler einen Incident in PagerDuty aus. Ihre Eskalationsrichtlinie übernimmt ab hier – ein Telefon klingelt, dann das nächste, wenn niemand abnimmt, bis sich jemand darum kümmert.

Warnungen brauchen einen Verantwortlichen, kein Publikum

Eine Chat-Warnung ist ein Rundruf: Alle sehen sie, also gehört sie niemandem. PagerDuty macht aus demselben Fehler eine Zuweisung – ein Name, ein Countdown, und der nächste Name, wenn der Countdown abgelaufen ist.

Die Warnung als Nachricht im Kanal

Von allen gesehen, von niemandem verantwortet

Signing API fällt aus
04:52 · gepostet in #alerts
hier hat niemand Dienst
Der Chatverlauf
drei 👍-Reaktionen bis zum Frühstück

Jeder, der die Nachricht sieht, denkt, ein Kollege näher an der Tastatur kümmert sich schon – und sonntags schläft der ganze Raum gleichzeitig. Ein Kanal weiß nicht, wessen Wochenende gerade ist.

Die Warnung als PagerDuty-Incident

Ein Name, ein Timer, dann ein Telefon

Signing API fällt aus
04:52 · Auslösung
Richtlinie · 4-Min.-Timer
Das Telefon, das rangehen muss
klingelt, eskaliert, hält die Bestätigung fest

PagerDuty weiß längst, wessen Woche gerade läuft, welche Nummer es wählen muss und was zu tun ist, wenn niemand abnimmt. Nur eines fehlt: der Auslöser selbst – der Nachweis von außerhalb Ihres Netzwerks, dass ein echter Besucher die Seite nicht laden konnte.

Ein lauterer Kanal hilft nicht. Eine Warnung mit Verantwortlichem und Stoppuhr dagegen schon. Hier ein Failover am Sonntagmorgen, Minute für Minute:

Ein Ausfall, ein Anruf

Ein einzelner Fehler in Ihrer Infrastruktur kann neun Prüfungen gleichzeitig rot färben – Checkout, API, Login, alles in derselben Minute. Uptimia fasst sie zu einem Incident zusammen, und PagerDuty ruft ein Telefon an: das der Rufbereitschaft dieser Woche.

04:52 Neun Prüfungen schlagen unter einer Eskalationsrichtlinie fehlEin Auslöseereignis: „9 Monitore down — Signing API +8 weitere (#482)“ sev · critical
04:53 Die Richtlinie ruft die primäre Rufbereitschaft an – keine AntwortNichts geht verloren: Die Richtlinie zählt bereits das Zeitfenster für Stufe zwei herunter Richtlinie · Stufe 1
04:58 Die Vertretung bestätigt und startet das Regions-FailoverDie Zusammenfassung nannte Monitor und Schweregrad – genug, um sofort handeln zu können quittiert in PagerDuty
05:16 ✅ Entwarnung: alle 9 Monitore wieder erreichbarEigenes Ereignis mit Schweregrad warning – der Bearbeiter schließt den Incident Erholungsereignis
24 mindown → up
Der Entwickler, der es behoben hat, hatte Uptimia nie geöffnetWoche 2 im Dienstplan
Die Person in Rufbereitschaft hatte keinen Uptimia-Login und brauchte nie einen. Die Meldung nannte Monitor, Schweregrad und Komponente – genug zum Handeln – und die Bestätigung ist in PagerDuty protokolliert.
9 Monitore, 1 Auslöserquittiert in 6 Min.24 Minuten ausgefallenkein Login nötig
Die Erkennung kam von außerhalb des Hauses. Alles danach blieb in PagerDuty – der Dienstplan, der Anruf, die Eskalation, die Bestätigung. kein Monitoring-Login nötig

PagerDuty in drei Schritten verbinden

Legen Sie in PagerDuty einen Service an, kopieren Sie den erhaltenen Schlüssel und fügen Sie ihn in Uptimia ein. Keine App zu autorisieren, nichts selbst am Laufen zu halten.

Schritt 12 min

Schlüssel aus PagerDuty kopieren

Legen Sie in PagerDuty einen Service an – der angezeigte Schlüssel ist alles, was Uptimia braucht.

Web platform · Events API v2 Schlüssel kopieren
R0VE··············KEY · ein Wert, sonst nichts zu konfigurieren
Schritt 21 min

In Uptimia einfügen

Speichern Sie den Schlüssel – ein Testereignis beweist das Routing auf der Stelle.

Alarmziel für diesen Monitor
PagerDuty · Web platformE-MailSlack
Testereignis zugestellt · Schweregrad info · Quelle uptimia.com
Schritt 3wichtig

PagerDuty die Eskalation übernehmen lassen

Ihre Dienstpläne, Vertretungen und Anrufe bleiben in PagerDuty – Uptimia löst den Incident aus und zieht sich zurück.

Wer eskaliert
PagerDuty-Richtlinie – Rufbereitschaft → +4 Min. Vertretung → +10 Min. Lead
Uptimia-Leiter – eine Stufe · Wartungsfenster senden nichts
Technische Setup-Anleitung

PagerDuty mit Uptimia verbinden

Jeder Schritt, im Hilfecenter: den Service in PagerDuty anlegen, den Schlüssel kopieren und ihn Ihren Monitoren zuweisen.

Setup-Anleitung öffnen help.uptimia.com

Jede Ihrer Prüfungen kann Sie alarmieren

Ein Ping an die Homepage sagt Ihnen nur etwas über die Homepage. Uptimia geht dagegen einen Login Schritt für Schritt durch, verfolgt eine API-Kette, die beim dritten Aufruf abbricht, und bemerkt, wenn sich ein geplanter Job nie zurückgemeldet hat – und jede dieser Prüfungen kann die Warnung auslösen.

VerfügbarkeitsprüfungenZuerst von bis zu drei Regionen bestätigt
SSL-ZertifikateAblaufdaten und fehlgeschlagene Handshakes
Domain-AblaufVerlängerungsdaten, die sich anschleichen
ServermetrikenCPU, Arbeitsspeicher, Festplatte und Last
1 Routing-Key ein Schlüssel – jede Prüfung alarmiert darüber
Heartbeats & CronDer nächtliche Job, der sich nie meldete
TransaktionenCheckouts Schritt für Schritt nachgespielt
Viren & MalwareSeiten markiert, Hosts auf der Sperrliste
SeitenladezeitLadezeiten über Ihrem Schwellenwert
Jedes Ereignis bringt seinen eigenen Schweregrad mit – ein bestätigter Ausfall kommt als critical, eine Erholung oder ein Server über seiner CPU-, Speicher- oder Platten-Schwelle als warning, sodass Ihre Service-Regeln sie auseinanderhalten können. jede Prüfung · ein Schlüssel

Ordnen Sie jedes System dem zuständigen Team zu

Alarmieren Sie eine Rotation für alles, oder geben Sie jedem System seinen eigenen Service – den Checkout ans Storefront-Team, die Server ans Plattform-Team und die harmlosen Funde an einen Kanal, der auf den Morgen wartet.

Ein einzelner Service
Ein Schlüssel, eine Rotation – der Einstieg der meisten Teams.
Jeder Monitor-Typ löst dort aus
Eine Eskalationsrichtlinie, ein Auslöseereignis
Ihre Richtlinie entscheidet, wen sie weckt
ein Schlüssel, ein Kontakt
Ein Service pro System
Checkout, Plattform und Infrastruktur, jeweils mit eigenem Schlüssel.
Transaktions-Replays → die Zahlungs-Rotation
Server und Heartbeats → Infrastruktur
Zertifikate und Domains → die Verlängerungs-Warteschlange
Schlüssel sind nur Kontakte
Nachts Pager, tagsüber Chat
Nicht jeder Fund ist einen Anruf um 4 Uhr morgens wert.
Bestätigte Ausfälle → PagerDuty
Ablauf- und Schwellenwert-Warnungen → ein Chat-Kanal
Monatliche Verfügbarkeitsberichte → E-Mail
derselbe Incident, unterschiedliche Empfänger
Derselbe Incident erreicht auch SlackMS TeamsDiscordTelegramWhatsAppTwilio SMSE-Mail

Kanäle werden gelesen.Pager bekommen Antwort.

Die ganze Plattform in der Testphase – jede Art von Prüfung, ein Schlüssel, und ein Incident, sobald ein Fehler bestätigt ist.

Kostenlose 30-Tage-Testphase starten
30 Tage kostenlos keine Kreditkarte jederzeit kündbar

Auslöser in PagerDuty, Nachweise in Uptimia

Das Ereignis sagt, was kaputtging und wie schlimm – alles, was ein Bearbeiter braucht. Das Prüfstandort-Urteil, das Antwortzeit-Diagramm und die Vorfall-Timeline warten in Uptimia auf denjenigen, der das Follow-up schreibt.

Was das Ereignis tatsächlich enthält

Jeder Auslöser ist dasselbe JSON an die Events API v2: eine Zusammenfassung dessen, was kaputtging, source uptimia.com, ein Schweregrad und eine Komponente, die die Art der Prüfung nennt – oder Incident group, sobald eine Eskalationsrichtlinie ihn ausgelöst hat. Nichts zuzuordnen und nichts zu parsen.

summary — Signing API is DOWN (Uptimia incident #479)TEXT severity — criticalALARM component — Incident groupROUTING

Bestätigt, bevor es alarmiert

Ein einzelner unglücklicher Prüfknoten weckt niemanden. Bei Verfügbarkeits-, Geschwindigkeits-, Zertifikats- und Transaktionsprüfungen legen Sie fest, wie viele unabhängige Regionen übereinstimmen müssen – bis zu drei – bevor ein Ereignis gesendet wird.

171+ Prüfstandorte · 6 Kontinente

Ein Sturm, ein Incident

Monitore, die sich eine Eskalationsrichtlinie teilen und gemeinsam ausfallen, werden zu einem Uptimia-Incident zusammengefasst – PagerDuty erhält ein einziges Ereignis, das ihn benennt.

Uptimia-Incident #482 · 9 Monitore

Wartung bleibt still

Geplante Fenster unterdrücken die Alarmierung, damit ein Deploy um 23:00 nie zu einem Telefonanruf wird.

23:00–01:00 · stumm

Reaktionszeit protokolliert

Bei einer Eskalationsrichtlinie versieht Uptimia seine eigenen Bestätigungen mit Zeitstempeln – der Incident zeigt, wer übernommen hat und wie viele Minuten es dauerte.

quittiert · 6 Min.

Nur Fakten – mit Absicht

Chat-Kanäle bekommen einen Bestätigungslink; PagerDuty- und Webhook-Payloads nie – ein maschineller Feed aus Log-Pipelines darf niemals eine Eskalation zum Verstummen bringen. Bestätigen Sie entweder in PagerDuty oder in Uptimia, jedes für sein eigenes System.

PagerDuty-Ereignis – Fakten, kein BestätigungslinkMIT ABSICHT Chat-Kanäle – mit BestätigungslinkSLACK · TEAMS Dashboard – ein Tap beendet die LeiterUPTIMIA

So funktionieren Warnungen an PagerDuty

Uptimia prüft Ihre Websites von 171+ externen Standorten und löst bei einer fehlgeschlagenen Prüfung einen Incident in PagerDuty aus – Ihre Eskalationsrichtlinie ruft die Rufbereitschaft an und macht weiter, bis jemand bestätigt. Der Incident nennt den Monitor, was schiefgelaufen ist und wie schwer es wiegt; erholt sich die Prüfung, trägt ein zweites Ereignis die Entwarnung in denselben Service.

„Der Pager schließt sich von selbst, wenn die Site wieder da ist“

Die Erholung ist ein Ereignis, kein Beheben

Um 05:16 wieder erreichbar
Entwarnungs-Ereignis gesendet
es wird kein Resolve gesendet
Der Incident bleibt offen
bis ein Bearbeiter ihn schließt

Jedes Ereignis, das Uptimia sendet, ist ein Auslöser, nie ein Beheben – eine Prüfung, die wieder hochkommt, ist kein Incident, den jemand bearbeitet hätte. Die Entwarnung kommt als eigenes warning-Ereignis, das die zurückgekehrten Monitore nennt; der Bearbeiter schließt den Incident in PagerDuty.

Externe Prüfstandorte + Ihre Eskalationsrichtlinie

Draußen erkannt, drinnen eskaliert

171+ Standorte
bis zu drei Regionen müssen übereinstimmen
ein Auslöseereignis
Ihre Rufbereitschaftsrichtlinie
ruft an, eskaliert, protokolliert

Ein hausinterner Health-Check teilt Ihre Region, Ihren Load Balancer und Ihren schlechten Tag – und verstummt mit ihnen. Prüfstandorte in 70+ Ländern fallen unabhängig von Ihnen aus – der einzige Nachweis, für den es sich lohnt, einen Kollegen um 4 Uhr morgens zu wecken.

Jedes Ereignis

Sieben Ereignisse, ein Routing-Key

Jede Zeile ist ein einzelner POST an die Events API v2 – keine Templates zu pflegen, keine Felder zuzuordnen, nichts, was Sie selbst betreiben müssen.

Alle 12 Benachrichtigungskanäle vergleichen
EreignisSchweregradWas die Zusammenfassung sagt
Bestätigter AusfallcriticalDer Name des Monitors, markiert als DOWN
Sturm-Zusammenfassungcritical„9 Monitore down — Signing API +8 weitere (Uptimia-Incident #482)“
Update: weitere MonitorecriticalWie viele weitere Monitore demselben Incident beitraten
Erinnerung: weiterhin downcritical„Weiterhin down: 3 von 9 Monitoren“, wenn eine spätere Eskalationsstufe auslöst
Server-SchwellenwertwarningCPU, Arbeitsspeicher, Festplatte oder Last jenseits Ihres Grenzwerts
WiederherstellungwarningWieder erreichbar – ein einzelner Monitor meldet auch die Dauer
TestereignisinfoEin Hallo von Uptimia, gesendet, wenn Sie auf „Test senden“ drücken

FAQ zur PagerDuty-Integration

01Was brauche ich auf PagerDuty-Seite?+
Einen Service mit einer Events API v2-Integration. In PagerDuty: Services → New Service → Events API v2 als Integrationstyp wählen, dann den Integration Key im Tab Integrations des Service kopieren. Dieser Schlüssel ist der einzige Wert, den Uptimia speichert – es gibt keine App zu autorisieren, kein Benutzerkonto zu verbinden und nichts zu hosten.
02Löst Uptimia den Incident, wenn die Site wieder da ist?+
Nein. Jedes Ereignis, das Uptimia sendet, ist ein Auslöser, auch die Entwarnung: Die Erholung kommt als eigenes warning-Ereignis, das nennt, was zurückkam, und der PagerDuty-Incident bleibt offen, bis ihn dort jemand schließt. Eine Prüfung, die wieder anspringt, ist nicht dasselbe wie ein behobener Ausfall – deshalb hat der Bearbeiter das letzte Wort.
03Alarmiert mich ein einziger Ausfall neunmal?+
Nicht, wenn diese Monitore eine Eskalationsrichtlinie teilen. Die Gruppierung ist standardmäßig aktiv und fasst alles, was im selben Zeitfenster ausfällt, zu einem Uptimia-Incident zusammen – PagerDuty erhält ein einziges Ereignis, das ihn nennt: „9 Monitore down — Signing API +8 weitere (Uptimia-Incident #482)“. Später beitretende Monitore erzeugen ein gedrosseltes Update-Ereignis statt je einem pro Monitor, und eine gemeinsame Entwarnung, wenn alle wieder da sind. Monitore ohne Eskalationsrichtlinie werden einzeln alarmiert, und die Gruppierung lässt sich in den Alerting-Einstellungen abschalten, falls Sie das möchten.
04Wessen Eskalation gilt – die von Uptimia oder die von PagerDuty?+
Die, auf die Sie den Monitor zeigen lassen – beides gleichzeitig verdoppelt nur den Lärm. Teams, die ohnehin in PagerDuty leben, überlassen ihm die Rotation und hängen den Monitor an einen einzigen PagerDuty-Kontakt. Uptimias eigene Eskalationsrichtlinien – zeitgesteuerte Stufen zu weiteren Personen und Kanälen, die Sie ab dem Professional-Tarif selbst bauen – sind für Teams ohne Rufbereitschafts-Tool da.
05Bestätigt eine Bestätigung in PagerDuty auch die in Uptimia?+
Nein – die Verbindung ist gerichtet: Uptimia postet Ereignisse, PagerDuty postet nie zurück. Eine Bestätigung in PagerDuty stoppt PagerDutys Eskalation; eine Bestätigung im Uptimia-Dashboard stoppt die von Uptimia. Deshalb tragen PagerDuty-Payloads auch bewusst keinen Bestätigungslink, anders als die Chat-Kanäle – ein maschineller Feed und die Log-Pipelines dahinter dürfen eine Eskalation nicht zum Verstummen bringen.
06Welche Monitore können einen Incident auslösen?+
Jeder einzelne – Verfügbarkeit, Transaktionen, Ladezeiten, Real-User-Monitoring, SSL, Domains, Malware, Server, Heartbeats, Blacklists, DNS und API-Prüfungen. Jeder schreibt seine eigene Zusammenfassung, die Monitor und Vorfall nennt, und jeder sendet seine eigene Entwarnung, wenn die Prüfung wieder besteht.
07Wie werden die Schweregrade zugeordnet?+
Bestätigte Ausfälle werden als critical eingestuft, ebenso Ablauf- und Verschlechterungswarnungen der einzelnen Monitore – falls die niemanden alarmieren sollen, leiten Sie sie stattdessen an einen Chat-Kanal um. Serverschwellenwerte – CPU, Arbeitsspeicher, Festplatte, Last – sowie jede Erholung gelten als warning, ebenso gruppierte Incidents auf Störungsniveau. Das Testereignis gilt als info. Jedes Ereignis trägt außerdem source uptimia.com und eine Komponente, die die Art der Prüfung angibt („Uptime Monitoring“, „SSL Certificate“, „API Monitoring“), oder „Incident group“, sobald die Warnung über eine Eskalationsrichtlinie ausgelöst wurde.
08Können verschiedene Monitore verschiedene Services alarmieren?+
Ja. Legen Sie eine Integration pro Integration Key an – jeder wird ein eigener Kontakt – und hängen Sie dann Monitore an den Kontakt, dessen Dienstplan sie betreut. Ein Checkout-Replay kann den Payments-Service alarmieren, während eine Festplattenwarnung an die Infrastruktur geht.
09Was passiert, wenn der Schlüssel falsch ist oder PagerDuty nicht erreichbar ist?+
Der Aufruf ist begrenzt – zehn Sekunden zum Verbinden, dreißig insgesamt – daher kann ein langsamer oder unerreichbarer Endpunkt den Rest der Alarmierung nicht aufhalten, und das Ergebnis wird mit der Warnung protokolliert. Jeder andere Kontakt dieses Monitors wird unabhängig davon benachrichtigt. Einen vertippten Schlüssel findet man besser über Test senden als während eines Ausfalls.
10Ist PagerDuty in jedem Tarif enthalten?+
Ja – es ist ein integrierter Benachrichtigungskanal, in jedem Tarif und in der 30-tägigen kostenlosen Testphase enthalten, ohne Gebühr pro Ereignis von Uptimia. Was Sie PagerDuty für Nutzerplätze und dessen eigene Eskalationsfunktionen zahlen, ist eine Sache zwischen Ihnen und PagerDuty.

Ausfallwarnungen, direkt an Ihre Rufbereitschaft

Verbinden Sie PagerDuty mit einem Schlüssel, und jeder bestätigte Ausfall erreicht sofort die Rufbereitschaft – mit den Nachweisen, die bereits in Uptimia warten, wenn sie dort ankommt.

Ihre Rufbereitschaft, kein Rundruf Ein Schlüssel, kein Code 30-tägige kostenlose Testphase Keine Kreditkarte
PagerDuty ist ein integrierter Benachrichtigungskanal – jede Prüfung, die Uptimia fährt, kann einen Incident auslösen.