Verfügbarkeitsüberwachung für SaaS – Sie wissen es, bevor das erste Ticket kommt.
Uptimia prüft Ihre öffentliche API, Ihren Login-Ablauf und den nächtlichen Abrechnungsjob einzeln, statt von einer Startseite zu raten, die noch lädt. Ein Ausfall wird erst aus mehr als einer Region bestätigt, bevor die Rufbereitschaft alarmiert wird – in Slack, PagerDuty oder wo immer Ihr Team hinschaut.
Step breakdown
All 2 steps passedFailed at step 2244 ms · 02:13236 ms · 02:147-day averagesLast runAssertions — step 2
3 of 3 passing0 of 3 passedResponse — step 2
200 · 96 ms502 · 84 msRecent Runs
every minute · rotating locations
New York✗ Failed at step 20.24 s
Frankfurt✗ Failed at step 20.24 s
London✓ All 2 steps passed0.25 s
Sydney✓ All 2 steps passed0.26 s
Amsterdam✓ All 2 steps passed0.23 s
New York✓ All 2 steps passed0.24 s
Tokyo✓ All 2 steps passed0.25 sVier Annahmen, die SaaS-Kunden kosten
Jede klingt vernünftig – und jede lässt einen Ausfall weiterlaufen, bis ein Kunde ihn findet.
„Wenn etwas kaputtgeht, sagen es uns die Kunden schon.“
Wer sich meldet, gehört zu den Treuen. Ein Interessent, der auf eine kaputte Registrierung stößt, schließt den Tab und wird nie Kunde – es gibt niemanden, der sich beschwert, und nichts in Ihrem Posteingang, dem man nachgehen könnte.
„Wir sind bei AWS – Verfügbarkeit ist deren Job.“
Deren SLA deckt deren Infrastruktur ab, nicht Ihr Produkt. Ein fehlerhaftes Deployment, ein abgelaufenes Zertifikat, ein festhängender Queue-Worker – das alles ist Ihres, und die Statusseite des Anbieters bleibt bei jedem davon grün.
„Die App lädt, also sind wir online.“
Ein SaaS ist ein Bündel von Funktionen, nicht eine Seite. Das Dashboard kann laden, während die öffentliche API nicht mehr antwortet, der Login fehlschlägt oder der Abrechnungsjob eine Nacht still aussetzt – jedes bricht für sich, und „online“ verbirgt alles davon.
„Vorfälle öffentlich einzuräumen, lässt uns schlecht dastehen.“
Schweigen sieht schlechter aus. Ein Kunde, der einen Statushinweis findet, schreibt kein Ticket – und merkt sich, dass Sie es ihm gesagt haben, bevor er fragte. Ein Kunde, der nichts findet, nimmt an, dass Sie es auch nicht wissen.
„Drei Neunen sind im Grunde perfekt“ ist die größte davon. 99,9 % Verfügbarkeit erlauben 43 Minuten Ausfall pro Monat. Auf einer Broschürensite ist das ein Rundungsfehler – aber Kunden arbeiten in einem SaaS. 43 Minuten mal 500 Kunden: 21.500 Kundenminuten, 358 Stunden pro Monat, in denen jemand Ihr Produkt kaputt vorfindet.
Verlängerungen entscheiden sich nicht an Ihrer Verfügbarkeitsrate. Sie entscheiden sich daran, wer zuerst davon erfuhr und wie schnell es behoben war.
So sieht dieser Ausfall aus, wenn eine Kette den Endpunkt im Blick hat.↓ Minute für Minute
Ein API-Ausfall, von Anfang bis Ende
Der Konto-Endpunkt hörte auf zu funktionieren. Das Dashboard lud weiter, der Startseiten-Ping blieb grün, und jede Integration, die diesen Endpunkt aufruft, fiel bereits aus.
Damit ist die API abgedeckt. Aber ein SaaS bricht auf vier Ebenen – App, API, Abläufe, Jobs – und jede bricht für sich.↓ jede Ebene
Jede Ebene Ihres Produkts, im Blick
Prüfungen rufen Ihre API und Ihre Seiten auf, ein echter Browser spielt Login und Registrierung nach, Ihre Jobs pingen ein, und ein Snippet meldet, was echte Nutzer erlebten – alles läuft in einem Dashboard zusammen, auf einer Kontaktliste.
Gebaut dafür, wie SaaS bricht
Die API, die Ihre Kunden aufrufen
Eine Startseite, die lädt, sagt nichts darüber aus, ob der Endpunkt antwortet, den ihre Integrationen aufrufen – heute erfahren Sie es also von einem Kunden. Uptimia führt stattdessen eine echte Anfragekette gegen Ihre öffentliche API aus, so oft wie jede Minute: anmelden, den Token holen, den geschützten Endpunkt aufrufen, die Antwort lesen.
- Ketten mit bis zu 15 Schritten – jeder Schritt prüft die erhaltene Antwort und reicht weiter, was der nächste braucht
- Meldet sich zuerst an – es loggt sich ein und ruft dann die Endpunkte auf, die nur ein angemeldeter Kunde erreicht
- Bestätigt, nicht zufällig – ein fehlgeschlagener Schritt wird von bis zu drei Standorten nachgeprüft, bevor ein Vorfall geöffnet wird
Login und Registrierung – getestet, bevor es ein Kunde tut
Nach einem Deployment sollte die erste Person, die sich anzumelden versucht, ein Roboter sein. Uptimia spielt Login und Registrierung in einem echten Browser von 13 Standorten nach, so oft wie alle 10 Minuten, und öffnet einen Vorfall, sobald ein Schritt fehlschlägt – mit einem Screenshot der Seite im Moment des Fehlschlags.
- Ein echter Browser – Seite aufrufen, Felder ausfüllen, klicken, prüfen, was erscheint
- Screenshot bei Fehlschlag – der Wasserfall zeigt den Schritt, der fehlschlug, und wie die Seite aussah
- Schrittzeiten – Dauern pro Schritt, damit ein verlangsamter Ablauf auffällt, bevor er fehlschlägt
Der Abrechnungsjob, der nie lief
Ein Cron, der abstürzt, meldet es nicht – von außen sieht nichts „down“ aus, während Rechnungen still nicht rausgehen. Heartbeats drehen das um: Ihr Job pingt Uptimia, wenn er fertig ist, und ein fehlender Ping ist der Vorfall.
- Eine Ping-URL – eine Zeile am Ende eines Cron-, Worker- oder Backup-Skripts
- Sie legen fest, wann er fällig ist – ein Zeitplan und ein Toleranzfenster; ein Ping, der nie ankommt, öffnet den Vorfall
- Auch Start- & Fehlschlag-Signale – erfasst einen Job, der startete, aber nie fertig wurde, oder seinen eigenen Fehlschlag meldete
Eine Statusseite auf eigener Domain
Bevor ein Kunde ein Ticket eröffnet, sucht er nach einem Zeichen, dass Sie das Problem schon kennen. Richten Sie eine Statusseite auf Ihrer eigenen Domain ein – mit Ihrem Logo, ohne Uptimia-Badge – mit Live-Zustand, 90 Tagen Verlauf und jedem Vorfallshinweis; Abonnenten werden bei jedem Update per E-Mail benachrichtigt.
- Eigene Domain, automatisches SSL –
status.yourapp.comüber HTTPS, der „Powered by Uptimia“-Badge entfernbar - Bereiche & Abonnenten – Monitore nach Bereich gruppieren, Vorfall- und Wartungs-Updates posten, Abonnenten benachrichtigen
- Öffentlich oder privat – offen für Ihre Kunden oder passwortgeschützt
Ein Vorfall, Ihr Team und Ihre Statusseite
Derselbe bestätigte Vorfall alarmiert die Rufbereitschaft und aktualisiert die Seite, die Ihre Kunden ohnehin schon neu laden.
12 Benachrichtigungskanäle, eine Kontaktliste – und die Statusseite, die Ihre Kunden im Blick haben, aktualisiert aus demselben Vorfall.
Komplettes Integrationsverzeichnis durchsehen →Ein Ausfall sollte Sie alarmieren.Nicht Ihre Kunden.
Die 30-tägige Testphase schaltet jeden Monitor-Typ frei – API-Ketten, Login-Abläufe, Heartbeats und Verfügbarkeitsprüfungen.
SaaS-Überwachung in drei Schritten einrichten
Die kritischen Pfade Ihres Produkts können heute Nachmittag überwacht werden.
Prüfungen auf Ihr Produkt richten
Fügen Sie eine Verfügbarkeitsprüfung für die App hinzu, eine Anfragekette gegen Ihre öffentliche API und eine Login-Wiederholung in einem echten Browser.
Heartbeats in Ihre Jobs einbauen
Hängen Sie die Ping-URL ans Ende jedes Crons, Workers oder Backups – ein fehlender Ping wird zum Vorfall.
curl -fsS uptimia.com/p/hb_9f3c…
Warnungen routen & Status veröffentlichen
Senden Sie Warnungen an Slack und PagerDuty, wählen Sie, wer als Nächstes alarmiert wird, wenn niemand quittiert, und stellen Sie Verfügbarkeit und Abläufe auf eine Statusseite.
Ebenfalls enthalten
Sehen Sie, was echte Nutzer spüren
Ein passives JavaScript-Snippet meldet die Ladezeiten echter Besucher nach Gerät, Browser und Standort.
Automatisieren über die API
Erstellen Sie Monitore und Statusseiten aus Ihren eigenen Tools – Prüfungen in einem Deploy-Skript anlegen.
Wartungsfenster
Steht ein Release an? Planen Sie das Wartungsfenster – Prüfungen pausieren, Warnungen bleiben still, die Statusseite zeigt die geplante Arbeit.
Ein Vorfall, eine Warnung
Ein Alarmsturm wird zu einer einzigen Zusammenfassung statt zu hundert Alarmen – mit signiertem Link zum Quittieren und erfasster MTTA.
Wiederherstellungsbenachrichtigungen
Wenn die API wieder erreichbar ist, bekommen die alarmierten Ingenieure auch die Entwarnung.
Kostenlose Tools für die Fehlersuche danach
Verfolgen Sie eine Weiterleitung Header für Header mit dem HTTP Status Checker, oder sehen Sie mit dem Uptime Calculator, was jede „Neun“ erlaubt.
Was ist Verfügbarkeitsüberwachung für SaaS?
Verfügbarkeitsüberwachung für SaaS heißt, die Teile eines Produkts im Blick zu halten, von denen Kunden abhängen – die öffentliche API, Login- und Registrierungsabläufe und die Hintergrundjobs dahinter – damit Ihr Team alarmiert wird, sobald eines davon bricht. Ein Startseiten-Ping bleibt grün, während Ihre API nicht mehr antwortet, der Login fehlschlägt oder ein nächtlicher Job stoppt.
Grün, während Kunden feststecken
Ihre Prüfung ist grün, während genau das down ist, wofür Kunden zahlen – Sie erfahren es aus einem Ticket.
Sie sehen jede Ebene
API-, Ablauf- und Job-Prüfungen speisen eine Pipeline – der Ausfall erreicht einen Ingenieur, nicht einen Kunden.
Wie viel Ausfallzeit jede „Neun“ erlaubt
„99,9 % Verfügbarkeit“ klingt wasserdicht, bis man es in Minuten umrechnet – so viel erlaubt jede Stufe.
Verfügbarkeitsrechner öffnen →| Verfügbarkeit | Ausfallzeit / Monat | Ausfallzeit / Jahr |
|---|---|---|
| 99% | 7h 18m | 3d 15h |
| 99.9% | 43m 49s | 8h 46m |
| 99.95% | 21m 54s | 4h 23m |
| 99.99% | 4m 23s | 52m 35s |
| 99.999% | 26s | 5m 15s |
FAQ zur SaaS-Überwachung
01Was ist Verfügbarkeitsüberwachung für SaaS?+
02Was unterscheidet das von einem einfachen Ping meiner Startseite?+
03Kann ich meine öffentliche API überwachen?+
{{variable}}-Templating zwischen den Schritten. Sie läuft in jedem Tarif bis zu einmal pro Minute, und ein fehlgeschlagener Schritt wird von bis zu drei Standorten erneut ausgeführt, bevor ein Vorfall ausgelöst wird. Eine Kette ist die aufwendigste Prüfung, daher haben API-Monitore ein eigenes Kontingent pro Tarif – die Preise nennen die Zahlen.04Erkennt sie einen kaputten Login oder eine kaputte Registrierung?+
05Bekomme ich eine Warnung, wenn ein Hintergrundjob stoppt?+
06Wie oft wird geprüft?+
07Kann ich meinen Kunden eine Statusseite geben?+
08Kann ich ein Teammitglied auf nur bestimmte Monitore beschränken?+
09Unterstützen Sie SSO, und kann ich SLA-Berichte bekommen?+
10Welche Benachrichtigungskanäle kann mein Team nutzen?+
11Muss ich etwas in meiner App installieren?+
curl-Aufruf an die Ping-URL); Real User Monitoring ist ein kleines JavaScript-Snippet. Ein Agent ist nur nötig, wenn Sie zusätzlich Server-Metriken wollen.Ihre API, Abläufe und Jobs, im Blick
Stellen Sie Ihre API, Ihren Login-Ablauf und Ihre Hintergrundjobs heute Nachmittag unter Überwachung – und hören Sie auf, von Ihren Kunden von Ausfällen zu erfahren.