Zum Inhalt springen

Server-Monitoring, das Sie vor dem Ausfall warnt.

Die meisten Server stürzen nicht ab – ihnen geht etwas aus. Eine Bash-Zeile installiert den Agenten, 30 Sekunden später meldet er, und die Festplatte wird bei 90 % gerettet, nicht bei 100 %.

30-tägige kostenlose Testphase Keine Kreditkarte Linux · Installation in unter einer Minute
Meldeintervall
30s
Metriken pro Server
17
Offline markiert nach
90s
Metrik-Historie
1year

Von der sich füllenden Festplatte zur Warnung in 30 Sekunden

Logs stapeln sich über Nacht, und einem Ihrer Server geht der Speicherplatz aus. Noch ist nichts ausgefallen – ein kleiner Agent meldet alle 30 Sekunden, sodass die Warnung Server und Laufwerk nennt, solange noch Zeit ist, aufzuräumen.

02:14:03 /var überschreitet 90 % auf einem ServerDie 30-Sekunden-Meldung zeigt 92 % – Festplatten-Warnungen lösen sofort aus, ohne Zeitfenster der Server: noch erreichbar
02:14:03 Die Warnung nennt das Laufwerk„/var bei 92 %“ in der ersten Zeile – Slack, E-Mail; kein vager „Festplatte“-Alarm der Server: noch erreichbar
02:29 Alte Logs gelöscht – Speicher freiDie nächste Agent-Meldung, 30 Sekunden später, zeigt /var bei 62 % der Server: noch erreichbar
02:29:31 Automatisch behoben – Sie erfahren, dass es vorbei istEine „Wieder erreichbar“-Meldung geht an dieselben Kanäle, die Alarm geschlagen haben der Server: nie ausgefallen
15 minüberschritten → behoben
Der Absturz, der nie geschah.02:29:31
Ein volles /var legt den ganzen Server lahm – Datenbanken, Logs, Websites, alles. Dieser hier stoppte bei 92 %, weil die Warnung kam, solange noch Luft war.
genauer Mount + tatsächlicher Wertsofort, pro MountWieder-erreichbar-Meldung nach BehebungCPU · RAM · Load · Festplatte – alle 30 s
Und ohne den Agenten? Eine sich füllende Festplatte zeigt keine Symptome bis 100 % – dann fällt auf dem Server alles gleichzeitig aus. Aus dem Anstieg um 2 Uhr nachts wird eine Entdeckung um 7 Uhr morgens, mit fünf toten Stunden dazwischen. toter Server

17 Metriken, ein Bash-Agent

Ein Bash-Agent meldet 17 Metriken alle 30 Sekunden – bereits grafisch aufbereitet, sodass Sie den Zustand eines Servers ablesen können, ohne sich dafür extra anzumelden.

CPU & LoadAuslastung und Load-Average über 1·5·15 min
Arbeitsspeicher & SwapBelegt, frei – und ob gerade geswappt wird
Festplatte in % – pro MountJeder Mount, nicht nur /
Inode-BelegungVoll mit Mini-Dateien? Sie erfahren es
17 Metriken · 30 s direkt vom System gelesen · ohne Anmeldung
Prozesse & KerneAnzahl überwacht, Kerne bekannt
Netzwerk rein / rausDurchsatz, beide Richtungen
Host & AktualitätKernel, OS, Verfügbarkeit – und ein Live-Puls
Warnungen lösen bei anhaltenden Überschreitungen aus, nicht bei Aussetzern: CPU, Arbeitsspeicher, Load, Swap, Festplatte und Inodes pro Mount, Prozessanzahl, Netzwerk-Durchsatz – und das Lauteste von allem: der Server, der verstummt. Funkstille = Warnung

Warnungen und Historie

Keine Fehlalarme um 3 Uhr nachts

Alarmierung bei echten Problemen, nicht bei momentanen Spitzen

Uptimia löst eine CPU-, Arbeitsspeicher-, Swap-, Load-, Prozessanzahl- oder Netzwerk-Warnung erst aus, wenn jeder Messwert in Ihrem Fenster über der Linie bleibt – eine Zwei-Sekunden-Spitze vergeht in Stille, ein anhaltendes Problem nicht.

  • Sie entscheiden, wie lange ein Problem anhalten muss – von 1 Minute bis einer halben Stunde, pro Metrik einstellbar
  • Kein Konfigurationsaufwand zum Start – CPU, Arbeitsspeicher und Festplatte werden ab der ersten Meldung überwacht; die anderen schalten Sie dazu, wann Sie wollen
  • Festplatte und Inodes sind die Ausnahme – sie lösen sofort aus, wenn ein Mount die Schwelle überschreitet; eine volle Festplatte kann nicht warten
Wohin Ihre Warnungen zugestellt werden
CPU02:05:0030-Sekunden-Messwert94%
CPU02:07:3030-Sekunden-Messwert96%
CPU02:10:0030-Sekunden-Messwert93%
10/10Messwerte
über 90 %
CPU-Warnung – anhaltend02:10:01
Jeder Messwert lag 5 Minuten in Folge über 90 % – ein echtes Problem, kein Aussetzer, der sich von selbst erledigt hat.
SlackE-MailSMS+ PagerDuty…
Eine Zwei-Sekunden-Spitze? Ein einzelner heißer Messwert überlebt das Fenster nie – er vergeht in Stille. Nur Festplatte und Inodes lösen sofort aus. keine Warnung
Festplatte pro Mount

Wissen Sie sofort genau, welche Festplatte vollgelaufen ist

Uptimia grenzt Speicherplatz- und Inode-Warnungen auf den jeweiligen Mount ein, daher nennt der Vorfall /var – statt einer ganzen Maschine, die Sie durchsuchen müssten. Jeder Mount öffnet und behebt seinen eigenen Vorfall.

  • Ein Vorfall pro Mount – /, /var und /data werden jeweils separat verfolgt und behoben
  • Mount und Wert in der Warnung – „Speicherbelegung über 90 % auf /var“, bei 92 %
  • Abweichende Schwellenwerte pro Mount – einen stark beanspruchten Mount wie /var an einen strengeren Prozentsatz binden als den Rest
Wenn niemand eine Warnung bestätigt
Agentweb-01.caldmont.commeldet alle 30 s
/rooteigener Vorfallverlauf61%
Festplatten-Warnung – /var02:14:09
Speicherbelegung über 90 % auf /var – aktuell 92 %. Sofort, ohne Wartezeitfenster; ein eigener Vorfall, während /data grün bleibt.
pro MountsofortInodes inklusive
/dataDaten-Volumeeigener Vorfallverlauf38%
Ist /var stärker beansprucht als der Rest? Abweichende Schwellenwerte pro Mount halten einen Mount an eine strengere Linie als den serverweiten Standard. /var → 85%
Offline-Erkennung

Drei verpasste Meldungen öffnen einen Vorfall

Wenn ein Server komplett verstummt – Kernel-Panic, Strom, Netzwerk –, bemerkt eine separate minütliche Prüfung die fehlenden Meldungen und öffnet einen kritischen Vorfall. Ein toter Server kann sich nicht hinter seinem Schweigen verstecken.

  • Nach 3 verpassten Meldungen als offline markiert – 90 Sekunden Funkstille im 30-Sekunden-Takt
  • Behebt sich beim nächsten Check-in automatisch – schließt sich, sobald der Agent wieder da ist
  • Kein falsches „offline“ bei der Einrichtung – ein neuer Server, der auf seine erste Meldung wartet, wird nie markiert
Prüfungen von außen: Ping und TCP-Port
1
Meldung verpasst
02:40:30 · erwartet alle 30 s
warten
2
Weiterhin still
02:41:00 · zweites Mal verpasst
warten
3
Offline bestätigt
02:41:30 · ~90 s Funkstille
kritisch
Server offline02:41:30
web-03 ist komplett ausgefallen – Kernel-Panic, Strom oder Netzwerk. Der Vorfall behebt sich automatisch, sobald der Agent sich wieder meldet.
SlackE-MailSMS+ PagerDuty…
Agenten gerade installiert? Ein brandneuer Server, der auf seine erste Meldung wartet, wird nie als offline markiert. kein Fehlalarm
Historie & Trends

Ein Jahr Historie, Spitzen inklusive

Live-Zahlen sagen, was gerade nicht stimmt; Trends sagen, dass es seit Wochen langsam steigt. Uptimia hält beides vor – 6 Metrik-Karten und 5 Diagramme, die dieselben Daten lesen wie die Warnungen.

  • 6 Metrik-Karten + 5 Zeitreihen-Diagramme – CPU, Load, Arbeitsspeicher, Festplatte, Netzwerk – alle 30 Sekunden aktualisiert
  • Rohe 30-Sekunden-Daten für 24 Stunden – danach stündliche Durchschnitts- und Höchstwerte, sodass Spitzen erhalten bleiben, ein ganzes Jahr lang
  • Diagramme wählen die richtige Quelle – zoomen Sie auf die letzte Stunde oder das letzte Jahr, und die Daten wechseln automatisch
Lassen Sie sich diese Zahlen nach Zeitplan per E-Mail schicken
TRENDBelegter Arbeitsspeicher – web-01
letzte 30 Tage · Stundendaten · alle 30 s aktualisiert
30 d ago15 dnow
Langsamer Anstieg von 40 % auf 70 % über einen Monat – die Art von Problem, die ein Live-Snapshot nicht zeigt.
Roh · alle 30 Sekunden
jeder Messwert, 24 h aufbewahrt
02:10:00 → cpu 93% · mem 71%
Stündlicher Durchschnitt · 1 Jahr
die Trendlinie – glatt,
Monat für Monat vergleichbar
Stündliches Maximum · 1 Jahr
Spitzen überleben die Aggregation –
eine 2-Minuten-Spitze ist auch ein Jahr später noch sichtbar
Zoomen Sie beliebig – die letzte Stunde liest rohe 30-Sekunden-Daten, das letzte Jahr liest stündliche; die Diagramme wechseln die Quelle automatisch. automatisch

Meldet sich in unter einer Minute

Eine Zeile zum Installieren – keine Pakete, keine Laufzeitumgebung, und ein Skript entfernt jede Spur.

Schritt 130 s

Führen Sie eine Installationszeile als root aus

Der Einzeiler legt ein kleines Bash-Skript in /opt/uptimia ab und registriert einen systemd-Timer – oder cron, falls es kein systemd gibt.

$ curl -s uptimia.com/server-agent/install.sh | bash -s -- KEY
# ✓ systemd timer uptimia-agent.timer created
Schritt 230 s

Der Agent beginnt zu melden

Alle 30 Sekunden übermittelt er 17 Metriken – CPU, Arbeitsspeicher, Festplatte, Load und mehr – authentifiziert mit einem servereigenen Schlüssel.

Agent-Status
Verbunden – meldet alle 30 s
erste Meldung empfangen · 17 Metriken
Server
web-01 · Ubuntu 22.04 · 4 cores
Schritt 3automatisch

Schwellenwerte festlegen, Warnungen erhalten

CPU, Arbeitsspeicher und Festplatte starten bei 90 %. Eine überschrittene Schwelle öffnet einen Vorfall und warnt Ihr Team dort, wo es schon arbeitet.

#infra-alerts
Uptimia 02:14
⚠ Festplatte – /var bei 92 % auf web-01
über 90 %Vorfall pro Mount02:14:03
Zusätzlich gesendet an E-MailPagerDuty

Führen Sie eine Bash-Zeile aus.Wissen, bevor die Platte voll ist.

Jeder Server, jede Metrik, jeder Benachrichtigungskanal – 30 Tage kostenlos, und nichts davon ist ein kostenpflichtiges Add-on.

Kostenlose 30-Tage-Testphase starten
30 Tage kostenlos keine Kreditkarte jederzeit kündbar

Ebenfalls enthalten

Warnungen auf den Kanälen, die Sie schon nutzen

Server-Warnungen teilen sich eine Kontaktliste mit allen anderen Monitoren – E-Mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage und eigene Webhooks.

E-MailSlackTeamsPagerDutyTelegramWebhook+ mehr

Wartungsmodus

Patchen oder neu starten ohne Warnungsstau – die gesamte Alarmierung ist stummgeschaltet, während die Metriken weiterlaufen.

Neustart-Fenster · Warnungen stummgeschaltet

Wiederherstellungsbenachrichtigungen

Erfahren Sie, wann es vorbei ist, nicht nur, wann es begonnen hat – eine „Wieder erreichbar“-Meldung bei jeder Behebung.

✓ wiederhergestellt · Arbeitsspeicher zurück bei 58 %

Historie, die Downgrades überlebt

Bei einem Downgrade werden die Metriken eines Servers nicht gelöscht – nur die Alarmierung verstummt. Bei einem Upgrade reaktivieren sich pausierte Server von selbst.

Erfassung läuft weiter · Warnungen pausiert

Ein Dashboard für alles

Server stehen neben Ihren Verfügbarkeits-, SSL-, Heartbeat- und DNS-Monitoren – dieselben Kontakte, Gruppen und Rollen, ein Ort zum Nachschauen.

web-01.caldmont.comSERVER www.caldmont.comVERFÜGBARKEIT db-backup · nightlyHEARTBEAT

Deinstallation in einer Zeile

Ein Skript entfernt die systemd-Unit und /opt/uptimia vollständig – ohne Reste.

$ curl -fsS uptimia.com/server-agent/uninstall.sh | bash

Was ist Server-Monitoring?

Server-Monitoring ist die kontinuierliche Überwachung der Gesundheit eines Servers – CPU, Arbeitsspeicher, Festplatte, Load, Netzwerk und Prozesse –, sodass Sie gewarnt werden, sobald eine Ressource knapp wird oder die Maschine offline geht. Uptimias Linux-Server-Monitoring macht das mit einem kleinen Agenten, der alle 30 Sekunden 17 Metriken meldet und einen Vorfall auslöst, wenn eine Metrik Ihre Schwelle überschreitet.

Der Agent

Wie funktioniert der Agent?

Ihr Linux-Server
liest /proc · df
~17 Metriken · alle 30 s
Uptimia
Diagramme + Warnungen

Ein Bash-Skript auf einem systemd-Timer sendet eine kleine Meldung, authentifiziert mit einem servereigenen Schlüssel – nur bash und curl nötig.

Warnungslogik

Anhaltende gegenüber sofortigen Warnungen

CPU · Load · Arbeitsspeicher
ganzes Fenster über der Linie
dann Warnung
Festplatte · Inodes
sofortige Warnung

eine Spitze vergeht in Stille – nur eine anhaltende Überschreitung alarmiert Sie; ein voller Mount kann nicht warten, daher löst die Festplatte sofort aus

Die Vitalwerte

Welche Server-Metriken sollten Sie überwachen?

Die Signale, die echte Vorfälle ankündigen – und wie Uptimia jeden davon im Blick behält. CPU, Arbeitsspeicher und Festplatte werden ab der ersten Meldung überwacht; die anderen schalten Sie bei Bedarf dazu.

Alle Monitor-Typen in einem Konto
MetrikStandard-SchwellenwertWie Uptimia warnt
CPU-Auslastung90%anhaltend · 5-Minuten-Fenster
Arbeitsspeicher90%anhaltend · 5-Minuten-Fenster
Festplatte · pro Mount90%sofort, pro Mount
Load-Averagestandardmäßig ausanhaltend · Zeitfenster
Swapstandardmäßig ausanhaltend · Zeitfenster
Prozessanzahlstandardmäßig ausanhaltend · Zeitfenster
Netzwerk-Durchsatzstandardmäßig ausanhaltend · Zeitfenster
Server offline3 verpasste Meldungenkritisch · ~90 s

Server-Monitoring-FAQ

01Was ist Server-Monitoring?+
Die kontinuierliche Überwachung der Gesundheit eines Servers – CPU, Arbeitsspeicher, Festplatte, Load, Netzwerk und Prozesse –, sodass Sie gewarnt werden, wenn eine Ressource knapp wird oder die Maschine offline geht. Uptimias kleiner Agent meldet alle 30 Sekunden 17 Metriken und öffnet einen Vorfall, wenn eine Metrik Ihre Schwelle überschreitet.
02Wie funktioniert das Uptimia-Server-Monitoring?+
Eine einzeilige Installation platziert ein kleines Bash-Skript auf Ihrem Server und richtet einen systemd-Timer (oder Cron) ein. Alle 30 Sekunden liest es /proc und df aus und sendet 17 Metriken – CPU, Arbeitsspeicher, Swap, Festplatte pro Mount, Inodes, Load, Netzwerk, Prozessanzahl und OS-Infos – authentifiziert mit einem serverspezifischen Schlüssel. Sie erhalten 6 Metrik-Karten, 5 Zeitreihen-Diagramme und Schwellenwert-Warnungen – Server-Monitoring und Warnungen aus einem schlanken Agenten.
03Welche Betriebssysteme werden unterstützt?+
Der einzeilige Installationsbefehl ist für Linux gedacht – der Agent liest /proc und df und läuft daher auf Standard-Distributionen (Ubuntu, Debian, RHEL, Alma und so weiter). Auch für macOS und Windows PowerShell gibt es Agenten, die dieselben Metriken melden, aber von Hand eingerichtet werden (launchd unter macOS, eine geplante Aufgabe unter Windows) statt über den Einzeiler. Einen BSD-Agenten gibt es nicht – für diese Hosts nutzen Sie Uptimias Prüfungen von außen (Ping, TCP-Port, HTTP).
04Kann ich ändern, wie oft der Agent meldet?+
Nein – der 30-Sekunden-Takt ist fest. Steuern können Sie die Warnungen: den Schwellenwert jeder Metrik und wie lange ein Problem anhalten muss, bevor jemand gewarnt wird.
05Warnt mich eine kurze CPU-Spitze um 3 Uhr nachts?+
Nein. CPU-, Arbeitsspeicher-, Swap-, Load-, Prozessanzahl- und Netzwerk-Warnungen lösen erst aus, wenn jeder Messwert in Ihrem Fenster (Standard: 5 Minuten) über der Schwelle bleibt – eine momentane Spitze vergeht in Stille. Die Ausnahmen sind Festplatte und Inodes, die sofort auslösen: Eine volle Festplatte kann nicht auf ein Fenster warten.
06Wie schnell erfahre ich, wenn ein Server ausfällt?+
Wenn ein Server vollständig aufhört zu melden, markiert ihn eine minütliche Prüfung nach 3 verpassten Meldungen als offline – 90 Sekunden Funkstille – und öffnet einen kritischen Vorfall, der sich automatisch behebt, sobald sich der Agent zurückmeldet. Drei verpasste Meldungen bestätigen, dass er wirklich weg ist; ein neuer Server, der auf seine erste Meldung wartet, wird nie fälschlich markiert.
07Liest der Agent meine Logs oder führt Befehle aus?+
Nein. Es ist reines Server-Ressourcen-Monitoring – die Payload ist CPU, Arbeitsspeicher, Festplatte, Netzwerk, Load, Betriebszeit, Prozessanzahl und grundlegende OS-/Kernel-/Hostname-Infos. Keine Logs, keine Dateiinhalte, keine entfernten Befehle – nur eine einseitige Zahlenmeldung.
08Wie viel Historie behalte ich?+
Rohe 30-Sekunden-Messwerte werden 24 Stunden aufbewahrt. Darüber hinaus speichert Uptimia stündliche Durchschnitts- und Höchstwerte – Spitzen überleben im Maximum – ein ganzes Jahr lang. Diagramme wechseln die Quelle automatisch je nach Zeitraum.
09Kann ich Docker- oder Kubernetes-Container überwachen?+
Der Agent meldet Metriken auf Host-Ebene – das /proc und df der ganzen Maschine, keine Statistiken pro Container. Richtig für die Server, auf denen Ihre Container laufen; eine Erfassung pro Container gibt es derzeit nicht.
10Ist Server-Monitoring ein kostenpflichtiges Add-on?+
Nein. Jeder kostenpflichtige Tarif enthält Server-Monitoring neben Verfügbarkeits-, SSL-, Web-Transaktions-, DNS- und Heartbeat-Monitoring – nie als kostenpflichtiges Add-on. Die Tarife unterscheiden sich nur in der Anzahl der enthaltenen Server. Der kostenlose Tarif enthält keine Server-Monitore; die 30-tägige kostenlose Testphase schon (bis zu 50 Server), keine Kreditkarte erforderlich.

Überwachen Sie ab heute Ihre Server.

Ein Bash-Befehl genügt, und eine volllaufende Festplatte, heiße CPU oder ein ausgefallener Server erreicht Sie, solange noch Zeit bleibt.

30-tägige kostenlose Testphase Keine Kreditkarte Bash + curl · Deinstallation in einer Zeile
Server-Monitoring ist in der 30-tägigen Testphase und in jedem kostenpflichtigen Tarif verfügbar, neben jedem anderen Monitor-Typ.