Aller au contenu

La surveillance de serveur qui vous avertit avant la panne.

La plupart des serveurs ne plantent pas — ils manquent de quelque chose. Une ligne bash installe l'agent, 30 secondes plus tard il envoie ses relevés, et le disque est corrigé à 90 %, pas à 100 %.

Essai gratuit de 30 jours Sans carte bancaire Linux · installation en moins d'une minute
Intervalle de relevé
30s
Métriques par serveur
17
Signalé hors ligne en
90s
Historique des métriques
1year

D'un disque qui se remplit à une alerte en 30 secondes

Les journaux s'accumulent pendant la nuit et l'un de vos serveurs commence à manquer d'espace disque. Rien n'est encore en panne — un petit agent envoie un relevé toutes les 30 secondes, si bien que l'alerte nomme le serveur et le disque pendant qu'il reste encore du temps pour le libérer.

02:14:03 /var franchit 90 % sur un serveurLe relevé de 30 secondes affiche 92 % — les alertes disque sont instantanées, sans fenêtre d'attente la machine : toujours accessible
02:14:03 L'alerte nomme le disque« /var à 92 % » dès la première ligne — Slack, e-mail ; pas une vague alerte « disque » la machine : toujours accessible
02:29 Anciens journaux nettoyés — espace libéréLe relevé suivant de l'agent, 30 secondes plus tard, affiche /var à 62 % la machine : toujours accessible
02:29:31 Résolu automatiquement — vous êtes avertiUn avis de rétablissement part vers les mêmes canaux qui ont déclenché l'alerte la machine : jamais tombée
15 minfranchissement → résolution
La panne qui n'a jamais eu lieu.02:29:31
Un /var plein met toute la machine à terre — bases de données, journaux, sites, tout. Celui-ci a plafonné à 92 %, parce que l'alerte est arrivée pendant qu'il restait encore de la marge.
point de montage exact + valeur réelleinstantané, par point de montageavis de rétablissement à la repriseCPU · RAM · charge · disque — toutes les 30 s
Et sans l'agent ? Un disque qui se remplit ne présente aucun symptôme jusqu'à 100 % — puis tout tombe en panne d'un coup sur la machine. La montée de 2 h du matin devient une découverte à 7 h, avec cinq heures mortes entre les deux. machine morte

17 métriques, un agent bash

Un agent bash relève 17 métriques toutes les 30 secondes — déjà mises en graphique, pour lire l'état d'un serveur sans avoir à vous y connecter.

CPU & chargeUtilisation et moyenne de charge sur 1·5·15 min
Mémoire & swapUtilisée, libre — et en cours d'échange
Disque en % — par point de montageChaque point de montage, pas seulement /
Utilisation des inodesPlein de petits fichiers ? Vous le saurez
17 métriques · 30 s lues directement sur le système · sans connexion
Processus & cœursNombre surveillé, cœurs connus
Réseau entrant / sortantDébit, dans les deux sens
Hôte & fraîcheurNoyau, OS, disponibilité — et une pulsation en direct
Les alertes se déclenchent sur des dépassements soutenus, pas des pics passagers : CPU, mémoire, charge, swap, disque et inodes par point de montage, nombre de processus, débit réseau — et la plus bruyante de toutes : le serveur qui devient silencieux. silence = alerte

Alertes et historique

Pas de fausses alertes à 3 h du matin

Alerté pour de vrais problèmes, pas pour des pics momentanés

Uptimia ne déclenche une alerte CPU, mémoire, swap, charge, nombre de processus ou réseau que lorsque chaque relevé de votre fenêtre reste au-dessus du seuil — un pic de deux secondes passe en silence, un problème soutenu, non.

  • Vous décidez de la durée qu'un problème doit tenir — de 1 minute à une demi-heure, réglable par métrique
  • Rien à configurer pour démarrer — CPU, mémoire et disque sont surveillés dès le premier relevé ; ajoutez les autres quand vous le souhaitez
  • Disque et inodes font exception — ils se déclenchent dès qu'un point de montage franchit le seuil ; un disque plein ne peut pas attendre
Où vos alertes sont livrées
CPU02:05:00échantillon de 30 secondes94%
CPU02:07:30échantillon de 30 secondes96%
CPU02:10:00échantillon de 30 secondes93%
10/10échantillons
au-dessus de 90 %
Alerte CPU — soutenue02:10:01
Chaque relevé pendant 5 minutes d'affilée est resté au-dessus de 90 % — un vrai problème, pas un pic qui s'est résolu de lui-même.
SlackE-mailSMS+ PagerDuty…
Un pic de deux secondes ? Un seul relevé chaud ne survit jamais à la fenêtre — il passe en silence. Seuls le disque et les inodes se déclenchent instantanément. pas d'alerte
Disque par point de montage

Sachez exactement quel disque s'est rempli, instantanément

Uptimia limite les alertes d'espace disque et d'inodes à chaque point de montage, si bien que l'incident dit /var — et non toute une machine à fouiller. Chaque point de montage ouvre et résout son propre incident.

  • Un incident par point de montage — /, /var, /data chacun suivi et résolu séparément
  • Le point de montage et la valeur dans l'alerte — « Utilisation disque au-dessus de 90 % sur /var », à 92 %
  • Seuils personnalisés par point de montage — tenez un point de montage très sollicité comme /var à un pourcentage plus strict que le reste
Si personne n'acquitte une alerte
agentweb-01.caldmont.comrelevé toutes les 30 s
/rootsuivi d'incident propre61%
Alerte disque — /var02:14:09
Utilisation disque au-dessus de 90 % sur /var — à 92 %. Immédiat, sans délai : un incident à part, /data restant au vert.
par point de montageinstantanéinodes aussi
/datavolume de donnéessuivi d'incident propre38%
/var plus sollicité que le reste ? Les seuils personnalisés par point de montage tiennent un point de montage à une ligne plus stricte que la valeur par défaut de la machine. /var → 85%
Détection hors ligne

Trois relevés manqués ouvrent un incident

Si un serveur devient complètement silencieux — panique du noyau, coupure d'alimentation, réseau — une vérification distincte par minute remarque les relevés manquants et ouvre un incident critique. Une machine morte ne peut pas se cacher derrière « pas de nouvelles, bonnes nouvelles ».

  • Signalé hors ligne après 3 relevés manqués — 90 secondes de silence au rythme de 30 secondes
  • Se résout automatiquement à la prochaine connexion — se clôt dès que l'agent est de retour
  • Pas de faux « hors ligne » lors de la configuration — un nouveau serveur en attente de son premier relevé n'est jamais signalé
Vérifications de l'extérieur : ping et port TCP
1
Relevé manqué
02:40:30 · attendu toutes les 30 s
attente
2
Toujours silencieux
02:41:00 · deuxième manqué
attente
3
Hors ligne confirmé
02:41:30 · ~90 s de silence
critique
Serveur hors ligne02:41:30
web-03 s'est complètement éteint — panique du noyau, coupure d'alimentation ou réseau. L'incident se résout automatiquement dès que l'agent envoie de nouveau un relevé.
SlackE-mailSMS+ PagerDuty…
Agent tout juste installé ? Un serveur flambant neuf en attente de son premier relevé n'est jamais signalé hors ligne. pas de fausse alerte
Historique & tendances

Un an d'historique, pics inclus

Les chiffres en direct disent ce qui ne va pas maintenant ; les tendances disent que ça grimpe lentement depuis des semaines. Uptimia conserve les deux — 6 cartes de métriques et 5 graphiques, lisant les mêmes données que les alertes.

  • 6 cartes de métriques + 5 graphiques temporels — CPU, charge, mémoire, disque, réseau — actualisés toutes les 30 secondes
  • Détail brut sur 30 secondes pendant 24 heures — puis moyennes et maximums horaires, pour que les pics survivent, pendant un an entier
  • Les graphiques choisissent la bonne source — zoomez sur la dernière heure ou la dernière année et les données changent automatiquement
Recevez ces chiffres par e-mail selon un horaire
TENDANCEMémoire utilisée — web-01
30 derniers jours · données horaires · actualisées toutes les 30 s
30 d ago15 dnow
Montée lente de 40 % à 70 % sur un mois — le genre de problème qu'un instantané en direct ne peut pas montrer.
Brut · toutes les 30 secondes
chaque échantillon, conservé 24 h
02:10:00 → cpu 93% · mem 71%
Moyenne horaire · 1 an
la ligne de tendance — lisse,
comparable mois après mois
Maximum horaire · 1 an
les pics survivent à l'agrégation —
un pic de 2 minutes reste visible un an plus tard
Zoomez où vous voulez — la dernière heure lit les données brutes de 30 secondes, la dernière année lit les données horaires ; les graphiques changent de source automatiquement. automatique

Des relevés en moins d'une minute

Une ligne à installer — aucun paquet, aucun environnement d'exécution, et un script efface toute trace.

Étape 130 s

Exécutez une ligne d'installation en tant que root

La ligne unique dépose un petit script bash dans /opt/uptimia et enregistre un minuteur systemd — ou cron, en l'absence de systemd.

$ curl -s uptimia.com/server-agent/install.sh | bash -s -- KEY
# ✓ systemd timer uptimia-agent.timer created
Étape 230 s

L'agent commence à envoyer ses relevés

Toutes les 30 secondes, il transmet 17 métriques — CPU, mémoire, disque, charge et plus — authentifiées par une clé propre au serveur.

Statut de l'agent
Connecté — relevé toutes les 30 s
premier relevé reçu · 17 métriques
Serveur
web-01 · Ubuntu 22.04 · 4 cores
Étape 3automatique

Fixez des seuils, soyez alerté

CPU, mémoire et disque sont réglés à 90 % par défaut. Un seuil franchi ouvre un incident et alerte votre équipe là où elle travaille déjà.

#infra-alerts
Uptimia 02:14
⚠ Disque — /var à 92 % sur web-01
au-dessus de 90 %incident par point de montage02:14:03
Envoyé également à E-mailPagerDuty

Exécutez une ligne bash.Sachez-le avant que le disque ne soit plein.

Chaque serveur, chaque métrique, chaque canal d'alerte — gratuit pendant 30 jours, sans aucune option payante.

Démarrez votre essai gratuit de 30 jours
30 jours gratuits sans carte bancaire résiliable à tout moment

Également inclus

Alertes sur les canaux que vous utilisez déjà

Les alertes serveur partagent une seule liste de contacts avec toutes les autres sondes — e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage et webhooks personnalisés.

E-mailSlackTeamsPagerDutyTelegramWebhook+ plus

Mode maintenance

Corrigez ou redémarrez sans accumuler d'alertes — toute l'alerte est mise en sourdine pendant que les métriques continuent d'affluer.

fenêtre de redémarrage · alertes en sourdine

Avis de rétablissement

Sachez quand c'est fini, pas seulement quand ça a commencé — un avis « résolu » à chaque résolution.

✓ résolu · mémoire revenue à 58 %

Un historique qui survit à un déclassement

Rétrogradez un forfait et les métriques d'un serveur ne sont pas supprimées — seule l'alerte se tait. Passez en supérieur et les serveurs suspendus se réactivent d'eux-mêmes.

ingestion continue · alertes en pause

Un tableau de bord pour tout

Les serveurs se retrouvent aux côtés de vos sondes de disponibilité, SSL, signal de présence et DNS — mêmes contacts, groupes et rôles, un seul endroit où regarder.

web-01.caldmont.comSERVEUR www.caldmont.comDISPONIBILITÉ db-backup · nightlySIGNAL DE PRÉSENCE

Désinstallation en une ligne

Un script supprime intégralement l'unité systemd et /opt/uptimia — sans laisser de trace.

$ curl -fsS uptimia.com/server-agent/uninstall.sh | bash

Qu'est-ce que la surveillance de serveur ?

La surveillance de serveur est le suivi continu de l'état d'un serveur — CPU, mémoire, disque, charge, réseau et processus — pour que vous soyez alerté dès qu'une ressource vient à manquer ou que la machine passe hors ligne. La surveillance de serveurs Linux d'Uptimia le fait avec un petit agent qui relève 17 métriques toutes les 30 secondes et déclenche un incident quand une métrique franchit votre seuil.

L'agent

Comment fonctionne l'agent ?

Votre serveur Linux
lit /proc · df
~17 métriques · toutes les 30 s
Uptimia
graphiques + alertes

Un script bash sur un minuteur systemd envoie un petit relevé, authentifié par une clé propre au serveur — seuls bash et curl sont nécessaires.

Logique d'alerte

Alertes soutenues ou instantanées

CPU · charge · mémoire
toute la fenêtre au-dessus du seuil
puis alerte
Disque · inodes
alerte instantanée

un pic passe en silence — seul un dépassement soutenu vous alerte ; un point de montage plein ne peut pas attendre, le disque se déclenche donc instantanément

Les vitaux

Quelles métriques de serveur devriez-vous surveiller ?

Les signaux qui annoncent de vrais incidents — et comment Uptimia surveille chacun d'eux. CPU, mémoire et disque sont surveillés dès le premier relevé ; les autres sont à activer vous-même.

Tous les types de sondes dans un seul compte
MétriqueSeuil par défautComment Uptimia alerte
Utilisation CPU90%soutenu · fenêtre de 5 min
Mémoire90%soutenu · fenêtre de 5 min
Disque · par point de montage90%instantané, par point de montage
Moyenne de chargedésactivé par défautsoutenu · fenêtre
Swapdésactivé par défautsoutenu · fenêtre
Nombre de processusdésactivé par défautsoutenu · fenêtre
Débit réseaudésactivé par défautsoutenu · fenêtre
Serveur hors ligne3 relevés manquéscritique · ~90 s

FAQ sur la surveillance de serveur

01Qu'est-ce que la surveillance de serveur ?+
Le suivi continu de l'état d'un serveur — CPU, mémoire, disque, charge, réseau et processus — pour que vous soyez alerté quand une ressource vient à manquer ou que la machine passe hors ligne. Le petit agent d'Uptimia relève 17 métriques toutes les 30 secondes et ouvre un incident quand une métrique franchit votre seuil.
02Comment fonctionne la surveillance de serveur Uptimia ?+
Une installation en une seule ligne place un petit script bash sur votre serveur et enregistre un timer systemd (ou une tâche cron). Toutes les 30 secondes, il lit /proc et df et envoie 17 métriques — CPU, mémoire, swap, disque par point de montage, inodes, charge, réseau, nombre de processus et infos OS — authentifiées par une clé propre à chaque serveur. Vous obtenez 6 cartes de métriques, 5 graphiques temporels et des alertes à seuil : toute la surveillance et l'alerte serveur en un seul petit agent.
03Quels systèmes d'exploitation sont pris en charge ?+
L'installateur en une ligne cible Linux — l'agent lit /proc et df, il tourne donc sur les distributions standards (Ubuntu, Debian, RHEL, Alma, etc.). Des agents macOS et PowerShell Windows existent aussi et relèvent les mêmes métriques, à configurer à la main (launchd sur macOS, une tâche planifiée sur Windows) plutôt que via la ligne unique. Il n'existe pas d'agent BSD — pour ces hôtes, utilisez les vérifications externes d'Uptimia (ping, port TCP, HTTP).
04Puis-je changer la fréquence des relevés de l'agent ?+
Non — le rythme de 30 secondes est fixe. Ce que vous contrôlez, c'est l'alerte : le seuil de chaque métrique, et combien de temps un problème doit tenir avant d'alerter quiconque.
05Un bref pic de CPU va-t-il m'alerter à 3 h du matin ?+
Non. Les alertes CPU, mémoire, swap, charge, nombre de processus et réseau ne se déclenchent que lorsque chaque relevé de votre fenêtre (5 minutes par défaut) reste au-dessus du seuil — un pic momentané passe en silence. Les exceptions sont le disque et les inodes, qui se déclenchent instantanément : un disque plein ne peut pas attendre une fenêtre.
06À quelle vitesse saurai-je si un serveur tombe en panne ?+
Si un serveur cesse complètement d'envoyer des relevés, une vérification par minute le signale hors ligne après 3 relevés manqués — 90 secondes de silence — et ouvre un incident critique qui se résout automatiquement dès que l'agent se reconnecte. Trois relevés manqués confirment qu'il a vraiment disparu ; un nouveau serveur en attente de son premier relevé n'est jamais faussement signalé.
07L'agent lit-il mes journaux ou exécute-t-il des commandes ?+
Non. C'est uniquement de la surveillance des ressources serveur — la charge utile est CPU, mémoire, disque, réseau, charge, disponibilité, nombre de processus et infos OS/noyau/nom d'hôte de base. Aucun journal, aucun contenu de fichier, aucune commande à distance — un relevé de chiffres à sens unique.
08Combien d'historique est-il conservé ?+
Les échantillons bruts de 30 secondes sont conservés 24 heures. Au-delà, Uptimia stocke des moyennes et maximums horaires — les pics survivent dans le maximum — pendant un an entier. Les graphiques changent de source automatiquement selon la période.
09Puis-je surveiller des conteneurs Docker ou Kubernetes ?+
L'agent relève des métriques au niveau de l'hôte — le /proc et le df de la machine entière, pas de statistiques par conteneur. Adapté aux serveurs sur lesquels tournent vos conteneurs ; pas de collecte par conteneur aujourd'hui.
10La surveillance de serveur est-elle un module payant ?+
Non. Chaque forfait payant inclut la surveillance de serveur aux côtés de la disponibilité, du SSL, des transactions, du DNS et du signal de présence — jamais en module payant. Les forfaits ne diffèrent que par le nombre de serveurs inclus. Le forfait gratuit n'inclut pas de sondes serveur ; l'essai gratuit de 30 jours, si (jusqu'à 50 serveurs), sans carte bancaire.

Commencez à surveiller vos serveurs dès aujourd'hui.

Exécutez une ligne bash, et un disque qui se remplit, un CPU en surchauffe ou une machine éteinte vous atteignent pendant qu'il reste encore de la marge.

Essai gratuit de 30 jours Sans carte bancaire Bash + curl · désinstallation en une ligne
La surveillance de serveur est disponible pendant l'essai de 30 jours et dans chaque forfait payant, aux côtés de chaque autre type de sonde.