La surveillance de serveur qui vous avertit avant la panne.
La plupart des serveurs ne plantent pas — ils manquent de quelque chose. Une ligne bash installe l'agent, 30 secondes plus tard il envoie ses relevés, et le disque est corrigé à 90 %, pas à 100 %.
CPU Usage
alerts only if every 30 s reading stays over 90% for 5 minDisk Usage
per mount · worst firstServer Details
reported by the agentD'un disque qui se remplit à une alerte en 30 secondes
Les journaux s'accumulent pendant la nuit et l'un de vos serveurs commence à manquer d'espace disque. Rien n'est encore en panne — un petit agent envoie un relevé toutes les 30 secondes, si bien que l'alerte nomme le serveur et le disque pendant qu'il reste encore du temps pour le libérer.
17 métriques, un agent bash
Un agent bash relève 17 métriques toutes les 30 secondes — déjà mises en graphique, pour lire l'état d'un serveur sans avoir à vous y connecter.
Alertes et historique
Alerté pour de vrais problèmes, pas pour des pics momentanés
Uptimia ne déclenche une alerte CPU, mémoire, swap, charge, nombre de processus ou réseau que lorsque chaque relevé de votre fenêtre reste au-dessus du seuil — un pic de deux secondes passe en silence, un problème soutenu, non.
- Vous décidez de la durée qu'un problème doit tenir — de 1 minute à une demi-heure, réglable par métrique
- Rien à configurer pour démarrer — CPU, mémoire et disque sont surveillés dès le premier relevé ; ajoutez les autres quand vous le souhaitez
- Disque et inodes font exception — ils se déclenchent dès qu'un point de montage franchit le seuil ; un disque plein ne peut pas attendre
au-dessus de 90 %
Sachez exactement quel disque s'est rempli, instantanément
Uptimia limite les alertes d'espace disque et d'inodes à chaque point de montage, si bien que l'incident dit /var — et non toute une machine à fouiller. Chaque point de montage ouvre et résout son propre incident.
- Un incident par point de montage — /, /var, /data chacun suivi et résolu séparément
- Le point de montage et la valeur dans l'alerte — « Utilisation disque au-dessus de 90 % sur /var », à 92 %
- Seuils personnalisés par point de montage — tenez un point de montage très sollicité comme /var à un pourcentage plus strict que le reste
Trois relevés manqués ouvrent un incident
Si un serveur devient complètement silencieux — panique du noyau, coupure d'alimentation, réseau — une vérification distincte par minute remarque les relevés manquants et ouvre un incident critique. Une machine morte ne peut pas se cacher derrière « pas de nouvelles, bonnes nouvelles ».
- Signalé hors ligne après 3 relevés manqués — 90 secondes de silence au rythme de 30 secondes
- Se résout automatiquement à la prochaine connexion — se clôt dès que l'agent est de retour
- Pas de faux « hors ligne » lors de la configuration — un nouveau serveur en attente de son premier relevé n'est jamais signalé
Un an d'historique, pics inclus
Les chiffres en direct disent ce qui ne va pas maintenant ; les tendances disent que ça grimpe lentement depuis des semaines. Uptimia conserve les deux — 6 cartes de métriques et 5 graphiques, lisant les mêmes données que les alertes.
- 6 cartes de métriques + 5 graphiques temporels — CPU, charge, mémoire, disque, réseau — actualisés toutes les 30 secondes
- Détail brut sur 30 secondes pendant 24 heures — puis moyennes et maximums horaires, pour que les pics survivent, pendant un an entier
- Les graphiques choisissent la bonne source — zoomez sur la dernière heure ou la dernière année et les données changent automatiquement
chaque échantillon, conservé 24 h 02:10:00 → cpu 93% · mem 71%
la ligne de tendance — lisse, comparable mois après mois
les pics survivent à l'agrégation — un pic de 2 minutes reste visible un an plus tard
Des relevés en moins d'une minute
Une ligne à installer — aucun paquet, aucun environnement d'exécution, et un script efface toute trace.
Exécutez une ligne d'installation en tant que root
La ligne unique dépose un petit script bash dans /opt/uptimia et enregistre un minuteur systemd — ou cron, en l'absence de systemd.
# ✓ systemd timer uptimia-agent.timer created
L'agent commence à envoyer ses relevés
Toutes les 30 secondes, il transmet 17 métriques — CPU, mémoire, disque, charge et plus — authentifiées par une clé propre au serveur.
Fixez des seuils, soyez alerté
CPU, mémoire et disque sont réglés à 90 % par défaut. Un seuil franchi ouvre un incident et alerte votre équipe là où elle travaille déjà.
Exécutez une ligne bash.Sachez-le avant que le disque ne soit plein.
Chaque serveur, chaque métrique, chaque canal d'alerte — gratuit pendant 30 jours, sans aucune option payante.
Également inclus
Alertes sur les canaux que vous utilisez déjà
Les alertes serveur partagent une seule liste de contacts avec toutes les autres sondes — e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage et webhooks personnalisés.
Mode maintenance
Corrigez ou redémarrez sans accumuler d'alertes — toute l'alerte est mise en sourdine pendant que les métriques continuent d'affluer.
Avis de rétablissement
Sachez quand c'est fini, pas seulement quand ça a commencé — un avis « résolu » à chaque résolution.
Un historique qui survit à un déclassement
Rétrogradez un forfait et les métriques d'un serveur ne sont pas supprimées — seule l'alerte se tait. Passez en supérieur et les serveurs suspendus se réactivent d'eux-mêmes.
Un tableau de bord pour tout
Les serveurs se retrouvent aux côtés de vos sondes de disponibilité, SSL, signal de présence et DNS — mêmes contacts, groupes et rôles, un seul endroit où regarder.
Désinstallation en une ligne
Un script supprime intégralement l'unité systemd et /opt/uptimia — sans laisser de trace.
Qu'est-ce que la surveillance de serveur ?
La surveillance de serveur est le suivi continu de l'état d'un serveur — CPU, mémoire, disque, charge, réseau et processus — pour que vous soyez alerté dès qu'une ressource vient à manquer ou que la machine passe hors ligne. La surveillance de serveurs Linux d'Uptimia le fait avec un petit agent qui relève 17 métriques toutes les 30 secondes et déclenche un incident quand une métrique franchit votre seuil.
Comment fonctionne l'agent ?
Un script bash sur un minuteur systemd envoie un petit relevé, authentifié par une clé propre au serveur — seuls bash et curl sont nécessaires.
Alertes soutenues ou instantanées
un pic passe en silence — seul un dépassement soutenu vous alerte ; un point de montage plein ne peut pas attendre, le disque se déclenche donc instantanément
Quelles métriques de serveur devriez-vous surveiller ?
Les signaux qui annoncent de vrais incidents — et comment Uptimia surveille chacun d'eux. CPU, mémoire et disque sont surveillés dès le premier relevé ; les autres sont à activer vous-même.
Tous les types de sondes dans un seul compte →| Métrique | Seuil par défaut | Comment Uptimia alerte |
|---|---|---|
| Utilisation CPU | 90% | soutenu · fenêtre de 5 min |
| Mémoire | 90% | soutenu · fenêtre de 5 min |
| Disque · par point de montage | 90% | instantané, par point de montage |
| Moyenne de charge | désactivé par défaut | soutenu · fenêtre |
| Swap | désactivé par défaut | soutenu · fenêtre |
| Nombre de processus | désactivé par défaut | soutenu · fenêtre |
| Débit réseau | désactivé par défaut | soutenu · fenêtre |
| Serveur hors ligne | 3 relevés manqués | critique · ~90 s |
FAQ sur la surveillance de serveur
01Qu'est-ce que la surveillance de serveur ?+
02Comment fonctionne la surveillance de serveur Uptimia ?+
/proc et df et envoie 17 métriques — CPU, mémoire, swap, disque par point de montage, inodes, charge, réseau, nombre de processus et infos OS — authentifiées par une clé propre à chaque serveur. Vous obtenez 6 cartes de métriques, 5 graphiques temporels et des alertes à seuil : toute la surveillance et l'alerte serveur en un seul petit agent.03Quels systèmes d'exploitation sont pris en charge ?+
/proc et df, il tourne donc sur les distributions standards (Ubuntu, Debian, RHEL, Alma, etc.). Des agents macOS et PowerShell Windows existent aussi et relèvent les mêmes métriques, à configurer à la main (launchd sur macOS, une tâche planifiée sur Windows) plutôt que via la ligne unique. Il n'existe pas d'agent BSD — pour ces hôtes, utilisez les vérifications externes d'Uptimia (ping, port TCP, HTTP).04Puis-je changer la fréquence des relevés de l'agent ?+
05Un bref pic de CPU va-t-il m'alerter à 3 h du matin ?+
06À quelle vitesse saurai-je si un serveur tombe en panne ?+
07L'agent lit-il mes journaux ou exécute-t-il des commandes ?+
08Combien d'historique est-il conservé ?+
09Puis-je surveiller des conteneurs Docker ou Kubernetes ?+
/proc et le df de la machine entière, pas de statistiques par conteneur. Adapté aux serveurs sur lesquels tournent vos conteneurs ; pas de collecte par conteneur aujourd'hui.10La surveillance de serveur est-elle un module payant ?+
Commencez à surveiller vos serveurs dès aujourd'hui.
Exécutez une ligne bash, et un disque qui se remplit, un CPU en surchauffe ou une machine éteinte vous atteignent pendant qu'il reste encore de la marge.