Aller au contenu

Surveillance de disponibilité pour hébergeurs qui vous alerte avant l’arrivée des tickets.

Uptimia vérifie les sites de vos clients depuis l’extérieur, tandis qu’un agent en une ligne remonte le CPU, le disque et la charge depuis l’intérieur de chaque serveur. Vous voyez /var à 92 % pendant que les quarante sites de ce nœud continuent de se charger normalement — et vous réglez le problème avant même qu’une panne survienne.

Sites, serveurs & IP de messagerie dans un seul tableau de bord Installation de l’agent en une ligne Sans carte bancaire
Sites web surveillés
100,000+
Vérifications par jour
50M+
Points de contrôle
171+
Pays couverts
70+

Quatre idées reçues qui remplissent la file d’attente

Les quatre tiennent la route jusqu’à ce qu’un disque plein fasse tomber quarante sites.

Idée reçue 01

« Nous surveillons déjà tout depuis l’intérieur du datacenter. »

La surveillance depuis l’intérieur partage le sort de ce qu’elle observe — quand le rack perd le réseau, vos alertes le perdent aussi. Et elle mesure depuis vos propres murs ; elle ne pourra jamais voir ce que voit un client à trois réseaux de distance.

Idée reçue 02

« Les sites répondent, donc les serveurs vont bien. »

« Répond » est un indicateur retardé. Un serveur à 96 % sur /var répond à chaque requête — jusqu’au moment où il n’en sert plus aucune. Le temps que les sites vous le disent, ce n’est pas une alerte isolée — c’est tout le nœud, d’un coup.

Idée reçue 03

« Si nos IP de messagerie avaient un problème, on verrait des rejets. »

Les rejets se produisent discrètement, à l’autre bout. Le message quitte votre file sans problème ; une IP blacklistée se fait simplement refuser ailleurs. Vous l’apprenez quand un client vous transfère sa troisième facture jamais reçue.

Idée reçue 04

« Personne ne lit vraiment les pages de statut. »

Personne ne les lit quand tout va bien. Pendant un incident, elles font la différence entre une seule note de statut et quarante tickets identiques — et un seul incident suffit à vos clients pour apprendre où regarder.

× 40
clients sur un seul serveur mutualisé

« Un serveur en panne, c’est un incident » est la plus grande de toutes. En hébergement mutualisé, la multiplication est brutale : un nœud × 40 clients = quarante pannes simultanées, quarante boîtes de support, quarante conversations de renouvellement — à cause d’un seul disque plein. La correction coûte un ingénieur et une rotation de logs ; le découvrir trop tard coûte la patience de quarante clients.

La question n’est donc pas de savoir si un serveur va se remplir ce trimestre. C’est de savoir si la première personne à l’apprendre travaille pour vous.

Voici à quoi ressemble un disque qui se remplit quand quelque chose le surveille depuis l’intérieur du serveur.↓ minute par minute

Ce qui se passe quand /var se remplit

Un disque sur l’un de vos serveurs se remplit discrètement pendant la nuit. Les quarante sites clients de ce serveur continuent de répondre à chaque requête, et tous les tableaux de bord restent au vert.

03:06:30 /var franchit 90 % sur db-node-02L’agent remonte le disque toutes les 30 s — il voit la montée, pas la chute tickets : aucun
03:07 L’astreinte est alertée — pas quarante clientsD’abord Slack, SMS cinq minutes plus tard si personne n’acquitte tickets : aucun
03:19 Log incontrôlé mis en rotation — disque revenu à 58 %Reprise confirmée par le rapport suivant de l’agent, seuil repassé sous la limite tickets : aucun
08:00 Au matin : quarante sites n’ont jamais bronchéLa détection tient en une ligne dans le rapport du nœud — la preuve pour l’appel de renouvellement tickets : toujours aucun
0 minindisponibilité · 40 sites
Vous le saviez déjà.08:00
La panne qui aurait dû en devenir quarante n’a jamais eu lieu. Le support a démarré sa journée sur une file vide — la seule trace est la ligne du rapport qui prouve que votre équipe l’a repérée.
repéré à 92 % · résolu en 13 min0 ticket · 0 min d’arrêtregroupé par rackCPU · RAM · disque — seuils par point de montage
Et sans l’agent ? /var atteint discrètement 100 % avant l’aube — et un seul disque plein devient quarante pannes simultanées. Le support démarre sa journée sur une boîte de réception saturée et quarante conversations de renouvellement. 40 pannes

C’est un serveur sauvé. Mais une flotte d’hébergement tombe en panne à plus de niveaux que le disque — sites, certificats, domaines, réputation e-mail.↓ chaque niveau, un seul tableau de bord

Sites, serveurs et IP de messagerie

La surveillance de serveurs pour les hébergeurs, c’est trois veilles à la fois : les sites clients depuis l’extérieur, les serveurs depuis l’intérieur, et les IP par lesquelles part leur messagerie. Un seul tableau de bord, regroupé par rack ou par client.

Métriques serveurCPU, RAM et disque depuis l’intérieur
Vérifications de disponibilitéToutes les 30 s à partir du forfait Professional
Certificats SSLExpiration détectée des semaines à l’avance
Expiration du nom de domaineRenouvellement surveillé au niveau du registre
940 sites · 25 serveurs un tableau de bord · regroupé par rack
Vitesse de chargementTemps de chargement complet de la page, sous forme de graphique
Blacklist / DNSBLIP de messagerie vérifiées sur 17 zones
TransactionsCheckout parcouru étape par étape
Les sites clients sont vérifiés depuis plus de 171 points de contrôle dans plus de 70 pays, et un échec est revérifié depuis jusqu’à 3 régions supplémentaires avant que quiconque soit alerté — pendant que l’agent remonte l’intérieur de chaque serveur toutes les 30 s. Une route capricieuse ne réveille jamais votre astreinte. aucune fausse alerte

Ce que vos clients remarquent en premier

Surveillance de serveurs

À un log incontrôlé de la saturation

Aujourd’hui, il faudrait vous connecter à chaque serveur pour savoir lequel est concerné. Un agent en une ligne le remonte en continu — CPU, mémoire, disque, charge et réseau depuis chaque serveur Linux, toutes les 30 secondes — pour qu’un /var qui se remplit alerte votre astreinte pendant que les sites qui y résident sont encore servis.

  • Installation en une ligne — une commande curl, un timer systemd, aucune interruption des sites
  • Seuils de disque par point de montage/var alerte plus tôt que /, et chaque point de montage ouvre et résout son propre incident
  • Le silence compte aussi — un serveur qui manque trois rapports d’affilée est signalé hors ligne, 90 secondes après le dernier
Découvrir la surveillance de serveurs
CPU31 % · 4 cœurs · charge 8,9ok
Mémoire62 % · swap 4 %ok
Disque · /41 % · alerte > 90 %ok
Disque · /var96 % · alerte par point de montage > 90 %dépassé
db-node-02 — alerte en coursagent toutes les 30 s
Disque /var 96 % > 90 % — à un log incontrôlé de la saturation. Repéré et signalé maintenant, avant que tout le nœud ne tombe.
SlackSMSastreinte
Un serveur qui cesse de se manifester pendant trois intervalles déclenche aussi une alerte — le silence compte, pas seulement les pics. le silence compte
Surveillance de blacklist

IP de messagerie passées au crible sur 17 zones

Un listage chez Spamhaus ou Barracuda ne s’annonce nulle part : le message quitte votre file proprement et se fait refuser à l’autre bout. La surveillance de blacklist pour serveurs de messagerie passe chaque domaine d’envoi et ses IP au crible de 17 zones DNSBL toutes les 15, 30 ou 60 minutes, et ouvre un plan de délistage dès qu’une zone répond « listé ».

  • Domaine + IP web + IP de messagerie — une sonde couvre tout un domaine d’envoi, plus jusqu’à cinq IP dédiées, sur les 17 zones
  • Suit votre infra — l’IP web (enregistrement A) et l’IP de messagerie (MX) sont réévaluées à chaque passage, si bien que la surveillance suit quand vous déplacez le serveur
  • Aucune fausse alerte — les codes de réputation comme Hostkarma NOBL et Mailspike « good » sont interprétés comme propres, jamais confondus avec un listage
Découvrir la surveillance de blacklist Essayer le vérificateur de blacklist gratuit
Majeures · 3 zonesSpamhaus ZEN · DBL · Barracuda1 listée
Standard · 12 zonesSpamCop · SURBL · Mailspike · Hostkarma …propre
Info · 2 zonesUCEPROTECT L1 · L3n’alerte jamais
Barracuda BRBL — listéeIP de messagerie · alerte envoyée
TXT : « rejected — see barracudacentral.org/rbl ». Plan de délistage ouvert, revérifié à chaque passage, clôturé une fois la levée confirmée.
203.0.113.24réévaluée à chaque passage
17 zones en trois niveaux — un listage Spamhaus ou Barracuda alerte votre astreinte ; UCEPROTECT est enregistré et ne réveille jamais personne. 1 sur 17
Intégration en masse

Un collage, tout un rack de sondes

Intégrer un rack formulaire par formulaire, c’est ainsi que la surveillance finit discrètement par ne plus correspondre à la flotte. Collez la liste des sites hébergés, choisissez le type de vérification, et tout le rack est créé en une seule passe et classé dans le groupe de ce rack — une passe par type, donc disponibilité, SSL et domaine en prennent trois. Le rack est arrêté dimanche ? Mettez-les tous en sourdine en une seule action, tous types confondus.

  • Coller pour créer — créez en masse des sondes de disponibilité, SSL, domaine, malware, vitesse ou utilisateurs réels, un type par passe, avec la liste analysée prévisualisée avant toute création
  • Résultats ligne par ligne — les doublons et les lignes hors limite reviennent nommés, ligne par ligne ; les lignes valides sont créées quand même
  • Maintenance en masse — suspendez, reprenez ou planifiez une fenêtre sur tout un rack depuis une seule sélection
Découvrir les fenêtres de maintenance
Coller les domaines hébergés
store-alpha.com
bravo-clinic.co
gamma-realty.net
delta-cafe.io
… 96 lignes de plus
DisponibilitéSSLDomaineMalwareVitesse
Création en masserésultat par ligne
store-alpha.com · disponibilitécréée ✓
bravo-clinic.co · disponibilitécréée ✓
gamma-realty.net · ignoréedoublon
delta-cafe.io · ignoréelimite du forfait
+ 96 créées de plus · 98 sondes de disponibilité, classées dans le groupe du rack
La même sélection les remet en pause — un rack, une action, que vous créiez des sondes ou que vous les mettiez en sourdine pour une fenêtre du dimanche. 1 collage
Pages de statut & rapports

Une note au lieu de quarante tickets

Pendant un incident, vos clients regardent votre boîte de réception — à moins que vous ne leur ayez donné un meilleur endroit où regarder. Une page de statut sur le propre domaine du client — son logo, aucun badge Uptimia — est alimentée en direct par ses sondes, si bien qu’un incident devient une note que vous écrivez au lieu de quarante tickets auxquels vous répondez.

  • Son domaine, vos notes — pointez un sous-domaine du client vers nous, et une page de statut à sa marque y répond, avec le badge « Powered by Uptimia » désactivé
  • Publique ou privée — ouverte à ses clients, ou restreinte par mot de passe / IP pour que lui seul la voie
  • Rapports à votre marque — synthèses de disponibilité planifiées en PDF, HTML ou CSV, avec vos couleurs et votre logo en tête
Découvrir les pages de statut Voir ce que couvre la marque blanche
Site webbravo-clinic.co · disponibilitéopérationnel
Portail patientapp.bravo-clinic.codégradé
status.bravo-clinic.co
Un service dégradé.
« On s’en occupe — ETA 30 min » · votre note, votre logo, aucun badge Uptimia
il y a 90 joursaujourd’hui
Publique🔒 Mot de passePrivée · IP
Quarante clients actualisent la page que vous leur avez donnée, pas votre boîte de réception. La marque blanche se limite aux pages de statut et aux rapports, votre tableau de bord reste donc interne. son domaine · aucun badge

Alerté avant que la file de support ne se remplisse

Un serveur, une IP de messagerie ou un site client — quoi qui tombe, l’alerte atteint votre roulement d’astreinte sur les canaux que votre équipe utilise déjà pour gérer les incidents.

Astreinte & escalade
Direct

Une seule liste de contacts — une seule liste d’astreinte pour toute la flotte.

Parcourir l’annuaire complet des intégrations
23:52 · incident ouvert — node14.caldmont.com · disque 96 % sur /var
#ops-alertsSlack
⚠ Disque en train de se remplir — node14.caldmont.com · /var à 96 %
seuil 90 %41 sites clients sur ce serveurAcquitter ↩
+371 ··· 4082SMS
Uptimia : DISQUE EN TRAIN DE SE REMPLIR node14.caldmont.com. /var à 96 %, au-dessus de votre seuil de 90 %, à 23:52 UTC.
InboxE-mail
⚠ Disque en train de se remplir — node14.caldmont.com · /var à 96 %
A franchi votre seuil de 90 % à 23:52 et continue de monter. Les 41 sites clients sur ce serveur répondent toujours…
ProductionPagerDuty
TRIGGEREDDisque en train de se remplir — node14.caldmont.com
assigné à l’astreinte · via l’intégration Uptimia

L’indisponibilité d’un client devrait vous alerter, vous.Pas un ticket de support.

L’essai de 30 jours débloque tous les types de sonde — sites, serveurs, SSL, domaine et blacklist.

Démarrez votre essai gratuit de 30 jours
30 jours gratuits sans carte bancaire résiliable à tout moment

Votre flotte surveillée en trois étapes

Sites, serveurs et IP de messagerie sous surveillance dès cet après-midi.

Étape 115 min

Ajoutez les sites et les serveurs

Collez votre liste de sites hébergés une fois par type de vérification — disponibilité, puis SSL, puis domaine — et déposez l’agent en une ligne sur chaque serveur Linux pour le CPU, le disque et la charge.

Ajout en masse + agent
store-alpha.com
bravo-clinic.co
… 98 de plus
294 sondes créées · 25 serveurs qui remontent des données
Étape 25 min

Définissez les seuils & acheminez les alertes

Définissez des seuils de disque et de charge par serveur, connectez Slack et les SMS, et décidez qui est alerté en premier — et qui suit si personne ne répond.

Canaux d’alerte
SlackSMSPagerDuty+ 9 de plus
échelle : Slack → +5 min SMS → +15 min tout le monde
Étape 310 min

Activez la couche visible par vos clients

Pages de statut à votre marque sur les domaines de vos clients et rapports mensuels à vos couleurs — ils apprennent les incidents par vous.

Livrables clients
status.bravo-clinic.co · en direct
rapport mensuel · votre logo · envoyé au client

Également inclus

Intégrez depuis l’API

Créez des sondes et des pages de statut depuis vos scripts de provisionnement — un nouveau serveur démarre, un appel suffit à le mettre sous surveillance.

POST /api/v2/server 201 · created · web-node-08

Fenêtres de maintenance

Un rack hors ligne ce week-end ? Planifiez la fenêtre — les vérifications se mettent en pause, les alertes restent silencieuses, personne ne s’alerte lui-même.

Dim. 02:00–04:00 · alertes en sourdine

Expiration SSL & domaine

Certificats et enregistrements surveillés avec une fenêtre d’alerte configurable avant l’expiration. Les sondes de domaine suivent l’échelle de la disponibilité jusqu’à 1 000 ; le SSL est compté avec les familles plus serrées, 100 tout en haut.

renouvelle dans 61 j · vérifié selon votre intervalle

Chaînes d’escalade

Acheminez d’abord une alerte de serveur en panne vers l’astreinte, le chargé de compte seulement si elle est encore ouverte après 15 minutes.

Slack → +5 min SMS → +15 min tous

Avis de rétablissement

Quand un serveur ou un site revient, les personnes alertées l’apprennent aussi — plus de panique qui traîne à 3 h du matin.

✓ web-node-03 de nouveau en ligne · 4 min hors ligne

Un seul compte, toute la flotte

Les groupes évitent que 25 nœuds et 940 sites ne deviennent une seule liste plate — filtrez, mettez en pause ou générez un rapport pour n’importe quel rack isolément.

Rack A · web-node-01…08640 SITES Rack B · db-node-01…044 BDD Cluster de messagerie3 IP

Surveillance de disponibilité pour hébergeurs

La surveillance de disponibilité pour hébergeurs consiste à observer chaque site hébergé, les serveurs qui les font tourner et les IP de messagerie par lesquelles envoient les clients — dans un seul tableau de bord externe — afin de repérer les problèmes avant l’arrivée des tickets de support. Les sites sont vérifiés depuis l’extérieur, un agent remonte les serveurs depuis l’intérieur, et les résultats alimentent des pages de statut et des rapports visibles par vos clients.

Sans surveillance

La file de support l’apprend en premier

Le serveur se remplit
03:06 · personne ne surveille
40 sites en panne
Vague de tickets
« pourquoi mon site est-il en panne ? »

Chaque problème qu’un client remarque en premier devient un ticket, un risque de rétrofacturation et une entaille dans votre réputation.

Avec Uptimia

Vous le repérez en premier

Le disque atteint 92 %
03:06 · l’agent alerte
en moins de 30 s
Astreinte sur Slack
résolu à 03:19 · zéro ticket

L’incident devient une ligne dans le rapport du nœud — la preuve que la plateforme est surveillée.

Chaque niveau

Ce que détecte chaque niveau

Trois choses à surveiller — sites, serveurs, IP de messagerie — couvertes depuis un seul endroit ; ajoutez la vitesse de page et les transactions là où c’est important.

Découvrir la surveillance SSL
NiveauCe qui est détectéComment ça marche
DisponibilitéSites en panne, erreurs serveurToutes les 30 s à partir du forfait Professional, revérifié depuis jusqu’à 3 régions supplémentaires
Métriques serveurDisque plein, pic de charge, serveur hors ligneL’agent remonte CPU/mémoire/disque/charge toutes les 30 s, 8 seuils
Certificat SSLExpiration, chaînes casséesFenêtre d’alerte configurable, critique à moins de 45 jours
Expiration du nom de domaineEnregistrements expirésWHOIS revérifié selon votre intervalle, critique à moins de 3 jours
BlacklistIP de messagerie listée sur une DNSBL17 zones passées au crible toutes les 15 à 60 min, IP réévaluées à chaque passage

FAQ sur la surveillance pour hébergeurs

01Qu’est-ce que la surveillance de disponibilité pour hébergeurs ?+
Un seul service externe qui surveille tout ce dont un hébergeur est responsable — les sites hébergés (disponibilité, SSL, domaine), les serveurs qui les font tourner (CPU, mémoire, disque, charge) et les IP de messagerie par lesquelles envoient les clients (listages en blacklist). L’essentiel, c’est le timing : la surveillance de disponibilité pour l’hébergement mutualisé détecte un disque qui se remplit ou une IP listée avant que quarante sites ne le ressentent — et avant le premier ticket. Uptimia ajoute des pages de statut à votre marque sur les domaines de vos clients et des rapports planifiés avec votre logo.
02Puis-je donner à un client un accès qui n’affiche que ses sites ?+
Oui, avec une réserve. Invitez-le comme membre en lecture seule et limitez ce poste à son groupe de sondes — les lectures, incidents, journaux et exports ne renvoient que les sondes de ce groupe, et une sonde hors périmètre répond comme si elle n’existait pas. La réserve : cela consomme un de vos postes d’équipe, et le tableau de bord sur lequel il atterrit est à la marque Uptimia. La plupart des hébergeurs préfèrent donner la page de statut et le rapport mensuel à la place — aucun poste, aucun accès à gérer.
03Vous intégrez-vous à cPanel, WHM ou Plesk ?+
Non — et pour une surveillance externe, c’est justement le principe. Aucun panneau ni plugin WordPress signifie que rien ne dépend de la pile technique du client ni ne casse quand elle est mise à jour. Les vérifications s’exécutent depuis l’extérieur comme un vrai visiteur ; la seule installation optionnelle est l’agent serveur, une simple commande sur le serveur lui-même.
04Est-ce un programme de revente ou de marque blanche ?+
Pas un programme de revente. La marque blanche couvre les surfaces visibles par vos clients : une page de statut sur le propre domaine du client via un simple CNAME, avec son logo et le badge « Powered by Uptimia » désactivé, plus des rapports planifiés à vos couleurs avec votre logo. Deux choses sont comptées ou verrouillées : le nombre de pages de statut augmente avec le forfait, et les thèmes qui mettent vos couleurs sur un rapport démarrent avec le forfait Professional. Le logo propre à la page de statut et le bouton du badge sont disponibles sur tous les forfaits. Le tableau de bord lui-même n’est pas personnalisable — il reste l’outil de votre équipe.
05L’agent serveur fonctionne-t-il sous Windows ?+
Linux est la plateforme de référence — une installation en root avec un timer systemd (ou un repli sur cron), qui remonte CPU, mémoire, disque, charge et réseau toutes les 30 secondes. Des agents macOS et Windows existent mais restent secondaires, et laissent de côté quelques métriques propres à Linux (CPU par cœur et attente d’E/S).
06À quelle vitesse la surveillance de blacklist détecte-t-elle un listage ?+
Elle passe vos domaines et IP de messagerie au crible de 17 zones DNSBL toutes les 15, 30 ou 60 minutes — vous choisissez la cadence par sonde, 15 par défaut. C’est un passage récurrent rapide, pas un push instantané. Une sonde couvre un domaine d’envoi ainsi que ses IP web et de messagerie et jusqu’à cinq IP dédiées, toutes réévaluées à chaque passage pour que la surveillance suive votre infrastructure. Les codes de réputation comme Hostkarma NOBL sont interprétés comme propres, jamais comme un listage.
07Combien de serveurs et de sites puis-je surveiller ?+
Les vérifications de disponibilité vont de quelques dizaines à un millier selon les forfaits, avec des quotas de serveurs, SSL, blacklist et domaine qui augmentent en parallèle — les tarifs détaillent les chiffres. L’essai de 30 jours est assez large pour y charger une vraie tranche de votre flotte avant de payer quoi que ce soit. Les groupes de sondes gardent tout organisé : un par rack ou par client.
08Puis-je limiter un membre de l’équipe à certains racks seulement ?+
Oui. Un poste a un rôle — administrateur, éditeur, lecture seule ou facturation — et les postes éditeur et lecture seule peuvent aussi être limités à des groupes de sondes spécifiques. Limitez votre prestataire NOC au Rack B, et sa liste de sondes, son tableau de bord, ses incidents, ses journaux et ses exports CSV ne contiennent que le Rack B et rien d’autre ; une sonde qu’il crée est classée dans ses propres groupes. Les sessions propriétaire et le rôle administrateur ne sont jamais limités, et les sélecteurs de sondes dans les éditeurs de pages de statut, d’alertes et de maintenance ne sont pas encore limités.
09Que se passe-t-il quand un serveur franchit un seuil ?+
L’agent le signale dans son rapport suivant de 30 secondes — disque au-delà du seuil de son point de montage, charge au-dessus de la ligne, ou serveur silencieux depuis trois intervalles. À partir du forfait Professional, votre échelle d’escalade se déroule jusqu’à ce que quelqu’un acquitte, ce qui l’arrête pour tout le monde ; sur Basic, et pendant l’essai, l’alerte atteint tout le monde en même temps. Au retour à la normale, les mêmes personnes reçoivent la levée d’alerte, et l’incident est consigné dans le rapport du nœud. Les seuils de disque sont définis par point de montage, si bien que /var peut alerter plus tôt que /.
10Dois-je installer quoi que ce soit sur les sites hébergés ?+
Non. Les vérifications de disponibilité, SSL, domaine et blacklist s’exécutent depuis l’extérieur — plus de 171 points de contrôle et des recherches DNSBL — donc il n’y a rien à installer, mettre à jour ou ralentir sur les sites hébergés. La seule installation optionnelle est l’agent serveur, sur le serveur que vous exploitez, pas sur le site du client.
11Quels canaux d’alerte mon équipe peut-elle utiliser ?+
E-mail, SMS, Slack, WhatsApp, PagerDuty, Microsoft Teams, Atlassian Statuspage, Discord, Telegram, Mattermost, Twilio et webhooks. Il n’y a ni appels vocaux, ni notifications push, ni roulements d’astreinte — les échelles d’escalade sont des étapes chronométrées, et un acquittement les arrête.

Détectez le disque plein avant qu’il n’emporte des sites

Chargez une tranche de votre flotte dans l’essai — sites, serveurs et IP de messagerie — et détectez le prochain problème avant qu’il ne devienne un ticket.

Vérifications de sites & agents serveur inclus Installation de l’agent en une ligne Pages de statut & rapports en marque blanche Sans carte bancaire
Essai gratuit de 30 jours · surveillez les sites, les serveurs et les IP de messagerie · vos clients ne voient jamais de logo fournisseur