Vai al contenuto

Monitoraggio del sito con avvisi PagerDuty

Uptimia controlla i tuoi siti, certificati e flussi di checkout dall'esterno della tua rete e segnala ogni guasto confermato come incidente in PagerDuty. Da lì se ne occupa la tua policy di escalation — un telefono squilla, poi il successivo se nessuno risponde, finché qualcuno non se ne occupa.

Gli avvisi hanno bisogno di un responsabile, non di un pubblico

Un avviso in chat è una trasmissione: lo vedono tutti, quindi non se ne occupa nessuno. PagerDuty trasforma lo stesso guasto in un incarico — un nome, un conto alla rovescia, e il nome successivo quando il conto alla rovescia si esaurisce.

L'avviso come messaggio in un canale

Visto da tutti, di nessuno

Signing API in errore
04:52 · pubblicato su #alerts
nessuno di turno qui
Lo storico dei messaggi
tre reazioni 👍 entro colazione

Chiunque veda il messaggio pensa che se ne stia occupando un collega più vicino a una tastiera, e di domenica l'intera stanza dorme all'unisono. Un canale non ha idea di chi sia di turno nel weekend.

L'avviso come incidente PagerDuty

Un nome, un timer, poi un telefono

Signing API in errore
04:52 · evento di trigger
policy · timer di 4 min
Il telefono che deve rispondere
squilla, fa escalation, registra la presa in carico

PagerDuty sa già di chi è il turno quella settimana, quale numero chiamare e cosa fare se nessuno risponde. L'unica cosa che non può fornire è il motivo per iniziare: la prova, dall'esterno della tua rete, che un visitatore reale non è riuscito a caricare la pagina.

Un canale più rumoroso non aiuta. Un avviso con un responsabile e un cronometro sì. Ecco un failover di domenica mattina, minuto per minuto:

Un'interruzione, una telefonata

Un singolo guasto nella tua infrastruttura può far diventare rossi nove controlli in una volta sola — checkout, API, login, tutti nello stesso minuto. Uptimia li raggruppa in un solo incidente, e PagerDuty chiama un solo telefono: chi è reperibile quella settimana.

04:52 Nove controlli falliscono su un'unica policy di escalationUn evento di trigger: "9 monitors down — Signing API +8 more (#482)" gravità · critical
04:53 La policy chiama il responsabile primario — nessuna rispostaNiente è perso: la policy sta già contando alla rovescia verso il passo due policy · passo 1
04:58 Il responsabile secondario prende in carico, avvia il failover regionaleIl riepilogo indicava il monitor e la gravità — abbastanza per agire subito preso in carico in PagerDuty
05:16 ✅ Cessato allarme: tutti e 9 i monitor di nuovo attiviUn evento proprio a gravità warning — chi risponde chiude l'incidente evento di ripristino
24 mindown → up
L'ingegnere che ha risolto il problema non aveva mai aperto Uptimiasettimana 2 di turno
La persona reperibile non aveva un accesso a Uptimia e non ne ha mai avuto bisogno. La pagina indicava il monitor, la gravità e il componente — abbastanza per agire — e la presa in carico è registrata in PagerDuty.
9 monitor, 1 triggerpreso in carico in 6 min24 minuti di inattivitànessun accesso richiesto
Il rilevamento è arrivato dall'esterno. Tutto il resto è rimasto in PagerDuty — il turno, la telefonata, l'escalation, la presa in carico. nessun accesso al monitoraggio richiesto

Collega PagerDuty in tre passaggi

Crea un servizio in PagerDuty, copia la chiave che ti fornisce, incollala in Uptimia. Non c'è nessuna app da autorizzare né niente di tuo da tenere in funzione.

Passo 12 min

Copia la chiave da PagerDuty

Crea un servizio in PagerDuty — la chiave che mostra è tutto ciò di cui Uptimia ha bisogno.

Web platform · Events API v2 Copia chiave
R0VE··············KEY · un solo valore, niente altro da configurare
Passo 21 min

Incollala in Uptimia

Salva la chiave, e un evento di test verifica subito l'instradamento.

Avvisa questo monitor su
PagerDuty · Web platformEmailSlack
evento di test recapitato · gravità info · fonte uptimia.com
Passo 3importante

Lascia che sia PagerDuty a gestire l'escalation

I tuoi turni, le sostituzioni e le telefonate restano in PagerDuty — Uptimia segnala l'incidente e si fa da parte.

Chi fa escalation
policy PagerDuty — reperibile → +4 min secondario → +10 min responsabile
scala di Uptimia — un solo passo · le finestre di manutenzione non inviano nulla
Guida tecnica alla configurazione

Collega PagerDuty a Uptimia

Ogni passaggio, nel Centro assistenza: creare il servizio in PagerDuty, copiare la chiave e collegarla ai tuoi monitor.

Ogni controllo che esegui può avvisarti tramite PagerDuty

Fare ping alla homepage ti dice solo della homepage. Uptimia percorre anche un login passo dopo passo, segue una catena di chiamate API che si interrompe alla terza chiamata e nota un job pianificato che non si è mai fatto sentire — e ognuno di questi può attivare l'incidente.

Controlli uptimeConfermato prima da fino a tre aree geografiche
Certificati SSLDate di scadenza e handshake falliti
Scadenza del dominioDate di rinnovo che si avvicinano
Metriche del serverCPU, memoria, disco e carico
1 routing key una sola chiave — ogni controllo passa da lì
Heartbeat e cronIl job notturno che non si è mai fatto sentire
TransazioniCheckout ripercorsi passo dopo passo
Virus e malwarePagine segnalate, host in blocklist
Velocità della paginaTempi di caricamento oltre la tua soglia
La gravità viaggia con l'evento — un'interruzione confermata arriva come critical, un ripristino e un server oltre la soglia di CPU, memoria o disco arrivano come warning, così le regole del tuo servizio possono instradarli separatamente. ogni controllo · una sola chiave

Instrada ogni sistema al team che se ne occupa

Avvisa un'unica rotazione per tutto, oppure assegna a ogni sistema il proprio servizio — il checkout al team storefront, i server al team platform, e le segnalazioni a basso rischio a un canale che aspetta il mattino.

Un unico servizio
Una chiave, una rotazione — da dove partono la maggior parte dei team.
Ogni tipo di monitor attiva un evento su di esso
Una policy di escalation, un evento di trigger
La tua policy decide chi svegliare
una chiave, un contatto
Un servizio per sistema
Checkout, platform e infrastruttura, ognuno con la propria chiave.
Replay delle transazioni → la rotazione dei pagamenti
Server e heartbeat → infrastruttura
Certificati e domini → la coda dei rinnovi
le chiavi sono semplici contatti
Cercapersone di notte, chat di giorno
Non ogni segnalazione merita una chiamata alle quattro del mattino.
Interruzioni confermate → PagerDuty
Avvisi di scadenza e soglia → un canale di chat
Report mensili sull'uptime → e-mail
stesso incidente, pubblici diversi
Lo stesso incidente può anche raggiungere SlackMS TeamsDiscordTelegramWhatsAppTwilio SMSEmail

I canali si leggono.I cercapersone si rispondono.

L'intera piattaforma in prova — ogni tipo di controllo, una chiave, e un incidente segnalato nel momento in cui un guasto viene confermato.

Inizia la tua prova gratuita di 30 giorni
30 giorni gratis senza carta di credito annulla quando vuoi

Trigger in PagerDuty, prove in Uptimia

L'evento dice cosa si è rotto e quanto gravemente, ed è tutto ciò di cui chi risponde ha bisogno. Il verdetto per singola sonda, il grafico dei tempi di risposta e la cronologia dell'incidente aspettano in Uptimia chi scriverà il follow-up.

Cosa contiene davvero l'evento

Ogni trigger è lo stesso JSON verso Events API v2: un riepilogo di cosa si è rotto, source uptimia.com, una gravità e un componente che indica il tipo di controllo — oppure Incident group quando è stata una policy di escalation a generarlo. Niente da mappare o interpretare.

summary — Signing API is DOWN (Uptimia incident #479)TESTO severity — criticalAVVISA component — Incident groupINSTRADA

Confermato prima di avvisare

Una sonda sfortunata da sola non sveglia mai nessuno. Sui controlli di uptime, velocità, certificati e transazioni imposti tu quante aree geografiche indipendenti devono concordare — fino a tre — prima che venga inviato un evento.

oltre 171 sonde · 6 continenti

Una tempesta, un incidente

I monitor che condividono una policy di escalation e falliscono insieme vengono raggruppati in un unico incidente Uptimia, e PagerDuty riceve un solo evento che lo identifica.

Uptimia incident #482 · 9 monitor

La manutenzione resta silenziosa

Le finestre pianificate sospendono gli avvisi, così un deploy alle 23:00 non si trasforma mai in una telefonata.

23:00–01:00 · silenziato

Tempo di reazione messo a verbale

Con una policy di escalation, Uptimia registra data e ora delle proprie prese in carico, così l'incidente riporta chi se ne è occupato e quanti minuti ci sono voluti.

preso in carico · 6 min

Solo fatti — per scelta

I canali di chat ricevono un link di presa in carico; i payload di PagerDuty e dei webhook non lo hanno mai — un flusso automatico di pipeline di log non deve mai poter silenziare un'escalation. Prendi in carico in PagerDuty o in Uptimia, ciascuno per la propria parte.

Evento PagerDuty — fatti, nessun link di presa in caricoPER SCELTA Canali di chat — link di presa in carico inclusoSLACK · TEAMS Dashboard — un tocco interrompe la scalaUPTIMIA

Come funzionano gli avvisi di monitoraggio PagerDuty

Uptimia controlla i tuoi siti web da oltre 171 postazioni esterne e, quando un controllo fallisce, segnala un incidente in PagerDuty — la tua policy di escalation chiama chi è reperibile e continua finché qualcuno non lo prende in carico. L'incidente indica il monitor, cosa è andato storto e quanto è grave, e quando il controllo si ripristina un secondo evento porta il cessato allarme nello stesso servizio.

«Il cercapersone si chiuderà da solo quando il sito torna online»

Il ripristino è un evento, non una risoluzione

Di nuovo online alle 05:16
evento di cessato allarme inviato
nessuna risoluzione viene inviata
L'incidente resta aperto
finché qualcuno non lo chiude

Ogni evento inviato da Uptimia è un trigger, mai una risoluzione — un controllo che torna su a intermittenza non è un incidente di cui qualcuno si è occupato. Il cessato allarme arriva come un proprio evento a gravità warning che indica i monitor tornati attivi; chi risponde chiude l'incidente in PagerDuty.

Sonde esterne + la tua policy di escalation

Rilevato dall'esterno, gestito in escalation internamente

171+ località
fino a tre aree geografiche devono concordare
un evento di trigger
La tua policy di reperibilità
chiama, fa escalation, registra

Un controllo di salute interno condivide la tua area geografica, il tuo load balancer e la tua giornata storta, e ammutolisce insieme a loro. Le sonde in oltre 70 paesi falliscono in modo indipendente da te — l'unico tipo di prova che vale la pena svegliare un collega alle 4 del mattino.

Ogni evento

Sette eventi, una routing key

Ogni riga è un singolo POST a Events API v2 — nessun template da mantenere, nessun campo da mappare, niente da tenere in funzione dal tuo lato.

Confronta tutti i 12 canali di avviso
EventoGravitàCosa dice il riepilogo
Interruzione confermatacriticalIl nome del monitor, contrassegnato DOWN
Riepilogo della tempestacritical"9 monitors down — Signing API +8 more (Uptimia incident #482)"
Aggiornamento di adesionecriticalQuanti altri monitor si sono aggiunti allo stesso incidente
Promemoria di down persistentecritical"Still down: 3 of 9 monitors" quando scatta un passo successivo dell'escalation
Soglia del serverwarningCPU, memoria, disco o carico oltre il limite impostato
RipristinowarningDi nuovo attivo — un singolo monitor riporta anche per quanto tempo è rimasto down
Evento di testinfoUn saluto da Uptimia, inviato quando premi Invia test

Domande frequenti sull'integrazione PagerDuty

01Cosa mi serve dal lato PagerDuty?+
Un servizio con un'integrazione Events API v2. In PagerDuty: Services → New Service → scegli Events API v2 come tipo di integrazione, poi copia la Integration Key dalla scheda Integrations del servizio. Quella chiave è l'unico valore che Uptimia memorizza — non c'è nessuna app da autorizzare, nessun account utente da collegare e niente da ospitare.
02Uptimia risolve l'incidente quando il sito torna online?+
No. Ogni evento inviato da Uptimia è un trigger, incluso il cessato allarme: il ripristino arriva come un proprio evento a gravità warning che indica cosa è tornato attivo, e l'incidente in PagerDuty resta aperto finché qualcuno non lo chiude lì. Un controllo che torna su non equivale a un'interruzione di cui qualcuno si è occupato, quindi l'ultima parola spetta a chi risponde.
03Un'unica interruzione mi avviserà nove volte?+
No, se quei monitor condividono una policy di escalation. Il raggruppamento è attivo per impostazione predefinita e riunisce tutto ciò che fallisce nella stessa finestra temporale in un unico incidente Uptimia, così PagerDuty riceve un solo evento che lo identifica: "9 monitors down — Signing API +8 more (Uptimia incident #482)". I monitor che si aggiungono in seguito generano un solo evento di aggiornamento limitato invece di uno per monitor, e un unico cessato allarme quando sono tutti tornati attivi. I monitor senza una policy di escalation collegata vengono avvisati uno per uno, e il raggruppamento può essere disattivato nelle impostazioni di Alerting se lo desideri.
04Quale escalation prevale — quella di Uptimia o quella di PagerDuty?+
Qualunque tu abbia collegato al monitor — e usarle entrambe raddoppia solo il rumore. I team che vivono già in PagerDuty lasciano che sia lui a gestire la rotazione, collegando il monitor a un unico contatto PagerDuty. Le policy di escalation proprie di Uptimia — passi temporizzati verso altre persone e canali, che costruisci tu stesso a partire dal piano Professional — sono pensate per i team senza uno strumento di reperibilità.
05Prendere in carico in PagerDuty lo prende in carico anche in Uptimia?+
No — il collegamento è a senso unico: Uptimia pubblica eventi, PagerDuty non risponde mai. Prendere in carico in PagerDuty ferma l'escalation di PagerDuty; prendere in carico nella dashboard di Uptimia ferma quella di Uptimia. È anche per questo che i payload di PagerDuty non contengono mai, di proposito, un link di presa in carico, a differenza dei canali di chat — un flusso automatico e le pipeline di log dietro di esso non dovrebbero poter silenziare un'escalation.
06Quali monitor possono attivare un incidente?+
Tutti quanti — uptime, transazioni, velocità delle pagine, real-user monitoring, SSL, domini, malware, server, heartbeat, blacklist, DNS e controlli API. Ognuno scrive il proprio riepilogo indicando il monitor e cosa gli è successo, e ognuno invia il proprio cessato allarme quando il controllo torna a passare.
07Come vengono mappate le gravità?+
Le interruzioni confermate arrivano come critical, così come gli avvisi di scadenza e degrado inviati per singolo monitor — se preferisci che questi non avvisino nessuno, inviali invece a un canale di chat. Le soglie delle risorse del server — CPU, memoria, disco, carico — e ogni ripristino arrivano come warning; lo stesso vale per gli incidenti raggruppati sollevati a livello di anomalia. L'evento di test arriva come info. Ogni evento porta anche source uptimia.com e un componente che indica il tipo di controllo ("Uptime Monitoring", "SSL Certificate", "API Monitoring"), oppure "Incident group" quando l'avviso è stato generato tramite una policy di escalation.
08Monitor diversi possono avvisare servizi diversi?+
Sì. Aggiungi un'integrazione per ogni Integration Key — ognuna diventa un contatto a sé — poi collega i monitor al contatto che corrisponde alla rotazione responsabile. Un replay del checkout può avvisare il servizio dei pagamenti mentre un avviso sul disco va all'infrastruttura.
09Cosa succede se la chiave è sbagliata o PagerDuty è irraggiungibile?+
La chiamata è limitata nel tempo — dieci secondi per connettersi, trenta in totale — così un endpoint lento o irraggiungibile non può bloccare il resto dell'invio degli avvisi, e l'esito viene registrato insieme all'avviso. Ogni altro contatto su quel monitor viene notificato in modo indipendente da questo. Conviene scoprire una chiave digitata male con Invia test, non durante un'interruzione.
10PagerDuty è disponibile su ogni piano?+
Sì — è un canale di avviso integrato, incluso in ogni piano e nella prova gratuita di 30 giorni, senza alcun addebito per evento da parte di Uptimia. Quanto paghi a PagerDuty per i posti utente e le sue funzionalità di escalation riguarda solo te e PagerDuty.

Avvisi di tempo di inattività, dritti alla tua reperibilità

Collega PagerDuty con una chiave, e ogni guasto confermato chiama chi è reperibile — con le prove che lo aspettano in Uptimia quando arriva.

La tua reperibilità, non una trasmissione Una chiave, senza codice Prova gratuita di 30 giorni Senza carta di credito
PagerDuty è un canale di avviso integrato — ogni controllo eseguito da Uptimia può attivare un incidente.