Monitorização de sites com alertas PagerDuty
A Uptimia verifica os seus sites, certificados e processos de checkout a partir do exterior da sua rede e regista cada falha confirmada como um incidente no PagerDuty. A partir daí, a sua política de escalonamento assume o controlo — um telemóvel toca, depois o seguinte quando ninguém atende, até alguém assumir o caso.
Overview
Last 7 DaysOs alertas precisam de um responsável, não de uma audiência
Um alerta de chat é uma difusão: todos o veem, por isso ninguém é responsável por ele. O PagerDuty transforma a mesma falha numa atribuição — um nome, uma contagem decrescente, e o nome seguinte quando a contagem chega ao fim.
Visto por todos, da responsabilidade de ninguém
Todos os que veem a mensagem presumem que um colega mais próximo de um teclado está a tratar do assunto, e num domingo a sala inteira está a dormir em uníssono. Um canal não faz ideia de quem está de folga.
Um nome, um temporizador, depois um telefonema
O PagerDuty já sabe de quem é a semana, que número ligar e o que fazer quando ninguém atende. A única coisa que não consegue fornecer é a razão para começar: a prova, a partir do exterior da sua rede, de que um visitante real não conseguiu carregar a página.
Uma interrupção, um telefonema
Uma falha na sua infraestrutura pode deixar nove verificações vermelhas ao mesmo tempo — checkout, API, início de sessão, tudo no mesmo minuto. A Uptimia agrupa-as num único incidente, e o PagerDuty faz tocar um único telemóvel: o de quem estiver de prevenção nessa semana.
Ligue o PagerDuty em três passos
Crie um serviço no PagerDuty, copie a chave que este lhe fornece, e cole-a na Uptimia. Não há nenhuma aplicação para autorizar nem nada seu para manter em funcionamento.
Copie a chave do PagerDuty
Crie um serviço no PagerDuty — a chave apresentada é tudo o que a Uptimia precisa.
Cole-a na Uptimia
Guarde a chave, e um evento de teste comprova o encaminhamento na hora.
Deixe o PagerDuty gerir o escalonamento
As suas escalas, substituições e telefonemas ficam no PagerDuty — a Uptimia regista o incidente e recua.
Ligue o PagerDuty à Uptimia
Todos os passos, no Centro de Ajuda: criar o serviço no PagerDuty, copiar a chave, e associá-la aos seus monitores.
Qualquer verificação que execute pode acionar o seu pager
Fazer ping à página inicial só diz respeito à página inicial. A Uptimia também percorre um início de sessão passo a passo, segue uma cadeia de API que falha na terceira chamada e nota quando uma tarefa agendada nunca reporta — e qualquer um destes casos pode acionar o pager.
Encaminhe cada sistema para a equipa responsável
Acione uma única escala para tudo, ou dê a cada sistema o seu próprio serviço — o checkout para a equipa da loja, os servidores para a equipa de plataforma, e as descobertas de baixo risco para um canal que espera pela manhã.
Os canais são lidos.Os pagers são atendidos.
Toda a plataforma no período de teste — todos os tipos de verificação, uma única chave, e um incidente registado no momento em que uma falha é confirmada.
Acionamento no PagerDuty, evidência na Uptimia
O evento diz o que falhou e com que gravidade, que é tudo o que um responsável precisa. O veredicto por sonda, o gráfico do tempo de resposta e a cronologia do incidente estão à espera na Uptimia para quem escrever o acompanhamento.
O que o evento realmente transporta
Todos os acionamentos são o mesmo JSON para a Events API v2: um resumo do que falhou, source uptimia.com, uma gravidade, e um componente que identifica o tipo de verificação — ou Incident group sempre que uma política de escalonamento o gerou. Nada para mapear ou analisar.
Confirmado antes de acionar o pager
Uma sonda com azar nunca acorda ninguém sozinha. Nas verificações de disponibilidade, velocidade, certificado e transação, define quantas regiões independentes têm de concordar — até três — antes de um evento ser enviado.
Uma tempestade, um incidente
Os monitores que partilham uma política de escalonamento e falham em conjunto são agrupados num único incidente Uptimia, e o PagerDuty recebe um único evento que o identifica.
A manutenção mantém-se silenciosa
As janelas planeadas suprimem os alertas, por isso uma implementação às 23:00 nunca se transforma num telefonema.
Tempo de reação registado
Numa política de escalonamento, a Uptimia regista a data e hora das suas próprias confirmações, por isso o incidente fica com o registo de quem o assumiu e quantos minutos demorou.
Apenas factos — por conceção
Os canais de chat recebem uma ligação de confirmação; o PagerDuty e as cargas úteis de webhook nunca a recebem — um fluxo automático de pipelines de registos nunca deve poder silenciar um escalonamento. Confirme no PagerDuty ou na Uptimia, cada um para o seu próprio escalonamento.
Como funcionam os alertas de monitorização PagerDuty
A Uptimia verifica os seus sites a partir de mais de 171 localizações externas e, quando uma verificação falha, regista um incidente no PagerDuty — a sua política de escalonamento chama quem estiver de prevenção e continua até alguém confirmar. O incidente identifica o monitor, o que correu mal e a sua gravidade, e quando a verificação recupera, um segundo evento leva o sinal de tudo resolvido ao mesmo serviço.
A recuperação é um evento, não uma resolução
Todos os eventos enviados pela Uptimia são acionamentos, nunca resoluções — uma verificação que volta a ficar ativa de forma instável não é um incidente que alguém tratou. O sinal de tudo resolvido chega como o seu próprio evento de gravidade warning, identificando os monitores que recuperaram; é o responsável quem fecha o incidente no PagerDuty.
Detetado no exterior, escalonado no interior
Uma verificação de estado interna partilha a sua região, o seu balanceador de carga e o seu mau dia, e fica em silêncio junto com eles. As sondas em mais de 70 países falham de forma independente de si — que é o único tipo de evidência que justifica acordar um colega às 4 da manhã.
Sete eventos, uma única chave de encaminhamento
Cada linha é um único POST para a Events API v2 — sem modelos para manter, sem campos para mapear, sem nada para manter em funcionamento do seu lado.
Compare os 12 canais de alerta →| Evento | Gravidade | O que o resumo diz |
|---|---|---|
| Interrupção confirmada | critical | O nome do monitor, marcado como DOWN |
| Resumo da tempestade | critical | "9 monitors down — Signing API +8 more (Uptimia incident #482)" |
| Atualização de adesão | critical | Quantos mais monitores aderiram ao mesmo incidente |
| Lembrete de indisponibilidade contínua | critical | "Still down: 3 of 9 monitors" quando um passo de escalonamento posterior dispara |
| Limiar do servidor | warning | CPU, memória, disco ou carga acima do limite definido |
| Recuperação | warning | Operacional novamente — um único monitor também indica há quanto tempo |
| Evento de teste | info | Uma saudação da Uptimia, enviada quando prime Enviar teste |
Perguntas frequentes sobre a integração PagerDuty
01O que preciso do lado do PagerDuty?+
02A Uptimia resolve o incidente quando o site volta a funcionar?+
03Uma única interrupção vai acionar o meu pager nove vezes?+
04De quem é o escalonamento que prevalece — o da Uptimia ou o do PagerDuty?+
05Confirmar no PagerDuty também confirma na Uptimia?+
06Que monitores podem acionar um incidente?+
07Como são atribuídas as gravidades?+
08Monitores diferentes podem acionar pagers de serviços diferentes?+
09O que acontece se a chave estiver errada ou o PagerDuty estiver inacessível?+
10O PagerDuty está disponível em todos os planos?+
Alertas de indisponibilidade, diretos para quem está de prevenção
Ligue o PagerDuty com uma única chave, e cada falha confirmada chama quem estiver de prevenção — com a evidência à espera na Uptimia quando lá chegar.