Políticas de escalonamento de incidentes que alertam até alguém responder.
Um alerta sem resposta tem de chegar a outra pessoa. Uma política de escalonamento leva o incidente subindo pelos níveis, ao seu ritmo, e para no momento em que alguém o confirma.
Dry run
example incident · recomputed as you editO alerta que ninguém respondeu
Uma terça-feira à noite: o checkout deixa de funcionar e o incidente é confirmado. O engenheiro de prevenção está a dormir, o telemóvel está virado para baixo, e passam cinco minutos sem resposta.
Uma cadeia, todos os tipos de monitor
Uma política de escalonamento associa-se a tudo o que monitoriza — disponibilidade, fluxos de checkout, certificados, DNS, servidores e tarefas agendadas, todos por igual. Cada incidente confirmado neles sobe os mesmos níveis.
Crie a cadeia uma vez, reutilize-a em todo o lado
Dê um nome à política, adicione passos temporizados e escolha quem cada um alerta — das suas equipas, pessoas e contactos individuais. Uma simulação em direto mostra exatamente quem é alcançado antes de guardar.
- Nível após nível — alertar estas pessoas agora, estas em 5 minutos, todos em 15
- Qualquer destinatário — equipas, membros individuais, operadores ou contactos únicos
- Uma simulação em direto resolve cada passo para pessoas reais, e avisa sobre um passo que não alcançaria ninguém
Subir, confirmar, recuperar
Um toque confirma — sem sessão iniciada
Os alertas enviados por e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram e Twilio incluem uma ligação de confirmação assinada. Toque nela a partir do alerta — sem painel, sem palavra-passe — e a primeira confirmação para a subida para todos no incidente.
- Um toque a partir do alerta — uma ligação assinada, sem sessão iniciada e sem aplicação a abrir
- A primeira confirmação para a subida — ninguém mais acima nos níveis é alertado
- Tempo até à confirmação registado em cada incidente escalonado, para que o tempo de resposta seja medido, não adivinhado
Quanto tempo até alguém responder
"Respondemos depressa" não passa de uma esperança até haver um número ao lado. Cada incidente escalonado fica marcado com os minutos entre a confirmação do incidente e a primeira confirmação, e com o nome de quem respondeu.
- Minutos até à confirmação — contados desde o momento em que o incidente foi confirmado até à primeira confirmação
- Quem respondeu, e a partir de onde — o painel de controlo, ou a ligação assinada no próprio alerta
- Os incidentes sem resposta ficam assinalados — a linha do histórico diz "recuperado antes do passo 2", indicando onde a cadeia parou
Estado, próximo passo e MTTA
A página do incidente abre com uma faixa de estatísticas pensada para o meio de uma interrupção: se a cadeia ainda está a escalonar, a que horas dispara o próximo passo, quem confirmou e quanto tempo demorou.
- A escalonar, Confirmado ou Resolvido — o estado da cadeia num único emblema
- Próximo escalonamento com contagem decrescente — "Passo 3 · 5 min", ou "Em pausa" assim que alguém confirma
- MTTA em minutos — da confirmação do incidente até à primeira confirmação, na mesma faixa
Aviso de recuperação só para quem foi alertado
Quando o monitor recupera, a cadeia cancela de imediato todos os alertas pendentes — e o aviso de recuperação chega apenas às pessoas que foram realmente alertadas, não à equipa mais alargada que poderia ter sido alertada três níveis depois.
- A recuperação cancela todos os passos pendentes e a repetição, no instante em que o monitor volta
- Só os destinatários que foram alertados recebem o aviso de recuperação — mais ninguém é notificado
- O horário de silêncio é respeitado em cada nível, por pessoa — uma cadeia nunca o sobrepõe
O próximo incidente das 3 da manhã devia acordar a pessoa certa.Não toda a gente.
Cadeias de prevenção sem preços de prevenção — o escalonamento, a confirmação e os lugares de equipa vêm incluídos no preço fixo do plano, nunca faturados por utilizador.
Como funcionam as políticas de escalonamento
Crie uma cadeia uma vez, associe-a aos seus monitores e deixe que um incidente sem resposta a suba sozinho.
Crie a cadeia
Adicione passos temporizados — alertar estas pessoas agora, estas em 5 minutos, toda a equipa em 15 — escolhendo destinatários entre as suas equipas, membros e contactos.
Associe-a a monitores
Associe a política a qualquer monitor — disponibilidade, transação, SSL, heartbeat. Uma cadeia pode cobrir toda a frota; um monitor sem política simplesmente alerta todos ao mesmo tempo.
Sobe até alguém responder
Quando um incidente é confirmado, o passo 1 é acionado de imediato. Se ninguém confirmar, a cadeia alerta o nível seguinte segundo o horário definido — até alguém confirmar, ou o monitor recuperar.
No preço do plano, nunca por lugar
Tantos níveis quantos o incidente precisar
Encadeie passos temporizados, cada um a alertar equipas, membros ou contactos individuais. Uma repetição limitada volta a acionar o último passo — ou todos eles — durante o número de rondas que permitir, e para aí.
Confirmação num toque
Uma ligação assinada no alerta confirma o incidente — sem painel, sem palavra-passe.
Tempo até à confirmação
Cada incidente escalonado regista os minutos até à primeira confirmação, e quem a deu.
A pausa silencia a cadeia
Pausar um monitor cancela o seu escalonamento ativo e limpa todos os alertas pendentes.
Janelas de manutenção
Uma janela agendada suprime os alertas, para que o trabalho planeado nunca inicie uma cadeia.
Uma política para todos os tipos de monitor
Associe a mesma cadeia aos monitores de disponibilidade, SSL, transação, DNS e heartbeat — reutilizada em toda a frota, não reconstruída por monitor.
Todos os níveis, os 12 canais
Uma cadeia alerta através da mesma lista de contactos e dos mesmos 12 canais que qualquer monitor da Uptimia já usa — sem um segundo diretório para manter.
12 canais, uma lista de contactos — cada nível de uma cadeia alerta através do mesmo encaminhamento.
Ver o diretório completo de integrações →O que é uma política de escalonamento de incidentes?
Uma política de escalonamento de incidentes é uma cadeia reutilizável e temporizada de passos de alerta: alerta o primeiro interveniente no momento em que um incidente é confirmado e, se ninguém confirmar, alerta automaticamente as pessoas seguintes segundo um horário que definir — até alguém responder ou o monitor recuperar. Transforma um alerta único e disparado ao acaso numa cadeia com responsabilidade, para que um incidente nunca fique esquecido numa única caixa de entrada por ler.
Como funciona uma política de escalonamento?
O passo 1 dispara no instante em que o incidente é confirmado. Uma confirmação para a cadeia de imediato, e nenhum nível seguinte é alertado.
Sobe e depois alarga
sem confirmação em 5 min → a cadeia alerta o nível seguinte, depois repete até alguém responder
Tudo de uma vez versus uma cadeia
Alertar todos ao mesmo tempo funciona — até a única pessoa capaz de resolver o problema estar a dormir, fora de serviço ou ter silenciado o canal. Uma cadeia alerta primeiro a pessoa certa, e só alarga se ninguém responder.
Ver alertas & notificações →| O que acontece | Alertar tudo de uma vez | Cadeia de escalonamento |
|---|---|---|
| O incidente é confirmado | ✓ Alertado | ✓ Alertado |
| O primeiro interveniente não responde | Silêncio | ✓ Nível seguinte alertado |
| A pessoa de prevenção está a dormir às 3 da manhã | Sem resposta | ✓ Sobe para o apoio |
| O incidente continua aberto | Sem repetição | ✓ Repete, com limite |
| O monitor recupera | Aviso de recuperação para todos | ✓ Só para quem foi alertado |
Perguntas frequentes sobre escalonamento de incidentes
01O que é uma política de escalonamento de incidentes?+
02Em que é que isto difere de alertar todos ao mesmo tempo?+
03O que é a confirmação num toque, sem sessão iniciada?+
04O que acontece se ninguém confirmar?+
05Quem recebe o aviso de recuperação?+
06Uma política pode cobrir vários monitores?+
07O escalonamento respeita o horário de silêncio?+
08E se eu eliminar uma política, ou um passo não tiver ninguém atribuído?+
09Pausar um monitor interrompe o seu escalonamento?+
10A cadeia pode repetir para sempre?+
11Que canais pode um passo alertar?+
12Que planos incluem políticas de escalonamento?+
Chegue a alguém que o consiga resolver
Crie uma cadeia de escalonamento reutilizável em minutos, associe-a a todos os monitores que tiver e deixe de esperar que o primeiro alerta tenha chegado a alguém.