Calculadora de indisponibilidade:
que percentagem de disponibilidade deixou a sua interrupção?
Indique a indisponibilidade registada — devolvemos a percentagem de disponibilidade, as metas de SLA que ela incumpre, o custo com os seus próprios números e a divisão por fase. A direção oposta da nossa calculadora de disponibilidade, que parte do SLA.
Um mês de indisponibilidade, avaliado
A mesma matemática da escala de SLA, mas ao contrário: parta dos minutos perdidos e veja que metas eles ainda cumprem.
Indisponibilidade num mês → nota de disponibilidade
mês = 30,42 dias · 43 800 min| Indisponibilidade / mês | Equivale a | Disponibilidade | Nota | Meta mais exigente cumprida |
|---|---|---|---|---|
| 1 minute | um deploy falhado, detetado depressa | 99.9977% | quatro noves | 99.99% |
| 4m 22s | todo o orçamento de quatro noves | 99.99% | quatro noves | 99.99% |
| 43m 48s | todo o orçamento de três noves | 99.9% | três noves | 99.9% |
| 3h 39m | uma tarde difícil | 99.5% | dois noves | 99.5% |
| 7h 18m | um problema recorrente | 99% | dois noves | 99% |
| 24 hours | um incidente com nome próprio | 96.7123% | um nove | nenhuma delas |
Transformar incidentes num número de indisponibilidade
Três regras decidem o número:
- Some, não faça a média. A indisponibilidade da janela é a soma da duração de cada incidente — três interrupções curtas não significam «disponível na maior parte do tempo».
- Meça de ponta a ponta. Um incidente começa no primeiro pedido falhado, não no primeiro alerta — e termina quando o serviço é verificado, não quando a correção é publicada.
- Decida o que significa «em baixo» — por escrito. Interrupção total, checkout avariado, ou apenas lento? Escolha a definição antes do incidente, ou a discussão acontece depois dele.
Depois é uma divisão: indisponibilidade ÷ janela. O registo à direita é o mês de junho de uma pequena loja — a calculadora acima é essa última linha, avaliada.
Um mês, totalmente registado
caldmont.com · junhoPerguntas frequentes sobre indisponibilidade
Existem duas direções para a mesma fórmula. Partindo de uma percentagem de SLA obtém-se a indisponibilidade que ela permite (é o que faz a nossa calculadora de disponibilidade). Partindo da indisponibilidade registada, como esta página faz, obtém-se a percentagem de disponibilidade que ela produziu: (janela − indisponibilidade) ÷ janela × 100. Acrescentamos os dois números que uma folha de cálculo não dá: quanto custou e para onde foram os minutos.
Divida a indisponibilidade pela janela e multiplique por 100. Uma interrupção de 43m 48s num mês de 30,42 dias: 2 628 s ÷ 2 628 000 s × 100 = 0,1% de indisponibilidade — ou seja, 99,9% de disponibilidade. Duas regras: some todos os incidentes da janela — sem fazer a média — e meça desde o primeiro pedido falhado até à recuperação verificada.
Entre duas e três noves é a faixa normal para serviços de produção pequenos a médios — entre 43 minutos e 7 horas por mês. Três noves (43m 48s/mês) é a meta de referência: alcançável com um bom alojamento, rollbacks rápidos e alguém de prevenção. Se o seu mês ultrapassar as 7 horas, a tabela de danos acima mostra a nota que está a entregar — e a secção da cronologia no resultado mostra onde recuperar minutos primeiro.
Ignore os valores por minuto divulgados em estudos empresariais — juntam bancos e padarias na mesma média. O seu teto é a sua própria aritmética: receita por hora × horas de indisponibilidade, mais as pessoas que largaram tudo, mais qualquer penalização contratual. A secção de custo do resultado calcula isto ao vivo com os seus números. Duas ressalvas. Alguns compradores interrompidos voltam mais tarde, por isso a receita perdida é um teto. E alguns custos nunca cabem numa folha de cálculo: confiança, SEO, a acumulação de pedidos de apoio.
Contam da forma que decidiu que contariam — antes do incidente. Prática comum: um caminho crítico avariado (checkout, início de sessão) conta na íntegra mesmo que a página inicial carregue; um estado degradado mas funcional conta à parte, ou não conta de todo. Escreva a definição e aplique-a sempre da mesma forma. As discussões sobre SLA giram em torno deste parágrafo, não da aritmética.
MTTR é o tempo médio de recuperação: indisponibilidade total ÷ número de incidentes. É a sua melhor alavanca, porque reduzi-lo para metade reduz a indisponibilidade para metade sem evitar um único incidente. MTBF é o tempo médio entre falhas, ou seja, com que frequência as coisas avariam. Depende da arquitetura e da disciplina nas alterações, não da velocidade de resposta. Juntos dão a disponibilidade: MTBF ÷ (MTBF + MTTR). O RTO é o MTTR que prometeu — quanto tempo uma interrupção pode durar antes de o plano de recuperação falhar. Teste-o antes que um incidente o faça.
Ataque o MTTR antes do MTBF — recuperar mais depressa é mais barato do que falhar menos. E dentro do MTTR, ataque primeiro a deteção: é a única fase que uma ferramenta consegue encurtar por completo. No nosso exemplo prático, a deteção demorou 11 minutos e a correção demorou 4. Verificações a cada trinta segundos limitam o silêncio antes da primeira verificação falhada a meio minuto — não conseguem encurtar o envio do alerta nem o tempo que alguém demora a atender o telefone, e é por isso que a deteção encolhe quatro minutos aqui, não onze. O diagnóstico encolhe com provas (resultados de várias localizações, marcas temporais exatas); a correção em si encolhe com rollbacks ensaiados — essa parte depende da preparação de cada equipa.
Não é possível calcular o que não foi detetado — o reinício das 3 da manhã no nosso registo de junho só existe porque algo estava a monitorizar. A monitorização independente fornece os dados de que esta calculadora precisa: horas exatas de início e fim, a partir de fora da própria infraestrutura. Isto cobre todos os incidentes, incluindo os que aconteceram enquanto ninguém estava acordado. A Uptimia verifica a partir de mais de 171 localizações em mais de 70 países — a cada 60 segundos no plano Basic, a cada 30 a partir do Professional — e mantém esse registo automaticamente.
Continuar a explorar
43m 48s de indisponibilidade = 99,9%.
Ao longo de um mês, 43m 48s de indisponibilidade deixam 99,9% de disponibilidade — três noves. Em baixo: os mesmos minutos comparados com quatro metas de SLA comuns, quanto custam com os seus números, e para onde foram.
43m 48s, avaliados face a quatro metas comuns
Os orçamentos são por janela e somam-se entre incidentes — este veredito assume que estes foram os únicos minutos perdidos.
Veredito face a quatro metas comuns
uma interrupção face a quatro metas de SLAA fórmula, com os seus números
percentagem de indisponibilidadeConvenção: ano de 365 dias, mês = ano ÷ 12 (30,42 dias) — o mesmo que a nossa calculadora de disponibilidade e a escala de noves.
Os seus 43m 48s ≈ €14,037 — calculado a partir da receita, das pessoas e do investimento em publicidade introduzidos
Três valores decidem a fatura. Edite-os aqui — o total, as linhas e a navegação acima atualizam-se à medida que escreve.
A fatura discriminada
43m 48s = 0.73 hO que paga o crédito de SLA do alojamento numa interrupção de 43m 48s
Os créditos de SLA estão limitados a uma parte da mensalidade do alojamento, por isso raramente cobrem a perda. O número que reduz a perda é o tempo de deteção.
11m 0s da sua interrupção foi provavelmente atraso puro de deteção
Um incidente típico divide-se em 25% deteção · 39% diagnóstico · 9% correção · 27% recuperação. Aplicado aos seus 43m 48s — a deteção é a fatia que uma ferramenta elimina por completo.
Os seus 43m 48s, divididos por fase
divisão típica, à escalaNa fatura acima, só a fatia de deteção ≈ €3,525. A monitorização não corrige o deploy, mas elimina a maior parte da fatia de deteção.
Cronologia de uma interrupção de 43m 48s, minuto a minuto
Com verificações a cada 30 segundos, a linha das 11:08:40 passa a 11:04:30: o silêncio antes da primeira verificação falhada desce de 4m 40s para 30 segundos, e todas as linhas abaixo dela avançam esses quatro minutos.
As ferramentas grátis são só o começo.
O Uptimia cuida dos seus sites.
Uptime, SSL, validade de domínio, velocidade de página, transações — monitorização em 171+ locais em todo o mundo. Grátis por 30 dias.