Saltar para o conteúdo

Monitorização de servidores que avisa antes da interrupção do serviço.

A maioria dos servidores não avaria — fica sem alguma coisa. Uma linha de bash instala o agente, 30 segundos depois já está a reportar, e o disco é corrigido aos 90%, não aos 100%.

Teste gratuito de 30 dias Sem cartão de crédito Linux · instala em menos de um minuto
Intervalo de reporte
30s
Métricas por servidor
17
Assinalado como offline em
90s
Histórico de métricas
1year

De um disco a encher a um alerta em 30 segundos

Os registos acumulam-se durante a noite e um dos seus servidores começa a ficar sem espaço em disco. Nada está ainda em baixo — um pequeno agente reporta a cada 30 segundos, por isso o alerta indica o servidor e a partição enquanto ainda há tempo para a libertar.

02:14:03 O /var ultrapassa 90% num servidorO reporte de 30 segundos mostra 92% — os alertas de disco são instantâneos, sem janela de tempo a máquina: ainda operacional
02:14:03 O alerta indica a partição"/var a 92%" logo na primeira linha — Slack, e-mail; não um alarme vago de "disco" a máquina: ainda operacional
02:29 Registos antigos limpos — espaço libertadoO reporte seguinte do agente, 30 segundos depois, mostra o /var a 62% a máquina: ainda operacional
02:29:31 Resolvido automaticamente — é avisado de que passouUm aviso de recuperação vai para os mesmos canais que soaram o alarme a máquina: nunca caiu
15 minultrapassar → normalizar
A avaria que nunca aconteceu.02:29:31
Um /var cheio derruba a máquina toda — bases de dados, registos, sites, tudo. Este chegou a um pico de 92%, porque o alerta chegou enquanto ainda havia margem de manobra.
partição exata + valor realinstantâneo, por partiçãoaviso de recuperação na normalizaçãoCPU · RAM · carga · disco — a cada 30 s
E sem o agente? Um disco a encher não dá sintomas até aos 100% — e depois tudo na máquina falha de uma vez. A subida das 2 da manhã transforma-se numa descoberta às 7, com cinco horas mortas pelo meio. máquina parada

17 métricas, um agente em bash

Um agente em bash reporta 17 métricas a cada 30 segundos — já em gráficos, para que consiga ver o estado de um servidor sem ter de iniciar sessão para verificar.

CPU e cargaUtilização e média de carga a 1·5·15 min
Memória e swapUsada, livre — e swapping
Disco % — por partiçãoTodas as partições, não só a /
Utilização de inodesCheio de ficheiros minúsculos? Vai saber
17 métricas · 30 s lidas diretamente do sistema · sem iniciar sessão
Processos e núcleosContagem vigiada, núcleos conhecidos
Rede entrada / saídaDébito, nas duas direções
Anfitrião e atualidadeKernel, SO, tempo de atividade — e um pulso em direto
Os alertas disparam em violações persistentes, não em picos momentâneos: CPU, memória, carga, swap, disco e inodes por partição, contagem de processos, débito de rede — e o mais ruidoso de todos: o servidor a ficar em silêncio. silêncio = alerta

Alertas e histórico

Sem falsos alarmes às 3 da manhã

Alertado por problemas reais, não por picos momentâneos

A Uptimia só dispara um alerta de CPU, memória, swap, carga, contagem de processos ou rede quando todas as leituras na sua janela se mantêm acima do limiar — um pico de dois segundos passa em silêncio, um problema persistente não.

  • Decide quanto tempo um problema tem de se manter — entre 1 minuto e meia hora, definido por métrica
  • Nada para configurar à partida — CPU, memória e disco são vigiados desde o primeiro reporte; adicione os outros quando quiser
  • Disco e inodes são a exceção — disparam no instante em que uma partição ultrapassa o limiar; um disco cheio não pode esperar
Onde os seus alertas são entregues
CPU02:05:00amostra de 30 segundos94%
CPU02:07:30amostra de 30 segundos96%
CPU02:10:00amostra de 30 segundos93%
10/10amostras
acima de 90%
Alerta de CPU — persistente02:10:01
Todas as leituras durante 5 minutos seguidos mantiveram-se acima de 90% — um problema real, não um pico que se resolveu sozinho.
SlackE-mailSMS+ PagerDuty…
Um pico de dois segundos? Uma única amostra elevada nunca sobrevive à janela — passa em silêncio. Só o disco e os inodes disparam de imediato. sem alerta
Disco por partição

Saiba exatamente qual o disco que encheu, instantaneamente

A Uptimia associa os alertas de espaço em disco e de inodes a cada partição, por isso o incidente diz /var — e não deixa uma máquina inteira para vasculhar. Cada partição abre e resolve o seu próprio incidente.

  • Um incidente por partição — /, /var, /data são cada um vigiado e resolvido de forma independente
  • A partição e o valor no alerta — "Utilização de disco acima de 90% em /var", a 92%
  • Exceções por partição — mantenha uma partição concorrida como /var numa percentagem mais rígida do que o resto
Se ninguém confirmar um alerta
agenteweb-01.caldmont.coma reportar a cada 30 s
/raizpercurso de incidente próprio61%
Alerta de disco — /var02:14:09
Utilização de disco acima de 90% em /var — a 92%. Instantâneo, sem janela de espera; um incidente próprio enquanto o /data se mantém verde.
por partiçãoinstantâneotambém inodes
/datavolume de dadospercurso de incidente próprio38%
O /var mais concorrido do que o resto? As exceções por partição mantêm uma partição num limiar mais rígido do que a predefinição da máquina. /var → 85%
Deteção de offline

Três reportes falhados abrem um incidente

Se um servidor ficar completamente silencioso — kernel panic, energia, rede — uma verificação separada, feita a cada minuto, repara nos reportes em falta e abre um incidente crítico. Uma máquina morta não se pode esconder atrás do "sem notícias, boas notícias".

  • Assinalado como offline após 3 reportes falhados — 90 segundos de silêncio à cadência de 30 segundos
  • Resolve-se automaticamente na próxima ligação — encerra-se sozinho assim que o agente volta
  • Sem falsos "offline" na configuração — um servidor novo à espera do primeiro reporte nunca é assinalado
Verificações de fora para dentro: ping e porta TCP
1
Reporte falhado
02:40:30 · esperado a cada 30 s
aguardar
2
Ainda em silêncio
02:41:00 · segunda falha
aguardar
3
Offline confirmado
02:41:30 · ~90 s de silêncio
crítico
Servidor offline02:41:30
O web-03 ficou completamente às escuras — kernel panic, energia ou rede. Resolve-se automaticamente assim que o agente voltar a reportar.
SlackE-mailSMS+ PagerDuty…
Acabou de instalar o agente? Um servidor novo à espera do primeiro reporte nunca é assinalado como offline. sem falso alarme
Histórico e tendências

Um ano de histórico, picos incluídos

Os números em direto dizem o que está mal agora; as tendências dizem que já vem a subir há semanas. A Uptimia guarda os dois — 6 cartões de métricas e 5 gráficos, a lerem os mesmos dados que os alertas.

  • 6 cartões de métricas + 5 gráficos de séries temporais — CPU, carga, memória, disco, rede — atualizados a cada 30 segundos
  • Detalhe em bruto de 30 segundos durante 24 horas — depois médias e máximos horários, para que os picos sobrevivam, durante um ano inteiro
  • Os gráficos escolhem a fonte certa — aproxime para a última hora ou o último ano e os dados mudam automaticamente
Receba estes números por e-mail, por agendamento
TENDÊNCIAMemória usada — web-01
últimos 30 dias · dados horários · atualizado a cada 30 s
30 d ago15 dnow
A subir de 40% para 70% ao longo de um mês — o tipo de problema que uma fotografia em direto não consegue mostrar.
Em bruto · a cada 30 segundos
todas as amostras, guardadas 24 h
02:10:00 → cpu 93% · mem 71%
Média horária · 1 ano
a linha de tendência — suave,
comparável mês a mês
Máximo horário · 1 ano
os picos sobrevivem à agregação —
um pico de 2 minutos continua visível um ano depois
Aproxime onde quiser — a última hora lê dados em bruto de 30 segundos, o último ano lê dados horários; os gráficos mudam de fonte automaticamente. automático

A reportar em menos de um minuto

Uma linha para instalar — sem pacotes, sem runtime, e um único script remove todos os vestígios.

Passo 130 s

Execute uma linha de instalação como root

A linha única coloca um pequeno script em bash em /opt/uptimia e regista um temporizador systemd — ou cron, se não houver systemd.

$ curl -s uptimia.com/server-agent/install.sh | bash -s -- KEY
# ✓ systemd timer uptimia-agent.timer created
Passo 230 s

O agente começa a reportar

A cada 30 segundos envia 17 métricas — CPU, memória, disco, carga e mais — autenticadas com uma chave por servidor.

Estado do agente
Ligado — a reportar a cada 30 s
primeira ligação recebida · 17 métricas
Servidor
web-01 · Ubuntu 22.04 · 4 cores
Passo 3automático

Defina limiares, seja alertado

CPU, memória e disco começam nos 90%. Um limiar ultrapassado abre um incidente e alerta a sua equipa onde já trabalha.

#infra-alerts
Uptimia 02:14
⚠ Disco — /var a 92% no web-01
acima de 90%incidente por partição02:14:03
Também enviado a E-mailPagerDuty

Execute uma linha de bash.Saiba antes de o disco encher.

Todos os servidores, todas as métricas, todos os canais de alerta — grátis durante 30 dias, sem nenhum extra pago.

Comece o seu teste gratuito de 30 dias
30 dias grátis sem cartão de crédito cancele quando quiser

Também incluído

Alertas nos canais que já usa

Os alertas de servidor partilham uma lista de contactos com todos os outros monitores — e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage e webhooks personalizados.

E-mailSlackTeamsPagerDutyTelegramWebhook+ mais

Modo de manutenção

Aplique patches ou reinicie sem acumular alertas — todos os alertas ficam silenciados enquanto as métricas continuam a chegar.

janela de reinício · alertas silenciados

Avisos de recuperação

Fique a saber quando termina, não só quando começou — um aviso de "recuperado" em cada resolução.

✓ recuperado · memória de volta a 58%

Histórico que sobrevive a uma mudança para um plano inferior

Ao mudar para um plano inferior, as métricas de um servidor não são eliminadas — só os alertas ficam em silêncio. Ao mudar para um plano superior, os servidores suspensos reativam-se sozinhos.

a receção de dados continua · alertas em pausa

Um painel para tudo

Os servidores ficam ao lado dos seus monitores de disponibilidade, SSL, heartbeat e DNS — os mesmos contactos, grupos e funções, um único lugar para consultar.

web-01.caldmont.comSERVIDOR www.caldmont.comDISPONIBILIDADE db-backup · nightlyHEARTBEAT

Desinstale numa linha

Um único script remove por completo a unidade systemd e /opt/uptimia — sem deixar vestígios.

$ curl -fsS uptimia.com/server-agent/uninstall.sh | bash

O que é a monitorização de servidores?

A monitorização de servidores é o acompanhamento contínuo do estado de um servidor — CPU, memória, disco, carga, rede e processos — para que seja alertado no momento em que um recurso escasseia ou a máquina fica offline. A monitorização de servidores Linux da Uptimia faz isto com um pequeno agente que reporta 17 métricas a cada 30 segundos e levanta um incidente quando uma métrica ultrapassa o seu limiar.

O agente

Como funciona o agente?

O seu servidor Linux
lê /proc · df
~17 métricas · a cada 30 s
Uptimia
gráficos + alertas

Um script em bash, num temporizador systemd, envia um pequeno reporte, autenticado com uma chave por servidor — só é preciso bash e curl.

Lógica de alertas

Alertas persistentes vs. instantâneos

CPU · carga · memória
janela inteira acima do limiar
depois alerta
Disco · inodes
alertam de imediato

um pico passa em silêncio — só uma violação persistente aciona o alerta; uma partição cheia não pode esperar, por isso o disco dispara de imediato

Os sinais vitais

Que métricas de servidor deve monitorizar?

Os sinais que preveem incidentes reais — e como a Uptimia vigia cada um. CPU, memória e disco são vigiados desde o primeiro reporte; os restantes ficam ao seu critério ativar.

Todos os tipos de monitor numa só conta
MétricaLimiar predefinidoComo a Uptimia alerta
Utilização de CPU90%persistente · janela de 5 min
Memória90%persistente · janela de 5 min
Disco · por partição90%instantâneo, por partição
Média de cargadesativado por predefiniçãopersistente · janela
Swapdesativado por predefiniçãopersistente · janela
Contagem de processosdesativado por predefiniçãopersistente · janela
Débito de rededesativado por predefiniçãopersistente · janela
Servidor offline3 reportes falhadoscrítico · ~90 s

Perguntas frequentes sobre monitorização de servidores

01O que é a monitorização de servidores?+
O acompanhamento contínuo do estado de um servidor — CPU, memória, disco, carga, rede e processos — para que seja alertado quando um recurso escasseia ou a máquina fica offline. O pequeno agente da Uptimia reporta 17 métricas a cada 30 segundos e abre um incidente quando uma métrica ultrapassa o seu limiar.
02Como funciona a monitorização de servidores da Uptimia?+
Uma instalação de uma linha coloca um pequeno script em bash no seu servidor e regista um temporizador systemd (ou cron). A cada 30 segundos lê /proc e df e envia 17 métricas — CPU, memória, swap, disco por partição, inodes, carga, rede, contagem de processos e informação do SO — autenticadas com uma chave por servidor. Tem 6 cartões de métricas, 5 gráficos de séries temporais e alertas por limiar — monitorização de servidores e alertas a partir de um único agente pequeno.
03Que sistemas operativos são suportados?+
O instalador de uma linha visa o Linux — o agente lê /proc e df, por isso corre em distribuições padrão (Ubuntu, Debian, RHEL, Alma e por aí fora). Também existem agentes para macOS e Windows PowerShell que reportam as mesmas métricas, configurados à mão (launchd no macOS, uma Tarefa Agendada no Windows) em vez de pela linha única. Não existe agente para BSD — para essas máquinas, use as verificações de fora para dentro da Uptimia (ping, porta TCP, HTTP).
04Posso mudar a frequência com que o agente reporta?+
Não — a cadência de 30 segundos é fixa. O que controla são os alertas: o limiar de cada métrica, e durante quanto tempo um problema tem de se manter antes de alguém ser alertado.
05Um pico breve de CPU vai acionar um alerta às 3 da manhã?+
Não. Os alertas de CPU, memória, swap, carga, contagem de processos e rede só disparam quando todas as leituras na sua janela (predefinição de 5 minutos) se mantêm acima do limiar — um pico momentâneo passa em silêncio. As exceções são o disco e os inodes, que disparam de imediato: um disco cheio não pode esperar por uma janela.
06Com que rapidez fico a saber se um servidor fica indisponível?+
Se um servidor deixar completamente de reportar, uma verificação feita a cada minuto assinala-o como offline após 3 reportes falhados — 90 segundos de silêncio — e abre um incidente crítico que se resolve automaticamente quando o agente volta a ligar-se. Três reportes falhados confirmam que desapareceu mesmo; um servidor novo à espera do primeiro reporte nunca é assinalado por engano.
07O agente lê os meus registos ou executa comandos?+
Não. É apenas monitorização de recursos do servidor — a carga útil é CPU, memória, disco, rede, carga, tempo de atividade, contagem de processos e informação básica de SO/kernel/nome de anfitrião. Sem registos, sem conteúdo de ficheiros, sem comandos remotos — um reporte de números numa única direção.
08Quanto histórico é guardado?+
As amostras em bruto de 30 segundos são guardadas durante 24 horas. Para lá disso, a Uptimia guarda médias e máximos horários — os picos sobrevivem no máximo — durante um ano inteiro. Os gráficos mudam de fonte automaticamente consoante o intervalo.
09Posso monitorizar contentores Docker ou Kubernetes?+
O agente reporta métricas ao nível do anfitrião — o /proc e o df da máquina inteira, não estatísticas por contentor. É adequado para os servidores onde os seus contentores correm; atualmente não existe recolha ao nível do contentor.
10A monitorização de servidores é um extra pago?+
Não. Todos os planos pagos incluem monitorização de servidores a par da monitorização de disponibilidade, SSL, transações, DNS e heartbeat — nunca como um extra pago. Os planos diferem apenas na quantidade de servidores incluídos. O plano gratuito não inclui monitores de servidor; o teste gratuito de 30 dias inclui (até 50 servidores), sem necessidade de cartão de crédito.

Comece hoje a monitorizar os seus servidores.

Execute uma linha de bash, e um disco a encher, um CPU sobreaquecido ou uma máquina às escuras chegam até si enquanto ainda há margem de manobra.

Teste gratuito de 30 dias Sem cartão de crédito Bash + curl · desinstala numa linha
A monitorização de servidores está disponível no teste de 30 dias e em todos os planos pagos, junto de todos os outros tipos de monitor.