Serverių stebėjimas, kuris įspėja anksčiau nei įvyksta sutrikimas.
Dauguma serverių nesugenda — jiems tiesiog kažko pritrūksta. Viena bash eilutė įdiegia agentą, po 30 sekundžių jis jau siunčia ataskaitas, o diskas sutvarkomas ties 90 %, ne ties 100 %.
CPU Usage
alerts only if every 30 s reading stays over 90% for 5 minDisk Usage
per mount · worst firstServer Details
reported by the agentNuo prisipildančio disko iki įspėjimo — 30 sekundžių
Per naktį prisikaupia žurnalų, ir viename serveryje pritrūksta vietos diske. Kol kas viskas veikia — mažas agentas siunčia ataskaitas kas 30 sekundžių, todėl įspėjime nurodomas ir serveris, ir diskas, kol dar spėsite jį išvalyti.
17 rodiklių, vienas bash agentas
Vienas bash agentas kas 30 sekundžių atsiunčia 17 rodiklių — jau sudėtų į grafikus, todėl serverio būklę matote prie jo neprisijungę.
Įspėjimai ir istorija
Budėtojas kviečiamas dėl tikrų problemų, ne trumpų šuolių
Uptimia siunčia CPU, atminties, swap, apkrovos, procesų skaičiaus ar tinklo įspėjimą tik tada, kai kiekvienas matavimas jūsų pasirinktu laikotarpiu lieka virš slenksčio — dviejų sekundžių šuolis praeina tyliai, o užsitęsusi problema — ne.
- Patys nusprendžiate, kiek problema turi trukti — nuo 1 minutės iki pusvalandžio, atskirai kiekvienam rodikliui
- Pradžiai nieko nustatinėti nereikia — CPU, atmintis ir diskas stebimi nuo pirmos ataskaitos; kitus įjungsite tada, kai prireiks
- Diskas ir inode yra išimtis — jie suveikia tą pačią akimirką, kai prijungimo taškas viršija ribą; pilnas diskas laukti negali
virš 90 %
Iš karto matote, kuris būtent diskas prisipildė
Uptimia disko vietos ir inode įspėjimus sieja su kiekvienu prijungimo tašku, todėl incidente nurodyta /var, o ne visa mašina, kurioje reikėtų ieškoti. Incidentas kiekvienam taškui sukuriamas ir užveriamas atskirai.
- Vienas incidentas kiekvienam taškui — /, /var ir /data sekami ir sprendžiami atskirai
- Įspėjime — ir taškas, ir reikšmė — „Disko naudojimas viršija 90 % prijungimo taške /var“, o iš tikrųjų 92 %
- Atskiros ribos kiekvienam taškui — labiau apkrautam taškui, tokiam kaip /var, galite taikyti griežtesnį procentą nei kitiems
Trys praleistos ataskaitos atidaro incidentą
Jei serveris visiškai nutyla — dėl branduolio klaidos, elektros ar tinklo gedimo — kas minutę vykdoma atskira patikra pastebi trūkstamas ataskaitas ir atidaro kritinį incidentą. Negyvas serveris nebepasislėps už tylos — tyla savaime dar nereiškia, kad viskas gerai.
- Serveris pažymimas neveikiančiu po 3 neatsiųstų ataskaitų — 90 sekundžių tylos, kai ataskaitos siunčiamos kas 30 sekundžių
- Išsisprendžia automatiškai, kai agentas vėl atsiliepia — incidentas užsidaromas tą pačią akimirką
- Diegiant klaidingai „neveikia“ nerodoma — naujas serveris, laukiantis pirmos ataskaitos, niekada nepažymimas
Metų istorija — su visais šuoliais
Gyvi skaičiai rodo, kas negerai dabar; tendencijos rodo, kad tai vyksta jau kelias savaites. Uptimia turi abu: 6 rodiklių korteles ir 5 grafikus, paremtus tais pačiais duomenimis kaip ir įspėjimai.
- 6 rodiklių kortelės + 5 laiko eilučių grafikai — CPU, apkrova, atmintis, diskas, tinklas — atnaujinama kas 30 sekundžių
- Neapdoroti 30 sekundžių duomenys 24 valandas — toliau valandiniai vidurkiai ir maksimumai, kad neprarastumėte šuolių, ištisus metus
- Grafikai patys pasirenka šaltinį — priartinkite paskutinę valandą ar paskutinius metus, ir duomenys persijungia automatiškai
kiekvienas matavimas, saugomas 24 val. 02:10:00 → cpu 93% · mem 71%
tendencijos linija — glotni, galima lyginti mėnesį su mėnesiu
šuoliai išlieka net apibendrinus duomenis — 2 minučių protrūkis matomas ir po metų
Ataskaitos — greičiau nei per minutę
Diegiama viena eilute – be paketų, be vykdymo aplinkos, o vienas skriptas pašalina visus pėdsakus.
Paleiskite diegimo eilutę kaip root
Diegimo eilutė įrašo nedidelį bash skriptą į /opt/uptimia ir užregistruoja systemd laikmatį — arba cron, jei systemd nėra.
# ✓ systemd timer uptimia-agent.timer created
Agentas pradeda siųsti ataskaitas
Kas 30 sekundžių jis siunčia 17 rodiklių — CPU, atmintį, diską, apkrovą ir kitus — autentifikuotus unikaliu kiekvieno serverio raktu.
Nustatykite slenksčius ir gaukite įspėjimus
CPU, atminties ir disko slenkstis iš pradžių — 90 %. Viršijus jį, sukuriamas incidentas ir įspėjama komanda jai įprastais kanalais.
Paleiskite vieną bash eilutę.Sužinokite, kol diskas dar neprisipildė.
Visi serveriai, visi rodikliai, visi įspėjimų kanalai — nemokamai 30 dienų, be jokių papildomų mokesčių.
Taip pat įskaičiuota
Įspėjimai tais kanalais, kuriais jau naudojatės
Serverių įspėjimai naudoja tą patį kontaktų sąrašą kaip ir visi kiti stebėjimo objektai — el. paštas, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage ir pasirinktiniai webhook adresai.
Techninės priežiūros režimas
Atnaujinkite ar perkraukite serverį be įspėjimų lavinos — visi įspėjimai nutildomi, o rodikliai toliau renkami.
Atsistatymo pranešimai
Sužinosite ne tik kada prasidėjo, bet ir kada baigėsi — apie kiekvieną atsistatymą gausite pranešimą.
Istorija išlieka ir sumažinus planą
Sumažinus planą serverio rodikliai neišnyksta — nutyla tik įspėjimai. Padidinus planą sustabdyti serveriai atsigauna patys.
Viskas viename valdymo skydelyje
Serveriai matomi šalia svetainių veikimo, SSL, veikimo signalų ir DNS stebėjimo objektų: tie patys kontaktai, grupės ir vaidmenys, viskas vienoje vietoje.
Pašalinama viena eilute
Vienas skriptas visiškai pašalina systemd vienetą ir /opt/uptimia — jokių likučių.
Kas yra serverių stebėjimas?
Serverių stebėjimas — tai nuolatinis serverio būklės sekimas: CPU, atmintis, diskas, apkrova, tinklas ir procesai, kad iš karto sužinotumėte, jei pritrūksta išteklių arba serveris nustoja veikti. „Uptimia“ Linux serverius stebi nedideliu agentu, kuris kas 30 sekundžių atsiunčia 17 rodiklių ir užregistruoja incidentą, kai rodiklis viršija nustatytą slenkstį.
Kaip veikia agentas?
Bash skriptas, paleidžiamas systemd laikmačiu, siunčia vieną nedidelę ataskaitą, patvirtintą unikaliu kiekvieno serverio raktu — reikia tik bash ir curl.
Užsitęsę ir momentiniai įspėjimai
šuolis praeina tyliai — įspėjimas siunčiamas tik dėl užsitęsusio viršijimo; pilnas prijungimo taškas laukti negali, todėl diskas suveikia iš karto
Kuriuos serverio rodiklius verta stebėti?
Ženklai, pagal kuriuos atpažįstami artėjantys incidentai, ir kaip juos seka „Uptimia“. CPU, atmintis ir diskas stebimi nuo pat pirmos ataskaitos; likusius įjungiate patys.
Visi stebėjimo tipai vienoje paskyroje →| Rodiklis | Numatytasis slenkstis | Kaip Uptimia įspėja |
|---|---|---|
| CPU naudojimas | 90% | nuolatinis · 5 min. intervalas |
| Atmintis | 90% | nuolatinis · 5 min. intervalas |
| Diskas · pagal tašką | 90% | iš karto, kiekvienam taškui |
| Vidutinė apkrova | iš pradžių išjungta | užsitęsęs · laikotarpis |
| Swap | iš pradžių išjungta | užsitęsęs · laikotarpis |
| Procesų skaičius | iš pradžių išjungta | užsitęsęs · laikotarpis |
| Tinklo pralaidumas | iš pradžių išjungta | užsitęsęs · laikotarpis |
| Serveris neveikia | 3 neatsiųstos ataskaitos | kritinis · ~90 s |
Dažni klausimai apie serverių stebėjimą
01Kas yra serverių stebėjimas?+
02Kaip veikia Uptimia serverių stebėjimas?+
/proc ir df bei išsiunčia 17 rodiklių — CPU, atmintį, swap, disko užimtumą pagal prijungimo tašką, inode, apkrovą, tinklą, procesų skaičių ir OS duomenis — autentifikuotus unikaliu serverio raktu. Gaunate 6 rodiklių korteles, 5 laiko eilučių grafikus ir slenksčių įspėjimus — tokį stebėjimą ir įspėjimus užtikrina vienas mažas agentas.03Kokias operacines sistemas palaiko agentas?+
/proc ir df, todėl veikia įprastose Linux distribucijose (Ubuntu, Debian, RHEL, Alma ir panašiose). Taip pat yra macOS ir Windows PowerShell agentai, siunčiantys tuos pačius rodiklius, tačiau juos reikia įdiegti rankiniu būdu (macOS – per launchd, Windows – per Scheduled Task), o ne vienu diegimo scenarijumi. BSD agento nėra — tokiems serveriams naudokite Uptimia patikras iš išorės (ping, TCP prievadas, HTTP).04Ar galiu pakeisti, kaip dažnai agentas atsiskaito?+
05Ar trumpas CPU šuolis pažadins mane 3 val. nakties?+
06Per kiek laiko sužinosiu, kad serveris nebeveikia?+
07Ar agentas skaito mano žurnalus ar vykdo komandas?+
08Kiek laiko saugoma rodiklių istorija?+
09Ar galiu stebėti Docker ar Kubernetes konteinerius?+
/proc ir df, o ne atskirų konteinerių statistiką. Tinka serveriams, kuriuose veikia jūsų konteineriai; konteinerių lygio duomenų rinkimo kol kas nėra.10Ar serverių stebėjimas yra mokamas priedas?+
Pradėkite stebėti savo serverius jau šiandien.
Paleiskite vieną bash eilutę – ir apie pildomą diską, įkaitusį CPU ar užgesusią mašiną sužinosite dar turėdami laiko sureaguoti.