SaaS veikimo stebėjimas — sužinote anksčiau, nei ateina pirmoji pagalbos užklausa.
Uptimia atskirai tikrina jūsų viešąją API, prisijungimo srautą ir naktinę sąskaitų užduotį — užuot spėliojus pagal pagrindinį puslapį, kuris vis dar atsidaro. Gedimas patvirtinamas daugiau nei viename regione ir tik tada iškviečia budintįjį — į Slack, PagerDuty ar ten, kur jūsų komanda ir taip žiūri.
Step breakdown
All 2 steps passedFailed at step 2244 ms · 02:13236 ms · 02:147-day averagesLast runAssertions — step 2
3 of 3 passing0 of 3 passedResponse — step 2
200 · 96 ms502 · 84 msRecent Runs
every minute · rotating locations
New York✗ Failed at step 20.24 s
Frankfurt✗ Failed at step 20.24 s
London✓ All 2 steps passed0.25 s
Sydney✓ All 2 steps passed0.26 s
Amsterdam✓ All 2 steps passed0.23 s
New York✓ All 2 steps passed0.24 s
Tokyo✓ All 2 steps passed0.25 sKeturi įsitikinimai, dėl kurių prarandami SaaS klientai
Kiekvienas skamba logiškai — ir dėl kiekvieno gedimas lieka nepastebėtas tol, kol jį randa klientas.
„Jei kas nors sugestų, klientai mums pasakytų.“
Pasako tik ištikimieji. Žmogus, pirmą kartą užklydęs į neveikiančią registraciją, uždaro kortelę ir niekada netampa klientu — niekas nesiskundžia, o pašto dėžutėje nelieka nieko, ką būtų galima tirti.
„Esame AWS debesyje — už veikimą atsako jie.“
Jų SLA dengia jų infrastruktūrą, o ne jūsų produktą. Nepavykęs diegimas, nebegaliojantis sertifikatas, užstrigęs eilės apdorojimo procesas — visa tai jūsų, o teikėjo būsenos puslapis per kiekvieną iš jų lieka žalias.
„Programa atsidaro, vadinasi, viskas veikia.“
SaaS yra funkcijų rinkinys, o ne vienas puslapis. Valdymo skydelis gali atsidaryti tuo metu, kai viešoji API nustoja atsakinėti, prisijungimas nepavyksta arba sąskaitų užduotis tyliai praleidžia naktį — kiekvienas dalykas genda atskirai, o žodis „veikia“ visa tai paslepia.
„Viešai skelbdami incidentus atrodysime prastai.“
Tyla atrodo prasčiau. Klientas, radęs pranešimą būsenos puslapyje, užklausos nerašo — ir prisimena, kad pasakėte anksčiau, nei jis paklausė. Klientas, neradęs nieko, mano, kad ir jūs nieko nežinote.
„Trys devynetai — praktiškai tobula“ yra didžiausias iš jų. 99,9 % veikimo laiko leidžia 43 neveikimo minutes per mėnesį. Vizitinės kortelės svetainėje tai apvalinimo paklaida — bet SaaS produkte klientai dirba. Padauginkite 43 minutes iš 500 klientų: 21 500 klientų minučių, 358 valandos per mėnesį, kai kas nors mato, kad jūsų produktas neveikia.
Prenumeratos pratęsiamos ne pagal jūsų pasiekiamumo procentą. Jos pratęsiamos pagal tai, kas sužinojo pirmas ir kaip greitai buvo sutvarkyta.
Štai kaip tas pats gedimas atrodo, kai galinį tašką stebi užklausų grandinė.↓ minutė po minutės
Vienas API sutrikimas nuo pradžios iki galo
Paskyros galinis taškas nustojo veikti. Valdymo skydelis vis dar atsidarė, pagrindinio puslapio ping liko žalias, o kiekviena į tą tašką besikreipianti integracija jau nebeveikė.
API jau stebima. Bet SaaS genda keturiuose sluoksniuose — programa, API, srautai, užduotys — ir kiekvienas jų sugenda atskirai.↓ kiekvienas sluoksnis
Stebimas kiekvienas jūsų produkto sluoksnis
Patikros kreipiasi į jūsų API ir puslapius, tikra naršyklė atkartoja prisijungimą ir registraciją, užduotys atsiunčia ping, o nedidelis skriptas praneša, ką patyrė tikri lankytojai — viskas suplaukia į vieną valdymo skydelį ir vieną kontaktų sąrašą.
Sukurta pagal tai, kaip genda SaaS
API, į kurią kreipiasi jūsų klientai
Tai, kad pagrindinis puslapis atsidaro, nieko nesako apie galinį tašką, į kurį kreipiasi klientų integracijos — todėl šiandien apie gedimą pirmas praneša klientas. Uptimia vietoj to net kas minutę paleidžia tikrą užklausų grandinę į jūsų viešąją API: prisijungti, pasiimti žetoną, kreiptis į apsaugotą galinį tašką, perskaityti atsaką.
- Grandinės iki 15 žingsnių — kiekvienas žingsnis patikrina gautą atsaką ir perduoda kitam tai, ko šiam reikia
- Pirmiausia prisijungia — o tada kreipiasi į galinius taškus, kuriuos pasiekia tik prisijungęs klientas
- Patvirtinta, o ne atsitiktinis trikdis — nepavykusį žingsnį prieš atidarant incidentą pakartoja iki trijų skirtingų vietų
Prisijungimas ir registracija išbandomi anksčiau už klientus
Po diegimo pirmasis prisijungti turėtų bandyti robotas. Uptimia net kas 10 minučių atkartoja prisijungimą ir registraciją tikroje naršyklėje iš 13 vietų ir, vos nepavykus žingsniui, atidaro incidentą — su ekrano nuotrauka, kaip puslapis atrodė gedimo akimirką.
- Tikra naršyklė — atidaryti puslapį, užpildyti laukus, spustelėti, patikrinti, kas atsivėrė
- Ekrano nuotrauka nepavykus — juostų diagramoje matyti nepavykęs žingsnis ir kaip tuo metu atrodė puslapis
- Žingsnių trukmės — matote kiekvieno žingsnio laiką, tad lėtėjantį srautą pastebite dar prieš jam sugendant
Sąskaitų užduotis, kuri taip ir nepasileido
Nutrūkusi cron užduotis apie tai nepraneša — iš išorės niekas neatrodo „neveikiantis“, o sąskaitos tyliai neišsiunčiamos. Veikimo signalai tai apverčia: baigusi darbą užduotis siunčia ping į Uptimia, o neatėjęs ping ir yra incidentas.
- Vienas ping URL — viena eilutė cron, apdorojimo proceso ar atsarginės kopijos skripto gale
- Terminą nustatote jūs — grafikas ir leistinas vėlavimas; niekada neatėjęs ping atidaro incidentą
- Taip pat pradžios ir klaidos signalai — pagaunama užduotis, kuri pasileido, bet nebaigė darbo, arba pati pranešė apie nesėkmę
Būsenos puslapis jūsų domene
Prieš rašydamas užklausą klientas ieško puslapio, kuris pasakytų, kad jūs jau žinote. Paskelbkite tokį savo domene — su savo logotipu ir išjungtu Uptimia ženkleliu — rodantį būseną realiu laiku, 90 dienų istoriją ir kiekvieną incidento pranešimą, o prenumeratoriai apie kiekvieną naujieną gauna laišką.
- Jūsų domenas, automatinis SSL —
status.yourapp.comper HTTPS, o užrašą „Powered by Uptimia“ galima pašalinti - Skiltys ir prenumeratoriai — sugrupuokite stebėjimo objektus pagal sritis, skelbkite incidentų ir techninės priežiūros naujienas, praneškite prenumeratoriams
- Viešas arba privatus — atviras jūsų klientams arba apsaugotas slaptažodžiu
Vienas incidentas, jūsų komanda ir jūsų būsenos puslapis
Tas pats patvirtintas incidentas iškviečia budintįjį ir atnaujina puslapį, kurį klientai jau ir taip perkrauna.
12 įspėjimų kanalų, vienas kontaktų sąrašas — ir klientų stebimas būsenos puslapis, atnaujinamas iš to paties incidento.
Peržiūrėkite visą integracijų katalogą →Sutrikimas turi iškviesti jus.Ne jūsų klientus.
30 dienų bandymas atveria visus stebėjimo tipus — veikimo patikras, API grandines, prisijungimo srautus ir veikimo signalus.
SaaS stebėjimą paleisite trimis žingsniais
Svarbiausius savo produkto srautus galite pradėti stebėti dar šiandien po pietų.
Nukreipkite patikras į savo produktą
Pridėkite programos veikimo patikrą, užklausų grandinę į viešąją API ir prisijungimo atkartojimą tikroje naršyklėje.
Įpinkite veikimo signalus į užduotis
Įrašykite ping URL kiekvieno cron, apdorojimo proceso ar atsarginės kopijos skripto gale — neatėjęs ping tampa incidentu.
curl -fsS uptimia.com/p/hb_9f3c…
Nukreipkite įspėjimus ir paskelbkite būseną
Siųskite įspėjimus į Slack ir PagerDuty, pasirinkite, kas iškviečiamas kitas, jei niekas nepatvirtina, ir įdėkite veikimo bei srautų patikras į būsenos puslapį.
Taip pat įskaičiuota
Stebėkite, ką patiria tikri naudotojai
Pasyvus JavaScript skriptas praneša tikrų lankytojų įkėlimo laikus pagal įrenginį, naršyklę ir vietą.
Automatizuokite per API
Kurkite stebėjimo objektus ir būsenos puslapius iš savo įrankių — paleiskite patikras tiesiai diegimo skripte.
Techninės priežiūros laikotarpiai
Leidžiate naują versiją? Suplanuokite laikotarpį — patikros pristabdomos, įspėjimai tyli, o būsenos puslapyje matyti suplanuoti darbai.
Vienas incidentas, vienas įspėjimas
Gedimų audra virsta viena suvestine, o ne šimtu žinučių — su pasirašyta nuoroda incidentui patvirtinti ir stebimu MTTA.
Atsistatymo pranešimai
Kai API vėl ima veikti, iškviesti inžinieriai gauna ir pranešimą, kad viskas tvarkoje.
Nemokamos priemonės priežasčiai ieškoti
Peradresavimą antraštė po antraštės išnagrinėkite su HTTP Status Checker, o kiek leidžia kiekvienas „devynetas“, pamatysite su Uptime Calculator.
Kas yra SaaS veikimo stebėjimas?
SaaS veikimo stebėjimas — tai nuolatinė tų produkto dalių, nuo kurių priklauso klientai, patikra: viešosios API, prisijungimo ir registracijos srautų bei už jų veikiančių foninių užduočių. Vos kuriai nors sugedus, jūsų komanda gauna įspėjimą. Pagrindinio puslapio ping lieka žalias tuo metu, kai jūsų API nustoja atsakinėti, prisijungimas nepavyksta arba naktinė užduotis nebepasileidžia.
Žalia, kol klientai negali dirbti
Jūsų patikra pavyksta, o tai, už ką klientai moka, neveikia — sužinote iš pagalbos užklausos.
Stebite kiekvieną sluoksnį
API, srautų ir užduočių patikros suplaukia į tą pačią įspėjimų sistemą — gedimas pasiekia inžinierių, o ne klientą.
Kiek neveikimo leidžia kiekvienas „devynetas“
„99,9 % veikimo laiko“ skamba nepriekaištingai, kol nepaverčiate to minutėmis — štai ką leidžia kiekviena pakopa.
Atverkite pasiekiamumo skaičiuoklę →| Veikimo laikas | Neveikimo laikas / mėn. | Neveikimo laikas / metus |
|---|---|---|
| 99% | 7h 18m | 3d 15h |
| 99.9% | 43m 49s | 8h 46m |
| 99.95% | 21m 54s | 4h 23m |
| 99.99% | 4m 23s | 52m 35s |
| 99.999% | 26s | 5m 15s |
Dažni klausimai apie SaaS stebėjimą
01Kas yra SaaS veikimo stebėjimas?+
02Kuo tai skiriasi nuo įprastos pagrindinio puslapio patikros?+
03Ar galiu stebėti savo viešąją API?+
{{variable}} šablonais. Ji vykdoma net kas minutę visuose planuose, o nepavykęs žingsnis prieš atidarant incidentą pertikrinamas iš iki trijų vietų. Grandinė yra sunkiausia patikra, todėl API stebėjimo objektams kiekviename plane skirtas atskiras limitas — tikslius skaičius rasite kainose.04Ar pagaus neveikiantį prisijungimą ar registraciją?+
05Ar gausiu įspėjimą, kai nustos veikti foninė užduotis?+
06Kaip dažnai gali vykti patikros?+
07Ar galiu klientams pasiūlyti būsenos puslapį?+
08Ar galiu komandos nariui atverti tik dalį stebėjimo objektų?+
09Ar palaikote SSO ir ar gausiu SLA ataskaitas?+
10Kokius įspėjimų kanalus gali naudoti mano komanda?+
11Ar reikia ką nors diegti savo programoje?+
curl į ping URL), o Real User Monitoring (RUM) — nedidelio JavaScript skripto. Agento nereikia, nebent norėsite ir serverio rodiklių.Jūsų API, srautai ir užduotys — stebimi
Pradėkite stebėti savo API, prisijungimo srautą ir fonines užduotis dar šiandien po pietų — ir nustokite apie veikimo sutrikimus sužinoti iš klientų.