Prometheus: Įvadas į Prometheus įspėjimus

Ši dokumentacija yra Įspėjimai vadovo dalis. Visą vadovą rasite čia: Kaip veikia Prometheus įspėjimai ir kaip juos konfigūruoti.

👋 Sveiki atvykę į Stackhero dokumentaciją!

Stackhero siūlo visiškai valdomą Prometheus cloud platformą, sukurtą patikimumui ir paprastumui:

  • Alert Manager yra integruotas, todėl galite nukreipti įspėjimus tiesiai į Slack, Mattermost, PagerDuty ir kitas populiarias sistemas.
  • Dedikuotas el. pašto serveris leidžia siųsti neribotą kiekį el. pašto įspėjimų be papildomo konfigūravimo.
  • Įtraukta Blackbox funkcija, leidžianti tikrinti HTTP, ICMP, TCP ir kitus protokolus išsamiai stebėsenai.
  • Greitai konfigūruokite savo instanciją naudodamiesi internetiniu konfigūracijos failo redaktoriumi. Nereikia rankiniu būdu tvarkyti YAML.
  • Atnaujinimus pritaikykite vienu paspaudimu. Stackhero pasirūpina visais atnaujinimo procesais, sumažindama prastovas ir rankinį įsikišimą.
  • Aukštas našumas ir stipri sauga užtikrinami dėl privačios, dedikuotos infrastruktūros.

Pradėkite naudotis vos per 5 minutes. Stackhero pasirūpina diegimu, kad galėtumėte susitelkti į stebėseną, o ne priežiūrą. Išbandykite Prometheus cloud hosting Stackhero platformoje ir supaprastinkite savo stebėsenos bei įspėjimų procesus.

Prometheus gali analizuoti jūsų metrikas ir sukelti įspėjimus pagal jūsų nustatytas taisykles. Naudojant Stackhero for Prometheus, įspėjimai apdorojami dviem etapais. Pirma, įvertinamos Prometheus įspėjimų taisyklės, o tada perima Alert Manager.

Viskas yra iš anksto įdiegta ir sukonfigūruota su Stackhero for Prometheus, todėl jums tereikia atlikti minimalią konfigūraciją, pavyzdžiui, pridėti savo el. pašto adresą, kad pradėtumėte gauti įspėjimus.

Didelis Stackhero for Prometheus vaizdasDidelis Stackhero for Prometheus vaizdas

Kai Prometheus gauna metrikas, jis jas įvertina pagal taisykles, nurodytas rules-alert.yml faile. Šios įspėjimų taisyklės apibrėžia slenksčius ir laiko langus, kada sukelti įspėjimus pagal surinktas metrikas.

Pavyzdžiui, įspėjimas gali būti sukeltas, jei disko naudojimas viršija 80%. Be to, taisyklės gali būti nustatytos prognozuoti būsimas sąlygas ir siųsti įspėjimą, jei prognozuojama, kad disko vieta bus visiškai užpildyta per artimiausias 24 valandas.

Kitas dažnas naudojimo atvejis yra neįprasto elgesio aptikimas. Pavyzdžiui, jei staiga padidėja tinklo pralaidumo naudojimas, gali būti sukeltas įspėjimas, padedantis aptikti galimas paskirstytas paslaugų atsisakymo (DDoS) atakas ar duomenų ištraukimo bandymus.

Prometheus įspėjimų taisyklės yra tiesiogiai įtrauktos į Prometheus serverį.

Alert Manager gauna įspėjimus, kuriuos sukėlė Prometheus įspėjimų taisyklės. Jis deduplikuoja įspėjimus, juos grupuoja ir tada perduoda per įvairius pranešimų kanalus, tokius kaip el. paštas, Slack, Mattermost, PagerDuty ir kt. Jo konfigūracijos failas yra alert-manager.yml.

Pavyzdžiui, jei įvyksta serverio sulėtėjimas, Prometheus įspėjimų taisyklės gali sukelti atskirus įspėjimus dėl padidėjusios apkrovos ir CPU naudojimo. Alert Manager gauna šiuos įspėjimus, juos grupuoja, nes jie susiję su tuo pačiu serveriu, ir siunčia vieną sujungtą pranešimą tinkamam gavėjui ar komandai pagal jūsų konfigūraciją.

Jei sulėtėjimas tęsiasi, Prometheus toliau siųs įspėjimus, bet Alert Manager slopins pasikartojančius pranešimus tam tikrą laikotarpį, kad išvengtų jūsų komandos užtvindymo pertekliniais įspėjimais.

Taip pat galite nutildyti arba visiškai slopinti įspėjimus, jei reikia. Kai pagrindinė problema išsprendžiama, siunčiamas atkūrimo pranešimas, kad praneštų jūsų komandoms.

Šis pavyzdys iliustruoja bendrą scenarijų, tačiau galite visiškai pritaikyti nustatymus pagal savo specifinius reikalavimus.

įspėjimas Alert Manager nėra įtrauktas pagal numatymą su Prometheus. Kad sutaupytume jūsų laiką ir supaprastintume procesą, mes integravome ir sukonfigūravome Alert Manager į Stackhero for Prometheus, kad galėtumėte siųsti įspėjimus vos per kelias minutes, su minimaliomis pastangomis.