Avaldati IncidentRelay 2.0, süsteem vahetuste korraldamiseks ja teavituste suunamiseks.

Ilmus välja projekt IncidentRelay 2.0, avatud süsteem, mis on mõeldud vahetuste korraldamiseks, teavituste marsruudiks ja sündmuste jälgimiseks, mis on paigaldatav isiklikule serverile (self-hosted). Projekt on suunatud SRE, DevOps ja infrastruktuuri meeskondadele, kes vajavad kohalikke alternatiive pilve põhistele operatsioon tööde haldamise platvormidele. Kood on kirjutatud Pythonis ja levitatakse MIT litsentsi alusel.

IncidentRelay võtab vastu sündmusi Prometheus Alertmanager'ist, Grafana Alerting'ist, Zabbix'ist, Sentry'st, LibreNMS'ist, RMON'st, AWS SNS/CloudWatch'ist, Datadog'ist, Uptime Kuma'st ja igasugustest webhook-protsessoritest. Pärast normaliseerimist seostatakse sündmus teenuse, meeskonna ja rotatsiooni ning sellele rakendatakse marsruudi reeglid ja eskaleerimise poliitikad, pärast mida saadetakse teavitamine praegusele vahetuses olevale inimesele. Edastamiseks toetatakse Mattermost'i, Slack'i, Telegram'i, Discord'i, Microsoft Teams'i, e-posti, webhook'e, brauseri/PWA push'i ja häälkõnede teenuste pakkujaid.

Versiooni 2.0 peamiseks uuenduseks on Event Orchestration mehhanism, mis pakub eraldi kihte sündmuste töötlemiseks sisendintegraatsioonide ja häire elutsükli vahel. Peamised muudatused:

  • Lisatud visuaalne orkestreerimise reeglite redaktor. Reegleid saab rakendada globaalsetena või üksikutele teenustele, neid saab grupeerida sisetingimuste rühmadesse ning järjestikused prioriteedi, olulisuse, sildid, meeskonna, marsruudi, rühmitamise meetodi, teavitamis- ja eskaleerimisreeglite muutmiseks;
  • Rakendatud toimingud sündmuste summutamiseks, tagasi lükkamiseks ja töötlemise peatamiseks, väärtuste väljatõmbamiseks regulaaravaldiste ja JSON Path abil, stringide jagamiseks, muutuja loomiseks ja väärtuste muutmiseks;
  • Orkestreerimise konfiguratsioon on jagatud redigeeritavate mustandite ja muutumatute avaldatud versioonide vahel. Toetatakse konfiguratsiooni kontrollimist, avaldamist, eelnevale versioonile tagasiviimist ja muudatuste kommentaaride lisamist;
  • Toetatud on režiimid disabled, shadow ja active. Shadow režiimis salvestatakse reeglite täitmise tulemused analüüsimiseks, kuid need ei mõjuta tegelikku marsruutimist. Üleminekuaegadel on saadaval legacy, hybrid ja orchestration ühilduvusrežiimid;
  • Lisatud on sündmuste simuleerimise ja taasesitamise vahendid. Need aitavad testida reegleid normaliseeritud sündmustel või algse payload'i integratsioonil ilma reaalse häire tekitamiseta. Tulemuste analüüsimiseks on saadaval teostamise jälgimine, Explain-andmed ja varjurežiimi mõõdikud;
  • On ellu viidud ümbertöödeldavad webhook-tegevused, mis toimuvad asünkroonselt pärast sündmuse töötlemist. Pealkirjad salvestatakse krüpteeritud kujul, saladusi peidetakse API-s ja logides, samas kui privaatsetesse võrkudesse pöördumised on vaikimisi keelatud. Saate seadistada ajutisi piire, uuesti proovimine ja lubatud siseadresse;
  • Lisatud on integreerimine Uptime Kuma'ga, mis võtab vastu standardseid webhook-sõnumeid monitooringu seisundist. On rakendatud UP ja DOWN seisundite normaliseerimine, tähtsuse määramine, siltide töötlemine ja uus sissetuleva marsruudi tüüp uptime_kuma;
  • Laiendatud on parametreid apply_to_existing ja reactivate_on_end vaikse ajal ja tööplaanide aegadel. Esimene võimaldab rakendada häiret nendele, mis on juba avatud, ja teine määrab, kas nende töötlemist tuleks jätkata pärast vaigistamise perioodi lõppu. Teavituste, meeldetuletuste ja eskalatsiooniahelate peatamine ja taastamine;
  • Isiklike API tokenite jaoks on kehtestatud eraldi lugemise ja muutmise õigused rühmade, meeskondade, kasutajate, marsruutide, kanalite, teenuste, rotatsioonide, poliitikate, hooldusakende, heartbeat-kontrollide, SSO ja orkestreerimise jaoks. Vanad koondatud õigused resources:read, resources:write ja * on tagatud tagurpidi ühilduvuse nimel;
  • Lisatud on auditi žurnali liides filtrite ja lehekülgede navigeerimisega. Žurnal fikseerib operatsioonid orkestreerimisest, webhook-tegevustest, vaigistustest ja tööplaanide akendest, samal ajal eemaldatakse konfidentsiaalsed väärtused kuvatud andmetest;
  • Veebiliideses on lisatud tume teema ning kasutajate keele- ja disainiseaded. Lisatud on prantsuse lokaliseerimine, laiendatud orkestreerimise ja hoolduse sektsioonide tõlked ning parandatud SSO rühmade vastendamise reeglite redigeerimist;
  • Parandatud on heartbeat-kontrollide toimimist: välistatud on ürituste korduv loomine viivituste osas, signaali taastamine suleb õigesti häire ja saadab teate probleemi lahendamisest, ühtlustatud ajatempli kuvamine;
  • Valmistatud dokumentatsioon Kubernetes'i juurutamiseks Helm'i abil. Helm-chart'i on lisatud eraldi Slack Socket Mode'i töötleja, mis on vajalik interaktiivsete kinnitusnuppude ja intsidentide sulgemise tööks;
  • Väljatõstetud väliste HTTP-päringute, regulaarsete avaldiste ja konfidentsiaalsete andmete kaitset, UTC ja ajavööndite tsentraliseeritud töötlemine, rotatsioonide ajakavade arvutuste ümberkujundamine ja automaatsete testidega katvuse laiendamine.

Enne värskendamist on soovitatav luua andmebaasi varukoopia. Vajalikud skeemi muutused teostatakse tavapärase IncidentRelay'i migreerimise mehhanismi abil. Aeglase rakendamise jaoks soovitavad arendajad kõigepealt kasutada shadow ja hybrid režiime, kontrollida reeglite täitmise jälgimist ja alles seejärel lülitada orkestreerimine aktiivsesse režiimi.

Allikas: opennet.ru

Osta usaldusväärne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid 🔥 Osta usaldusväärne hostimine veebilehtede jaoks DDoS-i kaitsega, VPS VDS serverid | ProHoster