PĂ€rast viie kuu arendust on vĂ€lja antud projekti IncidentRelay 1.1 vĂ€ljaanne, mis arendab avatud sĂŒsteemi vahetuste, hĂ€irete suunamise ja intsidentide haldamise korraldamiseks, mida kĂ€itatakse oma serveris (self-hosted). IncidentRelay 1.1 on mĂ€rgitud kui esimene stabiilne vĂ€ljaanne (versioon 1.0 oli beetaversioon). Projekt on suunatud SRE, DevOps ja infrastruktuurimeeskondadele, kes vajavad kohalikult juurutatavat alternatiivi SaaS-teenustele vahetuste haldamiseks, eskalatsioonipoliitikate rakendamiseks ja intsidentide kĂ€sitlemiseks. Projekti kood on kirjutatud Pythonis ja seda levitatakse MIT litsentsi alusel.
IncidentRelay vĂ”tab vastu sĂŒndmusi monitooringusĂŒsteemidest, seab need vastavusse teenuse, meeskonna ja rotatsiooniga ning edastab seejĂ€rel teavitused vastutavatele vahetusele vĂ”i meeskondadele. SĂŒsteem sisaldab vahetuste, rotatsioonide, vahetuste ĂŒhtluste ja kinnituse haldamise ajakavasid, ACK/Resolve olekute, meenutuste, eskalatsiooni, ajutiste asenduste mÀÀramise, planeeritud tööde kestuse mÀÀramise ja lĂ€rmakate hĂ€iresignaalide summutamise vĂ”imalusi.
Projekti peamine eelis on tĂ€ielik kontroll infrastruktuuri ja marsruutimise logika ĂŒle. IncidentRelay toimub oma keskkonnas, töötab oma andmebaasiga ja vĂ”imaldab selgelt eristada sissetulevaid marsruute, kĂ€ske, rotatsiooni ja kohaletoimetamise kanaleid. Sissetulevad tokeneid kuuluvad marsruutidele, mitte kanalitele, mistĂ”ttu on lihtsam mĂ”ista, milline vĂ€line allikas on volitatud sĂŒndmusi konkreetsele kĂ€sule saatma.
IncidentRelay toetab sĂŒndmuste vastuvĂ”ttu Prometheus Alertmanagerilt, Grafana Alerting'ilt, Zabbixilt, Sentry'lt, LibreNMS'ilt, RMONilt, AWS SNS/CloudWatch'ilt ja mistahes webhook'idelt. Teavituste saatmiseks on ette nĂ€htud kanalid nagu Mattermost, Slack, Telegram, Discord, Microsoft Teams, e-post, webhook'id, brauseri/PWA push ja hÀÀlekĂ”nede teenusepakkujad. Mattermostis ja Telegramis vĂ”ivad teavitused sisaldada toiminguid kinnitamiseks ja probleemide lahendamiseks, mis vĂ”imaldab sĂŒndmuse lahendamist ilma eraldi liidesesse minemata.
Projekti saab kĂ€ivitada Docker Compose'i, RPM-paketi kaudu Red Hati-sarnastes distributsioonides, kĂ€sitsi systemd kaudu, samuti Kuberneteses Helm-chart'i abil. VĂ€ikeste paigalduste jaoks vĂ”ib kasutada SQLite'd, samas soovitatakse töösĂŒsteemide ja suurema koormuse korral PostgreSQL'i.
Uues versioonis on tehtud jÀrgmised muudatused:
- Lisatud on mitme taseme hÀdaabikordinaatorid, mis arvestavad ajapiiranguid, prioriteete ja ajutisi asendusi;
- Paaridega on saadaval valvekalendar, CalDAV ja ICS-i tellimused vÀlistes kalendrites;
- Rakendatud on probleemide eskalatsioonipoliitikad mitmeastmeliste tÔstmise ahelatega;
- Lisatud on hoiatuste grupid, sĂŒndmuste rĂŒhmitamine, edasilĂŒkatud teated ja kĂ€eline seotud hoiatuste ĂŒhinemine;
- Töid teostamiseks on lisatud aknad ning 'vaiksed' hoiatused;
- Lisatud on vÔimalus lisada kommentaare hoiatustele;
- Lisatud on probleemide prioriteedid (P1-P5) ja automaatne prioriteedi tÔstmine tÀhtsuse alusel;
- Rakendatud on teenuste kataloog, teenuste sĂ”ltuvused, SLI/SLO, sĂŒsteemide töö mĂ”jutamise ajalugu (Service Impact History) ja Ă€riteenused (Business Services);
- Lisatud on Explain Trace marsruutimise analĂŒĂŒsiks: miks hoiatus jĂ”udis vĂ”i ei jĂ”udnud meeskonda, kas see rĂŒhmitati, mahasurutud vĂ”i saadetud kindlasse kanalisse;
- Lisatud on kontrollid (Heartbeats/dead-man-switch) watchdogi, varukoopia, ETL ja muude ĂŒlesannete jaoks, kus probleemiks on oodatava signaali puudumine.


Allikas: opennet.ru
