Lëshohet versioni i parë stabil i IncidentRelay, sistemit për organizimin e turneve dhe përshpejtimin e njoftimeve.

Pas pesë muajsh zhvillimi, është publikuar versioni 1.1 i projektit IncidentRelay, i cili zhvillon një sistem të hapur për organizimin e turneve, përshpejtimin e njoftimeve dhe mbështetje për incidente, i vendosur në serverin e tij (self-hosted). IncidentRelay 1.1 shënohet si versioni i parë stabil (dega 1.0 kishte statusin e beta-versionit). Projekti është orientuar për ekipet SRE, DevOps dhe infrastrukturore që kërkojnë një alternativë lokalisht të instaluar për shërbimet SaaS për menaxhimin e turneve, aplikimin e politikave të eskalimit dhe reagimin ndaj incidenteve. Kodi i projektit është shkruar në Python dhe shpërndahet nën licencën MIT.

IncidentRelay pranon ngjarje nga sistemet e monitorimit, i përputh ato me shërbimin, ekipin dhe rotacionin, pastaj dërgon njoftime tek turnet përgjegjës ose ekipet. Në sistem janë realizuar orarët e turneve, rotacionet, ribotimi i ndërrimeve, konfirmimi i marrjes së incidentit, gjendjet ACK/Resolve, kujtimet, eskalimet, zëvendësimet përkohësore të turneve, përcaktimi i kohës për punët e planifikuara dhe shtypja e alarmeve të zhurmshme.

Avantazhi kryesor i projektit është kontrolli i plotë mbi infrastrukturën dhe logjikën e përshpejtimit. IncidentRelay vendoset në mjedisin e tij, punon me bazën e saj të të dhënave dhe lejon ndarjen e qartë të rrugëve hyrëse, ekipeve, rotacioneve dhe kanaleve të dorëzimit. Tokenat hyrëse i përkasin rrugëve dhe jo kanaleve, kështu që është më e thjeshtë të kuptojmë se cili burim i jashtëm ka të drejtat për të dërguar ngjarje në një ekip të caktuar.

IncidentRelay mbështet pranimin e ngjarjeve nga Prometheus Alertmanager, Grafana Alerting, Zabbix, Sentry, LibreNMS, RMON, AWS SNS/CloudWatch dhe webhook-e të rastësishëm. Për dërgimin e njoftimeve janë parashikuar kanale si Mattermost, Slack, Telegram, Discord, Microsoft Teams, email, webhook-e, dërgime të shfletuesit/PWA dhe ofrues të thirrjeve vokale. Në Mattermost dhe Telegram, njoftimet mund të përmbajnë veprime për konfirmimin dhe zgjidhjen e problemeve, çka lejon trajtimin e incidentit pa kaluar në një ndërfaqe të veçantë.

Projekti mund të niset përmes Docker Compose, paketës RPM për shpërndarjet e ngjashme me Red Hat, dorazi përmes systemd, si dhe në Kubernetes duke përdorur Helm-chart. Për instalime të vogla, mund të përdoret SQLite, ndërsa për sistemet e punës dhe ngarkesat më të larta, rekomandohet PostgreSQL.

Në versionin e ri janë propozuar këto ndryshime:

  • Shtuar rotacione on-call me shumĂ« nivele me kufizime nĂ« kohĂ«, prioritete tĂ« niveleve dhe marrjen parasysh tĂ« zĂ«vendĂ«simeve tĂ« pĂ«rkohshme;
  • ËshtĂ« krijuar njĂ« kalendar turnesh, CalDAV dhe abonime ICS pĂ«r kalendare tĂ« jashtme;
  • JanĂ« realizuar politika pĂ«r eskalimin e incidenteve me zinxhirĂ« ndihme shumĂ«shkallĂ«she;
  • Shtuar grupe paralajmĂ«rimesh, grupimi i ngjarjeve, njoftime tĂ« shtyra dhe bashkimin manual tĂ« alerteve tĂ« lidhura;
  • JanĂ« shtuar dritaret pĂ«r kryerjen e punimeve tĂ« planifikuara dhe 'alerte tĂ« qeta';
  • Shtuar mundĂ«sia pĂ«r tĂ« shtuar komente nĂ« alerte;
  • Shtuar prioritetet e incidenteve (P1-P5) dhe rritja automatike e prioritetit sipas nivelit tĂ« rĂ«ndĂ«sisĂ«;
  • JanĂ« realizuar katalogu i shĂ«rbimeve, varĂ«sitĂ« e shĂ«rbimeve, SLI/SLO, historia e ndikimit nĂ« funksionimin e sistemeve (Service Impact History) dhe shĂ«rbimet biznesore (Business Services);
  • JanĂ« shtuar Explain Trace pĂ«r shpjegimin e rrugĂ«ve: pse njĂ« alert arriti ose nuk arriti nĂ« ekip, u grupua, u ndal ua dĂ«rgua nĂ« njĂ« kanal tĂ« caktuar;
  • Shtuar kontrollesh (Heartbeats/dead-man-switch) pĂ«r watchdog, backup, ETL dhe detyra tĂ« tjera, ku problemi Ă«shtĂ« mungesa e sinjalit tĂ« pritur.



Burimi: opennet.ru
Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster