Përmbledhja e sistemit hibrid të monitorimit Okerr

Para dy vjetësh kam bërë një postim Failover i thjeshtë për website-in për okerr. Tani ka disa zhvillime në projekt, dhe ndryshe, kam publikuar kodin burimor të pjesës serverike të okerr nën licencë të hapur, prandaj vendosa të shkruaj këtë përmbledhje të vogël për Habr.

Përmbledhja e sistemit hibrid të monitorimit Okerr
[ madhësi e plotë ]

Kush mund të jetë i interesuar për këtë

Kjo mund t'ju interesojĂ« nĂ«se punoni nĂ« njĂ« ekip tĂ« vogĂ«l ose madje vetĂ«m. Nuk keni monitorim dhe nuk jeni tĂ« sigurt nĂ«se vĂ«rtet ju nevojitet. Ose keni provuar ndonjĂ« monitorim tĂ« njohur dhe serioz 'pĂ«r djemtĂ« e mĂ«dhenj', por pĂ«r ju si qĂ« duket nuk Ă«shtĂ« 'ngjitur', ose funksionon nĂ« njĂ« konfigurim pothuajse default dhe nuk ka ndryshuar shumĂ« jetĂ«n tuaj. Gjithashtu — nĂ«se me siguri nuk planifikoni tĂ« angazhoni njĂ« punonjĂ«s (e madhe) pĂ«r tĂ« monitoruar tĂ« paktĂ«n disa orĂ« nĂ« ditĂ« nĂ« dashboard-in e monitorimit ose pĂ«r ta konfiguruar atĂ«.

Cila është veçoria e jashtëzakonshme e okerr

Më pas do të tregoj karakteristikat interesante të okerr-it, të cilat e dallojnë atë nga disa monitorime të tjera.

Okerr është një monitorim hibrid

GjatĂ« monitorimit tĂ« brendshĂ«m, nĂ« makinat e vĂ«zhguara funksionon njĂ« "agjent", i cili transmeton tĂ« dhĂ«nat nĂ« serverin e monitorimit (pĂ«r shembull, hapĂ«sira e lirĂ« nĂ« disqe). GjatĂ« monitorimit tĂ« jashtĂ«m, serveri kryen verifikime pĂ«rmes rrjetit (pĂ«r shembull, ping ose aksesueshmĂ«ria e njĂ« faqe interneti). Çdo qasje ka kufizimet e saj. Okerr pĂ«rdor tĂ« dyja variantet. Verifikimet brenda serverĂ«ve kryhen nga njĂ« agjent shumĂ« tĂ« lehtĂ« (30Kb) ose nga skriptet dhe aplikacionet tuaja, ndĂ«rsa ato rrjetore pĂ«rmes sensorĂ«ve okerr nĂ« vende tĂ« ndryshme.

okerr — nuk Ă«shtĂ« thjesht njĂ« soft, por gjithashtu njĂ« shĂ«rbim

Pjesa serverike e çdo monitorimi është një gjë e madhe dhe komplekse, e cila është e vështirë për t'u instaluar dhe konfiguruar, dhe kërkon burime. Me okerr mund të vendosni serverin tuaj të monitorimit (ai është falas dhe opensource), ose mund të përdorni vetëm pjesën klientike dhe të shfrytëzoni shërbimin e serverit tonë. Edhe kjo është falas.

NĂ«se mbikĂ«qyrja lejon tĂ« kompensosh, tĂ« mbulosh mungesĂ«n e besueshmĂ«risĂ« nĂ« serverĂ« dhe aplikacione, ngrihet njĂ« pyetje filozofike — kush e ruan ruajtĂ«sin? Si do na njoftojĂ« mbikĂ«qyrja pĂ«r njĂ« problem, nĂ«se ajo vetĂ« "vdes" pĂ«r ndonjĂ« arsye, veçmas ose sĂ« bashku me burime tĂ« tjera tuaja (p.sh., shkĂ«putja e kanalit nĂ« qendrĂ«n e tĂ« dhĂ«nave)? PĂ«rdorimi i shĂ«rbimit tĂ« jashtĂ«m okerr zgjidh kĂ«tĂ« problem — do tĂ« merrni njĂ« alert edhe nĂ«se e gjithĂ« qendra e tĂ« dhĂ«nave me serverĂ«t tuaj do tĂ« jetĂ« pa energji ose do t'i nĂ«nshtrohet njĂ« sulmi zombie.

Sigurisht, ka njĂ« rrezik qĂ« serveri okerr vetĂ« tĂ« mos jetĂ« i qasshĂ«m, Ă«shtĂ« e vĂ«rtetĂ« (siç dihet, 90% e besueshmĂ«risĂ« arrihen gjithmonĂ« thjesht dhe "falas", 99% — me minimum pĂ«rpjekjesh, dhe çdo nĂ«nshkrim tjetĂ«r i nĂ«ntĂ« — eksponencialisht mĂ« i komplikuar). Por, fillimisht, shanset pĂ«r kĂ«tĂ« janĂ« mĂ« tĂ« ulta, dhe sĂ« dyti, problemi mund tĂ« mbetet i paepur vetĂ«m nĂ«se ndodh pĂ«rkohĂ«sisht me problemet nĂ« serverĂ«t tanĂ«. NĂ«se ne kemi besueshmĂ«ri 99.9% dhe ju keni 99.9% (numra jo shumĂ« tĂ« lartĂ«), atĂ«herĂ« shansi pĂ«r njĂ« dĂ«shtim tĂ« paepur — 0.1% nga 0.1% = 0.0001%. TĂ« shtosh tre nĂ«ntĂ« nĂ« besueshmĂ«ri thuajse pa pĂ«rpjekje dhe pa shpenzime — Ă«shtĂ« shumĂ« e mirĂ«!

NjĂ« tjetĂ«r pĂ«rfitim i mbikĂ«qyrjes si shĂ«rbim Ă«shtĂ« se ofruesi i hostimit ose studioja e uebit mund tĂ« vendosĂ« serverin okerr dhe t'i ofrojĂ« klientĂ«ve akses si njĂ« shĂ«rbim shtesĂ« me pagesĂ« ose falas. KonkurentĂ«t tuaj ofrojnĂ« thjesht hostim dhe faqe — ndĂ«rsa ju ofroni hostim tĂ« besueshĂ«m me mbikĂ«qyrje.

Okerr — kjo Ă«shtĂ« pĂ«r treguesit

Treguesi Ă«shtĂ« njĂ« "dritĂ«". Ai ka dy gjendje kryesore — e gjelbĂ«r (OK) ose e kuqe (ERR). NĂ« projekt ka shumĂ« tregues tĂ« grumbulluar (p.sh., sipas serverĂ«ve). NĂ« faqen kryesore tĂ« projektit, ju menjĂ«herĂ« mund tĂ« shihni nĂ«se gjithçka Ă«shtĂ« e gjelbĂ«rt (dhe mund ta mbyllni), ose nĂ«se diçka Ă«shtĂ« e kuqe dhe duhet tĂ« rregullohet. Kur vazhdohet midis kĂ«tyre gjendjeve — dĂ«rgohet njĂ« njoftim. NjĂ« herĂ« nĂ« ditĂ«, ndĂ«rsa e konfiguroni — dĂ«rgohet njĂ« pĂ«rmbledhje pĂ«r projektin.

Përmbledhja e sistemit hibrid të monitorimit Okerr

Çdo indikator okerr ka kushte tĂ« integruara, sipas tĂ« cilave ndryshon gjendja e tij (nĂ« Zabbix kjo quhet trigger). PĂ«r shembull, ngarkesa mesatare nuk duhet tĂ« jetĂ« mĂ« shumĂ« se 2 (sigurisht, kjo Ă«shtĂ« e konfigurueshme). Dhe pĂ«r secilĂ«n kontrollim tĂ« brendshĂ«m (ngarkesa mesatare, hapĂ«sira e diskut, 
) — ka njĂ« watchdog. NĂ«se pĂ«r ndonjĂ« arsye nuk kemi marrĂ« njĂ« konfirmim tĂ« suksesshĂ«m nĂ« kohĂ«n e caktuar — regjistrohet njĂ« gabim dhe dĂ«rgohet njĂ« alert.

Schemi i zakonshĂ«m i punĂ«s pĂ«r ne Ă«shtĂ« — kontrolli i mĂ«ngjesit tĂ« postĂ«s, ku mes e-maileve tĂ« tjera shikojmĂ« pĂ«rmbledhjen (koha e saj caktuar nĂ« fillim tĂ« punĂ«s). NĂ«se gjithçka Ă«shtĂ« nĂ« rregull nĂ« tĂ« — merren me punĂ« tĂ« tjera tĂ« rĂ«ndĂ«sishme (por mund tĂ« shikojmĂ« shpejt nĂ« dashboard-in e okerr-it pĂ«r siguri, pĂ«r t'u siguruar se gjithçka Ă«shtĂ« e gjelbĂ«r nĂ« atĂ« minutĂ«). NĂ«se vjen njĂ« alert — reagojmĂ«.

Sigurisht, ka mundĂ«sinĂ« pĂ«r tĂ« mbajtur thjesht indikatorĂ« ‘informativë’ (pĂ«r tĂ« parĂ« pamjen e rrjetit nga monitorimi), por gjithçka Ă«shtĂ« bĂ«rĂ« pĂ«r tĂ« lehtĂ«suar, thjeshtuar dhe pĂ«r tĂ« krijuar shpejt indikatorĂ« pĂ«r vĂ«zhgimin automatik dhe dĂ«rgimin e alerteve.

QĂ«llimi pĂ«r tĂ« cilin po konfiguroni okerr — Ă«shtĂ« nĂ« alerte, qĂ« tĂ« mund tĂ« krijoni njĂ« tregues brenda njĂ« minute. Ai mund tĂ« ketĂ« «fjetur» pĂ«r njĂ« vit, thjesht duke pranuar pĂ«rditĂ«sime, dhe kur pas njĂ« viti diçka ju dĂ«mtohet — ai ndizet dhe dĂ«rgon alarmin. Koha qĂ« keni shpenzuar njĂ« herĂ« pĂ«r tĂ« krijuar treguesin Ă«shtĂ« shpĂ«rblyer; ju e mĂ«suat probleme menjĂ«herĂ«, para tĂ« gjithĂ«ve. Mund tĂ« keni edhe rregulluar, pĂ«rpara se dikush ta vĂ«rejĂ«. E ngritur shpejt nuk konsiderohet e rĂ«nĂ«!

Siguria

Do tĂ« ishte keq nĂ«se vendosni monitorimin pĂ«r tĂ« rritur besueshmĂ«rinĂ«, dhe si rezultat — ju sulmoheni pĂ«rmes tij, dhe ka shumĂ« vulnerabilitete nĂ« rrjet tĂ« mjeteve tĂ« ndryshme tĂ« monitorimit (Zabbix, Nagios).

Agjenti (okerrmod nga paketa okerrupdate), qĂ« funksionon nĂ« sistem — nuk Ă«shtĂ« njĂ« server rrjeti, por njĂ« klient. Prandaj nĂ« serverin e monitoruar nuk ka porte tĂ« hapura shtesĂ«; klienti punon lehtĂ«sisht pas njĂ« firewall-i ose NAT-i dhe Ă«shtĂ« shumĂ« e vĂ«shtirĂ« (do ta quaja «tĂ« pamundur») ta thyejĂ«sh nĂ« rrjet, pasi nuk dĂ«gjon asnjĂ« socket rrjeti.

Diagnozë e plotë e monitorimit

Tani kemi njĂ« rregull — ne zbulojmĂ« tĂ« gjithĂ« problemet teknike nga okerr. NĂ«se ndonjĂ«herĂ« rregulli shkelet (okerr nuk njofton pĂ«r ndodhinĂ« e saj tĂ« afĂ«rt (nĂ«se kjo Ă«shtĂ« e mundur) ose pĂ«r atĂ« qĂ« ka ndodhur tashmĂ«) — ne shtojmĂ« kontrollime nĂ« okerr.

Kontrollime të jashtme

Një grup i zakonshëm:

  • ping
  • http status
  • kontrolli i vlefshmĂ«risĂ« dhe freskisĂ« sĂ« certifikatĂ«s SSL (do tĂ« njoftojĂ« nĂ«se afati skadon sĂ« shpejti)
  • TCP port i hapur dhe banner mbi tĂ«
  • http grep (nĂ« faqe [nuk] duhet tĂ« ketĂ« njĂ« tekst tĂ« caktuar)
  • sha1 hash pĂ«r tĂ« kapur ndryshimin e faqeve.
  • DNS (regjistri DNS duhet tĂ« ketĂ« njĂ« vlerĂ« tĂ« caktuar)
  • WHOIS (do tĂ« njoftojĂ« nĂ«se domeni skadon sĂ« shpejti)
  • Antispam DNSBL (kontrolli i hostit nĂ« 50+ lista tĂ« zezĂ« antispam)

Kontrollime të brendshme

Po ashtu, një grup i zakonshëm (por i lehtë për t'u zgjeruar).

  • df (hapĂ«sira e lirĂ« nĂ« disqe)
  • load average
  • opentcp (TCP socket tĂ« hapur — do tĂ« njoftojĂ« nĂ«se diçka ka filluar ose ka rĂ«nĂ«)
  • uptime — thjesht uptime nĂ« server. Do tĂ« njoftojĂ« nĂ«se ndryshon pĂ«r poshtĂ« (dmth. serveri Ă«shtĂ« ri-ngarkuar)
  • client_ip
  • dirsize — e pĂ«rdorim pĂ«r tĂ« monitoruar kur virtualkĂ«t rootfs pĂ«rjashtohen nga madhĂ«sia e lejuar, pa vendosur kufizime tĂ« rrepta, dhe pĂ«r madhĂ«sitĂ« e katalogĂ«ve tĂ« pĂ«rdoruesve.
  • empty dhe nonempty — monitorojnĂ« skedarĂ«t qĂ« duhet tĂ« jenĂ« tĂ« zbrazĂ«t (ose jo tĂ« zbrazĂ«t). PĂ«r shembull, regjistri i gabimeve tĂ« shĂ«rbimit tĂ« serverit okerr — duhet tĂ« jetĂ« i zbrazĂ«t, dhe nĂ«se ka edhe njĂ« rresht — do tĂ« marr njĂ« njoftim dhe do ta kontrolloj. NdĂ«rsa mail.log nĂ« serverin e postĂ«s duhet tĂ« JETË JO i zbrazĂ«t (pas N minutash pas rotacionit). Disa herĂ« na ka ndodhur tĂ« jetĂ« tĂ« zbrazĂ«t, pas pĂ«rditĂ«simit tĂ« sistemit, kur logrotate nuk arriti tĂ« rihapĂ« saktĂ«sisht rsyslog.
  • linecount — numri i rreshtave nĂ« skedar (si wc -l). E pĂ«rdorim si njĂ« zĂ«vendĂ«sim mĂ« tĂ« butĂ« pĂ«r empty, kur regjistri i gabimeve mund tĂ« rritet, por vetĂ«m ngadalĂ« (p.sh., googlebot pĂ«rpiqet tĂ« hyjĂ« nĂ« disa faqe tĂ« mbyllura). Ka njĂ« limit prej 2 rreshtash nĂ« 20 minuta. NĂ«se pĂ«rfundojmĂ« mbi kĂ«tĂ« — do tĂ« ketĂ« njĂ« alarme.

Kontrollime interesante të brendshme.

Nëse derisa lexuat deri në këtë pikë e bëtë «në diagonale», tani do të jetë më interesante të lexoni me kujdes.

backups

Ndjek backup-et në katalog. Ndër ne, skedarët e backup-it kanë emra si «ServerName-20200530.tar.gz». Për çdo server në okerr krijohet një indikator ServerName-DATE.tar.gz (data aktuale ndryshohet me rreshtin «DATE»). Ndjeket edhe prania e një backup-i të ri dhe madhësia e tij (p.sh., nuk mund të jetë më e vogël se 90% e backup-it të mëparshëm).

ÇfarĂ« duhet tĂ« bĂ«jmĂ« qĂ« njĂ« backup i ri tĂ« fillojĂ« tĂ« ndiqet, pasi e kemi filluar ta krijojmĂ« dhe ta vendosim nĂ« kĂ«tĂ« katalog? AsgjĂ«! Ky Ă«shtĂ« njĂ« qasje shumĂ« e pĂ«rshtatshme, kur duhet tĂ« bĂ«ni «asgjë», sepse:

  • TĂ« bĂ«sh «asgjë» Ă«shtĂ« mjaft e shpejtĂ«, kursen kohĂ«
  • E vĂ«shtirĂ« qĂ« tĂ« harrosh tĂ« bĂ«sh «asgjë»
  • E vĂ«shtirĂ« qĂ« tĂ« bĂ«sh «asgjë» gabim. AsgjĂ« – Ă«shtĂ« metoda mĂ« e besueshme

NĂ«se ndodhi qĂ« tĂ« mos shfaqen mĂ« skedarĂ« tĂ« rinj tĂ« backup-it – do tĂ« ketĂ« njĂ« alarme. NĂ«se, pĂ«r shembull, keni çaktivizuar njĂ« nga serverĂ«t dhe backup-et e tij nuk duhet tĂ« jenĂ« mĂ« – do t'ju nevojitet tĂ« fshini indikatorin (nĂ«pĂ«rmjet ndĂ«rfaqes sĂ« internetit ose nga shell pĂ«rmes API).

maxfilesz

Ndjek madhësinë e skedarëve më të mëdhenj (zakonisht: /var/log/*). Kjo lejon kapjen e problemeve të paparashikueshme, p.sh., tentativat për të thyer fjalëkalimet ose shpërndarjen e spamit përmes serverit.

runstatus/runline

Këto janë dy module proxy të rëndësishme për të ekzekutuar programe të tjera në server. Runstatus raporton statusin e daljes së programit. Për shembull, në okerr nuk ka (nuk kërkohet) një modul për të kontrolluar nëse shërbimet systemd funksionojnë. Kjo bëhet përmes runstatus (shih më poshtë). Runline raporton në server rreshtin që jep programi. Për shembull, temp_RUN="cat /sys/class/thermal/thermal_zone0/temp" në konfigurimin e Runline në serverin tonë krijon një tregues servername:temp me temperaturën e procesorit.

sql

Ekzekuton njĂ« pyetje numerike nĂ« MySQL dhe raporton rezultatin nĂ« tregues. NĂ« rastin mĂ« tĂ« thjeshtĂ«, mund tĂ« bĂ«ni, pĂ«r shembull, «SELECT 1» — kjo do tĂ« kontrollojĂ« nĂ«se nĂ« pĂ«rgjithĂ«si DBMS funksionon.

Por njĂ« aplikim shumĂ« mĂ« interesant — pĂ«r shembull, tĂ« ndjekĂ«sh numrin e porosive nĂ« njĂ« dyqan online. NĂ«se e dini qĂ« çdo orĂ« keni 100 porosi, mund tĂ« vendosni njĂ« kufi minimal prej 100 ose 80. AtĂ«herĂ« nĂ«se papritur ju bien shitjet — do tĂ« merrni njĂ« alarĂ«m dhe do tĂ« mund tĂ« zgjidhni çështjen.

Vini re — nuk ka rĂ«ndĂ«si pĂ«r arsyen e paparashikueshme pĂ«rse ka ndodhur kjo:

  • Serveri thjesht nuk Ă«shtĂ« i aksesueshĂ«m (i pa energji ose pa rrjet), dhe alarami ka ardhur sepse treguesi Ă«shtĂ« 'prishur'.
  • Serveri Ă«shtĂ« i ngarkuar, punon ngadalĂ«, ose paketat po humbasin, pĂ«rdoruesit ndihen tĂ« pakĂ«naqur dhe largohen pa blerĂ«.
  • Serveri Ă«shtĂ« futur nĂ« listat e spam-it dhe postat nga ai nuk pranohen, pĂ«rdoruesit nuk mund tĂ« regjistrohen.
  • Buxheti i fushatĂ«s reklamuese Ă«shtĂ« mbaruar, banneret nuk po shfaqen.

Mund të ketë shumë arsye dhe nuk mund të parashikohet gjithçka paraprakisht, ndërsa është teknikisht e vështirë të monitorohet. Por mund të monitorohet lehtë parametri përfundimtar (porositë) dhe në bazë të tyre të përcaktohet se situata është e dyshimtë dhe kërkon verifikim.

Të dhënat logjike

Lejon pĂ«rdorimin e shprehjeve logjike (pĂ«rgjegjshmĂ«ria Python) pĂ«rmes modulit evalidate(artikulli nĂ« HabrĂ«). PĂ«r shprehjen, tĂ« dhĂ«nat e projektit dhe treguesve tĂ« tij janĂ« nĂ« dispozicion. PĂ«r shembull, nĂ« kapitullin mĂ« lart mbi verifikimin SQL, ndoshta e keni vĂ«nĂ« re njĂ« pikĂ« tĂ« dobĂ«t — gjatĂ« ditĂ«s kemi deri nĂ« 100 shitje nĂ« orĂ«, por natĂ«n — 20, dhe kjo Ă«shtĂ« normale, nuk Ă«shtĂ« problem. Si tĂ« veprojmĂ«? Treguesi do tĂ« panikonte vazhdimisht natĂ«n.

Mund të krijoni dy indikatorë, një të ditës dhe një të natës. Të dy t'i bëni «të qetë» (nuk do të dërgojnë njoftime). Po ashtu, të krijoni një indikator logjik, i cili kërkon që deri në orën 20:00 indikatorët e ditës të jenë në rregull, dhe pas orës 20:00, mjafton që indikatori i natës të jetë OK.

Një shembull tjetër i përdorimit të indikatorit logjik është eskalimi. Për shembull, menaxheri i projektit hiqet nga njoftimet (ai nuk e ka nevojën, administratorët duhet të reagojnë ndaj problemeve normale), por lidhet me indikatorin logjik, i cili nxjerr ngjyrë të kuqe nëse ndonjë indikator në projekt nuk është rregulluar brenda kohës së caktuar.

Po ashtu, ekziston mundĂ«sia pĂ«r tĂ« caktuar njĂ« kohĂ« tĂ« lejuar pĂ«r punĂ«, pĂ«r shembull, nga ora 3 deri nĂ« 5 tĂ« mĂ«ngjesit. Nuk na shqetĂ«son nĂ«se serverĂ«t dhe faqet bien nĂ« kĂ«tĂ« kohĂ«. Por nĂ« orĂ«n 5:00, ato duhet tĂ« funksionojnĂ«. NĂ«se nuk funksionojnĂ« nĂ« ndonjĂ« kohĂ« tjetĂ«r—do tĂ« ketĂ« njĂ« alerter. Gjithashtu, indikatorĂ«t logjikĂ« lejojnĂ« tĂ« merret parasysh rezervimi i serverĂ«ve. NĂ«se keni 5 serverĂ« web, atĂ«herĂ« administratorĂ«t mund tĂ« fikĂ«n 1-2 serverĂ« nĂ« çdo kohĂ«. Por nĂ«se nĂ« funksion do tĂ« ketĂ« mĂ« pak se 3 nga 5 serverĂ«t—do tĂ« ketĂ« njĂ« alerter.

Shembujt mĂ« sipĂ«r nuk janĂ« funksione tĂ« okerr, as ndonjĂ« tipar qĂ« duhet aktivizuar dhe konfiguruar. TĂ« gjitha kĂ«to funksione nuk i gjenden nĂ« okerr, por ekziston njĂ« modul logjik qĂ« mundĂ«son realizimin e kĂ«tij funksionaliteti (Mund tĂ« krahasohet me njĂ« gjuhĂ« programuese — nĂ«se kemi operatorĂ« aritmetikĂ«, atĂ«herĂ« nuk na nevojitet njĂ« funksion i veçantĂ« pĂ«r llogaritjen e 20% TVSH, sepse mund ta bĂ«jmĂ« vetĂ« sipas nevojave tona).

Indikatori logjik, ndoshta, është një nga temat relativisht të ndërlikuara në okerr, por lajm i mirë është se nuk keni nevojë t'i mësoni ato derisa të lindë nevoja. Megjithatë, ato zgjasin shumë mundësitë, duke e mbajtur sistemin vetë mjaft të thjeshtë.

Shtimi i kontrollit tuaj

Doja tĂ« theksoja se okerr nuk Ă«shtĂ« njĂ« grup me mijĂ«ra kontrolle tĂ« gatshme pĂ«r çdo rast, por pĂ«rkundrazi — nĂ« radhĂ« tĂ« parĂ« — njĂ« motor i thjeshtĂ« me mundĂ«sinĂ« e thjeshtĂ« pĂ«r tĂ« krijuar kontrollet tuaja. Krijimi i kontrolleve tuaja nĂ« okerr nuk Ă«shtĂ« njĂ« detyrĂ« pĂ«r hakerĂ«t, bashkĂ«-zhvilluesit e sistemit, ose tĂ« paktĂ«n pĂ«r pĂ«rdoruesit e avancuar tĂ« okerr, por Ă«shtĂ« njĂ« detyrĂ« e realizueshme pĂ«r çdo administrator qĂ« njĂ« muaj mĂ« parĂ« ka instaluar pĂ«r herĂ« tĂ« parĂ« linux.

Kontrollat në minimum bëhen përmes modulit statusi:

Kjo rresht në konfigurim statusi do të njoftojë nëse ndonjëherë "/bin/true" nuk fillon ose kthehet me jo 0.

true_OK="/bin/true"

NjĂ« rresht i vetĂ«m — dhe ja ku ne kemi zgjeruar pak funksionalitetin okerr. Madje edhe kjo kontrolle — ka vlerĂ«n e saj: nĂ«se ndonjĂ«herĂ« serveri juaj bie — treguesi pĂ«rkatĂ«s nĂ« serverin okerr nuk do tĂ« pĂ«rditĂ«sohet nĂ« kohĂ«, dhe pas kalimit tĂ« kohĂ«s do tĂ« shfaqet njĂ« alarme.

Ky kontroll do të njoftojë që serveri apache2 ka rënë (së paku
):

apache_OK="systemctl is-active --quiet apache2"

Pra, nĂ«se zotĂ«roni ndonjĂ« gjuhĂ« programimi, tĂ« paktĂ«n mund tĂ« shkruani skripte shell — atĂ«herĂ« ju mund tĂ« shtoni kontroll tĂ« tuajat.

MĂ« komplekse — mund tĂ« shkruani (nĂ« çfarĂ«do gjuhe) modul tuaj pĂ«r okerrmod. NĂ« rastin mĂ« tĂ« thjeshtĂ« duket kĂ«shtu:

E vërtetë, nuk është shumë e ndërlikuar? Moduli duhet të bëjë kontrollin vetë dhe të japë rezultatet në STDOUT. Një modul më kompleks jep, për shembull, këtë:

#!/usr/bin/python3

print("STATUS: OK")

$ okerrmod --dump df NAME: pi:df-/ TAGS: df METHOD: numerical|maxlim=90 DETAILS: 49.52%, 13.9G/28.2G përdorur, 13.0G të lirë STATUS: 49.52NAME: pi:df-/boot TAGS: df METHOD: numerical|maxlim=90 DETAILS: 84.32%, 53.1M/62.9M përdorur, 9.9M të lirë STATUS: 84.32

$ okerrmod --dump df
NAME: pi:df-/
TAGS: df
METHOD: numerical|maxlim=90
DETAILS: 49.52%, 13.9G/28.2G përdorur, 13.0G të lirë
STATUS: 49.52

NAME: pi:df-/boot
TAGS: df
METHOD: numerical|maxlim=90
DETAILS: 84.32%, 53.1M/62.9M përdorur, 9.9M të lirë
STATUS: 84.32

Ai përditëson disa tregues menjëherë (të ndara me një linjë të bardhë), dhe nëse është e nevojshme, krijon ato, përcakton detajet e kontrollit dhe etiketën, e cila lehtëson gjetjen e treguesve të nevojshëm në panelin e kontrollit.

Telegram

Ka një bot Telegram @OkerrBot. Nuk keni nevojë të mbushni telefonin me aplikacione të veçanta (as për vete nuk më pëlqen që për Pjatën nevojitet një aplikacion me hartën, për Lenten një tjetër, për MTS një të tretë, dhe kështu me radhë për të gjithë). Një Telegram është i mjaftueshëm. Përmes Telegramit mund të merrni alarmin menjëherë, të kontrolloni statusin e projektit dhe të jepni komandën për të kontrolluar përsëri të gjithë treguesit problematikë. Dola nga teatri/avioni, dy orë nuk e mbajta dorën në pulsin e situatës, aktivizova telefonin, shtypa një buton në chatbot, dhe u sigurova që gjithçka ishte në rregull.

Faqet e statusit

Në kohën tonë, faqet e statusit janë tashmë një must-have për çdo biznes që ka IT, një qëndrim të përgjegjshëm ndaj besueshmërisë dhe që respekton klientët/përdoruesit e vet.

Imagjinoni njĂ« situatĂ« – njĂ« pĂ«rdorues dĂ«shiron tĂ« bĂ«jĂ« diçka, tĂ« shikojĂ« informacion ose tĂ« bĂ«jĂ« njĂ« porosi, dhe diçka nuk funksionon. Ai nuk e di se çfarĂ« Ă«shtĂ« problemi, nĂ« anĂ«n e kujt Ă«shtĂ« problemi dhe kur do tĂ« zgjidhet. Ndoshta kompania juaj ka njĂ« faqe tĂ« paekzekutueshme? Ose Ă«shtĂ« prishur gjashtĂ« muaj mĂ« parĂ« dhe do tĂ« riparohen pas dy vitesh? Por frigoriferi duhet blerĂ« tani, Ă«shtĂ« nĂ« shportë  Dhe Ă«shtĂ« diçka shumĂ« ndryshe kur dikush sheh qĂ« diçka nuk Ă«shtĂ« nĂ« rregull me ju (tĂ« paktĂ«n Ă«shtĂ« e qartĂ« se problemi nuk Ă«shtĂ« nĂ« anĂ«n e tij), qĂ« problemi Ă«shtĂ« zbuluar, se ju po punoni mbi tĂ«, dhe ndoshta madje keni shkruar njĂ« kohĂ« tĂ« pĂ«rafĂ«rt pĂ«r riparimin. PĂ«rdoruesi mund tĂ« abonoheshe dhe tĂ« marrĂ« njĂ« njoftim nĂ« email kur problemi tĂ« zgjidhet dhe tĂ« mund tĂ« bĂ«jĂ« atĂ« qĂ« dĂ«shiron (tĂ« blejĂ« frigoriferin).

Përmbledhja e sistemit hibrid të monitorimit Okerr

Problemet, downtime – janĂ« tĂ« pranishme pĂ«r tĂ« gjithĂ«. Por pĂ«rdoruesit dhe partnerĂ«t i besojnĂ« mĂ« shumĂ« atyre qĂ« janĂ« mĂ« tĂ« hapur dhe e trajtojnĂ« kĂ«tĂ« nĂ« mĂ«nyrĂ« tĂ« pĂ«rgjegjshme.

Këtu është përmbledhje e 10 projekteve të tjera që lejojnë krijimin e faqeve të statusit. Këtu janë disa shembuj se si duken këto faqe te projektet Python dhe Dropbox. Faqja e statusit okerr.

Failover

PĂ«r tĂ« mos e bĂ«rĂ« kĂ«tĂ« artikull edhe mĂ« tĂ« gjatĂ«, do t'i referohem sĂ«rish artikullit tim tĂ« mĂ«parshĂ«m — Failover i thjeshtĂ« pĂ«r website-in . NĂ«se mund tĂ« krijoni njĂ« server rezervĂ«, atĂ«herĂ« duke pĂ«rdorur failover, nĂ« thelb nuk do tĂ« keni downtime tĂ« gjatĂ« — sa herĂ« qĂ« problemi tĂ« zbulohet, pĂ«rdoruesit automatikisht do tĂ« redirektohen nĂ« serverin rezervĂ« nĂ« punĂ«. MĂ« duket se kjo Ă«shtĂ« njĂ« tipar shumĂ« interesant e tĂ«rheqĂ«s, qĂ« pak vende e kanĂ«.

Kërkesat e ulëta për sistemin

PĂ«r serverat okerr — ne pĂ«rdorim makina me RAM nga 2Gb. PĂ«r sensorĂ«t rrjetĂ«rore — madje edhe 512Mb janĂ« tĂ« mjaftueshme. Pjesa klienti — pothuajse zero. (Pakoja okerrupdate peshon 26 Kb, por kĂ«rkon Python3 dhe bibliotekat standarde). Klienti ekzekutohet nga njĂ« skenar krone, kĂ«shtu qĂ« ka konsum tĂ« vazhdueshĂ«m zero tĂ« memories. NĂ« mesin e makinave qĂ« po vĂ«zhgojmĂ«, kemi sensorĂ« (VPS shumĂ« tĂ« lira me 512Mb RAM) dhe Raspberry Pi. ËshtĂ« e mundur madje tĂ« dĂ«rgoni pĂ«rditĂ«sime pa pjesĂ«n klient. pĂ«rdor duke curl! (shih mĂ« poshtĂ«)

Duke pasur parasysh kĂ«tĂ« — okerr, ndoshta, Ă«shtĂ« mĂ« e lirĂ« Sistemi i monitorimit nga ato qĂ« kemi, sepse pĂ«r tĂ« pĂ«rdorur njĂ« sistem tjetĂ«r falas me burĂ«s tĂ« hapur si Zabbix ose Nagios, duhet t'i kushtoni atij burime (server), dhe kjo Ă«shtĂ« tashmĂ« njĂ« kosto. PĂ«r mĂ« tepĂ«r, kĂ«rkohet disa mirĂ«mbajtje pĂ«r serverin. Me okerr — mund ta hiqni kĂ«tĂ« pjesĂ«. Dhe mund ta ruani dhe tĂ« pĂ«rdorni serverin tuaj, nĂ« varĂ«si tĂ« preferencave tuaja.

API dhe integrimi në programin tuaj

Arkitekturë e thjeshtë dhe e hapur. Me okerr, kemi një API, i cili është lehtë i përdorshëm. Duhet të krijoni 1000 tregues? Një shell-skript në 3-4 rreshta mund ta bëjë këtë. Duhet të ripërruani 1000 tregues? Po ashtu shumë lehtë. Për shembull, ne duam të kontrollojmë të gjitha certifikatat tona HTTPS saktësisht nga sensori rus:

#!/bin/sh

for indicator in `okerrclient --api-filter sslcert`
do
    echo set location for $indicator
    okerrclient --api-set location=ru retest=1 --name $indicator
done

Për të përditësuar një tregues, mund ta bëni atë duke përdorur modulin tonë klient, ose madje edhe pa të, thjesht përmes curl.

# short and nice (using okerrupdate and config file)
$ okerrupdate MyIndicator OK

# only curl is enough!
$ curl -d 'textid=MyProject&name=MyIndicator&secret=MySecret&status=OK' https://bravo.okerr.com/

Mund tĂ« pĂ«rmirĂ«soni treguesit drejtpĂ«rdrejt nga programi juaj. PĂ«r shembull, duke dĂ«rguar sinjale heartbeat, nĂ« mĂ«nyrĂ« qĂ« okerr tĂ« dijĂ« se Ă«shtĂ« aktiv, dhe tĂ« aktivizojĂ« alarmin nĂ«se ka rĂ«nĂ« ose Ă«shtĂ« ngrirĂ«. PĂ«r mĂ« tepĂ«r, komponentĂ«t e okerr e bĂ«jnĂ« kĂ«tĂ« — okerr monitoron vetveten, dhe problemet nĂ« pothuajse çdo modul do tĂ« zbulohen dhe do tĂ« gjenerojnĂ« njoftime pĂ«r problemin. (Dhe pĂ«r rastin e kĂ«tij «pothuajse» — ato kontrollohen gjithashtu nga njĂ« server tjetĂ«r)

Ja një kod (i thjeshtuar) në botin tonë të telegramit:

from okerrupdate import OkerrProject, OkerrExc

op = OkerrProject()
uptimei = op.indicator("{}:telebot_uptime".format(hostname))
...
uptimei.update('OK', 'pid: {} Uptime: {} cmds: {}'.format(
        os.getpid(), dhms(uptime), commands_cnt))

PĂ«r tĂ« pĂ«rmirĂ«suar treguesit nga programet Python — ekziston njĂ« bibliotekĂ« okerrupdate, pĂ«r gjuhĂ« tĂ« tjera — nuk ka biblioteka, por mund tĂ« thĂ«rrisni skenarin okerrupdate, ose tĂ« shkrepni njĂ« kĂ«rkesĂ« HTTP nĂ« serverin okerr.

Si na ndihmon okerr

Okerr e ka ndryshuar jetĂ«n tonĂ«. NĂ« tĂ« vĂ«rtetĂ«. Mund tĂ« kishte njĂ« sistem tjetĂ«r monitorimi po ashtu, por Ă«shtĂ« lehtĂ« dhe thjeshtĂ« tĂ« punosh me okerr dhe ofron tĂ« gjitha funksionalitetet qĂ« na duheshin (ato qĂ« mungonin — ne i shtuam). PĂ«r mĂ« tepĂ«r, nĂ«se ndonjĂ« funksionalitet nuk Ă«shtĂ« i pranishĂ«m — pyesni, dhe do ta shtoj (nuk premtoj, por kam dĂ«shirĂ« qĂ« okerr tĂ« jetĂ« sistemi mĂ« i mirĂ« i monitorimit pĂ«r projektet e vogla dhe tĂ« mesme). Apo, mĂ« mirĂ« akoma, shtoni vetĂ« — Ă«shtĂ« e thjeshtĂ«.

Kemi arritur tĂ« jetojmĂ« sipas parimit "tĂ« mĂ«sojmĂ« pĂ«r tĂ« gjitha problemet nga okerr". NĂ«se ndodhi ndonjĂ« problem, pĂ«r tĂ« cilin nuk mĂ«suam nga okerr — e shtojmĂ« kontrollin nĂ« okerr. (nĂ« kĂ«tĂ« rast, me "ne" kam parasysh pĂ«rdoruesit e sistemit, jo bashkĂ«-zhvilluesit). Fillimisht ndodhte shpesh, por tani Ă«shtĂ« bĂ«rĂ« shumĂ« e rrallĂ«.

Monitorimi

Me përmes okerr ne ndjekim madhësitë e logëve në të gjitha serverët. Leximi me kujdes i çdo rreshti të logut është në fakt i pamundur, por thjesht ndjekja e shpejtësisë së rritjes ofron shumë informacion. Në këtë mënyrë zbulojmë dërgimin e spamit dhe bruta-forcimin e fjalëkalimeve, si dhe kur ndonjë nga aplikacionet "çmendet", kur diçka shkon keq dhe ato përsërisin vazhdimisht (çdo herë duke shtuar disa rreshta në log).

Certifikatat SSL. Pothuajse menjĂ«herĂ« pas lançimit LetsEncrypt klienti ynĂ« filloi tĂ« ofrojĂ« certifikata SSL falas pĂ«r klientĂ«t e tij (afro njĂ« mijĂ« tĂ« tillĂ«). Dhe kjo u tregua njĂ« makth pĂ«r administrimin! Problemi Ă«shtĂ« se faqet janĂ« "aktive", klientĂ«t herĂ« pas here kĂ«rkojnĂ« qĂ« t'u bĂ«het diçka, programuesit e bĂ«jnĂ«. Ata mund tĂ« transferojnĂ« lirisht faqen nĂ« njĂ« DocumentRoot tjetĂ«r, pĂ«r shembull. Ose tĂ« shtojnĂ« njĂ« Rewrite tĂ« pa kushtĂ«zuar nĂ« konfigurimin e virthostit. Natyrisht, pas njĂ« ndryshimi tĂ« tillĂ«, automatikisht prishet rinovimi i certifikatave. Tani tĂ« gjithĂ« hostĂ«t SSL shtohen nĂ« okerr automatikisht pĂ«rmes njĂ« tjetĂ«r utilitari tĂ« dobishĂ«m nga paketa a2conf. Thjesht e ekzekutojmĂ« a2okerr.py — dhe nĂ«se nĂ« server janĂ« shfaqur disa faqe tĂ« reja — ato do tĂ« shfaqen automatikisht nĂ« okerr. NĂ«se pĂ«r ndonjĂ« arsye certifikata nuk rinovohet, ne e dimĂ« dhe merremi me tĂ« tre javĂ« para se tĂ« skadojĂ« certifikata. a2certbot.py nga e njĂ«jta paketĂ« — ndihmon shumĂ« nĂ« kĂ«tĂ« (verifikon menjĂ«herĂ« problemet mĂ« tĂ« mundshme — dhe tregon se çfarĂ« ka kaluar mirĂ« dhe ku ka ndoshta njĂ« problem).

Ne ndjekim afatin e skadimit tĂ« tĂ« gjitha domenĂ«ve tanĂ«. TĂ« gjithĂ« serverĂ«t tanĂ« tĂ« postĂ«s, tĂ« cilĂ«t dĂ«rgojnĂ« postĂ« — kontrollohen gjithashtu nĂ« mbi 50 lista tĂ« ndryshme tĂ« zeza. (Dhe herĂ« pas here kalojnĂ« nĂ« to). Nga ana tjetĂ«r, a e dini se serverĂ«t e postĂ«s sĂ« google gjithashtu janĂ« nĂ« lista tĂ« zeza? Thjesht pĂ«r vetĂ«testim, e kemi shtuar mail-wr1-f54.google.com nĂ« serverat qĂ« ndjekim, dhe ai Ă«shtĂ« nĂ« listĂ«n e zezĂ« SORBS! (Kjo Ă«shtĂ« pĂ«r pyetjen mbi vlerĂ«n e "anti-spam".)

BĂ«backup — mĂ« lart e kam shkruar se sa e lehtĂ« Ă«shtĂ« tĂ« ndjekim ato me okerr. Por ne gjithashtu ndjekim backupet e freskĂ«ta nĂ« serverin tonĂ«, dhe (me ndihmĂ«n e njĂ« utiliteti tĂ« veçantĂ« qĂ« pĂ«rdor okerr) — backupet qĂ« ngarkojmĂ« nĂ« Amazon Glacier. Dhe, po — herĂ« pas here ndodhin probleme. Nuk Ă«shtĂ« pĂ«r t'u habitur qĂ« po i ndjekim.

Ne përdorim një indikator eskalimi. Ai tregon nëse ndonjë problem nuk është zgjidhur për një kohë të gjatë. Edhe unë, kur zgjidh disa detyra, ndonjëherë mund të harroj për to. Eskalimi është një kujtesë e mirë, veçanërisht nëse i ndiqni vetë.

Në përgjithësi, unë mendoj se cilësia e punës sonë ka rritur ndjeshëm. Ka shumë pak ndërprerje (ose klienti as që arrin ta vërejë atë. Vetëm bllok!), ndërsa vëllimi i punës është zvogëluar dhe kushtet e punës janë bërë më të qetë. Ne kaluam nga puna e ngutshme me sëndylar të çarjeve me ngjitës në një punë të qetë dhe të përmirësuar, ku shumë çështje parashikohen më parë dhe ka kohë për t'i parandaluar ato. Edhe problemet e ndodhura janë bërë më të lehta për t'u zgjidhur: së pari, ne përpiqemi të informohemi për to para se klientët të krijojnë panik, së dyti, shpesh ndodh që problemi lidhet me punën e fundit (ndërkohë që bëja diçka, prisha diçka tjetër) - kështu që është më e lehtë të trajtojmë atë në momentin e ngjarjes.

Ja, kishte edhe një rast


A e dini se nĂ« Debian 9 tĂ« njohur (Stretch) njĂ« paketĂ« shumĂ« tĂ« njohur si phpmyadmin Ă«shtĂ« ende (qĂ« prej muajsh!) nĂ« statusin vulnerable?CVE-2019-6798). Kur doli vulnerabiliteti — ne shpejt e bllokuam atĂ« nĂ« disa mĂ«nyra. Por unĂ« vendosa qĂ« nĂ« okerr tĂ« vendosja ndjekjen e faqes security-tracker’it, pĂ«r tĂ« ditur kur do tĂ« dilte zgjidhja 'e bukur' (nĂ«pĂ«rmjet SHA1 tĂ« pĂ«rmbajtjes). Disa herĂ« indikatorĂ«t mĂ« tĂ«rhiqnin vĂ«mendjen, faqja ndryshonte, por siç e shihni — deri mĂ« sot (qĂ« nga janari 2019!) nuk Ă«shtĂ« njoftuar asgjĂ« pĂ«r zgjidhjen e problemit. Ndoshta, qofshin, dikush e di se çfarĂ« problemi Ă«shtĂ« qĂ« ky paketĂ« ka qenĂ« vulnerable pĂ«r mĂ« shumĂ« se njĂ« vit?

Një herë tjetër në një situatë të ngjashme: pas një dobësie në SSH, duhej të përditësoheshin të gjitha serverët. Kur vendos një detyrë, duhet ta kontrollosh ekzekutimin. (Nënshtruarit kanë tendencën të kuptojnë ndryshe, të harrojnë, të ngatërrohen, të bëjnë gabime). Prandaj, fillimisht në okerr shtuam kontrollin e versionit të SSH në të gjitha serverët, dhe përmes okerr ndoqëm që përditësimet të aplikohej në të gjitha serverët. (E përshtatshme! Zgjodha këtë lloj treguesi, dhe menjëherë shihet në cilin server cila version është). Kur u siguruam që detyra ishte përfunduar në të gjithë serverët, ne hoqëm treguesit.

Disa herĂ« ka ndodhur qĂ« ndonjĂ« problem tĂ« shfaqet, e mĂ« pas vetĂ« tĂ« zhduket. (sigurisht qĂ« Ă«shtĂ« e njohur pĂ«r tĂ« gjithĂ«?). NdĂ«rsa e vĂ«ren, derisa tĂ« kontrollosh — e aty nuk ka çfarĂ« tĂ« kontrollosh mĂ« — gjithçka funksionon mirĂ«. Por pastaj prapĂ« dĂ«shtues. Kjo na ka ndodhur, pĂ«r shembull, me produktet qĂ« ngarkonim nĂ« Amazon Marketplace (MWS). NĂ« njĂ« moment tĂ« caktuar, inventari i ngarkuar ishte i gabuar (nuk ishin ato sasi produktesh dhe nuk ishin ato çmime). E kuptuam. Por pĂ«r tĂ« kuptuar — ishte e rĂ«ndĂ«sishme tĂ« dinim pĂ«r problemin menjĂ«herĂ«. FatkeqĂ«sisht, MWS si tĂ« gjitha shĂ«rbimet e Amazon-it — Ă«shtĂ« paksa ngadalĂ«suese, prandaj gjithmonĂ« kishte vonesĂ«, por megjithatĂ« — arritĂ«m tĂ« kapnim sĂ« paku lidhjen mes problemit dhe skripteve qĂ« e shkaktojnĂ« atĂ« (bĂ«mĂ« njĂ« kontroll, e lidhĂ«m me errorin dhe kontrollonim menjĂ«herĂ« pas marrjes sĂ« alertit).

NjĂ« rast interesant sĂ« fundmi u shtua nĂ« koleksionin tim nga njĂ« ofrues i madh dhe i shtrenjtĂ« evropian i hostimit, tĂ« cilin e pĂ«rdor klienti ynĂ«. Papritmas, tĂ« gjithĂ« serverĂ«t tanĂ« u zhdukĂ«n nga radarĂ«t! Fillimisht, klienti vetĂ« e vuri re (shumĂ« shpejt, si Okerr!) qĂ« саĐčто me tĂ« cilin po punonte nuk hapte mĂ« dhe hapi njĂ« ticket pĂ«r kĂ«tĂ«. Por, jo vetĂ«m njĂ« sit, por tĂ« gjitha! (Natasha, ne i patĂ«m tĂ« gjithĂ«!). KĂ«shtu, Okerr filloi tĂ« dĂ«rgonte mesazhe tĂ« gjata me tĂ« gjithĂ« treguesit qĂ« u ndezĂ«n. PanikĂ«-panike, vrapojmĂ« rreth (çfarĂ« tjetĂ«r tĂ« bĂ«jmĂ«?). MĂ« pas, gjithçka u rikthye. U duk se nĂ«/data qendĂ«r kishte punime tĂ« programuar (njĂ« herĂ« çdo shumĂ« vjet) dhe, natyrisht, duhej tĂ« na kishin paralajmĂ«ruar. Por ndodhi qĂ« ata patĂ«n ndonjĂ« problem dhe nuk na paralajmĂ«ruan. NjĂ« infarkt mĂ« shumĂ«, njĂ« infarkt mĂ« pak. Por pas rikthimit tĂ« gjithçkaje — duhet ta kontrollosh gjithçka! Nuk mund ta imagjinoj si do ta bĂ«ja me duar. Okerr e testoi gjithçka brenda disa minutash. Doli se njĂ« pjesĂ« e madhe e serverĂ«ve thjesht ishte pĂ«rkohĂ«sisht e papĂ«rballueshme, por punonte. Disa — u ngarkuan, por gjithashtu u vendosĂ«n siç duhej. Nga tĂ« gjitha humbjet — humbĂ«m dy backup-e, tĂ« cilat sipas orarit duhej tĂ« ishin krijuar dhe ngarkuar nĂ« atĂ« kohĂ«, ndĂ«rkohĂ« qĂ« ndodhi ky haos. As qĂ« i krijova, thjesht pas njĂ« dite morĂ«m njoftime se gjithçka ishte nĂ« rregull, backup-et shfaqen. MĂ« pĂ«lqen shumĂ« ky rast, sepse Okerr u tregua shumĂ« i dobishĂ«m nĂ« njĂ« situatĂ« pĂ«r tĂ« cilĂ«n nuk kishim menduar paraprakisht, por kjo Ă«shtĂ« gjithashtu detyra e monitorimit — tĂ« pĂ«rballojĂ« tĂ« paparashikueshmin.

PĂ«r sensorĂ«t Okerr, ne pĂ«rdorim hostet mĂ« tĂ« lira (atje cilĂ«sia dhe besueshmĂ«ria nuk janĂ« tĂ« rĂ«ndĂ«sishme, ato sigurojnĂ« njĂ«ri-tjetrin). SĂ« fundmi, gjetĂ«m njĂ« host shumĂ« tĂ« mirĂ« dhe super tĂ« lirĂ«, benchmark-et janĂ« mahnitĂ«se. Por... ndonjĂ«herĂ« ndodh qĂ« lidhjet e daljes nga virtualka realizohen me njĂ« IP tjetĂ«r (fqinje). Mrekulli. Moduli client_ip https://diagnostic.opendns.com/myip merr njĂ« IP tĂ« gabuar. Madje, edhe nga log-et e serverit tĂ« indikatorit duket se pĂ«rditĂ«simi ka ardhur gjithashtu nga kjo IP fqinje. Tani po merremi me suportin. ËshtĂ« mirĂ« qĂ« e vĂ«mĂ« re kĂ«tĂ« nĂ« njĂ« kohĂ« paqĂ«sore. Por, p.sh., shpesh ndodh qĂ« qasja tĂ« registrohet nĂ« listĂ«n e bardhĂ« tĂ« IP-ve — dhe nĂ«se serveri ndonjĂ«herĂ« do tĂ« dridhĂ« pĂ«r njĂ« kohĂ« tĂ« shkurtĂ«r — mund tĂ« pĂ«rpiqemi shumĂ« gjatĂ« pĂ«r ta kapur kĂ«tĂ« problem.

Dhe dhe njĂ« herĂ« — kur flasim pĂ«r hostimin VPS — ne gjithmonĂ« pĂ«rdorim shĂ«rbime tĂ« pĂ«rballueshme (hetzner, ovh, scaleway). Dhomat nga benchmark-et dhe stabiliteti — na pĂ«lqen shumĂ«. PĂ«rdorim dhe shĂ«rbime mĂ« tĂ« shtrenjta si Amazon EC2 pĂ«r projekte tĂ« tjera. KĂ«shtu qĂ«, falĂ« okerr kemi njĂ« opinion tĂ« justifikuar. Ndeshje ndodhin — tĂ« dy janĂ« tĂ« tillĂ«. Dhe nuk do tĂ« thosha qĂ« gjatĂ« periudhĂ«s sonĂ« tĂ« gjatĂ« tĂ« vĂ«zhgimit, hostet e lirĂ« si hetzner rezultuan tĂ« ishin dukshĂ«m mĂ« pak tĂ« qĂ«ndrueshĂ«m se EC2. Prandaj, nĂ«se nuk jeni tĂ« lidhur nga funksione tĂ« tjera tĂ« Amazon — pĂ«rse tĂ« paguani mĂ« shumĂ«? 🙂

ÇfarĂ« ndodh mĂ« tej?

NĂ«se nĂ« kĂ«tĂ« fazĂ« nuk ju kam frikĂ«suar shumĂ« nga Okerr, provoni! Direket pĂ«rmes kĂ«tij linku mund tĂ« hyni nĂ« llogarinĂ« demonstrative tĂ« okerr (Klikoni tani!). Por mbani parasysh — qĂ« llogaria demo Ă«shtĂ« njĂ« pĂ«r tĂ« gjithĂ«, kĂ«shtu qĂ«, nĂ«se bĂ«ni diçka — dikush tjetĂ«r nĂ« tĂ« njĂ«jtĂ«n llogari mund t'ju pengojĂ«. Ose (mĂ« mirĂ«) regjistrohuni pĂ«rmes lidhjes nĂ« faqen kryesore tĂ« okerr — Ă«shtĂ« e thjeshtĂ«, pa SMS. NĂ«se nuk ju pĂ«lqen tĂ« pĂ«rdorni email-in tuaj tĂ« vĂ«rtetĂ« — mund tĂ« pĂ«rdorni njĂ« tĂ« pĂ«rkohshĂ«m, si mailinator (UnĂ« rekomandoj getnada.com). KĂ«to llogari me kalimin e kohĂ«s mund tĂ« fshihen — por pĂ«r testimin Ă«shtĂ« nĂ« rregull.

Pas regjistrimit do t'ju ofrohet tĂ« kaloni njĂ« trajnim (tĂ« realizoni disa detyra tĂ« thjeshta edukative). KufijtĂ« fillestarĂ« janĂ« shumĂ« tĂ« vogĂ«l, por pĂ«r trajnim ose njĂ« server janĂ« tĂ« mjaftueshĂ«m. Pas kalimit tĂ« trajnimit — kufijtĂ« (p.sh., numri maksimal i indikatorĂ«ve) do tĂ« rriten.

Nga dokumentacioni — nĂ« radhĂ« tĂ« parĂ« WIKI pĂ«r pjesĂ«n e serverit dhe pĂ«r klientin (okerrupdate wiki). Por nĂ«se diçka nuk Ă«shtĂ« e qartĂ« — shkruani nĂ« support (at) okerr.com ose lĂ«reni njĂ« biletĂ« — do tĂ« pĂ«rpiqemi tĂ« zgjidhim gjithçka shpejt.

NĂ«se do tĂ« pĂ«rdorni me seriozitet dhe kĂ«ta kufij tĂ« rritur nuk do tĂ« mjaftojnĂ« — gjithashtu, shkruani nĂ« suport, do t'i rrisim (pa pagesĂ«).

DĂ«shironi tĂ« vendosni server okerr nĂ« serverin tuaj? Ja repoziotori okerr-dev. Ne rekomandojmĂ« tĂ« vendosni nĂ« njĂ« virtualizim tĂ« pastĂ«r, kĂ«shtu qĂ« do tĂ« jetĂ« e lehtĂ« ta bĂ«ni kĂ«tĂ« me skenarin e instalimit. NĂ« virtualizimin tuaj — asnjĂ« kufizim :-). Dhe pĂ«rsĂ«ri — nĂ«se ka ndonjĂ« problem — do tĂ« pĂ«rpiqemi gjithmonĂ« tĂ« ndihmojmĂ«.

Ne duam qĂ« ky projekt tĂ« fluturojĂ«, qĂ« bota tĂ« bĂ«het mĂ« e sigurt falĂ« nesh. FalĂ« softuerit dhe shĂ«rbimeve tĂ« lira, bota Ă«shtĂ« bĂ«rĂ« mĂ« miqĂ«sore dhe zhvillohet mĂ« shpejt. Burimet mund tĂ« ruhen nĂ« GitHub falas, pĂ«r postĂ« tĂ« pĂ«rdoret Gmail falas. Ne pĂ«rdorim Freshworks pĂ«r mbĂ«shtetje. AsnjĂ«ra nga kĂ«to nuk kĂ«rkon pagesa pĂ«r serverĂ«, nuk Ă«shtĂ« e nevojshme tĂ« shkarkoni dhe konfiguroni dhe tĂ« zgjidhni probleme tĂ« ndryshme operacionale. Çdo projekt i ri, çdo ekip — menjĂ«herĂ« ka postĂ«, repo dhe CRM. Dhe gjithçka Ă«shtĂ« shumĂ« cilĂ«sore, falas dhe menjĂ«herĂ«. Ne duam qĂ« pĂ«r monitorimin tĂ« jetĂ« ashtu siç Ă«shtĂ« — kompanitĂ« e vogla dhe projektet tĂ« mund tĂ« pĂ«rdorin okerr falas dhe madje nĂ« fazĂ«n e lindjes dhe rritjes tĂ« kenĂ« besueshmĂ«rinĂ« si projektet serioze. Freshworks pĂ«r mbĂ«shtetje. AsnjĂ«ra nga kĂ«to nuk kĂ«rkon pagesa pĂ«r servera, nuk Ă«shtĂ« e nevojshme tĂ« shkarkoni dhe konfiguroni dhe tĂ« zgjidhni probleme tĂ« ndryshme operacionale. Çdo projekt i ri, çdo ekip — menjĂ«herĂ« ka postĂ«, repo dhe CRM. Dhe gjithçka Ă«shtĂ« shumĂ« cilĂ«sore, falas dhe menjĂ«herĂ«. Ne duam qĂ« pĂ«r monitorimin tĂ« jetĂ« ashtu siç Ă«shtĂ« — kompanitĂ« e vogla dhe projektet tĂ« mund tĂ« pĂ«rdorin okerr falas dhe madje nĂ« fazĂ«n e lindjes dhe rritjes tĂ« kenĂ« besueshmĂ«rinĂ« si projektet serioze.

Burimi: habr.com

Bli njĂ« hosting tĂ« besueshĂ«m pĂ«r faqet me mbrojtje DDoS, VPS VDS serverĂ« đŸ”„ Bli njĂ« hosting tĂ« besueshĂ«m pĂ«r faqet me mbrojtje DDoS, VPS VDS serverĂ« | ProHoster