
Sot do të shqyrtojmë metrikat e sistemit disk në vSphere. Problemet me ruajtjen janë arsyeja më e zakonshme për ngadalësinë e makinës virtuale. Ndryshe nga CPU dhe RAM, ku diagnostikimi ndalon në nivelin e hipervizorit, kur ka probleme me diskun, ndoshta do të duhet të shqyrtojmë rrjetin e transferimit të të dhënave dhe ruajtësin e lidhur.
Tema do të shqyrtohet në shembullin e qasjes bllok, megjithatë, në qasjen me skedarë, numrat janë përafërsisht të njëjtë.
Pak teori
Kur flitet për performancën e sistemit disk të makinave virtuale, zakonisht kushtohet vëmendje tre parametrave të lidhur ngushtë:
- numri i operacioneve të hyrjes/daljeve (Input/Output Operations Per Second, IOPS);
- kapaciteti (Throughput);
- vonesa e operacioneve të hyrjes/daljeve (Latency).
Numri i IOPS zakaton është i rëndësishëm për ngarkesa me karakter të rastësishëm (random): qasja në blloqet e diskut të shpërndara në vende të ndryshme. Një shembull i tillë ngarkese mund të jenë bazat e të dhënave, aplikacionet e biznesit (ERP, CRM) etj.
Kapaciteti i Kalimit është e rëndësishme për ngarkesa me karakter disaherë: qasja në blloqet që janë ngjitur njëri pas tjetrit. Për shembull, ngarkesa e tillë mund të gjenerohet nga serverët e skedarëve (por jo gjithmonë) dhe sistemet e videovëzhgimit.
Kapaciteti lidhet me numrin e operacioneve të hyrjes/daljeve në këtë mënyrë:
Throughput = IOPS * Block size, ku Block size është madhësia e bllokut.
MadhĂ«sia e bllokut Ă«shtĂ« njĂ« karakteristikĂ« mjaft e rĂ«ndĂ«sishme. Versionet moderne tĂ« ESXi lejojnĂ« blloqe me madhĂ«si deri nĂ« 32 767 KB. NĂ«se blloku Ă«shtĂ« akoma mĂ« i madh, ai ndahet nĂ« disa blloqe. Jo tĂ« gjithĂ« ruajtĂ«sit janĂ« nĂ« gjendje tĂ« punojnĂ« efektivisht me blloqe tĂ« tilla tĂ« mĂ«dha, prandaj nĂ« CilĂ«simet e Avancuara tĂ« ESXi ekziston parametri DiskMaxIOSize. Me tĂ«, mund tĂ« zvogĂ«loni madhĂ«sinĂ« maksimale tĂ« bllokut qĂ« lejohet nga hipervizori (Lexoni mĂ« shumĂ« ). Rekomandoj qĂ« para se tĂ« ndryshoni kĂ«tĂ« parametĂ«r tĂ« konsultoheni me prodhuesin e ruajtĂ«sit ose tĂ« paktĂ«n tĂ« testoni ndryshimet nĂ« njĂ« mjedis laboratorik.Â
Madhësia e madhe e bllokut mund të ndihmojë në performancën e dobët të ruajtësit. Edhe nëse numri i IOPS dhe kapaciteti janë relativisht të ulët, mund të ketë vonesa të larta nëse madhësia e bllokut është e madhe. Prandaj, tregoni vëmendje ndaj këtij parametri.
Gabimi â Ă«shtĂ« parametri mĂ« interesant i performancĂ«s. Vonesa e operacioneve tĂ« hyrjes/daljeve pĂ«r njĂ« makinĂ« virtuale pĂ«rbĂ«het nga:
- vonesa brenda hipervizorit (KAVG, Average Kernel MilliSec/Read);
- vonesa që jep rrjeti i transferimit të të dhënave dhe ruajtësi (DAVG, Average Driver MilliSec/Command).
Vonesa totale, e cila shikohet në sistemin e operimit të mysafirit (GAVG, Average Guest MilliSec/Command), është shuma e KAVG dhe DAVG.
GAVG dhe DAVG matet, kurse KAVG llogaritet: GAVGâDAVG.

Le të ndalemi pak më shumë te KAVG. Në punën normale KAVG duhet të përpiqet të arrijë zero ose, të paktën, të jetë shumë më e vogël se DAVG. Një rast i vetëm i njohur për mua kur KAVG është pritur të jetë i lartë është kufizimi i IOPS në diskun e VM. Në këtë rast, përpjekja për të tejkaluar limitin do të rrisë KAVG.
Pjesa mĂ« e rĂ«ndĂ«sishme e KAVG Ă«shtĂ« QAVG â koha nĂ« radhĂ« pĂ«r pĂ«rpunim brenda hipervizorit. PjesĂ«t e tjera tĂ« KAVG janĂ« shumĂ« tĂ« vogla pĂ«r t'u konsideruar.
Radhët në driver-in e adaptores së diskut dhe radhët për lunët kanë një madhësi fikse. Për mjediset me ngarkesë të lartë, ndonjëherë është e dobishme të rritet kjo madhësi. është përshkruar si të rriten radhët në driver-in e adaptores (njëkohësisht do të rritet edhe radhët për lunët). Ky parametër funksionon kur me lunin punon vetëm një VM, gjë që ndodh rrallë. Nëse me lunin punojnë disa VM, gjithashtu duhet të rritet parametri Disk.SchedNumReqOutstanding (udhëzimi ). Duke rritur radhën, ulni QAVG dhe KAVG përkatësisht.
Por, përsëri, fillimisht duhet të njiheni me dokumentacionin e prodhuesit HBA dhe të testoni ndryshimet në një mjedis laboratorik.
Madhësia e radhës për lun mund të ndikohet nga aktivizimi i mekanizmit SIOC (Storage I/O Control). Ai siguron një qasje të barabartë në lun nga të gjithë serverat e klasterit duke ndryshuar dinamik radhën për lun në serverat. Pra, nëse në ndonjë nga hostet punon një VM, e cila kërkon një performancë të proporcioni shumë të lartë (VM fqinj i zhurmshëm), SIOC zvogëlon gjatësi radhës për lun në këtë host (DQLEN). Lexoni më shumë .
Tani që e kuptuam KAVG, le të flasim pak për DAVG. Këtu gjithçka është e thjeshtë: DAVG është vonesa që sjell ambienti jashtë (rrjeti i transferimeve dhe ruajtësi). Në çdo ruajtës modern, ka numra të vet të performancës. Për analizën e problemeve me DAVG ka kuptim të shikoni në to. Nëse nga ana e ESXi dhe ruajtësit është gjithçka në rregull, kontrolloni rrjetin e transferimit të të dhënave.
PĂ«r tĂ« shmangur problemet me performancĂ«n, zgjidhni Politiken e Zgjedhjes sĂ« RrugĂ«ve (PSP) tĂ« duhur pĂ«r sistemin tuaj tĂ« ruajtjes. Praktikisht tĂ« gjitha sistemet moderne tĂ« ruajtjes mbĂ«shtesin PSP Round-Robin (me ALUA, Asymmetric Logical Unit Access, ose pa tĂ«). Kjo politikĂ« lejon pĂ«rdorimin e tĂ« gjitha rrugĂ«ve tĂ« disponueshme drejt sistemit tĂ« ruajtjes. NĂ« rastin e ALUA-s, pĂ«rdoren vetĂ«m rrugĂ«t drejt kontrolluesit qĂ« zotĂ«ron LUN-in. Jo tĂ« gjitha sistemet e ruajtjes nĂ« ESXi kanĂ« rregulla tĂ« paracaktuara qĂ« vendosin politikĂ«n Round-Robin. NĂ«se pĂ«r sistemin tuaj tĂ« ruajtjes nuk ka rregulla, pĂ«rdorni plugin-in e prodhuesit qĂ« do tĂ« krijojĂ« njĂ« rregull pĂ«rkatĂ«s nĂ« tĂ« gjitha hostet e klasterit, ose krijoni njĂ« rregull vetĂ«. Detajet .Â
Gjithashtu, disa prodhues të sistemeve të ruajtjes rekomandojnë të ndryshoni numrin e IOPS nga vlera standarde 1000 në 1. Në praktikën tonë, kjo na ka lejuar të "nxjerrim" më shumë performancë nga sistemi i ruajtjes dhe të reduktojmë ndjeshëm kohën që nevojitet për failover në rast se ndodh ndonjë dështim ose përditësim të kontrolluesve. Konsultohuni me rekomandimet e prodhuesit dhe nëse nuk ka kundërshtime, provoni të ndryshoni këtë parametër. Detajet .
Numrat kryesorë të performancës së nën-sistemëve të diskëve të makinës virtuale
Numrat e performancës së nën-sistemëve të diskëve në vCenter janë të mbledhur në seksionet Datastore, Disk, Virtual Disk:

Në seksionin Datastore janë metrikat për objektet e ruajtjes vSphere (datastoret) ku ndodhen diskët e VM. Këtu do të gjeni numra standard për:
- IOPS (KĂ«rkesat mesatare pĂ«r lexim/shkrim nĂ« sekondĂ«),Â
- kapacitetin (Shkalla e Leximit/Shkruarjes),Â
- vonëset (Lexim/Shkrim/Vonësimi më i lartë).
Nga emrat e numrave, në përgjithësi është e qartë. Sërish do të theksoj se këtu statistikat nuk janë për një VM specifike (ose për diskun e VM-së), por janë të përgjithshme për të gjithë datastorin. Në mendimin tim, kjo statistikë është më e lehtë për t'u parë në ESXTOP, duke marrë parasysh se periudha minimale e matjes aty është 2 sekonda.
Në seksionin Disk janë metrikat për pajisjet bllokuese që përdoren nga VM. Këtu ka numra për IOPS të tipit summation (numri i operacioneve të hyrjes/daljes gjatë periudhës së matjes) dhe disa numra që i përkasin qasjes bllokuese (Commands aborted, Bus resets). Këtë informacion, në mendimin tim, është gjithashtu më e lehtë ta shihni në ESXTOP.
Pjesa Virtual Disk është më i dobishëm për të gjetur problemet e performancës së nën-sistemit të diskëve të VM. Këtu mund të shihni performancën për secilën disk virtual. Kjo informacion është e nevojshme për të kuptuar nëse ka ndonjë problem te një makinë virtuale specifike. Përveç numrave standard të operacioneve të hyrjes/daljes, volumit të leximit/shkrimit dhe vonësave, në këtë seksion ka numra të dobishëm që tregojnë madhësinë e bllokut: Madhësia e kërkesës për Lexim/Shkrim.
NĂ« imazhin mĂ« poshtĂ« Ă«shtĂ« grafiku i performancĂ«s sĂ« diskut tĂ« VM, ku mund tĂ« shihni numrin e IOPS, vonesat dhe madhĂ«sinĂ« e bllokut.Â

Gjithashtu, metrikat e performancës mund të shihen për tërë datastorin, nëse është aktivizuar SIOC. Këtu paraqitet informacioni bazë për vonesën mesatare dhe IOPS. Nga default, ky informacion mund të shikohet vetëm në kohë reale.

ESXTOP
Në ESXTOP ka disa ekrane, ku prezantohet informacioni për nën-sistemin e diskëve të hostit në tërësi, makinat virtuale të veçanta dhe diskët e tyre.
Le të fillojmë me informacionin për makinat virtuale. Ekrani "Disk VM" aktivizohet me çelësin "v":

NVDISK - është numri i diskëve të VM. Për të parë informacionin për secilin disk, shtypni "e" dhe, nëse është e nevojshme, shkruani GID e VM-së që ju intereson.
Vlera e parametrave të tjerë në këtë ekran është e qartë nga emrat e tyre.
NjĂ« ekran tjetĂ«r i dobishĂ«m nĂ« gjetjen e problemeve Ă«shtĂ« â Disk adapter. Aktivizohet me çelĂ«sin "d" (nĂ« imazhin mĂ« poshtĂ« janĂ« zgjedhur fushat A,B,C,D,E,G):

NPTH - numri i rrugëve drejt LUN-ave që janë të dukshme nga ky adaptues. Për të marrë informacion për secilën rrugë në adaptues, shtypni "e" dhe shkruani emrin e adaptuesit:

AQLEN - madhësia maksimale e radhës në adaptues.
Gjithashtu në këtë ekran janë paraqitur numrat e vonesave për të cilat kam folur më lart: KAVG/cmd, GAVG/cmd, DAVG/cmd, QAVG/cmd.
NĂ« ekranin Disk device, i cili aktivizohet me çelĂ«sin "u", paraqitet informacioni pĂ«r pajisjet e veçanta bllokuese â LUN-ave (nĂ« imazhin mĂ« poshtĂ« janĂ« zgjedhur fushat A, B, F, G, I). KĂ«tu mund tĂ« shihni gjendjen e radhĂ«s ndaj LUN-ave.

DQLEN - madhësia e radhës për pajisjen bllokuese.
ACTV - numri i komandave të hyrjes/daljes në bërthamën ESXi.
QUED - numri i komandave të hyrjes/daljes në radhë.
%USD - ACTV / DQLEN Ă 100%.
LOAD - (ACTV + QUED) / DQLEN.
Nëse %USD është i lartë, është e arsyeshme të shqyrtohet mundësia e rritjes së radhës. Sa më shumë komanda të jenë në radhë, aq më e lartë është QAVG dhe, për rrjedhojë, KAVG.
Gjithashtu, në ekranin Disk device mund të shihni nëse është aktiv VAAI (vStorage API për Integrimin e Array). Për këtë, duhet të zgjidhni fushat A dhe O.
Mekanizmi VAAI lejon transferimin e një pjesë të punës nga hipervizori direkt në sistemin e ruajtjes, për shembull, zerimin, kopjimin e blloqeve ose bllokimin.
![]()
Siç shihet në imazhin më sipër, VAAI funksionon në këtë sistem ruajtjeje: përdoren aktivisht primitivët Zero dhe ATS.
Këshilla për optimizimin e punës me sistemin e diskëve në ESXi
- Kujdesuni për madhësinë e bllokut.
- Vendosni madhësinë optimale të radhës në HBA.
- Mos harroni të aktivizoni SIOC në datastores.
- Zgjidhni PSP në përputhje me rekomandimet e prodhuesit të sistemit të ruajtjes.
- Sigurohuni që VAAI funksionon.
Artikuj të dobishëm mbi temën:
Burimi: habr.com
