
Sot do të shqyrtojmë metrikat e sistemit të ruajtjes në vSphere. Problemi me ruajtjen është arsyeja më e zakonshme e ngadalësimit të funksionimit të makinës virtuale. Kur për CPU dhe RAM problemi zgjidhet në nivelin e hipervizorit, në rastet e problemeve me disqet, mund të jetë e nevojshme të merremi me rrjetin e transferimit të të dhënave dhe sistemin e ruajtjes.
Temën do ta shqyrtoj me shembuj të qasjes bllok në sistemin e ruajtjes, megjithatë, me qasje skedarësh, treguesit janë afërsisht të njëjtë.
Pak teori
Kur flitet për performancën e sistemit të ruajtjes së makinave virtuale, zakonisht i kushtohet vëmendje tre parametrave të lidhur me njëri-tjetrin:
- numri i operacioneve të hyrje/dalje (Input/Output Operations Per Second, IOPS);
- kapaciteti (Throughput);
- vonesa e operacioneve të hyrje/dalje (Latency).
Numri i IOPS zakonisht është i rëndësishëm për ngarkesat e natyrës së rastësishme (random): qasja në blloqet e diskut të vendosura në vende të ndryshme. Një shembull i tillë ngarkese mund të jenë bazat e të dhënave, aplikacionet e biznesit (ERP, CRM) etj.
Kapaciteti është e rëndësishme për ngarkesat e natyrës së rregullt: qasja në blloqet, të vendosura njëri pas tjetrit. Për shembull, një ngarkesë e tillë mund të gjenerohet nga serverët e skedarëve (por jo gjithmonë) dhe sistemet e mbikëqyrjes video.
Kapaciteti është i lidhur me numrin e operacioneve të hyrje/dalje në këtë mënyrë:
Throughput = IOPS * Sasia e bllokut, ku Sasia e bllokut është madhësia e bllokut.
MadhĂ«sia e bllokut Ă«shtĂ« njĂ« karakteristikĂ« mjaft e rĂ«ndĂ«sishme. Versionet moderne tĂ« ESXi kalojnĂ« blloqe me madhĂ«si deri nĂ« 32,767 KB. NĂ«se blloku Ă«shtĂ« edhe mĂ« i madh, ai ndahet nĂ« disa. Jo tĂ« gjitha sistemet e ruajtjes mund tĂ« funksionojnĂ« efikasht me blloqe kaq tĂ« mĂ«dha, prandaj nĂ« CilĂ«simet e Avancuara tĂ« ESXi ka njĂ« parametĂ«r DiskMaxIOSize. Me ndihmĂ«n e tij, mund tĂ« zvogĂ«loni madhĂ«sinĂ« maksimale tĂ« bllokut qĂ« kalon hipervizori (mĂ« shumĂ« ). Rekomandoj qĂ« para ndryshimit tĂ« kĂ«tij parametri tĂ« konsultoheni me prodhuesin e sistemit tĂ« ruajtjes ose sĂ« paku tĂ« testoni ndryshimet nĂ« njĂ« ambient laboratorik.Â
Madhësia e madhe e bllokut mund të ndikojë negatively në performancën e sistemit të ruajtjes. Edhe nëse numri i IOPS dhe throughput është relativisht i vogël, me madhësi të madhe blloku mund të shfaqen vonesa të larta. Prandaj, kushtojini vëmendje këtij parametri.
Latenca â parametri mĂ« interesant i performancĂ«s. Vonesa e operacioneve tĂ« hyrje/dalje pĂ«r makinĂ«n virtuale pĂ«rbĂ«het nga:
- vonesa brenda hipervizorit (KAVG, Average Kernel MilliSec/Read);
- mungesa qĂ« ofrojnĂ« rrjetin e transmetimit tĂ« tĂ« dhĂ«nave dhe SĂD (DAVG, Milisekonda e Mesme e Drejtuesit / KomandĂ«s).
Mungesa totale, e cila është e dukshme në OS-në mysafire (GAVG, Milisekonda e Mesme e Mysafirit / Komandës), është shuma e KAVG dhe DAVG.
GAVG dhe DAVG maten, ndĂ«rsa KAVG llogaritet: GAVGâDAVG.

Le të ndalemi pak më shumë në KAVG. Në një funksionim normal, KAVG duhet të tendoset drejt zeros ose, të paktën, të jetë shumë më e vogël se DAVG. Rasti i vetëm që njoh ku KAVG pritet të jetë i lartë është kufizimi IOPS në disqin e VM. Në këtë rast, kur përpiqeni të kaloni limitin, KAVG do të rritet.
Pjesa më e rëndësishme e KAVG është QAVG - koha në radhë për përpunim brenda hipervizorit. Pjesët e tjera të KAVG janë të papërfillshme.
Radhët në drejtuesin e adaptorit të diskut dhe radhët ndaj lunave kanë një madhësi fikse. Për mjediset me ngarkesë të lartë, është e dobishme ta rrisni këtë madhësi. është përshkruar si të rrisni radhët në drejtuesin e adaptorit (njëkohësisht do të rritet radhët ndaj lunave). Ky rregullim funksionon kur në lun punon vetëm një VM, e cila ndodh rrallë. Nëse në lun janë disa VM, është e nevojshme gjithashtu të rrisni parametrin Disk.SchedNumReqOutstanding (udhëzimi ). Duke rritur radhën, ju zvogëloni QAVG dhe KAVG përkatësisht.
Por, sërish, fillimisht shikoni dokumentacionin nga furnizuesi HBA dhe testoni ndryshimet në një laborator.
Madhësia e radhës ndaj lunës mund të ndikojë nga aktivizimi i mekanizmit SIOC (Kontrolli i I/O Së Ruajtjes). Ai siguron akses të barabartë në lun nga të gjitha serverët e grupit duke ndryshuar dinamikisht radhën ndaj lunës në serverat. Kjo do të thotë që, nëse në ndonjë nga hostët punon një VM që kërkon një performancë të proporcioni të lartë (noisy neighbor VM), SIOC zvogëlon gjatësinë e radhës ndaj lunës në këtë host (DQLEN). Më shumë informacion .
Me KAVG e diskutua, tani pak mbi DAVG. KĂ«tu Ă«shtĂ« e thjeshtĂ«: DAVG Ă«shtĂ« vonesa e sjellĂ« nga ambienti i jashtĂ«m (rrjeti i transmetimit tĂ« tĂ« dhĂ«nave dhe SĂD). NĂ« çdo SĂD moderne dhe jo shumĂ«, ka numra tĂ« performancĂ«s. PĂ«r tĂ« analizuar problemet me DAVG, ka kuptim tĂ« shikoni ata. NĂ«se nga ana e ESXi dhe SĂD gjithçka Ă«shtĂ« mirĂ«, kontrolloni rrjetin e transmetimit tĂ« tĂ« dhĂ«nave.
PĂ«r tĂ« shmangur problemet me performancĂ«n, zgjidhni Politiken e Zgjedhjes sĂ« RrugĂ«s (PSP) tĂ« duhur pĂ«r sistemin tuaj tĂ« ruajtjes. Praktikisht tĂ« gjitha sistemet moderne tĂ« ruajtjes mbĂ«shtesin PSP Round-Robin (me ALUA, Asimetriçka Qasje nĂ« NjĂ«sitĂ« Logjike, ose pa tĂ«). Kjo politikĂ« lejon pĂ«rdorimin e tĂ« gjitha rrugĂ«ve tĂ« disponueshme pĂ«r sistemin e ruajtjes. NĂ« rastin e ALUA pĂ«rdoren vetĂ«m rrugĂ«t deri te kontrolluesi qĂ« zotĂ«ron LUN-in. Nuk janĂ« tĂ« gjitha sistemet e ruajtjes nĂ« ESXi qĂ« kanĂ« rregulla tĂ« parazgjedhura, tĂ« cilat vendosin politikĂ«n Round-Robin. NĂ«se pĂ«r sistemin tuaj tĂ« ruajtjes nuk ka rregulla, pĂ«rdorni njĂ« plugin nga prodhuesi i sistemit, i cili do tĂ« krijojĂ« rregullin pĂ«rkatĂ«s nĂ« tĂ« gjitha hostet e klasterit, ose krijoni rregullin vetĂ«. Detaje .Â
Po ashtu disa prodhues të sistemit të ruajtjes rekomandojnë të ndryshoni numrin e IOPS nga vlera standarde 1000 në 1. Në praktikën tonë kjo ka lejuar "të nxjerrim" më shumë performancë nga sistemi i ruajtjes dhe të reduktojmë ndjeshëm kohën e nevojshme për failover në rast dështimi apo përditësimi të kontrolluesve. Rishikoni rekomandimet e ofruesit, dhe nëse nuk ka kundërshtime, provoni të ndryshoni këtë parametër. Detaje .
Matrica kryesore të performancës së nënsystemit disk të makinës virtuale
Matrica e performancës së nënsystemit disk në vCenter janë mbledhur në seksionet Datastore, Disk, Disku Virtual:

Në seksionin Datastore ndodhen metrikat për ruajtjet disk vSphere (datastoret), në të cilat ndodhen disqet e VM. Këtu do të gjeni matjet standarde për:
- IOPS (KĂ«rkesat mesatare tĂ« leximit/shkrimit pĂ«r sekondĂ«),Â
- kapacitetin (ShpejtĂ«sia e Leximit/Shkrimit),Â
- vonesat (Vonesa e Leximit/Shkrimit/Vonesa më e lartë).
Nga emrat e matjeve në të vërtetë është gjithçka e kuptueshme. Përsëris se këtu statistika nuk është për një VM (apo disk të VM) të veçantë, por e përgjithshme për të gjithë datastorin. Në mendimin tim, është më e lehtë të shikohet kjo statistikë në ESXTOP, të paktën duke pasur parasysh që periudha minimale e matjes atje është 2 sekonda.
Në seksionin Disk ndodhen metrikat për pajisjet bllokuese, të cilat përdoren nga VM. Këtu ka matje për IOPS të tipit summation (numri i operacioneve të hyrjes/daljes në periudhën e matjes) dhe disa matje të tjera të lidhura me qasjen bllokuese (Komandat e ndërprera, Rivendosjet e autobusëve). Në mendimin tim, është gjithashtu më e lehtë të shikohet kjo informacion në ESXTOP.
Seksioni Disku Virtual â Ă«shtĂ« mĂ« i dobishĂ«m pĂ«r gjetjen e problemeve me performancĂ«n e nĂ«nshkallĂ«s diskore tĂ« VM. KĂ«tu mund tĂ« shihni performancĂ«n e çdo disku virtual. Kjo Ă«shtĂ« informacioni qĂ« nevojitet pĂ«r tĂ« kuptuar nĂ«se ka njĂ« problem me njĂ« makinĂ« virtuale tĂ« veçantĂ«. PĂ«rveç hesapimeve standarde tĂ« numrit tĂ« operacioneve tĂ« hyrjes/daljes, volumit tĂ« leximit/shkrimit dhe vonesave, nĂ« kĂ«tĂ« seksion ka parameter tĂ« dobishĂ«m qĂ« tregojnĂ« madhĂ«sinĂ« e bllokut: MadhĂ«sia e kĂ«rkesĂ«s pĂ«r lexim/shkrim.
NĂ« figurĂ«n mĂ« poshtĂ«, grafiku i performancĂ«s sĂ« diskut tĂ« VM, ku mund tĂ« shihni numrin e IOPS, vonesat dhe madhĂ«sinĂ« e bllokut.Â

Po ashtu, metrikat e performancës mund të shihen për tërë datastorin, nëse SIOC është i aktivizuar. Këtu është paraqitur informacion i bazës në lidhje me Latency të mesme dhe IOPS. Sipas parazgjedhjes, ky informacion mund të shikohet vetëm në kohë reale.

ESXTOP
Në ESXTOP, ka disa ekrane, ku është paraqitur informacioni mbi nënshkallën diskore të hostit në tërësi, makinat virtuale të veçanta dhe diskët e tyre.
Le të fillojmë me informacionin mbi makinat virtuale. Ekrani "Disk VM" aktivizohet me çelësin "v":

NVDISK â Ă«shtĂ« numri i diskĂ«ve tĂ« VM. PĂ«r tĂ« shikuar informacionin pĂ«r çdo disk, shtypni "e" dhe shkruani GID e VM-sĂ« qĂ« ju intereson.
Vlera e parametrave të tjerë në këtë ekran është e qartë nga emrat e tyre.
Një ekran tjetër i dobishëm për gjetjen e problemeve është Disk adapter. Aktivizohet me çelësin "d" (në figurën më poshtë janë zgjedhur fushat A, B, C, D, E, G):

NPTH â numri i rrugĂ«ve nĂ« lunat, tĂ« cilat janĂ« tĂ« dukshme nga ky adaptues. PĂ«r tĂ« marrĂ« informacionin pĂ«r çdo rrugĂ« nĂ« adaptues, shtypni "e" dhe shkruani emrin e adaptuesit:

AQLEN â madhĂ«sia maksimale e radhĂ«s nĂ« adaptues.
Po ashtu, në këtë ekran janë paraqitur hesapet e vonesave, për të cilat kam folur më sipër: KAVG/cmd, GAVG/cmd, DAVG/cmd, QAVG/cmd.
NĂ« ekranin Disk device, i cili aktivizohet me çelĂ«sin "u", paraqitet informacioni mbi pajisjet e veçanta bllokuese â lunat (nĂ« figurĂ«n mĂ« poshtĂ« janĂ« zgjedhur fushat A, B, F, G, I). KĂ«tu mund tĂ« shihni gjendjen e radhĂ«s pĂ«r lunat.

DQLEN â madhĂ«sia e radhĂ«s pĂ«r pajisjen e bllokut.
ACTV â numri i komandave tĂ« hyrjes/daljes nĂ« bĂ«rthamĂ«n ESXi.
QUED â numri i komandave tĂ« hyrjes/daljes nĂ« radhĂ«.
%USD â ACTV / DQLEN Ă 100%.
LOAD â (ACTV + QUED) / DQLEN.
Nëse %USD është i lartë, është e arsyeshme të shqyrtohet rritja e radhës. Sa më shumë komanda të jenë në radhë, aq më i lartë është QAVG dhe, për rrjedhojë, KAVG.
Në ekranin Disk device mund të kontrolloni nëse VAAI (vStorage API for Array Integration) funksionon në SHK. Për këtë, duhet të zgjidhni fushat A dhe O.
Mekanizmi VAAI lejon që të transferohet një pjesë e punës nga hipervizori direkt në SHK, për shembull, zerozimi, kopjimi i blloqeve ose bllokimi.
![]()
Siç shihet në imazhin e mësipërm, në këtë SHK VAAI funksionon: përdoren aktivisht primitivët Zero dhe ATS.
Këshilla për optimizimin e punës me nën sistemin e disks në ESXi
- Kujdesuni për madhësinë e bllokut.
- Vendosni madhësinë optimale të radhës në HBA.
- Mos harroni të aktivizoni SIOC në datastoret.
- Zgjidhni PSP në përputhje me rekomandimet e prodhuesit të SHK.
- Sigurohuni që VAAI të funksionojë.
Artikuj të dobishëm mbi temën:
Burimi: habr.com
