Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

Pjesa 1. Rreth procesorit
Pjesa 2. Rreth Memories

Sot do të shqyrtojmë metrikat e sistemit të ruajtjes në vSphere. Problemi me ruajtjen është arsyeja më e zakonshme e ngadalësimit të funksionimit të makinës virtuale. Kur për CPU dhe RAM problemi zgjidhet në nivelin e hipervizorit, në rastet e problemeve me disqet, mund të jetë e nevojshme të merremi me rrjetin e transferimit të të dhënave dhe sistemin e ruajtjes.

Temën do ta shqyrtoj me shembuj të qasjes bllok në sistemin e ruajtjes, megjithatë, me qasje skedarësh, treguesit janë afërsisht të njëjtë.

Pak teori

Kur flitet për performancën e sistemit të ruajtjes së makinave virtuale, zakonisht i kushtohet vëmendje tre parametrave të lidhur me njëri-tjetrin:

  • numri i operacioneve tĂ« hyrje/dalje (Input/Output Operations Per Second, IOPS);
  • kapaciteti (Throughput);
  • vonesa e operacioneve tĂ« hyrje/dalje (Latency).

Numri i IOPS zakonisht është i rëndësishëm për ngarkesat e natyrës së rastësishme (random): qasja në blloqet e diskut të vendosura në vende të ndryshme. Një shembull i tillë ngarkese mund të jenë bazat e të dhënave, aplikacionet e biznesit (ERP, CRM) etj.

Kapaciteti është e rëndësishme për ngarkesat e natyrës së rregullt: qasja në blloqet, të vendosura njëri pas tjetrit. Për shembull, një ngarkesë e tillë mund të gjenerohet nga serverët e skedarëve (por jo gjithmonë) dhe sistemet e mbikëqyrjes video.

Kapaciteti është i lidhur me numrin e operacioneve të hyrje/dalje në këtë mënyrë:

Throughput = IOPS * Sasia e bllokut, ku Sasia e bllokut është madhësia e bllokut.

Madhësia e bllokut është një karakteristikë mjaft e rëndësishme. Versionet moderne të ESXi kalojnë blloqe me madhësi deri në 32,767 KB. Nëse blloku është edhe më i madh, ai ndahet në disa. Jo të gjitha sistemet e ruajtjes mund të funksionojnë efikasht me blloqe kaq të mëdha, prandaj në Cilësimet e Avancuara të ESXi ka një parametër DiskMaxIOSize. Me ndihmën e tij, mund të zvogëloni madhësinë maksimale të bllokut që kalon hipervizori (më shumë këtu). Rekomandoj që para ndryshimit të këtij parametri të konsultoheni me prodhuesin e sistemit të ruajtjes ose së paku të testoni ndryshimet në një ambient laboratorik. 

Madhësia e madhe e bllokut mund të ndikojë negatively në performancën e sistemit të ruajtjes. Edhe nëse numri i IOPS dhe throughput është relativisht i vogël, me madhësi të madhe blloku mund të shfaqen vonesa të larta. Prandaj, kushtojini vëmendje këtij parametri.

Latenca – parametri mĂ« interesant i performancĂ«s. Vonesa e operacioneve tĂ« hyrje/dalje pĂ«r makinĂ«n virtuale pĂ«rbĂ«het nga:

  • vonesa brenda hipervizorit (KAVG, Average Kernel MilliSec/Read);
  • mungesa qĂ« ofrojnĂ« rrjetin e transmetimit tĂ« tĂ« dhĂ«nave dhe SÇD (DAVG, Milisekonda e Mesme e Drejtuesit / KomandĂ«s).

Mungesa totale, e cila është e dukshme në OS-në mysafire (GAVG, Milisekonda e Mesme e Mysafirit / Komandës), është shuma e KAVG dhe DAVG.

GAVG dhe DAVG maten, ndĂ«rsa KAVG llogaritet: GAVG–DAVG.

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage
Burimi

Le të ndalemi pak më shumë në KAVG. Në një funksionim normal, KAVG duhet të tendoset drejt zeros ose, të paktën, të jetë shumë më e vogël se DAVG. Rasti i vetëm që njoh ku KAVG pritet të jetë i lartë është kufizimi IOPS në disqin e VM. Në këtë rast, kur përpiqeni të kaloni limitin, KAVG do të rritet.

Pjesa më e rëndësishme e KAVG është QAVG - koha në radhë për përpunim brenda hipervizorit. Pjesët e tjera të KAVG janë të papërfillshme.

Radhët në drejtuesin e adaptorit të diskut dhe radhët ndaj lunave kanë një madhësi fikse. Për mjediset me ngarkesë të lartë, është e dobishme ta rrisni këtë madhësi. Këtu është përshkruar si të rrisni radhët në drejtuesin e adaptorit (njëkohësisht do të rritet radhët ndaj lunave). Ky rregullim funksionon kur në lun punon vetëm një VM, e cila ndodh rrallë. Nëse në lun janë disa VM, është e nevojshme gjithashtu të rrisni parametrin Disk.SchedNumReqOutstanding (udhëzimi  këtu). Duke rritur radhën, ju zvogëloni QAVG dhe KAVG përkatësisht.

Por, sërish, fillimisht shikoni dokumentacionin nga furnizuesi HBA dhe testoni ndryshimet në një laborator.

Madhësia e radhës ndaj lunës mund të ndikojë nga aktivizimi i mekanizmit SIOC (Kontrolli i I/O Së Ruajtjes). Ai siguron akses të barabartë në lun nga të gjitha serverët e grupit duke ndryshuar dinamikisht radhën ndaj lunës në serverat. Kjo do të thotë që, nëse në ndonjë nga hostët punon një VM që kërkon një performancë të proporcioni të lartë (noisy neighbor VM), SIOC zvogëlon gjatësinë e radhës ndaj lunës në këtë host (DQLEN). Më shumë informacion këtu.

Me KAVG e diskutua, tani pak mbi DAVG. KĂ«tu Ă«shtĂ« e thjeshtĂ«: DAVG Ă«shtĂ« vonesa e sjellĂ« nga ambienti i jashtĂ«m (rrjeti i transmetimit tĂ« tĂ« dhĂ«nave dhe SÇD). NĂ« çdo SÇD moderne dhe jo shumĂ«, ka numra tĂ« performancĂ«s. PĂ«r tĂ« analizuar problemet me DAVG, ka kuptim tĂ« shikoni ata. NĂ«se nga ana e ESXi dhe SÇD gjithçka Ă«shtĂ« mirĂ«, kontrolloni rrjetin e transmetimit tĂ« tĂ« dhĂ«nave.

Për të shmangur problemet me performancën, zgjidhni Politiken e Zgjedhjes së Rrugës (PSP) të duhur për sistemin tuaj të ruajtjes. Praktikisht të gjitha sistemet moderne të ruajtjes mbështesin PSP Round-Robin (me ALUA, Asimetriçka Qasje në Njësitë Logjike, ose pa të). Kjo politikë lejon përdorimin e të gjitha rrugëve të disponueshme për sistemin e ruajtjes. Në rastin e ALUA përdoren vetëm rrugët deri te kontrolluesi që zotëron LUN-in. Nuk janë të gjitha sistemet e ruajtjes në ESXi që kanë rregulla të parazgjedhura, të cilat vendosin politikën Round-Robin. Nëse për sistemin tuaj të ruajtjes nuk ka rregulla, përdorni një plugin nga prodhuesi i sistemit, i cili do të krijojë rregullin përkatës në të gjitha hostet e klasterit, ose krijoni rregullin vetë. Detaje këtu. 

Po ashtu disa prodhues të sistemit të ruajtjes rekomandojnë të ndryshoni numrin e IOPS nga vlera standarde 1000 në 1. Në praktikën tonë kjo ka lejuar "të nxjerrim" më shumë performancë nga sistemi i ruajtjes dhe të reduktojmë ndjeshëm kohën e nevojshme për failover në rast dështimi apo përditësimi të kontrolluesve. Rishikoni rekomandimet e ofruesit, dhe nëse nuk ka kundërshtime, provoni të ndryshoni këtë parametër. Detaje këtu.

Matrica kryesore të performancës së nënsystemit disk të makinës virtuale

Matrica e performancës së nënsystemit disk në vCenter janë mbledhur në seksionet Datastore, Disk, Disku Virtual:

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

Në seksionin Datastore ndodhen metrikat për ruajtjet disk vSphere (datastoret), në të cilat ndodhen disqet e VM. Këtu do të gjeni matjet standarde për:

  • IOPS (KĂ«rkesat mesatare tĂ« leximit/shkrimit pĂ«r sekondĂ«), 
  • kapacitetin (ShpejtĂ«sia e Leximit/Shkrimit), 
  • vonesat (Vonesa e Leximit/Shkrimit/Vonesa mĂ« e lartĂ«).

Nga emrat e matjeve në të vërtetë është gjithçka e kuptueshme. Përsëris se këtu statistika nuk është për një VM (apo disk të VM) të veçantë, por e përgjithshme për të gjithë datastorin. Në mendimin tim, është më e lehtë të shikohet kjo statistikë në ESXTOP, të paktën duke pasur parasysh që periudha minimale e matjes atje është 2 sekonda.

Në seksionin Disk ndodhen metrikat për pajisjet bllokuese, të cilat përdoren nga VM. Këtu ka matje për IOPS të tipit summation (numri i operacioneve të hyrjes/daljes në periudhën e matjes) dhe disa matje të tjera të lidhura me qasjen bllokuese (Komandat e ndërprera, Rivendosjet e autobusëve). Në mendimin tim, është gjithashtu më e lehtë të shikohet kjo informacion në ESXTOP.

Seksioni Disku Virtual – Ă«shtĂ« mĂ« i dobishĂ«m pĂ«r gjetjen e problemeve me performancĂ«n e nĂ«nshkallĂ«s diskore tĂ« VM. KĂ«tu mund tĂ« shihni performancĂ«n e çdo disku virtual. Kjo Ă«shtĂ« informacioni qĂ« nevojitet pĂ«r tĂ« kuptuar nĂ«se ka njĂ« problem me njĂ« makinĂ« virtuale tĂ« veçantĂ«. PĂ«rveç hesapimeve standarde tĂ« numrit tĂ« operacioneve tĂ« hyrjes/daljes, volumit tĂ« leximit/shkrimit dhe vonesave, nĂ« kĂ«tĂ« seksion ka parameter tĂ« dobishĂ«m qĂ« tregojnĂ« madhĂ«sinĂ« e bllokut: MadhĂ«sia e kĂ«rkesĂ«s pĂ«r lexim/shkrim.

Në figurën më poshtë, grafiku i performancës së diskut të VM, ku mund të shihni numrin e IOPS, vonesat dhe madhësinë e bllokut. 

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

Po ashtu, metrikat e performancës mund të shihen për tërë datastorin, nëse SIOC është i aktivizuar. Këtu është paraqitur informacion i bazës në lidhje me Latency të mesme dhe IOPS. Sipas parazgjedhjes, ky informacion mund të shikohet vetëm në kohë reale.

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

ESXTOP

Në ESXTOP, ka disa ekrane, ku është paraqitur informacioni mbi nënshkallën diskore të hostit në tërësi, makinat virtuale të veçanta dhe diskët e tyre.

Le të fillojmë me informacionin mbi makinat virtuale. Ekrani "Disk VM" aktivizohet me çelësin "v":

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

NVDISK – Ă«shtĂ« numri i diskĂ«ve tĂ« VM. PĂ«r tĂ« shikuar informacionin pĂ«r çdo disk, shtypni "e" dhe shkruani GID e VM-sĂ« qĂ« ju intereson.

Vlera e parametrave të tjerë në këtë ekran është e qartë nga emrat e tyre.

Një ekran tjetër i dobishëm për gjetjen e problemeve është Disk adapter. Aktivizohet me çelësin "d" (në figurën më poshtë janë zgjedhur fushat A, B, C, D, E, G):

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

NPTH – numri i rrugĂ«ve nĂ« lunat, tĂ« cilat janĂ« tĂ« dukshme nga ky adaptues. PĂ«r tĂ« marrĂ« informacionin pĂ«r çdo rrugĂ« nĂ« adaptues, shtypni "e" dhe shkruani emrin e adaptuesit:

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

AQLEN – madhĂ«sia maksimale e radhĂ«s nĂ« adaptues.

Po ashtu, në këtë ekran janë paraqitur hesapet e vonesave, për të cilat kam folur më sipër: KAVG/cmd, GAVG/cmd, DAVG/cmd, QAVG/cmd.

NĂ« ekranin Disk device, i cili aktivizohet me çelĂ«sin "u", paraqitet informacioni mbi pajisjet e veçanta bllokuese – lunat (nĂ« figurĂ«n mĂ« poshtĂ« janĂ« zgjedhur fushat A, B, F, G, I). KĂ«tu mund tĂ« shihni gjendjen e radhĂ«s pĂ«r lunat.

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

DQLEN – madhĂ«sia e radhĂ«s pĂ«r pajisjen e bllokut.
ACTV – numri i komandave tĂ« hyrjes/daljes nĂ« bĂ«rthamĂ«n ESXi.
QUED – numri i komandave tĂ« hyrjes/daljes nĂ« radhĂ«.
%USD – ACTV / DQLEN × 100%.
LOAD – (ACTV + QUED) / DQLEN.

Nëse %USD është i lartë, është e arsyeshme të shqyrtohet rritja e radhës. Sa më shumë komanda të jenë në radhë, aq më i lartë është QAVG dhe, për rrjedhojë, KAVG.

Në ekranin Disk device mund të kontrolloni nëse VAAI (vStorage API for Array Integration) funksionon në SHK. Për këtë, duhet të zgjidhni fushat A dhe O.

Mekanizmi VAAI lejon që të transferohet një pjesë e punës nga hipervizori direkt në SHK, për shembull, zerozimi, kopjimi i blloqeve ose bllokimi.

Analiza e performancës së VM në VMware vSphere. Pjesa 3: Storage

Siç shihet në imazhin e mësipërm, në këtë SHK VAAI funksionon: përdoren aktivisht primitivët Zero dhe ATS.

Këshilla për optimizimin e punës me nën sistemin e disks në ESXi

  • Kujdesuni pĂ«r madhĂ«sinĂ« e bllokut.
  • Vendosni madhĂ«sinĂ« optimale tĂ« radhĂ«s nĂ« HBA.
  • Mos harroni tĂ« aktivizoni SIOC nĂ« datastoret.
  • Zgjidhni PSP nĂ« pĂ«rputhje me rekomandimet e prodhuesit tĂ« SHK.
  • Sigurohuni qĂ« VAAI tĂ« funksionojĂ«.

Artikuj të dobishëm mbi temën:http://www.yellow-bricks.com/2011/06/23/disk-schednumreqoutstanding-the-story/
http://www.yellow-bricks.com/2009/09/29/whats-that-alua-exactly/
http://www.yellow-bricks.com/2019/03/05/dqlen-changes-what-is-going-on/
https://www.codyhosterman.com/2017/02/understanding-vmware-esxi-queuing-and-the-flasharray/
https://www.codyhosterman.com/2018/03/what-is-the-latency-stat-qavg/
https://kb.vmware.com/s/article/1267
https://kb.vmware.com/s/article/1268
https://kb.vmware.com/s/article/1027901
https://kb.vmware.com/s/article/2069356
https://kb.vmware.com/s/article/2053628
https://kb.vmware.com/s/article/1003469
https://www.vmware.com/content/dam/digitalmarketing/vmware/en/pdf/techpaper/performance/vsphere-esxi-vcenter-server-67-performance-best-practices.pdf

Burimi: habr.com

Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster