Situata: GPU virtuale nuk i nënshtrohen performancës së zgjidhjeve harduerike

Në shkurt, në Stanford u mbajt një konferencë, e cila trajtoi llogaritë me performancë të lartë (HPC). Përfaqësuesit e VMware njoftuan se, kur punojnë me GPU, sistemi i bazuar në të modifikuar hipervizorin ESXi nuk i nënshtrohet ndryshimeve të shpejtësisë përballë zgjidhjeve bare metal.

Ne flasim për teknologjitë që e bënë këtë të mundur.

Situata: GPU virtuale nuk i nënshtrohen performancës së zgjidhjeve harduerike
/ фото Victorgrigas CC BY-SA

Problemi i performancës

Sipas analistëve, rreth 70% e ngarkesave të punës në qendrat e të dhënave janë virtualizuar. Megjithatë, 30% e mbetur ende punon në bare metal pa hipervizorë. Këto 30% kryesisht përbëhen nga aplikacione me ngarkesë të lartë që lidhen, për shembull, me trajnimin e rrjeteve neurale dhe përdorin karta grafike.

Ekspertët e shpjegojnë këtë trend duke thënë se hipervizori si një shtresë ndërmjetësimi mund të ndikojë në performancën e tërë sistemit. Në studimet pesëvjeçare që kanë kaluar mund të gjenden të dhëna për një ulje prej 10% në shpejtësinë e punës. Prandaj, kompanitë dhe operatorët e qendrave të të dhënave nuk janë të nxituar të transferojnë ngarkesat HPC në mjedisin virtual.

Por teknologjitë e virtualizimit po zhvillohen dhe përmirësohen. Në konferencën e një muaji më parë, VMware informoi se hipervizori ESXi nuk ka ndikim negativ në performancën e GPU-ve. Shpejtësia e llogaritjeve mund të ulet me tre për qind, e cila është e krahasueshme me parametrat e bare metal.

Si funksionon

Për të rritur performancën e sistemeve HPC me karta grafike, VMware kanë bërë disa ndryshime në funksionimin e hipervizorit. Veçanërisht, e kanë eliminuar funksionin e vMotion. Ky funksion nevojitet për balancimin e ngarkesës dhe zakonisht transferon makinat virtuale (VM) midis serverëve ose GPU-ve. Shkëputja e vMotion ka bërë që çdo VM tani të lidhet me një GPU specifike. Kjo ka ndihmuar në uljen e kostove gjatë shkëmbimit të të dhënave.

Një komponent tjetër kyç i sistemit është teknologjia DirectPath I/O. Ajo lejon që drejtuesi CUDA për llogaritjet paralel të ndërveprojë me makinat virtuale në mënyrë direkte, duke anashkaluar hipervizorin. Kur në një GPU nevojitet të ekzekutohen disa VM njëkohësisht, zbatohet zgjidhja GRID vGPU. Ajo ndan memorien e kartës në disa segmente (por ciklet llogaritëse nuk ndahen).

Skema e funksionimit të dy makinave virtuale në këtë rast do të duket si më poshtë:

Situata: GPU virtuale nuk i nënshtrohen performancës së zgjidhjeve harduerike

Rezultatet dhe parashikimet

Kompania u kryen teste të hipervizorit, duke trajnuar një model gjuhësor të bazuar TensorFlow. "Dëmi" i performancës ishte vetëm 3–4%, krahasuar me bare metal. Megjithatë, sistemi fitoi mundësinë për të shpërndarë burimet sipas kërkesës në varësi të ngarkesave aktuale.

Giganti IT gjithashtu kryente teste me kontejnerët. Inxhinierët e kompanisë trajnuan rrjetet neurale për të njohur imazhet. Gjatë kësaj, burimet e një GPU-je u shpërndanë midis katër VM-ve kontejner. Si rezultat, performanca e makinave individuale u ul me 17% (krahasuar me një VM që kishte qasje të plotë në burimet e GPU). Megjithatë, numri i imazheve të përpunuara për sekondë u rrit u rrit tre herë. Pritet që sisteme të tilla të gjejnë përdorim në fushën e analizës së të dhënave dhe modelimit kompjuterik.

Midis problemeve të mundshme me të cilat mund të përballet VMware, ekspertët përmendin kanë një audiencë shumë të ngushtë. Me sistemet e llogaritjes së performancës të lartë, aktualisht punojnë një numër i vogël kompanish. Megjithëse në Statista theksojnë, që deri në vitin 2021 do të kenë virtualizuar 94% të ngarkesave të punës globale. Sipas parashikimeve

Situata: GPU virtuale nuk i nënshtrohen performancës së zgjidhjeve harduerike
/ фото Global Access Point PD

Zgjidhje të ngjashme

analistëve, vlera e tregut HPC do të rritet nga 32 në 45 miliard dollarë në periodën 2017 deri në 2022.

Në treg ka disa analoge që po zhvillohen nga kompani të mëdha IT: AMD dhe Intel. ofron Kompania e parë për virtualizim të GPU-ve

ndjek një qasje bazuar në SR-IOV (virtualizimi i hyrjes/daljes me rrënjë të vetme). Kjo teknologji ofron VM-ve qasje në një pjesë të kapaciteteve harduerike të sistemit. Zgjidhja lejon ndarjen e GPU-së midis 16 përdoruesve me performancë të barabartë të sistemeve të virtualizuara. Sa i përket gjigantit të dytë IT, teknologjia e tyre bazohet në hipervizorin Citrix XenServer 7. Ajo bashkon punën e drejtuesit standard të GPU-ve dhe makinës virtuale, duke lejuar kështu që ajo të shfaqë aplikacione 3D dhe desktop-e në pajisjet e qindra përdoruesve.

E ardhmja e teknologjisë

Zhvilluesit e GPU-ve virtuale po vendosin në sistemet e AI që po bëhen gjithnjë e më të njohura në tregun e teknologjive të biznesit. Ata shpresojnë se nevoja për përpunimin e volumit të madh të të dhënave do të rrisë kërkesën për vGPU.

Aktualisht prodhuesit po kërkojnë një mënyrë të bashkohen funksionalitetet e CPU dhe GPU në një bërthamë, për të përshpejtuar zgjidhjen e problemeve që lidhen me grafikën, kryerjen e llogaritjeve matematikore, operacione logjike, përpunimin e të dhënave. Shfaqja në treg e tillë e bërthamave në të ardhmen do të ndryshojë qasjen ndaj virtualizimit të burimeve dhe shpërndarjes së tyre mes ngarkesave të punës në mjedisin virtual dhe në re.

Çfarë të lexoni mbi këtë temë në blogun tonë korporativ:

Një çift postimesh nga kanali ynë në Telegram:

Burimi: habr.com

Bli një hosting të besueshëm për faqet me mbrojtje DDoS, VPS VDS serverë 🔥 Bli një hosting të besueshëm për faqet me mbrojtje DDoS, VPS VDS serverë | ProHoster