Ju lutem, mos nxitoni me konkludimet për shkak të titullit! Ne kemi argumente të forta në mbështetje të tij dhe i kemi paketuar sa mundëm më kompak. Po ofrojmë për vëmendjen tuaj një postim mbi konceptin dhe parimet e funksionimit të sistemit tonë të ri të ruajtjes së të dhënave, lansimi i të cilit ndodhi në janar 2020.

Sipër mendimit tonë, avantazhi kryesor konkurrues i familjeve të sistemeve të ruajtjes Dorado V6 e sigurojnë pikërisht performanca dhe besueshmëria të përmendura në titull. Po, po, aq e thjeshtë, por se përmes cilave zgjidhjeve dhe jo aq zgjidhjeve të mençura arritëm këtë "thjeshtë", do të flasim sot.
Për të zbuluar më mirë potencialin e sistemeve të reja të brezit, do të flasim për përfaqësuesit më të lartë të gamës së modeleve (modelet 8000, 18000). Nëse nuk është e shënuar ndryshe, nënkuptohen pikërisht ato.

Një fjalë për tregun
PĂ«r tĂ« kuptuar mĂ« mirĂ« vendin e zgjidhjeve Huawei nĂ« treg, le tĂ« referohemi nĂ« njĂ« masĂ« tĂ« provuar â "" Gartner. Dy vjet mĂ« parĂ«, nĂ« sektorin e sistemeve tĂ« ruajtjes sĂ« pĂ«rgjithshme, kompania jonĂ« hyri me siguri nĂ« grupin e liderĂ«ve, duke u lĂ«nĂ« pas vetĂ«m NetApp dhe Hewlett Packard Enterprise. Pozita e Huawei nĂ« tregun e sistemeve tĂ« ruajtjes SSD nĂ« vitin 2018 ishte karakterizuar nga statusi "pretendent", megjithatĂ« diçka mungonte pĂ«r tĂ« arritur pozitat lider.
NĂ« vitin 2019 Gartner nĂ« studimin e tij bashkoi tĂ« dyja sektorĂ«t e pĂ«rmendur mĂ« sipĂ«r nĂ« njĂ« â "Ruajtja Kryesore". Si rezultat, Huawei sĂ«rish pĂ«rfundoi nĂ« katrorin e liderĂ«ve, pranĂ« ofruesve si IBM, Hitachi Vantara dhe Infinidat.
Për plotësinë e pamjes, le të theksojmë se 80% e të dhënave për analizë Gartner i mbledh në tregun amerikan, që çon në një përqindje të ndjeshme në favor të kompanive që janë mirë të prezantuara pikërisht në SHBA. Ndërkohë, ofruesit që orientohen drejt tregjeve evropiane dhe aziatike ndodhen në një pozicion më të pafavorshëm. Dhe edhe pse kjo, vitin e kaluar produktet e Huawei zënë një vend të denjë në katrorin e sipërm të djathtë dhe, sipas vendimit të Gartner, "mund të rekomandohet për përdorim".

ĂfarĂ« Ă«shtĂ« e re nĂ« Dorado V6
Linija e produkteve Dorado V6, në veçanti, paraqitet me sistemet e nivelit fillestar të serisë 3000. Fillimisht të pajisura me dy kontrollues, ato mund të zgjaten horizontalisht deri në 16 kontrollues, 1200 disqe dhe 192 GB cache. Gjithashtu, sistemi do të pajiset me porte të jashtme Fibre Channel (8 / 16 / 32 Gb/s) dhe Ethernet (1 / 10 / 25 / 40 / 100 Gb/s).
Vlen të theksohet se aktualisht po bëhet reduktimi i përdorimit të protokolleve pa sukses tregtar, prandaj në fillim ne vendosëm t'u heqim mbështetje për Fibre Channel over Ethernet (FCoE) dhe Infiniband (IB). Ato do të shtohen në versionet e ardhshme të programit të funksionimit. Mbështetje për NVMe over Fabric (NVMe-oF) është e disponueshme "nga kutia" mbi Fibre Channel. Në versionin e ardhshëm, i cili është planifikuar për në qershor, është parashikuar mbështetja e modit NVMe over Ethernet. Nga pikëpamja jonë, grupi i lartpërmendur do të mbulojë mjaft nevojat e shumicës së klientëve të Huawei.
Qasja në skedarë në versionin aktual të programit të funksionimit mungon dhe do të shfaqet në një nga përditësimet e ardhshme afër fundit të vitit. Zbatimi është planifikuar në nivelin natyror, nga vetë kontrolluesit me porta Ethernet, pa përdorimin e pajisjeve të jashtme.
Dallimi kryesor midis modelit Dorado V6 tĂ« serisĂ« 3000 dhe atyre mĂ« tĂ« vjetra Ă«shtĂ« se nĂ« backend mbĂ«shtet vetĂ«m njĂ« protokoll â SAS 3.0. Si rezultat, dhe ruajtĂ«sit mund tĂ« pĂ«rdoren vetĂ«m me atĂ« ndĂ«rfaqe. Nga pikĂ«pamja jonĂ«, performanca qĂ« sigurohet nĂ« kĂ«tĂ« mĂ«nyrĂ« Ă«shtĂ« mjaft e mjaftueshme pĂ«r njĂ« pajisje tĂ« kĂ«tij lloji.
Sistemet Dorado të serive V6 5000 dhe 6000 i përkasin zgjidhjeve të mesme. Ato gjithashtu realizohen në formën 2U dhe janë të pajisura me dy kontrollues. Nga njëra-tjetra, ato dallohen nga performanca, numri i procesorëve, numri maksimal i disqeve dhe kapaciteti i cache-it. Megjithatë, në planin arkitektonik dhe inxhinieror, Dorado V6 5000 dhe 6000 janë identikë dhe duken njësoj.
Sistemet Dorado V6 të serive 8000 dhe 18000 i përkasin klasës hi-end. Të realizuara në madhësinë 4U, ato me defaut kanë një arkitekturë të ndarë, në të cilën kontrolluesit dhe ruajtësit e dhënash janë të ndara. Në konfigurimin minimal, ato gjithashtu mund të pajisen me vetëm dy kontrollues, megjithatë, klientët zakonisht kërkojnë instalimin e katër ose më shumë.
Dorado V6 8000 shkruhet horizontalisht dhe mund të përmasohet deri në 16 kontrolerë, ndërsa Dorado V6 18000 deri në 32. Këto sisteme janë të pajisura me procesorë të ndryshëm me numra dhe kapacitete të ndryshme cache. Identiteti i zgjidhjeve inxhinierike mbetet i njëjtë, ashtu si në modelet e klasës mid-end.
Raftet 2U me disqe lidhen përmes RDMA me një bandwidth prej 100 Gbit/s. Backend-i i serive më të larta Dorado V6 gjithashtu mbështet SAS 3.0, por më tepër për rastin nëse disqet SSD me këtë ndërfaqe do të ulen drastikisht në çmim. Në atë rast do të ketë një justifikim ekonomik për përdorimin e tyre, pavarësisht performancës më të ulët. Megjithatë, momentalisht, ndryshimi në çmim midis SSD-ve me ndërfaqet SAS dhe NVMe është aq i vogël saqë ne nuk jemi të gatshëm të rekomandojmë një zgjidhje të tillë.

Brenda kontrolluesit
Kontrolluesit e Dorado V6 janë realizuar në bazën tonë të elementeve. Asnjë procesor nga Intel, asnjë ASIC nga Broadcom. Kështu, të gjitha përbërësit e mundshëm të pllakës amë, po ashtu si vetë ajo, janë plotësisht jashtë ndikimeve të rreziqeve që lidhen me presionin e sanksioneve nga kompanitë amerikane. Ata që e kanë parë ndonjëherë pajisjen tonë me sytë e tyre, me siguri kanë vënë re shilën me një vijë të kuqe nën logon. Ajo do të thotë se produkti nuk ka përbërës amerikanë. Kjo është politika zyrtare e Huawei - kalimi në përbërës të prodhuar vetë, ose në çdo rast, që prodhohen në vende që nuk ndjekin politikën e SHBA.
Këtu është çfarë mund të shihni në pllakën e kontrolluesit.
- Një ndërfaqe rrjeti universale (çipi Hisilicon 1822), e cila është përgjegjëse për lidhjen me Fibre Channel ose Ethernet.
- BMC çipi që siguron aksesin e largët në sistem, dmth. Hisilicon 1710, për menaxhim dhe monitorim të plotë në distancë të sistemit. Të ngjashme përdoren gjithashtu në serverët tanë dhe zgjidhje të tjera.
- Procesori qendror, i cili është një çip Kunpeng 920 i prodhuar nga Huawei, i ndërtuar mbi arkitekturën ARM. Ky është i shfaqur në diagramin e mësipërm, megjithatë, në kontrollues të tjerë mund të instalohen modele të ndryshme me numra dhe frekuenca të ndryshme. Nga modeli në model, ndryshon gjithashtu numri i procesorëve në një kontrollues. Për shembull, në seritë më të larta Dorado V6, në një pllakë ka katër.
- Kontrolluesi SSD (çipi Hisilicon 1812e), i cili mbështet lidhjen si me disqet SAS ashtu edhe me ato NVMe. Shtojmë se, Huawei prodhon vetë SSD-të, megjithatë nuk prodhon vetë qelizat NAND, duke preferuar t'i blejë ato nga katër prodhuesit më të mëdhenj në botë në formën e pllakatave të silikonit të pa shkëputura. Prerja, testimi dhe paketimi në çipa bëhet nga Huawei, pas së cilës i lëshon ato nën markën e vet.
- Ăipi i inteligjencĂ«s artificiale â Ascend 310. NĂ« mĂ«nyrĂ« tĂ« paracaktuar, ai nuk Ă«shtĂ« i pranishĂ«m nĂ« kontrollues dhe montohet pĂ«rmes njĂ« karte tĂ« veçantĂ«, e cila zĂ« njĂ« nga vendet e rezervuara pĂ«r adaptuesit e rrjetit. Ăipi pĂ«rdoret pĂ«r tĂ« garantuar njĂ« sjellje inteligjente tĂ« kujtesĂ«s, pĂ«r tĂ« menaxhuar performancĂ«n ose proceset e deduplication dhe kompresionit. TĂ« gjitha kĂ«to detyra mund tĂ« kryhen edhe nga procesori qendror, por çipi i AI e bĂ«n kĂ«tĂ« shumĂ« mĂ« efikas.

Veçmas për procesorët Kunpeng
Procesori Kunpeng përbën një sistem në një çip (SoC), ku përveç njësisë përpunuese, ka module hardueri që përshpejtojnë procese të ndryshme, si llogaritja e kontrolleve ose ekzekutimi i "kodit të fshirjes" (erasure coding). Në të është implementuar mbështetje harduerike për SAS, Ethernet, DDR4 (nga gjashtë në tetë kanale), etj. Kjo i lejon Huawei të krijojë kontrollues të AXH, të cilët nuk i japin pas Intel-it në performancë.
Për më tepër, zgjidhjet e saj të bazuara në arkitekturën ARM i japin Huawei mundësinë të krijojë zgjidhje të plota serverësh dhe t'i ofrojë ato klientëve të saj si një alternativë ndaj x86.

Arkitektura e re Dorado V6...
Arkitektura e brendshme e AXH Dorado V6 të serisë së lartë është e paraqitur nga katër sub-domenë kryesore (fabrika).
Fabrika e parë është frontend i përgjithshëm (interfacet e rrjetit që janë përgjegjës për lidhjen me fabrikën SAN ose hostet).
Fabrika e dytĂ« â njĂ« grup kontrolluesish, secili prej tĂ« cilĂ«ve mund tĂ« arrijĂ« pĂ«rmes protokollit RDMA si nĂ« çdo kartĂ« rrjeti tĂ« frontendit, ashtu edhe tek "motorĂ«t" (engine), qĂ« pĂ«rbĂ«n njĂ« kuti me katĂ«r kontrollues, si dhe blloqet e pĂ«rbashkĂ«ta tĂ« furnizimit me energji dhe ftohjes. Tani modelet Dorado V6 tĂ« klasĂ«s hi-end mund tĂ« pajisen me dy "motorĂ«" tĂ« tillĂ« (pĂ«rkatĂ«sisht tetĂ« kontrollues).
Fabrika e tretë është përgjegjëse për backend dhe përbëhet nga kartat rrjetëse RDMA 100G.
Më në fund, fabrika e katërt "në hardware" paraqitet me rafte inteligjente të ndërlidhura me disqe.
Për struktura simetrike të tillë zbulon të gjithë potencialin e teknologjisë NVMe dhe garanton performancë të lartë dhe besueshmëri. Procesi i hyrjes dhe daljes maksimalisht ndahen nëpër procesorë dhe bërthamë, duke siguruar lexime dhe shkruajta të njëkohshme në shumë rrjedha.

âŠdhe çfarĂ« na dha ajo
Performanca maksimale e zgjidhjeve Dorado V6 është rreth tri herë më e lartë se treguesit e sistemeve të brezit të kaluar (të njëjtës kategori) dhe mund të arrijë deri në 20 milion IOPS.
Kjo është për shkak se në brezin e kaluar të pajisjeve, mbështetje për NVMe ishte e pranishme vetëm në rafte të ndërlidhura me disqe. Tani, ajo është e pranishme në të gjitha fazat, nga hosti deri te SSD. Rrjeti i backend-it gjithashtu ka pësuar ndryshime: SAS/PCIe janë zëvendësuar nga RoCEv2 me kapacitet prej 100 Gbit/s.
Ka ndryshuar edhe vetë formati i SSD. Nëse më parë një rafte 2U kishte 25 disqe, tani ajo është rritur në 36 disqe me format fizik në përmasën palm-sized. Për më tepër, rafte janë "inteligjentuar". Tani në çdo rafte ka një sistem të qëndrueshëm me dy kontrolerë të bazuar në çipet ARM, të ngjashme me ato që janë instaluar në kontrolerët qendrorë.

Derisa ata merren vetëm me reorganizimin e të dhënave, me daljen e versioneve të reja të programimit do të shtohet kompresimi dhe kodimi i fshirjes, duke lejuar që ngarkesa në kontrolerët kryesorë të ulet nga 15 në 5%. Shkëmbimi i disa detyrave në rafte gjithashtu çliron kapacitetin e rrjetit të brendshëm. Dhe gjithë kjo rrit ndjeshëm potencialin e shtrirjes së sistemit.
Kompresimi dhe deduplichimi në SAN-in e brezit të kaluar janë kryer me blloqe me gjatësi fikse. Tani është shtuar një mod për të punuar me blloqe me gjatësi të ndryshueshme, i cili për momentin duhet të aktivizohet manualisht. Versionet e mëpasshme të programimit ndoshta do të ndryshojnë këtë situatë.
Po ashtu, shkurtimisht mbi tolerancën ndaj dështimeve. Dorado V3 mbajti funksionalitetin nëse një kontroler nga dy e dështon. Dorado V6 do të sigurojë disponueshmërinë e të dhënave edhe nëse dështojnë njëra pas tjetrës shtatë kontrolerë nga tetë ose për njëkohësisht katër nga një "motor".

Besueshmëria nga këndvështrimi ekonomik
SĂ« fundmi, ndĂ«r klientĂ«t e Huawei u krye njĂ« anketĂ« nĂ« lidhje me atĂ« se cilat elemente tĂ« veçanta tĂ« infrastrukturĂ«s IT kompania i konsideron tĂ« pranueshme. NĂ« masĂ« tĂ« madhe, respondentĂ«t e pranuan me tolerance njĂ« situatĂ« hipotetike ku njĂ« aplikacion nuk pĂ«rgjigjet pĂ«r disa qindra sekonda. PĂ«r sistemin operativ ose adaptoin e hostit, koha kritike e ndaljes rezultoi tĂ« ishte disa dhjetĂ«ra sekonda (thellĂ«sisht, koha e rinisjes). Dikush tregoi kĂ«rkesa edhe mĂ« tĂ« larta pĂ«r rrjetin: kapaciteti i tij i kalimit nuk duhet tĂ« bie mĂ« shumĂ« se 10â20 sekonda. Siç mund tĂ« merret me mend, pjesĂ«marrĂ«sit e anketĂ«s e konsideruan si mĂ« kritik dĂ«shtimin e sistemeve tĂ« ruajtjes. Nga kĂ«ndvĂ«shtrimi i pĂ«rfaqĂ«suesve tĂ« biznesit, ndalimi i njĂ« sistemi ruajtjeje nuk duhet tĂ« tejkalojë⊠disa sekonda nĂ« vit!
Me fjalë të tjera, nëse aplikacioni klient i bankës nuk përgjigjet për 100 sekonda, kjo ndoshta nuk do të sjellë pasojat katastrofike. Por, nëse po aq kohë nuk punon sistemi i ruajtjes, ndalimi i biznesit dhe humbjet financiare janë të mundshme.

Në diagramin e sipërm janë paraqitur shkallët e kostos për orën e punës për dhjetë bankat më të mëdha (të dhënat Forbes 2017). Pranojeni, nëse kompania juaj i afrohet përmasave të bankave kineze, do të jetë e lehtë të arsyetoni nevojën për të blerë një sistem ruajtjeje për disa milion dollarë. E njëjta gjë është e vërtetë e kundërta: nëse biznesi nuk pëson humbje të konsiderueshme gjatë ndalimit, atëherë sigurisht nuk do të blejë një sistem ruajtjeje të klasës hi-end. Në çdo rast, është e rëndësishme të keni një ide se sa do të jetë vrima që mund të formohet në portofolin tuaj, ndërsa administratori i sistemit merret me një sistem ruajtjeje të dështuar.

Sekonda për kalimin emergjent
Në Zgjidhjen A që ilustrohet më lart, mund të njihni sistemin tonë të brezit të kaluar Dorado V3. Katër kontrolluesit e saj punojnë të çiftuar, dhe kopjet e caches ruhen vetëm në dy kontrollues. Kontrolluesit brenda çiftit mund të riparatojnë ngarkesën. Në të njëjtën kohë, siç shihni, këtu nuk ka "fabrika" për frontin dhe prapavijën, kështu që çdo raft me memorie lidhet me një çift të caktuar kontrolluesish.
Në diagramin e Zgjidhjes B është paraqitur një zgjidhje aktuale në treg nga një furnizues tjetër (e kuptuat?). Këtu tashmë ka fabrika frontend dhe backend, ndërsa ruajtësit lidhen direkt me katër kontrollorë. Megjithatë, në punën e algoritmeve të brendshme të sistemit ka nuanca që nuk janë të dukshme në shikim të parë.
Në të djathtë është paraqitur arkitektura jonë aktuale e SCSI Dorado V6 me të gjitha elementët e saj të brendshëm. Le të shqyrtojmë se si këto sisteme e përballojnë një situatë tipike - dështimin e një kontrollori.
Në sistemet klasike, të cilat përfshijnë edhe Dorado V3, periudha që kërkohet për të shpërndarë ngarkesën pas një dështimi arrin deri në katër sekonda. Gjatë kësaj kohe, hyrja-dalja ndalet plotësisht. Në zgjidhjen Zgjidhja B nga kolegët tanë, pavarësisht nga arkitektura më moderne, koha e qëndrimit pas një dështimi është madje më e gjatë - gjashtë sekonda.
SCSI Dorado V6 e rikthen funksionimin e saj pas vetëm një sekonde pas dështimit. Ky rezultat arrihet falë një ambienti të brendshëm homogjen RDMA, që i lejon kontrollorit të qaset në memorien 'e huaj'. Një rrethanë tjetër e rëndësishme është pranija e fabrikës frontend, që bën që rruga për hostin të mos ndryshojë. Porta qëndron e njëjtë, dhe ngarkesa thjesht dërgohet në kontrollorët e shëndetshëm nga drejtuesit e multi-passt.
Dështimi i kontrollorit të dytë në Dorado V6 menaxhohet për një sekondë sipas së njëjtës skemë. Për Dorado V3, kjo zgjat rreth gjashtë sekonda, ndërsa për zgjidhjen e një furnizuesi tjetër - nëntë. Për shumë DBMS, këto intervale nuk mund të konsiderohen të pranueshme, pasi gjatë kësaj kohe sistemi kalon në modin standby dhe ndalon së funksionuari. Kjo iu referohet së pari DBMS-ve, që përbëhen nga shumë pjesë.
Dështimi i kontrollorit të tretë Solution A nuk mund të përballohet. Thjesht për shkak se humbet aksesin në një pjesë të diskëve me të dhëna. Nga ana tjetër, Solution B në një situatë të tillë rikthen funksionalitetin, për të cilin nevojitet, si në rastin e mëparshëm, nëntë sekonda.
ĂfarĂ« ndodh me Dorado V6? NjĂ« sekondĂ«.

ĂfarĂ« mund tĂ« bĂ«het brenda njĂ« sekonde?
GjĂ«ja kryesore Ă«shtĂ« qĂ« nuk na nevojitet shumĂ«. ĂshtĂ« e rĂ«ndĂ«sishme tĂ« theksojmĂ« se nĂ« Dorado V6 klasa hi-end fabrika e front-end-it Ă«shtĂ« e ndarĂ« nga fabrika e kontrolerĂ«ve. KĂ«shtu, nuk ka porte tĂ« ngurta qĂ« i pĂ«rkasin njĂ« kontrolluesi tĂ« caktuar. Ri-strukturimi nĂ« rast tĂ« njĂ« dĂ«shtimi nuk kĂ«rkon kĂ«rkimin e marrĂ«veshjeve alternative ose ri-iniçializimin e multi-passing. Sistemi vazhdon tĂ« punojĂ« siç ka punuar.

Resistenca ndaj shumë dështimeve
Modelet më të avancuara të Dorado V6, pa asnjë problem, përballojnë dështimin e përbashkët të dy kontrolerëve të çdo lloji (!) nga çdo "motor". Kjo ishte e mundur falë faktit se tani zgjidhja ruan tri kopje të caches. Prandaj, madje edhe në rastin e një dështimi të dyfishtë, gjithmonë do të ketë një kopje të pandërprerë.
Dështimi sinkron i të katër kontrolerëve në një nga "motorët" gjithashtu nuk do të shkaktojë pasoja fatale, pasi të tre kopjet e caches në çdo moment janë të shpërndara midis "motorëve". Sistemi vetë monitoron përputhshmërinë e kësaj logjike pune.
Në fund, një skenar krejt i papritur është dështimi radhazi i shtatë kontrolerëve nga tetë. Megjithatë, intervali minimal i lejuar për të ruajtur funksionalitetin midis dështimeve të veçanta është 15 minuta. Gjatë kësaj kohe, sistemi ruajtës do të arrijë të kryejë operacionet e nevojshme për migrimin e caches.
Kontrolleri i mbetur do të sigurojë operimin e ruajtjes së të dhënave dhe do të mbajë caches për pesë ditë (vlera e paracaktuar, që mund të ndryshohet lehtësisht në cilësime). Pas kësaj, caches do të çaktivizohet, por funksionimi i sistemit do të vazhdojë.

Përditësime që nuk shqetësojnë
Sistemi i ri operativ Dorado V6 lejon përditësimin e firmware të sistemit ruajtës pa rinisur kontrollerët.
Sistemi operativ, ashtu si në rastin e zgjidhjeve të mëparshme, është ndërtuar në bazë të Linux, megjithatë shumë procese operacionale janë transferuar nga bërthama në modin e përdoruesit. Shumica e funksioneve, për shembull ato që lidhen me deduplication dhe kompresimin, tani janë procese të zakonshme që funksionojnë si demonë në sfond. Falë kësaj, për të përditësuar modulet e veçanta nuk është e nevojshme të ndërroni të gjithë sistemin operativ. Për shembull, për të shtuar mbështetje për një protokoll të ri, do të mjaftonte të çaktivizohej moduli përkatës dhe të aktivizohej ai i ri.
ĂshtĂ« e qartĂ« se çështjet e pĂ«rditĂ«simit tĂ« sistemit vazhdojnĂ« tĂ« mbeten, sepse edhe nĂ« bĂ«rthamĂ« mund tĂ« ketĂ« elementĂ« qĂ« kĂ«rkojnĂ« pĂ«rditĂ«sim. Por, sipas vĂ«zhgimeve tona, ato pĂ«rbĂ«jnĂ« mĂ« pak se 6% tĂ« numrit total. Kjo lejon tĂ« rivendosen kontrollorĂ«t dhjetĂ«ra herĂ« mĂ« rrallĂ« se mĂ« parĂ«.

Zgjidhjet e qëndrueshmërisë ndaj katastrofave dhe zgjidhjet me disponueshmëri të lartë (HA/DR)
Dorado V6 "nga kutia" është e gatshme për integrim në zgjidhjet e shpërndara gjeografikisht, klasteret e nivelit të qytetit (metro) dhe qendrat e të dhënave "tre herë".
Majtas nĂ« ilustrimin mĂ« sipĂ«r â njĂ« metro-klaster qĂ« Ă«shtĂ« i njohur pĂ«r shumicĂ«n. Dy SHD funksionojnĂ« nĂ« mĂ«nyrĂ«n aktive / aktive nĂ« njĂ« distancĂ« deri nĂ« 100 km nga njĂ«ri-tjetri. NjĂ« infrastrukturĂ« e tillĂ« me praninĂ« e njĂ« ose mĂ« shumĂ« serverĂ«ve tĂ« kuorumit mund tĂ« mbĂ«shtetet nga zgjidhje tĂ« kompanive tĂ« ndryshme, duke pĂ«rfshirĂ« sistemin tonĂ« operativ nĂ« re FusionSphere. Karakteristikat e kanalit midis sitĂ«ve bĂ«hen tĂ« rĂ«ndĂ«sishme nĂ« kĂ«to projekte, ndĂ«rsa tĂ« gjitha detyrat e tjera nĂ« kĂ«tĂ« rast i merr mbi vete funksioni HyperMetro, i disponueshĂ«m, pĂ«rsĂ«ri, "nga kutia". Mund tĂ« bĂ«het integrim pĂ«rmes Fibre Channel, si dhe pĂ«rmes iSCSI nĂ« rrjetet IP, nĂ«se ka nevojĂ« tĂ« tillĂ«. Nuk ka mĂ« nevojĂ« pĂ«r optikĂ« "tĂ« errĂ«t" tĂ« dedikuar, sepse sistemi Ă«shtĂ« nĂ« gjendje tĂ« lidhet pĂ«rmes kanaleve ekzistuese.
Kur ndĂ«rtohen kĂ«to sisteme, kĂ«rkesa e vetme harduerike pĂ«r SHD Ă«shtĂ« rezervimi i porteve pĂ«r replikim. Mjafton tĂ« blini njĂ« licencĂ«, tĂ« nisni serverĂ«t e kuorumit â fizik ose virtual â dhe tĂ« siguroheni pĂ«r lidhje IP me kontrollorĂ«t (10 Mbit/s, 50 ms).
Kjo arkitekturë lehtë transferohet në një sistem me tre QENDRA të Tà DHENAVE (shih pjesën e djathtë të ilustrimit). Për shembull, kur dy QENDRA të Tà DHENAVE punojnë në mënyrën e metro-klasterit, dhe një vendndodhje e tretë, e vendosur në një distancë më të madhe se 100 km, përdor replikimin asinkron.
Sistemi teknologjikisht mbështet skenarë të ndryshëm biznesi, të cilat do të realizohen në rast të një eksesi masiv.

Mundësia e mbijetesës së metro-klasterit në rast të disa dështimeve
Në ilustrimin më sipër dhe më poshtë gjithashtu shihet një metro-klaster klasik, që përbëhet nga dy SHD dhe një server kuorum. Siç e shihni, në gjashtë nga nëntë skenarët e mundshëm të dështimeve të shumta, infrastruktura jonë do të ruajë funksionalitetin.
Për shembull, në skenarin e dytë, në rastin e dështimit të serverit të kuorumit dhe sinkronizimit midis platformave, sistemi mbetet funksional, pasi platforma e dytë ndalon punën. Një sjellje e tillë është e inkorporuar në algoritmet e ndërtuara.
Edhe pas tre dështimeve, qasja në informacion mund të ruhet, nëse intervali midis tyre është të paktën 15 sekonda.

Asesi zakonshëm i nëntokës
KujtojmĂ« se Huawei prodhon jo vetĂ«m SXD, por edhe njĂ« gamĂ« tĂ« plotĂ« tĂ« pajisjeve rrjet. ĂfarĂ«do qĂ« tĂ« jetĂ« ofruesi i SXD-sĂ« qĂ« zgjidhni, nĂ«se midis platformave pĂ«rdoret njĂ« rrjet WDM, nĂ« 90% tĂ« rasteve ai do tĂ« ndĂ«rtohet mbi zgjidhjet e kompanisĂ« sonĂ«. Shpesh lind pyetja logjike: pse tĂ« grumbullojmĂ« njĂ« zvarritĂ«s sistemi, kur tĂ« gjithĂ« âharduerinâ qĂ« Ă«shtĂ« plotĂ«sisht i kompatibil Ă«shtĂ« nĂ« dispozicion nga njĂ« ofrues?

Përsa i përket performancës
Ndoshta nuk ka nevojë të bindim askënd më se kalimi në SXD All-Flash lejon të reduktohen ndjeshëm shpenzimet për mirëmbajtjen e infrastrukturës, pasi të gjitha operacionet rutinë kryhen shumë më shpejt. Të gjithë ofruesit e pajisjeve të këtij lloji e dëshmojnë këtë. Megjithatë, shumë ofrues fillojnë të manipullojnë kur flitet për rënien e performancës kur aktivizohen moda të ndryshme të funksionimit të SXD-së.
NĂ« industrinĂ« tonĂ«, praktikisht Ă«shtĂ« e zakonshme tĂ« jepen SXD pĂ«r testim pĂ«r njĂ« ose dy ditĂ«. Ofruesi fillon njĂ« test 20-minutĂ«sh nĂ« njĂ« sistem tĂ« zbrazĂ«t, duke marrĂ« tregues tĂ« jashtĂ«zakonshĂ«m tĂ« performancĂ«s. NdĂ«rsa nĂ« shfrytĂ«zim tĂ« vĂ«rtetĂ«, dalin shpejt âkambanat e nĂ«nshkrimitâ. Pas njĂ« dite, vlerat e bukura tĂ« IOPS zvogĂ«lohen dyfih dhe trefish, dhe nĂ«se SXD mbushet deri nĂ« 80%, ato bĂ«hen edhe mĂ« tĂ« ulta. Aktivizimi i RAID 5 nĂ« vend tĂ« RAID 10 humb edhe 10-15%, dhe nĂ« modalitetin e metro-kllasterit performanca reduktohet gjithashtu pĂ«r gjysmĂ«.
Gjithçka qĂ« u pĂ«rmend mĂ« parĂ«, nuk ka tĂ« bĂ«jĂ« me Dorado V6. KlientĂ«t tanĂ« kanĂ« mundĂ«sinĂ« tĂ« fillojnĂ« njĂ« test tĂ« performancĂ«s pĂ«r fundjavĂ« ose tĂ« paktĂ«n pĂ«r njĂ« natĂ«. AtĂ«herĂ« dalin nĂ« pah mbledhjet e mbeturinave dhe bĂ«het e qartĂ« si aktivizimi i opsioneve tĂ« ndryshme â siç janĂ« snapshot-et dhe replikimi â ndikon nĂ« vlerĂ«n e arritshme tĂ« IOPS.
NĂ« Dorado V6, snapshot-et dhe RAID me paritet praktikisht nuk ndćœ±ćojnĂ« performancĂ«n (3â5% nĂ« vend tĂ« 10-15%). Proçesi i mbledhjes sĂ« mbetjeve (mbushja e qelizave tĂ« ruajtjes me zero), kompresimi, dhe deduplikimi nĂ« SAN tĂ« mbushur nĂ« 80% gjithmonĂ« do tĂ« ndikojnĂ« nĂ« shpejtĂ«sinĂ« e pĂ«rgjithshme tĂ« pĂ«rpunimit tĂ« kĂ«rkesave. Por Dorado V6 Ă«shtĂ« interesante sepse, çfarĂ«do kombinimi tĂ« funksioneve dhe mekanizmave mbrojtĂ«s qĂ« aktivizoni, performanca pĂ«rfundimtare e SAN nuk do tĂ« bjerĂ« nĂ«n 80% tĂ« treguesit tĂ« arritur pa ngarkesĂ«.

Balancimi i ngarkesës
Performanca e lartë e Dorado V6 arrihet përmes balansimit në çdo hap, konkretisht:
- multipassimit;
- përdorim të disa lidhjeve nga një host;
- prania e një fabrike frontend;
- ndarjes së punës së kontrolluesve të SAN;
- distribuimit të ngarkesës në të gjithë ruajtësit në nivelin RAID 2.0+.
Në parim, kjo është një praktikë e zakonshme. Sot, pak njerëz mbajnë të gjitha të dhënat në një LUN: të gjithë përpiqen të kenë, le të thonë, tetë, ose dyzet, dhe ndoshta edhe më shumë. Ky është një qasje e qartë dhe e duhur, që ne e përkrahim. Por nëse detyra juaj kërkon vetëm një LUN, që është më e lehtë për t'u menaxhuar, zgjidhjet tona arkitekturore lejojnë të arrijmë performancën 80% të disponueshme kur përdoren disa LUN.

Planifikimi dinamik i ngarkesës së procesorëve
Distribuimi i ngarkesës në procesorë kur përdoret një LUN është realizuar si më poshtë: detyrat akoma në nivelin e LUN ndahen në 'shard' të vogla, secila e caktuar në mënyrë të fortë për kontrollues të veçantë në 'motor'. Kjo është bërë për të siguruar që sistemi të mos humbasë performancën, ndërsa 'kërcen' me këtë copë të dhënash ndërmjet kontrolluesve të ndryshëm.
Një mekanizëm tjetër për ruajtjen e performancës së lartë është planifikimi dinamik, ku disa bërthama të procesorëve mund të ndahen për grupe të ndryshme detyrash. Për shembull, nëse sistemi aktualisht është në pritje në nivelin e deduplikimit dhe kompresimit, një pjesë e bërthamave mund të aktivizohet në procesin e shërbimit të hyrje-daljeve. Ose anasjelltas. Të gjitha këto kryhen automatikisht dhe në mënyrë transparente për përdoruesin.
Të dhënat mbi ngarkesën aktuale të secilit nga bërthamat Dorado V6 nuk shfaqen në ndërfaqen grafike, por përmes komandës mund të aksesoni sistemin operativ të kontrolluesit dhe të përdorni komandën e zakonshme linux. top.

Mbështetje për NVMe dhe RoCE
Siç është përmendur tashmë, në këtë moment Dorado V6 mbështet plotësisht NVMe mbi Fibre Channel «nga kutia» dhe nuk kërkon asnjë licencë. Në mes të vitit do të shfaqet mbështetje për modalitetin NVMe mbi Ethernet. Për ta përdorur atë në mënyrë efektive, do të nevojitet mbështetje Ethernet me qasje të drejtpërdrejtë në kujtesë (DMA) versioni v2.0 si nga vetë SCSI, ashtu edhe nga switch-et dhe adaptori të rrjetit. Për shembull, siç janë Mellanox ConnectX-4 ose ConnectX-5. Mund të përdoren edhe kartat e rrjetit të bazuara në çipet tona. Po ashtu, mbështetja RoCE duhet të realizohet në nivelin e sistemit operativ.
Në përgjithësi, ne e konsiderojmë Dorado V6 si një sistem të orientuar drejt NVMe. Pavarësisht nga mbështetja ekzistuese për Fibre Channel dhe iSCSI, planifikohet kalimi në Ethernet me shpejtësi të lartë me RDMA në të ardhmen.

Një shkas marketingu
Duke pasur parasysh se sistemi Dorado V6 ka një qëndrueshmëri të lartë ndaj gabimeve, shkallëzohet mirë horizontalisht, mbështet teknologji të ndryshme migrimi etj., efekti ekonomik i blerjes së tij shfaqet me fillimin e shfrytëzimit intensiv të SCSI. Ne do të përpiqemi të vazhdojmë ta bëjmë zotërimin e sistemit sa më fitimprurës, edhe nëse në fillim kjo nuk vihet re.
Në veçanti, ne kemi formuar programin FLASH EVER, i lidhur me zgjatjen e ciklit të jetës së SCSI dhe i destinuar për të lehtësuar sa më shumë klientin gjatë përmirësimeve.

Ky program përfshin një sërë masash:
- mundësia e zëvendësimit gradual të kontrolluesve dhe raftëve me disqe me versionet e reja pa zëvendësuar tërë pajisjen (për sistemet Dorado V6 të klasës hi-end);
- mundësia e ruajtjes federale (bashkimi i versioneve të ndryshme të Dorado si pjesë e një klasteri hibrid SCSI);
- virtualizimin inteligjent (mundësia e përdorimit të pajisjeve të palëve të treta si pjesë e zgjidhjes Dorado).

Duhet theksuar se situata e komplikuar në botë ka pasur një ndikim të vogël në perspektivat tregtare të sistemit të ri. Megjithëse lançimi zyrtar i Dorado V6 ishte vetëm në janar, ne po shohim një kërkesë të konsiderueshme për të në Kinë, si dhe një interes të madh nga partnerët rusë dhe ndërkombëtarë në fushën financiare dhe strukturat qeveritare.
Përveç të tjerash, lidhur me pandeminë, pavarësisht se sa do të zgjasë ajo, shfaqet një pyetje veçanërisht e mprehtë mbi sigurimin e punonjësve të distancuar me tavolina virtuale. Në këtë proces, Dorado V6 do të mund të ofronte zgjidhje për shumë probleme. Për këtë, ne po bëjmë të gjitha përpjekjet e nevojshme, përfshirë pothuajse arritjen e një marrëveshjeje për përfshirjen e sistemit të ri në listën e pajtueshmërisë të VMware.
***
Për më tepër, mos harroni për webinarët tanë të shumtë, të cilët zhvillohen jo vetëm në segmentin rusishtfolës, por edhe në nivel global. Lista e webinarëve për prillin është e disponueshme në .
Burimi: habr.com
