Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Tema e qëndrueshmërisë në sistemet e ruajtjes së të dhënave është gjithmonë aktuale, sepse në epokën tonë të virtualizimit universalis dhe konsolidimit të burimeve, ruajtja e të dhënave është ajo pikë, rënia e së cilës do të çojë jo vetëm në një aksident të zakonshëm, por në ndërprerje të zgjatura të shërbimeve. Prandaj, ruajtjet e të dhënave moderne përmbajnë shumë komponente të dyfishta (deri në kontrolluesit). Por, a është e mjaftueshme kjo mbrojtje?

Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Të gjithë furnizuesit, duke përmendur karakteristikat e ruajtjeve të të dhënave, patjetër që përmendin qëndrueshmërinë e lartë të zgjidhjeve të tyre, duke shtuar domosdoshmërisht termin "pa asnjë pikë dështimi". Le të hedhim një sy më të afërt në një sistem tipik ruajtjeje të të dhënave. Për të përjashtuar ndërprerjet gjatë mirëmbajtjes, në ruajtjet e të dhënave dyfishohen blloqet e energjisë, modulat e ftohjes, portet hyrëse/dale, ruajtësit (duam të themi RAID) dhe natyrisht, kontrolluesit. Nëse e shikoni me kujdes këtë arkitekturë, mund të vëreni të paktën dy pika potenciale dështimi, për të cilat flitet me kujdes:

  1. Prania e një buekplemesi të vetëm (backplane)
  2. Prania e një kopjeje të të dhënave

Backplane është një pajisje teknike e komplikuar, e cila patjetër i nënshtrohet një testi të rëndësishëm gjatë prodhimit. Prandaj, raste të tilla kur ajo prishen plotësisht janë shumë të rralla. Megjithatë, edhe në rast të defekteve të pjesshme, siç është një vend i papunë i ruajtësit, do të nevojitet zëvendësimi i tij me një fikje të plotë të ruajtjes së të dhënave.

Krijimi i disa kopjeve të të dhënave gjithashtu në shikim të parë nuk është një problem. Për shembull, funksionaliteti Clone në ruajtjet e të dhënave, që lejon përditësimin me një periudhë të caktuar të një kopjeje të plotë të të dhënave, është mjaft i zakonshëm. Megjithatë, në rast të problemeve me të njëjtin backplane, kopja do të jetë po aq e pamundur të arrihet sa origjinali.

Një zgjidhje e qartë për të tejkaluar këto mangësi është replikimi në një sistem tjetër të ruajtjes së të dhënave. Nëse mbyllim sytë për rritjen e pritur të kostos së pajisjeve (përballë këtij vendimi, supozojmë se ata që zgjedhin të tillë janë të vetëdijshëm dhe e pranojnë këtë fakt), do të mbeten akoma shpenzime të tjera për organizimin e replikimit, përfshirë licencat, software dhe hardware shtesë. Gjithashtu, është e domosdoshme të sigurohet ndonjë mënyrë për qëndrueshmërinë e të dhënave të replikueshme. Domethënë, ndërtimi i një virtualizuesi të ruajtjes së të dhënave / vSAN / dhe etj., që gjithashtu kërkon resurset financiare dhe ato të kohës.

AccelStor kur krijuam sistemet tona High Availability, synuam të eliminojmë mangësitë e përmendura më sipër. Kështu lindi interpretimi i teknologjisë Shared Nothing, që në një përkthim të lirë do të thotë "pa përdorimin e pajisjeve të përbashkëta".

Koncepci Shared Nothing arkitektura përfshin përdorimin e dy nodave të pavarura (kontrollerë), secila prej të cilave ka setin e vet të dhënash. Ndërmjet nodave realizohet replikimi sinxhor nëpërmjet një interface InfiniBand 56G në mënyrë tërësisht transparente për software-in që funksionon mbi sistemin e ruajtjes. Si rezultat, nuk kërkohet përdorimi i virtualizuesve të ruajtjes së të dhënave, agentëve softuerikë etj.

Zgjidhja fizikisht dy-nodale nga AccelStor mund të realizohet në dy modele:

  • H510 — mbi bazĂ«n e serverĂ«ve Twin nĂ« kabinĂ« 2U, nĂ«se kĂ«rkohet performancĂ« tĂ« moderuar dhe kapacitet deri nĂ« 22TB;
  • H710 — mbi bazĂ«n e serverĂ«ve tĂ« veçantĂ« 2U, nĂ«se kĂ«rkohet performancĂ« e lartĂ« dhe kapacitet i madh (deri nĂ« 57TB).

Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Modeli H510 mbi bazën e serverit Twin

Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Modeli H710 mbi bazën e serverëve të veçantë

Përdorimi i formateve të ndryshme është i nevojshëm për numrin e ndryshëm të SSD-ve për të arritur kapacitetin dhe performancën e caktuar. Përveç kësaj, platforma Twin është më e lirë dhe lejon ofrimin e zgjidhjeve më të përballueshme, megjithëse me një "mangësi" të kushtuar në formën e një blloku backend të vetëm. Të gjitha gjëra të tjera, duke përfshirë parimet e punës, janë identike për të dy modelet.

Grupi i tĂ« dhĂ«nave nĂ« çdo nod ka dy grupe FlexiRemap, plus 2 hot spare. Çdo grup Ă«shtĂ« i aftĂ« tĂ« mbajĂ« dĂ«shtimin e njĂ« SSD. TĂ« gjitha kĂ«rkesat e ardhshme pĂ«r shk writing regjistrohen nga nodi nĂ« pĂ«rputhje me ideologjinĂ« FlexiRemap reorganizes data into sequential chains with 4KB blocks, which are then written to SSDs in the most optimal manner for them (sequential write). Moreover, the host receives write confirmation only after the data is physically placed on the SSD, meaning there is no caching in RAM. As a result, an impressive performance of up to 600K IOPS for writes and 1M+ IOPS for reads (model H710) is achieved.

As previously mentioned, data set synchronization occurs in real-time over the InfiniBand 56G interface, which has high bandwidth and low latency. To maximize the efficiency of the communication channel when transmitting small packets, a dedicated 1GbE link is used for additional heartbeat verification since there is only one communication channel. Only heartbeat signals are transmitted through it, so there are no specific speed requirements.

In the case of increasing the system's capacity (up to 400+ TB) due to rafteve të zgjerimit they are also connected in pairs to adhere to the concept of 'no single point of failure.'

For additional data protection (besides the fact that AccelStor already has two copies), a special algorithm is used to handle the failure of any SSD. If an SSD fails, the node will start rebuilding the data onto one of the hot spare drives. The FlexiRemap group, which is in a degraded state, will switch to read-only mode. This is done to eliminate interference from write operations and rebuilding on the spare drive, which ultimately speeds up the recovery process and reduces the time during which the system is potentially vulnerable. Once the rebuilding is complete, the node returns to normal read-write operation.

Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Of course, like other systems, overall performance decreases during rebuilding (since one of the FlexiRemap groups is not functioning for writes). However, the recovery process occurs as quickly as possible, which distinguishes AccelStor systems favorably from solutions offered by other vendors.

Another useful feature of the Nothing Shared technology is the true active-active mode of node operation. Unlike the 'classic' architecture, where a specific volume/pool is owned by only one controller while the second simply handles input/output operations, in these systems AccelStor Çdo nyje punon me grupin e saj tĂ« tĂ« dhĂ«nave dhe nuk i transmeton kĂ«rkesat "mikut". Si rezultat, pĂ«rmirĂ«sohet performanca e pĂ«rgjithshme e sistemit pĂ«rmes pĂ«rpunimit paralel tĂ« kĂ«rkesave tĂ« hyrjes/daljes nga nyjet dhe aksesit nĂ« ruajtĂ«s. Po ashtu, koncepti i failover-it nĂ« fakt Ă«shtĂ« i paekzistueshĂ«m, pasi nuk ka nevojĂ« pĂ«r tĂ« kaluar kontrollin mbi volumet te njĂ« nyje tjetĂ«r nĂ« rast dĂ«shtimi.

NĂ«se e krahasojmĂ« teknologjinĂ« Nothing Shared tĂ« arkitekturĂ«s me njĂ« kopjim tĂ« plotĂ« tĂ« SÇD, ajo herĂ« pas here do tĂ« duket se Ă«shtĂ« paksa mĂ« e ulĂ«t nĂ« fleksibilitet nĂ« krahasim me njĂ« realizim tĂ« plotĂ« tĂ« rikuperimit nga fatkeqĂ«sitĂ«. Kjo Ă«shtĂ« veçanĂ«risht e vĂ«rtetĂ« pĂ«r organizimin e linjĂ«s sĂ« komunikimit midis sistemeve tĂ« ruajtjes. KĂ«shtu, nĂ« modelin H710 Ă«shtĂ« e mundur tĂ« shpĂ«rndahen nyjet deri nĂ« 100 m pĂ«rmes pĂ«rdorimit tĂ« kabllove aktive optike InfiniBand, tĂ« cilat nuk janĂ« tĂ« lira. Por edhe nĂ« krahasim me realizimin e zakonshĂ«m tĂ« replikimit sinkron nga ofrues tĂ« tjerĂ« pĂ«rmes FibreChannel, edhe nĂ« distanca mĂ« tĂ« mĂ«dha, zgjidhja e AccelStor do tĂ« rezultojĂ« mĂ« e lirĂ« dhe mĂ« e lehtĂ« pĂ«r instalim/pĂ«rdorim, pasi nuk ka nevojĂ« pĂ«r instalimin e virtualizuesve tĂ« SÇD dhe/ose pĂ«r integrimin me softuerin (çka nuk Ă«shtĂ« gjithmonĂ« e mundur nĂ« parim). Plus, mos harrojmĂ« se zgjidhjet AccelStor janĂ« tĂ« gjitha nckjimeve Flash me performancĂ« mĂ« tĂ« lartĂ« se "SÇD" klasike me SSD vetĂ«m.

Reduktimi i rreziqeve të downtime falë arkitekturës Shared Nothing

Duke përdorur teknologjinë Nothing Shared të arkitekturës së AccelStor, është realisht e mundur të arrihet një disponueshmëri e sistemit të ruajtjes në nivelin 99.9999% për një kosto të arsyeshme. Së bashku me besueshmërinë e lartë të zgjidhjes, duke përfshirë përdorimin e dy kopjeve të të dhënave, dhe performancën mbresëlënëse për shkak të algoritmeve të markës. FlexiRemap, zgjidhjet nga AccelStor janë kandidate të shkëlqyera për pozita kyçe në ndërtimin e një dataqendre moderne.

Burimi: habr.com

Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster