Hapet OpenXLA, një mjet për optimizim dhe kompilim të modeleve të mësimit të makinerive

Kompani të mëdha që merren me zhvillimin në fushën e mësimit të makinerive kanë paraqitur projektin OpenXLA, i cili synon zhvillimin e përbashkët të mjeteve për kompilimin dhe optimizimin e modeleve për sistemet e mësimit të makinerive. Nën mbrojtjen e projektit, u transferua zhvillimi i mjeteve që lejojnë unifikimin e kompilimit të modeleve, të përgatitura në kornizat TensorFlow, PyTorch dhe JAX, për trajnim dhe ekzekutim efikas në GPU të ndryshëm dhe përshpejtues të specializuar. Në këtë projekt janë angazhuar kompani si Google, NVIDIA, AMD, Intel, Meta, Apple, Arm, Alibaba dhe Amazon.

Pritet që falë bashkimit të përpjekjeve të ekipeve lider për hulumtim dhe përfaqësuesve të komunitetit të arrihet të stimulohet zhvillimi i sistemeve të mësimit të makinerive dhe të zgjidhet problemi i fragmentimit të infrastrukturës për kornizat dhe pajisjet e ndryshme. OpenXLA lejon realizimin e mbështetjes efektive për pajisje të ndryshme, pa marrë parasysh se mbi cilën kornizë është ndërtuar modeli i mësimit të makinerive. Pritet që me OpenXLA të arrihet të reduktohet koha e trajnimit të modeleve, të rritet kapaciteti i kalimit, të zvogëlohen vonesat, të ulen kostot për burimet kompjuterike dhe të shkurtohet koha e nxjerrjes së produktit në treg.

Hapet OpenXLA, një mjet për optimizim dhe kompilim të modeleve të mësimit të makinerive

OpenXLA përbëhet nga tre komponentë kryesorë, kodi i të cilëve shpërndahet nën licencën Apache 2.0:

  • XLA (Accelerated Linear Algebra) — njĂ« kompajler qĂ« lejon optimizimin e modeleve tĂ« mĂ«simit tĂ« makinerive pĂ«r ekzekutimin e lartĂ« nĂ« platforma tĂ« ndryshme harduerike, duke pĂ«rfshirĂ« GPU, CPU dhe pĂ«rshpejtues tĂ« specializuar nga prodhues tĂ« ndryshĂ«m.
  • StableHLO — specifikimi dhe implementimi bazĂ« i njĂ« grupi operacioneve me nivel tĂ« lartĂ« (HLO, High-Level Operations) pĂ«r t’u pĂ«rdorur nĂ« modelet e sistemeve tĂ« mĂ«simit tĂ« makinerive. Vepron si njĂ« ndĂ«rfaqe midis kornizave tĂ« mĂ«simit tĂ« makinerive dhe kompajlerĂ«ve qĂ« ndĂ«rrjnĂ« modelin pĂ«r ekzekutim nĂ« harduerin specifik. NdĂ«rfaqet pĂ«r gjenerimin e modeleve nĂ« formatin StableHLO janĂ« pĂ«rgatitur pĂ«r kornizat PyTorch, TensorFlow dhe JAX. Si bazĂ« pĂ«r StableHLO Ă«shtĂ« pĂ«rdorur grupi MHLO, i cili Ă«shtĂ« zgjeruar me mbĂ«shtetje pĂ«r serializimin dhe versionimin.
  • IREE (Mjedisi i Ekzekutimit tĂ« PĂ«rfaqĂ«simit tĂ« MesĂ«m) — njĂ« kompilator dhe runtime qĂ« transformon modelet e mĂ«simit tĂ« makinerive nĂ« njĂ« pĂ«rfaqĂ«sim tĂ« pĂ«rbashkĂ«t tĂ« ndĂ«rmjetĂ«m, tĂ« bazuar nĂ« formatin MLIR (PĂ«rfaqĂ«simi NdĂ«rmjetĂ«s nĂ« Nivel tĂ« ShumĂ«fishtĂ«) nga projekti LLVM. Pjesa dalluese Ă«shtĂ« mundĂ«sia e kompilimit paraprak (ahead-of-time), mbĂ«shtetje pĂ«r menaxhimin e rrjedhĂ«s, mundĂ«sia e pĂ«rdorimit tĂ« elementeve dinamike nĂ« modele, optimizimi pĂ«r CPU dhe GPU tĂ« ndryshme, dhe shpenzime tĂ« ulĂ«ta tĂ« mbĂ«shtetjes.

Përfitimet kryesore të instrumentit OpenXLA:

  • Arrihni performancĂ«n optimale pa qenĂ« e nevojshme tĂ« thellohem nĂ« shkrimin e kodit tĂ« specializuar pĂ«r pajisje tĂ« caktuara. Ofrimi i optimizimeve tĂ« gatshme, qĂ« pĂ«rfshijnĂ« thjeshtimin e shprehjeve algebraike, vendosjen efikase nĂ« memorie, planifikimin e ekzekutimit duke marrĂ« parasysh reduktimin e pikĂ«ve maksimale tĂ« konsumit tĂ« memories dhe mbingarkesave.
  • Thjeshtimi i skalimit dhe paralelizimit tĂ« llogaritjeve. Programuesi duhet vetĂ«m tĂ« shtojĂ« annotimet pĂ«r njĂ« nĂ«ngrup kritik tĂ« tensoreve, mbi tĂ« cilat kompilatori mund tĂ« gjenerojĂ« automatikisht kodin pĂ«r llogaritje paralele.
  • Sigurimi i portabilitetit pĂ«rmes mbĂ«shtetjes sĂ« platformave tĂ« ndryshme harduerike, si GPU AMD dhe NVIDIA, CPU tĂ« bazuara nĂ« arkitekturĂ«n x86 dhe ARM, pĂ«rshpejtuesit ML TPU tĂ« Google, IPU AWS Trainium Inferentia, Graphcore dhe Cerebras Wafer-Scale Engine.
  • MbĂ«shtetje pĂ«r lidhjen e zgjerimeve me implementimin e mundĂ«sive tĂ« tjera, si mbĂ«shtetje pĂ«r shkrimin e primitiveve tĂ« mĂ«simit tĂ« thellĂ« me pĂ«rdorimin e CUDA, HIP, SYCL, Triton dhe gjuhĂ«ve tĂ« tjera pĂ«r llogaritjet paralele. MundĂ«sia e rregullimit manual tĂ« ngushticave nĂ« modele.

Burimi: opennet.ru

Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS đŸ”„ Blini hosting tĂ« besueshĂ«m pĂ«r faqe interneti me mbrojtje nga DDoS, serverĂ« VPS VDS | ProHoster