Pas një vit e gjysmë zhvillimi, organizata Apache Software Foundation lëshimi , një platformë e lirë për organizimin e përpunimit të shpërndarë të sasisë së madhe të të dhënave duke përdorur paradigmat , ku detyra ndahet në shumë fragmente më të vogla të izoluara, secila prej të cilave mund të ekzekutohet në një nyje të veçantë të klastri. Shtylla e bazuar në Hadoop mund të përfshijë mijëra nyje dhe të përmbajë eksabajt të dhënash.
Në përbërje të Hadoop është implementimi i sistemit të skedarëve të shpërndarë Hadoop Distributed Filesystem (HDFS), i cili automatikisht siguron rezervimin e të dhënave dhe është optimizuar për aplikacionet e MapReduce. Për të thjeshtuar qasjen në të dhëna në depo të Hadoop, është krijuar DB HBase dhe një gjuhë sipas SQL, të cilën e quajmë Pig, e cila është një lloj SQL për MapReduce, ku kërkesat mund të paralelizohen dhe të përpunohen nga disa platforma Hadoop. Projekti vlerësohet si plotësisht i stabilizuar dhe i gatshëm për përdorim industrisë. Hadoop përdoret aktivisht në projekte të mëdha industriale, duke ofruar mundësi të ngjashme me platformën Google Bigtable/GFS/MapReduce, ndërsa kompania Google zyrtarisht Hadoop dhe projekte të tjera Apache të drejtën për të përdorur teknologjitë, për të cilat zbatohen patentet, të lidhura me metodën MapReduce.
Hadoop renditet i pari në mesin e depot Apache për numrin e ndryshimeve të paraqitura dhe i pesti për madhësinë e bazës së kodit (rreth 4 milionë rreshta kodi). Disa nga përdorimet e mëdha të Hadoop përfshijnë depozitimet e Netflix (në të cilat ruhet më shumë se 500 miliardë ngjarje në ditë), Twitter (një klasër prej 10 mijë nyjesh në kohë reale ruan më shumë se një zetabajt të dhënash dhe përpunon më shumë se 5 miliardë seanca në ditë), Facebook (një klasër prej 4 mijë nyjesh ruan më shumë se 300 petabajt dhe rritet çdo ditë me 4 PB).
Ndryshimet kryesore në Apache Hadoop 3.3:
- U shtua mbështetje për platformat mbi bazën e arkitekturës ARM.
- Implementimi i formatit (Protocol buffers), e përdorur për serializimin e të dhënave të strukturuara, u përditësua në lëshimin 3.7.1 për shkak të mbarimit të ciklit të jetës së degës protobuf-2.5.0.
- Janë zgjeruar mundësitë e lidhësit S3A: u shtua mbështetje për autentifikimin me anë të tokenëve (), përmirësuar mbështetje për caching të përgjigjeve me kod 404, rritur performancën e S3guard dhe përmirësuar besueshmërinë e funksionimit.
- Në sistemin e skedarëve ABFS, janë zgjidhur problemet me tuningun automatik.
- U shtua mbështetje e integruar për sistemin e skedarëve Tencent Cloud COS për qasjen në depozitat objektive COS.
- U shtua mbështetje e plotë për Java 11.
- U stabilizua implementimi i HDFS RBF (Router-based Federation). Në Router-in e HDFS u shtuan mjete për menaxhimin e sigurisë.
- U shtua shërbimi i DNS Resolution për identifikimin nga klienti të serverëve përmes DNS nëpërmjet emrave të nyjeve, duke lejuar shmangien e listimit të të gjitha hosteve në konfigurime.
- U shtua mbështetje për planifikimin e lançimit nëpërmjet menaxherit të centralizuar të burimeve (ResourceManager), duke përfshirë mundësinë e shpërndarjes së kontejnerëve duke marrë parasysh ngarkesën e secilës nyje.
- U shtua katalogu i aplikacioneve YARN (Yet Another Resource Negotiator) me mundësi kërkimi.
Burimi: opennet.ru
