Spark schemaEvolution praktikas
Lugupeetud lugejad, head päeva! Selles artiklis kirjeldab Big Data Solutions ärisuuna juhtiv konsultant ettevõttes «Neoflex» põhjalikult muutuva struktuuriga vitriinide ehitamise võimalusi Apache Spark'iga. Andmete analüüsi projekti raames tõusetub sageli küsimus vitriinide loomise kohta halvasti struktureeritud andmete põhjal. Tüüpilised näited hõlmavad logisid või erinevate süsteemide vastuseid, mis on salvestatud JSON või XML formaadis. […]
