Jak zorganizowaliśmy wysoko wydajny i niedrogi DataLake oraz dlaczego właśnie w ten sposób
Żyjemy w niesamowitym czasie, kiedy można szybko i łatwo połączyć kilka gotowych narzędzi open source, skonfigurować je z „wyłączonym umysłem” według porad z stackoverflow, nie wgłębiając się w „wielkie słowa”, i uruchomić w eksploatacji komercyjnej. A kiedy zajdzie potrzeba aktualizacji/rozszerzenia lub ktoś przypadkowo zrestartuje kilka maszyn — uświadomimy sobie, że zaczyna się jakiś natrętny zły sen na jawie, wszystko nagle skomplikowało się do […]
