Come abbiamo organizzato un DataLake altamente efficace e a basso costo e perché lo abbiamo fatto in questo modo
Viviamo in un periodo straordinario, in cui è possibile integrare rapidamente e facilmente diversi strumenti open source, configurarli con 'coscienza spenta' seguendo i consigli di stackoverflow, senza approfondire i 'mille termini', e lanciarli in produzione. Ma quando sarà necessario aggiornare/espandere o se qualcuno riavvierà accidentalmente alcune macchine, ci si renderà conto che è iniziato un incubo palpabile, e tutto è diventato drasticamente più complesso […]
