Come abbiamo organizzato un DataLake altamente efficiente ed economico e perché proprio in questo modo
Viviamo un periodo straordinario in cui è possibile collegare rapidamente e facilmente diversi strumenti open source, configurarli con un "cervello spento" seguendo i consigli di stackoverflow, senza approfondire "lunghe lettere", e lancerli in produzione commerciale. E quando sarà necessario aggiornare/espandere o qualcuno riavvierà accidentalmente un paio di macchine, ci si renderà conto che è iniziato un qualche tipo di incubo regressivo, tutto si è complicato fino a […]
