Diffusion en continu de données de colonnes avec Apache Arrow
La traduction de cet article a été préparée spécialement pour les étudiants du cours « Data Engineer ». Au cours des dernières semaines, avec Nong Li, nous avons ajouté un format binaire de flux à Apache Arrow, complétant le format de fichiers d'accès aléatoire/IPC déjà existant. Nous avons des implémentations en Java et C++, ainsi que des liaisons Python. Dans cet article, je vais expliquer comment fonctionne le format et montrer comment on peut y parvenir […]
