Amazon a annoncé l'acquisition de DuckLabs, développeur du système de gestion de bases de données open source DuckDB. L'acquisition a été finalisée le 31 août et le montant de la transaction n'a pas été divulgué. L'équipe de développement de DuckDB rejoindra AWS et poursuivra le développement des technologies DuckDB sous la direction des cofondateurs de DuckLabs.
Les développements de DuckDB visent à moderniser, simplifier et optimiser l'efficacité de la suite d'outils analytiques proposée sur la plateforme AWS. Amazon S3 a vocation à devenir un service de stockage doté de fonctionnalités d'analyse de données intégrées. Le code source de DuckDB continuera d'être développé en tant que projet open source, distribué sous licence MIT et géré par la fondation à but non lucratif DuckDB Foundation. L'intégration à AWS permettra à DuckDB d'accroître sa base d'utilisateurs et de bénéficier de ressources supplémentaires pour la mise en œuvre de nouvelles solutions de mise à l'échelle.
Le SGBD DuckDB est conceptuellement similaire à SQLite et combine des fonctionnalités telles que la compacité, la prise en charge des bibliothèques intégrables, le stockage de données dans un seul fichier et une interface en ligne de commande, avec des capacités et des optimisations pour l'exécution de requêtes analytiques portant sur une part importante des données stockées, comme l'agrégation du contenu complet des tables ou la fusion de plusieurs tables volumineuses. Ce SGBD prend en charge un dialecte étendu du langage SQL, incluant des fonctionnalités supplémentaires pour le traitement de requêtes complexes, longues et imbriquées.
Le projet utilise un shell de SQLite, un analyseur de PostgreSQL, un composant Date Math de MonetDB, sa propre implémentation de fonctions de fenêtre (basée sur l'algorithme Segment Tree Aggregation), un processeur d'expressions régulières basé sur la bibliothèque RE2, son propre optimiseur de requêtes, un mécanisme MVCC de gestion de l'exécution simultanée de tâches (Multi-Version Concurrency Control) et un moteur d'exécution de requêtes vectorisées basé sur l'algorithme Hyper-Pipelining Query Execution, qui permet de traiter de grands ensembles de valeurs en une seule opération.
Source: opennet.ru
