DuckDB lance DuckLake, format lakehouse

Original : DuckDB Ducklake

Pourquoi c'est important

DuckLake peut démocratiser le lakehouse pour les équipes sans infra Spark.

DuckDB publie DuckLake sur GitHub, un format open-source de lakehouse conçu pour gérer des données analytiques directement via DuckDB, sans infrastructure complexe.

DuckDB, le moteur analytique in-process devenu référence dans l'écosystème data, publie DuckLake sur GitHub. Il s'agit d'un format de type lakehouse — combinant stockage fichier et couche métadonnées transactionnelle — pensé pour fonctionner nativement avec DuckDB. L'idée : offrir une alternative légère aux solutions comme Apache Iceberg ou Delta Lake, sans dépendre d'un cluster Spark ou d'un service cloud dédié. DuckLake s'appuie sur les capacités SQL de DuckDB pour gérer les métadonnées, les transactions ACID et l'évolution de schéma directement depuis le moteur local. Le projet est open-source, hébergé sous l'organisation officielle DuckDB sur GitHub. Les détails techniques complets (formats de fichiers, API, compatibilité) restent à confirmer via la documentation du dépôt.

Source

github.com — Lire l'original →