DuckDB v2.0 预览:化身服务器,性能狂飙
A Preview of DuckDB v2.0
DuckDB v2.0 代号 Cyanoptera 即将发布,标志着从湖仓之年迈向 DuckDB 作为服务器之年。此次更新不仅是版本号的提升,更带来了全新的 SQL 解析器、默认存储格式以及经过重构的 C API。核心亮点包括通过 quack 扩展实现的客户端/服务器模式,让 DuckDB 能够像 PostgreSQL 一样处理多租户部署;VARIANT 类型升级为一级公民,实现半结构化数据的高效存储与查询;原生支持触发器、异步 I/O 以及更强大的 SQL 方言特性。性能方面,递归 CTE 查询速度提升约 40 倍,存储格式优化让大表索引加载瞬间完成。这不仅是功能的堆砌,更是 DuckDB 向企业级服务架构迈出的关键一步。
去年是湖仓之年,而这次发布开启了 DuckDB 作为服务器之年。
HN 评论区
19- otter-in-a-suit
对 Quack 超级兴奋(部分原因确实是这个名字)。我既用 DuckDB 做分析也做运行时处理,但我确实需要像管理运行时产物一样去服务/处理/管理一个巨大的、多 GiB 的 duckdb 文件 [1]。我知道这并非完美的数据库方案,但它速度快、支持空间数据、编程接口合理、与 dbt 集成极佳,而且我可以用同一个工具完成从“运行包含数百个步骤的巨大 dbt 流水线”到“查询该流水线的输出”,再到“读取/查询磁盘上的 csv 文件”的所有操作,这实在太棒了。如果我能像管理传统数据库那样集中管理该资源,我会非常开心。
我通过为数据流水线中的不同步骤使用独立的数据库部分解决了这个问题,甚至尝试过用 Clickhouse 作为完全替代品,但我实在太喜欢 DuckDB 的太多东西了,无法替换它。
[1]: 如果你感兴趣:https://skaldmaps.com/blog/2026/07/zip-codes-are-a-bad-spati...
- jtbaker
DuckDB 是我很久以来最期待的项目之一。自 2023 年以来,我在三家公司的项目中引入了它,极大地降低了资源需求,并在各种环境中运行它。仅凭能够在低端消费级硬件上处理超出内存大小的数据(out of core),这一点就令人惊叹。
感谢团队的付出!
- therealdrag0
> 仓库是一个名称、一个 URL 前缀以及一个或多个受信任的 RSA 公钥,用于对从该仓库提供的扩展进行签名。
现在请求 Hannes 和 Mark 让我们改用类似 minisign 的方案而不是 RSA,是不是太晚了?:)
非常期待 2.0 版本,恭喜大家!
- dm03514
虽然不想提这个,但不到 6 个月就有 10,000 次提交,这数量太多了。AI 是其中的主要贡献者吗?
对于像 DuckDB 这样备受喜爱的工具,利用 AI 加速开发是否足以平息那些 lingering 的怀疑者?
- gw32
如果你喜欢 DuckDB,请考虑资助数据库研究 [1]!