DuckDB
面向进程内分析的列式数据库,可直接查询 Parquet、CSV、JSON 和 Arrow 数据。
数据模型分析型 · 嵌入式 OLAP
查询接口接近 PostgreSQL 的分析 SQL,提供丰富文件扫描、列表和结构体函数
许可证MIT
浏览器 Live正式支持
模型与查询语言
数据表达
关系模型、向量化列式执行和嵌套类型;强调本地数据分析。
查询方式
接近 PostgreSQL 的分析 SQL,提供丰富文件扫描、列表和结构体函数。
事务、索引与扩展
事务与一致性
- 单进程内 ACID
- 面向批量分析而非高并发 OLTP
- 查询在连接上顺序执行
索引与查询优化
- 自适应基数树索引
- 列式统计信息和跳过扫描
- 性能重点通常是向量化与文件裁剪
复制、分片与扩展
- 单节点垂直扩展
- 直接处理对象存储和本地文件
- 不提供分布式协调服务
部署形态
- Python/R/Node/Java 等进程内客户端
- CLI 与服务封装
- 官方 DuckDB-Wasm 浏览器运行时
适用边界
适合
- 本地数据探索与 Notebook
- 浏览器内 CSV/Parquet 分析
- 数据管道中的嵌入式转换
限制
- 不适合大量并发短事务
- 浏览器受内存、线程和 CORS 约束
- 不是共享业务主库
选型建议:分析数据就在文件或当前进程中,并且不值得部署数据仓库服务时优先 DuckDB。
页面内 Live 实验
当前产品具有正式浏览器运行环境。直接修改查询并运行,不需要复制到其他页面。