PDF
duckdb教程
内容摘要
| 章节 | 核心内容 |
|---|---|
| 第1章 | DuckDB 本质、设计哲学、与 SQLite/PostgreSQL/pandas/Spark/ClickHouse 对比、适用与不适合场景 |
| 第2章 | 安装与运行:CLI、Python 绑定、持久化/内存模式、示例数据生成 |
| 第3章 | 交互界面:CLI 点命令、Python API、Node/Java/Go/Rust/C/WASM、ODBC/JDBC |
| 第4章 | Friendly SQL 语法糖:FROM-first、EXCLUDE/REPLACE/COLUMNS、GROUP BY ALL、QUALIFY、INSERT BY NAME、UNION BY NAME |
| 第5章 | 数据类型:数值、字符串、时间、BOOLEAN/NULL、ENUM/UUID、嵌套、JSON/VARIANT、类型转换 |
| 第6章 | 表、视图、Schema 管理:CTAS、约束、分区、元数据查询、为什么不用传统索引 |
| 第7章 | 查询基础:投影、过滤、排序、分页、NULL 陷阱、SARGable 原则 |
| 第8章 | 聚合与分组:FILTER、近似聚合、ROLLUP/CUBE、直方图、PIVOT/UNPIVOT |
| 第9章 | 连接与集合:INNER/LEFT/FULL、SEMI/ANTI、LATERAL、ASOF、POSITIONAL、UNION/INTERSECT/EXCEPT |
| 第10章 | CTE、递归 CTE、窗口函数、帧语义、QUALIFY、会话化、漏斗、同环比 |
| 第11章 | 嵌套数据类型:LIST、STRUCT、MAP、UNION、ARRAY、JSON/VARIANT、unnest 与聚合 |
| 第12章 | 读取外部文件:CSV、Parquet、JSON/NDJSON、Excel、Hive 分区、HTTP/S3、多文件合并 |
| 第13章 | 写出数据与 ETL:COPY TO、分区导出、EXPORT/IMPORT DATABASE、幂等 ETL 模式 |
| 第14章 | 挂载数据库与云存储:ATTACH、Secret、S3/R2/Azure/GCS、PostgreSQL/MySQL/SQLite 联邦查询 |
| 第15章 | Python 与 Arrow 生态:pandas/Polars/PyArrow 零拷贝、关系式 API、流式读取、Jupyter 工作流 |
| 第16章 | 执行引擎内部:列存、向量化、并行、Pipeline、Hash Join、Sort、Spill |
| 第17章 | EXPLAIN 与性能调优:EXPLAIN ANALYZE、配置项、慢查询改写、OOM 处理、存储布局优化 |
| 第18章 | 持久化、事务与并发:文件格式、WAL、Checkpoint、ACID、快照隔离、单写多读 |
| 第19章 | 扩展生态与自定义函数:INSTALL/LOAD、官方/社区扩展、SQL 宏、Python UDF |
| 第20章 | 生产实践与排错:三种架构、上线 checklist、常见错误速查、资源管理、版本升级、生产脚本模板 |
| 第21章/示例数据 | examples/00-seed.sql:生成 users、sales、events、trades 等确定性示例数据 |
| 第22章 | 实战案例集:17 个端到端案例 |
| 附录 | 速查手册:元数据、类型、函数、文件读写、ATTACH/Secret、配置、CLI、Python API、SQL 片段、性能清单、方言差异 |
在线预览
共 285 页,当前展示 20 页