PistaDB 是什么?
PistaDB 是一个用纯 C99 编写、零外部依赖的轻量级嵌入式向量数据库。它以单个共享库的形式发布,所有数据都存放在一个 .pst 文件里。
它专为本地 RAG 管道、离线 AI 智能体、隐私敏感应用、边缘推理,以及一切不适合部署完整向量集群的场景而生——坦白说,大多数场景都是这样。
PistaDB 与云端 / 服务端向量数据库对比
| PistaDB | 云端 / 服务端向量数据库 | |
|---|---|---|
| 部署方式 | 复制一个 .dll / .so | Docker、Kubernetes、云订阅 |
| 存储结构 | 单个 .pst 文件 | 数据文件 + WAL + 配置 + 附属文件 |
| 数据隐私 | 全部数据留在本地 | 向量嵌入通过网络传输 |
| 内存占用 | 可配置,极小 | JVM / 运行时动辄数 GB |
| 外部依赖 | 无(纯 C99) | 数十个第三方包 |
| 查询延迟 | 笔记本上亚毫秒级 | 网络往返延迟 |
| 使用成本 | 永久免费(MIT) | 按查询次数或向量数量计费 |
适用场景
- 桌面应用:语义搜索不需要"打电话回家"。
- 移动端 RAG(Android 通过 JNI,iOS 通过 Swift Package Manager)。
- 边缘 / MCU 推理(实验性 ESP32 组件)。
- 嵌入式分析:嵌入到已有的 C/C++/Go/Rust 应用中。
- Notebook 原型阶段:决定是否真的需要集群之前先快速验证。
不适用场景
- 数千并发写入者的多租户 SaaS——用服务端数据库。
- 单机放不下的超大数据集——PistaDB 的目标是单文件 1000 万级,而非 100 亿级。
- 需要托管控制平面、复制或分布式共识的工作负载。
