Skip to content

PistaDB 是什么?

PistaDB 是一个用纯 C99 编写、零外部依赖的轻量级嵌入式向量数据库。它以单个共享库的形式发布,所有数据都存放在一个 .pst 文件里。

它专为本地 RAG 管道、离线 AI 智能体、隐私敏感应用、边缘推理,以及一切不适合部署完整向量集群的场景而生——坦白说,大多数场景都是这样。

PistaDB 与云端 / 服务端向量数据库对比

PistaDB云端 / 服务端向量数据库
部署方式复制一个 .dll / .soDocker、Kubernetes、云订阅
存储结构单个 .pst 文件数据文件 + WAL + 配置 + 附属文件
数据隐私全部数据留在本地向量嵌入通过网络传输
内存占用可配置,极小JVM / 运行时动辄数 GB
外部依赖无(纯 C99)数十个第三方包
查询延迟笔记本上亚毫秒级网络往返延迟
使用成本永久免费(MIT)按查询次数或向量数量计费

适用场景

  • 桌面应用:语义搜索不需要"打电话回家"。
  • 移动端 RAG(Android 通过 JNI,iOS 通过 Swift Package Manager)。
  • 边缘 / MCU 推理(实验性 ESP32 组件)。
  • 嵌入式分析:嵌入到已有的 C/C++/Go/Rust 应用中。
  • Notebook 原型阶段:决定是否真的需要集群之前先快速验证。

不适用场景

  • 数千并发写入者的多租户 SaaS——用服务端数据库。
  • 单机放不下的超大数据集——PistaDB 的目标是单文件 1000 万级,而非 100 亿级。
  • 需要托管控制平面、复制或分布式共识的工作负载。

下一步

  • 快速开始——60 秒完成安装并运行第一次查询。
  • 索引算法——为你的工作负载挑选合适的索引。
  • 多模态检索——一条记录挂多个 vector 字段 + RRF 混合搜索。
  • 语言绑定——Python、Go、Rust、Swift、Kotlin、C# 等。

基于 MIT 协议发布