zvec

活跃
GitHub C++ Apache-2.0

简介

阿里巴巴开源的轻量级高性能进程内向量数据库,采用 C++ 核心实现,支持 Node.js 和 Python 绑定,适用于 RAG、Agent 记忆和向量检索场景。

核心特性

  • 极速进程内向量数据库,毫秒级搜索数十亿向量
  • 支持稠密和稀疏向量,单次调用原生支持多向量查询
  • 混合搜索结合语义相似度和结构化过滤器,实现精准检索
  • 通过 WAL 预写日志实现持久化存储,崩溃后数据不丢失
  • 提供 Python 和 Node.js 绑定,简单 pip/npm 安装,零配置零服务器
  • 经过阿里巴巴集团生产验证,具备生产级低延迟相似度搜索能力

适用场景

💡 RAG(检索增强生成)管道中的向量嵌入检索
💡 Agent 长期对话上下文的记忆存储和检索
💡 边缘设备、笔记本和服务器应用中的实时相似度搜索
💡 结合文本、图像和音频向量的多模态嵌入搜索

快速开始

通过 pip 安装:`pip install zvec`(Python 3.10-3.14)或 npm:`npm install @zvec/zvec`。定义 schema,创建集合,插入带向量的文档,运行相似度查询。示例:`collection.query(zvec.VectorQuery("embedding", vector=[0.4,0.3,0.3,0.1]), topk=10)`。

相关项目