SurfSense

活跃
GitHub Python NOASSERTION

简介

SurfSense 是一个把网页搜索与个人知识库结合的 RAG 工具,让 AI 引用经过用户收藏和批注的网络资料回答问题。

核心特性

  • Web 收藏 — 把网页/PDF 拖进知识库,自动建立索引
  • 语义检索 — 用自然语言搜索自己的收藏与笔记
  • RAG 问答 — 直接与收藏库对话并给出引用
  • 多源支持 — 网页、PDF、Notion、Bookmarks 统一入库
  • 本地部署 — 知识与索引默认本地化
  • 浏览器扩展 — Chrome/Firefox 一键收藏

适用场景

💡 构建可被引用的个人研究知识库
💡 为 Agent 提供私有可信的外部信息源
💡 把碎片化的资料整理为可检索的第二大脑
💡 为产品/竞品研究提供基于个人收藏的问答

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(15.9k stars)
  • 项目有一定历史沉淀(已维护 2 年)
  • Issue 响应及时,积压少

⚠️ 不足

  • 缺少明确的开源许可证

快速开始

docker run -d -p 8080:8080 \
  -e OPENAI_API_KEY=sk-... \
  surfsense/app:latest

相关项目

Graphiti

30.0k · Python
活跃 A+

Graphiti 是面向 Agent 记忆的时序知识图谱引擎,帮助系统持续沉淀长期上下文。

memoryknowledge-graphrag +1
  • · 时序事实管理 — 每个事实具有时间窗口,旧事实被失效而非删除,可查询当前或历史任意时刻的真实状态
  • · 溯源与血缘追踪 — 每个实体和关系追溯到产生它的原始数据(Episodes),完整的推导事实到数据源的血缘
  • · 混合检索 — 结合语义嵌入、关键词 BM25 和图遍历实现低延迟高精度查询,无需依赖 LLM 摘要

Mem0

63.4k · Python
活跃 A+

Mem0 是面向 AI Agent 的长期记忆层,支持跨会话记忆管理与个性化上下文检索。

memoryragpersonalization +1
  • · 多层级记忆 — 无缝管理用户级、会话级和 Agent 级三层记忆状态,支持自适应个性化
  • · 单次 ADD 提取 — 一次 LLM 调用完成记忆提取,无 UPDATE/DELETE,记忆只累积不覆盖
  • · 实体链接 — 提取实体并跨记忆嵌入链接,提升检索准确性