DocsGPT

活跃
GitHub Python MIT

简介

面向文档的 AI 助手平台,支持私有化部署,内置 Agent 构建器、深度研究、文档分析和多模型支持,适用于企业知识检索和智能问答场景。

核心特性

  • 广泛格式支持:PDF、DOCX、CSV、XLSX、音频等多种文档格式
  • 语音工作流:录音转文字,支持会议录音和语音笔记搜索
  • Agent 构建器:可视化构建条件节点的 AI 工作流
  • 可靠溯源答案:带源引用的无幻觉响应,可验证
  • 多模型支持:OpenAI、Google、Anthropic 及本地模型(Ollama、llama_cpp)
  • 预置集成:HTML/React 聊天组件、Discord/Telegram 机器人等

适用场景

💡 企业私有化部署的知识库问答系统
💡 基于内部文档的智能助手和客服机器人
💡 多源数据(网页、GitHub、Reddit)的统一检索和分析
💡 需要可靠溯源和审计的企业决策支持场景

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(18.2k stars)
  • 开源许可证友好(MIT)
  • 项目有一定历史沉淀(已维护 3 年)

快速开始

克隆仓库后运行 ./setup.sh(macOS/Linux)或 .\setup.ps1(Windows),脚本会引导选择部署方式,完成后访问 http://localhost:5173/

相关项目

RAG-Anything

22.9k · Python
活跃 A+

全模态 RAG 框架,支持文本、图像、表格、公式等多种文档格式的检索增强生成,实现统一的知识问答能力。

ragmultimodalknowledge-base +2
  • · 全模态端到端流水线 — 从文档摄取、解析到多模态查询应答的完整工作流
  • · 通用文档支持 — 无缝处理 PDF、Office 文档、图片等多种文件格式
  • · 专用内容分析 — 图像、表格、数学公式、异构内容的专用处理器

RAGFlow

88.6k · Go
活跃 A+

领先的开源 RAG 引擎,融合前沿 RAG 技术与 Agent 能力,为 LLM 提供高质量的上下文层,支持深度文档理解、知识库管理和智能检索。

ragdocument-understandingknowledge-base +3
  • · 深度文档理解 — 基于 deepdoc 技术从复杂格式非结构化数据中提取知识,支持 PDF、Word、PPT、Excel、图片等
  • · 模板化分块 — 提供多种智能分块模板选项,实现可解释的文档切分与知识组织
  • · 可追溯引用与减少幻觉 — 可视化文本分块结果,支持人工干预,答案附带关键参考来源

QAnything

14.1k · Python
不活跃 C

QAnything 是网易有道开源的本地知识库问答系统,支持任意格式文件,提供离线 RAG 能力,可快速搭建私有知识问答。

ragqaknowledge-base +1
  • · 本地知识库问答,支持 PDF、Word、PPT、XLS、Markdown、图片、CSV 等多种格式
  • · 两阶段向量检索:嵌入 + 重排序,大规模数据下精度稳定提升
  • · 完全离线运行,支持断网环境安装部署

RAGatouille

4.0k · Python
不活跃 C

轻松使用和训练最先进的后期交互检索方法(ColBERT),模块化设计,可将 ColBERT 模型集成到任何 RAG 管道中,显著提升检索精度。

ragpythonembedding +1
  • · ColBERT 后期交互检索:将先进的 ColBERT 模型封装为简单 API,无需深入了解检索论文即可在 RAG 管道中使用后期交互检索方法
  • · 端到端训练与微调:内置 RAGTrainer 和 TrainingDataProcessor,自动处理数据去重、正负样本配对和硬负例挖掘,支持从零训练或微调预训练模型
  • · 模块化可组合架构:DataProcessor、NegativeMiner 等组件可独立使用,也支持自定义 NegativeMiner 接入训练管道