Kotaemon

正常
GitHub Python Apache-2.0

简介

Kotaemon 是开源 RAG 文档对话工具,支持与 PDF 等文档进行智能问答,提供简洁的聊天界面与多种 LLM 和嵌入模型后端。

核心特性

  • 混合检索管道 — 同时使用全文检索和向量检索,配合重排序确保最高检索质量
  • 多模态文档问答 — 支持 PDF、HTML、XLSX 等格式,可解析文档中的图表和表格
  • 高级引用与文档预览 — 提供带评分的相关性引用,内置浏览器 PDF 阅读器支持高亮预览
  • 多种推理模式 — 支持问题分解(question decomposition)和基于 Agent 的 ReAct/ReWOO 推理
  • 可配置设置界面 — 在 UI 上直接调整检索和生成的关键参数,包括提示词模板
  • 多用户协作 — 支持多用户登录、私有/公开文档集合管理、聊天分享

适用场景

💡 个人文档知识库:上传 PDF/文档后通过聊天界面进行问答
💡 团队知识共享平台:创建私有文档集合,团队成员共同使用和管理
💡 学术文献研究:对论文进行多模态问答,提取图表数据和引用
💡 企业合规文档检索:在合规文件中快速定位相关条款和解释
💡 多语言文档处理:结合本地 LLM(如 Ollama)进行隐私友好的离线问答

优势与不足

优势

  • 社区热度高(25.7k stars)
  • 开源许可证友好(Apache-2.0)
  • 项目有一定历史沉淀(已维护 2 年)
  • Issue 响应及时,积压少

快速开始

```bash
docker run -e GRADIO_SERVER_NAME=0.0.0.0 -e GRADIO_SERVER_PORT=7860 -v ./ktem_app_data:/app/ktem_app_data -p 7860:7860 -it --rm ghcr.io/cinnamon/kotaemon:main-full
```

相关项目

MaxKB

22.7k · Python
活跃 A+

MaxKB 是基于 LLM 大模型的开源知识库问答与 Agent 构建平台,支持向量检索、工作流编排与多种模型接入,开箱即用。

knowledge-baseragchatbot +3
  • · RAG 流水线 — 支持文档上传与在线爬取,自动切分、向量化,有效减少大模型幻觉
  • · Agentic 工作流 — 强大的工作流引擎、函数库与 MCP 工具调用,满足复杂业务场景
  • · 零代码集成 — 无缝接入第三方业务系统,快速赋予现有系统智能问答能力

Khoj

37.2k · Python
正常 A

Khoj 是一个可自托管的 AI 第二大脑,支持从网页和文档中获取答案、构建自定义 Agent、安排自动化任务和深度研究。

second-brainragself-hosted +2
  • · 多 LLM 支持 — 本地和云端 LLM 灵活切换,支持 llama3、qwen、gemma、mistral、gpt、claude、gemini、deepseek
  • · 多格式文档检索 — 从 PDF、Markdown、Word、Notion、org-mode、图片等文件中获取答案
  • · 自定义 Agent 创建 — 支持自定义知识库、人格、聊天模型和工具,构建专属 AI 助手

Langchain-Chatchat

38.6k · Python
不活跃 B

Langchain-Chatchat 是一个基于 Langchain 和多种大语言模型的本地知识库 RAG 与 Agent 应用平台,支持 ChatGLM、Qwen、Llama 等模型,提供对话、知识库管理、Agent 调用等功能。

ragllmpython +3
  • · 本地知识库问答 — 基于 Langchain 实现文档加载、文本分割、向量化和语义检索,支持 BM25+KNN 混合检索
  • · 多模型推理框架接入 — 支持 Xinference、Ollama、FastChat、LocalAI 等框架,接入 GLM-4、Qwen2、Llama3 等模型
  • · Agent 工具调用 — 针对 ChatGLM3 和 Qwen 优化,支持多工具自动选择、单工具参数解析、手动工具调用和多模态图片对话

MemAgent

1.1k · Python
不活跃 B

可扩展至 350 万上下文 token 的记忆智能体框架,附带用于任意智能体工作流 RL 训练的训练框架,解决长上下文记忆难题。

memoryagentrag +2
  • · 超长上下文处理:从 8K 训练上下文外推至 350 万 token,性能损失低于 5%
  • · 强化学习驱动:采用 RLVR(可验证奖励强化学习)训练,扩展 DAPO 算法支持多轮对话端到端优化
  • · 线性时间复杂度:突破长文本处理的计算瓶颈,资源随文本长度线性扩展