LightRAG

活跃
GitHub Python MIT

简介

LightRAG 是一个简洁高效的 RAG 框架,使用图结构增强检索效果,发表于 EMNLP 2025。

核心特性

  • 图结构增强检索 — 使用知识图谱实体和关系进行双层检索(local/global),比传统向量检索更精准
  • 四种文本分块策略 — 支持 Fixed、Recursive、Vector、Paragraph 分块,适应不同文档类型
  • 多后端存储支持 — 兼容 Neo4j、PostgreSQL、MongoDB、OpenSearch、JSON KV Store 等多种存储方案
  • 多模态文档处理 — 通过 RAG-Anything 集成,支持 PDF、图片、Office 文档、表格、公式的解析和提取
  • 角色化 LLM 配置 — 四种独立角色(EXTRACT、QUERY、KEYWORDS、VLM)可分别配置不同的 LLM
  • WebUI 可视化管理 — 提供 Web 界面进行知识插入、查询和知识图谱可视化浏览

适用场景

💡 大规模文档知识库 — 构建包含数万文档的知识图谱,通过双层检索快速定位相关实体和关系
💡 学术论文分析 — 提取论文中的方法、实验和结论,构建领域知识图谱辅助文献综述
💡 企业知识管理 — 整合内部文档、邮件和报告,通过图检索实现跨文档关联查询
💡 多模态 RAG 系统 — 处理包含图片、表格和公式的 PDF 文档,实现全模态检索增强生成
💡 智能问答系统 — 结合图检索和向量检索,构建能够回答复杂关联问题的 QA 系统

快速开始

```bash
pip install lightrag-hku

python -c "
import lightrag
from lightrag import LightRAG

rag = LightRAG(work_dir='./lightrag_work')
with open('input.txt', 'r') as f:
    text = f.read()
rag.ainsert(text)
result = rag.aquery('What is the main topic?')
print(result)
"
```

相关项目

相关文章