Tongyi DeepResearch

不活跃
GitHub Python Apache-2.0

简介

阿里巴巴通义实验室开源的深度研究 Agent,采用多阶段迭代式信息检索和推理架构,能够对复杂问题进行深度分析、综合和总结,支持网页搜索和文档分析。

核心特性

  • 30.5B 总参数的智能体 LLM,每 token 仅激活 3.3B 参数(MoE 架构)
  • 全自动合成数据生成流水线,支持智能体预训练、SFT 和强化学习
  • 基于多样化智能体交互数据的大规模持续预训练
  • 端到端强化学习,采用定制的群组相对策略优化(GRPO)框架
  • 兼容 ReAct 和 IterResearch Heavy 两种推理范式
  • 在 Humanity's Last Exam、BrowseComp、FRAMES 和 SimpleQA 基准测试中达到 SOTA

适用场景

💡 深度信息检索和多步骤网络研究任务
💡 长周期智能体搜索和问答
💡 学术研究和文献综述自动化
💡 跨多个网络来源的复杂事实核查
💡 部署为研究助手 API 服务

优势与不足

优势

  • 社区热度高(19.9k stars)
  • 开源许可证友好(Apache-2.0)
  • Issue 响应及时,积压少

⚠️ 不足

  • 已超过 6 个月未更新

快速开始

1. 环境准备:conda create -n deepresearch python=3.10.0 && conda activate deepresearch
2. 安装依赖:pip install -r requirements.txt
3. 配置:cp .env.example .env 并填写 API 密钥(SERPER_KEY_ID、JINA_API_KEYS 等)
4. 运行推理:python inference/react_inference.py --dataset <your_dataset>

相关项目

MiroThinker

8.4k · Python
正常 A

专为复杂研究和预测任务优化的深度研究 Agent 框架,其 MiroThinker-1.7 和 MiroThinker-H1 模型在 BrowseComp 基准上分别达到 74.0 和 88.2 分,支持多步骤推理和信息检索。

pythonagentllm +3
  • · 专为复杂研究和预测任务优化的深度研究 Agent 框架
  • · MiroThinker-1.7 模型在 BrowseComp 基准达到 74.0 分,H1 模型达到 88.2 分
  • · 支持 256K 上下文窗口和每次任务最多 300 次工具调用

Vision Agents

8.1k · Python
活跃 A+

Stream 开源的视觉与语音智能体框架,支持任意模型和视频提供商,利用边缘网络实现超低延迟的实时多模态 AI 交互。

voiceagentpython +3
  • · 实时视频 AI,集成 YOLO、Roboflow 并结合 Gemini/OpenAI 进行实时视觉理解
  • · 通过 Stream 边缘网络实现 30ms 以下超低延迟音视频传输,500ms 内加入
  • · 原生 SDK 方法来自 OpenAI、Gemini 和 Claude,始终使用最新 LLM 能力

LangExtract

38.5k · Python
活跃 A+

Google 开源的 Python 库,用于利用 LLM 从非结构化文本中精确提取结构化信息,支持源文本标注和交互式可视化,适用于数据标注和知识抽取场景。

data-processingllmpython +2
  • · 精确源文本锚定 — 每条提取结果映射到原文精确位置,支持视觉高亮追溯验证
  • · 受控结构化输出 — 基于 few-shot 示例强制一致输出 Schema,利用 Gemini 受控生成保证结果鲁棒性
  • · 长文档优化策略 — 通过文本分块、并行处理和多轮扫描克服大文档「大海捞针」问题,提升召回率