Tongyi DeepResearch

不活跃
GitHub Python Apache-2.0

简介

阿里巴巴通义实验室开源的深度研究 Agent,采用多阶段迭代式信息检索和推理架构,能够对复杂问题进行深度分析、综合和总结,支持网页搜索和文档分析。

核心特性

  • 30.5B 总参数的智能体 LLM,每 token 仅激活 3.3B 参数(MoE 架构)
  • 全自动合成数据生成流水线,支持智能体预训练、SFT 和强化学习
  • 基于多样化智能体交互数据的大规模持续预训练
  • 端到端强化学习,采用定制的群组相对策略优化(GRPO)框架
  • 兼容 ReAct 和 IterResearch Heavy 两种推理范式
  • 在 Humanity's Last Exam、BrowseComp、FRAMES 和 SimpleQA 基准测试中达到 SOTA

适用场景

💡 深度信息检索和多步骤网络研究任务
💡 长周期智能体搜索和问答
💡 学术研究和文献综述自动化
💡 跨多个网络来源的复杂事实核查
💡 部署为研究助手 API 服务

快速开始

1. 环境准备:conda create -n deepresearch python=3.10.0 && conda activate deepresearch
2. 安装依赖:pip install -r requirements.txt
3. 配置:cp .env.example .env 并填写 API 密钥(SERPER_KEY_ID、JINA_API_KEYS 等)
4. 运行推理:python inference/react_inference.py --dataset <your_dataset>

相关项目