PDFMathTranslate

活跃
GitHub Python AGPL-3.0

简介

AI 驱动的 PDF 学术论文翻译工具,完整保留原始排版格式,支持 Google/DeepL/Ollama/OpenAI 等多种翻译引擎。

核心特性

  • 保留排版格式翻译 — 翻译 PDF 学术论文时完整保留公式、图表、目录和批注的原始排版
  • 多翻译引擎支持 — 支持 Google Translate、DeepL、Ollama、OpenAI、MiniMax 等多种翻译服务
  • 多种使用方式 — 提供 CLI 命令行、Gradio GUI 界面、Docker 容器、Zotero 插件等多种接入方式
  • 双语对照输出 — 翻译后生成原文和译文并排的双语版本,方便对照阅读
  • v2.0 精确模式 — 实验性支持 v2.0 翻译内核的精确模式,使用隔离环境进行更准确的翻译

适用场景

💡 学术论文阅读 — 翻译英文论文为中文,保留公式和图表格式,辅助理解复杂学术内容
💡 文献综述准备 — 批量翻译多篇论文,双语对照方便标注和引用
💡 技术文档本地化 — 将英文技术文档翻译为目标语言,保持原始排版不变
💡 Zotero 文献管理 — 通过 Zotero 插件直接在文献管理器中翻译 PDF 论文

优势与不足

优势

  • 活跃维护,近期持续更新
  • 社区热度高(36.8k stars)
  • 项目有一定历史沉淀(已维护 2 年)
  • Issue 响应及时,积压少

⚠️ 不足

  • 许可证限制较多(AGPL-3.0)

快速开始

pip install pdf2zh
pdf2zh document.pdf

相关项目

Docstrange

1.5k · Python
不活跃 B

通用文档格式转换工具,支持从 PDF、图片、Word、PPT 等提取数据并转换为 Markdown、JSON、CSV 等多种格式。

pythonragtools +2
  • · 多格式转换——将 PDF、DOCX、PPTX、XLSX、图片和 URL 转换为 Markdown、JSON、CSV 和 HTML
  • · 7B 参数模型——升级的核心模型,显著提高准确性和对复杂文档的理解能力
  • · 高级 OCR 管道——从扫描文档、手机照片和收据中高精度提取文本

LangExtract

38.5k · Python
活跃 A+

Google 开源的 Python 库,用于利用 LLM 从非结构化文本中精确提取结构化信息,支持源文本标注和交互式可视化,适用于数据标注和知识抽取场景。

data-processingllmpython +2
  • · 精确源文本锚定 — 每条提取结果映射到原文精确位置,支持视觉高亮追溯验证
  • · 受控结构化输出 — 基于 few-shot 示例强制一致输出 Schema,利用 Gemini 受控生成保证结果鲁棒性
  • · 长文档优化策略 — 通过文本分块、并行处理和多轮扫描克服大文档「大海捞针」问题,提升召回率