PDFMathTranslate:3 分钟完成 PDF 文献翻译,公式图表一个不丢
PDFMathTranslate:3 分钟完成 PDF 文献翻译,公式图表一个不丢
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
PDFMathTranslate 是一款开源的 PDF 文献翻译工具。英文论文读得费劲、复制粘贴又毁掉格式?它专治这个。目标人群从啃文献的学生到审合同的法务,只要手里有外文 PDF 就用得上。
PDF 文献翻译的底层:它凭什么不丢公式?
翻译开始前,它先用一个叫 DocLayout-YOLO 的版面检测模型,给整页 PDF 拍一张"结构 X 光"。YOLO 本身是一类目标检测框架,在这里被训练成专门框出正文、公式、图表和目录的位置——干的正是给文档做 X 光检查的活。随后文本部分交给翻译引擎:Google、DeepL、Ollama、OpenAI 等 10 余种服务可切换,检测模型跑在 ONNX Runtime 上,没有独立显卡也能转。最后由 PyMuPDF、Pdfminer.six 这类 PDF 处理库把内容拆出来、再按原始坐标填回去。
公式不丢,图表不动,目录还在。
翻出来的效果长这样——同一页左英文、右中文,公式编号一一对得上:
📦 拿起来就能用的 4 种姿势
- 在线服务:免安装在线体验,浏览器打开传文件就能翻,适合先尝个鲜的人。
- 命令行:
pip install pdf2zh装好后一条命令翻完全文,适合习惯自动化的技术用户。 - 浏览器界面:启动后在网页里拖文件、选引擎,适合完全不想碰终端的人。
- Docker 容器:拉镜像、起端口,团队内网部署一份共用,适合要长期用的团队。
常用参数(源语言、目标语言、换引擎、跳过缓存)在 docs/ 目录里都有文档;想改翻译行为本身,可以直接看 pdf2zh/translator.py。
谁在用、怎么用
读博第三年、每天要啃 2 篇论文的学生:把整篇翻成双语对照稿,公式和引用位置都不变,来回切原文与译文的时间全省了。
跨境团队里审英文合同的法务:本地接 Ollama 跑纯私域翻译,文件不出内网,翻完直接归档。
想搭自己工作流的开发者:图形界面之外还支持 MCP(一种让 AI 应用调用外部工具的标准协议)和 HTTP API,翻译能力可以嵌进自己的程序里。
选它而不是别家的 4 个理由
- 🎯版式保留是核心设计,不是附属功能:公式、图表、目录、注释都保留,译文按原始坐标回填,不是另起炉灶重排一遍。
- 纯译文和双语对照稿一次全给:跑一次任务,同时产出单语翻译版和双语对照版两份 PDF。
- 引擎随便换,还能全本地:10 余种翻译服务可切换;选 Ollama 时整个流程可离线跑在自己的机器上。
- 不装也能先试:官方有免费在线服务,另有 HuggingFace 和 ModelScope 上的演示环境,浏览器里就能翻。
它没打算替你读文献,只是把"看懂排版"这件最耗神的活接走了。第一次使用不用任何配置,默认翻译引擎开箱就能跑。打开在线 Demo 传一篇试试,3 分钟后见分晓。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
