
保留公式与版式的 PDF 论文翻译pdf2zh 两条命令上手指南【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslatePDFMathTranslate命令行名为 pdf2zh是一款开源的 PDF 全文翻译工具能完整保留版面。它先用版面检测模型识别公式、图表和正文只把文字送去翻译最后同时输出纯中文译文和中英对照两个版本。它已被 EMNLP 2025 收录两条命令即可跑起来。普通翻译工具翻完论文后的通病用普通工具翻一篇论文你可能都见过这种场面公式变成一串乱码、双栏被拆断、图编号和脚注错位最后还得手动修排版。根源在于它只把文档看成一堆文字并不理解版面的结构。为什么公式翻完不会乱pdf2zh 的做法是先看懂页面再翻译版面检测内置 DocLayout-YOLO 模型逐块识别公式、图表、目录和标注公式区域不送翻译原样保留双版本输出一次翻译同时得到纯译文-mono.pdf和中英对照-dual.pdf对照阅读两不误服务随便换默认 Google 无需任何密钥也可用-s切到 DeepL、OpenAI、Ollama 等 20 余种服务本地模型同样能跑--mcp还能以 MCP 服务器模式接入 Claude Desktop自带缓存相同句子只调一次 API重复处理同一份文档省时省额度两条命令装好跑起来要求只是 Python 3.11 到 3.12pip install pdf2zh pdf2zh document.pdf当前目录会生成document-mono.pdf和document-dual.pdf。不想敲命令的话执行pdf2zh -i打开浏览器里的图形界面默认 http://localhost:7860/上传 PDF 直接翻。批量翻译整个文件夹的方法文献多的时候不用逐个喂。--dir会递归扫描目录下所有 PDF 并逐一翻译-o指定结果落到哪pdf2zh --dir /path/to/papers/ -o results/其他常用参数-p选页码范围、-li/-lo指定源语言和目标语言、-t调并发、--ignore-cache强制重新翻译。完整清单在官方文档 docs/ADVANCED.md 里都有表格可查。 首次运行最容易踩的两个坑扫描版 PDF 翻不了。它解析的是 PDF 里的文本层纯图片扫描件请先行 OCR。模型下载卡住。首次运行要拉取wybxc/DocLayout-YOLO-DocStructBench-onnx模型部分地区网络受限按 README 提示设置镜像即可set HF_ENDPOINThttps://hf-mirror.comPowerShell 用户把这条换成$env:HF_ENDPOINT https://hf-mirror.com。一句话总结pdf2zh 把PDF 翻成中文且公式版面不坏这件事压缩到了两条命令的距离。细节参数看 docs/ADVANCED.md图形界面用法看 docs/README_GUI.md装好翻一篇论文就知道值不值。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考