ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

PDFMathTranslate:一条命令翻译 PDF 论文,22 万人下载过,公式不坏

PDFMathTranslate:一条命令翻译 PDF 论文,22 万人下载过,公式不坏 PDFMathTranslate一条命令翻译 PDF 论文22 万人下载过公式不坏【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate翻完的论文里公式全变乱码PDFMathTranslate 是一个开源的保版式 PDF 翻译工具只换文字公式和图表留在原位产出纯中文和双语对照各一份。EMNLP 2025 收录PyPI 下载量超 22 万。先看结果公式版式不坏跑一次命令当前目录会多出两个 PDFpaper-mono.pdf是纯中文版适合直接读paper-dual.pdf是中英双语对照适合逐句核对。官方演示用的是一篇 2006 年的 Nature 论文双栏、多公式、带网络图翻译后正文变中文公式、节点网络图、图注都还在原来的位置。下面两张图来自官方文档的翻译前后对照一次看懂它是怎么做到的它先认出版面上每块是什么只翻译该翻的正文所以版式不会坏。具体链路是读取可解析文本层的 PDF用 ONNX 版面模型DocLayout-YOLO识别页面上每一块的类型——正文、公式、图、图注——再把正文发给翻译服务把译文写回原来的位置。版面模型负责决定哪里不动翻译服务只管文字。核心代码在pdf2zh/目录里版面解析和翻译调度分在pdfinterp.py、translator.py等文件篇幅不长可以顺着读。三步拿到第一份双语版需要 Python 3.11 或 3.12从安装到出结果只要三步。安装命令pip install pdf2zh装完后终端里就多了一个pdf2zh命令习惯uv的人可以改用uv tool install --python 3.12 pdf2zh。把 PDF 放到当前目录执行翻译pdf2zh paper.pdf第一次运行还会下载版面模型wybxc/DocLayout-YOLO-DocStructBench-onnx你会先看到下载进度所以首跑偏慢之后就不等了。✅ 跑完看当前目录多出paper-mono.pdf纯中文和paper-dual.pdf双语对照两个新文件。默认走 Google 翻译服务不需要任何 API key。五句命令覆盖高频场景下面每条命令复制即改文件名就能用高频场景命令整篇翻译出两份产物pdf2zh paper.pdf显式指定英文译中文pdf2zh paper.pdf -li en -lo zh先试读前 5 页pdf2zh paper.pdf -p 1-5换 DeepL 服务pdf2zh paper.pdf -s deepl批量翻一个文件夹pdf2zh --dir /path/to/papers/ -o output/ -t 3-p还支持-p 1-3,5这种页码范围写法翻译结果带缓存先翻几页试读、满意再全量跑不会重复消耗 API 调用。-t是翻译线程数-o指定输出目录。不想装 Python 的 Windows 用户直接下载发布页的pdf2zh-version-win64.zip解压后运行pdf2zh.exe即可。按需挑三个进阶选项换翻译服务或完全离线——当默认的 Google 满足不了质量要求或翻译环节不能碰外网加-s参数切换bing同样免 keyollama接本地模型其余服务要先配 API key 环境变量各服务的完整环境变量对照表 里列了每个服务要设哪些变量。有固定术语时用--prompt prompt.txt传自定义提示词文件模板支持${lang_in}、${lang_out}、${text}三个变量。浏览器里打开图形界面——不想碰命令行时执行pdf2zh -i浏览器没自动弹出就访问http://localhost:7860/把 PDF 拖进窗口点翻译也可以先用环境变量PDF2ZH_LANG_FROM、PDF2ZH_LANG_TO固定源语言和目标语言。细节见 GUI 文档。Docker 部署给团队共用——需要让其他人免安装使用时docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh启动后团队里任何人从浏览器访问http://localhost:7860/就能用。避开这五个翻译坑 ⚠️首跑卡在模型下载→ 版面模型首次运行时从 Hugging Face 拉取网络慢会超时 → 先设镜像变量再跑Windows 用set HF_ENDPOINThttps://hf-mirror.comPowerShell 用$env:HF_ENDPOINThttps://hf-mirror.com其他网络问题查 代理配置文档。换了服务或提示词译文却没变→ 翻译结果有缓存相同内容直接复用旧译文 → 加--ignore-cache强制重翻。扫描版、图片型 PDF 翻不了→ 工具解析的是文本层和版面不认纯图片 → 先 OCR 成可复制文本的 PDF 再翻项目也有实验性 OCR 支持pip install pdf2zh[ocr]后它会自动对纯图片页跑本地 OCR目前面向白底扫描手写体和行间公式可能识别不准。输出文件有字体兼容问题→ 默认启用字体子集化来压缩体积个别阅读器不兼容 → 加--skip-subset-fonts跳过子集化。Windows 压缩包双击打不开→ 缺微软 VC 运行库 → 装上vc_redist.x64.exe再试。决定下探到什么程度只想读论文的话做到三步拿到第一份双语版的第 2 步就够了dual文件就是你每天要看的要团队共用就上第 6 节的 Docker。 它只做一件事把公式当公式、把图当图只让文字变得能读——文献整理里最费时的后处理就是这一步。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进