
PDF 论文翻译工具 PDFMathTranslate公式图表原地保留两条命令翻出中文版【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate导师今晚要这篇论文的中文要点你手上只有一份英文 PDF复制正文喂给在线翻译软件公式和引用编号全乱了。PDFMathTranslate 就是干这事的把 PDF 整篇翻成中文公式、图表、目录按原坐标回填。一条命令装好翻出第一份中文 PDF本地机器装 Python 3.11 或 3.12然后pip install pdf2zh pdf2zh document.pdf第一行把工具装进当前环境第二行把同目录下的document.pdf翻一遍文件名换成你自己的即可产物就落在当前目录document-mono.pdf是纯译文document-dual.pdf是中英对照版。翻完拿到什么版式原地不动翻出来的 PDF 跟原文页码一一对应正文换成了中文公式、图表、表格还留在原来的位置。和直接把文字抠出来机翻不一样它是先跑一个版式识别模型把公式、图片区域圈出来只翻普通正文最后按原坐标写回去。说白了翻译完的文档还是原来那份文档的样子。按你的处境挑一条路在自己电脑上拖一下就能翻pdf2zh -i适合不想敲参数的人它起一个本地 Web 界面浏览器没自动打开就手动访问http://localhost:7860拖入 PDF、选翻译语言等待下载。在团队服务器上Docker 起一份大家共用docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh适合不想在每台工位装 Python 的情况团队成员浏览器打开http://服务器IP:7860就能翻。在脚本里跑一个目录整批翻pdf2zh --dir ./papers/适合文献量大、要并进流水线目录里所有 PDF 依次翻完papers/换成你的目录即可。换引擎、调口味翻译服务是个参数不是门槛默认 Google 服务开箱即用想更准可以切 DeepL要设DEEPL_AUTH_KEY环境变量数据不想出内网就接 Ollama 跑本地模型。服务适合要不要额外配置google默认日常快翻不用deepl质量优先设DEEPL_AUTH_KEYopenai接自己的 LLM设OPENAI_API_KEY等ollama数据不出机器本机先起 Ollama完整服务清单和各家环境变量都在 docs/ADVANCED.md给要接第三方服务的同学看给 LLM 类服务定制提示词用--prompt指向一个文本文件。翻不动时首次运行卡在模型下载原因要拉一个版式识别模型网络受限。 修复export HF_ENDPOINThttps://hf-mirror.comWindows PowerShell 写成$env:HF_ENDPOINT https://hf-mirror.com复杂排版的 PDF 报错或翻坏原因非标准版式解析失败开兼容模式先把 PDF 转成 PDF/A 再翻。 修复pdf2zh complex_document.pdf --compatible7860 端口被占了原因本地已有别的程序占着这个端口。 修复pdf2zh -i --serverport 7861继续深入docs/ADVANCED.md全部参数、服务配置和自定义词典给要长期调优的人docs/APIS.md二次开发接口给想把翻译能力嵌进自己工具的人pdf2zh/核心源码入口在 pdf2zh/pdf2zh.py版式解析在 pdf2zh/doclayout.py给想搞清怎么做到版式不动的人。下次拿到英文 PDF直接pdf2zh翻一版出来再细读要批量读文献就用--dir把整个目录一次跑完。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考