PDFMathTranslate 免费 PDF 翻译工具指南:完整保留排版,整篇论文译成中英双语
发布时间:2026/9/19 21:53:11 锦皓数字建站

PDFMathTranslate 免费 PDF 翻译工具指南完整保留排版整篇论文译成中英双语【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate翻译工具能把公式、图表、页码放回原位同时给出通顺中文吗PDFMathTranslate命令名 pdf2zh可以它是一款免费开源的 PDF 翻译工具把整篇英文学术论文译成中文时完整保留原始排版并额外产出一份中英双语对照文档。最短路径上手两条命令出两份 PDF先确认 Python 版本在 3.11 到 3.12 之间然后安装pip install pdf2zh这条命令装好 pdf2zh 命令和全部依赖首次翻译时它会再下载一个版面识别模型多等几分钟属正常。接着把论文放进当前目录直接运行pdf2zh example.pdf跑完当前目录会多出两个文件后缀带-mono.pdf的是纯中文版带-dual.pdf的是中英对照版每页原文和译文上下排布版式与原件一致。默认翻译走 Google不需要任何 key只想先读摘要和实验部分时加-p 1-5只翻前 5 页。它凭什么做得到先切版面只翻文本PDFMathTranslate 先用版面检测模型把每一页切成正文、公式、图表等区域然后只把文本块送进翻译服务译文再填回原来的文本框。公式等非文本区域自始至终不经过翻译引擎。可验证的效果有三点1行内公式与整块数学符号位置不变、符号不丢2图片、表格、目录、页码、脚注落点与原文一致3页面结构不变双语版可以逐页逐段对照阅读。翻译前同一篇英文论文在网页版里的原文预览翻译后标题、正文、图注都变成中文版面保持原样按场景选引擎改一个参数就切换切换引擎只改一个参数-s三类场景对应三种选法零成本默认默认服务 Google 免 keyBing 同样免 key直接跑基础命令即可适合快速通读论文。高质量付费DeepL、OpenAI、DeepSeek 等需要先设置各自的环境变量API key 之类再用-s deepl这样的方式指定适合对译文质量要求高的场景。本地离线机器上跑着 Ollama 时用-s ollama把OLLAMA_HOST和OLLAMA_MODEL指到本地模型全程不碰外网。十几种服务的完整清单和对应环境变量在 docs/ADVANCED.md想把它接进自己的程序Python API 和 HTTP API 说明见 docs/APIS.md。从一篇到一批批量、缓存与配置文件三项能力各有一个才需要的触发点批量目录里堆着多篇论文、要一次性全翻时用pdf2zh --dir /path/to/folder/直接指向目录它会逐个处理不用一篇篇敲命令。缓存重复翻译同一篇文档时已译段落直接从缓存取回第二次明显快于第一次想丢弃缓存强制重译时加--ignore-cache。配置文件同一套服务、语言、例外规则反复使用时写进一个 JSON 再用--config传入即可默认读取位置是~/.config/PDFMathTranslate/config.json。不碰本机环境也能用嫌 Python 环境麻烦或要在实验室共享机上统一部署用官方 Docker 镜像共两条命令docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh镜像自带 Python 运行环境与版面模型容器起好后浏览器打开http://localhost:7860/拖入 PDF 点 Translate 即可。网页端选项和命令行一致可挑选翻译服务、目标语言与页码范围结果直接下载。云端部署需要自定义构建时可参考仓库里的 script/Dockerfile.Demo。避坑清单五个最高频问题1. 首次运行卡在下载版面模型原因模型从 HuggingFace 拉取国内网络容易超时。 解法把环境变量HF_ENDPOINT指向镜像https://hf-mirror.com再跑一次PowerShell 里变量名前加$env:。2. pip 安装时版本校验报错原因项目仅支持 Python 3.11 到 3.12。 解法先python --version确认版本用 conda 或 uv 切到 3.11/3.12 环境重装。3. 公式或特殊字符被翻成乱码原因默认例外规则没覆盖该处的字体或符号。 解法用-f和-c传正则把目标字体或字符排除在翻译之外匹配写法见 docs/ADVANCED.md。4. 换了引擎重跑结果却和上次一样原因相同文本命中了翻译缓存第二次复用旧结果是正常行为。 解法加--ignore-cache强制整篇重新翻译。5. 输出文件个别字体缺字或错乱原因默认对字体做子集化压缩个别阅读器不完全兼容。 解法加--skip-subset-fonts跳转子集化后重新生成。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
锦
锦皓数字建站
深耕本土企业品牌数字化升级,专注原创端正雅致商务官网,从视觉设计到稳定运维全程保驾护航。