
PDFMathTranslate PDF 翻译3 条命令拿到英文论文的中文版【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate周四下午同事把一个文件夹交给你8 篇英文 PDF共 260 页周五评审要用中文讲清关键部分。逐句读不现实丢进网页翻译器公式和页码又全乱。开源工具 PDFMathTranslate命令pdf2zh就是干这个的排版不动把整篇英文 PDF 译成中文再给出一份中英对照文档。下面是可以直接照做的步骤。1. 一条安装命令加一条翻译命令拿到中文版 PDF先确认本机 Python 在 3.11 到 3.12 之间然后执行pip install pdf2zh该命令把 pdf2zh 和依赖一起装好。首次运行会下载一个版面识别模型多等几分钟属正常网络不顺时先设镜像端点CMD 里set HF_ENDPOINThttps://hf-mirror.comPowerShell 里$env:HF_ENDPOINT https://hf-mirror.com再跑。把论文放进当前目录pdf2zh report.pdf结束后同目录生成report-mono.pdf纯中文和report-dual.pdf原文与译文上下排布边读边对。想先看效果可以看下面这段演示动画。公式、目录、注释都留在原位置页码、字体与原文一致。拿到文件后下一件事是挑翻译引擎。2. 如何把翻译引擎切换到本地模型默认走 Google 翻译不用配任何 API key。想让数据不出本机可以接 Ollamaset OLLAMA_MODELgemma2 pdf2zh report.pdf -s ollama第一行指定本地模型第二条命令里-s切换翻译服务Ollama 默认在127.0.0.1:11434上监听运行前确认本机 Ollama 已启动。DeepL、OpenAI、DeepSeek、Xinference 在内的 24 种服务及各自所需的环境变量完整列表在 docs/ADVANCED.md。论文一篇接一篇地来就该批处理了。3. 一次翻完整个文件夹批量参数与缓存复用pdf2zh --dir ./papers/--dir指向目录里面所有 PDF 依次翻完不用逐个敲文件名。两个高频参数-p 1-10只译第 1 到 10 页时间紧时先扫摘要和结论-li en -lo ja指定源语言与目标语言代码可用zh、ko、fr、de中英日德法互译都行。把常用参数写进config.json再用--config config.json加载同一套设置反复用。译文本身有缓存同一文档重复翻译会直接复用已翻段落不再重复消耗 API想强制重翻就加--ignore-cache。服务器上没有 Python 环境时用最后一节的容器方案。4. 两条 Docker 命令启动网页版docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh镜像里环境与模型都已备好跑起来后浏览器打开http://localhost:7860/把 PDF 拖进窗口、点 Translate 即可全程不碰本机 Python。要把它接进自己的工具Python 与 HTTP 接口见 docs/APIS.md。最后是几个常见问题。FAQ翻译会覆盖原始文件吗不会。工具只读取原始 PDF结果以两个新文件输出在同目录原文件逐字节不动。能不调外部服务吗可以。-s ollama配合本地模型后翻译全程离线唯一需要联网的是首次下载版面模型用HF_ENDPOINT指定镜像即可。接自定义 OpenAI 兼容端点为什么报 404确认BASE_URL以/v1结尾例如https://your-proxy:8000/v1漏掉/v1就会直接 404。首次运行报版面模型下载失败通常是网络问题。设置HF_ENDPOINT指向镜像端点重试仍失败时检查onnxruntime依赖是否装全。扫描件能用自动 OCR 吗目前是实验功能面向白底扫描只对纯图片页做识别手写与行内公式可能识别错误需先执行pip install pdf2zh[ocr]安装扩展。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考