ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

PDFMathTranslate:一条命令翻论文,公式排版原样保留

PDFMathTranslate:一条命令翻论文,公式排版原样保留 PDFMathTranslate:一条命令翻论文,公式排版原样保留【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate深夜赶稿,论文公式太密,在线翻译一粘全变乱码。PDFMathTranslate(命令名pdf2zh)做保版式 PDF 翻译:正文变中文,公式、图表、图注原位不动;论文发表于 EMNLP 2025,PyPI 总下载量已过 22 万。照这篇做完,你手里会多出纯中文版和双语对照版两份 PDF 文件。先划清边界它读入带文本层的 PDF,用 ONNX 版面模型区分哪块是文字、哪块是公式与插图,只把文字送进翻译服务,译文写回原坐标,产出原名-mono.pdf与原名-dual.pdf两个文件。你攒了一文件夹待读文献,想一口气出中文版你要边读原文边查译,想要一份中英并排的讲义你啃的是公式密集的原著,译完后每个方程必须仍是可编辑的方程扫描版、图片型 PDF 直接出局:它只认文本层,页面上没有文字就没法翻,得先用 OCR 补上文字层再跑。最短路径——从零到第一份成品环境要求:Python 3.11 或 3.12。装包:pip install pdf2zh把要翻的 PDF 放进工作目录,执行:pdf2zh paper.pdf✅ 同目录生成两个新文件:paper-mono.pdf纯中文版,paper-dual.pdf中英并排对照版。默认走 Google 引擎,免 key 直接跑。用uv管理环境的话,换成uv tool install --python 3.12 pdf2zh;Windows 上懒得配 Python,下发布页的pdf2zh-version-win64.zip解压即可。按需求深度往下走快速试水:先翻几页,换个引擎如果你不确定质量,或者文档太长,先小范围跑一遍。pdf2zh paper.pdf -p 1-3,5 -s bing-p: 页码范围,支持1-3,5这种跳段组合;-s: 翻译服务,google是默认,bing是另一个免配置的。缓存按句子去重,同一句翻过就不再发请求,所以试翻几页、满意再全量跑,不重复消耗 API。质量调优:定术语、传 prompt、本地模型如果你有术语要求(比如某个基因名必须译成指定中文名),或者整套流程不想出内网:pdf2zh paper.pdf -s openai --prompt prompt.txt--prompt: 自定义提示词文件,模板里可用${lang_in}、${lang_out}、${text}三个占位符;-s: 换服务,本地模型填ollama。各家服务对应的环境变量,去 docs/ADVANCED.md 的对照表对号入座,本文不展开。改完提示词重跑,盯一下输出文件里术语是否统一。规模化:批量翻译 PDF,团队共用如果你不止一份 PDF,或者要把 GUI 搬上服务器给团队用:pdf2zh --dir /path/to/papers/ -o out/ -t 3--dir: 整目录批量处理;-o: 输出目录;-t: 翻译线程数。团队共用、免装环境,直接上 Docker:docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh起完在浏览器打开http://localhost:7860/,选文件、选服务、下载译文,GUI 细节看 docs/README_GUI.md。眼见为实官方拿一篇 Nature 老论文做过完整演示:双栏排布、方程密集、中间嵌了一张网络图。翻译前后对比:变的只有文字层:标题、正文换成中文;方程、网络示意图、图下说明一个位置都没挪。论文发表于 EMNLP 2025 System Demonstrations,摘要里自己报了个数:PyPI 下载量 222k核心逻辑集中在 pdf2zh/ 目录,从版面模型输出到译文落盘,链路不长,值得读一遍源码Python API 处于弃用状态、2.0 再提供,要程序化调用先翻 docs/APIS.md踩坑清单首跑卡在模型下载:版面模型wybxc/DocLayout-YOLO-DocStructBench-onnx只在第一次运行时拉取,超时先设镜像再执行——cmd 里set HF_ENDPOINThttps://hf-mirror.com,PowerShell 里$env:HF_ENDPOINThttps://hf-mirror.com免 key 的只有俩:google(默认)与bing零配置,其余服务必须先把环境变量配齐,变量名见 docs/ADVANCED.md换引擎后译文没动:译文有缓存,加--ignore-cache让它绕开缓存重新调 API输出文件字体异常:默认做字体裁剪压体积,个别阅读器打不开时加--skip-subset-fonts关掉这步装不上:只收 Python 3.11–3.12,版本不对就用uv tool install --python 3.12 pdf2zh指定解释器,或换个环境网络问题五花八门:除模型镜像外,代理配置细节在 docs/PROXY_CONFIGURATION.md如果你在读论文:今天就pip install pdf2zh,翻出第一份dual文件验收质量如果你在维护团队工具:部署一个 Docker 实例,让同事都通过网页使用如果你想看实现:打开 pdf2zh/ 目录,从模型推理到文件落盘,代码量比看上去小它只动文字层:方程还是方程,插图还是插图,变的只有该被读懂的句子。翻完再修版式的活儿,被版面模型接走了,你只管读。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进