ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

PDFMathTranslate(pdf2zh)实用指南:一篇科学论文 PDF 全文翻译,公式与双栏排版原样保留

PDFMathTranslate(pdf2zh)实用指南:一篇科学论文 PDF 全文翻译,公式与双栏排版原样保留 PDFMathTranslatepdf2zh实用指南一篇科学论文 PDF 全文翻译公式与双栏排版原样保留【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate想读外文论文又不想被排版破坏的翻译结果劝退PDFMathTranslate命令名pdf2zh用一条命令翻译科学论文 PDF公式、图表编号和双栏结构都留在原位面向需要大量阅读外文文献的学生与科研人员。 看懂机制为什么公式不会被译成文字它不是找到文字再翻译的普通翻译工具而是先做版面检测再翻译内置的 DocLayout-YOLO 版面检测模型先标出每页中公式、图表、目录、注释的位置只把纯文本区域交给翻译服务其余区域原封不动。每份输入会产出两份文档mono是纯译文dual是中英文对照版方便逐段核对。使用边界先说清楚解析的是 PDF 文本层纯图片扫描件不能直接译需先走 OCR项目内置实验性 OCR见后文。默认翻译服务是 Google无需任何密钥。首次运行要下载版面模型wybxc/DocLayout-YOLO-DocStructBench-onnx需要一次联网。依赖 Python 3.113.12其他版本装不上。30 秒跑通首次翻译一条命令拿到双语版在 PDF 所在目录执行pip install pdf2zh pdf2zh document.pdf当前目录会生成document-mono.pdf纯译文和document-dual.pdf中英对照。首次运行稍慢因为在下载版面模型之后走本地缓存。不愿配 Python 环境的话也可直接用仓库 release 页的 Windows 版 exe 双击运行。能力速查想做什么查这一行想做的事命令 / 参数说明翻译单个 PDFpdf2zh document.pdf默认 Google 服务免密钥切换翻译服务-s deepl或-s openai:gpt-4o-mini先设DEEPL_AUTH_KEY、OPENAI_API_KEY等变量对照服务变量表批量处理整个目录pdf2zh --dir ./papers -o results/目录下所有 PDF 一次跑完只译指定页-p 1-3,5第 13 页和第 5 页指定源/目标语言-li en -lo zh支持英、日、韩、德等十余种语言加快速度-t 4并发翻译线程数跳过缓存重译--ignore-cache相同文本默认命中缓存固定参数便于复用--config config.json批量场景推荐调整保留的公式字体-f/-c默认保留 Latex、Mono、Code、Italic、Symbol、Math 六类翻译扫描件pip install pdf2zh[ocr]实验性 OCR快模式自动识别图片页 核对效果公式、编号、双栏是否都在原位翻译前后各截一页对照双栏结构、图表编号、脚注和页眉都没有错位公式区域内的数学符号不会被当作普通文字送去翻译。个别字体输出异常时用-f指定正则让某类字体整体保留即可参数写法见高级用法。 不止命令行GUI、Docker、MCP 与 API图形界面pdf2zh -i启动后浏览器打开http://localhost:7860/拖入 PDF、选服务与页码即可实时预览详见 GUI 说明。Docker 部署拉取镜像并映射 7860 端口——docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zhMCP 服务器pdf2zh --mcp以 STDIO 方式运行加--sse切换为 SSE可接入 Claude Desktop 等客户端配置示例在 ADVANCED.md 的 MCP 小节。程序化调用docs/APIS.md 提供 Python APItranslate/translate_stream两个函数与 HTTP API 两种集成方式HTTP 端需先pip install pdf2zh[backend]。常见卡点三种典型故障与解法版面模型下载失败或超时把HF_ENDPOINT环境变量指向一个模型镜像地址后重跑即可这是首次运行最常被卡住的环节。扫描件翻不动纯图片 PDF 没有文本层先装pip install pdf2zh[ocr]启用实验性 OCR或自行用 OCR 工具生成文本层再翻译手写体和行内公式的识别精度有限。换服务后报缺密钥或 401对照服务变量表确认环境变量已设置OpenAI 兼容接口的BASE_URL必须以/v1结尾少写就会 404。行动清单先翻一篇短论文逐页核对dual版本里的公式与分栏位置。批量场景把--dir与-o组合使用并用--config固定参数方便重复执行。出问题先查 docs/ADVANCED.md 目录按小节定位语言、服务、缓存、字体各节。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进