尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

PDFMathTranslate 快速指南:1条命令AI翻译PDF并保留公式与排版

PDFMathTranslate 快速指南:1条命令AI翻译PDF并保留公式与排版 PDFMathTranslate 快速指南1条命令AI翻译PDF并保留公式与排版【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate你要读完一篇带满数学公式和双栏排版的英文论文但只能看懂摘要。接下来这一篇PDFMathTranslate 能帮你用 AI 翻译 PDF 全文同时原样保留公式、图表和版式最终生成一份中文版加一份中英对照版。适合刚进实验室的研究生、需要翻技术文档的工程师以及任何被英文文献卡住的人。它解决什么问题排版、公式和双语文档传统做法是逐段复制文本到翻译工具公式抄进编辑器图表截图重排——一份 20 页的论文折腾下来排版基本就散了。PDFMathTranslate 是 EMNLP 2025 的演示论文项目定位很明确翻译只动文字版面结构不动。版面原样保留它用 DocLayout-YOLO 模型检测版式公式、图表、目录、注释都不参与翻译位置不偏移。一次产出双语文档翻译完成后同时生成纯中文版和逐段对照版不用手动拼对照稿。翻译引擎可换内置 Google、DeepL、OpenAI、Ollama 等 8 种服务本地部署的模型也能接进来。入口不止命令行除 CLI 外还提供 Web 界面、Docker 镜像、MCP 服务还有 Zotero 插件可用。最快上手路径安装 pdf2zh 并翻译第一份 PDF环境要求只有 Python 3.11–3.12装好包后一条命令就能跑起来pip install pdf2zh pdf2zh paper.pdf运行结束后当前目录会多出两个文件paper-mono.pdf纯中文和paper-dual.pdf中英对照。不想装环境的话Windows 有免安装的 exe 版本需要图形界面时执行pdf2zh -i浏览器打开http://localhost:7860/即可详见 GUI 文档。Web 界面上传 PDF、选择翻译服务和目标语言点 Translate 即可能力拆解翻译时版面是怎么保住的版式保持公式、图表、图注不重排这是整个工具的核心。文字段落被替换成译文后双栏结构、图表位置、页脚页码都维持原样。图注Figure caption会被翻译成目标语言但不会把正文顺序打乱。对带浮动图的期刊论文来说这一点决定了翻译结果能不能直接用。双语对照一份文档同时看原文和译文每次翻译固定产出两个 PDF-mono是纯译文适合通读-dual是逐段中英对照适合精读和校对术语。想只处理部分章节时用-p 1-5指定页码范围即可不用把整份文档跑一遍。翻译服务从云端 API 到本地模型服务用-s参数切换例如pdf2zh paper.pdf -s deepl走 DeepL-s ollama接本地 Ollama 上的模型-li、-lo指定源语言和目标语言。需要批量处理时--dir参数可以一次性翻译整个文件夹参数细节见 进阶用法文档。效果对照同一页论文翻译前后的差异下面用同一页 Nature 论文做前后对比。左图是翻译前英文原文双栏正文、网络结构图、公式 b/c k 都在右图是翻译后标题变成“图谱和社交网络合作演化的简单规则”正文全部替换为中文。翻译前英文原文页面含双栏正文、网络结构与公式 b/c k翻译后中文译文页面双栏排版、图表、图注编号全部保留再看一个带密集数学公式的教材页左右分别是英文原页和中文译页公式编号 34.32–34.41 和行间公式均原样保留仅正文被翻译新手最常被问的3个问题问装不上或者报错一般是什么原因先确认 Python 版本在 3.11 到 3.12 之间版本过老或过新都会装不上。Windows 下如果双击 exe 打不开装一下 VC 运行库再试一次。问第一次运行时卡在网络下载上程序首次运行要下载一个版面检测模型DocLayout-YOLO ONNX 版。如果迟迟下不动在命令行里设置镜像源再运行set HF_ENDPOINThttps://hf-mirror.comPowerShell 用户写$env:HF_ENDPOINT https://hf-mirror.com。更多网络排障思路见 代理配置文档。问扫描版的 PDF 能直接用吗不行。这个工具读取的是 PDF 里嵌入的文字层扫描出来的图像型 PDF 里没有可提取文本需要先用 OCR 转成文字版 PDF 再送进来。它最擅长的是学术论文、教材、技术报告这类矢量 PDF。小结PDFMathTranslate 的核心就一句话AI 翻译 PDF 全文版式和公式不动输出中文加双语两个文件。下一步动作找一份手头要读的英文 PDF先用-p 1只试译第一页确认排版没问题后再跑全文。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表