
BabelDOC 使用教程一条命令把外文 PDF 翻成保留原排版的双语中文【免费下载链接】BabelDOCYet Another Document Translator项目地址: https://gitcode.com/GitHub_Trending/ba/BabelDOC手头有几份英文 PDF 要啃逐句复制进在线翻译又得手动拼回排版还经常把公式和表格弄丢。BabelDOC 是一个免费开源的 PDF 文档翻译工具它直接处理 PDF 文件把英文内容翻译成中文译文字回到原来的位置公式、表格保持不动并额外输出一份双语对照版。下面从安装讲起到只翻指定页码、批量处理、锁定术语全部是现成命令。 项目速览BabelDOC 是什么这一节回答两个问题它解决什么、值不值得装。读完你可以确定它适不适合你的文档。BabelDOC 是一个 PDF 翻译库和命令行工具主要面向英文转中文场景既可以直接命令行使用也可以作为库嵌进自己的程序。四个核心能力排版原位回填翻译后的文字放回原文位置公式、表格、图片位置不变读起来仍是原来那份文档。双语与单语双版本一次运行同时产出纯中文 PDF 和原文译文并排的双语对照 PDF核对原文不用来回翻文件。翻译服务自带缓存同一段文字只翻译一次重跑或处理重复内容时直接复用结果省时间和 API 费用。术语可控支持自定义 CSV 术语表也内置自动术语抽取领域词汇的译法可以锁死。⚡ 最短上手路径一条命令安装一条命令翻译这一节只做两件事装好 BabelDOC跑出第一个译文。全程两条命令。环境要求先装好 uvPython 包与工具管理器它会自动管理 Python 3.12 环境不需要你手动配虚拟环境。第一条命令安装 BabelDOCuv tool install --python 3.12 BabelDOC跑完后用babeldoc --version能打印版本号说明安装成功。第二条命令翻译第一份 PDF翻译服务以 OpenAI 兼容接口接入把 API 地址和密钥换成你自己的babeldoc --files paper.pdf \ --lang-in en --lang-out zh \ --openai --openai-model gpt-4o-mini \ --openai-base-url https://api.openai.com/v1 \ --openai-api-key 你的API密钥跑完后终端会滚动进度条目录里多出一个单语中文 PDF 和一个双语对照 PDF默认带翻译水印。如果只想用仓库源码运行先git clone https://gitcode.com/GitHub_Trending/ba/BabelDOC进入目录后把命令换成uv run babeldoc ...即可。 三个高频场景指定页码、批量翻译、锁定术语这一节覆盖实际使用中出镜率最高的三个场景每个场景一条命令照抄即可。只翻指定页码。想先试读前几页或只处理正文部分用--pages参数babeldoc --files paper.pdf --pages 1-5 --lang-in en --lang-out zh ...跑完后只有第 1 到 5 页有译文其余页面保持原样1,2,1-,-3,3-5这类写法都支持。一次翻多份文档。--files可以重复书写每份文件独立产出babeldoc --files a.pdf --files b.pdf --lang-in en --lang-out zh ...跑完后两份 PDF 各自在输出目录生成对应的单语和双语文件互不影响。锁定领域术语。把专业词汇整理成 CSV 术语表第一行是表头之后每行「源词,译词,目标语言」source,target,tgt_lng attention,注意力,zh-CN transformer,变换器,zh-CNbabeldoc --files paper.pdf --glossary-files glossary.csv ...跑完后这些词汇在译文中固定使用你指定的译法不会随上下文漂移不想手动整理时项目内置的自动术语抽取会先扫全文提取候选术语也可配合保存选项落盘复用。 核心机制缓存、术语与进度这一节点破三个模块的作用帮你判断哪些能力是免费的、哪些行为可以预期。babeldoc/translator/cache.py翻译结果按「引擎参数原文」存入本地缓存重复内容不再请求翻译服务帮你省 API 开销和等待时间想强制重译时加--ignore-cache。babeldoc/glossary.py加载 CSV 术语表并参与翻译流程保证领域词汇译法一致帮你省逐篇校对术语的心。babeldoc/progress_monitor.py驱动终端里的进度条大文档翻译时随时知道还剩多少。⚠️ 避坑指南三个高频问题的处理这一节把新手最常碰到的三个问题按「现象 → 处理」列出来每个都能一条命令解决。现象译文 PDF 在某些阅读器里字体或排版异常。处理加--enhance-compatibility重新生成它会一次启用三项兼容性增强选项。现象扫描版 PDF 翻译后译文叠在扫描文字上画面重叠。处理加--ocr-workaround译文区域会垫上白色背景盖住原文适合白底黑字的扫描件。现象几百页的大文档一次性翻译耗时很长中途卡住要全部重来。处理加--max-pages-per-part 50分批翻译并自动合并回一份完整 PDF。下一步BabelDOC 把「翻译外文 PDF 并保住排版」这件事压缩成了几条可复制的命令翻译服务、缓存、术语控制都已内置。建议从一份十页以内的小 PDF 开始用上面的第二条命令跑通一遍再按需叠加页码、批量和术语表参数——这些参数组合好之后长期处理文档基本不用再查文档。【免费下载链接】BabelDOCYet Another Document Translator项目地址: https://gitcode.com/GitHub_Trending/ba/BabelDOC创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考