
5分钟上手 BabelDOC零基础完成 PDF 文档翻译的完整指南【免费下载链接】BabelDOCYet Another Document Translator项目地址: https://gitcode.com/GitHub_Trending/ba/BabelDOC是不是常常遇到这种情况拿到一篇英文 PDF普通机器翻译内容倒是出来了公式却挪了位、段落挤成一行想对照原文还得两个窗口来回翻BabelDOC 是一个开源的 PDF 文档翻译工具它先解析原文档的排版再逐段翻译最后把译文按原文位置重新排版输出保留原格式的译文 PDF外加一份左右对照的双语 PDF。5分钟装好环境系统要求只有 Python 3.12 和 uv 包管理器没有 uv 的话先按它的说明装好然后三条命令搞定git clone https://gitcode.com/GitHub_Trending/ba/BabelDOC cd BabelDOC uv run babeldoc --help看到终端里列出全部参数选项说明环境就绪 ✅ 如果不想 clone 源码也可以用uv tool install --python 3.12 BabelDOC直接装 PyPI 上的打包版本。功能亮点把格式留住双语对照左右并排默认输出的双语文档是原文在左、译文在右的并排版式也可以用--use-alternating-pages-dual换成原文页、译文页交替排列。对照着读不再需要在两个文件之间切换一份文档就齐了。公式、图表基本不乱跑它会先做文档版面分析区分出文本、图、表和公式区域翻译时只替换文字。像 f(x)3x1 这类公式和图注都基本留在原处省去了翻译后重新核排版的返工。术语先提炼再翻译翻译开始前它会自动从文档里提炼高频术语并附进翻译提示词你也可以通过--glossary-files导入自己的 CSV 术语表——就像给翻译员发一张生词表专业词汇前后统一不跑偏。三步出双语文档第 1 步准备一个 OpenAI 兼容的翻译接口BabelDOC 靠 LLM 完成翻译所以你需要模型名、API 地址和密钥。任何 OpenAI 兼容的服务都行本地模型比如 Ollama也能接。第 2 步指定文档跑一条命令uv run babeldoc --files 你的.pdf --openai --openai-model gpt-4o-mini --openai-api-key 你的密钥 --openai-base-url 服务地址 --lang-in en --lang-out zh想只翻部分页可以加--pages 1-10。命令跑起来后终端会持续输出进度中途不用盯着。第 3 步在输出目录拿结果跑完后当前目录或-o指定的目录里会有两份文件一份纯译文的单语 PDF一份双语对照 PDF。排版和原文基本一致这样处理后的译文文档直接可用。进阶技巧遇到对应场景开对应开关如果你翻译的是专业领域文档导入自定义术语表CSV 三列是source/target/tgt_lng格式参考 docs/example/demo_glossary.csv。正文里出现术语时对应词条会自动带进翻译提示词。如果你的文档超过一百页加--max-pages-per-part 50它会按页数自动拆分、翻译完再合并回来同时调高--qps默认 4可以增加并发出稿更快。如果你的 PDF 肯定不是扫描件加--skip-scanned-detection跳过扫描检测提速反过来白底黑字的扫描 PDF 可以试--ocr-workaround它会在译文下面垫白色色块盖住原文。资源与下一步官方文档docs/各模块的实现细节在 docs/ImplementationDetails/涵盖 PDF 解析、段落划分、排版重排等示例文件examples/含基础排版、表格、公式等场景支持的语言列表docs/supported_languages.md无论你是啃外文论文的学生还是常和外语文档打交道的职场人都可以先拿一页 PDF 跑一遍试试 【免费下载链接】BabelDOCYet Another Document Translator项目地址: https://gitcode.com/GitHub_Trending/ba/BabelDOC创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考