PDF翻译需先判别类型:可选中文为文本型,否则为扫描型;文本型用DeepL或Acrobat直译保形,扫描型须先OCR再翻译,排版错乱时用Word中转法并嵌入字符。

PDF文档外语翻译不是简单复制粘贴文字再丢给翻译引擎,一旦忽略文件类型和结构特征,译文就会出现段落错位、表格塌陷、公式乱码、页眉页脚消失等问题。可编辑PDF与扫描PDF的处理路径完全不同,强行用同一套流程处理,轻则重排三天,重则整份文档无法交付。
先判断PDF类型,再选对应方案
打开PDF后,用鼠标拖选任意一段正文:能高亮并复制出完整句子→是【文本型PDF】;光标变成十字箭头、无法选中文字→是【扫描型PDF】。前者直接走语义解析路线,后者必须先过OCR关卡。跳过这一步就上传翻译,90%概率导出空白页或满屏方块字。
若PDF含混合页面(前几页是扫描件、后几页是可编辑文本),需用Adobe Acrobat或福昕PDF编辑器单独导出扫描页为新文件,再分批处理。
文本型PDF:用DeepL或Adobe Acrobat直译保形
这类文件自带文字层和基础样式锚点,翻译工具只要正确解析文本流顺序,就能还原排版。
方法一:DeepL文档翻译(推荐)
① 打开 deepl.com → 点击顶部“文档”标签 → 拖入PDF文件;
② 系统自动识别源语言,若识别错误,手动改为“英语”→“中文”;
③ 等待进度条走完,点击“下载PDF”即可。它默认启用坐标重排,标题层级、列表缩进、表格边框全部按原位置复现,连页眉里的公司Logo位置都不会偏移1像素。
方法二:Adobe Acrobat Online(适合含公式/脚注的学术PDF)
第一步:访问 acrobat.adobe.com/online/pdf-translator → 拖入文件;
第二步:在设置中勾选“启用高级文本识别”+“保留原始字体与间距”;
第三步:点击“翻译”,预览时重点检查数学符号是否被替换成乱码、脚注编号是否仍链接到正文对应位置。
扫描型PDF:必须过OCR再翻译
OCR不是万能开关,不同工具对模糊、倾斜、小字号文字的识别率差异极大。选错OCR引擎,后面所有翻译都是无用功。
方法一:福昕在线翻译(对中文用户最友好)
- 上传后自动触发多轮OCR:先粗扫定位文字区块,再逐行精读字符,最后校验上下文语义;
- 翻译时同步重建段落盒模型,确保“左栏→右栏”阅读顺序不被颠倒;
- 下载前可点击“双语对照”查看原文段落与译文是否一一匹配,避免某段被吞掉或重复翻译。
方法二:Yandex.Translate(适合英文模糊扫描件)
- 进入 yandex.com/translate/doc → 上传PDF → 开启“OCR模式”;
- 它的OCR底层调用的是俄罗斯国家OCR库,对低对比度、手写体混排的英文扫描页识别准确率比通用引擎高23%;
- 注意:译文下载为PDF后,务必用Ctrl+F搜索原文中出现的专有名词,确认是否被误识为其他单词(例如“Thermodynamics”被识成“Thermodynamies”)。
排版已乱但必须救:用Word中转法强行锁格式
当在线工具反复失败,或PDF含大量浮动图片、文本框、艺术字时,放弃“一键保排”幻想,改用可控性最强的本地中转链路。
1. 在Microsoft Word 2021或WPS Office中打开PDF → 弹窗选择“保留源格式”而非“匹配目标格式”;
2. 转换完成后全选 → Ctrl+C复制全部内容 → 新建空白Word文档 → 右键选择“只保留文本”粘贴(这一步清除所有不可见格式标记);
3. 再全选 → “审阅”选项卡 → “翻译”→“翻译所选内容”→ 勾选“保持格式”;
4. 翻译完毕,执行“文件→另存为→PDF”→ 在导出选项中【必须勾选“嵌入所有字符”】,否则中文标点会变成方块。

















