将 PDF 文档翻译成另一种语言应该产生以目标语言自然阅读的输出,同时忠实地保留原始文档的视觉设计。在实践中,翻译经常会带来格式问题。当目标语言使用原始字体中不存在的字形时,字符就会消失。由于译文通常比源文本长,文本会溢出其容器。随着文本重排更改元素位置,布局也会发生变化。出现这些问题的原因是翻译过程更改了文本内容,而没有调整围绕原始语言文本长度和字符集设计的文档结构。
在翻译 PDF 的同时保留嵌入字体和格式需要在翻译开始之前注意三个因素。字体嵌入可确保目标语言所需的所有字符都实际存在于 PDF 文件中。文本容器大小调整可适应在语言之间翻译文本时发生的扩展或收缩。尊重 PDF 结构的翻译工作流程会保留文档布局,同时仅替换文本内容。
WukongPDF 的翻译工具在语言转换过程中保留PDF 字体 和PDF 格式 文档结构和字体保真度,应对通用翻译方法带来的格式挑战。

为什么翻译会破坏 PDF 格式
PDF 页面布局是围绕最初创建文档时出现的特定文本而设计的。每个文本块在页面上都有固定的位置和固定的像素尺寸。当占据文本框的原始英语文本被替换为通常长百分之二十到三十的德语翻译时,翻译后的文本在物理上可能不适合原始文本容器的边界。文本末尾的字符可能会被剪切并且不可见,或者文本可能会溢出到相邻的页面元素中,从而造成视觉混乱。
字体兼容性代表一类单独且同等重要的格式化失败。原始文档是使用包含源语言所需的字符集的字体编写的。如果目标语言翻译包含这些字体中不存在的字符,例如法语或西班牙语中的重音字母、俄语中的西里尔字母或中文、日语或韩语中的 CJK 字形,则 PDF 阅读器必须替换不同的字体来显示这些字符。替代字体几乎肯定与原始字体具有不同的字符宽度、字母间距和行高度量,导致文本在其容器内回流,并且对齐方式在页面上中断。
第三个也是更微妙的问题涉及 PDF 文件中的文本编码。直接替换 PDF 数据流中的文本的翻译工具可能会更改字符编码,而不会相应地更新字体引用。 PDF 阅读器遇到使用一种标准编码的文本,但被告知使用需要不同编码的字体呈现它,则会显示不正确的字形。视觉结果是乱码文本,显示为随机符号而不是可读字符,即使技术上正确的翻译文本存在于文件数据中。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
步骤 1:翻译前验证并嵌入所有字体
在开始任何翻译工作之前,请验证 PDF 中使用的每种字体是否完全嵌入到文件中,而不是仅仅通过名称引用。在 Acrobat Pro 中打开 PDF,导航至“文件”、“属性”,然后选择“字体”选项卡。列出的每个字体都应在其名称旁边显示“嵌入”或“嵌入子集”状态。如果任何字体显示“未嵌入”,则该字体数据实际上并不存在于 PDF 文件中,PDF 阅读器必须在本地计算机系统上找到匹配的字体才能呈现文本。
要嵌入当前未嵌入的字体,请返回到其原始创作应用程序(例如 Microsoft Word 或 Adobe InDesign)中的源文档,并在启用字体嵌入的情况下重新生成 PDF。在 Microsoft Word 中,转到“文件”、“选项”、“保存”,然后选中标记为“在文件中嵌入字体”的选项。在 Adobe InDesign 中,“导出到 PDF”对话框包括一个“字体”部分,其中嵌入阈值可以设置为 100%,以确保包含每种字体的每个字符。如果源文档不再可用,Acrobat Pro 印刷制作下的印前检查工具可以尝试从本地系统查找并嵌入丢失的字体。
嵌入字体后,重新打开“字体”选项卡并确认每个条目现在都显示“嵌入”状态,以验证嵌入是否成功。通过选择使用每种字体的文本并确认可以在没有字体替换警告的情况下对其进行编辑来测试嵌入字体。完全嵌入的字体集是在不损坏格式的情况下进行翻译的最重要的先决条件。
步骤 2:为翻译扩展准备文本容器
不同的语言需要不同的空间来表达相同的内容。英语到德语的翻译通常会将文本长度扩展百分之二十到百分之三十。英语到西班牙语或法语的比例扩大了百分之十五到百分之二十五。英语到汉语或日语的翻译通常会缩短百分之二十到百分之三十。翻译之前,评估现有文本容器是否能够在物理上适应目标语言中预期的长度变化。
如果源文档可用于编辑,请在预计翻译扩展的区域增加文本框尺寸或少量减小字体大小。将字体大小缩小半点到整点即可吸收百分之二十的文本扩展,而不会在文档外观中产生明显的变化。将文本框加宽几毫米可以达到相同的效果。如果源文档不可用,请计划在翻译完成后手动调整翻译后的 PDF 中的字体大小和文本框尺寸。
具有多列布局、狭窄侧边栏、密集表格或紧紧围绕图像的文本的 PDF 最容易出现翻译引起的格式问题。这些复杂的布局需要翻译前最仔细的准备和翻译后最彻底的验证。对于布局复杂的关键文档,请考虑委托专门处理格式化 PDF 内容的专业翻译服务,而不是使用自动化工具。
步骤 3:选择保留结构的翻译方法
并非所有 PDF 翻译方法都能以同等能力处理格式保存。从 PDF 中提取文本、在外部翻译提取的文本,然后将翻译后的文本重新插入原始 PDF 位置的工具通常比将 PDF 转换为中间可编辑格式、以该格式翻译整个文档,然后转换回 PDF 的工具保留更多的文档格式。提取-翻译-重新插入方法保持文档结构不变,仅修改每个文本位置的文本内容。
对于整个 PDF 文档的自动翻译,DeepL 和 Google Translate 都提供直接 PDF 文件上传和翻译,并保留格式。 DeepL 通常比谷歌翻译能提供更好的格式保存,特别是对于其训练数据最广泛的欧洲语言对。将 PDF 上传到翻译服务,选择目标语言,然后下载翻译结果。在分发翻译后的文档之前,系统地检查输出的每一页是否存在格式问题。
在文档工作流程中,对于格式保真度至关重要的文档,专门从事文档翻译的专业翻译服务会使用专门设计的商业工具,以便在翻译工作流程中保留 PDF 布局。当视觉呈现是文档目的不可或缺的一部分时,例如营销材料、法律文件或面向客户的出版物,格式化感知的专业翻译服务的额外成本是合理的。
步骤 4:翻译后格式验证
收到翻译后的 PDF 后,在将文档分发给目标受众之前进行系统的格式审查。检查每个页面是否有文本溢出,即翻译后的文本超出其容器的可见边界并在单词中间被切断。检查字体替换,其中某些字符或整个段落以与周围文本不同的字体显示,表明原始字体缺少必要的字形。检查对齐偏移,即原件中居中或右对齐的翻译文本在输出中已偏移为不同的对齐方式。
以相同的缩放级别并排比较翻译后的 PDF 与原始源文档。视觉并排比较可以发现各个页面评论所遗漏的格式差异,因为这些问题体现在两个版本中元素之间的相对位置上。单独查看翻译后的文档时,向右移动几毫米的徽标可能并不明显,但当同时查看原文和译文时,徽标会立即变得明显。
在文档工作流程中,对于将要专业打印的已翻译文档,请在目标打印机上从已翻译的 PDF 中打印单个测试页。颜色、边距和字体呈现在纸张上与在屏幕上可能有所不同。在提交完整的打印运行之前,测试打印会捕获特定于打印的格式问题。
如果在翻译之前做好准备并在翻译之后进行验证,就可以在不丢失字体和格式的情况下翻译 PDF。字体嵌入可确保无论目标语言如何,都能正确呈现字符。容器大小可适应不同语言之间的文本长度变化。保留结构的翻译工具在替换文本内容的同时保持文档布局。翻译后审核可在文档到达受众之前发现并纠正剩余的格式问题。这四个步骤将 PDF 翻译从格式化赌博转变为可靠、可重复的过程,始终产生专业的结果。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
