
为什么翻译 PDF 而不是将文本复制到翻译工具
从 PDF 复制文本并将其粘贴到在线翻译工具中是本能的方法,但由于两个原因,它会产生较差的结果。
首先,从 PDF 复制文本通常会导致不必要的换行、段落碎片和格式丢失,从而使翻译后的文本难以重新组合成连贯的文档。其次,使用粘贴文本的翻译工具会翻译单词,但会丢失文档结构、标题、列表、表格和页面布局。
自动翻译会生成强大的初稿,人工审阅者可以对其进行改进,以实现准确性和自然表达。
翻译后的 PDF 保留了原始页面结构,可以轻松跨语言版本引用内容。
处理整个文档的翻译 PDF工具可在翻译文本内容时保留文档结构。标题仍然是标题。列表仍然是列表。这些段落仍然是段落。翻译后的文档看起来与原始文档相似,只是语言不同。这种结构保留对于布局有助于表达意义的文档(例如表格、手册、证书和法律文档)至关重要。
PDF Converter PDF 翻译方法认识到翻译不仅仅是文字。它是用目标语言生成可用的文档。翻译后的表格应保持可填写状态。翻译后的手册应保持可导航性。翻译后的证书应保持美观。保留文档的功能属性及其文本内容是 PDF 翻译与文本翻译的区别。
翻译后的文档的PDF导出应可用于与原始文档相同的用途。翻译好的小册子应该可以印刷了。翻译后的合同应已准备好可供签署。翻译后的报告应已准备好可供分发。翻译过程不应产生额外的工作以使翻译后的文档可用。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
如何逐步翻译 PDF 文档
选择支持您的语言对的 PDF 翻译工具。
包括 Google Translate 和 DeepL 在内的主要翻译平台现在支持直接 PDF 翻译,处理整个文档并生成翻译后的 PDF 输出。通过网络界面或移动应用程序将 PDF 上传到翻译工具。
选择源语言,或让工具自动检测它,然后选择目标语言。大多数工具支持数十种语言对。 Google 翻译支持 100 多种语言。 DeepL 支持数量较少但不断扩展的语言,以听起来更自然的翻译而闻名,尤其是对于欧洲语言对。
翻译工具处理 PDF 的每一页,提取文本,进行翻译,然后将翻译后的文本放回到页面布局中。处理时间取决于文档长度和翻译服务负载。 10 页的文档通常在一分钟内即可完成翻译。 100 页的文档可能需要几分钟的时间。
翻译完成后,下载翻译后的 PDF 并立即查看。将翻译后的文档的第一页和最后一页与原始文档进行比较,以验证翻译是否成功完成并且页面布局完好无损。请特别注意特殊元素,例如页眉、页脚、页码和图像标题。这些元素有时无法正确翻译,因为翻译引擎可能无法将它们识别为可翻译文本。
WukongPDF的翻译PDF工具直接处理文档并在翻译文本内容时保留原始格式。上传 PDF,选择目标语言,然后下载保持原始布局不变的翻译文档。
自动 PDF 翻译质量的期望
自动 PDF 翻译可为简单、真实的文本提供良好的结果。商务信函、技术文档、新闻文章和信息内容翻译得很好,因为语言直接且句子结构传统。文学文本、营销文案、法律语言以及带有文化参考或双关语的内容翻译效果较差,因为这些类型的文本依赖于自动翻译无法捕获的细微差别。
对于翻译准确性至关重要的文档,例如法律合同、医疗记录或出版质量的内容,自动翻译应被视为初稿。仔细审阅翻译,最好由精通两种语言的人工翻译人员审阅。自动翻译提供了一个强有力的起点,人工审阅者可以对其进行改进,以实现准确性和自然表达。
布局复杂的 PDF(包括多列文本、图像上的文本和紧凑的表格)给自动翻译带来了额外的挑战。翻译引擎在翻译之前必须正确识别文本的阅读顺序,而复杂的布局可能会混淆阅读顺序检测。特别仔细地检查翻译文档的这些部分,可以发现布局引起的翻译错误。
自动 PDF 翻译的质量持续快速提高。在大量多语言数据集上训练的神经机器翻译模型产生的翻译越来越自然且适合上下文。今天翻译的文档将明显优于两年前通过相同服务翻译的相同文档。
处理混合语言或非拉丁文字的 PDF
某些 PDF 在同一文档中包含多种语言的文本。产品手册可能在交替页面上有英语、法语和西班牙语的说明。学术文章可能会在英文翻译的同时引用原文的段落。大多数翻译工具将整个文档作为单一语言处理。对于混合语言 PDF,提取每种语言的页面或部分,并使用正确的源语言设置单独翻译它们。
具有从右到左文字(例如阿拉伯语、希伯来语和波斯语)的 PDF 需要支持双向文本处理的翻译工具。翻译后的文本必须正确放置在从右到左的页面布局中。并非所有 PDF 翻译工具都正确支持从右到左的文本放置。验证翻译后的文本是否以正确的方向流动,并且文本对齐方式遵循目标语言约定。
对于包含文本扫描图像而不是本机文本的 PDF,必须在翻译之前执行 OCR。 OCR 步骤识别扫描图像中的文本并创建可编辑的文本图层。然后翻译工具翻译识别的文本。最终翻译的准确性取决于 OCR 步骤的准确性。干净、高分辨率的扫描可产生更好的 OCR 结果,从而获得更好的翻译。
一些翻译工具支持批量处理多个 PDF。如果您有一组文档需要翻译成相同的目标语言,批处理会在一次操作中将它们全部翻译,而不是单独处理每个文档。对于经常接收外语文档并需要将其翻译以供内部审核的组织来说,这种批处理功能尤其有价值。
翻译过程中文档内容的隐私是一个重要的考虑因素。当您将 PDF 上传到在线翻译服务时,文档内容将传输到服务服务器并在服务服务器上进行处理。对于敏感或机密文档,请查看翻译服务隐私政策以了解如何处理您的文档数据。某些服务会保留上传的文档以提高质量。其他人翻译后立即删除它们。
对于出于法律或官方目的需要认证翻译的文件,自动翻译不能满足认证要求。经过认证的翻译必须由合格的翻译人员制作或审核,以证明翻译的准确性。自动翻译可以提供工作草案,然后由经过认证的翻译人员进行审查和认证。
对于格式、表格和图像复杂的文档,翻译后的 PDF 可能需要手动调整文本位置。翻译文本的长度通常与原始文本不同。德语文本通常比英语长 20% 到 30%。中文文本通常较短。这些长度差异可能会导致固定布局 PDF 中的文本溢出或过多空白。检查翻译后的文档是否存在布局问题。
翻译工具的选择应考虑您需要的语言对。有些工具在欧洲语言对方面表现出色。其他人为亚洲语言提供了更好的结果。 DeepL 被广泛认为是为欧洲语言提供最自然的翻译。谷歌翻译支持最广泛的语言。对于重要文档,可以尝试多种翻译工具并比较结果。
对于相同语言对和文档类型的重复翻译需求,创建一个简化流程的翻译工作流程。记录翻译工具、设置以及通常需要的任何翻译后调整。此记录的工作流程可确保一致的结果并减少每次翻译所需的时间。
翻译后的 PDF 应由阅读目标语言的人员(最好是熟悉文档主题的人员)进行审阅。自动翻译可能会生成语法正确的句子,但由于翻译引擎误解了源文本中的技术术语或歧义短语,因此传达了错误的含义。流利的演讲者的简短回顾可以发现这些含义错误。
翻译 PDF 手册或指南时,请验证翻译后的说明是否仍然可行。如果译者不理解技术上下文,在原文中读得很清楚的步骤在翻译中可能会变得含糊或令人困惑。使用翻译后的文档自行浏览翻译后的说明。如果您无法正确完成这些步骤,则翻译需要修改。
对于学术或研究 PDF,请保留原始文档和译文,以供参考和引用之用。在学术著作中引用翻译文件时,请同时引用原文和译文。原文提供了权威的文本。翻译为不阅读原文的读者提供了访问途径。
翻译后的 PDF 保留原始文档页数和布局结构。一份 20 页的英文报告变成了一份 20 页的西班牙语报告,具有相同的标题、相同的段落分隔符和相同的图像位置。这种结构保真度意味着西班牙语读者和英语读者可以逐页讨论文档,引用相同页码上的相同内容。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
