您在旅行时遇到了您无法阅读的语言的标志、菜单、文档或标签。您拿出手机,打开相机,然后将其对准文本。在屏幕上,外文字符会实时转换成您的语言,叠加在摄像机视图上,就好像标志本身是用您的母语书写的一样。这不是科幻小说。它现在已内置于您的手机中。它是手机内置的基于摄像头的翻译,也适用于 PDF。
使用手机摄像头翻译 PDF 中的文本时,将 OCR(识别图像中的文本)与机器翻译(将其转换为目标语言)相结合。该过程有两种模式:针对打印文档的实时相机翻译,以及针对 PDF 屏幕截图和照片的静态图像翻译。两者都可以通过手机上已有的免费工具获得。

方法 1:打印 PDF 和纸质文档的实时相机翻译
谷歌翻译的相机模式适用于 iPhone 和 Android。打开谷歌翻译应用程序。选择源语言,或者如果您不确定文档使用的语言,请将其设置为“检测语言”。选择您的目标语言。点击相机图标。将手机的摄像头对准打印的文档或在另一个屏幕上打开的 PDF。该应用程序将翻译后的文本直接实时叠加到相机视图上。原文被译文所取代,并与相同的位置和视角对齐。这种增强现实视图可让您阅读文档,就像它是用您的语言打印的一样。
实时翻译运行速度很快,每屏文本处理时间大约为一秒,但它并不完美。翻译由谷歌的机器翻译引擎执行,该引擎可以很好地处理常见语言对,但对于惯用表达、专业术语和训练数据有限的语言会产生尴尬或不正确的翻译。使用实时翻译进行理解:理解文档的内容。不要依赖它来生成精美的翻译来与他人分享。为此,您需要一个可以审阅和编辑的静态翻译。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
方法 2:使用手机的照片应用程序翻译 PDF 屏幕截图或照片
如果您在手机上打开了 PDF 并且想要翻译特定部分,请截取屏幕截图。在 iPhone 上,同时按下侧面按钮和调高音量。在 Android 上,按电源按钮和音量调低按钮。屏幕截图保存到您的照片库。在 Google 照片或 Apple 照片中打开照片,然后使用内置的翻译 PDF文本识别来提取和翻译文本。
在 Google Photos 中,打开屏幕截图并点击 Google Lens 图标。 Lens 会检测文本并提供翻译选项。选择目标语言,翻译后的文本将显示在图像上。您可以点击单个单词来查看原文,或复制翻译后的文本以粘贴到其他地方。在 iPhone 上的 Apple Photos 中,实时文本功能会检测文本,并在您选择文本时提供翻译选项。翻译出现在弹出窗口中。这两种方法都可以在最新设备上离线进行文本识别,但翻译步骤需要互联网连接。
方法 3:使用基于浏览器的工具进行完整文档翻译
为了翻译整个 PDF 文档,而不仅仅是屏幕截图,基于浏览器的翻译工具会处理整个文件。打开手机浏览器,导航至翻译工具,然后上传 PDF。如果 PDF 是扫描件,该工具会执行 OCR、提取文本、翻译文本并生成翻译后的 PDF。输出保留原始布局,翻译后的文本放置在与原始文本相同的位置。这是您需要完整阅读、与他人共享或翻译存档的文档的方法。
基于浏览器的方法可以有效地处理多页文档。上传一次,等待处理,然后下载完整的翻译文件。翻译质量与主要机器翻译引擎相同,因为WukongPDF 使用相同的底层技术。与基于屏幕截图的翻译相比,其优势在于完整性:每个页面的每个单词都会被翻译,并且输出是正确的 PDF,而不是手机屏幕截图的集合。
了解电话翻译能做什么和不能做什么
基于电话的PDF阅读翻译对于采用常见字体和可读尺寸的打印文本效果最佳。它很难处理手写、高度风格化的字体、弯曲或反光表面上打印的文本以及尺寸非常小的文本(例如标签上的细则印刷)。它还难以处理在同一页面上混合多种语言的文档,例如双语合同或包含一种语言的菜肴名称和另一种语言的描述的菜单。翻译引擎必须猜测每个片段所使用的语言,并且它经常猜测错误,从而产生令人困惑的结果。
翻译技术、法律或医疗文件需要特别小心。机器翻译不能像人工翻译那样理解上下文。在源语言中具有多种含义的单词在目标语言中可能会被翻译成错误的含义。具有特定法定定义的法律术语可以翻译为不具有相同法律效力的口语等效术语。对于精确含义很重要的文档,请使用电话翻译进行初步理解,然后如果将依赖该文档做出决策,则请阅读两种语言的人员对翻译进行审核。
保存和共享电话翻译
翻译 PDF 屏幕截图或照片后,您通常想要保存结果。 Google Lens 允许您复制翻译后的文本并将其粘贴到笔记、电子邮件或文档中。 Apple 的 Live Text 同样可以让您复制已识别和翻译的文本。为了获得更持久的记录,完整文档翻译会生成一个 PDF,您可以保存、共享和存档。翻译后的 PDF 可以在任何设备上打开并像任何其他文档一样阅读。
手机摄像头已悄然成为消费者可用的最强大的翻译工具之一。它将高分辨率摄像头与设备上的 OCR 和基于云的机器翻译结合在一起,并且可以放入口袋中。对于旅行者、国际商人、使用外语资源的研究人员以及任何遇到无法阅读的文本的人来说,将手机指向 PDF 并以自己的语言查看它的能力是十年前不存在的真正的超能力。 WukongPDF 将该功能从快照扩展到完整文档,使基于电话的翻译适用于所有 PDF 内容。
对于需要翻译非拉丁文字语言(中文、日语、韩语、阿拉伯语、俄语)的 PDF 的用户来说,手机摄像头方法还有一个额外的优势。传统的基于文本提取的翻译通常无法处理这些脚本,因为 OCR 引擎必须识别数千个唯一字符,而不是几十个字母。基于相机的翻译绕过字符级识别并在视觉模式级别工作,将整个字符形状与翻译模型进行匹配,而不是识别单个字母。这种视觉方法对于中文和日文特别有效,谷歌翻译的相机模式可以生成可读的文档翻译,这将完全击败基于文本的 OCR 翻译管道。从技术意义上来说,视觉路径并不更准确,但它的失败方式不同,对于某些语言和文档组合,它在基于文本的翻译完全失败的情况下成功了。
尝试翻译 PDF
无需安装。直接在您的浏览器中工作。
