
為什麼翻譯 PDF 而不是將文本複製到翻譯工具
從 PDF 複製文字並將其貼上到線上翻譯工具中是本能的方法,但由於兩個原因,它會產生較差的結果。
首先,從 PDF 複製文字通常會導致不必要的換行、段落碎片和格式遺失,使翻譯後的文字難以重新組合成連貫的文件。其次,使用貼上文字的翻譯工具會翻譯單詞,但會遺失文件結構、標題、清單、表格和頁面佈局。
自動翻譯會產生強大的初稿,人工審查者可以對其進行改進,以實現準確性和自然表達。
翻譯後的 PDF 保留了原始頁面結構,可以輕鬆跨語言版本引用內容。
處理整份文件的翻譯 PDF工具可在翻譯文字內容時保留文件結構。標題仍然是標題。列表仍然是列表。這些段落仍然是段落。翻譯後的文檔看起來與原始文檔相似,只是語言不同。這種結構保留對於佈局有助於表達意義的文件(例如表格、手冊、證書和法律文件)至關重要。
PDF Converter PDF 翻譯方法認識到翻譯不僅僅是文字。它是用目標語言產生可用的文檔。翻譯後的表格應保持可填寫狀態。翻譯後的手冊應保持可導航性。翻譯後的證書應保持美觀。保留文件的功能屬性及其文字內容是 PDF 翻譯與文字翻譯的區別。
翻譯後的文件的PDF匯出應可用於與原始文件相同的用途。翻譯好的小冊子應該可以印刷了。翻譯後的合約應已準備好可供簽署。翻譯後的報告應已準備好可供分發。翻譯過程不應產生額外的工作以使翻譯後的文件可用。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
如何逐步翻譯 PDF 文檔
選擇支援您的語言對的 PDF 翻譯工具。
包括 Google Translate 和 DeepL 在內的主要翻譯平台現在支援直接 PDF 翻譯,處理整個文件並產生翻譯後的 PDF 輸出。透過網頁介面或行動應用程式將 PDF 上傳到翻譯工具。
選擇來源語言,或讓工具自動偵測它,然後選擇目標語言。大多數工具支援數十種語言對。 Google 翻譯支援 100 多種語言。 DeepL 支援數量較少但不斷擴展的語言,以聽起來更自然的翻譯而聞名,尤其是對於歐洲語言對。
翻譯工具處理 PDF 的每一頁,提取文本,進行翻譯,然後將翻譯後的文本放回頁面佈局中。處理時間取決於文件長度和翻譯服務負載。 10 頁的文件通常在一分鐘內即可完成翻譯。 100 頁的文檔可能需要幾分鐘的時間。
翻譯完成後,下載翻譯後的 PDF 並立即查看。將翻譯後的文件的第一頁和最後一頁與原始文件進行比較,以驗證翻譯是否成功完成且頁面佈局完好無損。請特別注意特殊元素,例如頁首、頁尾、頁碼和圖像標題。這些元素有時無法正確翻譯,因為翻譯引擎可能無法將它們識別為可翻譯文字。
WukongPDF的翻譯PDF工具直接處理文件並在翻譯文本內容時保留原始格式。上傳 PDF,選擇目標語言,然後下載保持原始佈局不變的翻譯文件。
自動 PDF 翻譯品質的期望
自動 PDF 翻譯可為簡單、真實的文字提供良好的結果。商務信函、技術文件、新聞文章和資訊內容翻譯得很好,因為語言直接且句子結構傳統。文學文本、行銷文案、法律語言以及帶有文化參考或雙關語的內容翻譯效果較差,因為這些類型的文本依賴於自動翻譯無法捕獲的細微差別。
對於翻譯準確性至關重要的文檔,例如法律合約、醫療記錄或出版品質的內容,自動翻譯應被視為初稿。仔細審閱翻譯,最好由精通兩種語言的人工翻譯人員來審閱。自動翻譯提供了一個強有力的起點,人工審查者可以對其進行改進,以實現準確性和自然表達。
版面複雜的 PDF(包括多列文字、圖像上的文字和緊湊的表格)為自動翻譯帶來了額外的挑戰。翻譯引擎在翻譯之前必須正確識別文字的閱讀順序,而複雜的佈局可能會混淆閱讀順序偵測。特別仔細檢查翻譯文件的這些部分,可以發現佈局引起的翻譯錯誤。
自動 PDF 翻譯的品質持續快速提升。在大量多語言資料集上訓練的神經機器翻譯模型產生的翻譯越來越自然且適合上下文。今天翻譯的文檔將明顯優於兩年前透過相同服務翻譯的相同文件。
處理混合語言或非拉丁文字的 PDF
某些 PDF 在同一文件中包含多種語言的文字。產品手冊可能在交替頁面上有英語、法語和西班牙語的說明。學術文章可能會在英文翻譯的同時引用原文的段落。大多數翻譯工具將整個文件作為單一語言處理。對於混合語言 PDF,提取每種語言的頁面或部分,並使用正確的來源語言設定單獨翻譯它們。
具有從右到左文字(例如阿拉伯語、希伯來語和波斯語)的 PDF 需要支援雙向文字處理的翻譯工具。翻譯後的文字必須正確放置在從右到左的頁面佈局中。並非所有 PDF 翻譯工具都正確支援從右到左的文字放置。驗證翻譯後的文字是否以正確的方向流動,並且文字對齊方式遵循目標語言約定。
對於包含文字掃描圖像而不是本機文字的 PDF,必須在翻譯之前執行 OCR。 OCR 步驟可辨識掃描影像中的文字並建立可編輯的文字圖層。然後翻譯工具翻譯辨識的文字。最終翻譯的準確性取決於 OCR 步驟的準確性。乾淨、高解析度的掃描可產生更好的 OCR 結果,從而獲得更好的翻譯。
一些翻譯工具支援批量處理多個 PDF。如果您有一組文件需要翻譯成相同的目標語言,批次會在一次操作中將它們全部翻譯,而不是單獨處理每個文件。對於經常接收外語文件並需要將其翻譯以供內部審核的組織來說,這種批次功能尤其有價值。
翻譯過程中文件內容的隱私是一個重要的考慮因素。當您將 PDF 上傳到線上翻譯服務時,文件內容將傳輸到服務伺服器並在服務伺服器上進行處理。對於敏感或機密文檔,請查看翻譯服務隱私權政策以了解如何處理您的文檔資料。某些服務會保留上傳的文件以提高品質。其他人翻譯後立即刪除它們。
對於出於法律或官方目的需要認證翻譯的文件,自動翻譯不能滿足認證要求。經過認證的翻譯必須由合格的翻譯人員製作或審核,以證明翻譯的準確性。自動翻譯可以提供工作草案,然後由經過認證的翻譯人員進行審查和認證。
對於格式、表格和圖像複雜的文檔,翻譯後的 PDF 可能需要手動調整文字位置。翻譯文本的長度通常與原始文本不同。德語文本通常比英語長 20% 到 30%。中文文字通常較短。這些長度差異可能會導致固定佈局 PDF 中的文字溢出或過多空白。檢查翻譯後的文件是否有佈局問題。
翻譯工具的選擇應考慮您需要的語言對。有些工具在歐洲語言對方面表現優異。其他人為亞洲語言提供了更好的結果。 DeepL 被廣泛認為是為歐洲語言提供最自然的翻譯。谷歌翻譯支援最廣泛的語言。對於重要文檔,可以嘗試多種翻譯工具並比較結果。
對於相同語言對和文件類型的重複翻譯需求,建立一個簡化流程的翻譯工作流程。記錄翻譯工具、設定以及通常需要的任何翻譯後調整。此記錄的工作流程可確保一致的結果並減少每次翻譯所需的時間。
翻譯後的 PDF 應由閱讀目標語言的人員(最好是熟悉文件主題的人員)進行審查。自動翻譯可能會產生語法正確的句子,但由於翻譯引擎誤解了來源文字中的技術術語或歧義短語,因此傳達了錯誤的含義。流利的演講者的簡短回顧可以發現這些含義錯誤。
翻譯 PDF 手冊或指南時,請驗證翻譯後的說明是否仍然可行。如果譯者不理解技術上下文,在原文中讀得很清楚的步驟在翻譯中可能會變得含糊或令人困惑。使用翻譯後的文件自行瀏覽翻譯後的說明。如果您無法正確完成這些步驟,則翻譯需要修改。
對於學術或研究 PDF,請保留原始文件和譯文,以供參考和引用之用。在學術著作中引用翻譯文件時,請同時引用原文和譯文。原文提供了權威的文本。翻譯為不閱讀原文的讀者提供了訪問途徑。
翻譯後的 PDF 保留原始文件頁數和佈局結構。一份 20 頁的英文報告變成了一份 20 頁的西班牙語報告,具有相同的標題、相同的段落分隔符號和相同的圖像位置。這種結構保真度意味著西班牙語讀者和英語讀者可以逐頁討論文檔,並引用相同頁碼上的相同內容。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
