將 PDF 文件翻譯成另一種語言應該產生以目標語言自然閱讀的輸出,同時忠實地保留原始文件的視覺設計。在實踐中,翻譯經常會帶來格式問題。當目標語言使用原始字體中不存在的字形時,字元就會消失。由於譯文通常比原文長,文本會溢出其容器。隨著文字重排更改元素位置,佈局也會改變。出現這些問題的原因是翻譯過程更改了文字內容,而沒有調整圍繞原始語言文字長度和字元集設計的文件結構。
在翻譯 PDF 的同時保留嵌入字體和格式需要在翻譯開始之前註意三個因素。字體嵌入可確保目標語言所需的所有字元都實際存在於 PDF 檔案中。文字容器大小調整可適應在語言之間翻譯文字時發生的擴展或收縮。尊重 PDF 結構的翻譯工作流程會保留文件佈局,同時僅取代文字內容。
WukongPDF 的翻譯工具在語言轉換過程中保留PDF 字體 和PDF 格式 文檔結構和字體保真度,應對通用翻譯方法帶來的格式挑戰。

為什麼翻譯會破壞 PDF 格式
PDF 頁面佈局是圍繞最初建立文件時出現的特定文字而設計的。每個文字區塊在頁面上都有固定的位置和固定的像素尺寸。當佔據文字方塊的原始英文文字被替換為通常長百分之二十到三十的德文翻譯時,翻譯後的文字在物理上可能不適合原始文字容器的邊界。文字末尾的字元可能會被剪下且不可見,或者文字可能會溢出到相鄰的頁面元素中,從而造成視覺混亂。
字體相容性代表一類單獨且同等重要的格式化失敗。原始文件是使用包含來源語言所需的字元集的字體編寫的。如果目標語言翻譯包含這些字體中不存在的字符,例如法語或西班牙語中的重音字母、俄語中的西里爾字母或中文、日語或韓語中的 CJK 字形,則 PDF 閱讀器必須替換不同的字體來顯示這些字符。替代字體幾乎肯定與原始字體具有不同的字元寬度、字母間距和行高度量,導致文字在其容器內回流,並且對齊方式在頁面上中斷。
第三個也是更微妙的問題涉及 PDF 文件中的文字編碼。直接取代 PDF 資料流中的文字的翻譯工具可能會變更字元編碼,而不會相應地更新字型引用。 PDF 閱讀器遇到使用一種標準編碼的文本,但被告知使用需要不同編碼的字體呈現它,則會顯示不正確的字形。視覺結果是亂碼文本,顯示為隨機符號而不是可讀字符,即使技術上正確的翻譯文本存在於文件資料中。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
步驟 1:翻譯前驗證並嵌入所有字體
在開始任何翻譯工作之前,請先驗證 PDF 中使用的每種字體是否完全嵌入到文件中,而不是僅僅透過名稱引用。在 Acrobat Pro 中開啟 PDF,導覽至“檔案”、“屬性”,然後選擇“字型”標籤。列出的每個字體都應在其名稱旁邊顯示“嵌入”或“嵌入子集”狀態。如果任何字體顯示“未嵌入”,則該字體資料實際上並不存在於 PDF 文件中,PDF 閱讀器必須在本機電腦系統上找到匹配的字體才能呈現文字。
若要嵌入目前未嵌入的字體,請返回其原始創作應用程式(例如 Microsoft Word 或 Adobe InDesign)中的來源文檔,並在啟用字體嵌入的情況下重新產生 PDF。在 Microsoft Word 中,前往“檔案”、“選項”、“儲存”,然後選取標記為“在檔案中嵌入字體”的選項。在 Adobe InDesign 中,「匯出到 PDF」對話方塊包括一個「字體」部分,其中嵌入閾值可以設定為 100%,以確保包含每種字體的每個字元。如果原始文件不再可用,Acrobat Pro 印刷製作下的印前檢查工具可以嘗試從本機系統尋找並嵌入遺失的字體。
嵌入字體後,重新開啟「字體」標籤並確認每個條目現在都顯示「嵌入」狀態,以驗證嵌入是否成功。透過選擇使用每種字體的文字並確認可以在沒有字體替換警告的情況下對其進行編輯來測試嵌入字體。完全嵌入的字體集是在不損壞格式的情況下進行翻譯的最重要的先決條件。
步驟 2:為翻譯擴展準備文本容器
不同的語言需要不同的空間來表達相同的內容。英語到德語的翻譯通常會將文字長度擴展百分之二十到百分之三十。英語到西班牙語或法語的比例擴大了百分之十五到百分之二十五。英語到漢語或日語的翻譯通常會縮短百分之二十到百分之三十。在翻譯之前,評估現有文本容器是否能夠在物理上適應目標語言中預期的長度變化。
如果原始文件可用於編輯,請在預計翻譯擴充的區域增加文字方塊尺寸或少量縮小字體大小。將字體大小縮小半點到整點即可吸收百分之二十的文字擴展,而不會在文件外觀中產生明顯的變化。將文字方塊加寬幾毫米可以達到相同的效果。如果原始文件不可用,請規劃在翻譯完成後手動調整翻譯後的 PDF 中的字體大小和文字方塊尺寸。
具有多列佈局、狹窄側邊欄、密集表格或緊緊圍繞圖像的文本的 PDF 最容易出現翻譯引起的格式問題。這些複雜的佈局需要翻譯前最仔細的準備和翻譯後最徹底的驗證。對於佈局複雜的關鍵文檔,請考慮委託專門處理格式化 PDF 內容的專業翻譯服務,而不是使用自動化工具。
步驟 3:選擇保留結構的翻譯方法
並非所有 PDF 翻譯方法都能以同等能力處理格式儲存。從 PDF 中提取文本、在外部翻譯提取的文本,然後將翻譯後的文本重新插入原始 PDF 位置的工具通常比將 PDF 轉換為中間可編輯格式、以該格式翻譯整個文檔,然後轉換回 PDF 的工具保留更多的文檔格式。提取-翻譯-重新插入方法保持文檔結構不變,僅修改每個文字位置的文字內容。
對於整個 PDF 文件的自動翻譯,DeepL 和 Google Translate 都提供直接 PDF 文件上傳和翻譯,並保留格式。 DeepL 通常比Google翻譯能提供更好的格式保存,特別是對於其訓練資料最廣泛的歐洲語言對。將 PDF 上傳到翻譯服務,選擇目標語言,然後下載翻譯結果。在分發翻譯後的文件之前,有系統地檢查輸出的每一頁是否有格式問題。
在文件工作流程中,對於格式保真度至關重要的文檔,專門從事文檔翻譯的專業翻譯服務會使用專門設計的商業工具,以便在翻譯工作流程中保留 PDF 佈局。當視覺呈現是文件目的不可或缺的一部分時,例如行銷資料、法律文件或面向客戶的出版物,格式化感知的專業翻譯服務的額外成本是合理的。
步驟 4:翻譯後格式驗證
收到翻譯後的 PDF 後,在將文件分發給目標受眾之前進行系統的格式審查。檢查每個頁面是否有文字溢出,即翻譯後的文字超出其容器的可見邊界並在單字中間被切斷。檢查字體替換,其中某些字元或整個段落以與周圍文字不同的字體顯示,表明原始字體缺少必要的字形。檢查對齊偏移,即原件中居中或右對齊的翻譯文字在輸出中已偏移為不同的對齊方式。
以相同的縮放等級並排比較翻譯後的 PDF 與原始來源文件。視覺並排比較可以發現各個頁面評論所遺漏的格式差異,因為這些問題體現在兩個版本中元素之間的相對位置。單獨查看翻譯後的文件時,向右移動幾毫米的徽標可能並不明顯,但當同時查看原文和譯文時,徽標會立即變得明顯。
在文件工作流程中,對於將要專業列印的已翻譯文檔,請在目標印表機上從已翻譯的 PDF 列印單一測試頁。顏色、邊距和字型呈現在紙張上與在螢幕上可能有所不同。在提交完整的列印運行之前,測試列印會捕獲特定於列印的格式問題。
如果在翻譯之前做好準備並在翻譯之後進行驗證,就可以在不丟失字體和格式的情況下翻譯 PDF。字體嵌入可確保無論目標語言為何,都能正確呈現字元。容器大小可適應不同語言之間的文字長度變化。保留結構的翻譯工具在取代文字內容的同時保持文件佈局。翻譯後審核可在文件到達受眾之前發現並修正剩餘的格式問題。這四個步驟將 PDF 翻譯從格式化賭博轉變為可靠、可重複的過程,始終產生專業的結果。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
