翻譯 PDF 通常會用翻譯版本取代原始文字。源語言文字從輸出中消失。對於某些用例,將原始文字保留為翻譯旁邊的隱藏層是很有價值的。雙語讀者可以對照原文驗證譯文。未來的譯者無需找到原始文件就可以看到原始文本是什麼。搜尋引擎可以對兩種語言進行索引,從而使文件可以用任何一種語言找到。問題是翻譯 PDF工具是否可以在翻譯過程中保留原始文本圖層,以及在什麼條件下可以這樣做。
要點
大多數 PDF 翻譯工具都會用翻譯版本取代原始文字。將原始文字保留為隱藏層需要支援雙語或平行輸出的工具,其中原始文字作為翻譯文字下方的不可見層儲存。此功能在某些專業翻譯工具中可用,但在消費級 PDF 翻譯器中並非標準功能。另一種方法是翻譯 PDF 的副本,並將原件保留為單獨的參考文件。

PDF 文本圖層在翻譯過程中如何運作
文字擷取步驟是最複雜的地方。翻譯工具不僅必須提取可見文本,還必須記錄其確切位置、字體屬性和每個字元的編碼。將翻譯後的文字放回原位時,該工具需要原始文字的位置資料才能正確對齊新文字。將原始文字保留為隱藏層的工具必須儲存兩組完整的文字資料並管理它們的分層。這大約使文字處理工作量增加了一倍,這就是為什麼許多工具不提供此功能的原因。技術能力存在於PDF規範中。限制在於工具實現,而不是格式。
PDF 將文字儲存為內容流中的字元代碼。當翻譯工具處理 PDF 時,它會提取這些字元代碼,將它們映射為可讀文本,將文本發送到翻譯引擎,然後將翻譯後的文本放回文件中。標準工作流程以翻譯後的字元代碼取代原始字元代碼。原始文字已從文件中消失。無法撤銷。為了保留原始文本,翻譯工具必須建立包含原始語言的第二個文字圖層,將其標記為隱藏或非列印,並將翻譯後的文字放置在可見圖層中。這在技術上是可行的,但需要翻譯工具在整個過程中管理雙文本層。
PDF 規範支援可選內容群組,通常稱為PDF 圖層,可以獨立顯示或隱藏。翻譯工具可以將原始文字放置在一個圖層中,將翻譯後的文字放置在另一個圖層中,預設將原始圖層設定為隱藏。想要查看原始文字的讀者可以在 PDF 檢視器中切換圖層可見性。這種方法將兩種語言保留在一個文件中,並使讀者能夠控制哪種語言可見。技術能力以 PDF 格式存在。問題是給定的翻譯工具是否實現了它。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
支援原文保存的翻譯工具
在地化機構使用的專業翻譯平台通常支援雙語 PDF 輸出。這些工具專為審閱者需要將翻譯與原始文本進行比較的工作流程而設計。輸出的 PDF 包含兩個語言層,審查者可以在它們之間切換或在專門的審查介面中並排查看它們。這些工具通常是基於訂閱的,專為大批量商業翻譯工作而不是偶爾的文件翻譯而設計。
對於消費者和小型企業用戶來說,選擇更加有限。一些線上 PDF 翻譯服務提供並排輸出格式,其中原始文字和翻譯文字以交替段落或兩列佈局出現。這可以明顯地保留兩種語言,而不是將一種語言隱藏為一層。該文件較長,但兩種語言都可以訪問,無需層切換。 WukongPDF 的翻譯工具支援並排輸出模式,將原始段落和翻譯段落放在一起,將兩種語言保留在單一可讀文件中。
替代方案:保留原始 PDF 作為參考
對於需要在多個修訂週期內維護文件雙語版本的團隊來說,文件管理方法比單一文件方法效果更好。將原始 PDF 和翻譯後的 PDF 儲存在版本控制的儲存庫中,並使用連結它們的命名約定。當原始文件更新時,命名約定會明確需要更新哪個翻譯以符合。對於隨時間變化的文檔,此工作流程比單一雙語 PDF 更可靠。
當翻譯工具不支援雙語輸出時,最簡單的工作流程是翻譯 PDF 副本並將原件保留為單獨的參考文件。文件的命名保持一致,以便它們之間的關係清晰。像英文翻譯版的report-2025-en.pdf 和法文原版的report-2025-fr-original.pdf 這樣的命名約定使得任何瀏覽該資料夾的人都可以清楚地看到這種關係。將兩個檔案儲存在同一位置,並在翻譯文件的元資料或封面頁註解中引用原始檔案名稱。
出於存檔目的,原始加翻譯對通常是最可靠的方法。每個文件都是任何讀者都可以開啟的標準 PDF。不依賴圖層可見性設定或專門的檢視工具。這對文件以幾十年後仍可存取的格式記錄了原始文字和翻譯。這種方法可能不如單一雙語 PDF 那麼優雅,但從長遠來看它更可靠。
驗證原始文本層是否完好
對雙語 PDF 執行文字擷取測試。從文件中提取所有文本,並從原始語言中搜尋獨特的單字或短語。如果它出現在提取的文本中,則表示原始圖層存在並且編碼正確。如果擷取的文字僅包含翻譯的語言,則原始圖層遺失或未編碼為可擷取文字。此測試捕獲了層面板的目視檢查可能遺漏的編碼故障。
如果您的翻譯工具聲稱將原始文字保留為隱藏層,請在依賴它之前驗證這一點。在支援圖層可見性切換的檢視器(例如 Adobe Acrobat Pro)中開啟翻譯後的 PDF。在導覽窗格中尋找圖層面板。如果該工具正確建立了原始文字圖層,它將顯示為具有可見性切換的命名圖層。開啟和關閉圖層以確認原始文字按預期出現和消失。運行文字搜索,尋找您知道出現在原文中但在翻譯中發生更改的單字。如果搜尋找到原始單字,則該圖層存在且可搜尋。
也要根據標準翻譯版本的大小檢查雙語 PDF 的文件大小。具有雙文字層的 PDF 將比單語言版本大約 10% 到 30%,具體取決於文字量。無論該工具的文檔聲明如何,與標準翻譯大小相同的雙語 PDF 可能不包含原始文字層。文件大小差異是一種快速可靠的檢查。
常見問題
隱藏原文圖層會不會大幅增加檔案大小?此增加與文字量成正比,對於文字較多的文檔,通常為 15% 至 30%。對於圖像較多的文件(其中文字僅佔總文件大小的一小部分),增加可以忽略不計。雙層方法添加了文字資料和層管理元資料的第二個副本,但它不複製圖像、字體或頁面結構。對於檔案使用,適度增加文件大小是雙語可訪問性的合理權衡。
保留原始文本圖層是否會影響PDF的可搜尋性?
是的,積極的。由於存在兩種語言層,因此可以用兩種語言搜尋 PDF。用原始語言搜尋術語的用戶將在隱藏層中找到它,而用翻譯語言搜尋的用戶將在可見層中找到它。這種雙重可搜尋性是保留原始文字的主要好處之一。
我可以從雙語 PDF 中提取原始文字來恢復來源文檔嗎?
如果原始文字層存在且編碼正確,則提取它可以高保真度地恢復來源文字。提取品質取決於翻譯工具如何儲存原始文字。將其儲存為完整、未損壞的文字流的工具會產生可提取的輸出。將其儲存為碎片文字物件的工具可能會產生可提取的輸出,其中包含需要手動清理的破碎句子。
雙語 PDF 比保留兩個單獨的文件大嗎?
通常不會。具有兩種語言層的雙語 PDF 通常小於兩個單獨的單語言 PDF 的總大小,因為圖像、字體和頁面組成在各層之間共享。文字圖層僅添加少量資料。對於儲存受限的環境,雙語 PDF 比維護兩個單獨的檔案更有效。
嘗試翻譯 PDF
無需安裝。直接在您的瀏覽器中工作。
