顯示亂碼文字、隨機符號、空白方塊行或無意義字串的 PDF 可能看起來像是無法實際恢復的損壞檔案。文件開啟時沒有錯誤訊息,頁數顯示正確,所有圖像或圖形顯示正常,但文字本身已被完全無法閱讀的內容所取代。這種模式通常表示字體編碼問題,而不是結構性文件損壞,這是個好消息,因為字體問題通常無需專業資料復原工具或取證文件修復服務即可修復。底層內容可能仍然存在於文件中,由於字體資料遺失或不匹配,其編碼方式 PDF 檢視器無法解釋。

診斷字體編碼與真實檔案損壞
第一個診斷步驟是確定問題是否源自於字體編碼或 PDF 文件結構本身。字型編碼問題會在整個文件中產生系統的、一致的亂碼。字母 A 的每個實例都可能變成空心正方形,或者所有文字始終顯示為來自不同字母表的隨機重音字符,但該模式會按預期重複。真正的文件損壞會產生不一致的行為:頁面根本無法呈現,嘗試開啟文件時出現錯誤訊息,或文件的某些部分完全空白,而其他部分顯示正確。完美呈現圖像但顯示亂碼文字的頁面非常強烈地表明字體問題而不是結構損壞。
至少在兩個不同的檢視器中開啟 PDF 以確認診斷。如果文件在 Adobe Acrobat Reader 中正確顯示,但在基於瀏覽器的檢視器(如 Chrome 或 Edge)中顯示不正確,則瀏覽器檢視器很可能不支援 PDF 中使用的特定嵌入字型格式。如果檔案在 Chrome 中正確顯示,但在 Mac 上的預覽中無法正確顯示,則預覽可能缺乏對特定字體編碼方案的支援。如果檔案在不同作業系統上測試的每個檢視器中顯示亂碼,則 PDF 本身內的字體資料已損壞或遺失,並且需要進行修復 PDF 操作來解決字體資源問題。
嘗試修復 PDF
無需安裝。直接在您的瀏覽器中工作。
重新嵌入遺失或損壞的字體
當 PDF 引用未嵌入文件中且未安裝在檢視系統上的字型時,PDF 檢視器將被迫替換其可用的其他字型。這種替換經常會導致字元錯位,因為替換字體的字元寬度、間距度量和字形位置與原始字體不同。文字顯示為混亂或隨機符號,因為 PDF 中儲存的字元代碼會對應到替代字體中的字形與文件作者想要的字形完全不同。解決方案是將正確的字體重新嵌入 PDF 中,以便查看者不再需要猜測。
在可以在文件層級檢查和修改字體資源的工具中開啟 PDF。檢查字體清單,查看文件引用了哪些字體,以及每種字體是否完全嵌入、僅包含所使用字元的子集部分嵌入、或列為根本未嵌入。如果字體顯示為未嵌入,您需要在系統上安裝該字體,並在啟用嵌入所有字體選項的情況下重新儲存 PDF,或者使用 PDF Fix PDF 工具,該工具可以從其自己的授權字體庫中找到並嵌入所需的字體資料。大多數字體庫中都提供了 Arial、Times New Roman、Helvetica 和 Courier 等常見系統字體,並且可以在沒有許可限制的情況下嵌入。
使用列印到 PDF 技術進行快速恢復
如果亂碼文字是由某個特定檢視器正確處理而其他檢視器無法正確處理的字體編碼所引起的,那麼最快的實際修復方法就是利用該單一工作檢視器。在能夠在螢幕上正確呈現文字的檢視器中開啟 PDF。按 Ctrl-P 或 Command-P 開啟列印對話框,然後選擇 Microsoft 列印到 PDF 或另存為 PDF 作為目標印表機。列印管道對螢幕上顯示的文字進行光柵化或重新編碼,並使用標準的、普遍支援的字體和編碼將其嵌入到全新的 PDF 中,每個現代 PDF 檢視器都可以理解,無需特殊的字體處理。
此方法會產生一個修復 PDF 副本,其中包含乾淨、可讀的文本,並且在各處一致顯示,但在實施之前需要了解一個重要的權衡。列印的 PDF 通常會失去文字的選擇性、可搜尋性和任何互動式表單元素。文字有效地成為頁面圖像的一部分。對於只需要在螢幕上閱讀並可能列印一次的文檔,這是一個完全可以接受的解決方案,只需幾秒鐘。對於修復後需要保持可搜尋、可選擇或可編輯的文檔,請先嘗試字體嵌入方法,並保留列印到 PDF 作為後備。
透過中間格式轉換 PDF
當字型嵌入無法解決問題且列印到 PDF 會遺失太多文件功能時,透過中間格式轉換 PDF 可以移除損壞的編碼,同時將文字保留為實際文字。使用 PDF 到 Word 轉換器將 PDF 匯出到 Word 文件。轉換過程讀取 PDF 內容流,並將識別的文字輸出為使用 Word 自己的字體處理和編碼的新格式,完全獨立於原始 PDF 中的任何損壞。開啟生成的 Word 文件,確認文字全文閱讀正確,進行所需的細微格式更正,然後將其匯出回 PDF,並啟用字體嵌入。
Word 的往返過程會用乾淨、符合標準的編碼取代損壞的編碼,但具有多列、精確定位或嵌入向量圖形的複雜佈局可能無法完美地完成轉換。下表比較了三種修復方法以及選擇應用哪種方法時的重要因素:
| 方法 | 文本可選 | 保留佈局 | 速度 |
|---|---|---|---|
| 重新嵌入字體 | 是的 | 是的 | 緩和 |
| 列印為 PDF | 不 | 是的 | 快速地 |
| PDF 到 Word 到 PDF | 是的 | 部分的 | 慢的 |
處理 Unicode 和 CID 字型編碼問題
使用非拉丁文字(例如中文、日文、韓文、阿拉伯文或西里爾文)建立的 PDF 有時會顯示亂碼文本,特別是當字體使用 CID(字元識別碼)編碼並且查看者無法將數字 CID 映射回其對應的 Unicode 字元時。這對於掃描軟體或傳統出版系統產生的舊版 PDF 來說很常見,這些系統使用 Unicode 成為通用標準之前設計的預 Unicode 編碼表嵌入字型。例如,來自 2005 年日本掃描器的 PDF 可能使用 CID 字體,如果沒有原始供應商特定的 CMAP 文件,現代檢視者就無法解釋該字體。
明確支援 CID 到 Unicode 映射的專用 PDFFix PDF 工具可以重建正確的字元關聯。這些工具從字型資料和嵌入的 CMAP 資料表(如果存在)中讀取原始 CID 程式碼,以重建 Unicode 對應。這個過程在專為 PDF 字體修復而設計的工具中是自動化的,只需要您上傳文件並下載正確的版本。對於包含東亞語言的 PDF,請選擇在其功能集中明確列出 CJK 字體支援的修復工具,因為主要為拉丁文字設計的通用字體修復工具可能不包括這些書寫系統的 CMAP 資料或字形識別模型。
防止您建立的 PDF 中出現亂碼文本
如果您經常建立的 PDF 到達收件者時出現亂碼,則根本原因幾乎總是產生 PDF 的軟體中的字體嵌入設定。從 Word、PowerPoint、InDesign 或設計工具匯出時,找到 PDF 匯出或儲存選項對話框,然後選取標記為「嵌入字體」或「嵌入所有字體」的方塊。某些應用程式提供了一個附加複選框,用於僅嵌入文件中使用的字符,這會透過子集字體建立較小的文件,但如果稍後編輯 PDF 或與其他內容合併,可能會導致顯示問題。為了獲得最大的跨平台相容性,只要檔案大小的增加是可以接受的,就嵌入完整的字體而不是子集。
WukongPDF 等平台處理PDF 格式 轉換,預設啟用全面的字體嵌入,避免因僅適用於創建者電腦的系統特定字體依賴性而產生的編碼問題。當發送必須在不同作業系統、裝置和檢視器應用程式中正確顯示的 PDF 時,快速驗證測試是在基於瀏覽器的 PDF 檢視器中開啟文件,因為這些檢視器無法存取本機安裝的系統字體,並且會立即顯示任何字體嵌入問題,否則這些問題在收件者報告亂碼文字之前不會被注意到。
何時接受 PDF 無法修復
儘管採用了最好的修復技術,但某些 PDF 仍遭受了無法實際恢復的損壞。如果您嘗試過重新嵌入字體、從每個可用檢視器列印到新的 PDF,以及透過 Word 進行往返轉換,並且文字仍然是亂碼,則該文件可能在內容流本身中存在結構損壞,而不僅僅是字體編碼問題。此時,最有效的方法通常是找到原始來源文件並從中產生新的 PDF。
保留損壞的文件以供參考,因為即使文字無法恢復,圖像和頁面結構可能仍部分完整。如果文件來自掃描儀,則重新掃描原始紙本文件會產生具有正確文字編碼的乾淨 PDF。如果文件是從 Word 文件或設計應用程式建立的,請要求原始作者在明確啟用字體嵌入的情況下重新匯出它。從來源文件進行全新匯出可以繞過損壞副本中存在的所有編碼問題,並在比嘗試進一步修復更短的時間內產生乾淨的檔案。
嘗試修復 PDF
無需安裝。直接在您的瀏覽器中工作。
