Others

為什麼我的 PDF 打開時顯示隨機符號或亂碼而不是正常文本

您昨天打開了一個完全可讀的 PDF。如今,每個頁面都顯示隨機符號而不是文字。字母已被方框、問號、加號或完全不相關的字串(如“%$#@!”)取代。句子應該在哪裡。文檔結構完好無損。頁面就在那裡。圖像很好。但每一頁上的每一個字都變成了亂碼。

這是字體編碼失敗,也是最令人擔憂的 PDF 問題之一,因為看起來檔案已損壞且無法恢復。在大多數情況下,內容是完整的。 PDF 使用的字元代碼檢視者無法對應到正確的字母形狀。修復通常涉及修復字體編碼、安裝遺失的字體或透過正確解析編碼的引擎重新渲染 PDF。

Why Does My PDF Show Random Symbols or Gibberish Instead of Normal Text When I Open It

PDF 中出現亂碼文本的三個最常見原因

原因一:缺少沒有嵌入後備的字體。 PDF 是使用未嵌入文件中的字體建立的,並且您的系統沒有安裝該字體。 PDF 檢視器嘗試替換不同的字體,但替換後使用不同的字元編碼。表示“A”的字元代碼是“A”。原始字體中的內容意味著替代字體中的其他內容。觀看者忠實地呈現替代字符,這就是為什麼頁面上的每個字母都被不同的符號取代的原因。

原因二:PDF 中的字體資料損壞。字體已嵌入,但嵌入的字體資料已損壞。當 PDF 被部分下載、透過修改二進位資料的電子郵件系統傳輸或儲存在故障的儲存裝置上時,可能會發生這種情況。字體資料存在,但包含導致渲染引擎錯誤解釋字元代碼的錯誤。文字看起來是隨機的,但實際上是損壞的輸入的確定性結果。每次開啟檔案時,相同的文字都會顯示為相同的亂碼,因為損壞是在儲存的字體資料中,而不是在瞬態渲染錯誤中。

原因三:PDF中指定的字元編碼不正確。 PDF 包含 /Encoding 條目,告訴檢視者如何將字元代碼對應到字形,但指定的編碼與文字的實際編寫方式不符。這種情況最常發生在由舊版或非標準軟體創建的 PDF 中,這些軟體使用一種編碼編寫文本,但在文件的元資料中聲明了不同的編碼。檢視器應用聲明的編碼並產生亂碼。如果它改為應用程式創建者使用的實際編碼,則文字將正確呈現。聲明的編碼和實際的編碼之間的不匹配是三個原因中最容易修復的,因為文字資料是完整的。只是映射指令是錯誤的。

WukongPDF

嘗試修復 PDF

無需安裝。直接在您的瀏覽器中工作。

立即開始 →

如何診斷您的 PDF 有哪些問題

一組快速測試可以縮小原因範圍。首先,在不同的檢視器中開啟 PDF。如果它在 Adobe Acrobat 中顯示正確,但在瀏覽器中顯示亂碼,則問題出在瀏覽器的 PDF 渲染器上,而不是檔案。安裝缺少的字型或使用其他檢視器。如果 PDF 在每個檢視器中都顯示亂碼,則問題出在文件本身。

其次,檢查文檔屬性中的PDF字體清單。在 Acrobat 中,前往「檔案」、「屬性」、「字型」。如果字體清單顯示標記為未嵌入的字體,且您的系統上未安裝這些字體,則存在字體遺失問題。安裝該字體或在具有該字體的系統上開啟該檔案。如果字體清單顯示嵌入字體,但文字仍然是亂碼,則嵌入字體資料可能已損壞。

第三,嘗試選擇並複製亂碼文字。將其貼到文字編輯器中。如果貼上的文本是原始的正確文本,則字元會正確儲存在 PDF 中,但顯示映射會被破壞。這表示編碼聲明不符。文字資料很好。觀眾只是顯示錯誤。如果貼上的文字也是亂碼,則字元資料本身已損壞,這是一個更深層的問題。

如何修復 PDF 顯示隨機符號

對於缺少的字體,請在系統上安裝所需的字體。字體名稱列在文件屬性中。許多字型可以免費下載,也可以購買和安裝商業字型。安裝字型後,重新開啟 PDF。文本應該正確呈現。如果安裝字型不可行,請在具有更好字型替換的檢視器(例如 Adobe Acrobat)而不是瀏覽器檢視器中開啟 PDF,或使用WukongPDF 使用嵌入字型重新呈現 PDF。重新渲染過程會解析所有字體引用並嵌入實際的字元形狀,產生可在任何系統上正確顯示的獨立 PDF。

對於損壞的嵌入字體,修復方法是修復或替換字體資料。 WukongPDF 的PDF 修復 工具可以偵測損壞的字體流並嘗試從倖存的資料中重建它們。如果字體是部分可恢復的,則工具會提取完整的部分並重建工作字體子集。這並不總是成功的。如果損壞很嚴重,文字可能部分或完全無法恢復,唯一的辦法是找到原始來源文件並重新建立 PDF。

對於編碼不匹配,在所有情況下最可靠的解決方法是將 PDF 列印為新的 PDF。在任何可以正確顯示文件的檢視器中開啟文件,即使一台特定電腦上只有一個檢視器可以正確呈現該文件,然後使用「列印到 PDF」功能來建立新文件。列印過程使用系統目前的字體渲染重新渲染每個字符,有效地將正確的字符形狀作為嵌入字體資料烘焙到新的 PDF 中。由於新的 PDF 使用帶有嵌入字體的標準編碼,因此解決了編碼不匹配的問題。此修復保留了文字的視覺外觀,但可能會丟失底層字元編碼,如果以後需要對文字進行搜尋或提取,這一點很重要。對於可搜尋性很重要的文檔,請使用專用的Fix PDF工具來修復編碼,同時保留文字層。

防止您建立的 PDF 中出現字體編碼問題

建立 PDF 時始終嵌入字體。這個單一設定可以防止絕大多數亂碼文字問題。在每個匯出為 PDF、Word、InDesign、Illustrator、PowerPoint 的應用程式中,都有一個嵌入字體的選項。找到它。啟用它。產生的 PDF 會稍大一些,通常每種字體 50 KB 到 200 KB,但無論現在還是將來,它都會在每個檢視器的每個系統上正確顯示。

使用標準編碼。避免使用自訂字元編碼,除非您有特定原因並且了解其含義。每個 PDF 檢視器都可以理解 PDF 標準編碼(用於拉丁文字的 WinAnsiEncoding 和用於 Unicode 的 Identity-H)。自訂編碼可以被創建它們的軟體理解,而不是其他。對於 PDF 文字來說,帶有嵌入字體的標準編碼是最便攜、最可靠的組合,並且隨著時間的推移,它在所有平台上都保持可讀性。

如果您在由舊版或專用應用程式(例如大型機報告產生器、舊會計系統或科學儀器輸出模組)建立的 PDF 中遇到亂碼文本,則編碼問題可能出在 PDF 的字元映射表中,而不是缺少字體。這些系統有時會產生 PDF,其中使用自訂符號編碼儲存文本,該編碼將字元代碼對應到字體中的字形位置而不是 Unicode 值。當現代檢視者嘗試將文字提取為 Unicode 時,映射會失敗並產生亂碼。這些文件的修復方法是使用 PDF 修復工具,該工具可以檢測非標準編碼,並將其替換為標準 Unicode 映射,或將文字提取為原始字元代碼並從字體資料重建編碼。這是一種超出通用 PDF 工具處理能力的專門修復操作,並且通常需要一個明確支援舊版編碼修復的工具。

WukongPDF

嘗試修復 PDF

無需安裝。直接在您的瀏覽器中工作。

立即開始 →