當你打開一個 PDF 文件時,每一頁都充滿了空白的矩形、小正方形,或者文字應該所在的行相同的佔位符號,而不是文字。文檔結構完好無損。佈局看起來正確。但每一個字母、數字和標點符號都被一個空心框取代。這是字體替換失敗,這意味著 PDF 正在嘗試使用 PDF 閱讀器無法使用的字體來顯示文字。文字資料仍在文件中。它尚未被刪除或損壞。問題完全出在渲染層,這使得它可以修復。

是什麼導致字型替換產生空矩形
原因比症狀所暗示的簡單。
每個 PDF 都包含有關如何顯示文字的說明。每段文字都引用一種特定的字體,該字體要么在創建 PDF 時嵌入在 PDF 中,要么預計在查看它的系統上可用。嵌入字體後,PDF 包含字體資料的副本,無論查看裝置上安裝了什麼字體,任何 PDF 閱讀器都可以正確顯示文字。當未嵌入字體時,PDF閱讀器必須在本機系統上找到相符的字體。如果不存在匹配項,讀者將替換後備字體。大多數時候,這種方法足夠有效:文字以略有不同但可讀的字體顯示。
當替代機製本身崩潰時,就會發生空矩形故障。發生這種情況的原因有很多。 PDF 可能使用與作業系統識別的任何標準字體名稱不符的內部名稱來引用字體。該字體可能是自訂或專有字體,其字元編碼是標準後備字體無法映射的。 PDF 檔案可能包含損壞或不完整的字體嵌入,其中包含字體資料但在文件傳輸過程中被損壞,使讀者無法對其進行解碼。在每種情況下,讀者都知道文字應該出現在特定位置,但它沒有要渲染的字形數據,因此它會繪製缺失字元的通用符號:空矩形(ISO,“ISO 32000-2:2020,PDF 中的字體處理”,2020)。
嘗試修復 PDF
無需安裝。直接在您的瀏覽器中工作。
檢查字體是否嵌入或缺失
第一個診斷步驟是確定 PDF 是否包含嵌入字體,如果包含,則確定它們是否完整。在可以顯示文件屬性的檢視器(例如 Adobe Acrobat)中開啟 PDF。導航到文件、屬性、字體。字體清單顯示文件引用的每個字體以及每種字體是嵌入的還是嵌入的子集。嵌入字體顯示其全名,後面帶有 (Embedded) 或 (Embedded Subset)。非嵌入字體僅顯示字體名稱,沒有嵌入指示符。如果遺失文字使用的字體被列為未嵌入,則問題在於查看裝置沒有安裝這些字體。
如果字體被列為嵌入的,但文字仍然顯示為矩形,則嵌入的字體資料可能已損壞。當 PDF 透過不可靠的網路連線傳輸、儲存在故障的儲存裝置上或由不完全支援所使用的字體嵌入格式的軟體處理時,可能會發生這種情況。字體資料存在於文件中但無法解碼。文件屬性面板可能仍將字體顯示為嵌入的,因為即使字體二進位資料已損壞,嵌入聲明也完好無損。
修復非嵌入字體問題
對於從未嵌入字體的 PDF,修復路徑是在查看裝置上安裝遺失的字體或重新建立嵌入字體的 PDF。當您知道缺少哪些字體並且可以合法獲取它們時,安裝字體就可以了。當缺少的字體是您已經擁有但尚未安裝在當前裝置上的常見商業字體(例如 Helvetica 或 Times New Roman)時,這很實用。當缺少的字體是自訂公司字體或昂貴的授權字體時,它就不太實用。
WukongPDF 的修復 PDF 工具可以透過分析文件中的文字編碼和字體引用來重新處理存在字體顯示問題的 PDF。對於廣泛使用的非嵌入字體,該工具可以替換保留文字內容和近似外觀的緊密匹配。對於必須準確保留原始文字的文檔,從啟用字體嵌入的來源文檔重新建立 PDF 是最可靠的長期解決方案。大多數文字處理程式和設計應用程式在其 PDF 匯出對話方塊中都有一個標記為「嵌入字體」或「嵌入所有字元」的設定。啟用此設定可以防止字體替換成為問題。
從嵌入字體損壞的 PDF 中恢復文字
當嵌入字體損壞時,文字資料通常保持完整,即使無法顯示。指定哪些字母出現在何處的字元代碼與告訴渲染器如何繪製這些字母的字體字形資料分開儲存。即使視覺渲染失敗,您也可以從 PDF 中提取文字內容。透過點擊並拖曳來複製看似空的文字區域。即使什麼都看不到,文字也可以被選擇。將其貼到文字編輯器中。如果出現可讀文本,則文字資料完好無損,僅字體渲染被破壞。
如果複製貼上出現亂碼,則可能是字型編碼不標準。在這種情況下,請使用專用 PDF 工具中的 PDF 文字擷取功能,該功能可嘗試使用多種編碼方案對文字進行解碼。然後,可以將提取的文字放入具有正確嵌入字體的新文件中。原始 PDF 作為佈局的視覺參考,而提取的文字則提供修復版本的內容。這種兩步驟恢復可以保留資訊及其表示形式。
防止您建立的 PDF 中出現字體問題
最有效的預防措施是在建立 PDF 時始終嵌入字體。在 Microsoft Word 中,該選項位於「檔案」、「選項」、「儲存」中,並在共用此文件時保持保真度下。選中在文件中嵌入字體。在 Adobe InDesign 和類似的佈局應用程式中,PDF 匯出對話方塊包含一個字體嵌入部分,您可以在其中指定要嵌入的字體。嵌入完整字符集而不是子集可確保即使稍後編輯文件並使用原始子集之外的字符,它們也能正確顯示。
對於從其他人收到的 PDF,請將字體呈現問題視為可修復的問題,而不是永久損壞。幾乎可以肯定該文本仍在文件中。 修復 PDF 方法是診斷字體是否遺失或損壞,提取可恢復的文本,然後安裝遺失的字體或使用嵌入字體重建文件。充滿空矩形的 PDF 看起來令人震驚,但這些矩形後面的內容通常是完整的,並且可以透過正確的步驟來恢復。
非拉丁和專業腳本中的字體替換
字體替換失敗對於非拉丁文字(例如中文、日文、韓文、阿拉伯文和西里爾文)尤其常見。這些書寫系統使用的字元集遠大於拉丁字母,支援它們的字體也相應更大,使得它們在 PDF 創建過程中更有可能被子集或省略。在具有完整 CJK 字體支援的系統上建立的 PDF 在缺乏這些字體的系統上可能會顯示為空矩形。這同樣適用於數學、樂譜和語言學中使用的特殊字元集。使用這些腳本的文件應始終完全嵌入字體,而不是子集,以確保跨平台相容性。
當收到缺少非拉丁字體的 PDF 時,安裝特定字體通常是唯一可靠的修復方法。為拉丁文字設計的字體替換演算法在非拉丁字元集上表現不佳,因為字形形狀差異太大,無法進行有意義的替換。識別原始文件中使用的確切字體、從合法來源獲取該字體並將其安裝在檢視系統上,可以將文件恢復到其預期外觀。 PDF 字體生態系統完全支援 Unicode,但此支援取決於渲染器可用的字體。對於複雜的書寫系統來說,缺少的字體是任何巧妙的替代品都無法完全彌補的差距。
空矩形問題是使用者可能遇到的視覺上最令人擔憂的 PDF 問題之一,但它也是最容易修復的問題之一。與根本無法開啟檔案的結構損壞不同,字體渲染失敗意味著檔案結構完好無損且內容存在。渲染器根本無法繪製它知道應該存在的內容。有條不紊地解決問題,檢查嵌入狀態,識別丟失的字體,並恢復文字內容,將看起來被破壞的 PDF 變成完全可用和可讀的 PDF。破壞的外觀是渲染層創建的幻覺。透過正確的診斷步驟和修復工具,幾乎總是可以恢復下面的資料。
當您第一次遇到文字所在的空矩形時,它們會令人震驚。在了解背後的字體替換機制後,它們成為一個可管理的技術問題,具有清晰的診斷路徑和可靠的修復方法。恐慌逐漸消退,問題的解決開始了。
嘗試修復 PDF
無需安裝。直接在您的瀏覽器中工作。
