您掃描某人手動填寫的紙本表格。表格上的印刷文字清晰。框中的手寫回應雖然混亂,但對人類來說是清晰易讀的。您對掃描件執行 OCR,希望能夠搜尋表單並將手寫答案提取為文字。列印文字的 OCR 結果近乎完美。手寫體的 OCR 結果是亂碼。經過印刷字體訓練的辨識引擎無法理解人類手寫體的可變、不規則形狀。
包含打字和手寫文字的文件對OCR PDF引擎提出了雙重挑戰。列印的文字需要標準 OCR,效果很好。手寫需要專門的手寫識別,準確度較低,需要不同的設定。在單一文件中處理這兩種內容需要一種適當處理每種內容類型的策略。

為什麼手寫對 OCR 引擎來說如此困難
印刷文字 OCR 的工作原理是將字元形狀與已知字體模式進行匹配。字母“a”是指字母“a”。在 12 點的 Times New Roman 中,每次出現時看起來都幾乎相同。 OCR 引擎儲存 Times New Roman 字母的模型,並與該模型進行比對。手寫體沒有這樣的模型。每個人都是「一個」看起來不一樣。即使是同一個人的「a」也可能是同一個人。每次出現的情況都會有所不同,這取決於周圍的字母、書寫速度、筆角度和疲勞程度。沒有固定的模式可以匹配。
手寫辨識使用經過數千或數百萬手寫樣本訓練的機器學習模型。這些模型學習手寫字母如何變化的統計模式,並且即使在明顯偏離任何單一模板的情況下也可以識別字元。透過深度學習,手寫辨識的準確性得到了顯著提高,但仍然遠遠落後於印刷文字辨識。 PDF 協會的 2025 年基準發現,乾淨掃描的印刷文字 OCR 準確率高於 97%。同一基準上的手寫辨識準確度約為 80% 至 85%,這意味著大約每五到六個手寫單字中就有一個包含錯誤(PDF 協會,“OCR 準確度基準報告”,2025 年)。
嘗試 PDF OCR
無需安裝。直接在您的瀏覽器中工作。
混合打字和手寫文件的 OCR 策略
最有效的策略是將文件分為打字區域和手寫區域,並使用適當的識別引擎處理每個區域。這種分離可以透過將文件裁剪或屏蔽成多個部分來手動完成,也可以透過偵測每個區域的內容類型的識別引擎自動完成。
WukongPDF 的 OCR 工具可偵測頁面上的每個文字區域是列印的還是手寫的,並應用適當的辨識模型。在帶有列印標籤和手寫答案的表單上,可以使用列印文字模型高精度地識別標籤。手寫答案將透過手寫模型以手寫品質允許的任何精度進行處理。輸出是結合了兩個識別結果的單一文字層。
透過更好的掃描提高手寫 OCR 準確性
掃描品質對手寫辨識的影響比對印刷文字辨識的影響更大。最低掃描解析度為 300 DPI。更高的解析度使識別引擎可以分析每個字元更多的像素。使用灰階或彩色模式而不是純黑白。手寫筆畫中微妙的灰色變化攜帶著純黑白閾值處理丟棄的字母形狀訊息。手寫的“e”部分填充的循環可以在灰度中識別,但在閾值設置為黑白時變成難以區分的斑點。
確保筆跡盡可能深色且一致。鉛筆筆跡比鋼筆更難識別,因為石墨會產生更微弱、變化更大的線條。白紙上的藍色或黑色墨水可產生最佳對比。紅色墨水、綠色墨水或彩色紙張會降低對比度和準確性。如果您控製表單填寫流程,請指定應使用黑色墨水填寫表單以獲得最佳 OCR 結果。表單本身的這條小指令可以將下游資料擷取的準確度提高 10 到 15 個百分點。
檢查和更正手寫 OCR 輸出
OCR 後,掃描的 PDF文字圖層的錯誤集中在手寫區域。印刷的文字將接近完美。將您的複習重點放在手寫答案上。開啟 PDF 並蒐索常見的手寫 OCR 錯誤。數字 1 通常被認為是字母 l。數字0通常被識別為字母O。字母組合“th”是指數字0。通常被識別為“+h”。因為 t 的橫槓融入了 h 中。
對於需要提取到資料庫或電子表格中的表單數據,手動檢查手寫欄位至關重要。識別引擎提供最佳猜測。人類必須根據原始筆跡驗證該猜測。在這個驗證步驟中,OCR 節省的時間被人工品質控制的需要部分抵消。淨節省取決於數量。對於 10 個表格,手動資料輸入可能比 OCR 加審核更快。對於 500 個表單,OCR 加審核速度顯著加快,因為審核步驟僅限於 OCR 置信度較低的欄位。 WukongPDF 的 OCR 輸出包括每個已識別文字區塊的置信度分數,可讓您按置信度排序並僅查看低置信度結果。
對於需要大量處理的表格,例如醫療表格、保險索賠或政府申請,表格設計本身可以提高手寫 OCR 準確性。設計表單時使用單獨的字元框,每個字母一個框,而不是用一長行來表示姓名或地址。單獨的字元框迫使作者將字母分開,這極大地提高了識別準確性,因為 OCR 引擎可以在嘗試識別之前隔離每個字元。這與世界各地的納稅表格和移民文件所使用的原則相同。這些盒子對於填寫表格的人來說有點不方便,但它們可以實現大規模的自動資料提取,這是大批量表格處理所需的權衡。
對混合文件進行 OCR 後的實用品質檢查點:搜尋常見的 OCR 錯誤模式,這些錯誤模式表明引擎將手寫內容與列印文字混淆了。搜尋“cl”並驗證它不應該是“d”。搜尋“0”並驗證每個實例實際上是零而不是大寫 O。搜尋“1”並驗證它是 1,而不是小寫 L 或大寫 I。這三個搜尋可擷取列印和手寫辨識中的大多數字元級 OCR 錯誤。修復發現的錯誤,然後再次搜尋對文件用途至關重要的特定名稱、數字或日期。列印說明中有拼字錯誤的表格很煩人。手寫藥物劑量錯誤的表格是危險的。
嘗試 PDF OCR
無需安裝。直接在您的瀏覽器中工作。
