由單張紙掃描器產生的掃描的 PDF 的頁面通常會稍微旋轉,通常會旋轉一到五度。以稍微不同的角度送入掃描器的每頁都會產生一份文檔,其中每頁的旋轉方式都不同。閱讀這樣的文檔很煩人。輕微的傾斜會使文字更難以掃描,並且列印此類頁面會浪費內容傾斜的紙張。批次糾偏可在一次操作中修正每個頁面的旋轉,將所有頁面拉至統一方向。
傾斜校正通常透過偵測文字行的主角來分析每個頁面上的內容,並將頁面旋轉相反的量以使文字達到水平。這個過程是自動化的、特定於頁面的且非破壞性的。它不會裁剪或調整頁面大小。它僅套用每個單獨頁面所需的旋轉校正。 裁切 PDF 工具與糾偏結合,產生的掃描文件看起來就像每一頁都完美筆直地通過掃描器。
WukongPDF 的PDF 品質 增強工具包括掃描文件的歪斜校正和頁面校直。對於大型掃描 PDF 的批次處理,下述專用工具提供專門的歪斜校正功能。

傾斜校正演算法如何偵測頁面旋轉
糾偏演算法的工作原理是分析不同候選旋轉角度下像素強度的投影直方圖。它將頁面圖像以每個候選角度投影到水平軸上,並測量文字行對齊的銳利度。在正確的角度下,文字行完全水平,投影會在每個文字行的垂直位置產生尖銳的峰值。在不正確的角度下,高峰會塗抹在多個投影行上。此演算法評估預期傾斜範圍(通常為負 10 度到正 10 度)內的角度,並選擇產生最尖銳投影峰值的角度。
該演算法還考慮內容類型。一頁具有清晰線條結構的純文字會產生強烈的歪斜校正訊號。以照片或圖形為主且沒有清晰的水平文字線的頁面會產生微弱的訊號,演算法可能會預設進行零校正以避免基於不可靠的資料進行旋轉。好的歪斜校正工具會報告每個頁面的計算角度,以便您可以檢查校正似乎不正確的頁面。
嘗試裁剪 PDF
無需安裝。直接在您的瀏覽器中工作。
方法 1:Acrobat Pro 的最佳化掃描頁面
Adobe Acrobat Pro 在其掃描頁面增強工具中包含批次校正歪斜功能。開啟掃描的 PDF,然後前往“工具”、“掃描和 OCR”、“增強”,然後選擇“最佳化掃描的頁面”。在最佳化對話方塊中,選取拉直和傾斜校正選項。將輸出設定為所需的分辨率,對於要重新列印的文檔,通常為 300 DPI;對於僅螢幕查看,通常為 150 DPI。 Acrobat 處理每個頁面,單獨校正歪斜,並產生最佳化的 PDF。
Acrobat 的傾斜校正是保守的。它可以糾正超過大約一度的明顯傾斜的頁面,但可能會留下半度以下的非常微妙的傾斜而不進行糾正。對於大多數文件來說,這種保守的行為是適當的。旋轉正確方向的頁面的錯誤傾斜校正比不改變幾乎察覺不到的傾斜更具破壞性。優化後,以適合寬度的縮放方式翻閱文檔,並目視檢查文字行是否呈水平狀態。未更正的頁面應該仍然可讀。
方法 2:用於專業批量校正偏移的 ScanTailor
ScanTailor 是一款專為掃描文件設計的開源後處理工具。它透過多個階段處理一批掃描頁面,包括糾偏、內容偵測、邊距裁剪和輸出格式化。首先使用 pdfimages 或 Acrobat Pro 的匯出所有影像功能等工具提取單一頁面影像,將掃描的 PDF 匯入 ScanTailor。
ScanTailor 會在每個頁面上顯示偵測到的重疊傾斜角度。在全域套用校正之前,您可以手動調整任何自動偵測不正確的頁面的角度。糾偏後,繼續進行內容選擇階段,識別文字區域並剪掉空白邊距,然後匯出為 PDF。 ScanTailor 的處理比 Acrobat Pro 的處理更徹底,可為需要校正歪斜和邊距裁切的文件產生更清晰的輸出。
| 工具 | 批量能力? | 準確度 |
|---|---|---|
| Adobe Acrobat Pro(最佳化掃描頁面) | 是的,過濾器適用於所有頁面 | 適合輕微到中度的傾斜 |
| ScanTailor(開源) | 是的,專為批量設計 | 出色的逐頁內容檢測 |
| ImageMagick + 糾偏 CLI | 是的,完全可編寫腳本 | 好,使用主導文字線角度 |
方法 3:使用 ImageMagick 進行命令列糾偏
對於腳本化批次工作流程,ImageMagick 的轉換指令包含一個糾偏運算子。指令 Convert input.png -deskew 40% output.png 分析影像並套用偵測到的旋轉校正。百分比參數(本例為 40%)設定歪斜校正操作覆蓋影像部分的閾值。
在文件工作流程中,要透過 ImageMagick 處理整個 PDF,請使用 pdfimages 或類似工具將 PDF 分割為單獨的頁面影像。使用 shell 循環在每個頁面影像上執行去歪斜命令。然後使用 ImageMagick 的轉換命令將拉直的圖像重新組合成 PDF,並按順序列出頁面圖像。命令列方法是完全自動化且免費的,使其適合 GUI 工具需要太多手動互動的大批量批次。對於具有清晰文字行結構的文檔,ImageMagick 的糾偏輸出品質與 Acrobat Pro 的輸出品質相當。
大量糾偏可在幾分鐘內將彎曲的掃描 PDF 轉換為經過專業校正的文件。自動校正單獨套用於每個頁面,處理逐頁變化,這使得手動校正對於多頁文件來說不切實際。
將歪斜校正與其他掃描頁面校正結合
當與單一處理管道中的其他掃描頁面校正搭配使用時,去歪斜是最有效的。糾偏後,應用內容偵測來辨識文字區域並裁切掉空白邊距。然後套用閾值過濾器將灰階頁面轉換為乾淨的黑白頁面,從而提高 OCR 準確性並減小檔案大小。最後,在拉直、裁切和閾值化的頁面上執行 OCR,以產生可搜尋的文件。
ScanTailor 和 OCRmyPDF 等工具將所有這些步驟組合到一個自動化管道中。 OCRmyPDF 是一個基於 Python 的命令列工具,它接受掃描的 PDF、校正每個頁面、應用自適應閾值、使用 Tesseract 運行 OCR,並輸出嵌入 OCR 文字層的可搜尋 PDF。單一指令 ocrmypdf --deskew input.pdf output.pdf 一次處理糾偏、閾值處理和 OCR。對於大批量掃描文檔數位化項目,組合管道可以端到端地處理文檔,而無需在任何階段進行人工幹預。
校準混合內容頁面的相差校正靈敏度
混合文字和照片的頁面(例如圖畫書或雜誌掃描)提出了糾偏挑戰。照片缺乏清晰的文字行方向,傾斜校正演算法可能會被圖像邊緣而不是文字誤導。大多數工具允許設定置信度閾值,以防止在檢測到的角度不確定時進行校正。
對於混合內容頁面,請保守地設定傾斜校正靈敏度。 0.3 度的傾斜幾乎無法察覺。將好頁面旋轉 0.5 度的錯誤校正比保持微小的傾斜不受影響更具破壞性。批次校正歪斜後,翻閱文件並辨識歪斜程度較大的頁面。手動將這些頁面重設為原始方向。
只需執行單一命令或按一下優化對話框,批量糾偏即可將彎曲的掃描文件轉換為專業對齊的文件。自動校正可處理每頁的變化,使手動校正變得不切實際。與裁切、閾值處理和 OCR 結合,糾偏是將原始掃描件轉換為乾淨、可搜尋、專業呈現的數位文件的處理流程中的一個步驟。
直頁是讀者在掃描文件中註意到的第一個品質訊號。在他們閱讀單字之前,在評估內容之前,頁面方向會告訴他們文件是否經過精心準備。批次糾偏可確保文件中的每一頁都發送正確的訊號。
批次校正歪斜是掃描文件處理流程中的一個步驟,但正是這個步驟決定了文件看起來是經過專業準備的還是粗心掃描的。在讀者閱讀單字之前,平直的頁面就向讀者發出了品質的訊號。與裁切、閾值處理和 OCR 結合,歪斜校正可將原始掃描件轉換為精美的數位文件。
嘗試裁剪 PDF
無需安裝。直接在您的瀏覽器中工作。
