シートフィード スキャナで生成された スキャン PDF には、ページがわずかに (通常は 1 ~ 5 度) 回転していることがよくあります。わずかに異なる角度でスキャナーに送り込まれる各ページは、各ページが異なる回転をした文書を生成します。そのような文書を読むのは面倒です。わずかな傾きによりテキストのスキャンが困難になり、そのようなページを印刷すると、コンテンツが傾いて紙が無駄になります。バッチデスキューは、1 回の操作ですべてのページの回転を修正し、すべてのページを均一な方向にまっすぐにします。
傾き補正は、通常、テキスト行の主要な角度を検出することによって各ページのコンテンツを分析し、逆の量だけページを回転してテキストを水平にします。このプロセスは自動化され、ページごとに異なり、非破壊的です。ページのトリミングやサイズ変更は行われません。個々のページに必要な回転補正のみを適用します。 Crop PDF ツールとスキュー補正を組み合わせると、あたかもすべてのページがスキャナーに完全にまっすぐに送られたかのように見えるスキャン文書が生成されます。
WukongPDF の PDF 品質 拡張ツールには、スキャンされたドキュメントのスキュー補正とページ矯正が含まれます。スキャンされた大きな PDF のバッチ処理の場合、以下で説明する専用ツールは、特殊なデスキュー機能を提供します。

デスキューアルゴリズムによるページ回転の検出方法
スキュー補正アルゴリズムは、さまざまな候補回転角度でのピクセル強度の投影されたヒストグラムを分析することによって機能します。ページ画像を各候補角度で水平軸に投影し、テキスト行がどの程度正確に揃っているかを測定します。テキスト行が完全に水平になる正しい角度では、投影により各テキスト行の垂直位置に鋭いピークが生成されます。角度が正しくないと、ピークが複数の投影列にわたって不鮮明になります。このアルゴリズムは、予想されるスキュー範囲 (通常はマイナス 10 度からプラス 10 度) 内の角度を評価し、最も鋭い投影ピークを生成する角度を選択します。
このアルゴリズムでは、コンテンツ タイプも考慮されます。明確な線構造を持つ純粋なテキストのページは、強力なデスキュー信号を生成します。明確な水平テキスト行のない写真やグラフィックが大半を占めるページは弱い信号を生成し、信頼性の低いデータに基づく回転を避けるために、アルゴリズムがデフォルトでゼロ補正を設定する場合があります。優れたスキュー補正ツールは各ページの計算された角度をレポートするため、修正が正しくないと思われるページを確認できます。
PDFをトリミングしてみる
インストールは必要ありません。ブラウザで直接動作します。
方法 1: Acrobat Pro のスキャンされたページの最適化
Adobe Acrobat Pro には、スキャンされたページの補正ツール内にバッチデスキュー機能が含まれています。スキャンした PDF を開き、[ツール]、[スキャンと OCR]、[拡張] の順に移動し、[スキャンされたページの最適化] を選択します。最適化ダイアログで、「傾き補正と傾き補正」オプションをチェックします。出力を希望の解像度に設定します。通常、再印刷されるドキュメントの場合は 300 DPI、画面のみの表示の場合は 150 DPI です。 Acrobat は各ページを処理し、個別にデスキューして、最適化された PDF を生成します。
Acrobat のデスキューは保守的です。約 1 度を超える明らかな傾きのあるページは修正されますが、0.5 度未満の非常に微妙な傾きが修正されないままになる場合があります。ほとんどのドキュメントでは、この保守的な動作が適切です。正しい向きのページを回転させる誤ったデスキュー補正は、かろうじて認識できる程度のスキューをそのままにしておくよりも混乱をもたらします。最適化後、幅に合わせてズームして文書をめくり、テキスト行が水平に表示されていることを視覚的に確認します。修正されていないページは引き続き読めるはずです。
方法 2: ScanTailor によるプロフェッショナルなバッチ補正
ScanTailor は、スキャンされたドキュメント専用に設計されたオープンソースの後処理ツールです。スキャンされたページのバッチは、スキュー補正、コンテンツ検出、余白のトリミング、出力フォーマットなどの複数の段階を通じて処理されます。まず pdfimages や Acrobat Pro のすべての画像のエクスポート機能などのツールを使用して個々のページ画像を抽出し、スキャンした PDF を ScanTailor にインポートします。
ScanTailor は、検出された傾き角度を各ページに重ねて表示します。修正を全体的に適用する前に、自動検出が正しくなかったページの角度を手動で調整できます。傾き補正後、コンテンツ選択段階を続行してテキスト領域を特定し、空白の余白を切り取り、PDF にエクスポートします。 ScanTailor の処理は Acrobat Pro よりも徹底的で、スキュー補正とマージン トリミングの両方が必要なドキュメントに対してよりクリーンな出力を生成します。
| ツール | バッチ対応? | 精度 |
|---|---|---|
| Adobe Acrobat Pro (スキャンされたページの最適化) | はい、フィルターはすべてのページに適用されます | 軽度から中程度のスキューに適しています |
| ScanTailor (オープンソース) | はい、バッチ用に設計されています | 優れたページごとのコンテンツ検出 |
| ImageMagick + デスキュー CLI | はい、完全にスクリプト可能です | 良いです。主要なテキスト行角度を使用します。 |
方法 3: ImageMagick を使用したコマンドラインの傾き補正
スクリプト化されたバッチ ワークフローの場合、ImageMagick の変換コマンドにはデスキュー オペレーターが含まれています。コマンド Convert input.png -deskew 40% Output.png は画像を分析し、検出された回転補正を適用します。パーセンテージ パラメーター (この例では 40 パーセント) は、デスキュー操作によってカバーされる画像の量のしきい値を設定します。
ドキュメントのワークフローに関して言えば、ImageMagick を使用して PDF 全体を処理するには、pdfimages または同様のツールを使用して PDF を個々のページ画像に分割します。シェル ループを使用して、各ページ イメージに対してデスキュー コマンドを実行します。次に、ページ画像を順番にリストした ImageMagick の変換コマンドを使用して、傾いた画像を PDF に再結合します。コマンドライン アプローチは完全に自動化可能で無料であるため、GUI ツールでは手動操作が多すぎる大量のバッチ処理に適しています。 ImageMagick のデスキューの出力品質は、クリア テキスト行構造のドキュメントでは Acrobat Pro の出力品質と同等です。
バッチスキュー補正により、スキャンされた曲がった PDF が、専門的にまっすぐに整えられたドキュメントに数分で変換されます。自動修正は各ページに個別に適用され、ページごとの変動に対応するため、数ページを超えるドキュメントでは手動での矯正が現実的ではありません。
デスキューと他のスキャンされたページ修正の組み合わせ
デスキューは、単一の処理パイプラインで他のスキャンされたページの補正と組み合わせると最も効果的です。傾き補正後、コンテンツ検出を適用してテキスト領域を識別し、空白の余白を切り取ります。次に、しきい値フィルターを適用してグレースケール ページをきれいな白黒に変換します。これにより、OCR の精度が向上し、ファイル サイズが削減されます。最後に、まっすぐにされ、トリミングされ、しきい値が設定されたページに対して OCR を実行して、検索可能なドキュメントを生成します。
ScanTailor や OCRmyPDF などのツールは、これらすべてのステップを単一の自動パイプラインに結合します。 Python ベースのコマンドライン ツールである OCRmyPDF は、スキャンされた PDF を受け入れ、各ページのスキューを補正し、適応型しきい値処理を適用し、Tesseract で OCR を実行し、OCR テキスト レイヤーが埋め込まれた検索可能な PDF を出力します。単一コマンド ocrmypdf --deskew input.pdf Output.pdf は、デスキュー、しきい値処理、および OCR を 1 つのパスで処理します。大量のスキャンされたドキュメントのデジタル化プロジェクトの場合、結合されたパイプラインは、どの段階でも手動介入なしでドキュメントをエンドツーエンドで処理します。
混合コンテンツ ページのデスキュー感度の調整
絵本や雑誌のスキャンなど、テキストと写真が混在するページでは、デスキューが困難になります。写真には明確なテキスト行の向きが欠けており、傾き補正アルゴリズムはテキストではなく画像の端によって誤解される可能性があります。ほとんどのツールでは、検出された角度が不確実な場合に修正を防ぐ信頼しきい値を設定できます。
混合コンテンツ ページの場合は、デスキュー感度を控えめに設定します。 0.3 度のスキューはかろうじて認識できます。正常なページを 0.5 度回転する誤った修正は、小さな歪みをそのまま放置するよりも大きな混乱をもたらします。一括傾き補正後、文書をめくって、さらに傾いたページを特定します。これらのページを手動で元の向きにリセットします。
バッチ補正により、単一のコマンドを実行するか、最適化ダイアログをクリックするだけで、曲がったスキャン文書が専門的に調整されたファイルに変換されます。自動補正は、手動による矯正を現実的ではないページごとの変動に対処します。トリミング、しきい値処理、OCR と組み合わせることで、スキュー補正は処理パイプラインの 1 ステップとなり、生のスキャンをクリーンで検索可能な、専門的に提示されたデジタル ドキュメントに変換します。
まっすぐなページは、スキャンされた文書で読者が最初に気づく品質信号です。単語を読む前、内容を評価する前に、ページの向きから、その文書が注意深く作成されたかどうかがわかります。バッチデスキューにより、ドキュメントのすべてのページが正しい信号を送信できるようになります。
バッチデスキューは、スキャンされたドキュメント処理パイプラインの単一ステップですが、ドキュメントが専門的に準備されたように見えるか、それとも不用意にスキャンされたように見えるかを決定するステップです。まっすぐなページは、読者が一言も読む前に品質の良さを読者に伝えます。トリミング、しきい値処理、OCR と組み合わせてスキュー補正を行うと、生のスキャンが洗練されたデジタル ドキュメントに変換されます。
PDFをトリミングしてみる
インストールは必要ありません。ブラウザで直接動作します。
