Tips & Tricks

スキャンしたページを 1 つの PDF に結合し、正しい順序に保つ方法

30 ページの束がスキャナーから出てきます。奇数ページは 1 つの PDF 内にあります。これは、スキャナーのドキュメント フィーダーがスタックを上向きで取得したためです。偶数ページは別の PDF にあります。これは、スタックを裏返した後の 2 回目のパスで裏面がスキャンされたためです。これらを正しくマージするとは、2 つのファイルをインターリーブすることを意味します。つまり、最初の PDF のページ 1 に続いて 2 番目の PDF のページ 1、次に最初の PDF のページ 2、2 番目の PDF のページ 2 という順に、15 ページのペアを介して 1 つの正しく順序付けられた 30 ページのドキュメントが生成されます。これを間違えると、ページごとに順序が狂い、文書が読めなくなることになります。

2 パス スキャン、ドキュメント フィーダの給紙ミス、ランダムな順序で取り込まれた個々のページなど、スキャンされたページが順序どおりに到着しないことがよくあります。スキャンを正しい順序に戻すことは、スキャンを文書として使用できるようにするための重要な最初のステップです。

スキャンしたページを正しく順序付けされた Merge PDF にマージするには、2 つのパスに分割された両面スキャンからファイルをインターリーブするか、スキャン中に反転された偶数ページのスタックを反転するか、順序を外して個別にキャプチャされたページを視覚的に並べ替える必要があります。 WukongPDF の スキャン PDF マージ ツールは、サムネイル ベースの並べ替え機能とインターリーブ機能を使用してページの順序を処理し、以下の手順により、スキャンされたページの到着方法に関係なく、山にあるスキャンされたページの正しいページ順序を復元します。

How to Merge Scanned Pages Into One PDF and Keep Them in the Right Order

2 パス スキャンからの 2 つの PDF のインターリーブ

両面フィーダのないスキャナでは、最初にすべてのページの表面をスキャンし、次に物理スタック全体を裏返し、2 回目のパスで裏面をスキャンする必要があります。表面をスキャンすると、すべての奇数ページが正しい順序で並んだ PDF が生成されます。裏面スキャンでは、すべての偶数ページを含む PDF が生成されますが、物理スタックを反転するとページ順序が逆になるため、順序は逆になります。 2 つの PDF をインターリーブする前に、最初に偶数ページの PDF を反転し、ページを最後から最初の順序から最初から最後の順序に復元する必要があります。

ほとんどの PDF エディターで利用できるページ並べ替えツールまたは反転ツールを使用して偶数ページの PDF を反転した後、2 つの PDF をページを交互にインターリーブします。奇数の PDF から最初のページを取得し、次に反転された偶数の PDF から最初のページを取得し、次に奇数から 2 ページ目、偶数から 2 ページ目を取得し、すべてのページを続けます。一部の PDF ツールには、これを自動的に処理する専用のインターリーブまたは代替マージ機能が含まれています。この機能のないツールでは、PDF 操作ライブラリを使用する Python スクリプトや、カスタム ページ順序指定を受け入れるマージ ツールを使用して、同じインターリーブを数秒で実行できます。

WukongPDF

PDFを結合してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

順番を外してスキャンされたページの並べ替え

ドキュメント フィーダーではなくフラットベッドで一度に 1 枚ずつスキャンされた個々のページは、元のドキュメント内のページの位置ではなく、各ページが取り込まれたタイミングに基づいてランダムな順序で名前が付けられて到着することがよくあります。 20 ページの文書をページごとにスキャンすると、scan-003 が実際のページ 1、scan-017 が 2 ページなど、スキャン ファイル名とコンテンツ シーケンスの間に関係のないファイルが生成される場合があります。ページの順序を変更するには、結合した結果を PDF エディターのサムネイル ビューで開き、内容によって正しい最初のページを視覚的に特定し、それを 1 番目の位置にドラッグし、次に 2 番目のページを特定して 2 番目の位置にドラッグし、ドキュメント全体を続けます。

PDF エディターのサムネイル ビューには、各ページの縮小プレビューが表示されます。通常は、ページ番号、見出し、または特徴的なコンテンツを識別するのに十分な大きさです。サムネイルを最初の位置から最後まで体系的にスキャンし、各ページを元のドキュメントがある場合はそれと照合し、オリジナルが手元にない場合は論理的なコンテンツ フローと照合します。このプロセスは、ページ番号や明確なコンテンツ マーカーが表示されている一般的なビジネス文書の場合、1 ページあたり約 3 ~ 5 秒かかります。 20 ページのドキュメントは、集中して 2 分以内に並べ替えられます。

注文検証としてのページ番号とコンテンツの連続性の使用

元の文書にページ番号が印刷されている場合は、結合後の最終的な順序参照として使用してください。結合された PDF をページごとにスクロールし、印刷されたページ番号が各ページで正確に 1 ずつ増加し、ギャップ、重複、反転がないことを確認します。ページ 7 の後にページ 9 が続くギャップは、8 ページがスキャンに含まれていないため、検索して挿入する必要があることを意味します。連続する 2 ページが両方とも 12 ページを示す重複は、同じ物理ページが 2 回スキャンされたことを意味し、1 つのコピーを削除する必要があります。

ページ番号が印刷されていない文書には、内容ベースの検証アプローチが必要です。ページ境界を越えた連続性を確認します。あるページの下部で始まり次のページの上部に続く段落は、文の欠落、テキストの繰り返し、または突然のトピックの変更がなく、自然に流れる必要があります。 2 ページにわたる表では、列ヘッダーを繰り返し、行番号を連続的に付ける必要があります。コンテンツの連続性のチェックはページ番号の検証よりも遅く、ページ境界ごとにおそらく 10 秒かかりますが、ページ番号がない場合でも同様に信頼性があります。

スキャンシナリオ結果の PDF注文修正が必要です
両面スキャン、シングルパス1 つの PDF、すべてのページが正しい順序で修正は必要ありません
前に2パス、その後に後ろにパス2 つの PDF、偶数ページを反転偶数 PDF を反転し、奇数 PDF とインターリーブします
個別のフラットベッドスキャン複数のファイルまたは 1 つのファイル、ランダムな順序コンテンツごとにサムネイルを手動で並べ替える
フィーダーの詰まり、部分的な再スキャン一部のページが重複しており、一部が欠落しています重複を削除し、再スキャンから欠落しているものを挿入

完全な結合ドキュメントの検証

差し込みと順序の修正が完了したら、サムネイル ビューで文書全体をスクロールし、すべてのページが正しい向きで、正しい順序で存在していることを確認します。スキャンしたページは、スキャナーのデフォルト設定から 90 度または 180 度回転して届くことがあります。特に、スキャナーが縦向きであることを想定し、フラットベッド上に横向きで置かれたページです。必要に応じて個々のページを回転し、結合された PDF のファイル サイズをソース ファイル サイズの合計と比較して確認し、注文プロセス中に重複挿入や誤って削除されないようにします。

WukongPDF

PDFを結合してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →