PDF から奇数ページのみ、または偶数ページのみを抽出することは、驚くほど一般的なタスクです。両面スキャナでは、すべてのシートが 2 つの別々のページとして取り込まれている可能性がありますが、レポートに必要なのは表面だけです。結合されたドキュメントでは、コンテンツ ページと、削除する必要がある空白のプレースホルダー ページが混在している場合があります。または、自動両面印刷をサポートしていないプリンタでは、印刷ジョブで両面ドキュメントを 2 つの片面ファイルに分割する必要があります。 Split PDF ツールを使用すると、パターンベースのページ選択ロジックを理解すると、この抽出が簡単になります。
基本的な原則はすべての抽出方法で同じです。奇数または偶数のフィルターを使用してページ範囲を定義し、フィルターに一致するページのみをエクスポートします。 100 ページの PDF で奇数ページをすべて必要とする場合は、1、3、5、から 99 ページをエクスポートすることになります。ほとんどの PDF ツールは、単純なパターン表記を通じてこれをサポートしています。ツール間の違いは、ページ番号を手動で入力する必要があるか、または 1-100:odd のような省略表現を受け入れるかどうかにあります。
WukongPDF の PDF ページ ツールには、ブラウザ内でパターンベースの選択を直接処理するページ抽出および分割機能が含まれています。大規模なドキュメント セットに対するバッチ操作の場合、以下で説明するコマンド ラインとスクリプトのアプローチにより、より優れた自動化が実現します。

なぜ奇数ページまたは偶数ページを抽出するのですか?
実際には、最も一般的なシナリオは、両面スキャンされたドキュメントを処理することです。両面モードに設定されたスキャナは、ページ 1 の表面をページ 1 として取り込み、裏面をページ 2 として取り込み、ページ 2 の表面をページ 3 として取り込みます。すべてのシートの表面のみが必要な場合は、奇数ページを抽出します。裏面のみが必要な場合は、偶数ページを抽出します。このワークフローは、領収書の両面をスキャンして表面のみをファイルするアーカイブデジタル化プロジェクト、法的文書処理、および会計部門では標準です。
もう 1 つの一般的なケースには、コンテンツと空白のページが交互に含まれるドキュメントが含まれます。一部の PDF ジェネレーターは、新しい章が常に印刷レイアウトの右向きのページから始まるようにするために、すべてのコンテンツ ページの後に空白ページを挿入します。ドキュメントがデジタルのみの配布に移行すると、これらの空白ページは視覚的なノイズを追加し、情報を提供することなくファイル サイズを増加させます。空白ではないページ (多くの場合、奇数または偶数のパターンに従います) のみを抽出すると、文書がクリーンアップされます。パリティによって抽出する前に、文書全体で空白ページが奇数または偶数の位置に一貫して続いていることを確認してください。
印刷所では、奇数偶数抽出を使用して、特定の製本方法に合わせて文書を準備することもできます。無線綴じでは、表ページと裏ページに別々のスタックが必要です。書籍 PDF を奇数コンポーネントと偶数コンポーネントに分割する PDF Batch 操作により、両方のスタックが数秒で準備されます。
PDFを分割してみる
インストールは必要ありません。ブラウザで直接動作します。
方法 1: Adobe Acrobat Pro のページ整理を使用する
Acrobat Pro は、奇数偶数抽出に対する最も視覚的なアプローチを提供します。 PDF を開き、[ツール]、[ページの整理] の順に移動します。サムネイル ビューには、すべてのページがページ番号とともに表示されます。 「ページの選択」ドロップダウンをクリックし、「ページ範囲」を選択します。個々のページ番号を手動で入力して、奇数ページのパターンを入力します (小さいドキュメントの場合は 1、3、5、7 など)。長い文書の場合、Acrobat は奇数/偶数の省略表現をネイティブにサポートしていないため、完全なシーケンスを入力するか、回避策を使用する必要があります。
Acrobat Pro での長い文書の実際的な回避策は、抽出ツールを回避策で使用することです。左側の「ページ」パネルを開き、サムネールをクリックして最初の奇数ページを選択し、Ctrl キーを押しながら後続の各奇数ページをクリックします。すべてのターゲット ページを選択したら、右クリックして [ページの抽出] を選択します。個別のページ ファイルが必要な場合は、ダイアログで「ページを個別のファイルとして抽出」にチェックを入れるか、チェックを外したままにして 1 つの結合された PDF を取得します。 「OK」をクリックします。 Acrobat は、選択したページのみを含む新しい PDF を作成します。この方法は、約 30 ページまでの文書に適用可能です。それを超えると、手動でクリックするとエラーが発生しやすくなり、スクリプトによるアプローチの方が現実的です。
方法 2: オンライン PDF ツールとパターンベースの選択
いくつかのオンライン PDF ツールは、奇数/偶数の短縮構文を使用したパターンベースのページ抽出をサポートしています。ツールのインターフェイスで分割、抽出、またはページ選択機能を探します。ページ番号の入力を求められたら、奇数または偶数の修飾子を付けて範囲を入力します。一般的な構文には、1-100:odd または 1-100:even、または単にドロップダウン メニューから奇数ページを選択するなどがあります。このツールはサーバー側でパターンを処理し、一致するページのみを含む PDF を返します。
オンライン ツールは、数百ページまでのドキュメントを快適に処理できます。処理時間はページ数に比例して増加します。 200 ページの文書には 15 ~ 30 秒かかる場合があります。ほとんどのオンライン ツールでは、補完的な逆演算も提供しています。奇数ページを抽出し、偶数ページも必要な場合は、同じドキュメントで偶数抽出を実行するか、ツールが提供する場合は [奇数と偶数に分割] オプションをオンにします。無料ツールは通常、処理されたファイルを数時間以内にサーバーから削除するため、両方の出力ファイルをすぐにダウンロードします。
方法 3: バッチ処理用のコマンドライン ツール
コマンド ラインに慣れているユーザー向けに、pdftk と qpdf を使用すると、手動でクリックすることなく奇数偶数抽出を正確に制御できます。 pdftk は、ページ範囲パターンを使用した cat 操作をサポートします。コマンド pdftk input.pdf cat 1-100odd Output odd_pages.pdf は、最初の 100 ページからすべての奇数ページを抽出します。偶数ページの場合は、奇数を偶数に置き換えます。このツールは、一般的なオフィス文書サイズの場合、文書を 1 秒未満で処理します。
より現代的な代替手段である qpdf は、 --pages フラグを使用して同様の機能を提供します。コマンド qpdf --empty --pages input.pdf 1-100:odd --output.pdf は奇数ページを選択します。 qpdf は、暗号化された PDF を pdftk よりも適切に処理し、抽出中にブックマーク、リンク、フォーム フィールドなどの幅広い PDF 機能を保持します。
| メソッド | 最適な用途 | 制限事項 |
|---|---|---|
| Acrobat Pro のページの整理 | 視覚的な選択、小さなセット | ドキュメントごとの手動作業 |
| オンライン PDF ツール | 迅速な抽出、インストール不要 | 無料枠のファイルサイズ制限 |
| コマンドライン (pdftk、qpdf) | バッチ処理、スクリプト作成 | コマンドラインの知識が必要です |
| Python の自動化 | カスタム ルール、大規模 | プログラミングが必要です |
繰り返しのバッチ操作の場合は、PDF フォルダーをループするシェル スクリプトでコマンド ライン ツールをラップします。単一の bash または PowerShell for ループで、数分で数百のドキュメントを処理できます。コマンドライン アプローチは自動化されたドキュメント パイプラインにも統合されており、人間の介入なしに PDF が監視フォルダーに到着し、処理されたファイルが出力フォルダーに移動されます。
Python による奇数偶数抽出の自動化
PyPDF2 や pikepdf などの Python ライブラリを使用すると、単純な奇偶規則を超えたカスタム ロジックを使用したプログラムによるページ抽出が可能になります。 Python スクリプトは PDF を読み取り、そのページを繰り返し処理し、任意の条件に対してページ番号をチェックし、一致するページを新しいファイルに保存できます。このロジックでは、他のフィルターとパリティを組み合わせることができます。つまり、奇数ページを抽出しますが、特定のサイズより小さいページはスキップしたり、偶数ページが空白でない場合にのみ抽出したりすることができます。
奇数ページ用の基本的な PyPDF2 スクリプトに必要なコードは 15 行未満です。このスクリプトは、入力 PDF のリーダー オブジェクト、出力のライター オブジェクトを作成し、開始インデックス 1 の enumerate を使用してページをループし、2 を法とするページ番号が奇数の場合は 1、偶数の場合は 0 に等しいかどうかを確認し、一致するページをライターに追加します。このスクリプトは、GUI ベースの抽出を制限する手動選択の煩わしさなしに、あらゆる長さのドキュメントを一貫して処理します。
抽出結果の確認
いずれかの方法で抽出した後は、出力に正しいページが含まれていること、およびページが削除されていないことを確認してください。元の PDF と抽出した PDF を並べて開きます。元のページから既知の数ページ (奇数ページ抽出の場合は 3、7、15 ページなど) までスクロールし、抽出された文書内にそれらのページが正しい順序で表示されていることを確認します。抽出されたファイルの合計ページ数が期待どおりであることを確認します。100 ページの文書から奇数ページを抽出すると、50 ページが生成されるはずです。
元の PDF 内のページ リンクまたはブックマークが特定のページ番号を指している場合、ページ番号がずれるため、抽出後にそれらの参照が壊れます。元のページ 42 を指していたブックマークは、新しいページ 42 の位置にあるコンテンツを指すようになりましたが、これは正しい可能性が低いです。内部ナビゲーションに大きく依存するドキュメントの場合は、抽出後にブックマークを再構築するか、ページ選択プロセス中にリンク先を保持する qpdf などのツールを使用することを計画してください。
PDF からの奇数ページまたは偶数ページの抽出は機械的な操作であり、上記のいずれの方法でも確実に処理できます。適切な方法を選択するかどうかは、処理する必要があるドキュメントの数と、これが 1 回限りのタスクであるか、繰り返し行われるワークフローであるかによって異なります。短い文書から時折抽出する場合、Acrobat Pro の視覚的な選択が最も直観的です。スキャンされた両面ドキュメントのフォルダーをバッチ処理する場合、コマンド ライン ツールは単一のコマンドですべてのドキュメントを処理します。抽出ルールが他の処理ステップと組み合わされる自動ドキュメント パイプラインの場合、Python スクリプトは、どの GUI ツールにも匹敵しない柔軟性を提供します。どちらの方法を選択する場合でも、元のファイルをアーカイブする前、または抽出されたページを宛先に送信する前に、出力ページ数とページ順序を必ず確認してください。
奇数偶数抽出におけるエッジケースの処理
一部のドキュメントは、明確な交互パターンに従っていません。表紙があり、その後に両面スキャンされたコンテンツがある PDF では、ページ 1 が片面表紙、ページ 2 ~ 101 が両面スキャンとなります。ドキュメント全体から奇数ページを抽出すると、表紙と表面が取得されます。これは、ほとんどのユースケースで望ましい結果です。表紙を除外する必要がある場合は、2 ページ目から最後まで抽出を実行します (2-101odd)。ほとんどのコマンド ライン ツールおよびオンライン サービスは、ページ範囲と奇数または偶数の修飾子との組み合わせをサポートしています。
ページ サイズが混在するドキュメントでは、別の特殊なケースが発生します。レターページとタブロイドページの両方を含む PDF を奇数偶数抽出で分割すると、正しいページ選択が生成されますが、均一なページ寸法を必要とする下流システムでは問題が発生する可能性があります。抽出後、出力文書のページサイズを確認してください。後続のプロセスで均一なページ寸法が必要な場合は、さらに処理する前に、抽出されたページを一貫した形式にトリミングまたはサイズ変更します。
PDFを分割してみる
インストールは必要ありません。ブラウザで直接動作します。
