從 PDF 中僅提取奇數頁或偶數頁是一項非常常見的任務。雙面掃描器可能會將每張紙捕獲為兩個單獨的頁面,但您只需要正面即可獲得報告。合併的文件可能會將內容頁面與需要刪除的空白佔位符頁面混合在一起。或者,對於不支援自動雙面列印的印表機,列印作業需要將雙面文件拆分為兩個單面文件。一旦您了解了基於模式的頁面選擇邏輯,Split PDF工具就可以使提取變得簡單。
所有提取方法的基本原理都是相同的:使用奇數或偶數過濾器定義頁面範圍,然後僅匯出與過濾器相符的頁面。對於 100 頁的 PDF,如果您想要所有奇數頁,則表示匯出第 1、3、5 到 99 頁。大多數 PDF 工具透過簡單的模式表示法支援此操作。工具之間的差異在於它們是否要求您手動鍵入頁碼,或者是否接受 1-100:odd 這樣的簡寫。
WukongPDF 的PDF 頁面 工具包括頁面擷取和分割功能,可直接在瀏覽器中處理基於模式的選擇。對於大型文件集的批次操作,下面描述的命令列和腳本方法提供了更好的自動化。

為什麼要提取奇數頁或偶數頁?
實際上,最常見的情況是處理雙面掃描文件。設定為雙面模式的掃描器將第 1 頁的正面擷取為第 1 頁,背面擷取為第 2 頁,第 2 頁的正面擷取為第 3 頁,依此類推。如果您只需要每張紙的正面,則可以提取奇數頁。如果您只需要背面,則提取偶數頁。此工作流程是檔案數位化專案、法律文件處理和會計部門的標準工作流程,掃描收據的兩面但僅歸檔正面。
另一種常見情況涉及內容和空白頁面交替出現的文件。某些 PDF 產生器會在每個內容頁面後插入一個空白頁面,以強制新章節始終從列印佈局中的右側頁面開始。當文件轉向純數位分發時,這些空白頁面會增加視覺噪音並增加文件大小,而不會提供任何資訊。僅提取通常遵循奇數或偶數模式的非空白頁可以清理文件。在按奇偶校驗擷取之前,請先驗證空白頁在整個文件中始終遵循奇數或偶數位置。
印刷廠還使用奇偶提取來準備用於特定裝訂方法的文件。無線裝訂要求正面和背面分開疊放。將書籍 PDF 拆分為奇數和偶數部分的PDF Batch 操作可在幾秒鐘內準備好兩個堆疊。
嘗試拆分 PDF
無需安裝。直接在您的瀏覽器中工作。
方法 1:使用 Adobe Acrobat Pro 的組織頁面
Acrobat Pro 提供了最直覺的奇偶萃取方法。開啟 PDF,前往“工具”,然後前往“組織頁面”。縮圖視圖顯示每個頁面及其頁碼。點擊選擇頁面下拉清單並選擇頁面範圍。透過手動輸入各個頁碼來鍵入奇數頁的模式,例如小文件的 1、3、5、7。對於較長的文檔,Acrobat 本身不支援奇數/偶數速記,因此您需要鍵入完整序列或使用解決方法。
Acrobat Pro 中較長文件的實際解決方法是使用「提取」工具和解決方法。開啟左側的「頁面」面板,透過點選縮圖選擇第一個奇數頁,然後按住 Ctrl 並點選每個後續奇數頁。選擇所有目標頁面後,右鍵單擊並選擇提取頁面。在對話方塊中,如果您需要單獨的頁面文件,請選取“將頁面提取為單獨的文件”,或不選中它以獲得一個合併的 PDF。按一下“確定”。 Acrobat 會產生一個僅包含所選頁面的新 PDF。此方法對於最多 30 頁左右的文件是可行的。除此之外,手動點擊很容易出錯,而腳本方法更實用。
方法 2:線上 PDF 工具和基於模式的選擇
一些線上 PDF 工具支援使用奇數/偶數速記語法的基於模式的頁面提取。在工具介面中尋找「拆分」、「提取」或「頁面選擇」功能。當提示輸入頁碼時,請輸入帶有奇數或偶數修飾符的範圍。常見語法包括 1-100:odd 或 1-100:even 或僅從下拉式選單中選擇 Odd Pages。該工具在伺服器端處理模式並傳回僅包含符合頁面的 PDF。
線上工具可以輕鬆處理多達數百頁的文件。處理時間與頁數呈線性關係。 200 頁的文件可能需要 15 到 30 秒。大多數線上工具還提供補充的逆運算。如果您提取奇數頁並想要偶數頁,請在同一文件上執行偶數提取,或勾選「拆分為奇數頁和偶數頁」選項(如果該工具提供)。立即下載這兩個輸出文件,因為免費工具通常會在幾個小時內從其伺服器中刪除已處理的文件。
方法 3:用於批次的命令列工具
對於熟悉命令列的使用者來說,pdftk 和 qpdf 可以精確控制奇偶提取,無需任何手動點擊。 pdftk 支援具有頁面範圍模式的 cat 操作。指令 pdftk input.pdf cat 1-100odd output odd_pages.pdf 從前 100 頁中擷取所有奇數頁。對於偶數頁,將奇數替換為偶數。該工具可以在一秒鐘內處理典型辦公室文檔大小的文檔。
qpdf 是一種更現代的替代方案,它透過 --pages 標誌提供類似的功能。指令 qpdf --empty --pages input.pdf 1-100:odd --output.pdf 選擇奇數頁。 qpdf 比 pdftk 更優雅地處理加密的 PDF,並在提取過程中保留更廣泛的 PDF 功能,包括書籤、連結和表單欄位。
| 方法 | 最適合 | 限制 |
|---|---|---|
| Acrobat Pro 組織頁面 | 目視選擇,小套 | 每個文件的手動工作 |
| 線上 PDF 工具 | 快速提取,無需安裝 | 免費套餐的檔案大小限制 |
| 命令列(pdftk、qpdf) | 批次、腳本 | 需要命令列知識 |
| Python自動化 | 自訂規則,大規模 | 需要程式設計 |
對於重複的批次操作,請將命令列工具包裝在循環遍歷 PDF 資料夾的 shell 腳本中。單一 bash 或 PowerShell for 迴圈可以在幾分鐘內處理數百個文件。命令列方法還整合到自動化文件管道中,其中 PDF 到達監視資料夾,處理後的文件移動到輸出資料夾,無需任何人工幹預。
使用 Python 自動奇偶提取
PyPDF2 和 pikepdf 等 Python 函式庫支援使用自訂邏輯進行程式設計頁面擷取,而不僅僅是簡單的奇偶規則。 Python 腳本可以讀取 PDF、遍歷其頁面、根據任何條件檢查頁碼,並將符合的頁面儲存到新檔案中。這個邏輯可以將奇偶校驗與其他過濾器結合:提取奇數頁但跳過小於特定維度的頁面,或僅提取非空白的偶數頁。
用於奇數頁的基本 PyPDF2 腳本需要少於 15 行程式碼。腳本為輸入 PDF 建立 reader 對象,為輸出建立一個 writer 對象,使用起始索引為 1 的 enumerate 循環遍歷頁面,檢查頁碼模 2 是否等於 1(奇數)或 0(偶數),並將匹配的頁面新增至 writer。該腳本可以一致地處理任何長度的文檔,而不會產生限制基於 GUI 的提取的手動選擇疲勞。
驗證提取結果
使用任何提取方法後,請驗證輸出是否包含正確的頁面並且沒有遺失任何頁面。並排打開原始 PDF 和提取的 PDF。捲動到原始文件中的幾個已知頁面,例如第 3、7 和 15 頁以進行奇數頁提取,並確認它們以正確的順序出現在提取的文件中。檢查提取文件的總頁數是否符合預期:從 100 頁文件中提取奇數頁應產生 50 頁。
如果原始 PDF 中的頁面連結或書籤指向特定頁碼,則這些引用在提取後將中斷,因為頁碼發生了變化。原來指向第 42 頁的書籤現在指向新的第 42 頁位置上的任何內容,這不太可能是正確的。對於嚴重依賴內部導航的文檔,計劃在提取後重建書籤或使用 qpdf 等工具在頁面選擇過程中保留連結目的地。
從 PDF 中提取奇數頁或偶數頁是上述任何方法都可以可靠處理的機械操作。選擇正確的方法取決於您需要處理的文件數量以及這是一次性任務還是重複工作流程。對於偶爾從短文檔中提取內容,Acrobat Pro 的視覺選擇是最直觀的。為了批次處理掃描的雙面文件的資料夾,命令列工具可以使用單一命令處理所有這些文件。對於提取規則與其他處理步驟相結合的自動化文件管道,Python 腳本提供了任何 GUI 工具都無法比擬的靈活性。無論您選擇哪種方法,在歸檔原始文件或將提取的頁面發送到目的地之前,請務必驗證輸出頁數和頁面順序。
處理奇偶提取中的邊緣情況
有些文檔不遵循乾淨的交替模式。封面後接雙面掃描內容的 PDF 的第 1 頁為單面封面,第 2 至 101 頁為雙面掃描件。從整個文件中提取奇數頁會抓住封面和正面,這是大多數用例所需的結果。如果您需要排除封面,請在第 2 頁至末尾運行提取:2-101odd。大多數命令列工具和線上服務都支援將頁面範圍與奇數或偶數修飾符組合起來。
具有混合頁面尺寸的文件呈現出另一種邊緣情況。同時包含字母和小報頁面的 PDF 在透過奇偶擷取進行分割時會產生正確的頁面選擇,但可能會在需要統一頁面尺寸的下游系統中造成問題。提取後,檢查輸出文件的頁面大小。如果後續處理需要統一的頁面尺寸,請在進一步處理之前將擷取的頁面裁切或調整為一致的格式。
嘗試拆分 PDF
無需安裝。直接在您的瀏覽器中工作。
