从 PDF 中仅提取奇数页或偶数页是一项非常常见的任务。双面扫描仪可能会将每张纸捕获为两个单独的页面,但您只需要正面即可获得报告。合并的文档可能会将内容页面与需要删除的空白占位符页面混合在一起。或者,对于不支持自动双面打印的打印机,打印作业需要将双面文档拆分为两个单面文件。一旦您了解了基于模式的页面选择逻辑,Split PDF工具就可以使提取变得简单。
所有提取方法的基本原理都是相同的:使用奇数或偶数过滤器定义页面范围,然后仅导出与过滤器匹配的页面。对于 100 页的 PDF,如果您想要所有奇数页,则意味着导出第 1、3、5 到 99 页。大多数 PDF 工具通过简单的模式表示法支持此操作。工具之间的区别在于它们是否要求您手动键入页码,或者是否接受 1-100:odd 这样的简写。
WukongPDF 的PDF 页面 工具包括页面提取和分割功能,可直接在浏览器中处理基于模式的选择。对于大型文档集的批处理操作,下面描述的命令行和脚本方法提供了更好的自动化。

为什么提取奇数页或偶数页?
实际上,最常见的情况是处理双面扫描文档。设置为双面模式的扫描仪将第 1 页的正面捕获为第 1 页,将背面捕获为第 2 页,将第 2 页的正面捕获为第 3 页,依此类推。如果您只需要每张纸的正面,则可以提取奇数页。如果您只需要背面,则提取偶数页。此工作流程是档案数字化项目、法律文件处理和会计部门的标准工作流程,扫描收据的两面但仅归档正面。
另一种常见情况涉及内容和空白页面交替出现的文档。某些 PDF 生成器会在每个内容页面后插入一个空白页面,以强制新章节始终从打印布局中的右侧页面开始。当文档转向纯数字分发时,这些空白页面会增加视觉噪音并增加文件大小,而不会提供任何信息。仅提取通常遵循奇数或偶数模式的非空白页可以清理文档。在按奇偶校验提取之前,请验证空白页在整个文档中始终遵循奇数或偶数位置。
印刷厂还使用奇偶提取来准备用于特定装订方法的文档。无线装订要求正面和背面分开叠放。将书籍 PDF 拆分为奇数和偶数部分的PDF Batch 操作可在几秒钟内准备好两个堆栈。
尝试拆分 PDF
无需安装。直接在您的浏览器中工作。
方法 1:使用 Adobe Acrobat Pro 的组织页面
Acrobat Pro 提供了最直观的奇偶提取方法。打开 PDF,转到“工具”,然后转到“组织页面”。缩略图视图显示每个页面及其页码。单击选择页面下拉列表并选择页面范围。通过手动输入各个页码来键入奇数页的模式,例如小文档的 1、3、5、7。对于较长的文档,Acrobat 本身不支持奇数/偶数速记,因此您需要键入完整序列或使用解决方法。
Acrobat Pro 中较长文档的实际解决方法是使用“提取”工具和解决方法。打开左侧的“页面”面板,通过单击缩略图选择第一个奇数页,然后按住 Ctrl 并单击每个后续奇数页。选择所有目标页面后,右键单击并选择提取页面。在对话框中,如果您需要单独的页面文件,请选中“将页面提取为单独的文件”,或者不选中它以获得一个合并的 PDF。单击“确定”。 Acrobat 会生成一个仅包含所选页面的新 PDF。此方法对于最多 30 页左右的文档是可行的。除此之外,手动单击很容易出错,而脚本方法更实用。
方法 2:在线 PDF 工具和基于模式的选择
一些在线 PDF 工具支持使用奇数/偶数速记语法的基于模式的页面提取。在工具界面中查找“拆分”、“提取”或“页面选择”功能。当提示输入页码时,请输入带有奇数或偶数修饰符的范围。常见语法包括 1-100:odd 或 1-100:even 或仅从下拉菜单中选择 Odd Pages。该工具在服务器端处理模式并返回仅包含匹配页面的 PDF。
在线工具可以轻松处理多达数百页的文档。处理时间与页数呈线性关系。 200 页的文档可能需要 15 到 30 秒。大多数在线工具还提供补充的逆运算。如果您提取奇数页并想要偶数页,请在同一文档上运行偶数提取,或者选中“拆分为奇数页和偶数页”选项(如果该工具提供)。立即下载这两个输出文件,因为免费工具通常会在数小时内从其服务器中删除已处理的文件。
方法 3:用于批处理的命令行工具
对于熟悉命令行的用户来说,pdftk 和 qpdf 可以精确控制奇偶提取,无需任何手动点击。 pdftk 支持具有页面范围模式的 cat 操作。命令 pdftk input.pdf cat 1-100odd output odd_pages.pdf 从前 100 页中提取所有奇数页。对于偶数页,将奇数替换为偶数。该工具可以在一秒内处理典型办公文档大小的文档。
qpdf 是一种更现代的替代方案,它通过 --pages 标志提供类似的功能。命令 qpdf --empty --pages input.pdf 1-100:odd --output.pdf 选择奇数页。 qpdf 比 pdftk 更优雅地处理加密的 PDF,并在提取过程中保留更广泛的 PDF 功能,包括书签、链接和表单字段。
| 方法 | 最适合 | 限制 |
|---|---|---|
| Acrobat Pro 组织页面 | 目视选择,小套 | 每个文档的手动工作 |
| 在线 PDF 工具 | 快速提取,无需安装 | 免费套餐的文件大小限制 |
| 命令行(pdftk、qpdf) | 批处理、脚本 | 需要命令行知识 |
| Python自动化 | 自定义规则,大规模 | 需要编程 |
对于重复的批处理操作,请将命令行工具包装在循环遍历 PDF 文件夹的 shell 脚本中。单个 bash 或 PowerShell for 循环可以在几分钟内处理数百个文档。命令行方法还集成到自动化文档管道中,其中 PDF 到达监视文件夹,处理后的文件移动到输出文件夹,无需任何人工干预。
使用 Python 自动奇偶提取
PyPDF2 和 pikepdf 等 Python 库支持使用自定义逻辑进行编程页面提取,而不仅仅是简单的奇偶规则。 Python 脚本可以读取 PDF、遍历其页面、根据任何条件检查页码,并将匹配的页面保存到新文件中。该逻辑可以将奇偶校验与其他过滤器结合起来:提取奇数页但跳过小于特定维度的页面,或者仅提取非空白的偶数页。
用于奇数页的基本 PyPDF2 脚本需要少于 15 行代码。该脚本为输入 PDF 创建一个 reader 对象,为输出创建一个 writer 对象,使用起始索引为 1 的 enumerate 循环遍历页面,检查页码模 2 是否等于 1(奇数)或 0(偶数),并将匹配的页面添加到 writer。该脚本可以一致地处理任何长度的文档,而不会产生限制基于 GUI 的提取的手动选择疲劳。
验证提取结果
使用任何提取方法后,请验证输出是否包含正确的页面并且没有丢失任何页面。并排打开原始 PDF 和提取的 PDF。滚动到原始文件中的几个已知页面,例如第 3、7 和 15 页以进行奇数页提取,并确认它们以正确的顺序出现在提取的文档中。检查提取文件的总页数是否符合预期:从 100 页文档中提取奇数页应生成 50 页。
如果原始 PDF 中的页面链接或书签指向特定页码,则这些引用在提取后将中断,因为页码发生了变化。原来指向第 42 页的书签现在指向新的第 42 页位置上的任何内容,这不太可能是正确的。对于严重依赖内部导航的文档,计划在提取后重建书签或使用 qpdf 等工具在页面选择过程中保留链接目的地。
从 PDF 中提取奇数页或偶数页是上述任何方法都可以可靠处理的机械操作。选择正确的方法取决于您需要处理的文档数量以及这是一次性任务还是重复工作流程。对于偶尔从短文档中提取内容,Acrobat Pro 的视觉选择是最直观的。为了批量处理扫描的双面文档的文件夹,命令行工具可以使用单个命令处理所有这些文档。对于提取规则与其他处理步骤相结合的自动化文档管道,Python 脚本提供了任何 GUI 工具都无法比拟的灵活性。无论您选择哪种方法,在归档原始文件或将提取的页面发送到目的地之前,请务必验证输出页数和页面顺序。
处理奇偶提取中的边缘情况
有些文档不遵循干净的交替模式。封面后跟双面扫描内容的 PDF 的第 1 页为单面封面,第 2 至 101 页为双面扫描件。从整个文档中提取奇数页会抓住封面和正面,这是大多数用例所需的结果。如果您需要排除封面,请在第 2 页至末尾运行提取:2-101odd。大多数命令行工具和在线服务都支持将页面范围与奇数或偶数修饰符组合起来。
具有混合页面尺寸的文档呈现出另一种边缘情况。同时包含字母和小报页面的 PDF 在通过奇偶提取进行分割时会产生正确的页面选择,但可能会在需要统一页面尺寸的下游系统中引起问题。提取后,检查输出文档的页面大小。如果后续处理需要统一的页面尺寸,请在进一步处理之前将提取的页面裁剪或调整为一致的格式。
尝试拆分 PDF
无需安装。直接在您的浏览器中工作。
