您将三个 PDF 文件合并为一个。第一个文件的页码为 1 到 10。第二个文件的页码也为 1 到 5。第三个文件根本没有页码。当您打开合并的文档时,页码编号一团糟。有些页面在文档中间从 1 重新开始。有些页面没有显示数字。有些页面显示错误的数字。发生了什么?
PDF 中的页码并不像每页底部打印的数字那么简单。 PDF 有两个独立运行的独立编号系统,它们之间的混淆是合并后几乎所有页码问题的根本原因。一旦理解了物理页码和逻辑页标签之间的区别,问题及其解决方案就会变得清晰。

两种编号系统:物理页面与逻辑标签
每个 PDF 都有一个从 1 开始的物理页面索引,并按顺序对文件中的每张纸进行计数。当您在页面跳转框中键入数字或侧边栏按顺序显示缩略图时,PDF 查看器将使用此数字进行导航。物理页码是绝对且不可变的。第 1 页始终是文件中的第一页,第 2 页是第二页,依此类推。合并文件时,第二个文件的物理页将变为物理页 11、12、13 等,附加在第一个文件的页面之后。
另外,PDF 可以具有逻辑页面标签。这些是出现在页面本身上的数字:“第 5 页”和“第 5 页”。打印在报告底部,或“iii”。位于目录页的底部。逻辑标签是元数据。它们告诉 PDF 查看器在页面计数器中显示什么标签。文件可以具有标记为“封面”的物理页1、或标记为“封面”的物理页1。物理页2标记为“i”,物理页3标记为“1”。这就是书籍和报告处理使用罗马数字的前面内容的方式。
合并后的问题是每个源文件都有自己的逻辑页面标签,并且合并PDF工具对这些标签的处理不一致。某些工具会保留每个源文件中的标签,这就是为什么页码在每个合并部分的开头从 1 重新开始。一些工具会丢弃所有标签并仅显示物理页码,这就是为什么前面有罗马数字的文档突然全文显示阿拉伯数字的原因。某些工具尝试连续对标签重新编号,但会出错,从而生成在意外位置跳过或重新启动的标签。
尝试合并 PDF
无需安装。直接在您的浏览器中工作。
为什么页面上显示的页码本身也可以移动
有些 PDF 的页码根本不是标签。它们是由创建文件的软件放置在每个页面上的实际文本或图像。例如,Microsoft Word 将页码作为文本插入页眉或页脚中。这些是页面内容的一部分,而不是元数据。将 Word 导出的 PDF 与另一个 PDF 合并时,第一个文件的打印页码在其原始页面上保持不变。
这会产生一种不和谐的视觉体验:合并的 PDF 显示物理页 15,其中包含文本“第 5 页”。打印在底部,因为该页面最初是第二个源文件的第 5 页。查看者的页面计数器显示为 15。页面上的打印文本显示为 5。两者在各自的上下文中都是正确的。两者都没有错。但读者感到困惑是可以理解的。这不是合并工具中的错误。这是合并文档的结果,每个文档都有自己独立的编号嵌入到其页面内容中。
如何在合并后修复页码
对于逻辑标签问题,如果您的 PDF 工具支持标签编辑,则修复起来很简单。某些高级 PDF 编辑器允许您手动设置页面标签。您可以告诉文件物理页面 1 到 5 应显示为“i、ii、iii、iv、v”。物理页面 6 到 50 应显示为“1,2,3,...45”。 WukongPDF 的PDF 页码 工具不会直接编辑标签,而是使用编辑工具将新页码添加到合并的 PDF(作为页眉或页脚中的文本),从而为合并的PDF 页面 提供与物理页面顺序相匹配的干净、一致的编号方案。
对于打印页码问题,旧页码被烘焙到每个源文件的页面内容中,选项更加有限。您无法有选择地仅从合并的 PDF 中删除旧页码,而不可能影响页眉和页脚中的其他内容。最实用的方法是添加视觉上突出的新页码,例如使用对比色或更大的字体,以便读者可以轻松地知道要遵循哪些页码。或者,在合并文件之前裁剪每页的下边距以删除旧的打印数字。这需要预处理每个源文件,但会产生最干净的最终结果。
在合并之前预防问题
解决页码混乱的最干净的解决方案是在合并之前阻止它。在合并文件之前,打开每个源 PDF 并删除所有打印的页码(如果可能),或者至少记下哪些页面有这些页码,这样您就不会对结果感到惊讶。如果源文件是 Word 文档或其他可编辑格式,请在导出为 PDF 之前从页眉和页脚中删除页码。合并干净的、未编号的文件,然后将页码添加到最终合并的文档中。结果是一个单一的、连贯的编号方案,从第一页连续运行到最后一页。
如果您定期合并来自不同来源的文档并且页码一致性很重要,请养成在归档源文件之前从源文件中删除页码的习惯。没有内置页码的文件是一个干净的构建块,可以与任何其他文件组合,而不会产生编号冲突。每次在新的组合中使用这些文件时,从模板和经常合并的文档中删除页码的少量前期投资就会得到回报。
当页码跳跃是更深层次问题的征兆
有时页码会跳过或重新开始,因为合并本身引入了结构问题。如果源 PDF 之一已损坏或内部页数与其实际页数不匹配,则合并工具可能会插入空白页来填充差异或跳过无法正确引用的页面。这些问题不像上述标签问题那么常见,但它们发生的频率足以值得检查。
合并后,滚动浏览整个文档一次。查找不应该出现的空白页面、内容似乎被切断的页面或序列中似乎缺失的页面。这些结构错误最容易在合并后立即修复,同时源文件仍然打开并且您记得哪些页面属于哪里。如果几天后发现问题,您将需要从源文件重新合并,这可能不再容易访问。
尝试合并 PDF
无需安装。直接在您的浏览器中工作。
