使用屏幕阅读器的同事打开您的 PDF 并听到第一个标题之前的第三段。图像标题在不属于项目符号列表的中间大声朗读。关于不相关主题的侧边栏打断了正文的中间句子。内容全部都在那里,文档在屏幕上看起来很好,但对于任何依赖辅助技术的人来说,阅读顺序是混乱的,文档很难或不可能遵循。
阅读顺序决定屏幕阅读器读取 PDF 页面上的元素的顺序。当阅读顺序正确时,体验就会流畅且合乎逻辑。如果错误,内容就会变成一串互不相连的碎片。这个问题对于有视力的读者来说是看不见的,因为他们以视觉方式处理页面,以任何吸引他们注意力的顺序在元素之间跳转。对于通过键盘、Tab 键或屏幕阅读器线性导航的用户,阅读顺序是唯一的顺序。

为什么 PDF 阅读顺序一开始就出错
PDF 本身并不理解阅读顺序。当应用程序将文档导出为 PDF 时,它会按照导出引擎处理内容对象的顺序将内容对象写入文件。此顺序通常是在源文档中创建元素的顺序,而不是人们遵循的逻辑阅读顺序。在主体文本之后添加到页面布局的文本框可能会稍后出现在对象流中,即使它应该首先作为引文或标注来读取。
多列布局特别容易出现阅读顺序问题。导出引擎可能会先写入第一列的所有内容,然后写入第二列的所有内容(这是正确的),或者可能先写入第一列的第一行,然后写入第二列的第一行,然后写入第一列的第二行,依此类推,这会产生难以理解的交替文本。同样的问题会影响包含侧边栏、标注框、图像标题、脚注以及包含实质性文本的页眉或页脚的文档。
带标签的 PDF 应该可以解决这个问题。 PDF 标签 定义了类似于 HTML 的分层结构,它告诉辅助技术正确的阅读顺序,为屏幕阅读器用户形成了PDF 可访问性 的支柱。但标签的好坏取决于生成它们的软件。从 Microsoft Word 导出并正确使用标题样式的 PDF 将具有相当好的标签结构。从图形设计应用程序导出的 PDF(其中设计者手动定位每个文本框架)可能根本没有标签,或者标签的顺序基本上是随机的。当标签树不存在或损坏时,屏幕阅读器会回退到内容对象顺序,这通常是错误的。
尝试编辑 PDF
无需安装。直接在您的浏览器中工作。
如何检查 PDF 的阅读顺序
Adobe Acrobat Pro 提供了最直接的阅读顺序检查工具。打开 PDF 并转到辅助功能工具集,然后选择阅读顺序。 Acrobat 在每个页面元素上显示编号叠加,显示当前的阅读顺序。每个数字对应于屏幕阅读器遇到该元素的顺序。如果顺序错误,则拖放以重新排序元素。该工具还显示分配给每个元素的内容类型:段落、标题、图形、表格、工件。标记为段落且应作为标题的元素不会出现在屏幕阅读器的标题导航列表中。
要进行不需要特殊软件的快速手动测试,请在 Acrobat Reader 中打开 PDF 并使用“视图”菜单下的“大声朗读”功能。激活它并聆听。阅读时请勿观看屏幕。如果有帮助的话请闭上眼睛。叙述内容是否遵循逻辑路径?它是否先宣布标题,然后是第一个标题,然后是该标题下的正文?或者它是从引言中的句子跳到脚注,然后跳到第三页的标题,然后回到正文?您听到的序列正是屏幕阅读器用户所体验到的。
常见阅读顺序失败及其修复
包含文档标题、页码或日期的页眉和页脚经常会打断阅读流程,因为它们出现在每一页上并且每次都会大声朗读,从而破坏了一页最后一段与下一页第一段之间的连续性。修复方法是将页眉和页脚内容标记为标签树中的工件。屏幕阅读器会忽略伪像。这告诉辅助技术该内容是装饰性的或重复的,在线性阅读时应该跳过。
无意中分配了替代文本或屏幕阅读器视为内容对象的装饰图像和背景元素会导致另一种常见的中断。背景渐变或装饰性边框图案没有信息价值,应标记为伪影。在阅读顺序工具中,右键单击该元素并选择“背景”或“装饰性”将其从阅读序列中删除。干净的阅读顺序仅包括人们有意阅读的内容,按照他们阅读的顺序。
表格提出了特定的阅读顺序挑战。屏幕阅读器应该逐行、逐个单元地读取表格,在每个数据单元格之前宣布列标题,以便侦听器知道每个值代表什么。如果表格未正确标记为表格标题单元格标记为 TH 且数据单元格标记为 TD,屏幕阅读器会将表格读取为连续的文本,没有结构上下文。数据表读取为“Q1 Q2 Q3 Q4 120 145 160 190”。毫无意义。通过标题关联读取的同一表变成“Q1 120、Q2 145、Q3 160、Q4 190”。它正确地传达了数据。
如何在没有 Acrobat Pro 的情况下修复阅读顺序
如果您无法访问 Acrobat Pro 的阅读顺序工具,最有效的解决方法是返回源文档并确保阅读顺序正确,然后再导出为 PDF。在 Microsoft Word 中,使用导航窗格来验证标题是否遵循逻辑层次结构。在“文件”、“信息”、“检查问题”、“检查可访问性”下运行内置的可访问性检查器。修复标题级别、向图像添加替代文本以及在导出之前标记表格标题行。干净的源文档生成干净的 PDF 比导出后尝试修复损坏的 PDF 更可靠。
WukongPDF 的编辑工具可以让您将页面重新排列成正确的顺序,从而在PDF 阅读工作流程中重新排序页面并重组内容。虽然基于浏览器的编辑器不提供 Acrobat Pro 的阅读顺序工具所提供的标签级控制,但它可以处理最常见的情况:由于文件以错误的顺序合并或扫描的页面插入到错误的位置而导致整个页面乱序的 PDF。对于完整的标签级修复,专用的辅助功能工具仍然是最佳选择,但页面级重新排序解决了用户最常遇到的问题。
在创作阶段防止阅读顺序问题
确保正确阅读顺序的最有效方法是从一开始就考虑到可访问性。使用标题样式(而不是手动字体大小和粗体格式)来创建文档的结构。将图像与文本内联放置,而不是将它们浮动在任意位置。使用应用程序的内置表格、列表和列工具,而不是使用制表符和空格模拟布局。创作阶段的每个选择都直接决定导出的 PDF 中标签结构的质量。
导出为 PDF 时,请始终选择创建带标签的 PDF 以及导出书签和超链接的选项。这些设置通常可以在 PDF 导出选项对话框的辅助功能或结构标题下找到。在Microsoft Word中,该选项是“用于辅助功能的文档结构标签”。在 Adobe InDesign 中,它是“创建带标签的 PDF”。在 Google 文档中,当您下载为 PDF 时,标记是自动的。检查该框需要一秒钟。事后修复未加标签的 PDF 可能需要几个小时。结构化创作和正确导出设置的小习惯可以消除阅读顺序问题,这些问题会令辅助技术用户感到沮丧并造成合规性难题。
尝试编辑 PDF
无需安装。直接在您的浏览器中工作。
