在 Adobe InDesign 或 QuarkXPress 中创建的 PDF 包含高分辨率图像、具有精确提示的嵌入字体和矢量图形。压缩此 PDF 以通过电子邮件分发通常可以将文件大小减少 70% 到 90%。面临的挑战是在不将精心排版的文本变成原始文本的模糊近似值的情况下实现这种减少。
桌面出版软件可生成针对打印而优化的 PDF。图像以 300 DPI 嵌入。字体嵌入了完整的字符集。矢量图形被保留为与分辨率无关的路径。 PDF 压缩 过程必须有选择地降低图像分辨率并压缩图像数据,同时保持文本和矢量内容不变。

为什么桌面出版 PDF 如此之大
InDesign 和类似工具以导出设置中指定的分辨率嵌入图像,通常打印输出为 300 DPI。在 CMYK 色彩空间中,300 DPI 的单张整页照片在未压缩时大约为 35 MB。导出过程中的 PDF 压缩会减少这种情况,但文件仍然很大,因为导出设置优先考虑质量而不是大小。
专业排版的字体嵌入包括提示数据、字距调整表和连字定义。具有所有这些功能的完整 OpenType 字体可能有几百 KB。使用五种字体的文档嵌入了五个完整的字体文件,在考虑任何页面内容之前添加了几兆字节。
桌面出版 PDF 中的PDF 字体 质量是通过字体数据中嵌入的精确字符定位和抗锯齿指令来实现的。过度压缩字体数据会剥离这些指令,从而降低渲染文本的质量。
尝试压缩 PDF
无需安装。直接在您的浏览器中工作。
保持文本质量的压缩设置
配置压缩工具以对文本和矢量内容应用无损压缩。文本不应使用 JPEG 或任何有损方法进行压缩。对文本内容流使用 Flate 或 ZIP 压缩,这样可以减小大小而不会造成任何质量损失。
要在不影响文本的情况下减小 PDF 大小,请将图像缩减采样分辨率设置为 150 DPI(用于屏幕查看)或 300 DPI(用于打印)。无论图像下采样设置如何,文本仍然基于矢量并以完整输出设备分辨率渲染。
WukongPDF 提供基于浏览器的压缩,为每种内容类型应用适当的设置。文本和矢量图形接受无损压缩,而图像则根据用户设置接受质量适当的压缩。
压缩后验证文本质量
以 200% 缩放并排打开原始 PDF 和压缩 PDF。比较文本清晰度,特别是在小尺寸、斜体或轻量文本中,压缩伪影最明显。压缩后的文本应该与原始文本没有区别。
请特别注意彩色背景上的文本、图像附近的文本以及图表中的文本。即使主体文本不受影响,这些区域也可能出现压缩伪影。
在压缩过程中处理特殊的版式特征
连字、小型大写字母和旧式数字需要完整的字体数据才能正确呈现。如果压缩过于激进地剥离字体提示或子集化字体,这些印刷功能可能会恢复为其默认形式或无法正确呈现。
嵌入字体可以进行子集化,以仅包含文档中使用的字符。子集化会减少字体数据而不影响文本质量,因为所需的字符仍然存在。确保压缩工具对字体进行子集化而不是删除它们。
对于排版至关重要的文档,请在压缩前保存未压缩的存档副本。档案副本保留了完整的印刷质量。压缩副本用于分发。两个副本都有其目的。
InDesign 或 QuarkXPress 的 PDF 导出对话框中桌面出版软件本身的压缩设置控制初始文件大小。使用针对打印优化的压缩设置导出会生成一个大文件。使用针对屏幕优化的压缩设置导出会生成较小的文件,但可能会降低图像质量,使其低于文档用途所需的质量。
在导出时选择正确的压缩设置可以减少导出后压缩的需要。以 200 DPI 和 JPEG 质量 80 导出的 PDF 图像将明显小于以 300 DPI 和最高质量导出的 PDF,并且屏幕查看时可能无法察觉质量差异。
初始 PDF 导出期间的字体子集仅包括文档中使用的字符,将嵌入的字体数据从数百 KB 的完整字体文件减少到通常为 20 到 50 KB 的子集。在导出过程中启用字体子集设置是减少字体相关文件大小的最有效的步骤。
矢量图形的压缩构成了桌面发布文档中的大部分视觉内容,它依赖于与图像压缩不同的算法。矢量路径使用无损 Flate 压缩进行压缩。具有许多路径的复杂矢量艺术品的压缩效率低于简单的艺术品。
应用压缩后,将压缩 PDF 的文件大小与原始文件大小进行比较,可以定量衡量压缩效果。高变焦下的视觉比较验证了尺寸减小的实现,并且在重要的地方没有质量损失。
对于压缩后存档的文档,在 PDF 元数据或存档记录中包含一条注释,指示所使用的压缩设置,为未来的用户提供上下文,这些用户可能想知道为什么存档副本的文件大小与同一文档的其他版本不同。
桌面发布的 PDF 的理想压缩方法根据其对质量降低的容忍度来处理每种内容类型:文本接受无损压缩,矢量图形接受优化的无损压缩,照片接受质量适当的 JPEG 压缩,并且字体被子集化以仅包含使用的字符。
桌面发布的 PDF 的压缩是文件大小和视觉质量之间的平衡行为,正确的平衡点取决于压缩 PDF 的使用方式:屏幕查看比打印更能容忍压缩,电子邮件分发需要比云存储共享更小的文件。
字体清晰度是读者首先注意到和最关心的质量维度,使其成为压缩过程中保存的首要任务,优先于图像质量和色彩准确性。
对于以阅读为主要活动的文档来说,压缩后的文本清晰度是最重要的质量指标。
字体子集化将嵌入的字体数据减少为仅文档中实际使用的字符。
字体嵌入可确保文本在任何设备上正确呈现,但嵌入的字体数据可能会占 PDF 文件大小的很大一部分。
对于文本较多的 PDF,对字体进行子集化以仅包含文档中使用的字符是最有效的压缩技术之一。
用于文本内容流的 Flate 压缩算法是无损的,这意味着压缩前后的文本质量在数学上是相同的。
JPEG 压缩不应应用于文本内容,因为有损伪影会在字符边缘周围产生可见的模糊。
矢量图形和文本同样容易受到不适当压缩的影响:两者都需要无损处理以保留锐利的边缘。
将文本放大 200% 或更高时,压缩良好和压缩不良的 PDF 之间的差异最为明显。
桌面发布的 PDF 中的图像可以降采样至 150 DPI 以进行屏幕查看,而不会造成明显的质量损失,而文本仍保持全分辨率。
压缩过程中的色彩空间转换可能会影响彩色背景上文本的外观,但不会影响文本清晰度本身。
桌面发布文档中的透明度效果会增加渲染复杂性,从而增加文件大小,但不会增加信息价值。
PDF 中嵌入的每种字体粗细和样式(常规、粗体、斜体、粗体斜体)都会添加可单独子集化的单独字体数据。
PDF 生成器元数据记录哪个软件创建了该文件,并可以提供有关该软件输出的最佳压缩设置的线索。
压缩工具可以在不同的质量设置下预览结果,让用户可以找到文件大小和视觉质量之间的最佳平衡。
过度压缩图像可能会与清晰的文本形成鲜明的对比,使文档看起来不一致。
压缩操作的顺序很重要:首先对图像进行下采样,然后应用压缩,以避免压缩将被丢弃的像素数据。
保存为预设的压缩设置可以一致地应用于设计团队或部门生成的所有文档。
在文档页面的代表性样本上测试压缩设置比在单个页面上测试产生更好的结果。
对于对少量文本使用大字符集的文档,仅通过字体子集设置即可将文件大小减少 30% 到 50%。
某些桌面出版工具在 PDF 导出期间应用默认压缩,可以通过导出后压缩覆盖默认压缩以获得更好的结果。
原始文本和 100% 缩放压缩后的视觉比较应显示文本质量没有明显差异。
自动压缩工作流程可以根据通过页面分析检测到的文档内容类型应用不同的设置。
PDF 优化工具的压缩报告显示哪些对象对文件大小减小贡献最大。
图表中的文本特别容易受到压缩伪影的影响,因为它通常呈现为图像的一部分而不是文本。
一个好的压缩工具可以保留文档结构,包括书签、链接和元数据,同时减小文件大小。
压缩比和质量之间的平衡是主观的,应该由目标观众在预期的观看条件下进行评估。
使用相同设置批量压缩多个文档可确保整个文档库的输出质量一致。
压缩所需的时间与文档的复杂性相关,图像较多的文档比文本较多的文档花费的时间更长。
字体许可限制可能会阻止嵌入,从而在查看期间强制替换字体,并可能更改文档外观。
面向打印的 PDF 中的 CMYK 图像应在压缩过程中转换为 RGB,以便面向屏幕分发。
PDF 版本会影响可用的压缩选项,较新的版本支持更高效的压缩算法。
无损压缩完全按照设计保留每个字符的每个像素,这对于文本保真度很重要的文档至关重要。
压缩的 PDF 应该在与压缩所用设备不同的设备上打开,以验证一致的渲染。
档案副本应使用无损压缩,以确保可以使用未来改进的算法重新压缩文档。
根据当前最佳实践定期审核压缩设置,确保组织随着工具的改进而使用最佳设置。
对于阅读清晰度是首要质量问题的文档来说,在压缩过程中保持文本清晰度至关重要。
| 内容类型 | 压缩方法 | 质量影响 | 尺寸减小 |
|---|---|---|---|
| 文字/矢量 | 扁平化(无损) | 没有任何;数学上相同 | 10-30% |
| 字体 | 子集化(无损) | 没有任何;保留所有使用过的字符 | 字体数据的 30-50% |
| 照片(彩色) | JPEG Q60-80 + 下采样 150DPI | 轻微;正常变焦时难以察觉 | 70-90% |
| 线条艺术/截图 | PNG/无损 | 没有任何 | 20-40% |
尝试压缩 PDF
无需安装。直接在您的浏览器中工作。
