压缩 PDF 通常针对图像,从照片和图形中删除冗余数据以缩小文件。但压缩也会影响嵌入字体,导致清晰的文本变得参差不齐、变细或不同字母之间不一致。保持字体质量的PDF压缩需要以不同于图像数据的方式处理文本和字体数据的设置。根据 PDF 协会 2025 年的分析,与字体相关的压缩伪像是压缩用于专业打印或屏幕阅读的文档的用户投诉的前三名(PDF 协会,“压缩后文档保真度调查”,2025 年)。
要点
当压缩算法对文件中嵌入的字体数据进行下采样或重新编码时,PDF 压缩会影响字体。无损压缩可以完美地保留字体,但可以适度减小文本较多的文档的文件大小。选择性压缩对文本和图像应用不同的设置,是缩小 PDF 同时保持字体清晰和可读的最有效方法。

PDF 压缩如何损害字体渲染
字体子集化又增加了一层漏洞。 PDF 中嵌入的子集字体仅包含文档中使用的字符。当压缩剥离或修改字体数据时,子集结构可能会被损坏。子集边缘的字符,特别是那些在文档中仅出现一次或两次的字符,可能会丢失其字体数据并呈现为空矩形。对于包含非拉丁字符(例如重音字母、货币符号或数学符号)的子集字体,该问题尤其常见,因为这些字符很少出现,并且压缩引擎可能会错误地将其字体数据分类为消耗品。
PDF 中的嵌入字体存储为完整字体程序或仅包含文档中使用的字符的子集。当压缩不加区别地针对整个文件时,它可能会使用为摄影图像设计的有损算法对字体数据进行下采样。矢量字体轮廓将每个字符描述为一组数学曲线,对有损压缩的响应不佳。干净的曲线变得用更少的控制点来近似,导致角色看起来稍微扭曲、粗细不一致或边缘粗糙。这种效果在小点尺寸下很微妙,但在标题、徽标和任何高于 18 点的文本中变得明显。
子集字体特别容易受到攻击。子集字体仅包含文档中出现的字形。剥离被识别为未使用数据的压缩算法可能会错误地从子集中删除字形,导致这些字符呈现为空框或回退到系统替换字体。结果是文档中大多数文本看起来都是正确的,但特定字符(通常是不太常见的字符,如欧元符号或破折号)丢失或呈现与周围文本不同。
尝试压缩 PDF
无需安装。直接在您的浏览器中工作。
为文本和字体数据选择无损压缩
最安全的方法是将压缩工具配置为对文本和字体数据应用无损压缩,同时仅允许对图像进行有损压缩。大多数专业的 PDF 压缩工具都提供一个设置面板,其中包含针对图像、文本和线条艺术的单独质量控制。将文本和线条艺术质量设置为最大或无损可以完全保留原始文档中的字体轮廓。此方法减少的文件大小小于完全有损压缩,通常为 30% 到 50%,而不是 70% 到 90%,但文本质量仍与原始质量相同。
对于文件大小是绝对优先级并且可以接受一些字体质量权衡的文档,请使用提供文本质量滑块而不是二进制无损或有损选择的压缩工具。将文本质量降低到原始质量的 90% 或 95% 通常仅在文本放大超过 200% 时才会产生明显差异。在正常阅读大小下,大多数读者无法察觉质量差异。 WukongPDF 的压缩工具将文本和图像质量控制分开,因此您可以保持字体完全保真度,同时积极压缩占文件大小大部分的照片和图形。
按字体影响进行压缩设置比较
| 压缩类型 | 对字体的影响 | 减小文件大小 | 最适合 |
|---|---|---|---|
| 无损(FlateDecode) | 无 - 字体完全保留 | 20-40% | 法律、档案、可打印文档 |
| 无损图像下采样 | 无 - 字体未受影响 | 30-55% | 供屏幕使用的混合文本/图像文档 |
| 高质量有损 (95%) | 正常尺寸下不易察觉 | 50-70% | 电子邮件附件、网络共享 |
| 中等质量有损 (75%) | 14pt 文本上方有明显的柔化效果 | 65-80% | 参考副本、内部草稿 |
| 最大压缩 | 所有尺寸都有明显的字体变形 | 80-95% | 仅缩略图预览 |
压缩后检查字体质量
对于字体渲染质量至关重要的文档(例如品牌指南、版式样本或将以非常大尺寸打印的文档),请考虑使用专门的 PDF 预检工具运行字体验证过程。这些工具可以检测肉眼看不到的细微字体损坏,包括缺少提示指令、损坏的字距调整表和不完整的字形轮廓。预检报告可识别哪些特定字体和字形受到影响,因此您可以精确地集中修复工作,而不是试图猜测哪个压缩设置导致了问题。
压缩后,打开 PDF 并将一些文本示例放大到 300%。检查标题、正文段落以及任何使用非标准字体的文本。查找比原始字母更薄或更厚的字母、字符之间的间距不一致以及任何形状发生变化的字符。特别注意 o、e 和 a 等圆形字符的字母形式,它们最清楚地显示压缩伪影,因为它们的曲线是最先被近似的。
在文档指定的打印机上打印压缩 PDF 的一张测试页(如果适用)。激光打印机和喷墨打印机渲染字体边缘的方式与屏幕不同,在屏幕上看起来可以接受的字体在打印时可能会产生明显的锯齿状或细长的文本。打印机的分辨率与压缩字体数据的交互方式与屏幕渲染不同,这使得打印测试成为对纸质文档最可靠的质量检查。
在 PDF 创建阶段防止字体问题
防止字体压缩损坏的最佳保护措施是从一开始就创建完全嵌入字体的 PDF。将文档保存或导出为 PDF 时,选择完全嵌入所有字体而不是嵌入子集的选项。完全嵌入将整个字体程序存储在 PDF 中,为压缩算法提供更多数据来处理,并消除因子集删除而丢失字形的风险。代价是压缩前的 PDF 文件较大,通常每个字体额外增加 50 到 200 KB,但压缩后的结果始终更好,因为压缩引擎有完整的字体数据可供优化。
如果您专门为包含压缩的工作流程创建 PDF,请尽可能使用标准字体,例如 Arial、Times New Roman、Calibri 或 Helvetica。这些字体采用强大的PDF字体暗示设计,比装饰或自定义字体更能承受压缩。专业字体中嵌入的提示指令告诉渲染引擎如何在不同尺寸和分辨率下调整字符形状。自定义或免费字体通常缺乏提示或提示最少,这使得它们在压缩过程中更容易受到明显的质量损失。
常见问题
使用字体安全设置多次压缩 PDF 是否会随着时间的推移而累积损坏?对同一文件多次应用无损压缩通常是安全的,因为无损算法不会修改底层数据。每一遍都会找到相同的冗余并产生相同的结果。但是,重复打开、压缩和保存 PDF 可能会累积保存操作本身的增量更改,例如更新的修改时间戳和重新生成的交叉引用表。对于归档工作流程,从原始文件压缩一次并将压缩版本归档为新的主文件,而不是重复压缩同一文件。
有损压缩损坏后字体渲染能否恢复?
不会。一旦通过有损压缩简化了字体轮廓,原始细节就会永久丢失。恢复锐利字体的唯一方法是返回原始未压缩文档并使用字体安全设置再次压缩。这就是为什么在第一次压缩尝试后立即检查字体质量很重要。在验证压缩版本可接受之前保留原始文件可以避免从头开始重新创建文档。
添加到扫描 PDF 中的 OCR 文本是否会受到压缩的影响?
OCR 文本存储为与页面图像分开的不可见文本层。无损压缩不影响OCR层。有损压缩不直接针对文本层,但剥离元数据和隐藏层的激进压缩可以删除 OCR 文本,使文档不可搜索。如果可搜索性很重要,请通过搜索您知道出现在文档中的单词来验证压缩后文本搜索是否仍然有效。
PDF/A 文件不受字体压缩问题影响吗?
PDF/A 要求完全嵌入所有字体并禁止对文本内容进行有损压缩。在压缩文档之前将其转换为 PDF/A,或者在 PDF/A 创建步骤期间对其进行压缩,可以为保留字体提供最有力的保证。缺点是 PDF/A 文件本质上比标准 PDF 文件大,因为无论压缩设置如何,都需要完整的字体嵌入。
尝试压缩 PDF
无需安装。直接在您的浏览器中工作。
