Tips & Tricks

Cómo comprimir un PDF sin que el texto parezca borroso o difícil de leer

Comprime un PDF escaneado y el tamaño del archivo cae de 15 MB a 2 MB. Los números se ven geniales. Luego abre el archivo comprimido y el texto, que era nítido y nítido en el original, ahora se ve suave, borroso y ligeramente desenfocado. La compresión funcionó, pero fue demasiado agresiva en el texto y el documento es más difícil de leer que antes.

Esta es la queja de compresión más común y ocurre porque la mayoría de las herramientas de compresión tratan la página completa como una sola imagen. No pueden distinguir entre el texto que necesita mantenerse nítido y el fondo o las fotografías que pueden tolerar una compresión más fuerte. Preservar la nitidez del texto durante la compresión requiere comprender qué configuraciones afectan la legibilidad del texto y elegir un enfoque de compresión que priorice las partes del documento que las personas realmente necesitan leer.

How to Compress a PDF Without Making the Text Look Blurry or Hard to Read

Por qué la compresión desenfoca el texto en primer lugar

La compresión de PDF funciona reduciendo la resolución de las imágenes incrustadas en el archivo. Para un PDF escaneado, cada página es una imagen, incluido el texto. Cuando el motor de compresión vuelve a muestrear la imagen de esa página de 300 DPI a 150 DPI, descarta la mitad de los píxeles en cada dimensión, manteniendo solo un píxel de cada cuatro. Los finos bordes de las letras, los finos trazos horizontales de una "t" las sutiles curvas que distinguen una "c" de una "e" todos dependen de esos píxeles desechados para verse nítidos. A 150 DPI, un carácter de 12 puntos que tenía 50 píxeles de alto en el escaneo original ahora tiene 25 píxeles de alto. A 100 DPI, tiene aproximadamente 17 píxeles de alto. A 72 DPI, tiene aproximadamente 12 píxeles de alto, apenas suficientes píxeles para representar una letra reconocible.

El tipo de algoritmo de reducción de resolución también importa. La reducción de resolución bicúbica, que calcula nuevos valores de píxeles promediando los píxeles circundantes, conserva gradientes suaves en las fotografías pero suaviza los bordes duros de las letras. El submuestreo, que selecciona un píxel de cada bloque y descarta el resto, preserva mejor la nitidez de los bordes, pero puede introducir artefactos irregulares. Para documentos con mucho texto, la reducción de resolución bicúbica a una resolución demasiado baja es la combinación que produce el texto suave y borroso del que la gente se queja. Un mejor enfoque es elegir una resolución objetivo más alta, 150 ppp como mínimo para el texto, o utilizar un método de compresión que pueda tratar el texto y las imágenes de manera diferente.

WukongPDF

Pruebe comprimir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →

Elegir la configuración de compresión adecuada para documentos con mucho texto

Para Compresión de PDF de documentos escaneados donde la legibilidad del texto es la prioridad, algunas configuraciones específicas producen resultados consistentemente buenos. Establezca la resolución objetivo en 150 DPI. Esto conserva suficiente densidad de píxeles para que el texto de 10 puntos se mantenga nítido y al mismo tiempo ofrezca una reducción del tamaño del archivo del 50% al 70%. No baje de 150 DPI para los documentos que se leerán en la pantalla. A 100 DPI, el texto de 10 puntos se vuelve notablemente suave. A 72 DPI, incluso el texto de 12 puntos comienza a degradarse.

Elija la compresión JBIG2 para páginas de texto en blanco y negro. JBIG2 está diseñado específicamente para imágenes de documentos monocromáticos y logra relaciones de compresión dramáticamente mejores que JPEG en texto, preservando al mismo tiempo la nitidez de los caracteres. Funciona identificando patrones recurrentes, cada vez que aparece la letra "e" parece casi idéntico y almacena cada patrón una vez. Esto es ideal para documentos mecanografiados. Para páginas que mezclan texto con fotografías o elementos de color, utilice JPEG2000 con una configuración de calidad media a alta. JPEG2000 maneja contenido mixto mejor que el JPEG estándar e introduce menos artefactos visibles con la misma relación de compresión.

Habilite la compresión MRC (contenido ráster mixto) si su herramienta la admite. MRC separa cada página en capas: una capa de texto mantenida en alta resolución para mayor nitidez, una capa de imagen comprimida de manera más agresiva y una capa de fondo. Este enfoque basado en capas, utilizado por el motor de compresión, preserva la nitidez del texto y al mismo tiempo logra una importante reducción del tamaño general. El texto se mantiene nítido porque se comprime con un método sin pérdidas o casi sin pérdidas, mientras que el fondo y las imágenes absorben la mayor parte de la compresión.

Probar los resultados de la compresión antes de comprometerse

Después de la compresión, abra el archivo comprimido y realice una comparación lado a lado con el original. Haz zoom al 100% y compara el mismo párrafo de texto. Mire las letras minúsculas "e", "un", y "s", que tienen los detalles más finos y son los primeros en degradarse. Si estas letras se ven nítidas y sus formas internas están claramente definidas, los ajustes de compresión son apropiados. Si los contadores, los espacios encerrados dentro de las letras, comienzan a llenarse o los bordes de las letras se ven suaves, la compresión fue demasiado agresiva.

Imprima una página de prueba si se va a imprimir el documento. Los artefactos de compresión que son invisibles en la pantalla pueden volverse evidentes en el papel porque las impresoras procesan entre 300 y 600 ppp, más que la mayoría de las pantallas. Un documento que parece aceptable en un monitor a 150 DPI puede parecer suave cuando se imprime a 300 DPI porque la impresora revela los detalles que faltan. La herramienta Reducir tamaño de PDF de WukongPDF proporciona un modo de vista previa que simula la salida impresa en diferentes niveles de compresión, permitiéndole verificar la legibilidad del texto antes de finalizar la configuración de compresión.

Qué hacer cuando la compresión ya ha desenfocado el texto

Si comprimiste un PDF y el texto ahora está borroso y ya no tienes el archivo original sin comprimir, la situación es difícil, pero no siempre desesperada. Si la compresión se aplicó a un PDF que originalmente tenía una capa de texto separada, ejecutar OCR en el archivo comprimido puede restaurar la capacidad de búsqueda, pero no puede restaurar la nitidez visual del texto original. OCR agrega una capa de texto detrás de la imagen borrosa. La imagen permanece borrosa. Para los archivos PDF escaneados, que no tienen una capa de texto separada, la única ruta de recuperación es ubicar el escaneo original o volver a escanear el documento físico con una resolución más alta y evitar repetir el mismo error de compresión.

Es por eso que mantener el archivo original sin comprimir es el hábito de compresión más importante. La compresión siempre debe producir una copia, nunca sobrescribir el original. El almacenamiento es económico. Los pocos megabytes que se ahorran al eliminar el original valen mucho menos que las horas necesarias para recrear un documento a partir de una copia comprimida y borrosa. La herramienta de compresión siempre genera un archivo nuevo, dejando intacto el original cargado. Esta elección de diseño evita el escenario muy común de darse cuenta de que las configuraciones de compresión eran incorrectas solo después de que el original ya no existe.

Comprimir documentos en color sin borrar las imágenes

Los documentos que mezclan texto con imágenes en color presentan un doble desafío: el texto necesita alta resolución para ser legible y las imágenes necesitan fidelidad de color. La solución es utilizar una herramienta de compresión que aplique diferentes configuraciones a diferentes tipos de contenido en la misma página. WukongPDF detecta automáticamente regiones de texto e imágenes dentro de cada página y aplica la compresión adecuada a cada una. Las regiones de texto reciben compresión sin pérdidas o casi sin pérdidas a una resolución efectiva más alta. Las regiones de la imagen reciben compresión JPEG o JPEG2000 a una resolución más baja. El resultado es una salida Calidad PDF donde tanto el texto como las imágenes se ven bien y el tamaño del archivo es dramáticamente más pequeño que el original sin comprimir.

La conclusión clave es que la borrosidad del texto después de la compresión no es una compensación inevitable. Es el resultado de configuraciones de compresión que no fueron optimizadas para el contenido del documento. Un escaneo con mucho texto necesita configuraciones diferentes a las de un álbum de fotos. Elegir la configuración correcta para el documento que tienes delante y conservar siempre el original garantiza que la compresión cumpla su promesa de archivos más pequeños sin sacrificar la legibilidad que hace que el documento sea útil en primer lugar.

Una última consideración que mucha gente pasa por alto es el efecto del formato de compresión en futuras ediciones. Si el PDF comprimido necesitará posteriormente OCR, compresión adicional o conversión de formato, un archivo moderadamente comprimido a 150 DPI con codificación de texto sin pérdidas sobrevive a esas operaciones posteriores mucho mejor que un archivo muy comprimido a 72 DPI con JPEG con pérdida. Cada recompresión de un archivo con pérdida agrava la pérdida de calidad. La primera compresión puede ser apenas perceptible. El segundo, aplicado al archivo ya comprimido, degrada el texto hasta el punto de hacerlo ilegible. Cuando comprime un PDF, está tomando una decisión no sólo sobre el tamaño actual de este archivo, sino también sobre cuánto margen de calidad queda para cualquier operación que el archivo pueda sufrir en el futuro. Una compresión moderada hoy deja espacio para el mañana. Una compresión agresiva agota ese espacio en un solo paso.

WukongPDF

Pruebe comprimir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →