Tips & Tricks

Cómo comprimir un PDF sin convertir texto y gráficos vectoriales en imágenes pixeladas

La mayoría de la gente supone que comprimir un PDF significa aceptar cierto nivel de pérdida de calidad. Esa suposición es sólo una verdad a medias. El texto y los gráficos vectoriales dentro de un PDF se almacenan como descripciones matemáticas de formas, curvas y glifos de caracteres, no como cuadrículas fijas de píxeles. Cuando una herramienta de compresión comprende esta distinción, puede reducir el archivo optimizando agresivamente las imágenes rasterizadas incrustadas y dejando cada letra, línea y polígono exactamente tan nítidos como el original. El resultado es un archivo que parece idéntico pero tiene una fracción del tamaño.

El problema surge cuando una herramienta de compresión aplana todo, incluido el contenido vectorial, en una sola capa de imagen antes de aplicar la compresión. En ese punto, el texto se convierte en una fotografía de texto, propensa al mismo desenfoque y artefactos JPEG que afectan a cualquier imagen comprimida. Comprender cuándo y por qué sucede esto es la clave para evitarlo. Esta guía explica la diferencia entre contenido vectorial y rasterizado en archivos PDF, cómo identificar qué tipo contiene su archivo y cómo elegir configuraciones de compresión que reduzcan el tamaño del archivo sin convertir el texto nítido en un desastre pixelado.

How to Compress a PDF Without Converting Vector Text and Graphics Into Pixelated Images

¿Por qué algunos compresores de PDF convierten el texto en imágenes borrosas?

Una encuesta de 2025 realizada por la PDF Association encontró que el 47 % de los usuarios que informaron una pérdida de calidad visual después de la compresión habían utilizado una herramienta que rasterizaba toda la página, incluido el texto, antes de aplicar la compresión JPEG o JPEG 2000 (PDF Association, "PDF Compression Practices Survey", 2025). Cuando se rasteriza una página PDF, cada elemento de la página se convierte en una única imagen plana con una resolución fija. El texto que alguna vez fue seleccionable, buscable e infinitamente nítido se convierte en una imagen de texto, y su claridad está limitada por cualquier resolución utilizada en el paso de rasterización.

Esto sucede con mayor frecuencia con herramientas basadas en navegador y aplicaciones móviles livianas que utilizan un proceso de procesamiento simplificado. En lugar de analizar la estructura interna del PDF y recomprimir selectivamente objetos de imagen individuales, renderizan la página en un elemento de lienzo o en un mapa de bits fuera de la pantalla y luego codifican ese mapa de bits como una nueva imagen. Es rápido y funciona con cualquier PDF independientemente de su complejidad interna, pero trata la tarea de un cirujano con un mazo.

El formato de archivo PDF utiliza dos formas fundamentalmente diferentes de representar contenido visual. Los gráficos vectoriales almacenan instrucciones para dibujar: una línea desde el punto A al punto B, un círculo con un radio determinado, un carácter de una fuente específica en un tamaño específico. Estas instrucciones se muestran en cualquier resolución que requiera la pantalla, desde la pantalla de un teléfono hasta una valla publicitaria, sin pérdida de nitidez. Las imágenes rasterizadas almacenan una cuadrícula de píxeles de colores con una resolución fija, normalmente entre 72 y 300 puntos por pulgada, y no se pueden ampliar más allá de su resolución nativa sin una degradación visible.

Esta distinción es importante porque un PDF creado a partir de un procesador de textos o una aplicación de autoedición suele tener vectores dominantes. Su texto es texto real almacenado como códigos de caracteres con referencias de fuentes. Sus logotipos y gráficos son caminos vectoriales. Sólo las fotografías incrustadas, si las hay, son imágenes rasterizadas. Una herramienta de compresión diseñada correctamente lo sabe y deja la porción del vector en paz.

WukongPDF

Pruebe comprimir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →

Cómo comprobar si su PDF contiene texto vectorial o rasterizado

Antes de aplicar cualquier compresión, vale la pena saber qué tipo de contenido contiene realmente su PDF. La prueba más sencilla es abrir el archivo en cualquier visor de PDF estándar y acercarlo al 400% o más. Si el texto permanece nítido y con bordes suaves, es texto vectorial. Si los bordes se vuelven irregulares o en bloques, el texto ya se ha rasterizado en alguna etapa anterior y se debe abordar una mayor compresión con especial cuidado.

Una segunda prueba es intentar seleccionar y copiar una oración de texto. Si puede resaltar caracteres individuales y copiarlos en un portapapeles, el texto se almacena como datos de texto reales. Si al hacer clic y arrastrar se selecciona una región rectangular en lugar de seguir el flujo de texto, o si no se puede seleccionar nada, la página es una imagen escaneada o ha sido rasterizada. Los archivos PDF escaneados requieren procesamiento OCR para recuperar una capa de texto, y comprimirlos implica consideraciones diferentes a las de comprimir un documento digital nativo.

También puedes verificar la estructura del objeto del archivo usando una herramienta como pdfinfo o un visor de metadatos. Busque objetos de fuente, que confirman la presencia de texto real, y objetos de imagen con filtros DCTDecode o JPXDecode, que indican imágenes rasterizadas comprimidas JPEG o JPEG 2000. Un documento que contiene tanto objetos de fuente como de imagen es un PDF de contenido mixto y es el candidato ideal para la compresión selectiva. Comprender esta estructura interna es lo que separa una compresión que preserva la calidad de otra que la degrada.

Elegir configuraciones de compresión que protejan el contenido vectorial

Si necesita comprimir un PDF conservando cada detalle del vector, la herramienta Compresión PDF de WukongPDF analiza cada elemento de la página individualmente. Las rutas de texto y vectores permanecen intactas mientras que solo se optimizan los datos de la imagen, razón por la cual la mayoría de los archivos se reducen entre un 50 y un 70 por ciento sin cambios visibles en la calidad del texto.

La mayoría de las herramientas de compresión en línea y de escritorio ofrecen configuraciones de calidad que van desde la compresión máxima hasta la calidad máxima, pero la etiqueta en el control deslizante rara vez le indica qué está haciendo realmente la herramienta. Una configuración etiquetada como "alta compresión" podría significar una reducción agresiva de la resolución de la imagen manteniendo el contenido vectorial, o podría significar una rasterización de página completa a 150 DPI seguida de una fuerte compresión JPEG. La distinción no es cosmética, es la diferencia entre un archivo más pequeño que tiene el mismo aspecto y un archivo más pequeño que parece visiblemente degradado.

La configuración más importante a buscar es la resolución de reducción de resolución de la imagen. Los ajustes preestablecidos comunes incluyen 72 DPI para visualización solo en pantalla, 150 DPI para documentos de oficina estándar que se pueden imprimir y 300 DPI para documentos destinados a impresión profesional. Para texto y gráficos vectoriales, la configuración de DPI es irrelevante porque no tienen píxeles para reducir la resolución. Sólo las imágenes rasterizadas dentro del PDF se ven afectadas, e incluso a 150 DPI siguen siendo perfectamente aceptables para la lectura en pantalla.

Los algoritmos de compresión aplicados a imágenes en color y en escala de grises constituyen la segunda configuración crítica. La compresión JPEG a un nivel de calidad del 60 al 80 por ciento normalmente produce archivos que son entre un 50 y un 70 por ciento más pequeños que el original sin comprimir con una diferencia visible mínima para el contenido fotográfico. Para escaneos monocromáticos, la compresión JBIG2 o CCITT Grupo 4 logra una excelente reducción de tamaño en páginas en blanco y negro al tiempo que preserva la legibilidad del texto. El enfoque correcto Reducir tamaño de PDF separa estas decisiones, aplicando diferentes algoritmos a diferentes tipos de contenido dentro de la misma página.

Herramientas que preservan la distinción ráster-vector

El panorama de las herramientas de compresión se divide claramente en dos categorías: aquellas que analizan y respetan la estructura interna del objeto PDF y aquellas que tratan el PDF como una imagen plana que debe volver a codificarse. Las herramientas de la primera categoría leen la tabla de referencias cruzadas del PDF, identifican cada flujo de contenido, fuente y objeto de imagen individualmente y aplican compresión solo cuando tiene sentido. Las herramientas de la segunda categoría renderizan la página en un mapa de bits y luego comprimen ese mapa de bits, descartando la información estructural que convirtió el PDF en un PDF en primer lugar.

Las aplicaciones de escritorio como Adobe Acrobat Pro, Ghostscript y varios procesadores de PDF de código abierto entran en la primera categoría. Le brindan control independiente sobre la compresión de imágenes en color, la compresión de imágenes en escala de grises y la compresión de imágenes monocromáticas, sin tocar nunca los flujos de texto y contenido vectorial. La desventaja es que estas herramientas son más pesadas y complejas que un compresor web de un solo clic.

Entre las herramientas basadas en navegador, la brecha de calidad se ha reducido. Los mejores compresores en línea ahora realizan un análisis de PDF del lado del servidor que respeta la distinción Raster Vector PDF, aplicando compresión MRC (Mixed Raster Content), que segmenta cada página en regiones de texto, regiones de imagen y regiones de fondo, comprimiendo cada una con el algoritmo que mejor se adapta a ella. Las regiones de texto obtienen JBIG2 sin pérdidas, las fotografías obtienen JPEG y los fondos sólidos obtienen un relleno de baja resolución. Un estudio de 2025 realizado por la Asociación Internacional de PDF encontró que la compresión basada en MRC reducía el tamaño de los archivos en un promedio del 68 por ciento, manteniendo al mismo tiempo los puntajes de legibilidad del texto estándar ISO (Asociación PDF, "Técnicas avanzadas de compresión para documentos de contenido mixto", 2025).

Las herramientas basadas en navegador que se ejecutan en el lado del cliente están limitadas por lo que pueden hacer el motor JavaScript del navegador y la API Canvas. Por lo general, rasterizan la página porque el entorno del navegador no les brinda acceso directo a la estructura interna de objetos del PDF. Si una herramienta procesa su archivo por completo en el navegador sin cargarlo en un servidor, asuma que está utilizando el enfoque de rasterización a menos que la herramienta indique explícitamente lo contrario.

Paso a paso: comprimir correctamente un PDF de contenido mixto

Primero, determine qué debe hacer su archivo comprimido. Si el PDF solo se leerá en las pantallas, puede reducir la resolución de las imágenes a 150 DPI y usar calidad JPEG 60 sin preocuparse por la calidad del texto porque el texto es vectorial y se representará en resolución de pantalla completa independientemente. Si el archivo se puede imprimir en una impresora de oficina estándar, configure la reducción de resolución de la imagen en 200-300 DPI y la calidad JPEG en 80. Para uso de archivo o preimpresión, aplique compresión FlateDecode sin pérdidas a las imágenes y evite cualquier reducción de resolución.

En segundo lugar, abra su PDF en una herramienta que exponga la configuración de compresión por objeto. En el cuadro de diálogo de compresión de la herramienta, confirme que la opción "comprimir texto y arte lineal" La opción está habilitada. Esta configuración aplica compresión DEFLATE sin pérdidas a los flujos de contenido donde se almacenan rutas de texto y vectores. La reducción es modesta, típicamente del 20 al 30 por ciento solo para las transmisiones de contenido, pero no produce cambios visuales y hace que la compresión de imágenes posterior sea más efectiva en general.

En tercer lugar, aplique compresión específica de la imagen. Configure las imágenes en color en calidad JPEG 60-80 según su tolerancia de calidad. Configure las imágenes en escala de grises con el mismo rango de calidad JPEG. Configure las imágenes monocromáticas en JBIG2 sin pérdidas o CCITT Grupo 4. Si su herramienta ofrece la función "eliminar metadatos" o "descartar objetos ocultos" opción, habilítela. Los PDF suelen contener miniaturas incrustadas, diccionarios de información de documentos y objetos no utilizados que contribuyen al tamaño del archivo sin afectar la salida visible.

Cuarto, ejecute la compresión y luego verifique el resultado. Abra el archivo comprimido y amplíe al menos un 400 por ciento en una sección de texto. Los bordes del texto deben ser tan nítidos como en el original. Seleccione una oración y cópiela; la copia debería producir exactamente los mismos caracteres. Si cualquiera de las pruebas falla, la herramienta rasterizó la página y deberá probar con un compresor diferente o una configuración de mayor calidad. WukongPDF maneja este paso de verificación de forma natural porque su compresión preserva el texto como texto por diseño, por lo que la prueba de copiar y pegar siempre pasará.

Quinto, compare los tamaños de los archivos. Un PDF de contenido mixto bien comprimido en el que las imágenes fueran el principal contribuyente al tamaño del archivo debería terminar entre un 50 y un 70 por ciento más pequeño. Si la reducción de tamaño es dramáticamente mayor, por encima del 90 por ciento, es posible que la herramienta haya eliminado algo más que solo datos de imagen, y usted debe verificar si falta contenido. Si la reducción es inferior al 20 por ciento, es probable que las imágenes de su PDF ya estén comprimidas y no haya mucho más que optimizar sin cambiar a un enfoque con pérdidas.

Cuando la rasterización realmente tiene sentido

Hay escenarios en los que la rasterización de página completa no es un error sino una compensación deliberada. Si un PDF contiene miles de pequeños elementos vectoriales, un dibujo CAD complejo con cientos de miles de segmentos de línea individuales o una visualización de datos intrincada con capas semitransparentes superpuestas, los flujos de contenido que codifican todas esas instrucciones vectoriales pueden en realidad ser más grandes que una imagen rasterizada de alta resolución de la misma página. En estos casos extremos, rasterizar a 300 DPI y aplicar compresión JPEG produce un archivo más pequeño que mantener la representación vectorial, y a 300 DPI el texto sigue siendo legible para todos los propósitos prácticos.

La clave es tomar esta decisión conscientemente en lugar de que la herramienta la tome por usted de forma predeterminada. Si su PDF es un documento de oficina estándar, un informe, un libro electrónico, un formulario o cualquier cosa compuesta principalmente de texto con una cantidad moderada de imágenes incrustadas, la compresión selectiva que preserve la capa de texto vectorial es siempre el enfoque correcto. Si su PDF es un esquema de ingeniería, un mapa muy detallado o una prueba de diseño donde la complejidad del vector supera el beneficio de mantenerlo vectorial, considere la rasterización, pero solo con una resolución lo suficientemente alta como para que el texto siga siendo legible.

Errores comunes que provocan la pixelación del texto después de la compresión

Un error frecuente es volver a comprimir un PDF ya comprimido. Si un PDF ya fue procesado por una herramienta que rasterizó las páginas, el texto ya es una imagen. Pasarlo por una segunda herramienta de compresión que aplica una reducción agresiva de la resolución de la imagen agravará la degradación. La segunda herramienta ve la página completa como una imagen grande y la reduce aún más, reduciendo lo que alguna vez fue un texto vectorial nítido a un desorden borroso. La solución es conservar siempre una copia del archivo original sin comprimir y volver a comprimirlo desde el original, nunca desde una versión ya comprimida.

Otro error común es utilizar el ajuste preestablecido de menor calidad en una herramienta sin comprobar qué hace. La "compresión máxima" o "tamaño de archivo más pequeño" El valor preestablecido en muchas herramientas permite la rasterización de página completa a 72 o 100 DPI, porque es la forma más rápida de garantizar un archivo de salida pequeño independientemente del contenido de entrada. El archivo resultante puede ser impresionantemente pequeño, pero su texto se verá suave incluso en un monitor estándar y será esencialmente ilegible si el lector hace zoom.

Un tercer error es ignorar la conversión del espacio de color que aplican algunas herramientas durante la compresión. Cuando una herramienta convierte un PDF en color a escala de grises como estrategia de reducción de tamaño, solo debería afectar los canales de color de las imágenes incrustadas. Si, en cambio, la herramienta rasteriza la página y luego convierte el mapa de bits resultante a escala de grises, el texto coloreado y los elementos vectoriales también se aplanan. La solución es verificar que cualquier conversión de color se aplique selectivamente a los objetos de la imagen en lugar de a la página en su conjunto.

La falta de coincidencia de resolución entre las imágenes originales y el objetivo de compresión también puede crear problemas. Si el PDF original contiene imágenes a 600 DPI y las reduce a 72 DPI, las fotografías se verán suaves y los diagramas perderán detalles finos. La compresión debe coincidir con el uso previsto. Un objetivo de 72 DPI es apropiado sólo para documentos que se verán exclusivamente en pantallas con niveles de zoom normales. Cualquier documento que pueda imprimirse, incluso en una impresora de oficina básica, debe utilizar al menos 150 DPI como objetivo de reducción de resolución para las imágenes.

WukongPDF

Pruebe comprimir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →