La maggior parte delle persone ritiene che comprimere un PDF significhi accettare un certo livello di perdita di qualità. Questa ipotesi è vera solo a metà. Il testo e la grafica vettoriale all'interno di un PDF vengono archiviati come descrizioni matematiche di forme, curve e glifi dei caratteri, non come griglie fisse di pixel. Quando uno strumento di compressione comprende questa distinzione, può ridurre il file ottimizzando in modo aggressivo le immagini raster incorporate lasciando ogni lettera, linea e poligono esattamente nitidi come l'originale. Il risultato è un file che sembra identico ma è una frazione della dimensione.
Il problema sorge quando uno strumento di compressione appiattisce tutto, incluso il contenuto vettoriale, in un singolo livello di immagine prima di applicare la compressione. A quel punto, il testo diventa una fotografia di testo, soggetta alla stessa sfocatura e agli stessi artefatti JPEG che influenzano qualsiasi immagine compressa. Capire quando e perché ciò accade è la chiave per evitarlo. Questa guida spiega la differenza tra contenuto vettoriale e raster nei PDF, come identificare il tipo contenuto nel file e come scegliere le impostazioni di compressione che riducono le dimensioni del file senza trasformare il testo nitido in un pasticcio pixelato.

Perché alcuni compressori PDF trasformano il testo in immagini sfocate?
Un sondaggio del 2025 condotto dalla PDF Association ha rilevato che il 47% degli utenti che hanno segnalato una perdita di qualità visiva dopo la compressione avevano utilizzato uno strumento che rasterizzava l'intera pagina, incluso il testo, prima di applicare la compressione JPEG o JPEG 2000 (PDF Association, "PDF Compression Practices Survey", 2025). Quando una pagina PDF viene rasterizzata, ogni elemento della pagina viene convertito in un'unica immagine piatta con una risoluzione fissa. Il testo che una volta era selezionabile, ricercabile e infinitamente nitido diventa un'immagine di testo e la sua chiarezza è limitata dalla risoluzione utilizzata dalla fase di rasterizzazione.
Ciò accade più spesso con strumenti basati su browser e app mobili leggere che utilizzano una pipeline di elaborazione semplificata. Invece di analizzare la struttura interna del PDF e ricomprimere selettivamente i singoli oggetti immagine, eseguono il rendering della pagina in un elemento tela o in una bitmap fuori schermo, quindi codificano quella bitmap come una nuova immagine. È veloce e funziona su qualsiasi PDF indipendentemente dalla sua complessità interna, ma tratta il compito di un chirurgo come una mazza.
Il formato file PDF utilizza due modi fondamentalmente diversi per rappresentare il contenuto visivo. La grafica vettoriale memorizza le istruzioni per disegnare: una linea dal punto A al punto B, un cerchio con un determinato raggio, un carattere di un carattere specificato con una dimensione specificata. Queste istruzioni riproducono a qualsiasi risoluzione richiesta dal display, dallo schermo di un telefono a un cartellone pubblicitario, senza perdita di nitidezza. Le immagini raster memorizzano una griglia di pixel colorati a una risoluzione fissa, in genere compresa tra 72 e 300 punti per pollice, e non possono essere ingrandite oltre la risoluzione nativa senza un degrado visibile.
Questa distinzione è importante perché un PDF creato da un elaboratore di testi o da un'applicazione di desktop publishing è in genere a predominanza di vettori. Il suo testo è testo reale memorizzato come codici di carattere con riferimenti a caratteri. I suoi loghi e grafici sono percorsi vettoriali. Solo le fotografie incorporate, se presenti, sono immagini raster. Uno strumento di compressione progettato correttamente lo sa e lascia intatta la porzione vettoriale.
Prova a comprimere PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Come verificare se il PDF contiene testo vettoriale o raster
Prima di applicare qualsiasi compressione, vale la pena sapere che tipo di contenuto contiene effettivamente il tuo PDF. Il test più semplice consiste nell'aprire il file in qualsiasi visualizzatore PDF standard e ingrandirlo fino al 400% o superiore. Se il testo rimane nitido e con bordi smussati, si tratta di testo vettoriale. Se i bordi diventano frastagliati o squadrati, il testo è già stato rasterizzato in una fase precedente e un'ulteriore compressione deve essere affrontata con particolare attenzione.
Un secondo test consiste nel provare a selezionare e copiare una frase di testo. Se è possibile evidenziare singoli caratteri e copiarli negli appunti, il testo viene memorizzato come dati di testo effettivi. Se facendo clic e trascinando si seleziona un'area rettangolare invece di seguire il flusso del testo o se non è possibile selezionare nulla, la pagina è un'immagine digitalizzata o è stata rasterizzata. I PDF scansionati richiedono l'elaborazione OCR per recuperare un livello di testo e la loro compressione comporta considerazioni diverse rispetto alla compressione di un documento digitale nativo.
Puoi anche controllare la struttura dell'oggetto del file utilizzando uno strumento come pdfinfo o un visualizzatore di metadati. Cerca oggetti font, che confermano la presenza di testo reale, e oggetti immagine con filtri DCTDecode o JPXDecode, che indicano immagini raster compresse JPEG o JPEG 2000. Un documento che contiene sia oggetti carattere che oggetti immagine è un PDF a contenuto misto ed è il candidato ideale per la compressione selettiva. Comprendere questa struttura interna è ciò che separa una compressione che preserva la qualità da una che la degrada.
Scelta delle impostazioni di compressione che proteggono il contenuto vettoriale
Se hai bisogno di comprimere un PDF preservando ogni dettaglio vettoriale, lo strumento Compressione PDF di WukongPDF analizza ogni elemento della pagina individualmente. I percorsi di testo e vettoriali rimangono intatti mentre vengono ottimizzati solo i dati dell'immagine, motivo per cui la maggior parte dei file si riduce dal 50 al 70% senza alcun cambiamento visibile nella qualità del testo.
La maggior parte degli strumenti di compressione desktop e online offrono impostazioni di qualità che vanno dalla massima compressione alla massima qualità, ma l'etichetta sul dispositivo di scorrimento raramente indica cosa sta effettivamente facendo lo strumento. Un'impostazione denominata "compressione alta" potrebbe significare un downsampling aggressivo dell'immagine con il contenuto vettoriale preservato, oppure potrebbe significare la rasterizzazione dell'intera pagina a 150 DPI seguita da una pesante compressione JPEG. La distinzione non è estetica, è la differenza tra un file più piccolo che sembra uguale e un file più piccolo che sembra visibilmente degradato.
L'impostazione più importante da cercare è la risoluzione del downsampling dell'immagine. Le preimpostazioni comuni includono 72 DPI per la visualizzazione solo su schermo, 150 DPI per documenti da ufficio standard che possono essere stampati e 300 DPI per documenti destinati alla stampa professionale. Per il testo e la grafica vettoriale, le impostazioni DPI sono irrilevanti perché non hanno pixel da sottocampionare. Sono interessate solo le immagini raster all'interno del PDF, che anche a 150 DPI rimangono perfettamente accettabili per la lettura su schermo.
Gli algoritmi di compressione applicati alle immagini a colori e in scala di grigi costituiscono la seconda impostazione critica. La compressione JPEG a un livello di qualità compreso tra il 60 e l'80% produce generalmente file più piccoli del 50-70% rispetto all'originale non compresso con una differenza visibile minima per il contenuto fotografico. Per le scansioni monocromatiche, la compressione JBIG2 o CCITT Gruppo 4 consente di ottenere un'eccellente riduzione delle dimensioni delle pagine in bianco e nero preservando la leggibilità del testo. Il giusto approccio Riduci le dimensioni del PDF separa queste decisioni, applicando algoritmi diversi a diversi tipi di contenuto all'interno della stessa pagina.
Strumenti che preservano la distinzione raster-vettore
Il panorama degli strumenti di compressione si divide nettamente in due categorie: quelli che analizzano e rispettano la struttura interna dell'oggetto PDF e quelli che trattano il PDF come un'immagine piatta da ricodificare. Gli strumenti della prima categoria leggono la tabella dei riferimenti incrociati del PDF, identificano individualmente ciascun flusso di contenuto, carattere e oggetto immagine e applicano la compressione solo dove ha senso. Gli strumenti della seconda categoria trasformano la pagina in una bitmap e quindi la comprimono, scartando le informazioni strutturali che hanno reso il PDF un PDF in primo luogo.
Le applicazioni desktop come Adobe Acrobat Pro, Ghostscript e diversi processori PDF open source rientrano nella prima categoria. Ti offrono un controllo indipendente sulla compressione delle immagini a colori, sulla compressione delle immagini in scala di grigi e sulla compressione delle immagini monocromatiche, senza mai toccare i flussi di testo e contenuto vettoriale. Il compromesso è che questi strumenti sono più pesanti e complessi di un compressore web con un solo clic.
Tra gli strumenti basati su browser, il divario qualitativo si è ridotto. I migliori compressori online ora eseguono l'analisi PDF lato server che rispetta la distinzione Raster Vector PDF, applicando la compressione MRC (Mixed Raster Content), che segmenta ciascuna pagina in regioni di testo, regioni di immagini e regioni di sfondo, comprimendole ciascuna con l'algoritmo più adatto ad essa. Le aree di testo ottengono JBIG2 senza perdite, le fotografie ottengono JPEG e gli sfondi solidi ottengono un riempimento a bassa risoluzione. Uno studio del 2025 condotto dall'International PDF Association ha rilevato che la compressione basata su MRC ha ridotto le dimensioni dei file in media del 68% mantenendo i punteggi di leggibilità del testo standard ISO (PDF Association, "Advanced Compression Techniques for Mixed-Content Documents", 2025).
Gli strumenti basati su browser in esecuzione sul lato client sono limitati da ciò che possono fare il motore JavaScript del browser e l'API Canvas. In genere rasterizzano la pagina perché l'ambiente del browser non fornisce loro l'accesso diretto alla struttura degli oggetti interni del PDF. Se uno strumento elabora il file interamente nel browser senza caricarlo su un server, presumi che stia utilizzando l'approccio di rasterizzazione a meno che lo strumento non indichi esplicitamente il contrario.
Passo passo: comprimere correttamente un PDF con contenuti misti
Innanzitutto, determina cosa deve fare il tuo file compresso. Se il PDF verrà letto solo sugli schermi, puoi eseguire il downsampling delle immagini a 150 DPI e utilizzare la qualità JPEG 60 senza preoccuparti della qualità del testo perché il testo è vettoriale e verrà visualizzato comunque con la risoluzione a schermo intero. Se il file può essere stampato su una stampante da ufficio standard, imposta il downsampling dell'immagine su 200-300 DPI e la qualità JPEG su 80. Per l'utilizzo in ambito di archiviazione o prestampa, applica la compressione FlateDecode senza perdita di dati alle immagini ed evita qualsiasi downsampling.
In secondo luogo, apri il tuo PDF in uno strumento che esponga le impostazioni di compressione per oggetto. Nella finestra di dialogo di compressione dello strumento, conferma che la casella "comprimi testo e grafica al tratto" l'opzione è abilitata. Questa impostazione applica la compressione DEFLATE senza perdita ai flussi di contenuto in cui sono archiviati testo e percorsi vettoriali. La riduzione è modesta, in genere dal 20 al 30% solo per i flussi di contenuto, ma non comporta alcun cambiamento visivo e rende la successiva compressione dell'immagine complessivamente più efficace.
In terzo luogo, applica la compressione specifica dell'immagine. Imposta le immagini a colori sulla qualità JPEG 60-80 a seconda della tua tolleranza di qualità. Imposta le immagini in scala di grigi sullo stesso intervallo di qualità JPEG. Imposta le immagini monocromatiche su JBIG2 lossless o CCITT Gruppo 4. Se il tuo strumento offre un'opzione "rimuovi metadati" o "scarta oggetti nascosti" opzione, abilitala. I PDF spesso contengono miniature incorporate, dizionari di informazioni sui documenti e oggetti inutilizzati che contribuiscono alla dimensione del file senza influire sull'output visibile.
In quarto luogo, esegui la compressione e quindi verifica l'output. Apri il file compresso e ingrandisci almeno il 400% su una sezione di testo. I bordi del testo dovrebbero essere netti come nell'originale. Seleziona una frase e copiala, la copia dovrebbe produrre esattamente gli stessi caratteri. Se uno dei test fallisce, lo strumento ha rasterizzato la pagina e dovresti provare un compressore diverso o un'impostazione di qualità superiore. WukongPDF gestisce questo passaggio di verifica in modo naturale perché la sua compressione preserva il testo come testo in base alla progettazione, quindi il test copia-incolla verrà sempre superato.
In quinto luogo, confronta le dimensioni dei file. Un PDF con contenuto misto ben compresso in cui le immagini contribuivano principalmente alla dimensione del file dovrebbe risultare più piccolo del 50-70%. Se la riduzione delle dimensioni è notevolmente più elevata, superiore al 90%, lo strumento potrebbe aver rimosso più dei semplici dati dell'immagine e dovresti verificare la presenza di contenuti mancanti. Se la riduzione è inferiore al 20%, è probabile che le immagini nel tuo PDF siano già compresse e non c'è molto altro da ottimizzare senza passare a un approccio con perdita di dati.
Quando la rasterizzazione ha davvero senso
Esistono scenari in cui la rasterizzazione dell'intera pagina non è un errore ma un compromesso deliberato. Se un PDF contiene migliaia di minuscoli elementi vettoriali, un disegno CAD complesso con centinaia di migliaia di singoli segmenti di linea o un'intricata visualizzazione di dati con strati semitrasparenti sovrapposti, i flussi di contenuto che codificano tutte quelle istruzioni vettoriali possono effettivamente essere più grandi di un'immagine raster ad alta risoluzione della stessa pagina. In questi casi limite, la rasterizzazione a 300 DPI e l'applicazione della compressione JPEG producono un file più piccolo rispetto al mantenimento della rappresentazione vettoriale e a 300 DPI il testo rimane leggibile a tutti gli effetti pratici.
La chiave è prendere questa decisione consapevolmente piuttosto che lasciare che lo strumento la faccia per te per impostazione predefinita. Se il tuo PDF è un documento Office standard, un report, un ebook, un modulo o qualsiasi cosa composta principalmente da testo con un numero moderato di immagini incorporate, la compressione selettiva che preserva il livello di testo vettoriale è sempre l'approccio giusto. Se il tuo PDF è uno schema tecnico, una mappa altamente dettagliata o una prova di progettazione in cui la complessità del vettore supera il vantaggio di mantenerlo vettoriale, considera la rasterizzazione ma solo a una risoluzione sufficientemente elevata da garantire che il testo rimanga leggibile.
Errori comuni che causano la pixelizzazione del testo dopo la compressione
Un errore frequente è ricomprimere un PDF già compresso. Se un PDF è già stato elaborato da uno strumento che ha rasterizzato le pagine, il testo è già un'immagine. L'esecuzione attraverso un secondo strumento di compressione che applica un downsampling aggressivo dell'immagine aggraverà il degrado. Il secondo strumento vede l'intera pagina come un'unica grande immagine e la sottocampiona ulteriormente, riducendo quello che una volta era un testo vettoriale nitido in un pasticcio sfocato. La soluzione è conservare sempre una copia del file originale non compresso e ricomprimerlo dall'originale, mai da una versione già compressa.
Un altro errore comune è utilizzare la preimpostazione di qualità più bassa su uno strumento senza controllare cosa fa. La "massima compressione" o "dimensione file minima" preimpostato in molti strumenti consente la rasterizzazione dell'intera pagina a 72 o 100 DPI, perché è il modo più veloce per garantire un file di output di piccole dimensioni indipendentemente dal contenuto di input. Il file risultante potrebbe essere sorprendentemente piccolo, ma il suo testo apparirà morbido anche su un monitor standard e sarà sostanzialmente illeggibile se il lettore ingrandisce.
Un terzo errore è ignorare la conversione dello spazio colore che alcuni strumenti applicano durante la compressione. Quando uno strumento converte un PDF a colori in scala di grigi come strategia di riduzione delle dimensioni, dovrebbe influenzare solo i canali di colore delle immagini incorporate. Se invece lo strumento rasterizza la pagina e poi converte la bitmap risultante in scala di grigi, verranno appiattiti anche il testo colorato e gli elementi vettoriali. La soluzione consiste nel verificare che qualsiasi conversione del colore venga applicata selettivamente agli oggetti immagine anziché alla pagina nel suo insieme.
Anche la mancata corrispondenza della risoluzione tra le immagini originali e la destinazione della compressione può creare problemi. Se il PDF originale contiene immagini a 600 DPI e le sottocampioni a 72 DPI, le fotografie appariranno morbide e i diagrammi perderanno i dettagli più fini. La compressione dovrebbe corrispondere all'uso previsto. Un target di 72 DPI è appropriato solo per i documenti che verranno visualizzati esclusivamente su schermi a livelli di zoom normali. Qualsiasi documento che potrebbe essere stampato, anche su una semplice stampante da ufficio, dovrebbe utilizzare almeno 150 DPI come target di downsampling per le immagini.
Prova a comprimere PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
