Tips & Tricks

Come riparare un PDF che si apre correttamente ma stampa con testo confuso o mancante

Un PDF che si apre istantaneamente e visualizza ogni pagina perfettamente sullo schermo ma produce pagine con caratteri confusi, lettere mancanti, simboli sovrapposti o aree completamente vuote quando inviato a una stampante fisica presenta una mancata corrispondenza nel rendering dei caratteri tra la pipeline di rendering dello schermo e la pipeline di rendering della stampa. La struttura del documento nel suo insieme è intatta. I flussi di contenuto sono validi e analizzabili. Il visualizzatore su schermo può individuare e disegnare correttamente ogni glifo. Tuttavia, le informazioni necessarie alla stampante per riprodurre fedelmente lo stesso testo sono assenti nel file, presenti ma internamente incoerenti o incompatibili con il sottosistema di gestione dei caratteri della stampante. Un approccio mirato Ripara PDF che affronta specifici livelli di incorporamento e descrizione dei caratteri risolve la causa più comune di questo sintomo in modo affidabile, spesso senza richiedere la ricostruzione del documento dai file di origine originali.

Questo problema è frustrante perché il documento appare perfettamente a posto durante l'intero processo di modifica e revisione sullo schermo. L'autore vede il testo corretto e presuppone che il file sia pronto per la distribuzione. Solo il destinatario, o l'autore, all'ultimo minuto quando stampa una copia cartacea per una riunione o una presentazione, scopre che l'output stampato è illeggibile. La discrepanza tra schermo e stampa non è casuale. Ne consegue una serie prevedibile di cause radicate nel modo in cui il formato PDF gestisce i dati dei caratteri e ciascuna causa ha una soluzione corrispondente.

How to Repair a PDF That Opens Correctly but Prints With Garbled or Missing Text

Perché un PDF può essere visualizzato correttamente sullo schermo ma non funziona una volta stampato

Il motore di rendering dello schermo e il motore di rendering della stampa all'interno di un'applicazione consumer PDF utilizzano due diversi percorsi di risoluzione dei caratteri. Un renderer dello schermo può ricorrere con garbo a un font di sistema sostitutivo quando il font incorporato originale è danneggiato, mancante o incorporato solo parzialmente. Può approssimare le forme dei glifi e le larghezze dei caratteri abbastanza da far sì che il testo appaia accettabile su un display a risoluzione medio-bassa. Una stampante, in particolare una stampante PostScript che interpreta il linguaggio di descrizione della pagina in modo nativo, richiede il sottoinsieme di caratteri originale completamente incorporato con i suoi dati di glifi completi e metriche di descrizione dei caratteri, oppure una corrispondenza stretta dei caratteri di sistema più tabelle di descrizione dei caratteri accuratamente definite, inclusa la matrice di larghezza dei caratteri, il riquadro di delimitazione dei caratteri, l'altezza del cappuccio, la larghezza dei gambi e le coppie di crenatura.

La specifica PDF definisce tre strategie distinte per la gestione dei caratteri (Adobe, "PDF Reference 1.7", 2006). I caratteri completamente incorporati includono l'intero programma binario dei caratteri nel file PDF. I caratteri incorporati nel sottoinsieme includono solo i caratteri specifici effettivamente utilizzati nel documento, identificati dai relativi punti di codice Unicode. I font di riferimento non includono alcun dato sui font; chiamano un font di sistema standard con il nome BaseFont e dipendono dal visualizzatore o dalla stampante per fornire un font corrispondente al momento della visualizzazione o della stampa. I caratteri di riferimento sono di gran lunga la fonte più comune di discrepanze tra testo su schermo e testo stampato perché la raccolta di caratteri installata sulla stampante differisce quasi sempre dalla raccolta di caratteri del visualizzatore almeno in alcuni caratteri tipografici.

WukongPDF

Prova a riparare PDF

Nessuna installazione necessaria. Funziona direttamente nel tuo browser.

Inizia ora →

Controllare quali caratteri sono incorporati e quali sono semplicemente referenziati

Il primo passaggio diagnostico consiste nell'aprire il PDF in qualsiasi visualizzatore in grado di segnalare lo stato di incorporamento di ciascun carattere utilizzato nel documento. In Adobe Acrobat Reader o Acrobat Pro, vai su File, Proprietà e fai clic sulla scheda Caratteri. La scheda elenca tutti i caratteri che appaiono ovunque nel documento. Accanto al nome di ciascun carattere viene mostrato lo stato di incorporamento. Un carattere elencato con lo stato "Incorporato" ha il suo programma di glifi completo memorizzato nel PDF. "Sottoinsieme incorporato" significa che sono presenti solo i caratteri specifici utilizzati nel testo del documento, il che è normale e sufficiente per la maggior parte dei documenti. Un carattere elencato senza alcun indicatore di incorporamento, che mostra solo il nome del carattere e un tipo come "Tipo 1"; o "TrueType", è un carattere di riferimento senza dati incorporati.

Se la scheda Caratteri rivela uno o più caratteri di riferimento, tali caratteri sono i principali sospettati dell'errore di stampa. Uno strumento Fix PDF o preflight in grado di individuare i caratteri di sistema corrispondenti, estrarre le forme dei glifi richieste solo per i caratteri utilizzati nel documento e incorporare tali glifi come nuovo sottoinsieme di caratteri all'interno del PDF risolve il problema di stampa. Il sottoinsieme incorporato fornisce alla stampante tutti i glifi di cui ha bisogno, eliminando la dipendenza dalla raccolta di caratteri della stampante.

Stampare il documento come immagine per ignorare l'elaborazione di tutti i caratteri

Quando i dati dei font sono effettivamente mancanti o danneggiati e né l'incorporamento né la riparazione sono immediatamente fattibili, la stampa del PDF come sequenza di immagini raster ignora completamente il sottosistema dei font della stampante. Nella finestra di dialogo Stampa di Adobe Acrobat Reader, fai clic sul pulsante Avanzate e seleziona l'opzione denominata "Stampa come immagine". Questa impostazione indica ad Acrobat di eseguire internamente il rendering di ciascuna pagina su una bitmap ad alta risoluzione e di trasmettere quindi solo i dati bitmap alla stampante, invece di inviare i comandi di disegno vettoriale originali e gli operatori di posizionamento del testo. L'output stampato sarà completamente leggibile, ma il testo di piccole dimensioni come note a piè di pagina, etichette degli assi o caratteri piccoli potrebbe mostrare un leggero ammorbidimento ai bordi dei caratteri a causa della fase di rasterizzazione.

La tabella seguente riassume i compromessi tra le diverse impostazioni di risoluzione della stampa come immagine:

Impostazione risoluzioneQualità del testo in uscitaDimensioni approssimative della bobina per paginaIl più adatto per
300 DPIBuono nel complesso, leggero ammorbidimento visibile sui serif inferiori a 8 puntiCirca 8 MB per una pagina di lettereDocumenti d'ufficio standard, rapporti interni, bozze
600 DPIEccellente, quasi indistinguibile dal vero testo vettorialeCirca 30 MB per una pagina di lettereContratti, documenti legali, documenti con note a piè di pagina o testo di piccole dimensioni
1200 DPIIndistinguibile dall'output vettoriale originaleCirca 120 MB per una pagina di lettereProve di stampa professionali, copie di conservazione di qualità d'archivio

Convertire il PDF in una versione appiattita con caratteri rasterizzati in modo permanente

Per una soluzione permanente che produca un documento autonomo che verrà stampato in modo identico su qualsiasi stampante, sistema operativo e visualizzatore PDF, converti l'intero PDF in una versione in cui tutto il testo è stato rasterizzato ad alta risoluzione. Ciò produce un nuovo file PDF in cui ogni pagina viene archiviata come immagine ad alta risoluzione e non rimangono dipendenze di carattere di alcun tipo nell'output. Il compromesso è che il testo diventa non ricercabile e non selezionabile e la dimensione del file aumenta rispetto al documento originale basato su vettori.

Ghostscript, il processore PDF gratuito da riga di comando, esegue questa conversione in modo efficiente. Il comando `gs -o output.pdf -sDEVICE=pdfwrite -dPDFSETTINGS=/printer -dEmbedAllFonts=true -dSubsetFonts=true input.pdf` utilizza la preimpostazione della stampante, che rasterizza il testo preservando la qualità dell'immagine a 300 DPI. Per una maggiore fedeltà, la preimpostazione di prestampa mantiene 300 DPI per le immagini a colori e in scala di grigi e lascia il testo come dati vettoriali dove i dati dei font sono validi. Se i dati dei caratteri sono danneggiati, aggiungi il flag `-dNoOutputFonts` al comando Ghostscript per forzare la rasterizzazione completa del testo indipendentemente dalla validità dei caratteri.

Riparare tabelle di caratteri danneggiate utilizzando uno strumento di preflight PDF

Quando le tabelle metriche interne di un font sono danneggiate anziché mancanti, uno strumento di riparazione preliminare può correggere le tabelle senza rasterizzare il testo. Un programma di font contiene diverse tabelle di dati interne. La "cmap" table associa i codici dei caratteri Unicode agli indici dei glifi all'interno del carattere. Una tabella cmap danneggiata fa sì che la stampante selezioni e disegni la forma del glifo errata per un determinato codice carattere, producendo caratteri confusi apparentemente casuali. Il "hmtx" La tabella memorizza le metriche orizzontali inclusa la larghezza di avanzamento di ciascun glifo. Una tabella hmtx danneggiata provoca la sovrapposizione, la collisione o la spaziatura dei caratteri a distanze irregolari. Gli strumenti di preflight possono rilevare danneggiamenti in entrambe le tabelle e ricostruirle dalla parte valida dei dati dei caratteri incorporati o sostituire un carattere di sistema corrispondente e rigenerare tabelle pulite dal sostituto.

Moduli di preflight professionali in Adobe Acrobat Pro nella sezione "Correzioni PDF" categoria e in callas pdfToolbox forniscono operazioni di riparazione della tabella dei font con un solo clic. Lo strumento Ripara PDF di WukongPDF include la diagnostica automatizzata dei caratteri che rileva l'incorporamento mancante, il danneggiamento del cmap e le incoerenze hmtx in un unico passaggio di analisi. I servizi di riparazione basati su browser includono sempre più la ricostruzione di sottoinsiemi di caratteri come parte della loro pipeline di riparazione automatizzata standard, rendendo la riparazione delle tabelle di caratteri accessibile senza software desktop o competenze da riga di comando.

Verificare l'output riparato su più tipi di stampanti e driver

Un PDF che viene stampato correttamente su una stampante a getto d'inchiostro domestica utilizzando un driver PCL standard potrebbe comunque produrre testo confuso su una stampante laser da ufficio che utilizza un driver PostScript o su una macchina da stampa digitale di produzione che utilizza un processore di immagini raster proprietario. Diversi tipi di stampante interpretano i dati dei font con diversi livelli di tolleranza per tabelle di font non standard o leggermente deformate. Le stampanti PostScript tendono ad essere più rigorose riguardo alla conformità dei caratteri rispetto alle stampanti PCL e rifiutano o interpretano in modo errato i caratteri che un driver PCL accetta silenziosamente con la sostituzione.

Dopo aver completato la riparazione, stampare una singola pagina di prova su ciascun tipo di stampante che probabilmente verrà utilizzata dal documento. Se il documento deve essere stampato in modo affidabile su un'ampia varietà di modelli di stampante sconosciuti, come un modulo che i destinatari stamperanno sulle stampanti del proprio ufficio o di casa, la stampa basata su immagini o l'approccio di rasterizzazione completa è la scelta più sicura e universalmente compatibile. Il leggero compromesso nella nitidezza del testo è controbilanciato dalla certezza che ogni destinatario vedrà un output leggibile indipendentemente dall'hardware della stampante.

Quando un PDF si apre e viene visualizzato correttamente sullo schermo ma produce testo confuso, mancante o illeggibile una volta stampato, la causa è quasi sempre radicata nel livello di gestione dei caratteri del documento. Controlla prima lo stato di incorporamento del carattere nelle proprietà del documento. Se sono presenti caratteri di riferimento, utilizzare uno strumento di verifica preliminare o di riparazione per incorporarli come sottoinsiemi. Stampa come immagine fornisce una soluzione immediata che ignora completamente l'elaborazione dei caratteri. La conversione in un PDF appiattito in modo permanente con testo rasterizzato produce un file portatile e a prova di futuro che verrà stampato in modo identico ovunque. La riparazione delle tabelle dei caratteri danneggiate a livello strutturale preserva la ricercabilità del testo e mantiene ridotte le dimensioni dei file. La combinazione di un rapido controllo diagnostico seguito dalla riparazione mirata che corrisponde al problema specifico del font ripristina l'output stampato esattamente come visualizzato sullo schermo.

WukongPDF

Prova a riparare PDF

Nessuna installazione necessaria. Funziona direttamente nel tuo browser.

Inizia ora →