Apri un PDF sul tuo laptop Windows e tutto sembra perfetto. Lo invii a un collega che utilizza un Mac e vedrà simboli casuali, caselle quadrate o punti interrogativi sparsi nel documento. Su una macchina Linux, lo stesso file potrebbe visualizzare spazi vuoti al posto del testo. Questa esperienza frustrante si verifica più spesso di quanto la maggior parte delle persone creda e dipende quasi sempre dal modo in cui i diversi sistemi operativi gestiscono i caratteri incorporati nei file PDF.
Il problema principale è semplice: un PDF è progettato per avere lo stesso aspetto ovunque, ma ciò dipende dal fatto che i caratteri siano incorporati nel file o disponibili sul sistema che lo apre. Quando un PDF si basa sui caratteri installati sul computer dell'autore ma non include tali caratteri nel file stesso, qualsiasi dispositivo privo di quegli stessi caratteri sostituirà qualcos'altro. Su un sistema operativo diverso, dove anche i caratteri comuni hanno nomi o versioni diversi, tale sostituzione può produrre un output confuso e illeggibile.

Il colpevole più comune: font mancanti o non incorporati
Quando qualcuno crea un PDF da un documento Word, un documento Google o un'applicazione di progettazione come InDesign, il software decide se incorporare i caratteri direttamente nel PDF o semplicemente farvi riferimento. L'incorporamento dei caratteri significa che i dati effettivi dei caratteri vengono inseriti nel file PDF. Il riferimento ai caratteri registra semplicemente il carattere utilizzato e si aspetta che il dispositivo di lettura lo abbia installato.
Microsoft Word su Windows utilizza in genere caratteri come Calibri, Cambria o Times New Roman. Quando l'autore del PDF sceglie di non incorporare i caratteri, spesso per mantenere le dimensioni del file più piccole, il PDF memorizza solo il nome del carattere, non le forme effettive dei caratteri. Un Mac che apre quel file cerca Calibri ma trova una versione diversa di Calibri o nessuna corrispondenza. Il visualizzatore PDF per Mac torna quindi a un font sostitutivo e la mappatura dei caratteri tra il font originale e il sostituto raramente si allinea perfettamente.
Un'analisi del 2024 condotta dalla PDF Association ha rilevato che i problemi relativi ai font rappresentano circa il 40% di tutti i problemi di rendering dei PDF su tutte le piattaforme (PDF Association, "PDF Rendering Errors Survey", 2024). Gli errori di sostituzione dei caratteri sono particolarmente comuni con gli script non latini come cirillico, CJK (cinese, giapponese, coreano), arabo ed ebraico, dove il carattere sostitutivo potrebbe non disporre completamente dei set di caratteri richiesti.
Questo è anche il motivo per cui potresti riscontrare problemi con Caratteri PDF con documenti che utilizzano caratteri personalizzati o concessi in licenza. Le applicazioni di progettazione utilizzano spesso caratteri premium che non sono distribuiti gratuitamente. Se il progettista si dimentica di incorporarli o la licenza del carattere vieta l'incorporamento, chiunque apra il PDF senza quel carattere specifico installato vedrà il testo confuso.
Lo stesso documento visualizzato su un sistema operativo diverso può apparire completamente diverso. Un PDF che viene visualizzato correttamente sul computer Windows su cui è stato creato potrebbe mostrare tofu (il soprannome delle caselle rettangolari vuote che appaiono quando a un font manca un carattere specifico) su un sistema Mac o Linux. Questa incoerenza è del tutto prevenibile durante la fase di creazione del PDF.
Prova a riparare PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Conflitti di codifica dei caratteri tra Windows, macOS e Linux
Utilizzando uno strumento PDF basato su browser significa inoltre che non sarà più necessario installare o aggiornare software. Lo strumento viene eseguito su server remoti e fornisce risultati tramite il tuo browser, così hai sempre accesso alla versione più recente senza download. Ciò è particolarmente utile quando è necessario elaborare rapidamente un file su un dispositivo su cui non si dispone delle autorizzazioni di amministratore per installare programmi.
Oltre ai caratteri mancanti, la codifica dei caratteri è il secondo motivo principale per cui i PDF vengono visualizzati in modo diverso a seconda delle piattaforme. La codifica dei caratteri è il sistema che mappa i codici numerici su forme di caratteri specifiche. Quando viene creato un PDF, a ogni carattere del documento viene assegnato un codice basato sulla codifica utilizzata dall'applicazione di origine. La visualizzazione di PDF su un sistema operativo diverso può interpretare erroneamente questi codici.
Le applicazioni Windows utilizzano storicamente tabelle codici legacy come Windows-1252 per le lingue dell'Europa occidentale o Shift-JIS per il giapponese. Le applicazioni Mac tendono a utilizzare codifiche basate su Unicode. I sistemi Linux hanno come impostazione predefinita UTF-8. Quando un PDF creato su Windows con una codifica specifica di Windows viene aperto su un sistema che interpreta gli stessi codici numerici in modo diverso, il risultato è mojibake, il termine per il testo confuso causato da una codifica dei caratteri errata.
Il problema si presenta più frequentemente con caratteri speciali: virgolette inglesi, accenti, simboli di valuta e notazione matematica. Un PDF creato in una lingua europea che utilizza caratteri accentati come é, ö o ñ potrebbe mostrare tali caratteri come simboli criptati se aperto su un sistema con una codifica predefinita diversa. La specifica PDF include meccanismi per definire esplicitamente la codifica dei caratteri all'interno del file, ma non tutti i software di creazione PDF li implementano in modo corretto o coerente.
I PDF in lingue asiatiche sono particolarmente vulnerabili. I documenti contenenti testo cinese, giapponese o coreano creati su un sistema utilizzando una codifica precedente potrebbero non includere le mappe caratteri necessarie. L'apertura di un file di questo tipo su un sistema operativo diverso può produrre un completo incomprensibile anziché solo pochi caratteri confusi. Per le organizzazioni che gestiscono documenti multilingue, i problemi di codifica rappresentano un vero e proprio rischio aziendale che può incidere su contratti, documenti legali e comunicazioni con i clienti.
Tabelle dei caratteri danneggiate e struttura PDF danneggiata
I problemi relativi ai caratteri non sono sempre causati da file mancanti. A volte i dati dei caratteri sono presenti nel PDF ma sono danneggiati. Un PDF memorizza le informazioni sui caratteri in strutture chiamate tabelle dei caratteri, che associano i codici dei caratteri alle descrizioni dei glifi. Se queste tabelle vengono danneggiate durante il trasferimento di file, un download incompleto o errori del disco, l'applicazione di lettura non può interpretare correttamente i dati dei caratteri anche se sono tecnicamente incorporati.
La corruzione parziale può produrre alcuni dei risultati più confusi. Potresti visualizzare il testo corretto sulla maggior parte delle pagine, ma caratteri confusi su pagine specifiche o lettere visualizzate correttamente nei titoli ma non nel corpo del testo. Questi modelli si verificano perché parti diverse del PDF fanno riferimento a sottoinsiemi di caratteri diversi e solo alcuni di questi sottoinsiemi sono danneggiati.
Un approccio Ripara PDF è spesso necessario quando noti che lo stesso file è stato visualizzato correttamente la settimana scorsa ma oggi mostra un testo confuso. Questo modello di cambiamento nel tempo indica quasi sempre la corruzione dei dati piuttosto che un problema di sostituzione dei caratteri. Il danneggiamento dei file può verificarsi durante la trasmissione di e-mail, la sincronizzazione nel cloud o anche quando un dispositivo di archiviazione inizia a guastarsi.
I PDF che passano attraverso più sistemi corrono un rischio maggiore. Ogni volta che un file viene elaborato da un server di posta, un servizio di archiviazione cloud o uno strumento di compressione file, esiste una piccola possibilità che i dati vengano danneggiati. Nel corso di diversi trasferimenti, questo rischio aumenta. Un PDF che viaggia da un desktop Windows attraverso un server di posta elettronica, un filtro antispam e infine un client di posta Mac potrebbe essere danneggiato in uno qualsiasi di questi passaggi e le tabelle dei caratteri, essendo tra le parti più complesse di un PDF, sono spesso le prime strutture a mostrare danni.
Formati di caratteri non standard e versioni PDF legacy
Il formato PDF si è evoluto in modo significativo dalla sua introduzione nel 1993. I file PDF più vecchi potrebbero utilizzare formati di caratteri che i visualizzatori moderni non supportano più completamente. I caratteri Type 1 (PostScript) erano standard nei primi PDF, ma Adobe ha iniziato a deprecarli nel 2021 e ha completato la loro eliminazione nel 2023 (Adobe, "PostScript Type 1 Font End of Support", 2023). L'apertura di un PDF contenente caratteri Type 1 in una versione corrente di Adobe Acrobat o in un moderno visualizzatore basato su browser può attivare un fallback dei caratteri che produce un output confuso.
Allo stesso modo, alcuni creatori di PDF incorporano caratteri in formati proprietari o compressi che solo il proprio software può decodificare completamente. Un PDF generato da una versione precedente di AutoCAD potrebbe utilizzare caratteri SHX che sono essenzialmente file di forma anziché formati di caratteri standard. La maggior parte dei visualizzatori PDF generici non sono in grado di visualizzarli correttamente e il risultato su un sistema operativo diverso è prevedibile: simboli casuali, caratteri disallineati o spazi vuoti.
I caratteri con codifica personalizzata rappresentano un'altra sfida. Alcuni strumenti di creazione PDF creano al volo una codifica di caratteri personalizzata, mappando i glifi utilizzati nel documento in posizioni arbitrarie in una tabella di caratteri. Se il lettore PDF non analizza correttamente questa codifica personalizzata, visualizza i glifi errati. Il testo potrebbe ancora sembrare parole vere, ma con le lettere scambiate o sostituite, il che a volte è peggio di un'ovvia spazzatura perché il lettore potrebbe non rendersi immediatamente conto che il contenuto è sbagliato.
Come risolvere un PDF con caratteri confusi
Quando incontri un PDF confuso, esistono diversi approcci per recuperare il testo leggibile. La soluzione più rapida è spesso quella di ricreare il PDF dal documento di origine originale. Apri il file Word originale, Google Doc o il file di progettazione e riesportalo come PDF con l'incorporamento dei caratteri esplicitamente abilitato. In Microsoft Word, questa impostazione si trova in File, Opzioni, Salva, quindi seleziona "Incorpora caratteri nel file". In Google Documenti, l'opzione di download come PDF incorpora sempre i caratteri. In Adobe InDesign o Illustrator, l'incorporamento dei caratteri è controllato nelle impostazioni di esportazione nel pannello Avanzate.
Se il documento originale non è disponibile, WukongPDF può rielaborare il file tramite il suo motore basato su browser, che normalizza i dati dei caratteri e risolve i conflitti di codifica indipendentemente dal sistema operativo utilizzato per visualizzare l'output. Uno strumento dedicato Ripara PDF può anche aiutare analizzando le tabelle dei caratteri interni del PDF e tentando di ricostruirle o mappare i codici dei caratteri esistenti su valori Unicode standard.
Stampare il PDF in un nuovo PDF è un'altra soluzione pratica. La maggior parte dei sistemi operativi include un'opzione "Stampa su PDF" o "Salva come PDF" opzione nella finestra di dialogo di stampa. Quando si stampa un PDF confuso su un nuovo PDF, la pipeline di stampa del sistema esegue il rendering di ogni pagina come una rappresentazione simile a un'immagine e quindi la scrive in un nuovo file PDF pulito. Questo processo elimina completamente i riferimenti ai caratteri problematici e incorpora solo la rappresentazione visiva. Il compromesso è che il nuovo PDF non avrà testo selezionabile o ricercabile, poiché i caratteri vengono visualizzati come elementi grafici.
Per i PDF con problemi di codifica piuttosto che con caratteri mancanti, la conversione del file in un formato intermedio può reimpostare la mappatura dei caratteri. Alcuni strumenti possono estrarre il testo non elaborato da un PDF e scriverlo in un nuovo file con la corretta codifica Unicode. Questo approccio funziona bene per i documenti che visualizzano testo in caratteri latini confuso a causa di mancate corrispondenze di codifica, ma potrebbe non essere d'aiuto con codifiche di caratteri personalizzate o proprietarie. In questi casi, il metodo di stampa su PDF è più affidabile.
Prevenzione dei problemi relativi ai caratteri durante la creazione di PDF per l'utilizzo multipiattaforma
Prevenire è molto più facile che riparare. Se crei regolarmente PDF che verranno condivisi tra diversi sistemi operativi, alcune abitudini possono eliminare quasi tutti i problemi di visualizzazione relativi ai caratteri.
Innanzitutto, incorpora sempre i caratteri durante l'esportazione in PDF. Tutte le principali applicazioni di documentazione e progettazione offrono questa opzione, anche se può essere chiamata con nomi diversi: "Incorpora caratteri" "Includi caratteri" o "Sottoinsieme di caratteri". Il sottoinsieme dei caratteri incorpora solo i caratteri effettivamente utilizzati nel documento anziché l'intero file dei caratteri, mantenendo gestibili le dimensioni del PDF pur fornendo tutti i dati sui caratteri necessari. Il leggero aumento delle dimensioni del file è un piccolo prezzo da pagare per garantire la leggibilità multipiattaforma.
In secondo luogo, attenersi ai caratteri standard o ampiamente disponibili se l'incorporamento non è possibile per motivi di licenza. È garantita la disponibilità dei 14 font Type 1 standard definiti nelle specifiche PDF originali, inclusi Times, Helvetica, Courier e Symbol, su ogni lettore PDF indipendentemente dal sistema operativo. Gli equivalenti moderni sicuri su tutte le piattaforme includono Arial, Times New Roman e la famiglia di caratteri Google Noto, che copre oltre 1.000 lingue ed è liberamente ridistribuibile.
Terzo, prova il tuo PDF su almeno un altro sistema operativo prima di distribuirlo ampiamente. Apri il file su un dispositivo che esegue un sistema operativo diverso da quello utilizzato per crearlo. Controlla non solo la prima pagina ma diverse pagine del documento e presta particolare attenzione a eventuali caratteri speciali, lettere accentate o testo non latino. Cinque minuti di test possono evitare ore di confusione per i tuoi destinatari.
In quarto luogo, verificare le proprietà del PDF dopo la creazione. La maggior parte dei visualizzatori PDF può mostrare un elenco di caratteri utilizzati nel documento e indicare se ciascun carattere è incorporato o meno. In Adobe Acrobat, questo è sotto File, Proprietà, Caratteri. Nei visualizzatori basati su browser, l'elenco dei caratteri è in genere accessibile tramite le proprietà del documento o gli strumenti di ispezione. Se vedi i caratteri elencati con "(Incorporato)" accanto a loro, il file dovrebbe essere visualizzato correttamente su tutte le piattaforme.
Infine, valuta la possibilità di utilizzare il formato PDF/A per i documenti che necessitano di affidabilità multipiattaforma a lungo termine. PDF/A è una versione standardizzata ISO del PDF che impone l'incorporamento dei caratteri e proibisce funzionalità che possono causare incoerenze di rendering. È stato progettato specificamente per i casi d'uso di archiviazione in cui i documenti devono rimanere leggibili decenni nel futuro, indipendentemente da come si evolvono i sistemi operativi e le tecnologie dei caratteri.
Prova a riparare PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
