Un PDF che visualizza testo confuso, simboli casuali, righe di quadrati vuoti o stringhe di caratteri senza significato può sembrare un file corrotto che non può essere recuperato in modo pratico. Il documento si apre senza messaggi di errore, il conteggio delle pagine appare corretto e tutte le immagini o i grafici vengono visualizzati normalmente, ma le parole stesse sono state sostituite da qualcosa di completamente illeggibile. Questo modello segnala in genere un problema di codifica dei caratteri piuttosto che un danneggiamento strutturale dei file, il che è una buona notizia perché i problemi dei caratteri sono spesso risolvibili senza strumenti specializzati di recupero dati o servizi forensi di riparazione di file. Il contenuto sottostante potrebbe essere ancora presente nel file, codificato in modo tale che il visualizzatore PDF non possa interpretare a causa di dati sui caratteri mancanti o non corrispondenti.

Diagnosi della codifica dei caratteri rispetto alla vera corruzione dei file
Il primo passo diagnostico è determinare se il problema ha origine nella codifica dei caratteri o nella struttura stessa del file PDF. Un problema di codifica dei caratteri produce confusione sistematica e coerente nel documento. Ogni istanza della lettera A potrebbe diventare un quadrato vuoto o tutto il testo apparire costantemente come caratteri accentati casuali di un alfabeto diverso, ma lo schema si ripete in modo prevedibile. Il vero danneggiamento dei file produce un comportamento incoerente: pagine che non vengono visualizzate affatto, messaggi di errore quando si tenta di aprire il file o sezioni del documento completamente vuote mentre altre sezioni vengono visualizzate correttamente. Le pagine che riproducono perfettamente le immagini ma mostrano testo confuso puntano fortemente verso problemi di font piuttosto che a danni strutturali.
Aprire il PDF in almeno due visualizzatori diversi per confermare la diagnosi. Se il file viene visualizzato correttamente in Adobe Acrobat Reader ma non in un visualizzatore basato su browser come Chrome o Edge, molto probabilmente il visualizzatore del browser non supporta lo specifico formato di carattere incorporato utilizzato nel PDF. Se il file viene visualizzato correttamente in Chrome ma non in Anteprima su Mac, l'anteprima potrebbe non supportare un particolare schema di codifica dei caratteri. Se il file visualizza testo confuso in ogni visualizzatore testato su diversi sistemi operativi, i dati dei caratteri all'interno del PDF stesso sono danneggiati o mancanti ed è necessaria un'operazione Ripara PDF che risolva le risorse dei caratteri.
Prova a riparare PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Reinserimento di caratteri mancanti o danneggiati
Quando un PDF fa riferimento a un carattere che non è incorporato nel file e non installato nel sistema di visualizzazione, il visualizzatore PDF è costretto a sostituire un carattere diverso disponibile. Questa sostituzione spesso disallinea i caratteri perché il carattere sostitutivo ha larghezze dei caratteri, parametri di spaziatura e posizioni dei glifi diversi rispetto al carattere originale. Il testo appare come simboli confusi o casuali perché i codici dei caratteri memorizzati nel PDF corrispondono a glifi nel carattere sostitutivo completamente diversi da quelli previsti dall'autore del documento. La soluzione è incorporare nuovamente i caratteri corretti nel PDF in modo che lo spettatore non debba più indovinare.
Apri il PDF in uno strumento in grado di ispezionare e modificare le risorse dei caratteri a livello di documento. Controlla l'inventario dei caratteri per vedere a quali caratteri fa riferimento il documento e se ciascuno di essi è completamente incorporato, parzialmente incorporato come sottoinsieme contenente solo i caratteri utilizzati o elencato come non incorporato affatto. Se un carattere viene visualizzato come non incorporato, è necessario installare quel carattere esatto sul sistema e salvare nuovamente il PDF con l'opzione Incorpora tutti i caratteri abilitata oppure utilizzare uno strumento PDF Fix PDF in grado di individuare e incorporare i dati dei caratteri richiesti dalla propria libreria di caratteri concessa in licenza. I caratteri di sistema comuni come Arial, Times New Roman, Helvetica e Courier sono disponibili nella maggior parte delle librerie di caratteri e possono essere incorporati senza limitazioni di licenza.
Utilizzo della tecnica di stampa su PDF per un ripristino rapido
Se il testo confuso è causato da una codifica di carattere che un particolare visualizzatore gestisce correttamente mentre altri no, la soluzione pratica più rapida sfrutta quel singolo visualizzatore funzionante. Apri il PDF in qualunque visualizzatore riproduca correttamente il testo sullo schermo. Premi Ctrl-P o Comando-P per aprire la finestra di dialogo di stampa e scegli Microsoft Stampa su PDF o Salva come PDF come stampante di destinazione. La pipeline di stampa rasterizza o ricodifica il testo così come appare sullo schermo e lo incorpora in un PDF nuovo di zecca utilizzando caratteri e codifiche standard universalmente supportati che ogni visualizzatore PDF moderno comprende senza richiedere una gestione speciale dei caratteri.
Questo metodo produce una copia Ripara PDF con testo pulito e leggibile che viene visualizzato in modo coerente ovunque, ma c'è un importante compromesso da comprendere prima di impegnarsi. Il PDF stampato in genere perde la selezionabilità del testo, la ricercabilità e qualsiasi elemento del modulo interattivo. Il testo diventa effettivamente parte dell'immagine della pagina. Per un documento che deve essere letto sullo schermo e magari stampato una sola volta, questa è una soluzione perfettamente accettabile che richiede pochi secondi. Per un documento che deve rimanere ricercabile, selezionabile o modificabile dopo la riparazione, prova prima l'approccio di incorporamento dei caratteri e prenota la stampa su PDF come fallback.
Conversione del PDF tramite un formato intermedio
Quando l'incorporamento dei caratteri non risolve il problema e la stampa su PDF perde troppe funzionalità del documento, la conversione del PDF tramite un formato intermedio può eliminare la codifica interrotta preservando il testo come testo reale. Esporta il PDF in un documento Word utilizzando un convertitore da PDF a Word. Il processo di conversione legge il flusso di contenuto PDF e restituisce il testo riconosciuto in un nuovo formato che utilizza la gestione e la codifica dei caratteri di Word, completamente indipendente da qualsiasi cosa fosse danneggiata nel PDF originale. Apri il file Word risultante, verifica che il testo venga letto correttamente, apporta eventuali piccole correzioni di formattazione necessarie, quindi esportalo nuovamente in PDF con l'incorporamento dei caratteri abilitato.
Il viaggio di andata e ritorno attraverso Word sostituisce la codifica interrotta con una codifica pulita e conforme agli standard, ma layout complessi con più colonne, posizionamento preciso o grafica vettoriale incorporata potrebbero non sopravvivere perfettamente alla conversione. La tabella seguente mette a confronto i tre approcci di riparazione in base ai fattori che contano nella scelta del metodo da applicare:
| Metodo | Testo selezionabile | Layout conservato | Velocità |
|---|---|---|---|
| Incorpora nuovamente i caratteri | SÌ | SÌ | Moderare |
| Stampa in PDF | NO | SÌ | Veloce |
| Da PDF a Word in PDF | SÌ | Parziale | Lento |
Gestione dei problemi di codifica dei caratteri Unicode e CID
I PDF creati in caratteri non latini come cinese, giapponese, coreano, arabo o cirillico a volte visualizzano testo confuso in particolare quando il carattere utilizza la codifica CID (Character Identifier) e il visualizzatore non può associare i CID numerici ai corrispondenti caratteri Unicode. Questo è comune con i PDF più vecchi prodotti da software di scansione o sistemi di pubblicazione legacy che incorporavano caratteri utilizzando tabelle di codifica pre-Unicode progettate prima che Unicode diventasse lo standard universale. Un PDF di uno scanner giapponese del 2005, ad esempio, può utilizzare un carattere CID che i visualizzatori moderni non possono interpretare senza il file CMAP originale specifico del fornitore.
Gli strumenti PDF specializzati Fix PDF che supportano esplicitamente la mappatura da CID a Unicode possono ricostruire le associazioni di caratteri corrette. Questi strumenti leggono i codici CID grezzi dai dati dei caratteri e dalla tabella CMAP incorporata, se presente, per ricostruire la mappatura Unicode. Il processo è automatizzato in strumenti progettati per la riparazione dei caratteri PDF, richiedendo solo il caricamento del file e il download della versione corretta. Per i PDF contenenti lingue dell'Asia orientale, scegli uno strumento di riparazione che elenchi esplicitamente il supporto dei caratteri CJK nel suo set di funzionalità, poiché gli strumenti di riparazione dei caratteri generici progettati principalmente per gli script latini potrebbero non includere i dati CMAP o i modelli di riconoscimento dei glifi per questi sistemi di scrittura.
Prevenire il testo confuso nei PDF creati
Se crei regolarmente PDF che arrivano ai destinatari con testo confuso, la causa principale sono quasi sempre le impostazioni di incorporamento dei caratteri nel software che genera il PDF. Quando esporti da Word, PowerPoint, InDesign o uno strumento di progettazione, individua la finestra di dialogo delle opzioni di esportazione o salvataggio PDF e seleziona la casella Incorpora caratteri o Incorpora tutti i caratteri. Alcune applicazioni offrono una casella di controllo aggiuntiva per Incorpora solo i caratteri utilizzati nel documento, che crea un file più piccolo suddividendo i caratteri in sottoinsiemi ma può causare problemi di visualizzazione se il PDF viene successivamente modificato o unito ad altri contenuti. Per la massima compatibilità multipiattaforma, incorpora il carattere completo anziché un sottoinsieme ogni volta che l'aumento della dimensione del file è accettabile.
Piattaforme come WukongPDF gestiscono la conversione del Formato PDF con l'incorporamento completo dei caratteri abilitato per impostazione predefinita, evitando i problemi di codifica che derivano dalle dipendenze dei caratteri specifiche del sistema che funzionano solo sul computer dell'autore. Quando si invia un PDF che deve essere visualizzato correttamente su diversi sistemi operativi, dispositivi e applicazioni di visualizzazione, un rapido test di convalida consiste nell'aprire il file in un visualizzatore PDF basato su browser, poiché questi visualizzatori non hanno accesso ai caratteri di sistema installati localmente e riveleranno immediatamente eventuali problemi di incorporamento dei caratteri che altrimenti passerebbero inosservati finché un destinatario non segnala un testo confuso.
Quando accettare che un PDF non possa essere riparato
Nonostante le migliori tecniche di riparazione, alcuni PDF hanno subito danni irreparabili. Se hai provato a incorporare nuovamente i caratteri, a stampare su un nuovo PDF da ogni visualizzatore disponibile e a effettuare la conversione di andata e ritorno tramite Word e il testo rimane confuso, il file potrebbe presentare danni strutturali nel flusso di contenuto stesso anziché semplicemente un problema di codifica dei caratteri. A questo punto, la soluzione più produttiva è solitamente quella di individuare il documento di origine originale e generare da esso un nuovo PDF.
Conservare il file danneggiato come riferimento, poiché le immagini e la struttura della pagina potrebbero essere ancora parzialmente intatte anche quando il testo non può essere recuperato. Se il documento ha avuto origine da uno scanner, la nuova scansione del documento cartaceo originale produce un PDF pulito con la codifica del testo corretta. Se il documento è stato creato da un file Word o da un'applicazione di progettazione, chiedi all'autore originale di riesportarlo con l'incorporamento dei caratteri esplicitamente abilitato. Una nuova esportazione dal documento di origine aggira tutti i problemi di codifica presenti nella copia danneggiata e produce un file pulito in meno tempo rispetto a tentativi di ulteriori riparazioni.
Prova a riparare PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
