La traduzione di un PDF in genere sostituisce il testo originale con la versione tradotta. Il testo nella lingua di origine è scomparso dall'output. Per alcuni casi d'uso, è utile preservare il testo originale come livello nascosto accanto alla traduzione. Un lettore bilingue può verificare la traduzione rispetto all'originale. Un futuro traduttore può vedere quale fosse il testo di partenza senza individuare il documento originale. Inoltre, un motore di ricerca può indicizzare entrambe le lingue, rendendo il documento reperibile in entrambe. La domanda è se gli strumenti Translate PDF possono preservare lo strato di testo originale durante la traduzione e a quali condizioni ciò è possibile.
Concetti chiave
La maggior parte degli strumenti di traduzione PDF sostituisce il testo originale con la versione tradotta. Per preservare il testo originale come livello nascosto è necessario uno strumento che supporti l'output bilingue o parallelo, in cui il testo originale venga archiviato come livello invisibile sotto il testo tradotto. Questa funzionalità è disponibile in alcuni strumenti di traduzione professionali ma non è standard nei traduttori PDF di livello consumer. Un approccio alternativo consiste nel tradurre una copia del PDF e conservare l'originale come documento di riferimento separato.

Come funzionano i livelli di testo del PDF durante la traduzione
La fase di estrazione del testo è quella in cui risiede la maggior parte della complessità. Lo strumento di traduzione non deve solo estrarre il testo visibile ma anche registrarne l'esatta posizione, le proprietà del carattere e la codifica per ciascun carattere. Quando si ricolloca il testo tradotto, lo strumento necessita dei dati di posizione del testo originale per allineare correttamente il nuovo testo. Uno strumento che preserva il testo originale come livello nascosto deve memorizzare due set completi di dati di testo e gestirne la stratificazione. Ciò raddoppia all’incirca il carico di lavoro di elaborazione del testo, motivo per cui molti strumenti non offrono questa funzionalità. La capacità tecnica esiste nella specifica PDF. La limitazione sta nell'implementazione dello strumento, non nel formato.
Un PDF memorizza il testo come codici di carattere nei flussi di contenuto. Quando uno strumento di traduzione elabora il PDF, estrae questi codici di carattere, li mappa in testo leggibile, invia il testo a un motore di traduzione e reinserisce il testo tradotto nel documento. Il flusso di lavoro standard sostituisce i codici carattere originali con quelli tradotti. Il testo originale è scomparso dal file. Non è possibile annullare. Per preservare il testo originale, lo strumento di traduzione deve creare un secondo livello di testo che contenga la lingua di origine, contrassegnarlo come nascosto o non stampabile e posizionare il testo tradotto nel livello visibile. Ciò è tecnicamente possibile ma richiede che lo strumento di traduzione gestisca i doppi livelli di testo durante tutto il processo.
La specifica PDF supporta gruppi di contenuti opzionali, comunemente chiamati Livelli PDF, che possono essere visualizzati o nascosti in modo indipendente. Uno strumento di traduzione potrebbe posizionare il testo originale in un livello e il testo tradotto in un altro, con il livello originale impostato su nascosto per impostazione predefinita. I lettori che desiderano vedere il testo originale possono attivare/disattivare la visibilità dei livelli nel visualizzatore PDF. Questo approccio preserva entrambe le lingue in un unico file e offre al lettore il controllo su quale lingua è visibile. La capacità tecnica esiste nel formato PDF. La domanda è se un determinato strumento di traduzione lo implementa.
Prova a tradurre PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Strumenti di traduzione che supportano la conservazione del testo originale
Le piattaforme di traduzione professionale utilizzate dalle agenzie di localizzazione spesso supportano l'output PDF bilingue. Questi strumenti sono progettati per flussi di lavoro in cui un revisore deve confrontare la traduzione con il testo di origine. Il PDF di output contiene entrambi i livelli della lingua e il revisore può alternarli o visualizzarli fianco a fianco in un'interfaccia di revisione specializzata. Questi strumenti sono generalmente basati su abbonamento e progettati per lavori di traduzione commerciale di grandi volumi piuttosto che per traduzioni occasionali di documenti.
Per gli utenti consumer e di piccole imprese, le opzioni sono più limitate. Alcuni servizi di traduzione PDF online offrono un formato di output affiancato in cui il testo originale e quello tradotto vengono visualizzati in paragrafi alternati o in un layout a due colonne. Ciò preserva visibilmente entrambe le lingue anziché nasconderne una come livello. Il documento è più lungo ma entrambe le lingue sono accessibili senza la commutazione dei livelli. Lo strumento di traduzione di WukongPDF supporta una modalità di output affiancata che posiziona i paragrafi originali e tradotti uno accanto all'altro, preservando entrambe le lingue in un unico documento leggibile.
Alternativa: conservare il PDF originale come riferimento
Per i team che necessitano di mantenere versioni bilingue dei documenti nell'arco di più cicli di revisione, un approccio di gestione dei documenti funziona meglio di un approccio a file singolo. Archivia i PDF originali e tradotti in un repository con versione controllata con una convenzione di denominazione che li collega. Quando il documento originale viene aggiornato, la convenzione di denominazione chiarisce quale traduzione deve essere aggiornata per corrispondere. Questo flusso di lavoro è più affidabile di un singolo PDF bilingue per documenti che cambiano nel tempo.
Quando lo strumento di traduzione non supporta l'output in doppia lingua, il flusso di lavoro più semplice consiste nel tradurre una copia del PDF e conservare l'originale come file di riferimento separato. Assegnare un nome coerente ai file in modo che la relazione tra loro sia chiara. Una convenzione di denominazione come report-2025-en.pdf per la traduzione inglese e report-2025-fr-original.pdf per l'originale francese rende la relazione ovvia a chiunque navighi nella cartella. Archivia entrambi i file nella stessa posizione e fai riferimento al nome del file originale nei metadati del documento tradotto o in una nota sulla copertina.
Per scopi archivistici, la coppia originale-più-traduzione è spesso l’approccio più affidabile. Ogni file è un PDF standard che qualsiasi lettore può aprire. Non esiste alcuna dipendenza dalle impostazioni di visibilità dei livelli o da strumenti di visualizzazione specializzati. La coppia di file documenta sia il testo di partenza che la traduzione in un formato che rimarrà accessibile per decenni. Questo approccio potrebbe non essere elegante come un singolo PDF bilingue, ma è più affidabile a lungo termine.
Verificare che il livello del testo originale sia intatto
Esegui un test di estrazione del testo sul PDF bilingue. Estrai tutto il testo dal documento e cerca una parola o una frase distintiva della lingua originale. Se appare nel testo estratto, il livello originale è presente e codificato correttamente. Se il testo estratto contiene solo la lingua tradotta, il livello originale manca o non è stato codificato come testo estraibile. Questo test rileva gli errori di codifica che l'ispezione visiva del pannello dei livelli non potrebbe rilevare.
Se il tuo strumento di traduzione afferma di preservare il testo originale come un livello nascosto, verificalo prima di fare affidamento su di esso. Apri il PDF tradotto in un visualizzatore che supporti l'attivazione/disattivazione della visibilità dei livelli, come Adobe Acrobat Pro. Cerca un pannello dei livelli nel riquadro di navigazione. Se lo strumento ha creato correttamente il livello di testo originale, apparirà come un livello con nome con un interruttore di visibilità. Attiva e disattiva il livello per confermare che il testo originale appare e scompare come previsto. Esegui una ricerca testuale per una parola che sai apparire nell'originale ma che è stata modificata nella traduzione. Se la ricerca trova la parola originale, il livello è presente e ricercabile.
Controlla anche la dimensione del file del PDF bilingue rispetto alla dimensione di una versione tradotta standard. Un PDF con due livelli di testo sarà circa dal 10 al 30% più grande di una versione in una sola lingua, a seconda della quantità di testo. Un PDF bilingue delle stesse dimensioni di una traduzione standard probabilmente non contiene il livello di testo originale, indipendentemente da ciò che afferma la documentazione dello strumento. La differenza nella dimensione del file è un controllo rapido e affidabile.
Domande frequenti
Il livello di testo originale nascosto aumenterà significativamente la dimensione del file? L'aumento è proporzionale alla quantità di testo, in genere dal 15 al 30% per i documenti con molto testo. Per i documenti ricchi di immagini in cui il testo rappresenta una piccola frazione della dimensione totale del file, l'aumento è trascurabile. L'approccio a doppio livello aggiunge una seconda copia dei dati di testo e dei metadati di gestione dei livelli, ma non duplica immagini, caratteri o struttura della pagina. Per l'utilizzo in ambito archivistico, l'aumento moderato delle dimensioni dei file rappresenta un compromesso ragionevole per l'accessibilità bilingue.
La conservazione del livello di testo originale influisce sulla ricercabilità del PDF?
Sì, positivamente. Con entrambi i livelli linguistici presenti, il PDF è ricercabile in entrambe le lingue. Un utente che cerca un termine nella lingua originale lo troverà nel livello nascosto, mentre un utente che cerca nella lingua tradotta lo troverà nel livello visibile. Questa doppia possibilità di ricerca è uno dei principali vantaggi derivanti dalla conservazione del testo originale.
Posso estrarre il testo originale da un PDF bilingue per recuperare il documento sorgente?
Se il livello di testo originale è presente e codificato correttamente, estraendolo si recupera il testo sorgente con alta fedeltà. La qualità dell'estrazione dipende da come lo strumento di traduzione ha archiviato il testo originale. Gli strumenti che lo archiviano come flusso di testo completo e non danneggiato producono output estraibile. Gli strumenti che lo memorizzano come oggetti di testo frammentati possono produrre output estraibile con frasi interrotte che richiedono una pulizia manuale.
Un PDF bilingue è più grande che tenere due file separati?
Di solito no. Un PDF bilingue con entrambi i livelli linguistici è in genere più piccolo della dimensione combinata di due PDF monolingue separati perché le immagini, i caratteri e la struttura della pagina sono condivisi tra i livelli. Il livello testo aggiunge solo una piccola quantità di dati. Per ambienti con vincoli di archiviazione, il PDF bilingue è più efficiente che mantenere due file separati.
Prova a tradurre PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
