Un documento di ricerca scritto in francese contiene figure con didascalie e tabelle con intestazioni che un revisore di lingua inglese deve comprendere. Il corpo del testo può rimanere in francese perché il revisore sta lavorando con un collega bilingue. Tradurre l'intero documento non è necessario e rischia di introdurre errori nei contenuti tecnici. Tradurre solo le didascalie delle figure e le intestazioni delle tabelle fornisce al revisore le informazioni necessarie per interpretare gli elementi visivi senza toccare il corpo del testo.
Tradurre PDF selettivo di didascalie e intestazioni è un compito di precisione che richiede uno strumento in grado di identificare elementi di testo specifici in base alla loro posizione, formattazione o modelli di contenuto. Le didascalie in genere vengono visualizzate sotto le figure con un carattere più piccolo. Le intestazioni della tabella vengono visualizzate nella prima riga di una tabella in grassetto. Questi suggerimenti di formattazione consentono l'estrazione e la traduzione selettiva.

Identificazione di didascalie e intestazioni per la traduzione selettiva
Le didascalie delle figure nei PDF accademici e tecnici seguono modelli di formattazione prevedibili. Appaiono immediatamente sotto o accanto alla figura. Utilizzano una dimensione del carattere inferiore rispetto al corpo del testo, in genere da 8 a 10 punti. Spesso iniziano con la cifra seguita da un numero. Questi modelli consentono l'identificazione manuale o automatizzata del testo dei sottotitoli.
Le intestazioni delle tabelle vengono visualizzate nella prima riga di una tabella, spesso in grassetto con uno sfondo ombreggiato. La riga di intestazione è strutturalmente distinta dalle righe di dati. Uno strumento di estrazione di tabelle PDF può identificare la riga di intestazione in base alla sua posizione e formattazione, estrarre il testo dell'intestazione e lasciare intatte le righe di dati.
Il Formato PDF memorizza didascalie e intestazioni come oggetti di testo posizionati, non come elementi taggati semanticamente. Per estrarli è necessario analizzare la posizione del testo, le proprietà dei caratteri e la vicinanza alle immagini o alle strutture delle tabelle. Uno strumento di estrazione del testo generico non è in grado di distinguere le didascalie dal corpo del testo. Uno strumento specializzato in grado di comprendere il layout del documento può.
Prova a tradurre PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Flusso di lavoro di traduzione selettiva
Innanzitutto, estrai la didascalia e il testo dell'intestazione dal PDF. Identifica ciascuna didascalia in base alla sua posizione rispetto alle immagini e alle caratteristiche del carattere. Identificare ciascuna intestazione di tabella in base alla sua posizione nelle strutture della tabella. Compila il testo estratto in un elenco di traduzione con riferimenti di posizione.
In secondo luogo, traduci il testo estratto. La traduzione automatica funziona bene per il linguaggio semplice utilizzato nelle didascalie e nelle intestazioni. La revisione umana delle traduzioni garantisce che i termini tecnici siano tradotti correttamente e che la terminologia specifica del dominio venga preservata.
WukongPDF fornisce funzionalità di estrazione da PDF a testo in grado di isolare elementi di testo specifici. L'estrazione combinata con la traduzione produce didascalie e intestazioni tradotte preservando il corpo del testo originale.
Reinserimento di didascalie e intestazioni tradotte
Dopo la traduzione, reinserisci il testo tradotto nel PDF nelle posizioni originali. Le didascalie tradotte sostituiscono le didascalie originali sotto ciascuna figura. Le intestazioni tradotte sostituiscono le intestazioni originali in ogni tabella. Il corpo del testo rimane invariato.
Le differenze nella durata della traduzione tra le lingue richiedono attenzione. Una didascalia francese che si traduce in testo inglese più lungo potrebbe richiedere una dimensione del carattere leggermente più piccola o un'interlinea più stretta per adattarsi allo stesso spazio. Regola la formattazione del testo per adattarlo alla traduzione senza interrompere il layout della pagina.
Quando la traduzione selettiva è l’approccio giusto
La traduzione selettiva è appropriata quando il lettore ha bisogno di comprendere gli elementi visivi ma non ha bisogno di leggere il corpo del testo in dettaglio. La collaborazione scientifica che supera le barriere linguistiche, la revisione tecnica delle proposte internazionali e i flussi di lavoro delle pubblicazioni multilingue traggono vantaggio da questo approccio mirato.
Il risparmio di costi e tempo della traduzione selettiva rispetto alla traduzione completa del documento è proporzionale al rapporto tra didascalie e intestazioni e corpo del testo. Un documento composto per l'80% da testo e per il 20% da didascalie consente di risparmiare l'80% dei costi di traduzione quando vengono tradotte solo le didascalie.
L'identificazione di didascalie e intestazioni per la traduzione selettiva può essere parzialmente automatizzata addestrando un modello di analisi del layout del documento sullo specifico documento o formato di pubblicazione. Un modello addestrato su un modello di rivista può identificare didascalie e intestazioni con elevata precisione in tutti gli articoli che utilizzano quel modello.
Gli strumenti di memoria di traduzione possono archiviare traduzioni di frasi di didascalie ricorrenti su più documenti dello stesso campo. Una frase come la Figura X mostra che la relazione tra appare in dozzine di articoli e beneficia di una traduzione coerente in tutti essi.
Il processo di controllo della qualità per la traduzione selettiva dovrebbe verificare sia che il testo corretto sia stato tradotto sia che il testo errato, il corpo del testo, non lo sia. Un revisore confronta un campione di didascalie tradotte con gli originali e controlla anche che il corpo del testo su quelle pagine rimanga nella lingua originale.
Documenti in cui le didascalie contengono riferimenti numerici al corpo del testo, vedere la Sezione 3.2 per i dettagli, la traduzione deve preservare questi riferimenti incrociati in modo accurato. Un riferimento incrociato tradotto male che punta a una sezione inesistente crea confusione.
Quando le didascalie tradotte vengono reinserite nel PDF, il nuovo testo dovrebbe essere visivamente distinguibile dal corpo del testo originale, magari per una sottile differenza di colore o una notazione a margine, in modo che i lettori capiscano che stanno visualizzando un documento tradotto selettivamente.
L’approccio della traduzione selettiva può essere esteso ad altri elementi del documento che beneficiano di una traduzione mirata: traduzione di abstract, traduzione di parole chiave per database internazionali e traduzione di etichette di figure per pubblicazioni multilingue.
Per gli editori accademici che producono riviste in più lingue, la traduzione selettiva di didascalie e intestazioni offre una via di mezzo economicamente vantaggiosa tra la costosa traduzione completa e l’assenza di traduzione.
La traduzione selettiva di didascalie e intestazioni è uno strumento di precisione per un'esigenza specifica, non un sostituto della traduzione completa del documento quando il pubblico ha bisogno di comprendere il contenuto completo.
Il rapporto costo-efficacia della traduzione selettiva la rende un’opzione interessante per le collaborazioni internazionali in cui la traduzione completa sarebbe proibitivamente costosa.
La traduzione selettiva fornisce una soluzione mirata per la collaborazione di documenti multilingue.
Le didascalie delle figure negli articoli scientifici seguono modelli prevedibili che gli strumenti di estrazione automatizzata possono identificare: appaiono sotto le figure, utilizzano caratteri più piccoli e iniziano con Figura seguita da un numero.
Le intestazioni delle tabelle sono strutturalmente distinte dalle righe di dati perché vengono visualizzate nella parte superiore della tabella, spesso utilizzano testo in grassetto e possono avere sfondi ombreggiati, caratteristiche utilizzate dagli strumenti di estrazione per l'identificazione.
Il processo di estrazione dovrebbe preservare le informazioni di formattazione originale in modo che il testo tradotto possa essere ricollocato nelle posizioni corrette con le proprietà del carattere e la spaziatura corrette.
Per le pubblicazioni multilingue, è possibile applicare sistematicamente la traduzione selettiva: estrarre didascalie e intestazioni, tradurre in tutte le lingue di destinazione e inserire ciascuna versione come livello PDF separato.
La qualità della traduzione automatica per i sottotitoli scientifici è migliorata al punto che il post-editing umano è più veloce e meno costoso della traduzione da zero per questi elementi di testo strutturati.
La differenza nella dimensione del carattere tra il corpo del testo e le didascalie è il segnale principale utilizzato dagli strumenti di estrazione automatizzata per identificare il testo delle didascalie, con le didascalie in genere da 2 a 4 punti più piccole rispetto al corpo del testo circostante.
Le righe di intestazione della tabella possono essere identificate dalla loro posizione come prima riga di ciascuna tabella, dalla formattazione del testo in grassetto e spesso da uno sfondo ombreggiato che le distingue dalle righe di dati.
Le didascalie e le intestazioni estratte dovrebbero essere compilate in un elenco strutturato che preservi il numero di pagina e le coordinate di posizione, consentendo un reinserimento accurato dopo la traduzione.
Gli strumenti di memoria di traduzione possono archiviare didascalie tradotte da documenti precedenti nello stesso campo, migliorando la coerenza e riducendo i costi di traduzione per la terminologia ricorrente.
Il reinserimento dei sottotitoli tradotti deve tenere conto delle differenze di lunghezza del testo tra le lingue, regolando la dimensione del carattere o l'interlinea secondo necessità per adattare il testo tradotto allo spazio della didascalia originale.
La garanzia della qualità per la traduzione selettiva include la verifica che siano stati estratti gli elementi di testo corretti, che le traduzioni siano accurate e che nessun corpo del testo sia stato modificato accidentalmente.
Per le riviste accademiche che pubblicano articoli in più lingue, la traduzione selettiva di didascalie e intestazioni può essere incorporata nel flusso di lavoro di produzione come passaggio standard.
Il risparmio sui costi della traduzione selettiva rispetto alla traduzione completa rende la collaborazione internazionale accessibile a progetti e pubblicazioni con budget di traduzione limitati.
La qualità della traduzione automatica per il linguaggio strutturato e stereotipato utilizzato nelle didascalie scientifiche è generalmente superiore a quella del testo narrativo, riducendo l'onere di post-editing.
La capacità di tradurre solo elementi specifici del documento preservando la lingua originale del corpo del testo crea flessibilità nei flussi di lavoro dei documenti internazionali.
Per le collaborazioni di ricerca che abbracciano più comunità linguistiche, la traduzione selettiva consente a ciascun collaboratore di accedere alle prove visive nella propria lingua preferita.
Questo approccio selettivo rende la collaborazione di documenti multilingue accessibile a team e progetti con risorse di traduzione limitate.
La traduzione mirata delle didascalie delle figure e delle intestazioni delle tabelle fornisce il contesto essenziale di cui i lettori hanno bisogno per interpretare gli elementi visivi.
La traduzione selettiva di didascalie e intestazioni consente ai lettori internazionali di comprendere l'evidenza visiva di un documento senza richiedere la traduzione completa del corpo del testo.
Questo approccio mirato alla traduzione dei documenti riduce i costi aumentando al tempo stesso l'accessibilità delle informazioni visive oltre le barriere linguistiche.
L'estrazione dei sottotitoli si basa sulla dimensione del carattere e sulle differenze di posizione rispetto al corpo del testo circostante.
Il testo della didascalia nei PDF è in genere posizionato immediatamente sotto o accanto alla figura corrispondente, utilizzando una dimensione del carattere da 2 a 4 punti più piccola del corpo del testo, rendendolo identificabile tramite strumenti di estrazione automatizzata che analizzano la posizione del testo e le caratteristiche di formattazione.
La traduzione selettiva di didascalie e intestazioni fornisce ai lettori internazionali l'accesso alle informazioni visive.
Questa capacità rende la collaborazione di ricerca internazionale più accessibile ed economicamente vantaggiosa.
L'approccio selettivo alla traduzione dei documenti risponde a un'esigenza specifica senza i costi di una traduzione completa.
| Elemento | Segnale di identificazione | Priorità traduzione | Nota di reinserimento |
|---|---|---|---|
| Didascalia della figura | Figura sotto; carattere più piccolo; Prefisso della figura N | Alto | Stessa posizione; potrebbe essere necessario ridimensionare il carattere |
| Intestazione della tabella | Prima fila; grassetto; bg ombreggiato | Alto | Stesse cellule; preservare l'allineamento |
| Etichetta dell'asse | Adiacente agli assi del grafico | Medio | Potrebbe essere necessario regolare la rotazione |
| Voce della legenda | Campione di colore + testo | Basso | Spesso non estratti separatamente |
Prova a tradurre PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
