Others

Pouvez-vous traduire uniquement les légendes des figures et les en-têtes des tableaux dans un PDF tout en laissant le corps du texte intact

Un document de recherche rédigé en français contient des figures avec des légendes et des tableaux avec des en-têtes qu'un critique anglophone doit comprendre. Le corps du texte peut rester en français car le réviseur travaille avec un collègue bilingue. Traduire l’intégralité du document est inutile et risque d’introduire des erreurs dans le contenu technique. Traduire uniquement les légendes des figures et les en-têtes des tableaux fournit au réviseur les informations nécessaires pour interpréter les éléments visuels sans toucher au corps du texte.

La Traduire PDF sélective des légendes et des en-têtes est une tâche de précision qui nécessite un outil capable d'identifier des éléments de texte spécifiques par leur position, leur formatage ou leurs modèles de contenu. Les légendes apparaissent généralement sous les chiffres dans une police plus petite. Les en-têtes de tableau apparaissent dans la première ligne d'un tableau en texte gras. Ces indices de formatage permettent une extraction et une traduction sélectives.

Can You Translate Only the Figure Captions and Table Headers in a PDF While Leaving the Body Text Untouched

Identification des légendes et des en-têtes pour la traduction sélective

Les légendes des figures dans les PDF académiques et techniques suivent des modèles de formatage prévisibles. Ils apparaissent immédiatement en dessous ou à côté de la figure. Ils utilisent une taille de police plus petite que le corps du texte, généralement de 8 à 10 points. Ils commencent souvent par un chiffre suivi d'un chiffre. Ces modèles permettent une identification manuelle ou automatisée du texte de la légende.

Les en-têtes de tableau apparaissent dans la première ligne d'un tableau, souvent en texte gras avec un arrière-plan ombré. La ligne d'en-tête est structurellement distincte des lignes de données. Un outil d'extraction de tableau PDF peut identifier la ligne d'en-tête par sa position et son formatage, extraire le texte de l'en-tête et laisser les lignes de données intactes.

Le Format PDF stocke les légendes et les en-têtes sous forme d'objets texte positionnés, et non sous forme d'éléments sémantiquement balisés. Leur extraction nécessite une analyse de la position du texte, des propriétés de la police et de la proximité des images ou des structures de tableaux. Un outil d’extraction de texte à usage général ne peut pas distinguer les légendes du corps du texte. Un outil spécialisé qui comprend la mise en page des documents le peut.

WukongPDF

Essayez de traduire le PDF

Aucune installation nécessaire. Fonctionne directement dans votre navigateur.

Commencer →

Flux de travail de traduction sélectif

Tout d’abord, extrayez la légende et le texte d’en-tête du PDF. Identifiez chaque légende par sa position par rapport aux images et ses caractéristiques de police. Identifiez chaque en-tête de tableau par sa position dans les structures de tableau. Compilez le texte extrait dans une liste de traduction avec des références de position.

Deuxièmement, traduisez le texte extrait. La traduction automatique fonctionne bien pour le langage simple utilisé dans les légendes et les en-têtes. L'examen humain des traductions garantit que les termes techniques sont correctement traduits et que la terminologie spécifique au domaine est préservée.

WukongPDF fournit des capacités d'extraction PDF vers Text qui peuvent isoler des éléments de texte spécifiques. L'extraction combinée à la traduction produit des légendes et des en-têtes traduits tout en préservant le corps du texte original.

Réinsertion des légendes et des en-têtes traduits

Après la traduction, remettez le texte traduit dans le PDF aux positions d'origine. Les légendes traduites remplacent les légendes originales sous chaque figure. Les en-têtes traduits remplacent les en-têtes d'origine dans chaque tableau. Le corps du texte reste inchangé.

Les différences de longueur de traduction entre les langues nécessitent une attention particulière. Une légende française qui se traduit par un texte anglais plus long peut nécessiter une taille de police légèrement plus petite ou un interligne plus serré pour tenir dans le même espace. Ajustez la mise en forme du texte pour s'adapter à la traduction sans perturber la mise en page.

Quand la traduction sélective est la bonne approche

La traduction sélective est appropriée lorsque le lecteur a besoin de comprendre les éléments visuels mais n’a pas besoin de lire le corps du texte en détail. La collaboration scientifique au-delà des barrières linguistiques, l'examen technique des soumissions internationales et les flux de publication multilingues bénéficient de cette approche ciblée.

Les économies de temps et d’argent réalisées grâce à la traduction sélective par rapport à la traduction complète d’un document sont proportionnelles au rapport entre les légendes et les en-têtes et le corps du texte. Un document composé à 80 % de corps de texte et à 20 % de légendes permet d'économiser 80 % du coût de traduction lorsque seules les légendes sont traduites.

L'identification des légendes et des en-têtes pour une traduction sélective peut être partiellement automatisée en entraînant un modèle d'analyse de mise en page de document sur le format de document ou de publication spécifique. Un modèle formé sur un modèle de journal peut identifier les légendes et les en-têtes avec une grande précision dans tous les articles utilisant ce modèle.

Les outils de mémoire de traduction peuvent stocker les traductions de phrases de légende récurrentes dans plusieurs documents du même champ. Une expression comme la figure X montre la relation entre apparaît dans des dizaines d'articles et bénéficie d'une traduction cohérente dans chacun d'eux.

Le processus d'assurance qualité pour la traduction sélective doit vérifier à la fois que le texte correct a été traduit et que le texte incorrect, le corps du texte, ne l'a pas été. Un réviseur vérifie un échantillon de légendes traduites par rapport aux originaux et vérifie également que le corps du texte de ces pages reste dans la langue d'origine.

Pour les documents dont les légendes contiennent des références numériques au corps du texte, voir la section 3.2 pour plus de détails, la traduction doit conserver ces références croisées avec précision. Une référence croisée mal traduite qui pointe vers une section inexistante crée de la confusion.

Lorsque les légendes traduites sont réinsérées dans le PDF, le nouveau texte doit se distinguer visuellement du corps du texte original, peut-être par une subtile différence de couleur ou une notation dans la marge, afin que les lecteurs comprennent qu'ils consultent un document traduit de manière sélective.

L'approche de traduction sélective peut être étendue à d'autres éléments de documents qui bénéficient d'une traduction ciblée : traduction de résumés, traduction de mots clés pour les bases de données internationales et traduction d'étiquettes de figures pour les publications multilingues.

Pour les éditeurs universitaires produisant des revues dans plusieurs langues, la traduction sélective des légendes et des en-têtes offre un juste milieu entre une traduction complète coûteuse et l’absence de traduction du tout.

La traduction sélective des légendes et des en-têtes est un outil de précision répondant à un besoin spécifique et ne remplace pas la traduction complète d'un document lorsque le public a besoin de comprendre l'intégralité du contenu.

La rentabilité de la traduction sélective en fait une option intéressante pour les collaborations internationales où une traduction complète serait d’un coût prohibitif.

La traduction sélective offre une solution ciblée pour la collaboration documentaire multilingue.

Les légendes des figures dans les articles scientifiques suivent des modèles prévisibles que les outils d’extraction automatisés peuvent identifier : elles apparaissent sous les figures, utilisent des polices plus petites et commencent par Figure suivi d’un chiffre.

Les en-têtes de tableau sont structurellement distincts des lignes de données car ils apparaissent en haut du tableau, utilisent souvent du texte en gras et peuvent avoir des arrière-plans ombrés, caractéristiques que les outils d'extraction utilisent pour l'identification.

Le processus d'extraction doit préserver les informations de formatage d'origine afin que le texte traduit puisse être replacé aux positions correctes avec les propriétés de police et l'espacement corrects.

Pour les publications multilingues, une traduction sélective peut être appliquée systématiquement : extrayez les légendes et les en-têtes, traduisez dans toutes les langues cibles et insérez chaque version en tant que couche PDF distincte.

La qualité de la traduction automatique des sous-titres scientifiques s'est améliorée à tel point que la post-édition humaine est plus rapide et moins coûteuse que la traduction à partir de zéro pour ces éléments de texte structurés.

La différence de taille de police entre le corps du texte et les légendes est le principal signal utilisé par les outils d'extraction automatisés pour identifier le texte des légendes, les légendes étant généralement de 2 à 4 points plus petites que le corps du texte environnant.

Les lignes d'en-tête de tableau peuvent être identifiées par leur position en tant que première ligne de chaque tableau, leur mise en forme de texte en gras et souvent un arrière-plan ombré qui les distingue des lignes de données.

Les légendes et en-têtes extraits doivent être compilés dans une liste structurée qui préserve le numéro de page et les coordonnées de position, permettant une réinsertion précise après la traduction.

Les outils de mémoire de traduction peuvent stocker les légendes traduites de documents précédents dans le même domaine, améliorant ainsi la cohérence et réduisant les coûts de traduction pour la terminologie récurrente.

La réinsertion des sous-titres traduits doit tenir compte des différences de longueur du texte entre les langues, en ajustant la taille de la police ou l'espacement des lignes si nécessaire pour adapter le texte traduit dans l'espace des sous-titres d'origine.

L'assurance qualité pour la traduction sélective consiste à vérifier que les éléments de texte corrects ont été extraits, que les traductions sont exactes et qu'aucun corps de texte n'a été accidentellement modifié.

Pour les revues universitaires qui publient des articles dans plusieurs langues, la traduction sélective des légendes et des en-têtes peut être intégrée au flux de production en tant qu'étape standard.

Les économies de coûts de la traduction sélective par rapport à la traduction complète rendent la collaboration internationale accessible aux projets et aux publications disposant de budgets de traduction limités.

La qualité de la traduction automatique du langage structuré et formulé utilisé dans les légendes scientifiques est généralement supérieure à celle du texte narratif, réduisant ainsi la charge de post-édition.

La possibilité de traduire uniquement des éléments spécifiques du document tout en préservant la langue originale du corps du texte crée de la flexibilité dans les flux de travail documentaires internationaux.

Pour les collaborations de recherche couvrant plusieurs communautés linguistiques, la traduction sélective permet à chaque collaborateur d'accéder aux preuves visuelles dans sa langue préférée.

Cette approche sélective rend la collaboration documentaire multilingue accessible aux équipes et aux projets disposant de ressources de traduction limitées.

La traduction ciblée des légendes des figures et des en-têtes des tableaux fournit le contexte essentiel dont les lecteurs ont besoin pour interpréter les éléments visuels.

La traduction sélective des légendes et des en-têtes permet aux lecteurs internationaux de comprendre les preuves visuelles d'un document sans avoir besoin d'une traduction complète du corps du texte.

Cette approche ciblée de la traduction de documents réduit les coûts tout en augmentant l’accessibilité des informations visuelles au-delà des barrières linguistiques.

L'extraction des légendes repose sur la taille de la police et les différences de position par rapport au corps du texte environnant.

Le texte de légende dans les PDF est généralement positionné immédiatement en dessous ou à côté de la figure correspondante, en utilisant une taille de police de 2 à 4 points plus petite que le corps du texte, ce qui le rend identifiable par des outils d'extraction automatisés qui analysent la position du texte et les caractéristiques de formatage.

La traduction sélective des sous-titres et des en-têtes permet aux lecteurs internationaux d'accéder à des informations visuelles.

Cette capacité rend la collaboration internationale en matière de recherche plus accessible et plus rentable.

L'approche sélective de la traduction de documents répond à un besoin spécifique sans les frais d'une traduction complète.

ÉlémentIndice d'identificationPriorité de traductionNote de réinsertion
Légende de la figureFigure ci-dessous ; police plus petite ; Préfixe de la figure NHautMême poste ; il faudra peut-être redimensionner la police
En-tête du tableauPremière rangée ; audacieux; bg ombréHautMêmes cellules ; préserver l'alignement
Etiquette de l'axeAdjacent aux axes du graphiqueMoyenPeut nécessiter un ajustement de rotation
Entrée de légendeÉchantillon de couleur + texteFaibleSouvent non extrait séparément
WukongPDF

Essayez de traduire le PDF

Aucune installation nécessaire. Fonctionne directement dans votre navigateur.

Commencer →