Tips & Tricks

So übersetzen Sie nur Bildunterschriften in einer PDF-Datei

Wissenschaftliche Arbeiten, technische Berichte und illustrierte Dokumente enthalten Bildunterschriften, die erklären, was jedes Bild, Diagramm oder Diagramm zeigt. Wenn der Haupttext eines solchen Dokuments bereits in einer Sprache verfasst ist, die der Leser versteht, die Bildunterschriften jedoch nicht, vermeidet die Übersetzung nur der Bildunterschriften die unnötige Arbeit der Übersetzung von Inhalten, die der Leser bereits verstehen kann. Die Herausforderung besteht darin, den Beschriftungstext vom umgebenden Textkörper zu isolieren, sodass nur die Beschriftungen die Übersetzungsmaschine passieren.

Beschriftungen in PDFs haben normalerweise eine etwas andere Schriftgröße oder einen anderen Schriftstil als der Fließtext. Sie befinden sich unter oder neben Bildern und beginnen oft mit „Abbildung“ oder „Tabelle“, gefolgt von einer Zahl. Diese visuellen und Positionshinweise helfen einem menschlichen Leser, Bildunterschriften auf einen Blick zu erkennen. PDF-Übersetzung Workflows, die nur auf Untertitel abzielen, verwenden diese Hinweise, um den richtigen Text auszuwählen, entweder durch manuelle Auswahl, stilbasierte Filterung oder Export- und Extraktionsansätze.

WukongPDFs PDF-Export und Übersetzungstools übernehmen die dokumentweite Sprachkonvertierung. Für die selektive Übersetzung nur von Untertiteln isolieren die folgenden manuellen und halbautomatischen Arbeitsabläufe den Untertiteltext vom umgebenden Inhalt.

How to Translate Only Figure Captions in a PDF

Methode 1: Manuelles Kopieren-Übersetzen-Einfügen für Untertitel

Für ein Dokument mit einer überschaubaren Anzahl von Untertiteln, in der Regel weniger als 20, ist die manuelle Methode die zuverlässigste Methode. Öffnen Sie die PDF-Datei in einem beliebigen Editor, der die Textauswahl unterstützt. Wählen Sie für jede Beschriftung den Text aus, kopieren Sie ihn, fügen Sie ihn in ein Übersetzungstool wie Google Translate oder DeepL ein, kopieren Sie die übersetzte Ausgabe und fügen Sie sie an derselben Stelle wieder in die PDF-Datei ein, wobei Sie den ursprünglichen Beschriftungstext ersetzen.

Die manuelle Methode ist präzise. Sie steuern genau, welcher Text übersetzt wird und wo die Übersetzung platziert wird. Dadurch wird das Risiko einer versehentlichen Übersetzung des Fließtexts oder fehlender Untertitel vermieden, die bei der automatischen Erkennung übersprungen werden könnten. Die Präzision geht auf Kosten der Zeit. Das Auswählen, Übersetzen und Ersetzen jeder Beschriftung dauert etwa 30 bis 60 Sekunden. Ein Dokument mit 15 Bildunterschriften dauert etwa 10 bis 15 Minuten. Für die einmalige Übersetzung eines einzelnen Dokuments ist die manuelle Methode ausreichend. Für wiederkehrende Übersetzungen oder Dokumente mit Hunderten von Untertiteln sind die folgenden automatisierten Methoden praktischer.

WukongPDF

Versuchen Sie es mit „PDF übersetzen“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Methode 2: Stilbasierte Auswahl in einem PDF-Editor

Das Tool „PDF bearbeiten“ von Adobe Acrobat Pro enthält eine Funktion, die den gesamten Text auswählt, der einer bestimmten Schriftart, Größe oder Farbe entspricht. Wenn die Beschriftungen im PDF einen einheitlichen Stil verwenden, z. B. 9-Punkt-Kursivschrift, können Sie den gesamten Beschriftungstext in einem Vorgang auswählen. Öffnen Sie die PDF-Datei in Acrobat Pro, gehen Sie zu „PDF bearbeiten“, klicken Sie in einen Beschriftungstextbereich, klicken Sie dann mit der rechten Maustaste und wählen Sie „Alle mit dieser Schriftart auswählen“. Acrobat wählt jeden Textblock auf der Seite aus, der dieselbe Schriftart und -größe verwendet. Kopieren Sie den ausgewählten Text und fügen Sie ihn in ein Textdokument ein.

Überprüfen Sie den eingefügten Text. Fließtext, der versehentlich dieselbe Schriftart wie die Untertitel verwendet, wird neben den eigentlichen Untertiteln ausgewählt. Entfernen Sie manuell jeglichen Text, der nicht zur Bildunterschrift gehört. Das Textdokument enthält jetzt nur noch Beschriftungsinhalte. Fügen Sie sie in das Übersetzungstool ein, übersetzen Sie sie und fügen Sie dann jede übersetzte Beschriftung wieder an ihrer ursprünglichen Position im PDF ein. Die stilbasierte Auswahl beschleunigt den Extraktionsschritt erheblich im Vergleich zur Einzelauswahl jeder Beschriftung.

Methode 3: Nach Word exportieren und nach Stil filtern

Konvertieren Sie die PDF-Datei mit der Funktion „Nach Word exportieren“ von Acrobat Pro oder einem Online-PDF-zu-Word-Konverter in das Word-Format. Öffnen Sie das resultierende DOCX in Microsoft Word. Word behält den Schriftstil der PDF-Datei bei, sodass Beschriftungen in derselben Schriftart und Größe wie im Original angezeigt werden. Verwenden Sie die Word-Funktion „Gesamten Text mit ähnlicher Formatierung auswählen“, um den gesamten Beschriftungstext im gesamten Dokument auszuwählen. Klicken Sie mit der rechten Maustaste auf einen Untertitelabsatz, gehen Sie zu „Stile“ und dann „Alle auswählen“. Word wählt jeden Absatz mit passender Formatierung aus.

Kopieren Sie den ausgewählten Text in eine Tabelle in einem neuen Dokument. Jede Beschriftung belegt eine Zeile. Fügen Sie eine zweite Spalte für den übersetzten Text hinzu. Übersetzen Sie jede Beschriftung mit dem Übersetzungstool und fügen Sie die Übersetzung in die angrenzende Spalte ein. Nachdem alle Beschriftungen übersetzt wurden, verwenden Sie die zweispaltige Tabelle als Referenz, um jede Beschriftung im PDF durch ihre Übersetzung zu ersetzen. Der Word-basierte Ansatz bietet einen strukturierten Arbeitsablauf, der einfacher zu verfolgen ist als die PDF-basierten Methoden, da der Übersetzungsfortschritt in der Tabelle sichtbar ist.

MethodeWie es funktioniertAm besten für
Selektives Kopieren und EinfügenKopieren Sie nur den Untertiteltext aus der PDF-Datei, übersetzen Sie ihn und fügen Sie ihn wieder einKurze Dokumente mit 5–10 Bildunterschriften
PDF-Editor nach Stil suchen und ersetzenWählen Sie den gesamten Text aus, der mit der Beschriftungsschriftart übereinstimmt, und kopieren Sie ihn in den ÜbersetzerDokumente mit gestalteten Beschriftungen
Untertitel in eine Textdatei exportierenPDF nach Word exportieren, Untertitel durch Formatierung isolierenDokumente mit vielen Beschriftungen, wiederkehrender Arbeitsablauf

Umgang mit Beschriftungen, die sich über mehrere Zeilen erstrecken

Eine mehrzeilige Beschriftung im PDF kann in separate Textblöcke aufgeteilt werden, einen pro Zeile. Wenn Sie die Beschriftung auswählen und kopieren, erhalten Sie drei separate Textauswahlen anstelle eines fortlaufenden Absatzes. Fügen Sie alle drei als einen einzigen Block in das Übersetzungstool ein, indem Sie sie mit einem Leerzeichen verbinden. Die Übersetzung besteht aus einem einzigen Absatz. Wenn Sie die Übersetzung wieder in die PDF-Datei einfügen, teilen Sie sie auf die gleiche Anzahl an Textblöcken wie das Original auf, um das Layout beizubehalten.

Wenn es um Dokument-Workflows geht, schützen Sie diese Begriffe bei Bildunterschriften, die technische Begriffe, Abkürzungen oder Maßeinheiten enthalten, vor der Übersetzung, indem Sie sie im Übersetzungstool als „Nicht übersetzen“ markieren, wenn das Tool dies unterstützt, oder indem Sie sie durch Platzhalter-Tokens ersetzen, die Übersetzung ausführen und die Originale wiederherstellen. Eine Bildunterschrift mit der Aufschrift „Abbildung 3: SEM-Bild von TiO2-Nanopartikeln bei 50.000-facher Vergrößerung“ sollte TiO2 und 50.000-fach genau wie beschrieben erhalten bleiben.

Wenn Sie nur Bildunterschriften übersetzen, verbleibt der Haupttext in der Originalsprache, während der visuelle Inhalt für Leser der Zielsprache verständlich gemacht wird. Der selektive Ansatz spart im Vergleich zur vollständigen Dokumentübersetzung Zeit und erstellt ein Dokument, in dem zweisprachige Leser, die häufigste Zielgruppe für teilweise übersetzte technische Inhalte, effizient navigieren können.

Batch-Übersetzung von Untertiteln über mehrere PDFs hinweg

Für Forscher oder technische Redakteure, die eine Bibliothek von Dokumenten mit Untertiteln in einer Fremdsprache verwalten, folgt die Stapelübersetzung über mehrere PDFs hinweg demselben Arbeitsablauf, vergrößert jedoch. Exportieren Sie alle PDFs mithilfe eines Stapelkonverters in das Word-Format. Verwenden Sie die Funktion „Suchen und Ersetzen“ von Word mit Formatierungsfiltern, um den gesamten Text zu finden, der einer bestimmten Schriftart und -größe entspricht, wodurch Beschriftungen in allen exportierten Dokumenten erfasst werden sollten. Kopieren Sie den gesamten gefundenen Text in einen einzigen Übersetzungsstapel.

Übersetzen Sie den gesamten Stapel in einem Vorgang mit DeepL oder Google Translate. Beide Dienste akzeptieren große Textblöcke und behalten Absatzumbrüche bei, die den einzelnen Beschriftungsgrenzen entsprechen. Teilen Sie den übersetzten Text nach der Übersetzung per Absatzumbruch wieder in einzelne Überschriften auf und fügen Sie jede einzelne in die entsprechende PDF-Datei ein. Durch den Batch-Ansatz wird der Übersetzungsaufwand pro Untertitel von 30 Sekunden auf etwa 5 Sekunden reduziert, was ihn für Dokumentsammlungen mit Hunderten von Untertiteln praktisch macht.

Layout beim Ersetzen übersetzter Untertitel beibehalten

Übersetzte Bildunterschriften sind oft länger oder kürzer als die Originale. Deutsche Übersetzungen dauern 20 bis 30 Prozent länger als englische. Chinesische Übersetzungen sind oft kürzer. Passen Sie die Schriftgröße der übersetzten Beschriftung um einen halben Punkt an, um die Längenänderung auszugleichen, ohne die Abmessungen des Textfelds zu ändern. Kleine Schriftartanpassungen bewahren das Layout und berücksichtigen gleichzeitig Unterschiede in der Übersetzungslänge.

Teilen Sie bei erheblichen Längenänderungen in allen Dokument-Workflows die übersetzte Beschriftung manuell auf mehrere Zeilen auf. Passen Sie die Zeilenumbrüche ungefähr an die visuelle Breite der Originalbeschriftung an. Das Ziel besteht darin, dass die übersetzte Bildunterschrift ungefähr den gleichen visuellen Raum wie das Original einnimmt und die Beziehung zwischen der Bildunterschrift und der darin beschriebenen Figur erhalten bleibt.

Die selektive Übersetzung von Bildunterschriften ist eine Präzisionsaufgabe, die die vorhandenen Sprachkenntnisse des Lesers respektiert. Wenn Sie nur das übersetzen, was übersetzt werden muss, sparen Sie Zeit und erstellen ein Dokument, in dem sich zweisprachige Leser bequem zurechtfinden. Die manuellen, stilbasierten und exportbasierten Methoden lassen sich von einem einzelnen Dokument mit fünf Untertiteln bis hin zu einer Dokumentbibliothek mit Hunderten skalieren.

Die selektive Übersetzung von Bildunterschriften ist eine Präzisionsaufgabe, die ein Dokument erstellt, das von zweisprachigen Lesern verwendet werden kann, die dem Fließtext folgen können, aber Bildunterschriften in ihrer bevorzugten Sprache benötigen. Der Workflow lässt sich von einem einzelnen Dokument mit fünf Untertiteln bis hin zu einer Bibliothek mit Hunderten skalieren, und die manuellen, stilbasierten und Exportmethoden bedienen jeweils unterschiedliche Maßstäbe.

Die selektive Untertitelübersetzung respektiert die vorhandenen Sprachkenntnisse des Lesers und macht visuelle Inhalte zugänglich. Die Präzision, nur das zu übersetzen, was übersetzt werden muss, und nicht das gesamte Dokument, spart Zeit und führt zu einem Ergebnis, in dem sich zweisprachige Leser bequem zurechtfinden. Die manuellen, stilbasierten und exportbasierten Methoden skalieren von einzelnen Dokumenten bis hin zu ganzen Bibliotheken.

WukongPDF

Versuchen Sie es mit „PDF übersetzen“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →