Bei der Konvertierung einer PDF-Datei in Word steht in der Regel die Beibehaltung des visuellen Layouts im Vordergrund, aber die Spracheinstellungen des Dokuments sind für die Barrierefreiheit, die Rechtschreibprüfung und die Kompatibilität mit Bildschirmleseprogrammen ebenso wichtig. Wenn bei der PDF-zu-Word-Konvertierung Sprachmetadaten verloren gehen, markiert das resultierende Dokument möglicherweise jedes Wort als Rechtschreibfehler, liest Text bei Verwendung eines Screenreaders mit der falschen Stimme vor und wendet sprachspezifische Silbentrennungs- und Grammatikregeln nicht an. Eine Studie von WebAIM aus dem Jahr 2025 ergab, dass bei 18 Prozent der getesteten PDF-zu-Word-Konvertierungen Sprachmetadaten aus der Ausgabe entfernt wurden, wodurch die Dokumente für Benutzer, die auf unterstützende Technologien angewiesen sind, weniger zugänglich wurden (WebAIM, „Screen Reader Accessibility of Converted Documents“, 2025).
Wichtige Erkenntnisse
PDF-Spracheinstellungen werden im Strukturbaum des Dokuments und in den einzelnen Textobjekteigenschaften gespeichert. Die meisten Exporttools behalten das visuelle Layout des Textes bei, verwerfen jedoch die Sprachmetadaten, es sei denn, die Konvertierungseinstellungen bewahren explizit die Dokumentstruktur. Die Spracheinstellung in der resultierenden Word-Datei steuert Wörterbücher für die Rechtschreibprüfung, Thesaurussuche, Silbentrennungsregeln und die den Bildschirmlesern angekündigte Standardsprache. Das Korrigieren verlorener Spracheinstellungen nach der Konvertierung dauert pro Dokument nur wenige Sekunden.

Wo Spracheinstellungen in einem PDF gespeichert sind
PDFs, die aus gescannten Dokumenten erstellt wurden, die mit OCR verarbeitet wurden, können Sprachmetadaten enthalten, die von der OCR-Engine hinzugefügt und nicht vom Originaldokument übernommen wurden. Wenn die OCR-Engine standardmäßig Englisch verwendet, das gescannte Dokument jedoch auf Französisch war, sind die Sprachmetadaten im PDF falsch, bevor die Konvertierung überhaupt beginnt. Überprüfen Sie vor der Konvertierung das Sprachfeld der PDF-Dokumenteigenschaften und korrigieren Sie es mit einem PDF-Metadaten-Editor, wenn die OCR-Engine es falsch eingestellt hat.
Ein PDF speichert Sprachinformationen an zwei Stellen. Die Sprache auf Dokumentebene wird im Dokumentkatalog festgelegt und gilt für den gesamten Text, sofern sie nicht überschrieben wird. Einzelne Textobjekte können über das Lang-Attribut ihre eigene Spracheigenschaft tragen, die die Sprache für diesen bestimmten Textabschnitt angibt. Eine mehrsprachige PDF-Datei, beispielsweise ein Produkthandbuch mit englischem Haupttext und französischen Zitaten, kann auf Dokumentebene Englisch mit französischen Lang-Attributen in den zitierten Passagen enthalten. Dieses zweistufige System folgt dem PDF/UA-Barrierefreiheitsstandard, um sicherzustellen, dass Bildschirmleser die Sprache korrekt wechseln.
Wenn ein PDF-Konverter Text aus einer PDF-Datei extrahiert, liest er die Zeichencodes und ordnet sie Unicode-Werten zu. Die Sprachmetadaten werden neben dem Text übertragen, sind jedoch nicht Teil der sichtbaren Zeichen. Ein Konverter, der nur den Zeichenstrom liest und die Metadaten ignoriert, erstellt ein Word-Dokument ohne Sprachinformationen, wodurch Word standardmäßig die Installationssprache verwendet, die möglicherweise mit der Sprache des Originaldokuments übereinstimmt oder nicht.
Versuchen Sie es mit PDF zu Word
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
Überprüfen und Einstellen der Sprache im ausgegebenen Word-Dokument
Bei Dokumenten, die mehrere Sprachen im selben Absatz enthalten, wie etwa ein Sprachlehrbuch oder eine linguistische Arbeit, ist die wortweise Sprachmarkierung von Word präziser als die Einstellungen auf Absatzebene. Nachdem Sie die Dokumentsprache festgelegt haben, wählen Sie einzelne Fremdwörter oder Phrasen aus und legen deren Sprache über die Registerkarte „Überprüfen“ fest. Dadurch wird die Rechtschreibprüfung von Word angewiesen, diese Wörter zu überspringen oder sie mit dem richtigen Wörterbuch zu vergleichen. Es weist Bildschirmleser außerdem an, die Aussprache für diese bestimmten Wörter zu ändern, was das Hörerlebnis für Benutzer unterstützender Technologien erheblich verbessert.
Öffnen Sie nach der Konvertierung das Word-Dokument und drücken Sie Strg+A, um den gesamten Text auszuwählen. Sehen Sie sich die Statusleiste unten im Word-Fenster an. Die aktuelle Sprache wird neben der Wortanzahl angezeigt. Wenn die falsche Sprache angezeigt wird oder „Sprache: (mehrere)“ angezeigt wird, oder leer ist, wurden die Sprachmetadaten bei der Konvertierung nicht beibehalten. Um die Sprache festzulegen, gehen Sie zur Registerkarte „Überprüfen“, klicken Sie auf „Sprache“, dann auf „Sprache für Korrekturhilfen festlegen“ und wählen Sie die richtige Sprache aus der Liste aus. Aktivieren Sie das Kontrollkästchen „Sprache automatisch erkennen“. wenn das Dokument mehrere Sprachen enthält, oder lassen Sie es deaktiviert, wenn das gesamte Dokument in einer Sprache vorliegt.
Bei mehrsprachigen Dokumenten, bei denen unterschiedliche Passagen unterschiedliche Spracheinstellungen erfordern, ist der Prozess aufwändiger. Wählen Sie jede Passage einzeln aus und legen Sie ihre Sprache über dasselbe Menü der Registerkarte „Überprüfen“ fest. Die Spracheinstellung gilt nur für den ausgewählten Text. Dieser manuelle Prozess funktioniert für kurze Dokumente mit einigen Sprachwechseln. Bei längeren mehrsprachigen Dokumenten sollten Sie erwägen, die Sprachmetadaten bei der ersten Konvertierung beizubehalten, anstatt sie anschließend manuell zu korrigieren.
Konvertierungstools, die Sprachmetadaten bewahren
Die Barrierefreiheits-Tag-Struktur in einer PDF-Datei enthält, sofern vorhanden, Sprachattribute für jedes Textelement. Wenn eine PDF-Datei ordnungsgemäß für die Barrierefreiheit gekennzeichnet wurde, was für die PDF/UA-Konformität erforderlich ist, werden die Sprachmetadaten in einem strukturierten, maschinenlesbaren Format gespeichert, das sauber in Word konvertiert werden kann. Wenn Ihr Workflow dies zulässt, fordern Sie für jedes Dokument, das später in Word konvertiert wird, PDFs mit Barrierefreiheits-Tags an oder erstellen Sie diese. Die Vorabinvestition in das Tagging zahlt sich durch schnellere und genauere Konvertierungen aus.
Die in Adobe Acrobat integrierte Funktion „PDF nach Word exportieren“ behält die Spracheinstellungen des Dokuments bei, wenn die Option „Fließtext beibehalten“ aktiviert ist. Die Option ist ausgewählt und „Kommentare und Bilder einbeziehen“ wird angezeigt. wird geprüft. Microsoft Word selbst versucht beim direkten Öffnen einer PDF-Datei über „Datei“ und „Öffnen“, die Metadaten der PDF-Sprache den Spracheinstellungen von Word zuzuordnen. Die Qualität der Zuordnung hängt davon ab, ob das PDF Standard-ISO-Sprachcodes verwendet. Ein PDF, das „en-US“ angibt. oder "fr-FR" Die Verwendung des Standard-Sprachcodes führt zu einer sauberen Konvertierung. Eine PDF-Datei, die einen nicht standardmäßigen oder fehlenden Sprachcode verwendet, führt zu einem Word-Dokument ohne Spracheinstellung.
Online-PDF-zu-Word-Konverter unterscheiden sich in der Unterstützung ihrer Sprachmetadaten. Tools, die auf Barrierefreiheit ausgelegt sind, beispielsweise solche, die auf die PDF/UA-Konformität abzielen, bewahren Spracheinstellungen eher als Allzweckkonverter. Das PDF-zu-Word-Konvertierungstool von WukongPDF bewahrt Sprachmetadaten auf Dokumentebene und ordnet sie der entsprechenden Word-Korrektursprache zu, sodass das Ausgabedokument ohne zusätzliche Sprachkonfiguration für die Rechtschreibprüfung und die Verwendung mit Bildschirmleseprogrammen bereit ist.
Warum die Erhaltung der Sprache über die Rechtschreibprüfung hinaus wichtig ist
Spracheinstellungen wirken sich auch auf die Leistung der Editor-Funktion von Word aus, die über die einfache Rechtschreibprüfung hinaus Schreibvorschläge bietet. Der Editor verwendet sprachspezifische Modelle, um Klarheitsprobleme, Bedenken bezüglich der inklusiven Sprache und Stilprobleme zu erkennen. Wenn die Dokumentsprache falsch eingestellt ist, wendet der Editor das falsche Sprachmodell an und generiert falsche Vorschläge, die die Zeit des Benutzers verschwenden. Durch die korrekte Einstellung der Sprache vor der Ausführung des Editors wird dieser Frust vermieden.
Spracheinstellungen in einem Word-Dokument wirken sich nicht nur auf die roten, verschnörkelten Linien unter falsch geschriebenen Wörtern aus. Sie legen fest, welchen Thesaurus Word verwendet, wenn Sie Umschalt+F7 drücken, welche Grammatikregeln bei der Grammatikprüfung angewendet werden, welches Silbentrennungswörterbuch für die automatische Silbentrennung bei Zeilenumbrüchen herangezogen wird und welche Sprach- und Ausspracheregeln ein Bildschirmleser beim Vorlesen des Dokuments verwendet. Für Benutzer mit Sehbehinderungen ist es deutlich schwieriger, den Inhalt zu verstehen, wenn das Dokument mit der falschen Stimme oder mit den falschen Ausspracheregeln vorgelesen wird.
In regulierten Branchen sind auch Spracheinstellungen für die Compliance von Bedeutung. Regierungsbehörden, Gesundheitsdienstleister und Bildungseinrichtungen in zweisprachigen Regionen müssen häufig Dokumente in bestimmten Sprachen erstellen. Eine konvertierte PDF-Datei, die ihre Sprachmetadaten verloren hat, enthält möglicherweise technisch gesehen den korrekten Text, besteht jedoch eine automatische Konformitätsprüfung nicht, da die Dokumenteigenschaften die erforderliche Sprache nicht deklarieren. Das Überprüfen und Festlegen der Sprache nach der Konvertierung ist ein kleiner Schritt, der ein größeres Compliance-Problem verhindert.
Häufig gestellte Fragen
Spielt die Spracheinstellung in der PDF-Datei eine Rolle, wenn ich sie nur zur Bearbeitung in Word konvertiere und später wieder in die PDF-Datei exportiere? Ja, da die Spracheinstellung im Word-Zwischendokument Auswirkungen auf die Rechtschreibprüfung, die Grammatikprüfung und die Sprachmetadaten hat, die in die endgültige PDF-Datei geschrieben werden. Wenn Sie das Festlegen der Sprache in Word überspringen, verfügt die endgültige PDF-Datei über keine Sprachmetadaten, was die Zugänglichkeit beeinträchtigt und dazu führen kann, dass die automatische Konformitätsprüfung nicht besteht.
Kann ich vor der Konvertierung Sprachmetadaten im Original-PDF festlegen, um das Ergebnis zu verbessern?
Ja. Wenn Sie den PDF-Erstellungsprozess steuern, stellen Sie sicher, dass die Dokumentsprache in den PDF-Eigenschaften festgelegt ist und dass jeder Text in einer anderen Sprache das richtige Lang-Attribut trägt. Aus Word erstellte PDFs mit der Funktion „Dokumentstruktur-Tags für Barrierefreiheit“ Die beim Export aktivierte Option schließt diese Metadaten automatisch ein. Das Konvertieren aus einer mit Barrierefreiheits-Tags versehenen PDF-Datei führt zu einer viel besseren Spracherhaltung als die Konvertierung aus einer nicht mit Tags versehenen PDF-Datei.
Was passiert mit den Rechts-nach-Links-Spracheinstellungen während der Konvertierung?
Für Rechts-nach-links-Sprachen wie Arabisch und Hebräisch sind sowohl der Sprachcode als auch die Einstellung der Absatzrichtung erforderlich. Standardmäßige PDF-zu-Word-Konverter behalten oft den Sprachcode bei, lassen aber die Richtungseinstellung weg, was dazu führt, dass der konvertierte Text von links nach rechts angezeigt wird. Wählen Sie nach der Konvertierung den betroffenen Text aus und stellen Sie die Absatzrichtung im Dialogfeld „Absatzeinstellungen“ in Word auf „Rechts nach links“ ein.
Beeinträchtigt die Konvertierung in ein älteres Word-Format wie DOC anstelle von DOCX den Spracherhalt?
Ja. DOCX speichert Spracheinstellungen in einem strukturierten XML-Format, das PDF-Metadaten zuverlässiger zuordnet. Das ältere DOC-Binärformat bietet nur begrenzte Unterstützung für Sprachattribute pro Text. Konvertieren Sie immer in DOCX, um die bestmögliche Erhaltung der Sprachmetadaten zu gewährleisten.
Wie kann ich vor der Konvertierung überprüfen, auf welche Sprache ein PDF eingestellt ist? Öffnen Sie die PDF-Datei und zeigen Sie die Dokumenteigenschaften an, normalerweise unter „Datei“, „Eigenschaften“ oder durch Drücken von Strg+D. Die Registerkarte „Erweitert“ oder „Beschreibung“ enthält ein Feld „Sprache“. Wenn dieses Feld leer ist, verfügt das PDF über keine Spracheinstellung auf Dokumentebene und Sie sollten damit rechnen, die Sprache nach der Konvertierung manuell in Word festzulegen.
Versuchen Sie es mit PDF zu Word
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
