Sie öffnen ein PDF, das gestern perfekt lesbar war. Heutzutage werden auf jeder Seite zufällige Symbole anstelle von Text angezeigt. Buchstaben wurden durch quadratische Kästchen, Fragezeichen, Pluszeichen oder Zeichenfolgen völlig unabhängiger Zeichen wie „%$#@!“ ersetzt. wo Sätze sein sollten. Die Dokumentstruktur ist intakt. Die Seiten sind da. Die Bilder sind in Ordnung. Aber jedes Wort auf jeder Seite wurde in Kauderwelsch verwandelt.
Hierbei handelt es sich um einen Fehler bei der Schriftartenkodierung und es handelt sich um eines der alarmierendsten PDF-Probleme, da es so aussieht, als ob die Datei irreparabel beschädigt wurde. In den meisten Fällen ist der Inhalt intakt. Das PDF verwendet Zeichencodes, die der Betrachter nicht den richtigen Buchstabenformen zuordnen kann. Die Korrektur umfasst normalerweise entweder das Reparieren der Schriftartenkodierung, die Installation der fehlenden Schriftart oder das erneute Rendern der PDF-Datei durch eine Engine, die die Kodierung korrekt auflöst.

Die drei häufigsten Ursachen für unverständlichen Text in PDFs
Ursache eins: fehlende Schriftarten ohne eingebetteten Fallback. Die PDF-Datei wurde mit einer Schriftart erstellt, die nicht in die Datei eingebettet war, und auf Ihrem System ist diese Schriftart nicht installiert. Der PDF-Viewer versucht, eine andere Schriftart zu ersetzen, diese verwendet jedoch eine andere Zeichenkodierung. Der Zeichencode, der „A“ bedeutete in der Originalschriftart bedeutet in der Ersatzschriftart etwas anderes. Der Betrachter gibt das Ersatzzeichen originalgetreu wieder, weshalb jeder Buchstabe auf der Seite durch ein anderes Symbol ersetzt wird.
Ursache zwei: beschädigte Schriftartdaten im PDF. Die Schriftart ist eingebettet, aber die eingebetteten Schriftartdaten sind beschädigt. Dies kann passieren, wenn eine PDF-Datei teilweise heruntergeladen, über ein E-Mail-System übertragen wird, das Binärdaten verändert, oder auf einem fehlerhaften Speichergerät gespeichert wird. Die Schriftartdaten sind vorhanden, enthalten jedoch Fehler, die dazu führen, dass die Rendering-Engine Zeichencodes falsch interpretiert. Der Text sieht zufällig aus, ist aber tatsächlich ein deterministisches Ergebnis einer fehlerhaften Eingabe. Jedes Mal, wenn Sie die Datei öffnen, erscheint derselbe Text als dasselbe Kauderwelsch, da die Beschädigung in den gespeicherten Schriftartdaten liegt und nicht in einem vorübergehenden Renderingfehler.
Ursache drei: Falsche Zeichenkodierung im PDF angegeben. Das PDF enthält einen /Encoding-Eintrag, der dem Betrachter sagt, wie er Zeichencodes Glyphen zuordnen soll, aber die angegebene Codierung stimmt nicht mit der tatsächlichen Schreibweise des Textes überein. Dies geschieht am häufigsten bei PDFs, die mit älterer oder nicht standardmäßiger Software erstellt wurden, die den Text mit einer Kodierung geschrieben, aber in den Metadaten der Datei eine andere Kodierung angegeben hat. Der Viewer wendet die deklarierte Kodierung an und erzeugt Kauderwelsch. Wenn stattdessen die vom Ersteller tatsächlich verwendete Codierung angewendet würde, würde der Text korrekt gerendert. Diese Diskrepanz zwischen deklarierter und tatsächlicher Kodierung ist die am besten behebbare der drei Ursachen, da die Textdaten intakt sind. Nur die Mapping-Anweisungen sind falsch.
Versuchen Sie es mit „PDF reparieren“.
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
So diagnostizieren Sie, welches Problem Ihr PDF hat
Eine schnelle Reihe von Tests grenzt die Ursache ein. Öffnen Sie zunächst das PDF in einem anderen Viewer. Wenn es in Adobe Acrobat korrekt angezeigt wird, in Ihrem Browser jedoch Kauderwelsch angezeigt wird, liegt das Problem am PDF-Renderer des Browsers und nicht an der Datei. Installieren Sie die fehlende Schriftart oder verwenden Sie einen anderen Viewer. Wenn das PDF in jedem Viewer Kauderwelsch anzeigt, liegt das Problem in der Datei selbst.
Überprüfen Sie zweitens die PDF-Schriftarten-Liste in den Dokumenteigenschaften. Gehen Sie in Acrobat zu Datei, Eigenschaften, Schriftarten. Wenn in der Schriftartenliste Schriftarten angezeigt werden, die als nicht eingebettet markiert sind, und diese Schriftarten nicht auf Ihrem System installiert sind, liegt ein Problem mit fehlenden Schriftarten vor. Installieren Sie die Schriftart oder öffnen Sie die Datei auf einem System, auf dem sie installiert ist. Wenn in der Schriftartenliste eingebettete Schriftarten angezeigt werden, der Text jedoch immer noch Kauderwelsch enthält, sind die eingebetteten Schriftartendaten wahrscheinlich beschädigt.
Drittens versuchen Sie, den Kauderwelschtext auszuwählen und zu kopieren. Fügen Sie es in einen Texteditor ein. Wenn der eingefügte Text der ursprüngliche korrekte Text ist, werden die Zeichen korrekt in der PDF-Datei gespeichert, aber die Anzeigezuordnung ist fehlerhaft. Dies weist auf eine Nichtübereinstimmung der Codierungsdeklaration hin. Die Textdaten sind gut. Der Betrachter zeigt es einfach falsch an. Wenn der eingefügte Text ebenfalls Kauderwelsch ist, sind die Zeichendaten selbst beschädigt, was ein tieferes Problem darstellt.
So beheben Sie ein PDF mit zufälligen Symbolen
Bei fehlenden Schriftarten installieren Sie die erforderliche Schriftart auf Ihrem System. Der Schriftartname wird in den Dokumenteigenschaften aufgeführt. Viele Schriftarten stehen zum kostenlosen Download zur Verfügung und kommerzielle Schriftarten können erworben und installiert werden. Sobald die Schriftart installiert ist, öffnen Sie das PDF erneut. Der Text sollte korrekt wiedergegeben werden. Wenn die Installation der Schriftart nicht praktikabel ist, öffnen Sie die PDF-Datei in einem Viewer, der eine bessere Schriftartenersetzung bietet, z. B. Adobe Acrobat, statt in einem Browser-Viewer, oder verwenden Sie WukongPDF, um die PDF-Datei mit eingebetteten Schriftarten neu zu rendern. Der Neurendering-Prozess löst alle Schriftartenverweise auf und bettet die tatsächlichen Zeichenformen ein, wodurch eine eigenständige PDF-Datei entsteht, die auf jedem System korrekt angezeigt wird.
Bei beschädigten eingebetteten Schriftarten besteht die Lösung darin, die Schriftartdaten zu reparieren oder zu ersetzen. Das Tool PDF Repair von WukongPDF kann beschädigte Font-Streams erkennen und versuchen, sie aus den verbleibenden Daten wiederherzustellen. Wenn die Schriftart teilweise wiederherstellbar ist, extrahiert das Tool die intakten Teile und rekonstruiert eine funktionierende Teilmenge der Schriftarten. Dies gelingt nicht immer. Wenn die Beschädigung groß ist, kann der Text möglicherweise teilweise oder vollständig nicht wiederhergestellt werden. Die einzige Möglichkeit besteht darin, das ursprüngliche Quelldokument zu finden und die PDF-Datei neu zu erstellen.
Bei Kodierungskonflikten besteht die zuverlässigste Lösung in allen Fällen darin, die PDF-Datei in eine neue PDF-Datei zu drucken. Öffnen Sie die Datei in einem beliebigen Viewer, der sie korrekt anzeigt, auch wenn nur ein Viewer auf einem bestimmten Computer sie ordnungsgemäß rendert, und verwenden Sie die Funktion „Als PDF drucken“, um eine neue Datei zu erstellen. Der Druckprozess rendert jedes Zeichen unter Verwendung der aktuellen Schriftartenwiedergabe des Systems neu und backt so effektiv die richtigen Zeichenformen als eingebettete Schriftartendaten in die neue PDF-Datei ein. Der Kodierungskonflikt wurde behoben, da das neue PDF eine Standardkodierung mit eingebetteten Schriftarten verwendet. Dieser Fix behält das visuelle Erscheinungsbild des Textes bei, geht jedoch möglicherweise die zugrunde liegende Zeichenkodierung verloren, was wichtig ist, wenn der Text später durchsuchbar oder extrahierbar sein muss. Für Dokumente, bei denen die Durchsuchbarkeit wichtig ist, verwenden Sie ein spezielles Fix PDF-Tool, das die Kodierung repariert und gleichzeitig die Textebene beibehält.
Verhindern von Problemen mit der Schriftkodierung in von Ihnen erstellten PDFs
Betten Sie beim Erstellen von PDFs immer Schriftarten ein. Diese einzelne Einstellung verhindert die überwiegende Mehrheit der Probleme mit Kauderwelschtexten. In jeder Anwendung, die in PDF, Word, InDesign, Illustrator oder PowerPoint exportiert, besteht die Möglichkeit, Schriftarten einzubetten. Finden Sie es. Aktivieren Sie es. Das resultierende PDF wird etwas größer sein, normalerweise 50 KB bis 200 KB pro Schriftart, aber es wird jetzt und in Zukunft auf jedem System in jedem Viewer korrekt angezeigt.
Verwenden Sie Standardkodierungen. Vermeiden Sie benutzerdefinierte Zeichenkodierungen, es sei denn, Sie haben einen bestimmten Grund und verstehen die Auswirkungen. Die PDF-Standardkodierung WinAnsiEncoding für lateinische Schriften und Identity-H für Unicode wird von jedem PDF-Viewer verstanden. Benutzerdefinierte Codierungen können von der Software verstanden werden, die sie erstellt hat, und von nichts anderem. Eine Standardkodierung mit eingebetteten Schriftarten ist die portierbarste und zuverlässigste Kombination für PDF-Text, der auf allen Plattformen und im Laufe der Zeit lesbar bleibt.
Wenn Sie in einer PDF-Datei, die mit einer älteren oder speziellen Anwendung erstellt wurde, wie einem Mainframe-Berichtsgenerator, einem älteren Buchhaltungssystem oder einem Ausgabemodul für wissenschaftliche Instrumente, auf Kauderwelschtext stoßen, liegt das Codierungsproblem möglicherweise in der Zeichenzuordnungstabelle der PDF-Datei und nicht in fehlenden Schriftarten. Diese Systeme erstellen manchmal PDFs, in denen der Text mithilfe einer benutzerdefinierten Symbolkodierung gespeichert wird, die Zeichencodes Glyphenpositionen in einer Schriftart zuordnet und nicht Unicode-Werten. Wenn ein moderner Viewer versucht, den Text als Unicode zu extrahieren, schlägt die Zuordnung fehl und es entsteht Unsinn. Die Lösung für diese Dateien besteht darin, ein PDF-Reparaturtool zu verwenden, das nicht standardmäßige Kodierungen erkennt und diese entweder durch Standard-Unicode-Zuordnungen ersetzt oder den Text als rohe Zeichencodes extrahiert und die Kodierung aus den Schriftartdaten neu erstellt. Hierbei handelt es sich um einen speziellen Reparaturvorgang, der über die Möglichkeiten allgemeiner PDF-Tools hinausgeht und in der Regel ein Tool mit expliziter Unterstützung für die Reparatur älterer Codierungen erfordert.
Versuchen Sie es mit „PDF reparieren“.
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
