Tips & Tricks

So reparieren Sie ein PDF, das mit verstümmeltem oder verschlüsseltem Text geöffnet wird

Eine PDF-Datei, die verstümmelten Text, zufällige Symbole, Reihen leerer Quadrate oder Zeichenfolgen bedeutungsloser Zeichen anzeigt, kann wie eine beschädigte Datei aussehen, die nicht wiederhergestellt werden kann. Das Dokument wird ohne Fehlermeldungen geöffnet, die Seitenzahl scheint korrekt zu sein und alle Bilder und Grafiken werden normal angezeigt, aber die Wörter selbst wurden durch etwas völlig Unleserliches ersetzt. Dieses Muster weist in der Regel eher auf ein Problem mit der Schriftartenkodierung als auf eine strukturelle Dateibeschädigung hin. Dies ist eine gute Nachricht, da Schriftartenprobleme häufig ohne spezielle Datenwiederherstellungstools oder forensische Dateireparaturdienste behoben werden können. Der zugrunde liegende Inhalt ist möglicherweise noch in der Datei vorhanden und so codiert, dass der PDF-Viewer ihn aufgrund fehlender oder nicht übereinstimmender Schriftartdaten nicht interpretieren kann.

How to Repair a PDF That Opens With Garbled or Scrambled Text

Diagnose der Schriftartenkodierung im Vergleich zu echter Dateibeschädigung

Der erste Diagnoseschritt besteht darin, festzustellen, ob das Problem in der Schriftartenkodierung oder in der PDF-Dateistruktur selbst liegt. Ein Problem mit der Schriftartenkodierung führt zu systematischer, konsistenter Verstümmelung im gesamten Dokument. Jedes Vorkommen des Buchstabens A könnte zu einem leeren Quadrat werden, oder der gesamte Text erscheint durchgängig als zufällig akzentuierte Zeichen aus einem anderen Alphabet, aber das Muster wiederholt sich vorhersehbar. Echte Dateibeschädigungen führen zu inkonsistentem Verhalten: Seiten, die überhaupt nicht gerendert werden, Fehlermeldungen beim Versuch, die Datei zu öffnen, oder Abschnitte des Dokuments, die völlig leer sind, während andere Abschnitte korrekt angezeigt werden. Seiten, die Bilder perfekt wiedergeben, aber verstümmelten Text zeigen, deuten eher auf Probleme mit der Schriftart als auf strukturelle Schäden hin.

Öffnen Sie das PDF in mindestens zwei verschiedenen Viewern, um die Diagnose zu bestätigen. Wenn die Datei in Adobe Acrobat Reader korrekt angezeigt wird, in einem browserbasierten Viewer wie Chrome oder Edge jedoch nicht, unterstützt der Browser-Viewer höchstwahrscheinlich nicht das spezifische eingebettete Schriftartformat, das in der PDF-Datei verwendet wird. Wenn die Datei in Chrome korrekt angezeigt wird, aber nicht in der Vorschau auf dem Mac, fehlt in der Vorschau möglicherweise die Unterstützung für ein bestimmtes Schriftartenkodierungsschema. Wenn die Datei in jedem auf verschiedenen Betriebssystemen getesteten Viewer verstümmelten Text anzeigt, sind die Schriftartdaten in der PDF-Datei selbst entweder beschädigt oder fehlen und es ist ein PDF reparieren-Vorgang erforderlich, der die Schriftartressourcen anspricht.

WukongPDF

Versuchen Sie es mit „PDF reparieren“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Erneutes Einbetten fehlender oder beschädigter Schriftarten

Wenn eine PDF-Datei auf eine Schriftart verweist, die nicht in die Datei eingebettet und nicht auf dem Anzeigesystem installiert ist, ist der PDF-Viewer gezwungen, eine andere Schriftart zu verwenden, die ihm zur Verfügung steht. Bei dieser Ersetzung kommt es häufig zu einer Fehlausrichtung von Zeichen, da die Ersatzschriftart andere Zeichenbreiten, Abstandsmaße und Glyphenpositionen aufweist als die Originalschriftart. Der Text erscheint als durcheinandergebrachte oder zufällige Symbole, da die in der PDF-Datei gespeicherten Zeichencodes völlig anderen Glyphen in der Ersatzschriftart zugeordnet sind als denen, die der Autor des Dokuments beabsichtigt hatte. Die Lösung besteht darin, die richtigen Schriftarten erneut in das PDF einzubetten, sodass der Betrachter nicht mehr raten muss.

Öffnen Sie die PDF-Datei in einem Tool, das Schriftartressourcen auf Dokumentebene prüfen und ändern kann. Überprüfen Sie das Schriftarteninventar, um zu sehen, auf welche Schriftarten das Dokument verweist und ob jede vollständig eingebettet ist, teilweise als Teilmenge eingebettet ist, die nur die verwendeten Zeichen enthält, oder als überhaupt nicht eingebettet aufgeführt ist. Wenn eine Schriftart als nicht eingebettet angezeigt wird, müssen Sie entweder genau diese Schriftart auf Ihrem System installieren und die PDF-Datei mit aktivierter Option „Alle Schriftarten einbetten“ erneut speichern oder ein PDF-Fix PDF-Tool verwenden, das die erforderlichen Schriftartdaten aus seiner eigenen lizenzierten Schriftartenbibliothek finden und einbetten kann. Gängige Systemschriftarten wie Arial, Times New Roman, Helvetica und Courier sind in den meisten Schriftbibliotheken verfügbar und können ohne Lizenzbeschränkungen eingebettet werden.

Verwendung der Print-to-PDF-Technik für eine schnelle Wiederherstellung

Wenn der verstümmelte Text durch eine Schriftartenkodierung verursacht wird, die ein bestimmter Viewer korrekt verarbeitet, während andere dies nicht tun, besteht die schnellste praktische Lösung darin, diesen einzelnen funktionierenden Viewer zu nutzen. Öffnen Sie die PDF-Datei in dem Viewer, der den Text korrekt auf dem Bildschirm darstellt. Drücken Sie Strg-P oder Befehl-P, um den Druckdialog zu öffnen, und wählen Sie „Microsoft Print to PDF“ oder „Als PDF speichern“ als Zieldrucker. Die Druckpipeline rastern oder kodiert den Text, während er auf dem Bildschirm erscheint, neu und bettet ihn in ein brandneues PDF ein. Dabei werden standardmäßige, universell unterstützte Schriftarten und eine Kodierung verwendet, die jeder moderne PDF-Viewer versteht, ohne dass eine spezielle Schriftartenbehandlung erforderlich ist.

Diese Methode erzeugt eine Reparatur-PDF-Kopie mit sauberem, lesbarem Text, der überall konsistent angezeigt wird. Bevor Sie sich dazu verpflichten, müssen Sie jedoch einen wichtigen Kompromiss verstehen. Das gedruckte PDF verliert in der Regel die Textauswählbarkeit, Durchsuchbarkeit und alle interaktiven Formularelemente. Der Text wird effektiv Teil des Seitenbildes. Für ein Dokument, das nur einmal auf dem Bildschirm gelesen und möglicherweise gedruckt werden muss, ist dies eine durchaus akzeptable Lösung, die Sekunden dauert. Für ein Dokument, das nach der Reparatur durchsuchbar, auswählbar oder bearbeitbar bleiben muss, probieren Sie zunächst den Ansatz der Schriftarteneinbettung aus und reservieren Sie das Drucken in PDF als Ausweichlösung.

Konvertieren der PDF-Datei in ein Zwischenformat

Wenn das Einbetten von Schriftarten das Problem nicht löst und beim Drucken in PDF zu viele Dokumentfunktionen verloren gehen, kann durch die Konvertierung der PDF-Datei in ein Zwischenformat die fehlerhafte Kodierung entfernt werden, während der Text als tatsächlicher Text erhalten bleibt. Exportieren Sie die PDF-Datei mithilfe eines PDF-zu-Word-Konverters in ein Word-Dokument. Der Konvertierungsprozess liest den PDF-Inhaltsstrom und gibt den erkannten Text in ein neues Format aus, das Words eigene Schriftartenverarbeitung und -kodierung nutzt, völlig unabhängig davon, was in der Original-PDF fehlerhaft war. Öffnen Sie die resultierende Word-Datei, vergewissern Sie sich, dass der Text durchgehend korrekt gelesen wird, nehmen Sie gegebenenfalls kleinere Formatierungskorrekturen vor und exportieren Sie sie dann mit aktivierter Schriftarteinbettung zurück ins PDF-Format.

Der Roundtrip durch Word ersetzt die fehlerhafte Kodierung durch eine saubere, standardkonforme, aber komplexe Layouts mit mehreren Spalten, präziser Positionierung oder eingebetteten Vektorgrafiken überstehen die Konvertierung möglicherweise nicht perfekt. In der folgenden Tabelle werden die drei Reparaturansätze anhand der Faktoren verglichen, die bei der Auswahl der anzuwendenden Methode wichtig sind:

MethodeText wählbarLayout beibehaltenGeschwindigkeit
Schriftarten erneut einbettenJaJaMäßig
Als PDF druckenNEINJaSchnell
PDF zu Word zu PDFJaTeilweiseLangsam

Umgang mit Problemen bei der Kodierung von Unicode- und CID-Schriftarten

PDFs, die in nicht-lateinischen Schriften wie Chinesisch, Japanisch, Koreanisch, Arabisch oder Kyrillisch erstellt wurden, zeigen manchmal verstümmelten Text an, insbesondere wenn die Schriftart CID-Codierung (Character Identifier) verwendet und der Betrachter die numerischen CIDs nicht wieder den entsprechenden Unicode-Zeichen zuordnen kann. Dies ist häufig bei älteren PDFs der Fall, die mit Scan-Software oder älteren Veröffentlichungssystemen erstellt wurden, die Schriftarten mithilfe von Codierungstabellen vor Unicode eingebettet haben, die entwickelt wurden, bevor Unicode zum universellen Standard wurde. Eine PDF-Datei von einem japanischen Scanner aus dem Jahr 2005 kann beispielsweise eine CID-Schriftart verwenden, die moderne Betrachter ohne die ursprüngliche herstellerspezifische CMAP-Datei nicht interpretieren können.

Spezielle PDF-Fix PDF-Tools, die die CID-zu-Unicode-Zuordnung explizit unterstützen, können die korrekten Zeichenzuordnungen rekonstruieren. Diese Tools lesen die rohen CID-Codes aus den Schriftartdaten und der eingebetteten CMAP-Tabelle, falls vorhanden, um die Unicode-Zuordnung neu zu erstellen. Der Prozess wird in Tools für die Reparatur von PDF-Schriftarten automatisiert und erfordert lediglich, dass Sie die Datei hochladen und die korrigierte Version herunterladen. Wählen Sie für PDFs, die ostasiatische Sprachen enthalten, ein Reparaturtool, das explizit die Unterstützung von CJK-Schriftarten in seinem Funktionsumfang auflistet, da generische Schriftartreparaturtools, die hauptsächlich für lateinische Schriften entwickelt wurden, möglicherweise nicht die CMAP-Daten oder die Glyphenerkennungsmodelle für diese Schriftsysteme enthalten.

Verstümmelten Text in von Ihnen erstellten PDFs verhindern

Wenn Sie regelmäßig PDF-Dateien erstellen, die beim Empfänger mit verstümmeltem Text ankommen, liegt die Ursache fast immer in den Schriftarteinbettungseinstellungen in der Software, die die PDF-Datei erstellt. Suchen Sie beim Exportieren aus Word, PowerPoint, InDesign oder einem Designtool das Dialogfeld „PDF-Export- oder Speicheroptionen“ und aktivieren Sie das Kontrollkästchen „Schriftarten einbetten“ oder „Alle Schriftarten einbetten“. Einige Anwendungen bieten ein zusätzliches Kontrollkästchen zum Einbetten nur der im Dokument verwendeten Zeichen an. Dadurch wird die Datei durch Unterteilung von Schriftarten kleiner, es kann jedoch zu Anzeigeproblemen kommen, wenn die PDF-Datei später bearbeitet oder mit anderen Inhalten zusammengeführt wird. Um eine maximale plattformübergreifende Kompatibilität zu erreichen, betten Sie die gesamte Schriftart statt einer Teilmenge ein, wenn die Vergrößerung der Datei akzeptabel ist.

Plattformen wie WukongPDF verarbeiten die Konvertierung im PDF-Format mit standardmäßig aktivierter umfassender Schriftarteneinbettung und vermeiden so Kodierungsprobleme, die durch systemspezifische Schriftartenabhängigkeiten entstehen, die nur auf dem Computer des Erstellers funktionieren. Wenn Sie eine PDF-Datei senden, die auf verschiedenen Betriebssystemen, Geräten und Viewer-Anwendungen korrekt angezeigt werden muss, besteht ein schneller Validierungstest darin, die Datei in einem browserbasierten PDF-Viewer zu öffnen, da diese Viewer keinen Zugriff auf lokal installierte Systemschriftarten haben und alle Probleme mit der Schriftarteneinbettung sofort aufdecken, die andernfalls unbemerkt bleiben würden, bis ein Empfänger verstümmelten Text meldet.

Wann muss akzeptiert werden, dass eine PDF-Datei nicht repariert werden kann

Trotz der besten Reparaturtechniken haben einige PDFs Schäden erlitten, die praktisch nicht mehr behebbar sind. Wenn Sie versucht haben, Schriftarten erneut einzubetten, aus jedem verfügbaren Viewer in eine neue PDF-Datei zu drucken und die Roundtrip-Konvertierung über Word durchzuführen und der Text verstümmelt bleibt, weist die Datei möglicherweise einen strukturellen Schaden im Inhaltsstrom selbst auf und nicht nur ein Problem mit der Schriftartenkodierung. An diesem Punkt ist es normalerweise am produktivsten, das ursprüngliche Quelldokument zu finden und daraus ein neues PDF zu generieren.

Bewahren Sie die beschädigte Datei als Referenz auf, da Bilder und Seitenstruktur möglicherweise noch teilweise intakt sind, selbst wenn der Text nicht wiederhergestellt werden kann. Wenn das Dokument von einem Scanner stammt, wird durch erneutes Scannen des ursprünglichen Papierdokuments ein sauberes PDF mit korrekter Textcodierung erstellt. Wenn das Dokument aus einer Word-Datei oder einer Designanwendung erstellt wurde, bitten Sie den ursprünglichen Autor, es erneut zu exportieren, wobei die Schriftarteinbettung explizit aktiviert ist. Ein neuer Export aus dem Quelldokument umgeht alle in der beschädigten Kopie vorhandenen Codierungsprobleme und erstellt in kürzerer Zeit eine saubere Datei als der Versuch weiterer Reparaturen.

WukongPDF

Versuchen Sie es mit „PDF reparieren“.

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →