Others

Waarom toont mijn PDF willekeurige symbolen of wartaal in plaats van normale tekst wanneer ik deze open?

U opent een pdf die gisteren nog perfect leesbaar was. Tegenwoordig worden op elke pagina willekeurige symbolen weergegeven in plaats van tekst. Letters zijn vervangen door vierkante vakken, vraagtekens, plustekens of reeksen volledig niet-gerelateerde tekens zoals "%$#@!" waar zinnen moeten staan. De documentstructuur is intact. De pagina's zijn er. De afbeeldingen zijn prima. Maar elk woord op elke pagina is omgezet in wartaal.

Dit is een fout bij het coderen van lettertypen en het is een van de meest alarmerende PDF-problemen, omdat het erop lijkt dat het bestand onherstelbaar beschadigd is. In de meeste gevallen is de inhoud intact. De PDF gebruikt tekencodes die de kijker niet kan toewijzen aan de juiste lettervormen. De oplossing omvat meestal het repareren van de lettertypecodering, het installeren van het ontbrekende lettertype of het opnieuw renderen van de PDF via een engine die de codering correct oplost.

Why Does My PDF Show Random Symbols or Gibberish Instead of Normal Text When I Open It

De drie meest voorkomende oorzaken van wartaal in pdf-bestanden

Oorzaak één: ontbrekende lettertypen zonder ingebedde terugval. De PDF is gemaakt met een lettertype dat niet in het bestand is ingesloten, en op uw systeem is dat lettertype niet geïnstalleerd. De PDF-viewer probeert een ander lettertype te vervangen, maar het vervangende lettertype gebruikt een andere tekencodering. De tekencode die "A" in het originele lettertype betekent iets anders in het vervangende lettertype. De kijker geeft het vervangende teken getrouw weer, daarom wordt elke letter op de pagina vervangen door een ander symbool.

Oorzaak twee: beschadigde lettertypegegevens in de PDF. Het lettertype is ingesloten, maar de ingesloten lettertypegegevens zijn beschadigd. Dit kan gebeuren wanneer een PDF gedeeltelijk wordt gedownload, overgedragen via een e-mailsysteem dat binaire gegevens wijzigt, of wordt opgeslagen op een defect opslagapparaat. De lettertypegegevens zijn aanwezig, maar bevatten fouten waardoor de weergave-engine tekencodes verkeerd interpreteert. De tekst ziet er willekeurig uit, maar is in werkelijkheid een deterministisch resultaat van beschadigde invoer. Elke keer dat u het bestand opent, verschijnt dezelfde tekst als hetzelfde gebrabbel, omdat de beschadiging in de opgeslagen lettertypegegevens zit en niet in een tijdelijke weergavefout.

Oorzaak drie: onjuiste tekencodering opgegeven in de PDF. De PDF bevat een item /Encoding dat de kijker vertelt hoe tekencodes aan glyphs moeten worden toegewezen, maar de opgegeven codering komt niet overeen met hoe de tekst daadwerkelijk is geschreven. Dit komt het vaakst voor bij PDF's die zijn gemaakt met oudere of niet-standaardsoftware die de tekst met één codering heeft geschreven, maar een andere codering heeft opgegeven in de metagegevens van het bestand. De kijker past de gedeclareerde codering toe en produceert wartaal. Als het in plaats daarvan de daadwerkelijke codering zou toepassen die de maker gebruikte, zou de tekst correct worden weergegeven. Deze discrepantie tussen de gedeclareerde en daadwerkelijke codering is de meest herstelbare van de drie oorzaken, omdat de tekstgegevens intact zijn. Alleen de mapping-instructies zijn verkeerd.

WukongPDF

Probeer PDF repareren

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →

Hoe u kunt vaststellen welk probleem uw PDF heeft

Een snelle reeks tests verkleint de oorzaak. Open eerst de PDF in een andere viewer. Als het correct wordt weergegeven in Adobe Acrobat, maar wartaal in uw browser vertoont, ligt het probleem bij de PDF-renderer van de browser en niet bij het bestand. Installeer het ontbrekende lettertype of gebruik een andere viewer. Als de PDF in elke viewer wartaal vertoont, ligt het probleem in het bestand zelf.

Controleer ten tweede de lijst PDF Fonts in de documenteigenschappen. Ga in Acrobat naar Bestand, Eigenschappen, Lettertypen. Als de lijst met lettertypen lettertypen weergeeft die zijn gemarkeerd als niet ingesloten, en deze lettertypen zijn niet op uw systeem geïnstalleerd, is er sprake van een probleem met ontbrekende lettertypen. Installeer het lettertype of open het bestand op een systeem dat dit bevat. Als de lijst met lettertypen ingesloten lettertypen weergeeft, maar de tekst nog steeds wartaal is, zijn de gegevens van de ingesloten lettertypen waarschijnlijk beschadigd.

Ten derde, probeer de wartaaltekst te selecteren en te kopiëren. Plak het in een teksteditor. Als de geplakte tekst de originele, correcte tekst is, worden de tekens correct in de PDF opgeslagen, maar is de weergavetoewijzing verbroken. Dit duidt op een niet-overeenkomende coderingsdeclaratie. De tekstgegevens zijn goed. De kijker geeft het gewoon verkeerd weer. Als de geplakte tekst ook onzin is, zijn de tekengegevens zelf beschadigd, wat een dieper probleem is.

Een pdf repareren waarin willekeurige symbolen worden weergegeven

Voor ontbrekende lettertypen installeert u het vereiste lettertype op uw systeem. De lettertypenaam wordt vermeld in de documenteigenschappen. Veel lettertypen kunnen gratis worden gedownload en commerciële lettertypen kunnen worden gekocht en geïnstalleerd. Zodra het lettertype is geïnstalleerd, opent u de PDF opnieuw. De tekst moet correct worden weergegeven. Als het installeren van het lettertype niet praktisch is, opent u de PDF in een viewer die betere lettertypevervanging heeft, zoals Adobe Acrobat in plaats van een browserviewer, of gebruikt u WukongPDF om de PDF opnieuw weer te geven met ingesloten lettertypen. Bij het opnieuw renderen worden alle lettertypereferenties opgelost en worden de daadwerkelijke tekenvormen ingesloten, waardoor een op zichzelf staande PDF ontstaat die op elk systeem correct wordt weergegeven.

Voor beschadigde ingebedde lettertypen bestaat de oplossing uit het repareren of vervangen van de lettertypegegevens. De tool PDF Repair van WukongPDF kan beschadigde lettertypestreams detecteren en proberen deze opnieuw op te bouwen op basis van de overgebleven gegevens. Als het lettertype gedeeltelijk kan worden hersteld, extraheert het hulpprogramma de intacte delen en reconstrueert het een werkende lettertypesubset. Dit is niet altijd succesvol. Als de corruptie groot is, kan de tekst geheel of gedeeltelijk onherstelbaar zijn en is de enige oplossing het lokaliseren van het originele brondocument en het opnieuw maken van de PDF.

Als de codering niet overeenkomt, is de meest betrouwbare oplossing in alle gevallen het afdrukken van de PDF naar een nieuwe PDF. Open het bestand in een viewer die het correct weergeeft, zelfs als slechts één viewer op één specifieke computer het correct weergeeft, en gebruik de functie Afdrukken naar PDF om een nieuw bestand te maken. Bij het afdrukproces wordt elk teken opnieuw weergegeven met behulp van de huidige lettertypeweergave van het systeem, waardoor de juiste tekenvormen in de nieuwe PDF worden ingevoegd als ingebedde lettertypegegevens. Het probleem met de codering is opgelost omdat de nieuwe PDF een standaardcodering met ingesloten lettertypen gebruikt. Deze oplossing behoudt het visuele uiterlijk van de tekst, maar kan de onderliggende tekencodering kwijtraken, wat van belang is als de tekst later doorzoekbaar of extraheerbaar moet zijn. Voor documenten waarbij de doorzoekbaarheid van belang is, gebruikt u een speciale tool Fix PDF die de codering repareert terwijl de tekstlaag behouden blijft.

Voorkomen van problemen met het coderen van lettertypen in PDF's die u maakt

Sluit altijd lettertypen in wanneer u PDF's maakt. Deze enkele instelling voorkomt de overgrote meerderheid van de problemen met wartaalteksten. In elke applicatie die exporteert naar PDF, Word, InDesign, Illustrator, PowerPoint is er een optie om lettertypen in te sluiten. Vind het. Schakel het in. De resulterende PDF zal iets groter zijn, doorgaans 50 KB tot 200 KB per lettertype, maar zal correct worden weergegeven op elk systeem in elke viewer, nu en in de toekomst.

Gebruik standaardcoderingen. Vermijd aangepaste tekencoderingen, tenzij u een specifieke reden heeft en u de implicaties begrijpt. De standaard PDF-codering, WinAnsiEncoding voor Latijnse scripts en Identity-H voor Unicode, wordt door elke PDF-viewer begrepen. Aangepaste coderingen kunnen worden begrepen door de software die ze heeft gemaakt en door niets anders. Een standaardcodering met ingebedde lettertypen is de meest draagbare en betrouwbare combinatie voor PDF-tekst die op alle platforms en in de loop van de tijd leesbaar blijft.

Als u wartaal tegenkomt in een PDF die is gemaakt door een oudere of gespecialiseerde toepassing, zoals een mainframerapportgenerator, een oud boekhoudsysteem of een uitvoermodule voor wetenschappelijke instrumenten, ligt het coderingsprobleem mogelijk in de karaktertoewijzingstabel van de PDF en niet in ontbrekende lettertypen. Deze systemen produceren soms PDF's waarin de tekst wordt opgeslagen met behulp van een aangepaste symboolcodering die tekencodes toewijst aan glyph-posities in een lettertype in plaats van aan Unicode-waarden. Wanneer een moderne kijker de tekst als Unicode probeert te extraheren, mislukt de mapping en ontstaat er wartaal. De oplossing voor deze bestanden is het gebruik van een PDF-reparatietool die niet-standaard coderingen kan detecteren en deze kan vervangen door standaard Unicode-toewijzingen, of de tekst kan extraheren als onbewerkte tekencodes en de codering opnieuw kan opbouwen op basis van de lettertypegegevens. Dit is een gespecialiseerde reparatieoperatie die verder gaat dan wat algemene PDF-tools aankunnen, en er is doorgaans een tool voor nodig met expliciete ondersteuning voor reparatie van verouderde codering.

WukongPDF

Probeer PDF repareren

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →