Een PDF die onleesbare tekst, willekeurige symbolen, rijen lege vierkanten of reeksen betekenisloze tekens weergeeft, kan eruit zien als een beschadigd bestand dat praktisch niet meer te herstellen is. Het document wordt geopend zonder foutmeldingen, het aantal pagina's lijkt correct en alle afbeeldingen of grafische afbeeldingen worden normaal weergegeven, maar de woorden zelf zijn vervangen door iets volkomen onleesbaars. Dit patroon duidt doorgaans op een probleem met de codering van lettertypen en niet op structurele bestandscorruptie. Dat is goed nieuws omdat problemen met lettertypen vaak kunnen worden opgelost zonder gespecialiseerde tools voor gegevensherstel of forensische bestandsreparatieservices. De onderliggende inhoud is mogelijk nog steeds aanwezig in het bestand, gecodeerd op een manier die de PDF-viewer niet kan interpreteren vanwege ontbrekende of niet-overeenkomende lettertypegegevens.

Diagnose van lettertypecodering versus echte bestandscorruptie
De eerste diagnostische stap is bepalen of het probleem zijn oorsprong vindt in de lettertypecodering of in de PDF-bestandsstructuur zelf. Een probleem met de codering van lettertypen zorgt voor systematische, consistente verminkingen in het hele document. Elke letter A kan een hol vierkant worden, of alle tekst verschijnt consequent als tekens met willekeurige accenten uit een ander alfabet, maar het patroon herhaalt zich voorspelbaar. Echte bestandscorruptie leidt tot inconsistent gedrag: pagina's die helemaal niet worden weergegeven, foutmeldingen bij een poging het bestand te openen, of gedeelten van het document die geheel leeg zijn terwijl andere gedeelten correct worden weergegeven. Pagina's die afbeeldingen perfect weergeven maar onleesbare tekst tonen, wijzen eerder op lettertypeproblemen dan op structurele schade.
Open de pdf in minimaal twee verschillende viewers om de diagnose te bevestigen. Als het bestand correct wordt weergegeven in Adobe Acrobat Reader, maar niet in een browsergebaseerde viewer zoals Chrome of Edge, ondersteunt de browserviewer hoogstwaarschijnlijk niet het specifieke ingesloten lettertypeformaat dat in de PDF wordt gebruikt. Als het bestand correct wordt weergegeven in Chrome, maar niet in Preview op de Mac, heeft Preview mogelijk geen ondersteuning voor een bepaald lettertypecoderingsschema. Als het bestand vervormde tekst weergeeft in elke viewer die op verschillende besturingssystemen is getest, zijn de lettertypegegevens in de PDF zelf beschadigd of ontbreken ze, en is een Repair PDF-bewerking nodig die de lettertypebronnen adresseert.
Probeer PDF repareren
Geen installatie nodig. Werkt rechtstreeks in uw browser.
Ontbrekende of beschadigde lettertypen opnieuw insluiten
Wanneer een PDF verwijst naar een lettertype dat niet in het bestand is ingesloten en niet op het weergavesysteem is geïnstalleerd, wordt de PDF-viewer gedwongen een ander lettertype te vervangen dat wel beschikbaar is. Door deze vervanging worden tekens vaak verkeerd uitgelijnd, omdat het vervangende lettertype andere tekenbreedtes, spatiëringsgegevens en glyph-posities heeft dan het originele lettertype. De tekst ziet eruit als door elkaar gegooide of willekeurige symbolen, omdat de tekencodes die in de PDF zijn opgeslagen, verwijzen naar totaal andere glyphs in het vervangende lettertype dan degene die de auteur van het document bedoelde. De oplossing is om de juiste lettertypen opnieuw in de PDF in te sluiten, zodat de kijker niet langer hoeft te raden.
Open de PDF in een tool die lettertypebronnen op documentniveau kan inspecteren en wijzigen. Controleer de lettertype-inventaris om te zien naar welke lettertypen het document verwijst en of elk lettertype volledig is ingesloten, gedeeltelijk is ingesloten als een subset die alleen de gebruikte tekens bevat, of wordt weergegeven als helemaal niet ingesloten. Als een lettertype wordt weergegeven als niet ingesloten, moet u dat exacte lettertype op uw systeem installeren en de PDF opnieuw opslaan met de optie Alle lettertypen insluiten ingeschakeld, of een PDF Fix PDF-tool gebruiken die de vereiste lettertypegegevens uit zijn eigen gelicentieerde lettertypebibliotheek kan lokaliseren en insluiten. Veelgebruikte systeemlettertypen zoals Arial, Times New Roman, Helvetica en Courier zijn beschikbaar in de meeste lettertypebibliotheken en kunnen zonder licentiebeperkingen worden ingesloten.
De Print-to-PDF-techniek gebruiken voor snel herstel
Als de onleesbare tekst wordt veroorzaakt door een lettertypecodering die door de ene viewer correct wordt afgehandeld en door andere niet, wordt met de snelste praktische oplossing gebruik gemaakt van die ene werkende viewer. Open de PDF in de viewer die de tekst correct op het scherm weergeeft. Druk op Ctrl-P of Command-P om het afdrukvenster te openen en kies Microsoft Afdrukken naar PDF of Opslaan als PDF als de doelprinter. De printpijplijn rastert of hercodeert de tekst zoals deze op het scherm verschijnt en sluit deze in een gloednieuwe PDF in met behulp van standaard, universeel ondersteunde lettertypen en codering die elke moderne PDF-viewer begrijpt zonder dat speciale lettertypebehandeling vereist is.
Deze methode levert een Repair PDF-kopie op met duidelijke, leesbare tekst die overal consistent wordt weergegeven, maar er is een belangrijke afweging die u moet begrijpen voordat u zich daaraan vastlegt. De afgedrukte PDF verliest doorgaans de selecteerbaarheid van tekst, doorzoekbaarheid en eventuele interactieve formulierelementen. De tekst wordt effectief onderdeel van de paginaafbeelding. Voor een document dat slechts op het scherm hoeft te worden gelezen en misschien één keer moet worden afgedrukt, is dit een prima aanvaardbare oplossing die slechts enkele seconden in beslag neemt. Voor een document dat na de reparatie doorzoekbaar, selecteerbaar of bewerkbaar moet blijven, probeert u eerst de aanpak voor het insluiten van lettertypen en reserveert u afdrukken naar PDF als reserve.
De PDF converteren via een tussenformaat
Wanneer het insluiten van lettertypen het probleem niet oplost en print-to-PDF te veel documentfunctionaliteit verliest, kan het converteren van de PDF via een tussenformaat de defecte codering verwijderen terwijl de tekst als daadwerkelijke tekst behouden blijft. Exporteer de PDF naar een Word-document met behulp van een PDF-naar-Word-converter. Het conversieproces leest de PDF-inhoudsstroom en voert de herkende tekst uit in een nieuw formaat dat gebruikmaakt van Word's eigen lettertypeverwerking en -codering, volledig onafhankelijk van wat er in de originele PDF is beschadigd. Open het resulterende Word-bestand, controleer of de tekst overal correct wordt gelezen, breng eventuele kleine opmaakcorrecties aan en exporteer het vervolgens terug naar PDF met het insluiten van lettertypen ingeschakeld.
De rondreis door Word vervangt de kapotte codering door een schone, aan de standaarden voldoende codering, maar complexe lay-outs met meerdere kolommen, nauwkeurige positionering of ingebedde vectorafbeeldingen overleven de conversie mogelijk niet perfect. In de onderstaande tabel worden de drie reparatiebenaderingen vergeleken met de factoren die van belang zijn bij het kiezen van de toe te passen methode:
| Methode | Tekst selecteerbaar | Indeling behouden | Snelheid |
|---|---|---|---|
| Lettertypen opnieuw insluiten | Ja | Ja | Gematigd |
| Afdrukken naar PDF | Nee | Ja | Snel |
| PDF naar Word naar PDF | Ja | Gedeeltelijk | Langzaam |
Omgaan met problemen met Unicode- en CID-lettertypecodering
PDF's die zijn gemaakt in niet-Latijnse schriften, zoals Chinees, Japans, Koreaans, Arabisch of Cyrillisch, geven soms verminkte tekst weer, vooral wanneer het lettertype CID-codering (Character Identifier) gebruikt en de kijker de numerieke CID's niet kan terugverwijzen naar de overeenkomstige Unicode-tekens. Dit komt vaak voor bij oudere PDF's die zijn geproduceerd door scansoftware of oudere publicatiesystemen waarin lettertypen zijn ingesloten met behulp van pre-Unicode-coderingstabellen die zijn ontworpen voordat Unicode de universele standaard werd. Een PDF van een Japanse scanner uit 2005 kan bijvoorbeeld een CID-lettertype gebruiken dat moderne kijkers niet kunnen interpreteren zonder het originele, leverancierspecifieke CMAP-bestand.
Gespecialiseerde PDF Fix PDF-tools die expliciet CID-naar-Unicode-toewijzing ondersteunen, kunnen de juiste tekenassociaties reconstrueren. Deze tools lezen de onbewerkte CID-codes uit de lettertypegegevens en de ingebedde CMAP-tabel, indien aanwezig, om de Unicode-toewijzing opnieuw op te bouwen. Het proces is geautomatiseerd in tools die zijn ontworpen voor het repareren van PDF-lettertypen, waarbij u alleen het bestand hoeft te uploaden en de gecorrigeerde versie moet downloaden. Voor PDF's die Oost-Aziatische talen bevatten, kiest u een reparatieprogramma dat expliciet ondersteuning voor CJK-lettertypen in de functieset vermeldt, aangezien generieke lettertypereparatieprogramma's die voornamelijk voor Latijnse scripts zijn ontworpen, mogelijk niet de CMAP-gegevens of de glyph-herkenningsmodellen voor deze schrijfsystemen bevatten.
Voorkom onleesbare tekst in PDF's die u maakt
Als u regelmatig PDF's maakt die bij de ontvangers aankomen met onleesbare tekst, is de hoofdoorzaak bijna altijd de instellingen voor het insluiten van lettertypen in de software die de PDF genereert. Wanneer u exporteert vanuit Word, PowerPoint, InDesign of een ontwerptool, zoekt u het dialoogvenster PDF-export- of opslagopties op en vinkt u het selectievakje Lettertypen insluiten of Alle lettertypen insluiten aan. Sommige toepassingen bieden een extra selectievakje voor het insluiten van alleen de tekens die in het document worden gebruikt, waardoor een kleiner bestand ontstaat door lettertypen in te delen, maar weergaveproblemen kan veroorzaken als de PDF later wordt bewerkt of samengevoegd met andere inhoud. Voor maximale platformonafhankelijke compatibiliteit sluit u het volledige lettertype in in plaats van een subset wanneer de toename van de bestandsgrootte acceptabel is.
Platforms zoals WukongPDF verwerken de conversie van PDF Format met uitgebreide lettertype-insluiting standaard ingeschakeld, waardoor de coderingsproblemen worden vermeden die voortkomen uit systeemspecifieke lettertype-afhankelijkheden die alleen werken op de computer van de maker. Bij het verzenden van een PDF die correct moet worden weergegeven op verschillende besturingssystemen, apparaten en viewertoepassingen, bestaat een snelle validatietest uit het openen van het bestand in een browsergebaseerde PDF-viewer, aangezien deze viewers geen toegang hebben tot lokaal geïnstalleerde systeemlettertypen en eventuele problemen met het insluiten van lettertypen onmiddellijk aan het licht zullen brengen die anders onopgemerkt zouden blijven totdat een ontvanger onleesbare tekst rapporteert.
Wanneer moet u accepteren dat een PDF niet kan worden gerepareerd
Ondanks de beste reparatietechnieken hebben sommige PDF's schade opgelopen die niet meer te herstellen is. Als u hebt geprobeerd lettertypen opnieuw in te sluiten, vanuit elke beschikbare viewer naar een nieuwe PDF af te drukken en de retourconversie via Word uit te voeren, en de tekst blijft onleesbaar, dan heeft het bestand mogelijk structurele schade in de inhoudsstroom zelf en niet alleen maar een probleem met de lettertypecodering. Op dit punt is de meest productieve cursus meestal het lokaliseren van het originele brondocument en het genereren van een nieuwe PDF ervan.
Bewaar het beschadigde bestand ter referentie, aangezien afbeeldingen en paginastructuur nog gedeeltelijk intact kunnen zijn, zelfs als de tekst niet kan worden hersteld. Als het document afkomstig is van een scanner, levert het opnieuw scannen van het originele papieren document een schone PDF op met de juiste tekstcodering. Als het document is gemaakt op basis van een Word-bestand of een ontwerptoepassing, vraag dan de oorspronkelijke auteur om het opnieuw te exporteren, waarbij het insluiten van lettertypen expliciet is ingeschakeld. Een nieuwe export van het brondocument omzeilt alle coderingsproblemen die aanwezig zijn in de beschadigde kopie en produceert een schoon bestand in minder tijd dan verdere reparaties.
Probeer PDF repareren
Geen installatie nodig. Werkt rechtstreeks in uw browser.
