Others

Waarom kan ik de tekst in mijn PDF niet bewerken?

Why Cannot I Edit Text in My PDF

Waarom een pdf die op tekst lijkt, niet bewerkbaar kan zijn

U opent een pdf, ziet woorden op het scherm en gaat ervan uit dat u ze kunt bewerken. Wanneer u op de tekst klikt en er gebeurt niets, of wanneer u probeert te typen en de cursor niet verschijnt, ontdekt u dat de PDF die op een tekstdocument lijkt, eigenlijk helemaal geen bewerkbaar document is. Deze ervaring komt frustrerend vaak voor omdat PDF's tekst in fundamenteel verschillende vormen kunnen bevatten, waarvan slechts enkele bewerkbaar zijn.

Door OCR uit te voeren op een gescande PDF wordt achter elke paginaafbeelding in het document een doorzoekbare en bewerkbare tekstlaag toegevoegd.

De conversie van PDF naar een bewerkbaar formaat en terug is een betrouwbare terugval wanneer directe bewerking niet mogelijk is.

Een PDF-editor kan tekst wijzigen die als daadwerkelijke tekstobjecten in de PDF bestaat, waarbij elk teken wordt weergegeven als een selecteerbare, aanpasbare tekencode. Dit wordt native of live tekst genoemd. Een PDF-formaat kan ook tekst bevatten die alleen als afbeelding bestaat, zoals een gescand document waarbij de tekst deel uitmaakt van de paginafoto. Op afbeeldingen gebaseerde tekst kan niet worden geselecteerd, doorzocht of bewerkt omdat de PDF geen tekengegevens bevat, maar alleen pixels die toevallig de vorm van letters vormen. Voordat u weet of een PDF bewerkbaar is, moet u weten welk type tekst deze bevat.

De snelste test is om te proberen tekst in de PDF te selecteren. Klik en sleep over een woord. Als de tekst tijdens het slepen oplicht, is het oorspronkelijke tekst en kan deze mogelijk worden bewerkt. Als er niets wordt gemarkeerd en de cursor niet verandert, is de tekst op afbeeldingen gebaseerd en kan deze niet rechtstreeks worden bewerkt. Als de tekst oplicht maar de markering vlekkerig is, waarbij sommige woorden worden geselecteerd maar andere worden overgeslagen, bevat de PDF een mix van oorspronkelijke tekst en tekst die alleen als visuele elementen bestaat, een veel voorkomende situatie bij PDF's die zijn gemaakt met oudere software of door meerdere brondocumenten te combineren.

WukongPDF

Probeer PDF bewerken

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →

Veelvoorkomende redenen waarom uw PDF-tekst niet kan worden bewerkt

De meest voorkomende reden is dat de PDF een gescand document is. Een PDF die is gemaakt door papieren pagina's te scannen met een flatbedscanner of een telefooncamera-app bevat afbeeldingen van tekst, geen echte teksttekens. Hoewel u de woorden op het scherm kunt lezen, bevat het PDF-bestand geen bewerkbare tekstgegevens. Om een gescande PDF bewerkbaar te maken, moet u eerst OCR uitvoeren om de tekst in de afbeeldingen te herkennen en een onzichtbare tekstlaag achter elke paginaafbeelding te creëren. Na OCR wordt de tekst doorzoekbaar en, in veel PDF-editors, bewerkbaar alsof het oorspronkelijke tekst is.

Wachtwoord- of toestemmingsbeperkingen zijn een andere veelvoorkomende barrière bij het bewerken. Een PDF die is beveiligd met een machtigingswachtwoord kan worden geopend en bekeken, maar de machtigingen kunnen bewerken, kopiëren of afdrukken blokkeren. Als u de PDF kunt openen en de tekst kunt zien, maar de bewerkingshulpmiddelen zijn grijs of geven een foutmelding, controleer dan de beveiligingsinstellingen van het document. In de meeste PDF-viewers wordt in het paneel Documenteigenschappen of Beveiliging weergegeven welke machtigingen beperkt zijn. Als bewerken beperkt is en u over het machtigingswachtwoord beschikt, kunt u de beperkingen opheffen en bewerken inschakelen.

De PDF kan tekst bevatten die tijdens het maken is omgezet naar contouren of curven. Grafische ontwerpers converteren tekst soms naar contouren in toepassingen zoals Adobe Illustrator voordat ze een PDF maken om ervoor te zorgen dat lettertypen correct worden weergegeven, ongeacht of de ontvanger deze lettertypen heeft geïnstalleerd. Tekst die naar contouren is geconverteerd, ziet er visueel identiek uit aan de oorspronkelijke tekst, maar bestaat uit vectorvormen in plaats van tekengegevens. Geen enkel gereedschap PDF bewerken] kan omlijnde tekst als tekst bewerken, omdat de tekeninformatie tijdens de conversie naar omtrekken is weggegooid.

Problemen met de codering van lettertypen kunnen ervoor zorgen dat tekst niet kan worden bewerkt, zelfs als de PDF oorspronkelijke teksttekens bevat. Sommige PDF's gebruiken aangepaste lettertypecoderingen die tekencodes op niet-standaard manieren aan glyphs toewijzen. Het bewerkingshulpmiddel ziet de tekencodes, maar kan niet bepalen welke tekens ze vertegenwoordigen, dus weigert het deze te bewerken om te voorkomen dat de tekst beschadigd raakt. Dit probleem komt het meest voor bij PDF's die zijn gegenereerd door gespecialiseerde software, oudere systemen of documenten die niet-Latijnse scripts gebruiken met aangepaste lettertypeverwerking. Door de PDF opnieuw te exporteren vanuit de oorspronkelijke toepassing terwijl het insluiten van lettertypen is ingeschakeld, wordt het coderingsprobleem vaak opgelost.

Een gescande PDF bewerkbaar maken met OCR

Optische tekenherkenning is het proces dat afbeeldingen van tekst omzet in daadwerkelijk bewerkbare tekst. Moderne OCR-technologie is zeer nauwkeurig voor schone, goed belichte scans van afgedrukte tekst in gangbare lettertypen en standaardformaten. Door OCR uit te voeren op een gescande PDF wordt achter elke paginaafbeelding een verborgen tekstlaag toegevoegd die de herkende tekens bevat. Nadat de OCR is voltooid, kunt u naar tekst in het document zoeken en, in de meeste PDF-editors, de herkende tekst bewerken alsof deze oorspronkelijk oorspronkelijk is.

De kwaliteit van de OCR-uitvoer is afhankelijk van de kwaliteit van de gescande afbeeldingen. Een scan met hoge resolutie bij 300 DPI met gelijkmatige belichting, vlakke pagina's en scherpe focus produceert een OCR-nauwkeurigheid van meer dan 99 procent voor standaard afgedrukte tekst. Een scan met een lage resolutie van 150 DPI met schaduwen, gebogen pagina's uit een ingebonden boek of onscherpe gebieden levert een lagere nauwkeurigheid op en vereist meer handmatige correctie na OCR. Het scannen van documenten met OCR in gedachten, dat wil zeggen platte pagina's, goede verlichting en voldoende resolutie, maakt het bewerkingsproces aanzienlijk soepeler.

De meeste PDF-editors die OCR ondersteunen, omvatten taalselectie als onderdeel van de herkenningsinstellingen. Het selecteren van de juiste taal verbetert de nauwkeurigheid omdat de OCR-engine taalspecifieke woordenboeken en tekenfrequentiegegevens gebruikt om dubbelzinnige tekens op te lossen. Een document in het Frans dat wordt herkend met de Franse taalinstelling levert betere resultaten op dan hetzelfde document dat wordt herkend met de Engelse instelling. Voor meertalige documenten selecteert u de primaire taal en corrigeert u eventuele fouten in passages van de secundaire taal handmatig.

De OCR PDF-tool van WukongPDF verwerkt gescande documenten in de browser en retourneert een PDF met een doorzoekbare, bewerkbare tekstlaag. De OCR-engine ondersteunt meerdere talen en verwerkt veelgebruikte documenttypen, waaronder brieven, formulieren, kwitanties en artikelen. Na OCR wordt de voorheen niet-bewerkbare gescande PDF bewerkbaar, waarbij de herkende tekst beschikbaar is voor selectie, zoeken en wijzigen.

Alternatieve benaderingen wanneer directe PDF-bewerking niet mogelijk is

Wanneer een PDF niet direct bewerkbaar kan worden gemaakt, omdat het een gescand document is zonder toegang tot OCR of omdat er beveiligingsbeperkingen aan verbonden zijn die u niet kunt verwijderen, kunt u met alternatieve workflows hetzelfde resultaat bereiken via een ander pad. Converteer de PDF naar een bewerkbaar formaat zoals Word of Google Docs, breng uw wijzigingen aan in dat formaat en converteer het bewerkte document terug naar PDF. De heen- en terugreis door een bewerkbaar formaat duurt langer dan rechtstreeks bewerken, maar werkt voor elke PDF die kan worden geopend en bekeken.

Voor documenten die slechts kleine correcties nodig hebben, zoals het corrigeren van een typefout in een enkele alinea, is het gebruik van de annotatiehulpmiddelen van de PDF om de onjuiste tekst te bedekken met een witte rechthoek en het typen van de gecorrigeerde tekst erbovenop een pragmatische oplossing. Deze methode bewerkt niet echt de onderliggende tekst en de documentstructuur, dus de op annotaties gebaseerde correctie is onzichtbaar voor zoek- en toegankelijkheidstools, maar voor snelle visuele correcties op een document dat wordt afgedrukt of als afbeelding wordt bekeken, levert het acceptabele resultaten op.

Voor documenten die uitgebreide bewerking vereisen en die niet direct kunnen worden bewerkt, is de meest betrouwbare aanpak om terug te keren naar het originele brondocument, als dit beschikbaar is.

Het Word-document, Google Doc of InDesign-bestand dat is gebruikt om de PDF te maken, bevat bewerkbare tekst die kan worden gewijzigd en opnieuw kan worden geëxporteerd naar een nieuwe PDF. Contact opnemen met de maker van het document voor het bronbestand, of het bronbestand in uw eigen administratie opzoeken, is vaak sneller dan worstelen met het bewerken van een niet-coöperatieve PDF.

Bij sommige PDF's die oorspronkelijke tekst lijken te bevatten, is de tekst feitelijk opgeslagen op een manier die door bewerkingstools niet kan worden gewijzigd, ook al is de tekst doorzoekbaar en selecteerbaar. Deze situatie doet zich voor wanneer een PDF een correcte tekstlaag heeft, waardoor zoeken en selecteren mogelijk is, maar de onderliggende lettertypecodering verhindert dat het bewerkingshulpmiddel bewerkte tekens terugzet in de juiste visuele glyphs. Het bewerkingshulpmiddel kan de tekst lezen, maar kan geen wijzigingen terugschrijven naar het document zonder mogelijk de tekentoewijzing te beschadigen. Deze verdediging tegen bewerken is soms opzettelijk van de kant van de maker van het document.

De toename van het aantal PDF-bewerkingstools heeft het gemakkelijker dan ooit gemaakt om PDF's te bewerken, maar heeft ook verwarring gecreëerd over wat bewerken inhoudt. Het toevoegen van een tekstannotatie bovenop een PDF-pagina is niet hetzelfde als het bewerken van de onderliggende tekst. Het vervangen van een afbeelding op een PDF-pagina is niet hetzelfde als het bewerken van de tekst die de afbeelding beschrijft. Als u het verschil begrijpt tussen op annotaties gebaseerde wijzigingen, waarbij nieuwe inhoud over de bestaande pagina wordt gelegd, en echte tekstbewerking, waarbij de daadwerkelijke tekstinhoud binnen de PDF-structuur wordt gewijzigd, kunt u voor elke bewerkingstaak het juiste hulpmiddel en de juiste aanpak kiezen.

Voor documenten die bestand zijn tegen alle bewerkingspogingen en die informatie bevatten die van cruciaal belang is om te worden bijgewerkt, is de nucleaire optie om het document helemaal opnieuw te maken. Gebruik de PDF als visuele referentie en typ de inhoud opnieuw in een tekstverwerker of ontwerptoepassing, terwijl u de wijzigingen tijdens het recreatieproces aanbrengt. Deze aanpak is arbeidsintensief, maar levert een schoon, volledig bewerkbaar document op zonder resterende opmaakproblemen, lettertypeproblemen of conversieartefacten. Het opnieuw maken van een document uit een PDF kost tijd die evenredig is aan de lengte en complexiteit van het document, en voor korte documenten die aanzienlijke bewerkingen vereisen, kan het zelfs sneller zijn dan het worstelen met niet-coöperatieve PDF-bewerkingstools.

WukongPDF

Probeer PDF bewerken

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →