U opent een PDF, selecteert een alinea met tekst, drukt op delete, typt nieuwe tekst in de plaats en slaat het bestand op. De nieuwe tekst verschijnt op het scherm. U verzendt het document. De ontvanger zoekt in de PDF naar een term die alleen in de oude tekst voorkwam, en de zoekopdracht vindt deze term. De oude tekst die u dacht te hebben verwijderd, staat nog steeds in het bestand, verborgen achter de nieuwe tekst, onzichtbaar op het scherm maar volledig aanwezig in de documentgegevens. Deze verontrustende ervaring onthult een fundamentele waarheid over het bewerken van PDF's: wat je ziet is niet alles wat er is.
De PDF Editor-tools die beschikbaar zijn in browsers en standaard desktopapplicaties voegen doorgaans inhoud toe aan een PDF in plaats van deze daadwerkelijk te vervangen. Wanneer u een alinea verwijdert en nieuwe tekst typt, tekent de editor een witte rechthoek over de oude tekst en wordt er nieuwe tekst bovenop geplaatst. De oude tekst blijft in de bestandsgegevenslaag staan. Iedereen die de tekst extraheert, het document doorzoekt of naar een andere indeling converteert, kan herstellen waarvan u dacht dat het was verwijderd.

Hoe PDF-bewerking feitelijk werkt: overlay, geen vervanging
PDF-bestanden zijn niet ontworpen om te worden bewerkt. Het formaat is gemaakt als definitief uitvoerformaat, het digitale equivalent van een gedrukte pagina. Wanneer een PDF-editor een document wijzigt, worden de originele tekstobjecten niet herschreven. Het voegt nieuwe objecten toe die over de oude heen tekenen. De originele tekstobjecten blijven in het bestand staan, omdat het verwijderen ervan de pagina-inhoudsstroom opnieuw moet opbouwen, wat een aanzienlijk complexere bewerking is dan het toevoegen van een overlay.
Deze overlay-aanpak heeft belangrijke gevolgen voor de documentbeveiliging en de integriteit van het PDF-formaat. De documentgrootte groeit bij elke bewerking, omdat oude inhoud nooit wordt verwijderd, maar alleen wordt afgedekt. Een PDF die tien keer is bewerkt, bevat de originele inhoud plus negen bewerkingslagen. De bestandsgrootte neemt bij elke revisie toe, ook al blijven het zichtbare aantal pagina's en de schijnbare inhoud hetzelfde.
Bij de overlay-aanpak wordt bewerkingskwaliteit ingewisseld voor bewerkingssnelheid, en de afweging is onzichtbaar totdat de verborgen inhoud weer boven water komt.
Het overlay-probleem is het meest acuut bij tekstbewerking. Een editor kan een witte rechthoek tekenen om oude tekst te verbergen en nieuwe tekst in een afzonderlijk tekstobject te plaatsen. De witte rechthoek bedekt de oude tekst visueel, maar de oude tekst bevindt zich nog steeds in de tekstlaag. Een schermlezer leest zowel de oude als de nieuwe tekst. Een zoekopdracht vindt beide. Een tekstextractietool krijgt beide. De bewerking was cosmetisch.
Een goed geïmplementeerde redactietool PDF Editor verwijdert inhoud uit de tekstlaag. Het algemene tekstbewerkingshulpmiddel in dezelfde toepassing is dit mogelijk niet. Gebruikers verwachten redelijkerwijs dat verwijderen verwijderen betekent, maar het PDF-formaat maakt verwijderen moeilijker dan toevoegen, en veel editors kiezen de gemakkelijkere weg.
Probeer PDF bewerken
Geen installatie nodig. Werkt rechtstreeks in uw browser.
Wanneer oude tekst opnieuw kan verschijnen
Oude tekst die verborgen is door overlays kan in verschillende veelvoorkomende scenario's opnieuw verschijnen. Als u de PDF naar een ander formaat converteert, zoals Word of platte tekst, wordt alle tekst uit het document gehaald, inclusief de verborgen oude tekst. De conversietool leest de PDF-tekstlaag rechtstreeks en ziet de witte overlay-rechthoeken niet, omdat dit visuele elementen zijn en geen tekstinhoud.
Als u de PDF in een andere viewer opent, kan verborgen tekst zichtbaar worden. Een kijker die de pagina anders weergeeft, plaatst de witte overlay-rechthoek mogelijk op de verkeerde positie, of geeft deze mogelijk helemaal niet weer, waardoor de oude tekst zichtbaar wordt. Browsergebaseerde viewers, mobiele PDF-apps en oudere desktopviewers hebben elk hun eigen weergavekenmerken die van invloed kunnen zijn op de positionering van de overlay.
Als u de functie Zoeken gebruikt om in het document te zoeken, wordt in de tekstlaag gezocht, niet in de visuele laag. Een zoekopdracht naar een woord dat in de verwijderde tekst voorkomt, zal het vinden, ook al is het woord niet zichtbaar op het scherm. Zo ontdekken ontvangers dat zogenaamd verwijderde inhoud nog steeds in het bestand aanwezig is.
Schermlezers en toegankelijkheidstools lezen de tekstlaag. Een visueel gehandicapte gebruiker die afhankelijk is van een schermlezer, hoort zowel de huidige tekst als de verwijderde tekst, vaak zonder enige indicatie dat een deel van wat hij hoort verborgen zou moeten zijn. De PDF Metadata en structuur kunnen ook sporen van eerdere bewerkingen in de documentwijzigingsgeschiedenis bevatten.
Hoe u kunt verifiëren dat verwijderde tekst echt verdwenen is
Controleer na het bewerken van een PDF of de verwijderde tekst daadwerkelijk is verwijderd door een tekstextractie uit te voeren op het bewerkte bestand. Kopieer alle tekst uit de PDF met Ctrl+A en plak deze in een teksteditor. Zoek in de geplakte tekst naar zinnen die u heeft verwijderd. Als de zinnen verschijnen, was de verwijdering cosmetisch. U kunt de bewerkte PDF ook converteren naar een tekstbestand zonder opmaak en daar naar de verwijderde inhoud zoeken.
Een tweede verificatiemethode maakt gebruik van de PDF Find-functie. Zoek naar een onderscheidend woord of zin uit de verwijderde tekst. Als het gereedschap Zoeken deze vindt, bevindt de tekst zich nog steeds in de documentgegevenslaag. Het zoekhulpmiddel in de meeste PDF-lezers doorzoekt de tekstinhoud rechtstreeks en wordt niet beïnvloed door visuele overlays.
Gebruik voor gevoelige documenten een speciale redactietool in plaats van een algemene bewerkingstool om inhoud te verwijderen. Redactietools zijn ontworpen om tekst uit de gegevenslaag te verwijderen en niet alleen visueel af te dekken. Het verschil tussen bewerken en redigeren is het verschil tussen inhoud verbergen en verwijderen.
Hoe u tekst op de juiste manier uit een PDF verwijdert
WukongPDF biedt redactiehulpmiddelen en algemene bewerkingshulpmiddelen. Wanneer u inhoud permanent uit een PDF wilt verwijderen, gebruikt u de redactiefunctie en niet de tekstbewerkingsfunctie. Bij redactie wordt tekst uit de gegevenslaag verwijderd en op zijn plaats een zwarte markering of witte ruimte geplaatst. Bij daaropvolgende tekstextractie, zoeken en conversie wordt de geredigeerde inhoud niet gevonden, omdat deze niet langer in het bestand voorkomt.
Als u al een PDF hebt bewerkt en er zeker van wilt zijn dat de oude tekst niet kan worden hersteld, is de veiligste aanpak het afdrukken van de PDF naar een nieuwe PDF. Het afdrukproces geeft elke pagina weer als een afbeeldingachtige weergave, waarbij alle verborgen tekstlagen en overlays worden verwijderd. De uitvoer-PDF bevat alleen wat zichtbaar is op de pagina. Het nadeel is dat de nieuwe PDF de doorzoekbaarheid van tekst, koppelingen en andere interactieve functies verliest.
Een andere benadering is om alleen de zichtbare tekstlagen te extraheren en daarvan een nieuwe PDF te maken, waarbij verborgen inhoud wordt weggegooid. Hiervoor is een tool nodig die onderscheid kan maken tussen zichtbare en verborgen tekstobjecten en selectief alleen de zichtbare tekstobjecten kan exporteren. De resulterende PDF is schoon en bevat alleen de beoogde inhoud.
Voorkomen dat onbedoelde inhoud wordt vastgehouden
Wanneer u PDF's bewerkt die extern worden gedeeld, moet u een workflow opzetten die een stap voor inhoudsverificatie omvat. Voer na het bewerken een tekstextractie uit en zoek naar inhoud die verwijderd had moeten worden. Voor documenten met juridische, financiële of persoonlijke gegevens moet deze verificatiestap verplicht zijn voordat het bestand uw controle verlaat.
Overweeg het gebruik van andere formaten dan PDF voor documenten die uitgebreide bewerking vereisen. Bewerk het document in het oorspronkelijke formaat, Word, Google Docs, InDesign, en exporteer een nieuwe PDF wanneer de inhoud definitief is. Een nieuwe export uit het brondocument bevat geen bewerkingsgeschiedenis en geen verborgen inhoud. De PDF dient het beoogde doel als uiteindelijk uitvoerformaat, niet als bewerkingsplan.
Het probleem beperkt zich niet tot tekst. Afbeeldingen die met een basiseditor uit een PDF zijn verwijderd, kunnen ook in de bestandsgegevens blijven staan. De editor tekent een witte rechthoek over de oude afbeelding en plaatst de nieuwe afbeelding erbovenop. De originele afbeeldingsgegevens zijn nog steeds ingesloten in de PDF, waardoor de bestandsgrootte groter wordt en ze uittrekbaar blijven voor iedereen die het bestand opent met een tool die alle ingesloten objecten kan opsommen.
Het bewaren van gevoelige informatie in PDF's is een gedocumenteerd beveiligingsrisico. In 2023 heeft het Australian Signals Directorate richtlijnen uitgegeven waarin werd gewaarschuwd dat PDF-redactie uitgevoerd met niet-gespecialiseerde tools de geredigeerde inhoud herstelbaar zou kunnen maken. In de richtlijnen werd specifiek opgemerkt dat het tekenen van zwarte kaders over tekst of afbeeldingen de onderliggende gegevens niet verwijdert en dat geconverteerde documenten de zogenaamd verwijderde inhoud bloot kunnen leggen.
De veiligste manier om een bewerkte PDF te delen die geen sporen van eerdere inhoud mag bevatten, is door de PDF uitsluitend op basis van de zichtbare inhoud opnieuw op te bouwen. Druk het bewerkte document af naar een nieuwe PDF met behulp van een PDF-printerstuurprogramma. Dit proces geeft elke pagina weer zoals deze op het scherm verschijnt en schrijft alleen de zichtbare inhoud naar het nieuwe bestand. Verborgen tekst, verwijderde afbeeldingen en bewerkingsgeschiedenis worden allemaal verwijderd omdat ze geen deel uitmaken van het weergegeven uiterlijk van de pagina.
Voor organisaties die documenten verwerken die onderworpen zijn aan wettelijke openbaarmaking of verzoeken om vrijheid van informatie, is het begrijpen van het verschil tussen bewerken en redigeren essentieel. Een document dat is geproduceerd als reactie op een openbaarmakingsverzoek en dat verborgen maar herstelbare tekst bevat, kan ernstige juridische gevolgen hebben. Rechtbanken en toezichthouders behandelen verborgen inhoud als openbaar gemaakte inhoud, ongeacht of deze zichtbaar was op de pagina.
De veiligste bewerkingsworkflow voor PDF's die gevoelige of vertrouwelijke informatie bevatten, is het bewerken van het brondocument, en niet de PDF. Breng wijzigingen aan in het originele Word-bestand, Google Doc of ontwerpbestand en exporteer een nieuwe PDF vanuit de bewerkte bron. Een nieuwe export bevat geen verborgen inhoud, geen bewerkingsgeschiedenis en geen resterende gegevens uit eerdere versies die door een bepaalde ontvanger kunnen worden hersteld.
| Scenario | Hoe verborgen tekst zichtbaar wordt | Risiconiveau |
|---|---|---|
| PDF naar Word-conversie | Converter extraheert alle tekst uit de gegevenslaag | Hoog: alle verborgen tekst wordt zichtbaar |
| Zoeken binnen PDF | Zoekfunctie zoekt naar tekststroom, niet naar visuele laag | Medium: onthult het bestaan van verborgen tekst |
| Toegang tot schermlezer | Leest de tekstlaag rechtstreeks en negeert overlays | Hoog: leest oude en nieuwe tekst samen |
| Verschillende PDF-viewer | Alternatieve viewer geeft de overlay mogelijk niet correct weer | Medium: inconsistent voor alle kijkers |
| Tekstextractie / kopiëren en plakken | Alles selecteren legt alle tekst in de gegevenslaag vast | Hoog: verborgen tekst verschijnt in de plakbuffer |
Probeer PDF bewerken
Geen installatie nodig. Werkt rechtstreeks in uw browser.
