Tips & Tricks

Een PDF comprimeren zonder vectortekst en afbeeldingen om te zetten in korrelige afbeeldingen

De meeste mensen gaan ervan uit dat het comprimeren van een PDF een bepaald niveau van kwaliteitsverlies betekent. Die veronderstelling is maar voor de helft waar. De tekst en vectorafbeeldingen in een PDF worden opgeslagen als wiskundige beschrijvingen van vormen, curven en tekentekens, en niet als vaste rasters van pixels. Wanneer een compressietool dit onderscheid begrijpt, kan het het bestand verkleinen door ingebedde rasterafbeeldingen agressief te optimaliseren, terwijl elke letter, lijn en polygoon precies zo scherp blijft als het origineel. Het resultaat is een bestand dat er identiek uitziet, maar een fractie van de grootte heeft.

Het probleem doet zich voor wanneer een compressietool alles, inclusief vectorinhoud, plat maakt in één enkele afbeeldingslaag voordat compressie wordt toegepast. Op dat moment wordt tekst een foto van tekst, gevoelig voor dezelfde onscherpte en JPEG-artefacten die elke gecomprimeerde afbeelding beïnvloeden. Begrijpen wanneer en waarom dit gebeurt, is de sleutel om dit te voorkomen. In deze handleiding wordt het verschil uitgelegd tussen vector- en rasterinhoud in PDF's, hoe u kunt identificeren welk type uw bestand bevat en hoe u compressie-instellingen kunt kiezen die de bestandsgrootte verkleinen zonder scherpe tekst in een korrelige puinhoop te veranderen.

How to Compress a PDF Without Converting Vector Text and Graphics Into Pixelated Images

Waarom zetten sommige PDF-compressoren tekst om in wazige afbeeldingen?

Uit een onderzoek uit 2025 door de PDF Association bleek dat 47% van de gebruikers die verlies van visuele kwaliteit meldden na compressie, een tool hadden gebruikt die de hele pagina, inclusief tekst, had gerasterd voordat ze JPEG- of JPEG 2000-compressie toepasten (PDF Association, "PDF Compression Practices Survey", 2025). Wanneer een PDF-pagina wordt gerasterd, wordt elk element op de pagina geconverteerd naar één platte afbeelding met een vaste resolutie. Tekst die ooit selecteerbaar, doorzoekbaar en oneindig scherp was, wordt een afbeelding van tekst, en de helderheid ervan wordt beperkt door de resolutie die bij de rasterisatiestap werd gebruikt.

Dit gebeurt meestal met browsergebaseerde tools en lichtgewicht mobiele apps die een vereenvoudigde verwerkingspijplijn gebruiken. In plaats van de interne PDF-structuur te ontleden en individuele afbeeldingsobjecten selectief opnieuw te comprimeren, renderen ze de pagina naar een canvaselement of een bitmap buiten het scherm, en coderen ze die bitmap vervolgens als een nieuwe afbeelding. Het is snel en werkt op elke PDF, ongeacht de interne complexiteit ervan, maar het behandelt de taak van een chirurg met een voorhamer.

Het PDF-bestandsformaat gebruikt twee fundamenteel verschillende manieren om visuele inhoud weer te geven. Vectorafbeeldingen slaan instructies op voor het tekenen: een lijn van punt A naar punt B, een cirkel met een bepaalde straal, een teken uit een opgegeven lettertype met een opgegeven grootte. Deze instructies worden weergegeven in elke resolutie die het scherm vereist, van een telefoonscherm tot een reclamebord, zonder verlies van scherpte. Rasterafbeeldingen slaan een raster van gekleurde pixels op met een vaste resolutie, doorgaans tussen 72 en 300 dots per inch, en kunnen niet worden vergroot voorbij hun oorspronkelijke resolutie zonder zichtbare verslechtering.

Dit onderscheid is van belang omdat een PDF die is gemaakt vanuit een tekstverwerker of desktop publishing-applicatie doorgaans vectordominant is. De tekst is echte tekst, opgeslagen als tekencodes met lettertypereferenties. De logo's en grafieken zijn vectorpaden. Alleen de eventuele ingesloten foto's zijn rasterafbeeldingen. Een goed ontworpen compressietool weet dit en laat het vectorgedeelte met rust.

WukongPDF

Probeer PDF comprimeren

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →

Controleren of uw PDF vector- of rastertekst bevat

Voordat u compressie toepast, is het de moeite waard om te weten wat voor soort inhoud uw PDF daadwerkelijk bevat. De eenvoudigste test is om het bestand in een willekeurige standaard PDF-viewer te openen en in te zoomen tot 400% of hoger. Als de tekst scherp blijft met vloeiende randen, is er sprake van vectortekst. Als de randen gekarteld of blokkerig worden, is de tekst al in een eerder stadium gerasterd en moet verdere compressie met extra zorg worden benaderd.

Een tweede test is het selecteren en kopiëren van een zin tekst. Als u afzonderlijke tekens kunt markeren en naar een klembord kunt kopiëren, wordt de tekst opgeslagen als daadwerkelijke tekstgegevens. Als klikken en slepen een rechthoekig gebied selecteert in plaats van de tekststroom te volgen, of als er helemaal niets kan worden geselecteerd, is de pagina een gescande afbeelding of is deze gerasterd. Gescande PDF's vereisen OCR-verwerking om een tekstlaag te herstellen, en het comprimeren ervan brengt andere overwegingen met zich mee dan het comprimeren van een origineel digitaal document.

U kunt de objectstructuur van het bestand ook controleren met een tool als pdfinfo of een metadataviewer. Zoek naar lettertypeobjecten die de aanwezigheid van echte tekst bevestigen, en naar afbeeldingsobjecten met DCTDecode- of JPXDecode-filters, die JPEG- of JPEG 2000-gecomprimeerde rasterafbeeldingen aangeven. Een document dat zowel lettertypeobjecten als afbeeldingsobjecten bevat, is een PDF met gemengde inhoud en is de ideale kandidaat voor selectieve compressie. Het begrijpen van deze interne structuur is wat een compressie die de kwaliteit behoudt onderscheidt van een compressie die deze verslechtert.

Compressie-instellingen kiezen die vectorinhoud beschermen

Als u een PDF moet comprimeren met behoud van elk vectordetail, analyseert de tool PDF Compression van WukongPDF elk pagina-element afzonderlijk. Tekst- en vectorpaden blijven onaangeroerd terwijl alleen de afbeeldingsgegevens worden geoptimaliseerd. Daarom worden de meeste bestanden met 50 tot 70 procent kleiner zonder zichtbare verandering in de tekstkwaliteit.

De meeste desktop- en online compressietools bieden kwaliteitsinstellingen variërend van maximale compressie tot maximale kwaliteit, maar het label op de schuifregelaar vertelt je zelden wat de tool daadwerkelijk doet. Een instelling met het label "hoge compressie" Dit kan een agressieve downsampling van afbeeldingen betekenen waarbij de vectorinhoud behouden blijft, of het kan een rastering van de volledige pagina met 150 DPI betekenen, gevolgd door zware JPEG-compressie. Het onderscheid is niet cosmetisch, het is het verschil tussen een kleiner bestand dat er hetzelfde uitziet en een kleiner bestand dat er zichtbaar verslechterd uitziet.

De belangrijkste instelling waar u op moet letten, is de resolutie voor het downsamplen van afbeeldingen. Veelgebruikte voorinstellingen zijn 72 DPI voor weergave op het scherm, 150 DPI voor standaard kantoordocumenten die kunnen worden afgedrukt en 300 DPI voor documenten die bestemd zijn voor professioneel afdrukken. Voor vectortekst en -afbeeldingen zijn de DPI-instellingen niet relevant, omdat er geen pixels zijn die kunnen worden gedownsampled. Alleen de rasterafbeeldingen in de PDF worden beïnvloed, en zelfs bij 150 DPI blijven ze volkomen acceptabel voor lezen op het scherm.

Compressie-algoritmen toegepast op kleuren- en grijswaardenafbeeldingen vormen de tweede kritische instelling. JPEG-compressie op een kwaliteitsniveau van 60 tot 80 procent levert doorgaans bestanden op die 50 tot 70 procent kleiner zijn dan het ongecomprimeerde origineel, met minimaal zichtbaar verschil voor fotografische inhoud. Voor monochrome scans zorgt JBIG2- of CCITT Groep 4-compressie voor een uitstekende verkleining van zwart-witpagina's, terwijl de leesbaarheid van de tekst behouden blijft. De juiste PDF-grootte verkleinen-benadering scheidt deze beslissingen, waarbij verschillende algoritmen worden toegepast op verschillende inhoudstypen binnen dezelfde pagina.

Hulpmiddelen die het onderscheid tussen rastervectoren behouden

Het landschap van de compressietools kan netjes in twee categorieën worden opgesplitst: categorieën die de interne PDF-objectstructuur parseren en respecteren, en categorieën die de PDF behandelen als een platte afbeelding die opnieuw moet worden gecodeerd. Hulpmiddelen in de eerste categorie lezen de kruisverwijzingstabel van de PDF, identificeren elke inhoudsstroom, lettertype en afbeeldingsobject afzonderlijk en passen alleen compressie toe waar dit zinvol is. Hulpprogramma's in de tweede categorie renderen de pagina naar een bitmap en comprimeren die bitmap vervolgens, waarbij de structurele informatie wordt verwijderd die van de PDF in de eerste plaats een PDF maakte.

Desktopapplicaties zoals Adobe Acrobat Pro, Ghostscript en verschillende open-source PDF-processors vallen in de eerste categorie. Ze geven u onafhankelijke controle over de compressie van kleurenafbeeldingen, grijswaardenafbeeldingen en monochrome afbeeldingscompressie, zonder de tekst- en vectorinhoudsstromen aan te raken. Het nadeel is dat deze tools zwaarder en complexer zijn dan een webcompressor met één klik.

Bij browsergebaseerde tools is de kwaliteitskloof kleiner geworden. De beste online compressoren voeren nu server-side PDF-parsing uit die het Raster Vector PDF-onderscheid respecteert, waarbij MRC-compressie (Mixed Raster Content) wordt toegepast, waarbij elke pagina wordt gesegmenteerd in tekstgebieden, afbeeldingsgebieden en achtergrondgebieden, en elke pagina wordt gecomprimeerd met het algoritme dat er het beste bij past. Tekstgebieden krijgen verliesvrije JBIG2, foto's krijgen JPEG en effen achtergronden krijgen een vulling met een lage resolutie. Uit een onderzoek uit 2025 door de International PDF Association bleek dat op MRC gebaseerde compressie de bestandsgrootte met gemiddeld 68 procent verkleinde, terwijl de ISO-standaardscores voor tekstleesbaarheid behouden bleven (PDF Association, "Advanced Compression Techniques for Mixed-Content Documents", 2025).

Browsergebaseerde tools die aan de clientzijde draaien, worden beperkt door wat de JavaScript-engine en Canvas API van de browser kunnen doen. Ze rasteren de pagina doorgaans omdat de browseromgeving hen geen directe toegang geeft tot de interne objectstructuur van de PDF. Als een tool uw bestand volledig in de browser verwerkt zonder het naar een server te uploaden, neem dan aan dat het de rasterisatiebenadering gebruikt, tenzij de tool expliciet anders aangeeft.

Stap voor stap: een PDF met gemengde inhoud correct comprimeren

Bepaal eerst wat uw gecomprimeerde bestand moet doen. Als de PDF alleen op schermen kan worden gelezen, kunt u afbeeldingen downsamplen naar 150 DPI en JPEG-kwaliteit 60 gebruiken zonder dat u zich zorgen hoeft te maken over de tekstkwaliteit, omdat de tekst vector is en hoe dan ook op volledige schermresolutie wordt weergegeven. Als het bestand op een standaard kantoorprinter kan worden afgedrukt, stelt u de beelddownsampling in op 200-300 DPI en de JPEG-kwaliteit op 80. Voor archiverings- of prepressgebruik past u verliesvrije FlateDecode-compressie toe op afbeeldingen en vermijdt u downsampling.

Ten tweede opent u uw PDF in een tool die de compressie-instellingen per object weergeeft. Bevestig in het compressiedialoogvenster van het hulpmiddel dat de optie "Tekst en lijntekeningen comprimeren" is ingeschakeld. optie is ingeschakeld. Deze instelling past verliesloze DEFLATE-compressie toe op de inhoudsstromen waarin tekst- en vectorpaden zijn opgeslagen. De reductie is bescheiden, doorgaans 20 tot 30 procent alleen al voor de contentstreams, maar er is geen sprake van visuele veranderingen en het maakt de daaropvolgende beeldcompressie in het algemeen effectiever.

Ten derde: pas afbeeldingsspecifieke compressie toe. Stel kleurenafbeeldingen in op JPEG-kwaliteit 60-80, afhankelijk van uw kwaliteitstolerantie. Stel grijswaardenafbeeldingen in op hetzelfde JPEG-kwaliteitsbereik. Stel monochrome afbeeldingen in op JBIG2 lossless of CCITT Group 4. Als uw tool een optie "metagegevens verwijderen" biedt, of "gooi verborgen voorwerpen weg" optie, schakel deze in. PDF's bevatten vaak ingesloten miniaturen, woordenboeken met documentinformatie en ongebruikte objecten die bijdragen aan de bestandsgrootte zonder de zichtbare uitvoer te beïnvloeden.

Voer ten vierde de compressie uit en controleer vervolgens de uitvoer. Open het gecomprimeerde bestand en zoom minimaal 400 procent in op een tekstgedeelte. De tekstranden moeten net zo scherp zijn als in het origineel. Selecteer een zin en kopieer deze. De kopie moet exact dezelfde tekens bevatten. Als een van beide tests mislukt, heeft het hulpprogramma de pagina gerasterd en moet u een andere compressor of een hogere kwaliteitsinstelling proberen. WukongPDF voert deze verificatiestap op natuurlijke wijze uit, omdat de compressie de tekst als tekst-by-design behoudt, zodat de kopieer-plaktest altijd zal slagen.

Ten vijfde: vergelijk de bestandsgroottes. Een goed gecomprimeerde pdf met gemengde inhoud, waarbij afbeeldingen de belangrijkste bijdrage leveren aan de bestandsgrootte, zou 50 tot 70 procent kleiner moeten zijn. Als de verkleining aanzienlijk hoger is, boven de 90 procent, heeft de tool mogelijk meer dan alleen afbeeldingsgegevens verwijderd en moet u controleren op ontbrekende inhoud. Als de reductie minder dan 20 procent bedraagt, zijn de afbeeldingen in uw PDF waarschijnlijk al gecomprimeerd en valt er niet veel meer te optimaliseren zonder over te schakelen op een lossy-aanpak.

Wanneer rasterisatie daadwerkelijk zinvol is

Er zijn scenario's waarbij rastering van de volledige pagina geen vergissing is, maar een bewuste afweging. Als een PDF duizenden kleine vectorelementen bevat, een complexe CAD-tekening met honderdduizenden individuele lijnsegmenten, of een ingewikkelde datavisualisatie met overlappende semi-transparante lagen, kunnen de inhoudsstromen die al deze vectorinstructies coderen in werkelijkheid groter zijn dan een rasterafbeelding met hoge resolutie van dezelfde pagina. In deze randgevallen levert het rasteren op 300 DPI en het toepassen van JPEG-compressie een kleiner bestand op dan het behouden van de vectorweergave, en bij 300 DPI blijft de tekst leesbaar voor alle praktische doeleinden.

De sleutel is om deze beslissing bewust te nemen, in plaats van dat de tool deze standaard voor u maakt. Als uw PDF een standaard Office-document is, een rapport, een e-boek, een formulier of iets dat voornamelijk bestaat uit tekst met een bescheiden aantal ingesloten afbeeldingen, is selectieve compressie waarbij de vectortekstlaag behouden blijft altijd de juiste aanpak. Als uw PDF een technisch schema, een zeer gedetailleerde kaart of een ontwerpproef is waarbij de vectorcomplexiteit het voordeel van het vectorhouden overweldigt, overweeg dan rasterisatie, maar alleen met een resolutie die hoog genoeg is zodat de tekst leesbaar blijft.

Veelvoorkomende fouten die tekstpixels veroorzaken na compressie

Een veelgemaakte fout is het opnieuw comprimeren van een reeds gecomprimeerde PDF. Als een PDF al is verwerkt door een tool die de pagina's heeft gerasterd, is de tekst al een afbeelding. Als je het door een tweede compressietool laat lopen die agressieve beelddownsampling toepast, zal de verslechtering toenemen. De tweede tool beschouwt de hele pagina als één grote afbeelding en downsampelt deze verder, waardoor wat ooit scherpe vectortekst was, wordt teruggebracht tot een wazige puinhoop. De oplossing is om altijd een kopie van het originele, niet-gecomprimeerde bestand te bewaren en het origineel opnieuw te comprimeren, nooit een reeds gecomprimeerde versie.

Een andere veel voorkomende fout is het gebruik van de laagste kwaliteit-voorinstelling op een tool zonder te controleren wat deze doet. De "maximale compressie" of "kleinste bestandsgrootte" De voorinstelling in veel tools maakt rastering van een volledige pagina mogelijk met 72 of 100 DPI, omdat dat de snelste manier is om een klein uitvoerbestand te garanderen, ongeacht de invoerinhoud. Het resulterende bestand kan indrukwekkend klein zijn, maar de tekst ziet er zelfs op een standaardmonitor zacht uit en zal in wezen onleesbaar zijn als de lezer inzoomt.

Een derde fout is het negeren van de kleurruimteconversie die sommige tools tijdens compressie toepassen. Wanneer een tool een kleuren-PDF naar grijstinten converteert als strategie voor het verkleinen van de grootte, zou dit alleen de kleurkanalen van ingesloten afbeeldingen moeten beïnvloeden. Als het gereedschap in plaats daarvan de pagina rastert en vervolgens de resulterende bitmap naar grijswaarden converteert, worden gekleurde tekst en vectorelementen ook afgevlakt. De oplossing is om te verifiëren dat elke kleurconversie selectief wordt toegepast op afbeeldingsobjecten in plaats van op de pagina als geheel.

Een niet-overeenkomende resolutie tussen de originele afbeeldingen en het compressiedoel kan ook voor problemen zorgen. Als de originele PDF afbeeldingen met 600 DPI bevat en u deze downsampelt naar 72 DPI, zien foto's er zacht uit en verliezen diagrammen fijne details. De compressie moet overeenkomen met het beoogde gebruik. Een doel van 72 DPI is alleen geschikt voor documenten die uitsluitend op schermen met normale zoomniveaus worden bekeken. Elk document dat kan worden afgedrukt, zelfs op een gewone kantoorprinter, moet minimaal 150 DPI gebruiken als downsamplingdoel voor afbeeldingen.

WukongPDF

Probeer PDF comprimeren

Geen installatie nodig. Werkt rechtstreeks in uw browser.

Nu beginnen →