Het scannen van bulkdocumenten levert één enorme PDF op met honderden afzonderlijke documenten, elk gescheiden van de volgende door niets meer dan een streepjescodepagina. De streepjescode, meestal een Code 39- of Code 128-symbool afgedrukt op een blanco vel, fungeert als een machinaal leesbare scheidingslijn die geautomatiseerde systemen vertelt waar het ene document eindigt en het volgende begint. Om een PDF te splitsen door deze streepjescodescheidingspagina's te detecteren, is een Split PDF-tool met streepjescodeherkenning nodig, die elke pagina leest, identificeert welke pagina's streepjescodes bevatten en die pagina's gebruikt als splitspunten om het document in de samenstellende bestanden te scheiden.

Hoe streepjescodescheidingspagina's werken bij het scannen van documenten
Voordat een grote partij papieren documenten wordt gescand, wordt er een streepjescodescheidingsblad bovenop elk afzonderlijk document in de stapel geplaatst. De scanner voert de hele stapel door als één doorlopende taak, waardoor één PDF ontstaat die wel duizenden pagina's lang kan zijn. De streepjescodevellen worden door de hele PDF verspreid op de grens tussen elk paar originele documenten. Elke streepjescode codeert informatie die identificeert wat erna komt: een documenttypecode, een zaaknummer, een werknemers-ID of een bestandsreferentie.
De streepjescode hoeft voor mensen geen visuele betekenis te hebben. Het is een machinaal leesbare gegevensdrager, gedrukt in een patroon van verticale balken van verschillende breedtes. Het verwerkingshulpmiddel PDF Batch leest de streepjescodewaarde en gebruikt deze om zowel het splitsingspunt als, optioneel, de bestandsnaam voor het geëxtraheerde document te bepalen. Een streepjescode van een scheidingspagina die de waarde INV-2026-0047 codeert, vertelt de splitter dat hij op deze pagina een nieuw document moet beginnen en het uitvoerbestand de naam INV-2026-0047.pdf moet geven.
Probeer PDF splitsen
Geen installatie nodig. Werkt rechtstreeks in uw browser.
De PDF voorbereiden voor op streepjescodes gebaseerd splitsen
Controleer voordat u de splitsing uitvoert of elke scheidingspagina in de PDF een duidelijk afgedrukte, onbeschadigde streepjescode bevat. Een streepjescode die vlekkerig is, gedeeltelijk verborgen is door een gaatje in de nietjes of schuin is afgedrukt, wordt mogelijk niet correct herkend, waardoor de splitter het splitspunt mist of een onjuiste waarde leest. Blader snel door de PDF en bekijk een willekeurig voorbeeld van scheidingspagina's. De streepjescode moet met donkerzwarte inkt op schoon wit papier worden afgedrukt, met aan alle zijden minimaal een kwart inch witte ruimte.
Bevestig dat de streepjescodepagina's de eerste pagina van elk document zijn, en niet de laatste pagina van het voorgaande document. Deze conventie is bijna universeel bij het scannen van documenten, omdat het betekent dat de streepjescodewaarde het volgende document beschrijft. Als de streepjescodepagina's in uw PDF in plaats daarvan als de laatste pagina van elk document zijn geplaatst, hebben de meeste hulpmiddelen voor het splitsen van streepjescodes een instelling om dit aan te passen, maar de standaardaanname is dat de streepjescode op de eerste pagina van elk nieuw document staat.
Een tool selecteren die streepjescodeherkenning ondersteunt
Standaard PDF-splitters die delen op basis van het aantal pagina's of bladwijzers kunnen geen streepjescodes detecteren, omdat streepjescodeherkenning optische analyse van de paginaafbeelding vereist. Zoek naar een tool voor het vastleggen van documenten of het beheer van zakelijke inhoud waarin scheiding op basis van streepjescodes expliciet als functie wordt vermeld. Adobe Acrobat Pro bevat streepjescodeherkenning in de Action Wizard voor documentverwerking. Browsergebaseerde Split PDF-platforms met streepjescodedetectie verzorgen de herkenning op de server en retourneren de gesplitste bestanden als een downloadbaar archief.
Voor organisaties die regelmatig door streepjescodes gescheiden PDF's verwerken, biedt speciale software voor het vastleggen van documenten, zoals Kofax, Ephesoft of Abbyy FlexiCapture, de meest betrouwbare streepjescodeherkenning. Deze tools zijn specifiek ontworpen voor het scheiden van documenten in grote volumes en omvatten functies zoals regels voor streepjescodevalidatie, afhandeling van uitzonderingen voor onleesbare streepjescodes en integratie met documentbeheersystemen. WukongPDF en vergelijkbare platforms bieden browsergebaseerde splitsing die toegankelijk is zonder installatie van bedrijfssoftware.
Instellingen voor streepjescodeherkenning configureren
Bij de meeste tools voor het splitsen van streepjescodes moet u vóór verwerking het streepjescodetype opgeven. De twee meest voorkomende typen bij het scannen van documenten zijn Code 39, die alfanumerieke tekens codeert en veel wordt gebruikt in juridische en medische dossiers, en Code 128, die de volledige ASCII-tekenset codeert en compactere streepjescodes produceert voor dezelfde gegevens. Selecteer het juiste barcodetype in de gereedschapsinstellingen. Als u het verkeerde type selecteert, worden alle streepjescodes niet herkend en meldt de tool dat er geen splitspunten zijn gevonden.
Sommige tools bieden een instelling voor de streepjescode-oriëntatie. Streepjescodes op scheidingspagina's worden doorgaans horizontaal afgedrukt, maar als de pagina's in liggende richting door de scanner zijn gevoerd of als de streepjescode verticaal langs de rand van de pagina is afgedrukt, moet de herkenningsengine weten in welke richting moet worden gescand. Stel de richting in op Auto, indien beschikbaar, zodat de engine alle vier de mogelijke rotaties voor elke pagina moet controleren.
De uitvoerbestanden een naam geven met behulp van streepjescodewaarden
De streepjescodewaarde op elke scheidingspagina kan een dubbele functie vervullen als splitsingstrigger en als uitvoerbestandsnaam. Configureer de splitstool om de streepjescodewaarde te gebruiken als de bestandsnaam voor het document dat op het scheidingsteken volgt. Een scheidingsteken met streepjescodewaarde CASE-0042-HARRIS produceert een uitvoerbestand met de naam CASE-0042-HARRIS.pdf dat alle pagina's bevat vanaf dat scheidingsteken tot, maar niet inclusief, de volgende scheidingspagina.
Als de streepjescodewaarden geen bestandsnaamveilige indeling volgen, zoals spaties, speciale tekens of tekens die illegaal zijn in bestandsnamen, configureert u het hulpprogramma om de waarden op te schonen. De meeste tools vervangen spaties automatisch door onderstrepingstekens of koppeltekens en verwijderen tekens die Windows- of macOS-bestandssystemen niet toestaan. Controleer de namen van de uitvoerbestanden na de eerste gesplitste taak om te bevestigen dat de opschoning leesbare, nuttige namen heeft opgeleverd in plaats van reeksen gestripte tekens die niet langer de oorspronkelijke betekenis overbrengen.
Omgaan met onleesbare en ontbrekende streepjescodes
Geen enkel barcodeherkenningsproces is perfect. Vlekkerige streepjescodes, pagina's die scheef worden ingevoerd en scheidingsvellen die per ongeluk zijn weggelaten tijdens het scannen, veroorzaken allemaal splitsingsfouten. Configureer de tool voor het afhandelen van uitzonderingen om niet-herkende pagina's te markeren in plaats van de documenten aan weerszijden van een gemist splitspunt stil samen te voegen. De tool moet een uitzonderingsrapport genereren met een lijst van elke pagina waarop een streepjescode werd verwacht maar niet werd gevonden, samen met het paginanummer en, indien mogelijk, een miniatuur van de paginaafbeelding.
Nadat de automatische splitsing is voltooid, bekijkt u het uitzonderingsrapport en splitst u handmatig alle documenten die de tool niet automatisch kon scheiden. Open de originele PDF, navigeer naar de gemarkeerde paginanummers, bepaal waar de splitsing moet plaatsvinden en extraheer de pagina's handmatig met behulp van een PDF-pagina-extractietool. De handmatige verwerking van uitzonderingen duurt minuten voor een handvol gemiste splitsingen, vergeleken met urenlange handmatige splitsing voor elk document in de batch.
Voor toekomstige scanprojecten kunt u de leesbaarheid van streepjescodes verbeteren door streepjescodes met een hoger contrast af te drukken, streepjescodes uit de buurt van de paginaranden te plaatsen waar de schaduwen van de scanner ze kunnen verbergen, en een kwaliteitscontrole vóór de scan uit te voeren op de scheidingspagina's voordat ze in de stapel documenten worden geplaatst.
Gesplitste resultaten valideren ten opzichte van de originele documentinventaris
Nadat de geautomatiseerde streepjescodesplitsing is voltooid, vergelijkt u het aantal uitvoerbestanden met het verwachte aantal documenten. Als het oorspronkelijke scanproject 247 documenten registreerde die werden gescand, zou de splitsing precies 247 uitvoerbestanden moeten opleveren. Een mismatch duidt op gemiste splitsingspunten, waarbij twee documenten zijn samengevoegd tot één uitvoerbestand, of op valse splitsingspunten, waarbij een enkel document is gesplitst omdat iets op een van de pagina's werd aangezien voor een streepjescode.
Voor splitsingsprojecten met hoge inzet, zoals juridische ontdekking of migratie van medische dossiers, voert u een afstemming van het aantal pagina's uit. Het totale aantal pagina's voor alle uitvoerbestanden moet gelijk zijn aan het aantal pagina's van de originele PDF minus de scheidingspagina's. Een verschil van zelfs maar één pagina betekent dat de splitsing niet perfect was en dat handmatige beoordeling van de uitvoer vereist is.
Sla de scheidingspagina's op als een afzonderlijke PDF in plaats van ze weg te gooien. De streepjescodewaarden op die pagina's vormen het audittraject dat elk uitvoerbestand verbindt met de oorspronkelijke positie in de gescande batch. Als er maanden later een vraag ontstaat over een specifiek document, bevestigt het archief met scheidingspagina's precies waar dat document vandaan komt.
Voor PDF Batch-splitsingsbewerkingen die volgens een schema worden uitgevoerd, zoals de nachtelijke verwerking van gescande documenten vanaf een multifunctionele printer, automatiseert u de gehele workflow, van scannen tot splitsen tot archiveren. Een bewaakte map controleert of er nieuwe PDF's zijn. Wanneer een PDF binnenkomt, verwerkt de barcodesplitter deze automatisch en plaatst de gesplitste bestanden in gecategoriseerde mappen op basis van de barcodewaarden. Automatisering verandert een handmatige splitsingstaak in een achtergrondproces dat geen menselijke aandacht vereist.
Wanneer u een streepjescodetype selecteert voor een nieuw documentscanproject, kiest u Code 128 boven Code 39 als de streepjescodewaarden zowel letters als cijfers bevatten. Code 128 produceert compactere barcodes voor alfanumerieke gegevens, wat betekent dat het barcodesymbool kleiner op de scheidingspagina kan worden afgedrukt zonder dat de scanbaarheid verloren gaat.
Voor langdurige PDF Batch-projecten documenteert u de barcodespecificaties en de splitsingsconfiguratie in een projectbestand dat naast de gescande documenten wordt opgeslagen. Wanneer het project maanden of jaren later opnieuw wordt bekeken, beantwoordt de documentatie de vragen welk barcodetype is gebruikt, wat de barcodewaarden vertegenwoordigen en hoe de splitsing is geconfigureerd.
Wanneer het vervangen van op streepjescodes gebaseerde PDF Batch splitsing door handmatige scheiding noodzakelijk is vanwege problemen met de kwaliteit van de streepjescode, neemt de benodigde tijd dramatisch toe. Een batch die binnen enkele minuten automatisch wordt gesplitst, kan uren duren om handmatig te scheiden.
Probeer PDF splitsen
Geen installatie nodig. Werkt rechtstreeks in uw browser.
