Zbiorcze skanowanie dokumentów tworzy pojedynczy, ogromny plik PDF zawierający setki pojedynczych dokumentów, każdy oddzielony od drugiego jedynie stroną z kodem kreskowym. Kod kreskowy, zazwyczaj symbol Code 39 lub Code 128 wydrukowany na pustym arkuszu, działa jak czytelna maszynowo przekładka, która informuje zautomatyzowane systemy, gdzie kończy się jeden dokument, a zaczyna następny. Dzielenie pliku PDF poprzez wykrywanie stron oddzielających kod kreskowy wymaga narzędzia Podziel PDF z funkcją rozpoznawania kodów kreskowych, które odczytuje każdą stronę, identyfikuje strony zawierające kody kreskowe i wykorzystuje te strony jako punkty podziału w celu podzielenia dokumentu na pliki składowe.

Jak strony oddzielające kody kreskowe działają podczas skanowania dokumentów
Przed zeskanowaniem dużej partii dokumentów papierowych na każdym dokumencie na stosie umieszczany jest arkusz oddzielający kody kreskowe. Skaner przepuszcza cały stos w ramach pojedynczego, ciągłego zadania, tworząc jeden plik PDF, który może mieć tysiące stron. Arkusze kodów kreskowych są rozmieszczone w całym pliku PDF na granicy każdej pary oryginalnych dokumentów. Każdy kod kreskowy koduje informacje identyfikujące to, co następuje po nim: kod typu dokumentu, numer sprawy, identyfikator pracownika lub numer referencyjny pliku.
Kod kreskowy nie musi mieć znaczenia wizualnego dla człowieka. Jest to nośnik danych nadający się do odczytu maszynowego, zadrukowany we wzór pionowych pasków o różnej szerokości. Narzędzie do przetwarzania PDF Batch odczytuje wartość kodu kreskowego i wykorzystuje ją do określenia zarówno punktu podziału, jak i opcjonalnie nazwy pliku wyodrębnionego dokumentu. Kod kreskowy strony rozdzielającej kodujący wartość INV-2026-0047 informuje rozdzielacz, aby rozpoczął nowy dokument na tej stronie i nazwał plik wyjściowy INV-2026-0047.pdf.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Przygotowanie pliku PDF do podziału na podstawie kodów kreskowych
Przed uruchomieniem podziału sprawdź, czy każda strona rozdzielająca w pliku PDF zawiera wyraźnie wydrukowany, nieuszkodzony kod kreskowy. Kod kreskowy, który jest rozmazany, częściowo zasłonięty przez dziurkę od zszywki lub wydrukowany pod kątem, może nie zostać poprawnie rozpoznany, co powoduje, że rozdzielacz albo nie trafia w punkt podziału, albo odczytuje nieprawidłową wartość. Szybko przewiń plik PDF i sprawdź losową próbkę stron separujących. Kod kreskowy należy wydrukować ciemnym czarnym tuszem na czystym białym papierze, pozostawiając co najmniej ćwierć cala wolnego miejsca ze wszystkich stron.
Upewnij się, że strony z kodami kreskowymi są pierwszą stroną każdego dokumentu, a nie ostatnią stroną poprzedniego dokumentu. Konwencja ta jest niemal uniwersalna w skanowaniu dokumentów, ponieważ oznacza, że wartość kodu kreskowego opisuje następny dokument. Jeśli zamiast tego strony z kodami kreskowymi w pliku PDF zostały umieszczone jako ostatnia strona każdego dokumentu, większość narzędzi do dzielenia kodów kreskowych ma ustawienie umożliwiające dostosowanie tego ustawienia, ale domyślnym założeniem jest to, że kod kreskowy znajduje się na pierwszej stronie każdego nowego dokumentu.
Wybór narzędzia obsługującego rozpoznawanie kodów kreskowych
Standardowe narzędzia do rozdzielania plików PDF dzielące według liczby stron lub zakładek nie wykrywają kodów kreskowych, ponieważ rozpoznawanie kodów kreskowych wymaga analizy optycznej obrazu strony. Poszukaj narzędzia do przechwytywania dokumentów lub zarządzania treścią przedsiębiorstwa, które wyraźnie wymienia separację na podstawie kodów kreskowych jako funkcję. Adobe Acrobat Pro umożliwia rozpoznawanie kodów kreskowych w Kreatorze akcji w celu przetwarzania dokumentów. Oparte na przeglądarce platformy Split PDF z funkcją wykrywania kodów kreskowych obsługują rozpoznawanie po stronie serwera i zwracają podzielone pliki w formie archiwum do pobrania.
W przypadku organizacji, które regularnie przetwarzają pliki PDF oddzielone kodami kreskowymi, dedykowane oprogramowanie do przechwytywania dokumentów, takie jak Kofax, Ephesoft lub Abbyy FlexiCapture, zapewnia najbardziej niezawodne rozpoznawanie kodów kreskowych. Narzędzia te zostały zaprojektowane specjalnie do separacji dokumentów o dużej objętości i obejmują takie funkcje, jak reguły sprawdzania poprawności kodów kreskowych, obsługa wyjątków w przypadku nieczytelnych kodów kreskowych oraz integracja z systemami zarządzania dokumentami. WukongPDF i podobne platformy zapewniają podział oparty na przeglądarce, dostępny bez instalacji oprogramowania dla przedsiębiorstw.
Konfigurowanie ustawień rozpoznawania kodów kreskowych
Większość narzędzi do dzielenia kodów kreskowych wymaga określenia typu kodu kreskowego przed przetworzeniem. Dwa najpopularniejsze typy skanowania dokumentów to Code 39, który koduje znaki alfanumeryczne i jest szeroko stosowany w dokumentacji prawnej i medycznej, oraz Code 128, który koduje pełny zestaw znaków ASCII i tworzy bardziej zwarte kody kreskowe dla tych samych danych. Wybierz właściwy typ kodu kreskowego w ustawieniach narzędzia. Wybranie niewłaściwego typu spowoduje, że wszystkie kody kreskowe nie zostaną rozpoznane, a narzędzie zgłosi, że nie znaleziono żadnych punktów podziału.
Niektóre narzędzia oferują ustawienie orientacji kodu kreskowego. Kody kreskowe na stronach rozdzielających są zazwyczaj drukowane poziomo, ale jeśli strony zostały podane przez skaner w orientacji poziomej lub jeśli kod kreskowy został wydrukowany pionowo wzdłuż krawędzi strony, mechanizm rozpoznawania musi wiedzieć, w której orientacji skanować. Ustaw orientację na Auto, jeśli jest dostępna, co nakazuje silnikowi sprawdzenie wszystkich czterech możliwych obrotów każdej strony.
Nazywanie plików wyjściowych przy użyciu wartości kodów kreskowych
Wartość kodu kreskowego na każdej stronie separatora może pełnić podwójną rolę zarówno jako wyzwalacz podziału, jak i nazwa pliku wyjściowego. Skonfiguruj narzędzie podziału, aby używać wartości kodu kreskowego jako nazwy pliku dokumentu następującego po separatorze. Separator z wartością kodu kreskowego CASE-0042-HARRIS tworzy plik wyjściowy o nazwie CASE-0042-HARRIS.pdf zawierający wszystkie strony od tego separatora aż do następnej strony separatora, ale bez nich.
Jeśli wartości kodów kreskowych nie są zgodne z formatem bezpiecznym dla nazw plików, np. zawierają spacje, znaki specjalne lub niedozwolone znaki w nazwach plików, skonfiguruj narzędzie w celu oczyszczenia wartości. Większość narzędzi automatycznie zastępuje spacje znakami podkreślenia lub łącznikami i usuwa znaki, na które nie pozwalają systemy plików Windows lub macOS. Sprawdź nazwy plików wyjściowych po pierwszym podzielonym zadaniu, aby potwierdzić, że oczyszczanie utworzyło czytelne, przydatne nazwy, a nie ciągi pozbawionych znaków, które nie przekazują już pierwotnego znaczenia.
Postępowanie z nieczytelnymi i brakującymi kodami kreskowymi
Żaden proces rozpoznawania kodów kreskowych nie jest doskonały. Rozmazane kody kreskowe, przekrzywione strony i arkusze separujące przypadkowo pominięte podczas skanowania powodują błędy podziału. Skonfiguruj obsługę wyjątków narzędzia, aby oznaczać nierozpoznane strony, zamiast dyskretnie łączyć dokumenty po obu stronach pominiętego punktu podziału. Narzędzie powinno wygenerować raport wyjątków zawierający listę każdej strony, na której oczekiwano kodu kreskowego, ale go nie znaleziono, wraz z numerem strony i, jeśli to możliwe, miniaturą obrazu strony.
Po zakończeniu automatycznego podziału przejrzyj raport wyjątków i ręcznie podziel wszystkie dokumenty, których narzędzie nie mogło automatycznie rozdzielić. Otwórz oryginalny plik PDF, przejdź do oznaczonych numerów stron, określ miejsce podziału i ręcznie wyodrębnij strony za pomocą narzędzia do wyodrębniania stron PDF. Krok ręcznej obsługi wyjątków zajmuje kilka minut w przypadku kilku pominiętych podziałów, w porównaniu do godzin ręcznego dzielenia każdego dokumentu w partii.
W przypadku przyszłych projektów skanowania popraw czytelność kodów kreskowych, stosując drukowanie kodów kreskowych o wyższym kontraście, umieszczając kody kreskowe z dala od krawędzi strony, gdzie cienie skanera mogą je zasłonić, oraz przeprowadzając wstępną kontrolę jakości stron rozdzielających przed ich umieszczeniem w stosie dokumentów.
Weryfikacja rozdzielonych wyników względem oryginalnej inwentaryzacji dokumentu
Po zakończeniu automatycznego podziału kodu kreskowego porównaj liczbę plików wyjściowych z oczekiwaną liczbą dokumentów. Jeśli w oryginalnym projekcie skanowania zarejestrowano 247 skanowanych dokumentów, podział powinien dać dokładnie 247 plików wyjściowych. Niedopasowanie oznacza albo pominięte punkty podziału, w przypadku których dwa dokumenty zostały połączone w jeden plik wyjściowy, albo fałszywe punkty podziału, w przypadku których pojedynczy dokument został podzielony, ponieważ coś na jednej z jego stron zostało wzięte za kod kreskowy.
W przypadku projektów o dużej stawce podziału, takich jak odkrycie informacji prawnych lub migracja dokumentacji medycznej, należy przeprowadzić uzgadnianie liczby stron. Całkowita liczba stron we wszystkich plikach wyjściowych powinna być równa liczbie stron oryginalnego pliku PDF pomniejszonej o strony oddzielające. Rozbieżność choćby na jednej stronie oznacza, że podział nie był doskonały i wymaga ręcznego sprawdzenia wyników.
Zapisz strony oddzielające jako oddzielny plik PDF, zamiast je odrzucać. Wartości kodów kreskowych na tych stronach stanowią ścieżkę audytu, która łączy każdy plik wyjściowy z jego pierwotną pozycją w zeskanowanej partii. Jeśli kilka miesięcy później pojawi się pytanie dotyczące konkretnego dokumentu, archiwum stron rozdzielających potwierdza dokładnie, skąd pochodzi ten dokument.
W przypadku operacji podziału PDF Partia wykonywanych zgodnie z harmonogramem, takich jak nocne przetwarzanie zeskanowanych dokumentów z drukarki wielofunkcyjnej, należy zautomatyzować cały przepływ pracy, od skanowania, przez podział, aż po archiwizację. Folder obserwowany monitoruje nowe pliki PDF. Po otrzymaniu pliku PDF moduł rozdzielania kodów kreskowych przetwarza go automatycznie i umieszcza podzielone pliki w folderach podzielonych na kategorie na podstawie wartości kodu kreskowego. Automatyzacja zamienia ręczne zadanie podziału w proces w tle, który nie wymaga ludzkiej uwagi.
Wybierając typ kodu kreskowego dla nowego projektu skanowania dokumentów, wybierz Kod 128 zamiast Kodu 39, jeśli wartości kodu kreskowego będą zawierać zarówno litery, jak i cyfry. Code 128 tworzy bardziej zwarte kody kreskowe dla danych alfanumerycznych, co oznacza, że symbol kodu kreskowego może być drukowany w mniejszym formacie na stronie rozdzielającej bez utraty możliwości skanowania.
W przypadku długoterminowych projektów PDF Batch należy udokumentować specyfikacje kodów kreskowych i konfigurację podziału w pliku projektu przechowywanym obok zeskanowanych dokumentów. Kiedy do projektu powraca się kilka miesięcy lub lat później, dokumentacja odpowiada na pytania, jaki typ kodu kreskowego został użyty, co reprezentują wartości kodu kreskowego i jak skonfigurowano podział.
W przypadku zastąpienia podziału PDF Partia opartego na kodzie kreskowym na ręczną separację, która jest konieczna ze względu na problemy z jakością kodu kreskowego, wymagany czas dramatycznie wzrasta. Partia, która jest dzielona automatycznie w ciągu kilku minut, może wymagać godzin ręcznego rozdzielenia.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
