Podzielenie 50-stronicowego pliku PDF na pojedyncze strony tworzy 50 plików o nazwach od strony 1.pdf do strony 50.pdf. Nazwy są technicznie dokładne pod względem fizycznej pozycji strony i całkowicie bezużyteczne pod względem treści. Strona 7 może zawierać umowę Smith z podpisem i warunkami płatności. Strona 23 może być fakturą Jonesa z pozycjami pojedynczymi i sumą. Zmiana nazwy wszystkich 50 plików poprzez otwieranie każdego z osobna w celu sprawdzenia, co zawiera, a następnie wpisanie opisowej nazwy pliku zajmuje prawie tyle samo czasu, co dzielenie pliku PDF i stwarza ryzyko błędów w nazewnictwie, które uniemożliwiają późniejsze odnalezienie plików.
Rzeczywista operacja podziału zajmuje kilka sekund. Następująca później zmiana nazwy zajmuje minuty lub godziny, w zależności od liczby plików i tego, czy istnieje metoda wyprowadzania nazw z treści. Automatyzacja etapu nazewnictwa sprawia, że dzielenie plików PDF z żmudnej czynności staje się faktycznie wydajnym przepływem pracy.
Dzielenie Podział pliku PDF i zapisywanie każdego pliku pod znaczącą, niestandardową nazwą oznacza albo skonfigurowanie przed podziałem wzorca nazewnictwa, który wyprowadza nazwy ze struktury dokumentu, np. zakładek, albo użycie narzędzia zbiorczej zmiany nazwy po podziale, które odczytuje tekst z każdego pliku i generuje opisową nazwę z zawartości. Narzędzia podziału PDF Pages WukongPDF obsługują niestandardowe nazewnictwo w oparciu o tekst zakładek, a poniższe metody obejmują zarówno ustrukturyzowane podejście przed podziałem, jak i podejście do wyodrębniania treści po podziale.

Wyprowadzanie nazw plików ze struktury dokumentu przed podziałem
Jeśli plik PDF ma dobrze zorganizowaną hierarchię zakładek, w której każda zakładka najwyższego poziomu odpowiada logicznej sekcji z opisowym tytułem, podział oparty na zakładkach tworzy pliki wyjściowe, które automatycznie dziedziczą tekst zakładki jako nazwę pliku. Plik PDF z miesięcznymi raportami klientów, w których każda zakładka najwyższego poziomu jest nazwą klienta, jest podzielony na pliki nazwane imionami każdego klienta, Smith-Corp.pdf, Jones-LLC.pdf, Acme-Inc.pdf, bez konieczności ręcznej zmiany nazw. Tekst zakładki musi być bezpieczny dla systemu plików, co oznacza, że nie może zawierać znaków zabronionych przez systemy operacyjne w nazwach plików, takich jak dwukropki, ukośniki, ukośniki odwrotne, gwiazdki lub znaki zapytania.
Jeśli zakładki są obecne, ale ich tekst nie nadaje się na nazwę pliku, jest za długi, zawiera nieprawidłowe znaki lub ma niespójne formatowanie, przed podziałem dokonaj edycji tekstu zakładek. W programie Adobe Acrobat otwórz panel Zakładki, kliknij prawym przyciskiem myszy każdą zakładkę, wybierz opcję Zmień nazwę i wpisz żądaną nazwę pliku. W przypadku dokumentu zawierającego dziesiątki sekcji edycja zakładek zajmuje kilka minut, ale czas zainwestowany w czyste zakładki zwraca się natychmiast, gdy operacja podziału pozwala uzyskać pliki o idealnie nazwanych plikach bez dalszej interwencji.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Wyodrębnianie nazw opartych na zawartości po podzieleniu na nazwy ogólne
Jeśli nazewnictwo oparte na zakładkach nie jest dostępne, ponieważ plik PDF całkowicie nie zawiera zakładek lub tekst zakładki nie zawiera znaczących identyfikatorów treści, najpierw podziel dokument za pomocą ogólnych nazw sekwencyjnych, a następnie zmień nazwę każdego pliku wyjściowego na podstawie tekstu wyodrębnionego z jego zawartości. Narzędzie do zbiorczej zmiany nazwy lub skrypt w języku Python odczytuje kilka pierwszych wierszy tekstu z pierwszej strony każdego podzielonego pliku, wyszukuje znany wzorzec, taki jak nazwa klienta pojawiająca się po etykiecie Klient: lub numer faktury po numerze faktury, i używa dopasowanego tekstu jako nowej nazwy pliku.
Metoda wyodrębniania treści sprawdza się najlepiej w przypadku dokumentów strukturalnych, w których każda podzielona sekcja ma spójny format z identyfikującym tekstem w przewidywalnym miejscu. Folder faktur miesięcznych, gdzie w pierwszym wierszu każdej strony znajduje się numer faktury, po którym następuje liczba, a w drugim wierszu Klient: po którym następuje nazwa. Można zbiorczo zmienić nazwę za pomocą skryptu, który wyodrębnia oba pola i tworzy nazwę pliku, np. Invoice-1234-Acme-Corp.pdf. Skrypt stosuje tę samą logikę wyodrębniania i nazewnictwa do każdego pliku w partii, eliminując zarówno czas, jak i poziom błędów ręcznej zmiany nazwy.
Skryptowanie przepływu pracy typu „Podziel i nadaj nazwę” dla zadań cyklicznych
Praca z podziałem i nazwą, która powtarza się zgodnie z harmonogramem, ta sama struktura raportów miesięcznych podzielona na sekcje o tych samych nazwach dla tej samej listy dystrybucyjnej w każdym miesiącu uzasadnia budowanie stałego skryptu zamiast powtarzania procesu ręcznego w każdym cyklu. Zapisz jednokrotnie zakresy stron i odpowiadające im nazwy plików wyjściowych w pliku konfiguracyjnym. Skrypt odczytuje konfigurację, dzieli plik PDF według określonych zakresów i nadaje każdemu plikowi wyjściowemu nazwę. Co miesiąc aktualizuj tylko wejściową nazwę pliku PDF w konfiguracji. Skrypt obsługuje wszystko inne identycznie w każdym cyklu.
Kontrola wersji zarówno skryptu, jak i pliku konfiguracyjnego. Gdy zmienia się struktura raportu, dodawana, usuwana lub reorganizowana jest sekcja, należy zaktualizować konfigurację, aby była zgodna. Logika skryptu pozostaje stała. To oddzielenie logiki przetwarzania zapisanej w skrypcie od danych specyficznych dla dokumentu zapisanych w konfiguracji sprawia, że przepływ pracy jest łatwy do utrzymania w miarę upływu czasu. Osoba prowadząca split miesięczny nie musi rozumieć ani modyfikować skryptu. Edytują prosty plik konfiguracyjny i wykonują skrypt.
| Metoda nazewnictwa | Warunki | Z uwzględnieniem treści? | Najlepsze dla |
|---|---|---|---|
| Podział na podstawie zakładek | Dobrze zorganizowane zakładki z czystym tekstem | Tak, nazwy pochodzą ze struktury dokumentu | Dokumenty z hierarchią nagłówków |
| Skrypt wyodrębniania treści | Spójne wzorce tekstu w każdej sekcji | Tak, nazwy pochodzą z treści dokumentu | Ustrukturyzowane formularze, faktury, raporty |
| Skrypt typu „podziel i nazwij”. | Plik konfiguracyjny z zakresami i nazwami | Tak, w pełni konfigurowalny | Powtarzające się zadania o identycznej strukturze |
Obsługa konfliktów nazw plików i nieprawidłowych znaków
Dwie podzielone strony lub sekcje, które dają tę samą wyodrębnioną nazwę, dwie faktury od tego samego klienta bez numeru wyróżniającego, tworzą konflikt nazw plików, w wyniku którego nie można zapisać drugiego pliku, ponieważ plik o tej nazwie już istnieje. Rozwiązuj konflikty, dodając różnicujący przyrostek, numer kolejny, datę lub inne pole odróżniające oba dokumenty. Faktura-1234-Acme-Corp.pdf i Faktura-1235-Acme-Corp.pdf rozróżnia się według numeru faktury. Jeżeli nie jest dostępne żadne pole rozróżniające, dołącz licznik sekwencji: Acme-Corp-1.pdf i Acme-Corp-2.pdf.
Wyodrębniony tekst używany jako nazwy plików musi zostać oczyszczony ze znaków zabronionych przez system operacyjny. Usuń lub zamień dwukropki, ukośniki, ukośniki odwrotne, gwiazdki, znaki zapytania, nawiasy ostre i znaki kreskowe łącznikami lub podkreśleniami. Przytnij początkowe i końcowe spacje oraz kropki. Etap czyszczenia jest przyziemny, ale niezbędny. Nieoczyszczona nazwa pliku zawierająca niedozwolony znak powoduje niepowodzenie operacji zmiany nazwy i wystąpienie błędu systemu operacyjnego, a zdiagnozowanie, który z 50 plików spowodował awarię, jest znacznie bardziej czasochłonne niż zapobiegawcze czyszczenie wszystkich nazw plików.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
