Wyodrębnianie tylko stron nieparzystych lub tylko stron parzystych z pliku PDF jest zaskakująco częstym zadaniem. Skaner dwustronny mógł przechwycić każdy arkusz jako dwie osobne strony, ale do raportu potrzebne są tylko przednie strony. Scalony dokument może mieszać strony treści z pustymi stronami zastępczymi, które należy usunąć. Lub zadanie drukowania wymaga podzielenia dokumentu dwustronnego na dwa jednostronne pliki w przypadku drukarki, która nie obsługuje automatycznego drukowania dwustronnego. Narzędzia Podziel PDF ułatwiają wyodrębnianie, jeśli zrozumiesz logikę wyboru strony opartą na wzorcach.
Podstawowa zasada jest taka sama w przypadku wszystkich metod ekstrakcji: zdefiniuj zakres stron za pomocą filtra nieparzystego lub parzystego, a następnie wyeksportuj tylko strony pasujące do filtra. 100-stronicowy plik PDF, w którym chcesz mieć wszystkie strony nieparzyste, oznacza eksportowanie stron od 1, 3, 5 do 99. Większość narzędzi PDF obsługuje to za pomocą prostego zapisu wzoru. Różnica między narzędziami polega na tym, czy wymagają ręcznego wpisywania numerów stron, czy też akceptują skrót, taki jak 1-100:nieparzysty.
Narzędzia PDF Pages WukongPDF obejmują funkcje wyodrębniania i dzielenia stron, które obsługują selekcję na podstawie wzorców bezpośrednio w przeglądarce. W przypadku operacji wsadowych na dużych zestawach dokumentów opisane poniżej podejścia oparte na wierszu poleceń i skryptach zapewniają lepszą automatyzację.

Po co wyodrębniać strony nieparzyste czy parzyste?
W praktyce najczęstszym scenariuszem jest obsługa dokumentów skanowanych dwustronnie. Skaner ustawiony na tryb dwustronny przechwytuje przód strony 1 jako stronę 1, tył jako stronę 2, przód strony 2 jako stronę 3 i tak dalej. Jeśli potrzebujesz tylko przednich stron każdego arkusza, wyodrębnij strony nieparzyste. Jeśli potrzebujesz tylko tylnych stron, wyodrębnij parzyste strony. Ten przepływ pracy jest standardem w projektach digitalizacji archiwów, przetwarzaniu dokumentów prawnych i działach księgowych, które skanują obie strony paragonów, ale archiwizują tylko przednie strony.
Innym częstym przypadkiem są dokumenty o zmiennej treści i pustych stronach. Niektóre generatory plików PDF wstawiają pustą stronę po każdej stronie zawartości, aby wymusić, aby nowe rozdziały zawsze zaczynały się na stronie skierowanej w prawo w układzie wydruku. Kiedy dokument jest przekazywany wyłącznie do dystrybucji cyfrowej, te puste strony powodują dodatkowe zakłócenia wizualne i zwiększają rozmiar pliku, nie wnosząc przy tym żadnych informacji. Wyodrębnienie tylko niepustych stron, które często mają nieparzysty lub parzysty wzór, czyści dokument. Przed wyodrębnieniem przez parzystość sprawdź, czy puste strony konsekwentnie zajmują nieparzyste lub parzyste położenie w całym dokumencie.
Drukarnie stosują również ekstrakcję nieparzystą i parzystą w celu przygotowania dokumentów do określonych metod oprawy. Idealne oprawy wymagają oddzielnych stosów dla stron przednich i tylnych. Operacja PDF Partia, która dzieli plik PDF książki na części nieparzyste i parzyste, przygotowuje oba stosy w ciągu kilku sekund.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Metoda 1: Korzystanie z funkcji Organizuj strony programu Adobe Acrobat Pro
Acrobat Pro zapewnia najbardziej wizualne podejście do ekstrakcji nieparzystej i parzystej. Otwórz plik PDF, przejdź do opcji Narzędzia, a następnie Organizuj strony. Widok miniatur pokazuje każdą stronę z jej numerem. Kliknij menu rozwijane Wybierz strony i wybierz Zakres stron. Wpisz wzór dla stron nieparzystych, wprowadzając ręcznie numery poszczególnych stron, np. 1,3,5,7 w przypadku małego dokumentu. W przypadku dłuższych dokumentów program Acrobat natywnie nie obsługuje skrótów nieparzystych/parzystych, dlatego należy wpisać pełną sekwencję lub zastosować obejście.
Praktycznym obejściem dłuższych dokumentów w programie Acrobat Pro jest użycie narzędzia Wyodrębnij z podejściem obejściowym. Otwórz panel Strony po lewej stronie, wybierz pierwszą stronę nieparzystą, klikając jej miniaturę, a następnie przytrzymaj klawisz Ctrl i kliknij każdą kolejną stronę nieparzystą. Po wybraniu wszystkich stron docelowych kliknij prawym przyciskiem myszy i wybierz opcję Wyodrębnij strony. W oknie dialogowym zaznacz opcję Wyodrębnij strony jako oddzielne pliki, jeśli chcesz mieć pojedyncze pliki stron, lub pozostaw to pole niezaznaczone, aby uzyskać jeden połączony plik PDF. Kliknij OK. Acrobat utworzy nowy plik PDF zawierający tylko wybrane strony. Metodę tę można zastosować w przypadku dokumentów liczących do około 30 stron. Poza tym ręczne klikanie staje się podatne na błędy, a podejście oparte na skryptach jest bardziej praktyczne.
Metoda 2: Narzędzia PDF online i wybór na podstawie wzorca
Kilka internetowych narzędzi PDF obsługuje wyodrębnianie stron w oparciu o wzorce przy użyciu skróconej składni nieparzystej/parzystej. Poszukaj funkcji Podziel, Wyodrębnij lub Wybór strony w interfejsie narzędzia. Po wyświetleniu monitu o podanie numerów stron wprowadź zakres z modyfikatorem nieparzystym lub parzystym. Typowe składnie obejmują 1-100:nieparzyste lub 1-100:parzyste lub po prostu wybranie stron nieparzystych z menu rozwijanego. Narzędzie przetwarza wzorzec po stronie serwera i zwraca plik PDF zawierający tylko pasujące strony.
Narzędzia online wygodnie obsługują dokumenty nawet do kilkuset stron. Czas przetwarzania skaluje się liniowo wraz z liczbą stron. Dokument liczący 200 stron może zająć od 15 do 30 sekund. Większość narzędzi online oferuje również uzupełniającą operację odwrotną. Jeśli wyodrębniasz strony nieparzyste i chcesz mieć także strony parzyste, uruchom wyodrębnianie parzyste w tym samym dokumencie lub zaznacz opcję Podziel na parzyste i nieparzyste, jeśli narzędzie to umożliwia. Natychmiast pobierz oba pliki wyjściowe, ponieważ bezpłatne narzędzia zazwyczaj usuwają przetworzone pliki z serwerów w ciągu kilku godzin.
Metoda 3: Narzędzia wiersza poleceń do przetwarzania wsadowego
Użytkownikom znającym się na wierszu poleceń pdftk i qpdf oferują precyzyjną kontrolę nad wyodrębnianiem nieparzystych i parzystych bez konieczności ręcznego klikania. pdftk obsługuje operację cat z wzorcami zakresów stron. Polecenie pdftk input.pdf cat 1-100odd Output odd_pages.pdf wyodrębnia wszystkie strony nieparzyste z pierwszych 100 stron. W przypadku stron parzystych zamień nieparzyste na parzyste. Narzędzie przetwarza dokument w czasie krótszym niż sekunda w przypadku typowych rozmiarów dokumentów biurowych.
qpdf, bardziej nowoczesna alternatywa, zapewnia podobną funkcjonalność z flagą --pages. Polecenie qpdf --empty --pages input.pdf 1-100:odd -- Output.pdf wybiera strony nieparzyste. qpdf obsługuje zaszyfrowane pliki PDF z większym wdziękiem niż pdftk i podczas wyodrębniania zachowuje szerszy zakres funkcji PDF, w tym zakładki, łącza i pola formularzy.
| Metoda | Najlepsze dla | Ograniczenia |
|---|---|---|
| Acrobat Pro Organizuj strony | Selekcja wizualna, małe zestawy | Ręczny wysiłek dla każdego dokumentu |
| Internetowe narzędzia PDF | Szybka ekstrakcja, bez instalacji | Limity rozmiaru plików w bezpłatnych warstwach |
| Linia poleceń (pdftk, qpdf) | Przetwarzanie wsadowe, skrypty | Wymaga znajomości wiersza poleceń |
| Automatyzacja Pythona | Niestandardowe reguły, duża skala | Wymaga programowania |
W przypadku powtarzających się operacji wsadowych należy zawinąć narzędzie wiersza poleceń w skrypt powłoki, który przegląda folder plików PDF w pętli. Pojedyncza pętla for-bash lub PowerShell może przetworzyć setki dokumentów w ciągu kilku minut. Podejście oparte na wierszu poleceń integruje się również z automatycznymi potokami dokumentów, w których pliki PDF trafiają do obserwowanego folderu, a przetworzone pliki są przenoszone do folderu wyjściowego bez jakiejkolwiek interwencji człowieka.
Automatyzacja ekstrakcji parzystej i nieparzystej za pomocą Pythona
Biblioteki Pythona, takie jak PyPDF2 i pikepdf, umożliwiają programowe wyodrębnianie stron za pomocą niestandardowej logiki wykraczającej poza proste reguły nieparzyste i parzyste. Skrypt w języku Python może czytać plik PDF, przeglądać jego strony, sprawdzać numer strony pod kątem dowolnych warunków i zapisywać pasujące strony w nowym pliku. Logika może łączyć parzystość z innymi filtrami: wyodrębniać strony nieparzyste, ale pomijać strony mniejsze niż określony wymiar lub wyodrębniać strony parzyste tylko wtedy, gdy nie są puste.
Podstawowy skrypt PyPDF2 dla stron nieparzystych wymaga mniej niż 15 linii kodu. Skrypt tworzy obiekt czytnika dla wejściowego pliku PDF, obiekt zapisujący dla danych wyjściowych, przegląda strony za pomocą enumerate z indeksem początkowym równym 1, sprawdza, czy numer strony modulo 2 jest równy 1 dla nieparzystego lub 0 dla parzystego i dodaje pasujące strony do modułu piszącego. Skrypt obsługuje dokumenty o dowolnej długości w sposób spójny, bez konieczności ręcznego wybierania, które ogranicza ekstrakcję w oparciu o graficzny interfejs użytkownika.
Weryfikacja wyniku ekstrakcji
Po zastosowaniu dowolnej metody wyodrębniania sprawdź, czy dane wyjściowe zawierają prawidłowe strony i czy żadna strona nie została porzucona. Otwórz zarówno oryginalne, jak i wyodrębnione pliki PDF obok siebie. Przewiń do kilku znanych stron oryginału, np. stron 3, 7 i 15 w celu wyodrębnienia stron nieparzystych, i potwierdź, że pojawiają się one w wyodrębnionym dokumencie we właściwej kolejności. Sprawdź, czy całkowita liczba stron wyodrębnionego pliku jest zgodna z oczekiwaniami: wyodrębnienie nieparzystej strony ze 100-stronicowego dokumentu powinno dać 50 stron.
Jeśli łącza do stron lub zakładki w oryginalnym pliku PDF wskazywały określone numery stron, odniesienia te zostaną przerwane po wyodrębnieniu z powodu zmiany numeracji stron. Zakładka, która w oryginale wskazywała stronę 42, teraz wskazuje treść, która znalazła się na nowej stronie 42, co jest mało prawdopodobne. W przypadku dokumentów, które w dużym stopniu opierają się na nawigacji wewnętrznej, zaplanuj odbudowanie zakładek po wyodrębnieniu lub użyj narzędzia takiego jak qpdf, które zachowuje miejsca docelowe linków podczas procesu wyboru strony.
Wyodrębnianie stron nieparzystych lub parzystych z pliku PDF to operacja mechaniczna, którą każda z powyższych metod wykonuje niezawodnie. Wybór właściwej metody zależy od tego, ile dokumentów musisz przetworzyć i czy jest to zadanie jednorazowe, czy cykliczne. W przypadku okazjonalnego wyodrębniania z krótkiego dokumentu wybór wizualny w programie Acrobat Pro jest najbardziej intuicyjny. W przypadku przetwarzania wsadowego folderu zeskanowanych dokumentów dwustronnych narzędzia wiersza poleceń przetwarzają je wszystkie za pomocą jednego polecenia. W przypadku zautomatyzowanych potoków dokumentów, w których reguły ekstrakcji łączą się z innymi etapami przetwarzania, skrypt Python zapewnia elastyczność, której nie może zapewnić żadne narzędzie GUI. Niezależnie od wybranej metody zawsze sprawdź liczbę stron wyjściowych i kolejność stron przed zarchiwizowaniem oryginalnego pliku lub wysłaniem wyodrębnionych stron do miejsca docelowego.
Obsługa przypadków Edge w ekstrakcji nieparzystej i parzystej
Niektóre dokumenty nie mają czystego wzoru naprzemiennego. Plik PDF ze stroną tytułową, po której następuje skan dwustronny, zawiera stronę 1 jako jednostronną okładkę i strony od 2 do 101 jako skany dwustronne. Wyodrębnienie nieparzystych stron z całego dokumentu spowodowałoby pobranie okładki i przednich stron, co jest pożądanym rezultatem w większości przypadków użycia. Jeśli chcesz wykluczyć okładkę, przeprowadź wyodrębnianie ze stron 2 do końca: 2-101odd. Większość narzędzi wiersza poleceń i usług online obsługuje łączenie zakresu stron z modyfikatorem nieparzystym lub parzystym.
Dokumenty o różnych rozmiarach stron stanowią kolejny przypadek Edge. Plik PDF zawierający zarówno strony z listami, jak i strony tabloidów, po podzieleniu za pomocą ekstrakcji nieparzystej i parzystej, powoduje prawidłowy wybór stron, ale może powodować problemy w dalszych systemach, które oczekują jednolitych wymiarów strony. Po wyodrębnieniu sprawdź rozmiary stron dokumentu wyjściowego. Jeśli kolejne procesy wymagają jednolitych wymiarów strony, przytnij lub zmień rozmiar wyodrębnionych stron do spójnego formatu przed dalszym przetwarzaniem.
Wypróbuj opcję Podziel plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
