Tips & Tricks

So extrahieren Sie nur ungerade oder gerade Seiten aus einer PDF-Datei

Das Extrahieren nur ungerader oder nur gerader Seiten aus einer PDF-Datei ist eine überraschend häufige Aufgabe. Ein doppelseitiger Scanner hat möglicherweise jedes Blatt als zwei separate Seiten erfasst, für einen Bericht benötigen Sie jedoch nur die Vorderseiten. In einem zusammengeführten Dokument können Inhaltsseiten mit leeren Platzhalterseiten vermischt sein, die entfernt werden müssen. Oder ein Druckauftrag erfordert die Aufteilung eines Duplexdokuments in zwei einseitige Dateien für einen Drucker, der den automatischen Duplexdruck nicht unterstützt. Split PDF-Tools machen diese Extraktion unkompliziert, sobald Sie die musterbasierte Seitenauswahllogik verstanden haben.

Das zugrunde liegende Prinzip ist bei allen Extraktionsmethoden dasselbe: Definieren Sie einen Seitenbereich mithilfe eines ungeraden oder geraden Filters und exportieren Sie dann nur die Seiten, die dem Filter entsprechen. Bei einem 100-seitigen PDF, bei dem Sie alle ungeraden Seiten haben möchten, müssen Sie die Seiten 1, 3, 5 bis 99 exportieren. Die meisten PDF-Tools unterstützen dies durch eine einfache Musternotation. Der Unterschied zwischen den Tools besteht darin, ob Sie die Seitenzahlen manuell eingeben müssen oder ob sie eine Abkürzung wie 1-100:ungerade akzeptieren.

Die PDF-Seiten-Tools von WukongPDF umfassen Funktionen zum Extrahieren und Teilen von Seiten, die die musterbasierte Auswahl direkt im Browser durchführen. Für Stapelvorgänge an großen Dokumentensätzen bieten die unten beschriebenen Befehlszeilen- und Skriptansätze eine bessere Automatisierung.

How to Extract Only Odd or Even Pages From a PDF

Warum ungerade oder gerade Seiten extrahieren?

In der Praxis ist der Umgang mit beidseitig gescannten Dokumenten das häufigste Szenario. Ein im Duplexmodus eingestellter Scanner erfasst die Vorderseite von Seite 1 als Seite 1, die Rückseite als Seite 2, die Vorderseite von Seite 2 als Seite 3 usw. Wenn Sie nur die Vorderseiten jedes Blattes benötigen, extrahieren Sie ungerade Seiten. Wenn Sie nur die Rückseiten benötigen, extrahieren Sie gerade Seiten. Dieser Arbeitsablauf ist Standard bei Archivierungsdigitalisierungsprojekten, der Verarbeitung von Rechtsdokumenten und Buchhaltungsabteilungen, die beide Seiten von Belegen scannen, aber nur die Vorderseiten ablegen.

Ein weiterer häufiger Fall sind Dokumente mit wechselndem Inhalt und leeren Seiten. Einige PDF-Generatoren fügen nach jeder Inhaltsseite eine leere Seite ein, um zu erzwingen, dass neue Kapitel im Drucklayout immer auf der rechten Seite beginnen. Wenn das Dokument auf eine rein digitale Verbreitung umgestellt wird, verursachen diese leeren Seiten visuelles Rauschen und erhöhen die Dateigröße, ohne dass Informationen dazu beitragen. Durch das Extrahieren nur der nicht leeren Seiten, die häufig einem ungeraden oder geraden Muster folgen, wird das Dokument bereinigt. Stellen Sie vor dem Extrahieren nach Parität sicher, dass die leeren Seiten im gesamten Dokument konsistent an einer ungeraden oder geraden Position stehen.

Auch Druckereien nutzen die Ungerade-Gerade-Extraktion, um Dokumente für bestimmte Bindemethoden vorzubereiten. Für die Klebebindung sind separate Stapel für Vorder- und Rückseite erforderlich. Ein PDF-Batch-Vorgang, der ein Buch-PDF in seine ungeraden und geraden Komponenten aufteilt, bereitet beide Stapel in Sekunden vor.

WukongPDF

Probieren Sie Split PDF aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Methode 1: Verwenden der Funktion „Seiten organisieren“ von Adobe Acrobat Pro

Acrobat Pro bietet den visuellsten Ansatz für die Ungerade-Gerade-Extraktion. Öffnen Sie die PDF-Datei, gehen Sie zu „Extras“ und dann zu „Seiten organisieren“. In der Miniaturansicht wird jede Seite mit ihrer Seitennummer angezeigt. Klicken Sie auf das Dropdown-Menü „Seiten auswählen“ und wählen Sie „Seitenbereich“. Geben Sie das Muster für ungerade Seiten ein, indem Sie einzelne Seitenzahlen manuell eingeben, z. B. 1,3,5,7 für ein kleines Dokument. Bei längeren Dokumenten unterstützt Acrobat nativ keine ungerade/gerade Kurzschrift, daher müssen Sie entweder die vollständige Sequenz eingeben oder eine Problemumgehung verwenden.

Der praktische Workaround für längere Dokumente in Acrobat Pro besteht darin, das Extrahieren-Tool mit einem Workaround-Ansatz zu verwenden. Öffnen Sie das Seitenbedienfeld auf der linken Seite, wählen Sie die erste ungerade Seite aus, indem Sie auf deren Miniaturansicht klicken, halten Sie dann die Strg-Taste gedrückt und klicken Sie auf jede weitere ungerade Seite. Sobald alle Zielseiten ausgewählt sind, klicken Sie mit der rechten Maustaste und wählen Sie „Seiten extrahieren“. Aktivieren Sie im Dialogfeld „Seiten als separate Dateien extrahieren“, wenn Sie einzelne Seitendateien möchten, oder lassen Sie die Option deaktiviert, um eine kombinierte PDF-Datei zu erhalten. Klicken Sie auf OK. Acrobat erstellt ein neues PDF, das nur die ausgewählten Seiten enthält. Diese Methode ist für Dokumente bis etwa 30 Seiten geeignet. Darüber hinaus wird das manuelle Klicken fehleranfällig und ein Skriptansatz ist praktischer.

Methode 2: Online-PDF-Tools und musterbasierte Auswahl

Mehrere Online-PDF-Tools unterstützen die musterbasierte Seitenextraktion mit einer ungeraden/geraden Kurzschriftsyntax. Suchen Sie in der Benutzeroberfläche des Tools nach einer Funktion zum Teilen, Extrahieren oder zur Seitenauswahl. Wenn Sie zur Eingabe von Seitenzahlen aufgefordert werden, geben Sie einen Bereich mit dem Modifikator „ungerade“ oder „gerade“ ein. Zu den gängigen Syntaxen gehören 1-100:ungerade oder 1-100:gerade oder die einfache Auswahl von ungeraden Seiten aus einem Dropdown-Menü. Das Tool verarbeitet das Muster serverseitig und gibt ein PDF zurück, das nur die passenden Seiten enthält.

Online-Tools verarbeiten Dokumente mit bis zu mehreren hundert Seiten komfortabel. Die Verarbeitungszeit skaliert linear mit der Seitenanzahl. Ein 200-seitiges Dokument kann 15 bis 30 Sekunden dauern. Die meisten Online-Tools bieten auch eine ergänzende Umkehroperation an. Wenn Sie ungerade Seiten extrahieren und auch die geraden Seiten möchten, führen Sie die gerade Extraktion für dasselbe Dokument durch oder aktivieren Sie die Option „In ungerade und gerade aufteilen“, sofern das Tool dies bietet. Laden Sie beide Ausgabedateien sofort herunter, da kostenlose Tools verarbeitete Dateien normalerweise innerhalb von Stunden von ihren Servern löschen.

Methode 3: Befehlszeilentools für die Stapelverarbeitung

Für Benutzer, die mit der Befehlszeile vertraut sind, bieten pdftk und qpdf eine präzise Kontrolle über die ungerade-gerade-Extraktion ohne manuelles Klicken. pdftk unterstützt die Cat-Operation mit Seitenbereichsmustern. Der Befehl pdftk input.pdf cat 1-100odd output odd_pages.pdf extrahiert alle ungeraden Seiten aus den ersten 100 Seiten. Ersetzen Sie ungerade durch gerade für gerade Seiten. Das Tool verarbeitet das Dokument bei typischen Office-Dokumentgrößen in weniger als einer Sekunde.

qpdf, eine modernere Alternative, bietet ähnliche Funktionalität mit dem Flag --pages. Der Befehl qpdf --empty --pages input.pdf 1-100:odd --output.pdf wählt ungerade Seiten aus. qpdf verarbeitet verschlüsselte PDFs eleganter als pdftk und behält beim Extrahieren eine größere Auswahl an PDF-Funktionen bei, darunter Lesezeichen, Links und Formularfelder.

MethodeAm besten fürEinschränkung
Acrobat Pro Seiten organisierenVisuelle Auswahl, kleine SetsManueller Aufwand pro Dokument
Online-PDF-ToolsSchnelle Extraktion, keine InstallationDateigrößenbeschränkungen für kostenlose Stufen
Befehlszeile (pdftk, qpdf)Stapelverarbeitung, SkripterstellungErfordert Befehlszeilenkenntnisse
Python-AutomatisierungBenutzerdefinierte Regeln, großer MaßstabErfordert Programmierung

Für wiederkehrende Stapelvorgänge binden Sie das Befehlszeilentool in ein Shell-Skript ein, das einen Ordner mit PDFs durchläuft. Eine einzelne Bash- oder PowerShell-For-Schleife kann Hunderte von Dokumenten in Minuten verarbeiten. Der Befehlszeilenansatz lässt sich auch in automatisierte Dokumentpipelines integrieren, bei denen PDFs in einem überwachten Ordner ankommen und verarbeitete Dateien ohne menschliches Eingreifen in einen Ausgabeordner verschoben werden.

Automatisieren der Odd-Even-Extraktion mit Python

Python-Bibliotheken wie PyPDF2 und pikepdf ermöglichen die programmgesteuerte Seitenextraktion mit benutzerdefinierter Logik, die über einfache Ungerade-Gerade-Regeln hinausgeht. Ein Python-Skript kann eine PDF-Datei lesen, ihre Seiten durchlaufen, die Seitenzahl anhand einer beliebigen Bedingung prüfen und übereinstimmende Seiten in einer neuen Datei speichern. Die Logik kann Parität mit anderen Filtern kombinieren: ungerade Seiten extrahieren, aber Seiten überspringen, die kleiner als eine bestimmte Dimension sind, oder gerade Seiten nur extrahieren, wenn sie nicht leer sind.

Ein einfaches PyPDF2-Skript für ungerade Seiten erfordert weniger als 15 Codezeilen. Das Skript erstellt ein Reader-Objekt für die Eingabe-PDF-Datei und ein Writer-Objekt für die Ausgabe, durchläuft die Seiten mithilfe von Enumerate mit einem Startindex von 1, prüft, ob die Seitenzahl Modulo 2 gleich 1 für ungerade oder 0 für gerade ist, und fügt dem Writer passende Seiten hinzu. Das Skript verarbeitet Dokumente beliebiger Länge konsistent, ohne dass die manuelle Auswahl ermüdend ist, was die GUI-basierte Extraktion einschränkt.

Überprüfung des Extraktionsergebnisses

Überprüfen Sie nach jeder Extraktionsmethode, ob die Ausgabe die richtigen Seiten enthält und keine Seiten gelöscht wurden. Öffnen Sie sowohl das Original als auch die extrahierten PDFs nebeneinander. Scrollen Sie zu einigen bekannten Seiten des Originals, z. B. den Seiten 3, 7 und 15 für eine Extraktion ungerader Seiten, und vergewissern Sie sich, dass sie im extrahierten Dokument in der richtigen Reihenfolge angezeigt werden. Überprüfen Sie, ob die Gesamtseitenzahl der extrahierten Datei den Erwartungen entspricht: Eine Extraktion ungerader Seiten aus einem 100-seitigen Dokument sollte 50 Seiten ergeben.

Wenn Seitenlinks oder Lesezeichen in der Original-PDF-Datei auf bestimmte Seitenzahlen verwiesen, werden diese Verweise nach dem Extrahieren unterbrochen, da sich die Seitennummerierung verschoben hat. Ein Lesezeichen, das im Original auf Seite 42 verwies, verweist jetzt auf den Inhalt, der an der neuen Position auf Seite 42 gelandet ist, was wahrscheinlich nicht korrekt ist. Planen Sie für Dokumente, die stark auf die interne Navigation angewiesen sind, die Neuerstellung der Lesezeichen nach der Extraktion ein oder verwenden Sie ein Tool wie qpdf, das die Linkziele während des Seitenauswahlprozesses beibehält.

Das Extrahieren ungerader oder gerader Seiten aus einer PDF-Datei ist ein mechanischer Vorgang, den jede der oben genannten Methoden zuverlässig bewältigt. Die Wahl der richtigen Methode hängt davon ab, wie viele Dokumente Sie verarbeiten müssen und ob es sich um eine einmalige Aufgabe oder einen wiederkehrenden Arbeitsablauf handelt. Für die gelegentliche Extraktion eines kurzen Dokuments ist die visuelle Auswahl von Acrobat Pro am intuitivsten. Für die Stapelverarbeitung eines Ordners mit gescannten Duplexdokumenten verarbeiten Befehlszeilentools sie alle mit einem einzigen Befehl. Für automatisierte Dokumentpipelines, in denen Extraktionsregeln mit anderen Verarbeitungsschritten kombiniert werden, bietet ein Python-Skript die Flexibilität, die kein GUI-Tool bieten kann. Welche Methode Sie auch wählen, überprüfen Sie immer die Anzahl der Ausgabeseiten und die Seitenreihenfolge, bevor Sie die Originaldatei archivieren oder die extrahierten Seiten an ihr Ziel senden.

Umgang mit Randfällen bei der Ungerade-Gerade-Extraktion

Einige Dokumente folgen keinem sauberen Wechselmuster. Eine PDF-Datei mit einem Deckblatt, gefolgt von beidseitig gescannten Inhalten, enthält Seite 1 als einseitiges Deckblatt und Seiten 2 bis 101 als doppelseitige Scans. Das Extrahieren ungerader Seiten aus dem gesamten Dokument würde das Deckblatt und die Vorderseiten erfassen, was in den meisten Anwendungsfällen das gewünschte Ergebnis ist. Wenn Sie das Cover ausschließen müssen, führen Sie die Extraktion auf Seite 2 bis zum Ende durch: 2-101odd. Die meisten Befehlszeilentools und Onlinedienste unterstützen die Kombination eines Seitenbereichs mit dem ungeraden oder geraden Modifikator.

Einen weiteren Grenzfall stellen Dokumente mit gemischten Seitengrößen dar. Eine PDF-Datei, die sowohl Letter- als auch Tabloidseiten enthält, führt bei der Aufteilung durch Ungerade-Gerade-Extraktion zu einer korrekten Seitenauswahl, kann jedoch in nachgelagerten Systemen, die einheitliche Seitenabmessungen erwarten, zu Problemen führen. Überprüfen Sie nach der Extraktion die Seitengrößen des Ausgabedokuments. Wenn nachfolgende Prozesse einheitliche Seitenabmessungen erfordern, schneiden Sie die extrahierten Seiten zu oder ändern Sie ihre Größe, um sie vor der weiteren Verarbeitung auf ein einheitliches Format zu bringen.

WukongPDF

Probieren Sie Split PDF aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →