Tips & Tricks

So teilen Sie eine PDF-Datei und speichern jede Seite unter einem anderen benutzerdefinierten Dateinamen

Wenn Sie ein 50-seitiges PDF in einzelne Seiten aufteilen, entstehen 50 Dateien mit den Namen Seite-1.pdf bis Seite-50.pdf. Die Namen sind hinsichtlich der physischen Seitenposition technisch korrekt und hinsichtlich des Inhalts völlig nutzlos. Seite 7 könnte den Smith-Vertrag mit Unterschrift und Zahlungsbedingungen enthalten. Seite 23 könnte die Jones-Rechnung mit Einzelposten und Gesamtsumme sein. Das Umbenennen aller 50 Dateien durch Öffnen jeder einzelnen Datei, um herauszufinden, was sie enthält, und anschließendes Eingeben eines beschreibenden Dateinamens dauert fast genauso lange wie das Aufteilen der PDF-Datei beim ersten Mal und birgt das Risiko von Benennungsfehlern, die Dateien später unauffindbar machen.

Der eigentliche Teilungsvorgang dauert Sekunden. Die anschließende Umbenennung dauert Minuten oder Stunden, abhängig von der Dateianzahl und davon, ob Sie über eine Methode zum Ableiten von Namen aus Inhalten verfügen. Durch die Automatisierung des Benennungsschritts wird die PDF-Aufteilung von einer mühsamen Aufgabe zu einem wirklich effizienten Arbeitsablauf.

Wenn Sie ein Split PDF aufteilen und jede Datei unter einem aussagekräftigen benutzerdefinierten Namen speichern möchten, müssen Sie entweder vor dem Aufteilen ein Benennungsmuster einrichten, das Namen aus der Dokumentstruktur wie Lesezeichen ableitet, oder nach dem Aufteilen ein Batch-Umbenennungstool verwenden, das Text aus jeder Datei liest und aus dem Inhalt einen beschreibenden Namen generiert. WukongPDFs PDF-Seiten-Split-Tools unterstützen benutzerdefinierte Benennung basierend auf Lesezeichentext, und die folgenden Methoden decken sowohl den strukturierten Pre-Split-Ansatz als auch den Inhaltsextraktions-Post-Split-Ansatz ab.

How to Split a PDF and Save Each Page With a Different Custom File Name

Ableiten von Dateinamen aus der Dokumentstruktur vor dem Teilen

Wenn die PDF-Datei über eine gut organisierte Lesezeichenhierarchie verfügt, in der jedes Lesezeichen der obersten Ebene einem logischen Abschnitt mit einem beschreibenden Titel entspricht, werden bei der lesezeichenbasierten Aufteilung Ausgabedateien erstellt, die den Lesezeichentext automatisch als Dateinamen übernehmen. Ein PDF mit monatlichen Kundenberichten, bei dem jedes Lesezeichen auf der obersten Ebene ein Kundenname ist, wird in Dateien aufgeteilt, die nach jedem Kunden benannt sind, Smith-Corp.pdf, Jones-LLC.pdf, Acme-Inc.pdf, ohne manuelles Umbenennen. Der Lesezeichentext muss dateisystemsicher sein, d. h. er darf keine Zeichen enthalten, die Betriebssysteme in Dateinamen verbieten, wie Doppelpunkte, Schrägstriche, Backslashes, Sternchen oder Fragezeichen.

Wenn Lesezeichen vorhanden sind, ihr Text jedoch nicht als Dateiname geeignet ist, zu lang ist, ungültige Zeichen enthält oder eine inkonsistente Formatierung verwendet, bearbeiten Sie den Lesezeichentext vor dem Teilen. Öffnen Sie in Adobe Acrobat das Bedienfeld „Lesezeichen“, klicken Sie mit der rechten Maustaste auf jedes Lesezeichen, wählen Sie „Umbenennen“ und geben Sie den gewünschten Dateinamen ein. Der Bearbeitungsschritt der Lesezeichen dauert bei einem Dokument mit Dutzenden von Abschnitten ein paar Minuten, aber die Zeit, die in saubere Lesezeichen investiert wird, zahlt sich sofort aus, wenn der Aufteilungsvorgang ohne weitere Eingriffe perfekt benannte Dateien erzeugt.

WukongPDF

Probieren Sie Split PDF aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Extrahieren inhaltsbasierter Namen nach der Aufteilung mit generischen Namen

Wenn die lesezeichenbasierte Benennung nicht verfügbar ist, weil in der PDF-Datei überhaupt keine Lesezeichen vorhanden sind oder der Lesezeichentext keine aussagekräftigen Inhaltskennungen erfasst, teilen Sie das Dokument zunächst mit generischen sequenziellen Namen auf und benennen Sie dann jede Ausgabedatei basierend auf dem aus ihrem Inhalt extrahierten Text um. Ein Batch-Umbenennungstool oder ein Python-Skript liest die ersten paar Textzeilen der ersten Seite jeder geteilten Datei, sucht nach einem bekannten Muster, z. B. einem Kundennamen, der nach der Bezeichnung „Kunde:“ erscheint, oder einer Rechnungsnummer nach „Invoice #“, und verwendet den übereinstimmenden Text als neuen Dateinamen.

Der Inhaltsextraktionsansatz eignet sich am besten für strukturierte Dokumente, bei denen jeder geteilte Abschnitt ein einheitliches Format aufweist und den Text an einer vorhersehbaren Position identifiziert. Ein Ordner mit monatlichen Rechnungen, in dem in der ersten Zeile jeder Seite „Rechnung #“ gefolgt von einer Zahl und in der zweiten Zeile „Kunde:“ gefolgt von einem Namen steht, kann ein Skript stapelweise umbenannt werden, das beide Felder extrahiert und einen Dateinamen wie „Invoice-1234-Acme-Corp.pdf“ erstellt. Das Skript wendet auf jede Datei im Stapel dieselbe Extraktions- und Benennungslogik an, wodurch sowohl der Zeitaufwand als auch die Fehlerquote beim manuellen Umbenennen entfallen.

Skripting des Split-and-Name-Workflows für wiederkehrende Aufträge

Ein Split-and-Name-Job, der sich nach einem Zeitplan wiederholt, wobei dieselbe monatliche Berichtsstruktur jeden Monat in dieselben benannten Abschnitte für dieselbe Verteilerliste aufgeteilt wird, rechtfertigt die Erstellung eines permanenten Skripts, anstatt den manuellen Prozess in jedem Zyklus zu wiederholen. Schreiben Sie die Seitenbereiche und die entsprechenden Ausgabedateinamen einmal in eine Konfigurationsdatei. Das Skript liest die Konfiguration, teilt die PDF-Datei entsprechend den angegebenen Bereichen auf und benennt jede Ausgabedatei mit ihrem festgelegten Namen. Aktualisieren Sie jeden Monat nur den eingegebenen PDF-Dateinamen in der Konfiguration. Das Skript behandelt alles andere in jedem Zyklus identisch.

Versionskontrolle sowohl des Skripts als auch der Konfigurationsdatei. Wenn sich die Berichtsstruktur ändert, ein Abschnitt hinzugefügt, entfernt oder neu organisiert wird, aktualisieren Sie die Konfiguration entsprechend. Die Skriptlogik bleibt konstant. Diese Trennung der im Skript erfassten Verarbeitungslogik von den in der Konfiguration erfassten dokumentspezifischen Daten macht den Workflow über die Zeit wartbar. Die Person, die die monatliche Aufteilung ausführt, muss das Skript nicht verstehen oder ändern. Sie bearbeiten die einfache Konfigurationsdatei und führen das Skript aus.

BenennungsmethodeVoraussetzungenInhaltsbewusst?Am besten für
Lesezeichenbasierte AufteilungGut strukturierte Lesezeichen mit klarem TextJa, aus der Dokumentstruktur abgeleitete NamenDokumente mit Überschriftenhierarchien
Skript zur InhaltsextraktionKonsistente Textmuster in jedem AbschnittJa, vom Dokumentinhalt abgeleitete NamenStrukturierte Formulare, Rechnungen, Berichte
Geskriptetes Split-and-NameKonfigurationsdatei mit Bereichen und NamenJa, vollständig anpassbarWiederkehrende Jobs mit identischer Struktur

Umgang mit Dateinamenkonflikten und ungültigen Zeichen

Zwei geteilte Seiten oder Abschnitte, die denselben extrahierten Namen erzeugen, zwei Rechnungen desselben Kunden ohne Unterscheidungsnummer führen zu einem Dateinamenskonflikt, bei dem die zweite Datei nicht gespeichert werden kann, da bereits eine Datei mit diesem Namen vorhanden ist. Lösen Sie Konflikte, indem Sie ein Unterscheidungssuffix, eine Sequenznummer, ein Datum oder ein beliebiges Feld anhängen, das die beiden Dokumente unterscheidet. Invoice-1234-Acme-Corp.pdf und Invoice-1235-Acme-Corp.pdf unterscheiden sich durch die Rechnungsnummer. Wenn kein Unterscheidungsfeld verfügbar ist, fügen Sie einen Sequenzzähler an: Acme-Corp-1.pdf und Acme-Corp-2.pdf.

Extrahierter Text, der als Dateinamen verwendet wird, muss von Zeichen bereinigt werden, die das Betriebssystem verbietet. Entfernen oder ersetzen Sie Doppelpunkte, Schrägstriche, Backslashes, Sternchen, Fragezeichen, spitze Klammern und Pipe-Zeichen durch Bindestriche oder Unterstriche. Schneiden Sie führende und nachfolgende Leerzeichen und Punkte ab. Der Reinigungsschritt ist banal, aber unerlässlich. Ein ungereinigter Dateiname, der ein ungültiges Zeichen enthält, führt dazu, dass der Umbenennungsvorgang mit einem Betriebssystemfehler fehlschlägt, und die Diagnose, welche der 50 Dateien den Fehler ausgelöst hat, ist weitaus zeitaufwändiger als die präventive Bereinigung aller Dateinamen.

WukongPDF

Probieren Sie Split PDF aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →