La divisione di un PDF di 50 pagine in singole pagine produce 50 file denominati da pagina-1.pdf a pagina-50.pdf. I nomi sono tecnicamente accurati in base alla posizione fisica della pagina e completamente inutili in termini di contenuto. La pagina 7 potrebbe contenere il contratto Smith con firma e termini di pagamento. La pagina 23 potrebbe essere la fattura Jones con le voci e il totale. Rinominare tutti i 50 file aprendoli singolarmente per scoprire cosa contiene e quindi digitando un nome file descrittivo, richiede quasi lo stesso tempo richiesto inizialmente per dividere il PDF e introduce il rischio di errori di denominazione che rendono i file introvabili in seguito.
L'effettiva operazione di suddivisione richiede pochi secondi. Il lavoro di ridenominazione che segue richiede minuti o ore a seconda del numero di file e se si dispone di un metodo per derivare i nomi dal contenuto. Automatizzare la fase di denominazione è ciò che trasforma la suddivisione dei PDF da un compito noioso in un flusso di lavoro effettivamente efficiente.
Dividere un PDF diviso e salvare ogni file con un nome personalizzato significativo significa impostare un modello di denominazione prima della divisione che faccia derivare i nomi dalla struttura del documento come i segnalibri, oppure utilizzare uno strumento di ridenominazione batch dopo la divisione che legga il testo da ciascun file e generi un nome descrittivo dal contenuto. Gli strumenti di divisione Pagine PDF di WukongPDF supportano la denominazione personalizzata basata sul testo del segnalibro e i metodi seguenti coprono sia l'approccio pre-divisione strutturato che l'approccio post-divisione di estrazione del contenuto.

Derivare i nomi dei file dalla struttura del documento prima della divisione
Quando il PDF presenta una gerarchia di segnalibri ben organizzata in cui ciascun segnalibro di livello superiore corrisponde a una sezione logica con un titolo descrittivo, la suddivisione basata sui segnalibri produce file di output che ereditano automaticamente il testo del segnalibro come nome file. Un PDF di report mensili sui clienti in cui ogni segnalibro di livello superiore è il nome di un cliente suddiviso in file denominati in base a ciascun cliente, Smith-Corp.pdf, Jones-LLC.pdf, Acme-Inc.pdf, senza ridenominazione manuale. Il testo del segnalibro deve essere sicuro per il file system, ovvero non può contenere caratteri vietati dai sistemi operativi nei nomi di file, ad esempio due punti, barre, barre rovesciate, asterischi o punti interrogativi.
Quando sono presenti segnalibri ma il loro testo non è adatto come nome file, è troppo lungo, contiene caratteri non validi o utilizza una formattazione incoerente, modificare il testo del segnalibro prima di dividerlo. In Adobe Acrobat, apri il pannello Segnalibri, fai clic con il pulsante destro del mouse su ciascun segnalibro, seleziona Rinomina e digita il nome file desiderato. La fase di modifica dei segnalibri richiede alcuni minuti per un documento con decine di sezioni, ma il tempo investito nella pulizia dei segnalibri viene ripagato immediatamente quando l'operazione di divisione produce file con nomi perfetti senza ulteriori interventi.
Prova Dividi PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Estrazione dei nomi basati sul contenuto dopo la suddivisione con nomi generici
Quando la denominazione basata sui segnalibri non è disponibile perché il PDF è completamente privo di segnalibri o il testo del segnalibro non acquisisce identificatori di contenuto significativi, dividere prima il documento con nomi sequenziali generici, quindi rinominare ciascun file di output in base al testo estratto dal suo contenuto. Uno strumento di ridenominazione batch o uno script Python legge le prime righe di testo dalla prima pagina di ogni file diviso, cerca un modello noto come il nome di un cliente che appare dopo l'etichetta Cliente: o un numero di fattura dopo la fattura # e utilizza il testo corrispondente come nuovo nome file.
L'approccio di estrazione del contenuto funziona meglio per i documenti strutturati in cui ciascuna sezione divisa condivide un formato coerente con l'identificazione del testo in una posizione prevedibile. Una cartella di fatture mensili in cui la prima riga di ogni pagina riporta Fattura n. seguita da un numero e la seconda riga riporta Cliente: seguito da un nome può essere rinominata in batch da uno script che estrae entrambi i campi e costruisce un nome file come Invoice-1234-Acme-Corp.pdf. Lo script applica la stessa logica di estrazione e denominazione a ogni file del batch, eliminando sia il tempo che il tasso di errore della ridenominazione manuale.
Scripting del flusso di lavoro di divisione e nome per lavori ricorrenti
Un lavoro suddiviso e denominato che si ripete secondo una pianificazione, la stessa struttura di report mensile suddivisa nelle stesse sezioni con lo stesso nome per la stessa lista di distribuzione ogni mese, giustifica la creazione di uno script permanente anziché ripetere il processo manuale ogni ciclo. Scrivi una volta gli intervalli di pagine e i nomi dei file di output corrispondenti in un file di configurazione. Lo script legge la configurazione, divide il PDF in base agli intervalli specificati e assegna a ciascun file di output il nome designato. Ogni mese, aggiorna solo il nome del file PDF di input nella configurazione. Lo script gestisce tutto il resto in modo identico in ogni ciclo.
Controlla la versione sia dello script che del file di configurazione. Quando la struttura del report cambia, una sezione viene aggiunta, rimossa o riorganizzata, aggiorna la configurazione in modo che corrisponda. La logica dello script rimane costante. Questa separazione della logica di elaborazione, catturata nello script, dai dati specifici del documento, catturati nella configurazione, rende il flusso di lavoro mantenibile nel tempo. Non è necessario che la persona che esegue la suddivisione mensile comprenda o modifichi lo script. Modificano il semplice file di configurazione ed eseguono lo script.
| Metodo di denominazione | Prerequisiti | Content-Aware? | Ideale per |
|---|---|---|---|
| Divisione basata sui segnalibri | Segnalibri ben strutturati con testo pulito | Sì, nomi derivati dalla struttura del documento | Documenti con gerarchie di intestazioni |
| Script di estrazione del contenuto | Modelli di testo coerenti in ogni sezione | Sì, nomi derivati dal contenuto del documento | Moduli strutturati, fatture, report |
| Divisione e nome tramite script | File di configurazione con intervalli e nomi | Sì, completamente personalizzabile | Lavori ricorrenti con struttura identica |
Gestione dei conflitti tra i nomi dei file e dei caratteri non validi
Due pagine o sezioni divise che producono lo stesso nome estratto, due fatture dello stesso cliente senza numero distintivo, creano un conflitto di nomi di file in cui il secondo file non può essere salvato perché esiste già un file con quel nome. Risolvi i conflitti aggiungendo un suffisso differenziante, un numero di sequenza, una data o qualunque campo distingua i due documenti. Invoice-1234-Acme-Corp.pdf e Invoice-1235-Acme-Corp.pdf si distinguono per numero di fattura. Quando non è disponibile alcun campo distintivo, aggiungi un contatore di sequenza: Acme-Corp-1.pdf e Acme-Corp-2.pdf.
Il testo estratto utilizzato come nome file deve essere ripulito dai caratteri vietati dal sistema operativo. Rimuovere o sostituire i due punti, le barre, le barre rovesciate, gli asterischi, i punti interrogativi, le parentesi angolari e i caratteri pipe con trattini o caratteri di sottolineatura. Taglia gli spazi e i periodi iniziali e finali. La fase di pulizia è banale ma essenziale. Un nome file non ripulito che contiene un carattere non valido causa il fallimento dell'operazione di ridenominazione con un errore del sistema operativo e diagnosticare quale dei 50 file ha attivato l'errore richiede molto più tempo rispetto alla pulizia preventiva di tutti i nomi file.
Prova Dividi PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
