Tips & Tricks

Cómo dividir un PDF y guardar cada página con un nombre de archivo personalizado diferente

Dividir un PDF de 50 páginas en páginas individuales produce 50 archivos denominados página-1.pdf hasta página-50.pdf. Los nombres son técnicamente precisos por la posición física de la página y completamente inútiles por el contenido. La página 7 puede contener el contrato de Smith con la firma y las condiciones de pago. La página 23 podría ser la factura de Jones con las partidas y el total. Cambiar el nombre de los 50 archivos abriendo cada uno individualmente para descubrir lo que contiene y luego escribir un nombre de archivo descriptivo toma casi tanto tiempo como dividir el PDF en primer lugar e introduce el riesgo de errores de nombre que hacen que los archivos no se puedan encontrar más adelante.

La operación de división real lleva unos segundos. El trabajo de cambio de nombre que sigue lleva minutos u horas dependiendo del número de archivos y de si tiene un método para derivar nombres del contenido. Automatizar el paso de denominación es lo que transforma la división de PDF de una tarea tediosa a un flujo de trabajo realmente eficiente.

Dividir un Dividir PDF y guardar cada archivo con un nombre personalizado significativo significa configurar un patrón de nomenclatura antes de dividirlo que derive nombres de la estructura del documento, como marcadores, o usar una herramienta de cambio de nombre por lotes después de la división que lea el texto de cada archivo y genere un nombre descriptivo a partir del contenido. Las herramientas de división PDF Pages de WukongPDF admiten nombres personalizados basados en el texto del marcador, y los métodos siguientes cubren tanto el enfoque estructurado previo a la división como el enfoque de extracción de contenido posterior a la división.

How to Split a PDF and Save Each Page With a Different Custom File Name

Derivar nombres de archivos de la estructura del documento antes de dividir

Cuando el PDF tiene una jerarquía de marcadores bien organizada donde cada marcador de nivel superior corresponde a una sección lógica con un título descriptivo, la división basada en marcadores produce archivos de salida que heredan automáticamente el texto del marcador como nombre de archivo. Un PDF de informes mensuales de clientes donde cada marcador de nivel superior es un nombre de cliente dividido en archivos con el nombre de cada cliente, Smith-Corp.pdf, Jones-LLC.pdf, Acme-Inc.pdf, sin cambio de nombre manual. El texto del marcador debe ser seguro para el sistema de archivos, lo que significa que no puede contener caracteres que los sistemas operativos prohíben en los nombres de archivos, como dos puntos, barras diagonales, barras invertidas, asteriscos o signos de interrogación.

Cuando hay marcadores pero su texto no es adecuado como nombre de archivo, es demasiado largo, contiene caracteres no válidos o utiliza un formato inconsistente, edite el texto del marcador antes de dividirlo. En Adobe Acrobat, abra el panel Marcadores, haga clic derecho en cada marcador, seleccione Cambiar nombre y escriba el nombre de archivo deseado. El paso de edición de marcadores lleva unos minutos para un documento con docenas de secciones, pero el tiempo invertido en limpiar marcadores se amortiza instantáneamente cuando la operación de división produce archivos con nombres perfectos sin mayor intervención.

WukongPDF

Pruebe dividir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →

Extracción de nombres basados en contenido después de dividirlos con nombres genéricos

Cuando la denominación basada en marcadores no está disponible porque el PDF carece completamente de marcadores o el texto del marcador no captura identificadores de contenido significativos, primero divida el documento con nombres secuenciales genéricos y luego cambie el nombre de cada archivo de salida según el texto extraído de su contenido. Una herramienta de cambio de nombre por lotes o un script de Python lee las primeras líneas de texto de la primera página de cada archivo dividido, busca un patrón conocido, como el nombre de un cliente que aparece después de la etiqueta Cliente: o un número de factura después de Número de factura, y utiliza el texto coincidente como nuevo nombre de archivo.

El enfoque de extracción de contenido funciona mejor para documentos estructurados donde cada sección dividida comparte un formato consistente con texto de identificación en una posición predecible. Una carpeta de facturas mensuales donde la primera línea de cada página dice Número de factura seguida de un número y la segunda línea dice Cliente: seguida de un nombre, se puede cambiar el nombre por lotes mediante un script que extrae ambos campos y construye un nombre de archivo como Factura-1234-Acme-Corp.pdf. El script aplica la misma lógica de extracción y denominación a cada archivo del lote, eliminando tanto el tiempo como la tasa de error del cambio de nombre manual.

Creación de secuencias de comandos del flujo de trabajo de división y nombre para trabajos recurrentes

Un trabajo de dividir y nombrar que se repite según una programación, la misma estructura de informe mensual dividida en las mismas secciones con el mismo nombre para la misma lista de distribución cada mes, justifica la creación de un guión permanente en lugar de repetir el proceso manual en cada ciclo. Escriba los rangos de páginas y los nombres de archivos de salida correspondientes en un archivo de configuración una vez. El script lee la configuración, divide el PDF según los rangos especificados y nombra cada archivo de salida con su nombre designado. Cada mes, actualice solo el nombre del archivo PDF de entrada en la configuración. El script maneja todo lo demás de manera idéntica en cada ciclo.

Control de versiones tanto del script como del archivo de configuración. Cuando la estructura del informe cambia, se agrega, elimina o reorganiza una sección, actualice la configuración para que coincida. La lógica del guión se mantiene constante. Esta separación de la lógica de procesamiento, capturada en el script, de los datos específicos del documento, capturados en la configuración, hace que el flujo de trabajo se pueda mantener en el tiempo. La persona que ejecuta la división mensual no necesita comprender ni modificar el guión. Editan el archivo de configuración simple y ejecutan el script.

Método de denominaciónRequisitos previos¿Consciente del contenido?Mejor para
División basada en marcadoresMarcadores bien estructurados con texto limpioSí, nombres derivados de la estructura del documento.Documentos con jerarquías de encabezados
Script de extracción de contenidoPatrones de texto consistentes en cada sección.Sí, nombres derivados del contenido del documento.Formularios estructurados, facturas, informes.
División y nombre con guiónArchivo de configuración con rangos y nombres.Sí, totalmente personalizableTrabajos recurrentes de estructura idéntica

Manejo de conflictos de nombres de archivos y caracteres no válidos

Dos páginas o secciones divididas que producen el mismo nombre extraído, dos facturas del mismo cliente sin número distintivo, crean un conflicto de nombre de archivo donde el segundo archivo no se puede guardar porque ya existe un archivo con ese nombre. Resuelva los conflictos añadiendo un sufijo diferenciador, un número de secuencia, una fecha o cualquier campo que distinga los dos documentos. Invoice-1234-Acme-Corp.pdf e Invoice-1235-Acme-Corp.pdf se distinguen por número de factura. Cuando no haya ningún campo distintivo disponible, agregue un contador de secuencia: Acme-Corp-1.pdf y Acme-Corp-2.pdf.

El texto extraído utilizado como nombres de archivos debe limpiarse de caracteres prohibidos por el sistema operativo. Elimine o reemplace los dos puntos, barras diagonales, barras invertidas, asteriscos, signos de interrogación, corchetes angulares y caracteres de barra vertical con guiones o guiones bajos. Recorte los espacios y puntos iniciales y finales. El paso de limpieza es mundano pero esencial. Un nombre de archivo sin limpiar que contiene un carácter ilegal hace que la operación de cambio de nombre falle con un error del sistema operativo, y diagnosticar cuál de los 50 archivos provocó la falla requiere mucho más tiempo que limpiar todos los nombres de archivo de manera preventiva.

WukongPDF

Pruebe dividir PDF

No se necesita instalación. Funciona directamente en su navegador.

Empezar ahora →