Escanee un libro abierto o un informe encuadernado en un escáner de superficie plana. Cada escaneo captura dos páginas una al lado de la otra, la página izquierda y la página derecha, como una única imagen ancha. Cuando ve el PDF resultante, cada hoja tiene una extensión de doble página. El texto de la página izquierda coincide con el texto de la página derecha. La búsqueda de una frase que se extiende a lo largo del margen entre las dos páginas no arroja nada. El PDF es visualmente fiel al libro original, pero resulta prácticamente inservible como documento de lectura.
Separar un documento escaneado de dos páginas en archivos PDF individuales de una sola página es una necesidad común para cualquiera que digitalice libros, informes encuadernados o revistas. El proceso implica dividir cada página de doble ancho por la mitad y reordenar las mitades en un documento secuencial de una sola página. Con el enfoque correcto, un libro escaneado de 100 páginas, 50 pliegos, se convierte en un PDF de 200 páginas que se lee correctamente de principio a fin.

Comprender el problema de las dos páginas
Cuando se escanea un libro en una superficie plana, el escáner captura toda el área del vidrio como una sola imagen. Si ambas páginas de un libro abierto caben en el cristal, el escaneo muestra dos páginas una al lado de la otra. El PDF trata esto como una única página orientada apaisada. Las dimensiones de la página pueden ser de 11 por 8,5 pulgadas, más anchas que altas. Cada página del libro original ocupa aproximadamente la mitad del área escaneada. El desafío es dividir esta página ancha en dos páginas orientadas a retratos, cada una de las cuales contiene una página de libro.
La simple división en el centro exacto funciona para escaneos perfectamente alineados, pero los escaneos de libros rara vez son perfectos. La columna vertebral puede crear una distorsión curva cerca del canalón. Es posible que las páginas izquierda y derecha no tengan el mismo ancho. Es posible que el libro se haya desplazado ligeramente entre escaneos, lo que hace que el punto de división varíe de una página a otra. Un buen método Split PDF para escanear libros debe abordar estas inconsistencias.
Pruebe dividir PDF
No se necesita instalación. Funciona directamente en su navegador.
Método 1: Recortar cada extensión en mitades izquierda y derecha
El método más confiable es un proceso de dos pasos: recortar cada pliego para extraer la página izquierda y luego recortar nuevamente para extraer la página derecha. Abra el PDF escaneado. Utilice la herramienta de recorte para seleccionar la mitad izquierda de cada página. Aplique el recorte, que oculta todo lo que está fuera del cuadro de recorte. Guarde el archivo como la versión de la página izquierda. Luego vuelva a abrir el original, recórtelo a la mitad derecha y guárdelo como la versión de la página derecha. Finalmente, intercale los dos archivos: página 1 del archivo izquierdo, página 1 del archivo derecho, página 2 del archivo izquierdo, página 2 del archivo derecho, etc.
La herramienta de recorte admite guardar regiones de recorte como ajustes preestablecidos con nombre, por lo que puede definir la mitad izquierda y la mitad derecha una vez y aplicarlas a todas las páginas con un solo clic. La herramienta también admite la aplicación de un recorte por lotes a todas las páginas pares o impares, lo cual resulta útil cuando todos los pliegos comparten un diseño coherente.
Método 2: Dividir por dimensiones de página
Si cada pliego tiene exactamente el mismo ancho, lo cual es común en los escaneos realizados con un alimentador automático de documentos o un escáner de libros dedicado, una división basada en dimensiones es más rápida que el recorte manual. Divida el ancho de la página por dos y establezca el punto de división en esa coordenada. Una extensión de 11 pulgadas de ancho se divide en 5,5 pulgadas. Aplique la división a todas las páginas de manera uniforme. Este método es rápido, requiere una sola operación para todo el documento, pero falla cuando los pliegos no están perfectamente centrados o cuando el libro cambia entre escaneos.
Para documentos escaneados en una superficie plana donde cada pliego se colocó manualmente, la división basada en dimensiones a menudo produce resultados aceptables si el operador fue razonablemente consistente. Para comprobarlo, divida las primeras páginas y verifique que no haya ningún texto cortado en la línea de división. Si la división recorta constantemente el contenido en un lado, ajuste la coordenada de división e inténtelo de nuevo. Una vez que se verifique el punto de división en una muestra, aplíquelo a todas las páginas.
Método 3: Uso de OCR para detectar el canal y la división automática
Algunos programas de escaneo avanzados incluyen detección automática de propagación. El software analiza cada página escaneada, identifica la banda vertical oscura del margen del libro y divide la página a lo largo de esa línea. Esto produce la división más precisa porque se adapta al contenido real de cada página en lugar de utilizar una coordenada fija. El margen interior suele ser la región vertical más oscura de la página y se detecta de forma fiable mediante algoritmos de análisis de imágenes.
El procesamiento PDF escaneado de WukongPDF incluye detección automática de márgenes para escaneos de libros. Cargue el escaneo y la herramienta identificará la sombra del lomo en cada página, calculará la línea de división óptima y generará un PDF de una sola página con las páginas en el orden de lectura correcto. Se recomienda la revisión manual de los resultados de la división, especialmente para páginas con imágenes a sangre completa que cruzan el margen, donde la detección automática puede colocar la línea de división en el medio de la imagen en lugar de en el margen.
Reordenar páginas después de dividir
La división de un pliego escaneado genera páginas que deben reordenarse en una secuencia de lectura. Un libro escaneado como pliego produce páginas en este orden: pliego 1 a la izquierda, pliego 1 a la derecha, pliego 2 a la izquierda, pliego 2 a la derecha. El orden de lectura correcto es: extendido 1 a la derecha, extendido 2 a la izquierda, extendido 2 a la derecha, extendido 3 a la izquierda. La primera página de la izquierda suele ser la portada interior o una página en blanco que precede a la página del título, así que verifique la secuencia prevista con el libro físico.
El paso de reordenamiento es manual pero sencillo. Abra el PDF dividido en un visor que muestre miniaturas de páginas. Arrastre las páginas en el orden correcto. La herramienta de reordenamiento de páginas de WukongPDF muestra todas las páginas como una cuadrícula de miniaturas, lo que facilita ver y corregir la secuencia. Un libro de 200 páginas tarda entre 10 y 15 minutos en volver a ordenarse correctamente. El tiempo está bien invertido porque un PDF ordenado correctamente de un libro escaneado se lee naturalmente de principio a fin, mientras que uno ordenado incorrectamente obliga al lector a saltar de una página a otra, que es exactamente el problema que la división pretendía resolver.
Después de dividir y reordenar, ejecute OCR en el PDF final de una sola página. El texto de cada página ahora está correctamente orientado y aislado, lo que mejora la precisión del OCR en comparación con la ejecución del OCR en páginas dobles. El OCR de una sola página también produce una capa de texto donde el orden de lectura coincide con la secuencia de páginas, por lo que la búsqueda de una frase arroja resultados en el orden de páginas correcto. Las PDF Pages transformadas son ahora un libro digital con una secuencia adecuada y con capacidad de búsqueda, en lugar de un montón de imágenes ilegibles de dos páginas.
Para escaneos de libros con puntos de división desiguales donde las páginas izquierda y derecha no tienen el mismo ancho en todo el documento, vale la pena recortar manualmente página por página los documentos a los que hará referencia repetidamente. La detección automática de medianil maneja correctamente el 80% de las páginas. El 20% restante necesita atención individual, generalmente páginas al principio y al final de los capítulos donde cambia el diseño de la página, o páginas con ilustraciones a sangrado completo que se extienden a lo largo del margen. En esas páginas, la división automática puede cortar por la mitad de una imagen o dejar visible una parte de la página opuesta. Abrir la miniatura de cada página después de dividirla y verificar las primeras y últimas palabras de cada línea confirma que no se perdió ningún contenido en el límite de división. El pase de verificación tarda aproximadamente 30 segundos por página y transforma una división que es mayoritariamente correcta en una que es exactamente correcta.
Pruebe dividir PDF
No se necesita instalación. Funciona directamente en su navegador.
