PDF에서 홀수 페이지만 추출하거나 짝수 페이지만 추출하는 것은 놀라울 정도로 일반적인 작업입니다. 양면 스캐너는 모든 시트를 두 개의 별도 페이지로 캡처할 수 있지만 보고서에는 앞면만 필요합니다. 병합된 문서에서는 제거해야 하는 빈 자리 표시자 페이지와 콘텐츠 페이지가 혼합될 수 있습니다. 또는 자동 양면 인쇄를 지원하지 않는 프린터의 경우 인쇄 작업을 위해 양면 문서를 두 개의 단면 파일로 분할해야 합니다. PDF 분할 도구를 사용하면 패턴 기반 페이지 선택 논리를 이해하면 이러한 추출이 간단해집니다.
기본 원칙은 모든 추출 방법에서 동일합니다. 즉, 홀수 또는 짝수 필터를 사용하여 페이지 범위를 정의한 다음 필터와 일치하는 페이지만 내보냅니다. 홀수 페이지를 모두 원하는 100페이지 PDF는 1, 3, 5, 99페이지를 내보내는 것을 의미합니다. 대부분의 PDF 도구는 간단한 패턴 표기법을 통해 이를 지원합니다. 도구 간의 차이점은 페이지 번호를 수동으로 입력해야 하는지 아니면 1-100:odd와 같은 단축어를 허용하는지에 있습니다.
WukongPDF의 PDF 페이지 도구에는 브라우저에서 직접 패턴 기반 선택을 처리하는 페이지 추출 및 분할 기능이 포함되어 있습니다. 대규모 문서 세트에 대한 일괄 작업의 경우 아래에 설명된 명령줄 및 스크립팅 접근 방식이 더 나은 자동화를 제공합니다.

홀수 또는 짝수 페이지를 추출하는 이유
실제로 가장 일반적인 시나리오는 양면 스캔 문서를 처리하는 것입니다. 양면 모드로 설정된 스캐너는 1페이지의 앞면을 1페이지로, 뒷면을 2페이지로, 2페이지의 앞면을 3페이지로 캡처합니다. 모든 시트의 앞면만 필요한 경우 홀수 페이지를 추출합니다. 뒷면만 필요한 경우 짝수 페이지를 추출합니다. 이 워크플로우는 영수증의 양면을 스캔하고 앞면만 보관하는 보관 디지털화 프로젝트, 법률 문서 처리 및 회계 부서의 표준입니다.
또 다른 일반적인 경우에는 내용과 빈 페이지가 번갈아 나타나는 문서가 포함됩니다. 일부 PDF 생성기는 새 장이 항상 인쇄 조판기의 오른쪽 페이지에서 시작되도록 하기 위해 모든 콘텐츠 페이지 뒤에 빈 페이지를 삽입합니다. 문서가 디지털 전용 배포로 이동하면 해당 빈 페이지는 시각적 노이즈를 추가하고 정보를 제공하지 않고 파일 크기를 증가시킵니다. 종종 홀수 또는 짝수 패턴을 따르는 비어 있지 않은 페이지만 추출하면 문서가 정리됩니다. 패리티로 추출하기 전에 빈 페이지가 전체 문서에서 일관되게 홀수 또는 짝수 위치를 따르는지 확인하십시오.
인쇄소에서는 홀짝수 추출을 사용하여 특정 제본 방법에 맞는 문서를 준비하기도 합니다. 무선 제본에는 앞 페이지와 뒷 페이지에 대한 별도의 스택이 필요합니다. 책 PDF를 홀수 및 짝수 구성 요소로 분할하는 PDF Batch 작업은 몇 초 안에 두 스택을 모두 준비합니다.
PDF 분할을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
방법 1: Adobe Acrobat Pro의 페이지 구성 사용
Acrobat Pro는 홀짝수 추출에 대한 가장 시각적인 접근 방식을 제공합니다. PDF를 열고 도구로 이동한 다음 페이지 구성으로 이동하세요. 축소판 보기에는 모든 페이지가 페이지 번호와 함께 표시됩니다. 페이지 선택 드롭다운을 클릭하고 페이지 범위를 선택합니다. 작은 문서의 경우 1,3,5,7과 같이 개별 페이지 번호를 수동으로 입력하여 홀수 페이지 패턴을 입력합니다. 긴 문서의 경우 Acrobat은 기본적으로 홀수/짝수 약어를 지원하지 않으므로 전체 시퀀스를 입력하거나 해결 방법을 사용해야 합니다.
Acrobat Pro에서 긴 문서에 대한 실질적인 해결 방법은 해결 방법과 함께 추출 도구를 사용하는 것입니다. 왼쪽의 페이지 패널을 열고 썸네일을 클릭하여 첫 번째 홀수 페이지를 선택한 다음 Ctrl 키를 누른 채 이어지는 각 홀수 페이지를 클릭합니다. 모든 대상 페이지가 선택되면 마우스 오른쪽 버튼을 클릭하고 페이지 추출을 선택합니다. 개별 페이지 파일을 원하는 경우 대화 상자에서 페이지를 별도의 파일로 추출을 선택하고, 하나의 결합된 PDF를 얻으려면 선택하지 않은 상태로 둡니다. 확인을 클릭하세요. Acrobat은 선택한 페이지만 포함된 새 PDF를 생성합니다. 이 방법은 최대 30페이지 정도의 문서에 적합합니다. 그 외에도 수동 클릭은 오류가 발생하기 쉬우므로 스크립팅 접근 방식이 더 실용적입니다.
방법 2: 온라인 PDF 도구 및 패턴 기반 선택
여러 온라인 PDF 도구는 홀수/짝수 단축 구문을 사용하여 패턴 기반 페이지 추출을 지원합니다. 도구 인터페이스에서 분할, 추출 또는 페이지 선택 기능을 찾으십시오. 페이지 번호를 묻는 메시지가 나타나면 홀수 또는 짝수 수정자를 사용하여 범위를 입력합니다. 일반적인 구문에는 1-100:odd 또는 1-100:even 또는 간단히 드롭다운 메뉴에서 홀수 페이지를 선택하는 것이 포함됩니다. 이 도구는 서버 측 패턴을 처리하고 일치하는 페이지만 포함된 PDF를 반환합니다.
온라인 도구는 최대 수백 페이지의 문서를 편안하게 처리합니다. 처리 시간은 페이지 수에 따라 선형적으로 늘어납니다. 200페이지 문서는 15~30초 정도 걸릴 수 있습니다. 대부분의 온라인 도구는 보완적인 역연산도 제공합니다. 홀수 페이지를 추출하고 짝수 페이지도 원하는 경우 동일한 문서에서 짝수 추출을 실행하거나 도구에서 제공하는 경우 홀수 및 짝수로 분할 옵션을 선택하세요. 무료 도구는 일반적으로 몇 시간 내에 서버에서 처리된 파일을 삭제하므로 두 출력 파일을 즉시 다운로드합니다.
방법 3: 일괄 처리를 위한 명령줄 도구
명령줄에 익숙한 사용자를 위해 pdftk 및 qpdf는 수동 클릭 없이 홀짝수 추출을 정밀하게 제어할 수 있는 기능을 제공합니다. pdftk는 페이지 범위 패턴으로 cat 작업을 지원합니다. pdftk input.pdf cat 1-100odd outodd_pages.pdf 명령은 처음 100페이지에서 홀수 페이지를 모두 추출합니다. 짝수 페이지의 경우 홀수를 짝수로 바꾸세요. 이 도구는 일반적인 사무용 문서 크기에 대해 1초 이내에 문서를 처리합니다.
보다 현대적인 대안인 qpdf는 --pages 플래그와 유사한 기능을 제공합니다. qpdf --empty --pages input.pdf 1-100:odd --output.pdf 명령은 홀수 페이지를 선택합니다. qpdf는 pdftk보다 암호화된 PDF를 더 우아하게 처리하고 추출 중에 책갈피, 링크 및 양식 필드를 포함한 더 넓은 범위의 PDF 기능을 유지합니다.
| 방법 | 에 가장 적합 | 제한 |
|---|---|---|
| Acrobat Pro 페이지 구성 | 시각적 선택, 작은 세트 | 문서별 수동 작업 |
| 온라인 PDF 도구 | 빠른 추출, 설치 불필요 | 무료 등급의 파일 크기 제한 |
| 명령줄(pdftk, qpdf) | 일괄 처리, 스크립팅 | 명령줄 지식이 필요합니다 |
| Python 자동화 | 사용자 정의 규칙, 대규모 | 프로그래밍이 필요함 |
반복되는 일괄 작업의 경우 PDF 폴더를 반복하는 셸 스크립트에 명령줄 도구를 래핑합니다. 단일 bash 또는 PowerShell for-loop는 몇 분 안에 수백 개의 문서를 처리할 수 있습니다. 또한 명령줄 접근 방식은 PDF가 감시 폴더에 도착하고 처리된 파일이 사람의 개입 없이 출력 폴더로 이동되는 자동화된 문서 파이프라인에 통합됩니다.
Python을 사용한 홀짝수 추출 자동화
PyPDF2 및 pikepdf와 같은 Python 라이브러리는 단순한 홀수 짝수 규칙 이상의 사용자 정의 논리를 사용하여 프로그래밍 방식의 페이지 추출을 가능하게 합니다. Python 스크립트는 PDF를 읽고, 해당 페이지를 반복하고, 모든 조건에 대해 페이지 번호를 확인하고, 일치하는 페이지를 새 파일에 저장할 수 있습니다. 논리는 패리티를 다른 필터와 결합할 수 있습니다. 즉, 홀수 페이지를 추출하지만 특정 차원보다 작은 페이지는 건너뛰거나, 비어 있지 않은 경우에만 짝수 페이지를 추출할 수 있습니다.
홀수 페이지에 대한 기본 PyPDF2 스크립트에는 15줄 미만의 코드가 필요합니다. 스크립트는 입력 PDF에 대한 판독기 개체, 출력에 대한 기록기 개체를 만들고, 시작 인덱스가 1인 열거를 사용하여 페이지를 반복하고, 페이지 번호 모듈로 2가 홀수인 경우 1, 짝수인 경우 0인지 확인하고 일치하는 페이지를 기록기에 추가합니다. 스크립트는 GUI 기반 추출을 제한하는 수동 선택 피로 없이 모든 길이의 문서를 일관되게 처리합니다.
추출 결과 확인
추출 방법을 수행한 후 출력에 올바른 페이지가 포함되어 있고 삭제된 페이지가 없는지 확인하십시오. 원본과 추출된 PDF를 나란히 엽니다. 홀수 페이지 추출을 위해 3, 7, 15페이지 등 원본에서 알려진 몇 개의 페이지로 스크롤하여 추출된 문서에 올바른 순서로 나타나는지 확인합니다. 추출된 파일의 총 페이지 수가 예상과 일치하는지 확인하십시오. 100페이지 문서에서 홀수 페이지를 추출하면 50페이지가 생성됩니다.
원본 PDF의 페이지 링크나 책갈피가 특정 페이지 번호를 가리키는 경우 페이지 번호 매기기가 바뀌기 때문에 추출 후 해당 참조가 끊어집니다. 원본에서 42페이지를 가리키는 북마크는 이제 새로운 42페이지 위치에 있는 모든 콘텐츠를 가리키며 이는 정확할 가능성이 없습니다. 내부 탐색에 크게 의존하는 문서의 경우 추출 후 책갈피를 다시 작성하거나 페이지 선택 프로세스 중에 링크 대상을 유지하는 qpdf와 같은 도구를 사용하도록 계획하십시오.
PDF에서 홀수 또는 짝수 페이지를 추출하는 것은 위의 방법 중 하나로 안정적으로 처리할 수 있는 기계적 작업입니다. 올바른 방법을 선택하는 것은 처리해야 하는 문서 수와 이것이 일회성 작업인지 반복적인 작업 흐름인지에 따라 달라집니다. 짧은 문서에서 가끔 추출하는 경우 Acrobat Pro의 시각적 선택이 가장 직관적입니다. 스캔한 양면 문서 폴더를 일괄 처리하기 위해 명령줄 도구는 단일 명령으로 모든 문서를 처리합니다. 추출 규칙이 다른 처리 단계와 결합되는 자동화된 문서 파이프라인의 경우 Python 스크립트는 어떤 GUI 도구도 따라올 수 없는 유연성을 제공합니다. 어떤 방법을 선택하든 원본 파일을 보관하거나 추출된 페이지를 대상으로 보내기 전에 항상 출력 페이지 수와 페이지 순서를 확인하십시오.
홀짝 추출에서 극단적인 경우 처리
일부 문서는 깔끔한 교대 패턴을 따르지 않습니다. 표지 페이지와 양면 스캔 내용이 있는 PDF에는 1페이지가 단면 표지이고 2~101페이지가 양면 스캔입니다. 전체 문서에서 홀수 페이지를 추출하면 표지와 앞면이 걸리게 되는데, 이는 대부분의 사용 사례에서 원하는 결과입니다. 표지를 제외해야 하는 경우 2페이지부터 끝: 2-101odd까지 추출을 실행하세요. 대부분의 명령줄 도구와 온라인 서비스는 페이지 범위와 홀수 또는 짝수 수정자를 결합하는 것을 지원합니다.
페이지 크기가 혼합된 문서는 또 다른 극단적인 경우를 나타냅니다. 문자 페이지와 타블로이드 페이지가 모두 포함된 PDF를 홀짝 추출로 분할하면 올바른 페이지가 선택되지만 균일한 페이지 크기를 기대하는 다운스트림 시스템에서는 문제가 발생할 수 있습니다. 추출 후 출력 문서의 페이지 크기를 확인하세요. 후속 프로세스에 균일한 페이지 크기가 필요한 경우 추가 처리 전에 추출된 페이지를 일관된 형식으로 자르거나 크기를 조정하십시오.
PDF 분할을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
