Tips & Tricks

척추 그림자를 제거하기 위해 책 페이지 PDF를 자르는 방법

책을 페이지별로 스캔하면 모든 페이지가 중앙을 따라 흐르는 어둡고 구부러진 그림자가 있는 PDF가 생성됩니다. 이 그림자는 페이지가 제본으로 구부러지는 책 등뼈에 의해 드리워집니다. 책등 근처의 텍스트가 어두워지고 때로는 페이지 곡률로 인해 왜곡됩니다. 그림자는 인쇄할 때 잉크나 토너를 소모하고 페이지가 전문적이지 않게 보이게 하며 영향을 받은 텍스트의 OCR 정확도를 방해합니다. 스캔한 각 페이지에서 등뼈 그림자를 자르면 시각적 아티팩트가 제거되고 독자의 주의가 내용에 집중됩니다. 책등 그림자 제거를 위한 Crop PDF 접근 방식은 페이지별로 적용해야 합니다. 책 두께가 앞에서 뒤로 변함에 따라 그림자 위치가 페이지마다 조금씩 이동하기 때문입니다.

How to Crop a Book Page PDF to Remove the Spine Shadow

책 스캔에 척추 그림자가 나타나는 이유

평판 스캐너는 책을 유리판에 대고 누릅니다. 책등 근처의 페이지는 제본으로 인해 완전히 평평하게 놓일 수 없습니다. 페이지와 유리 사이의 이러한 틈은 스캐너 빛이 다르게 반사되는 영역을 만들어 책등 가장자리에서 시작하여 제본에서 거리가 멀어짐에 따라 희미해지는 그림자를 생성합니다. 펼쳐진 책의 왼쪽 페이지에서 그림자는 왼쪽 가장자리를 따라 가장 어둡고 중앙을 향해 확장됩니다. 오른쪽 페이지에서 그림자는 오른쪽 가장자리를 따라 가장 어둡습니다.

제본 근처의 페이지 곡률로 인해 텍스트도 왜곡됩니다. 책등 근처의 문자는 스캐너 센서에 대한 페이지의 각도에 따라 압축되거나 늘어난 것처럼 보입니다. 자르기는 그림자와 왜곡된 텍스트를 제거합니다. 그림자를 밝게 하고 왜곡된 텍스트를 왜곡하기 위해 이미지 처리를 사용하는 대안은 더 복잡하며 단순히 영향을 받은 영역을 잘라내는 것만큼 깨끗한 결과를 생성하는 경우는 거의 없습니다. 책 스캔의 스캔된 PDF은 그림자 영역 수정 시도보다 자르기에서 더 많은 이점을 얻습니다.

WukongPDF

PDF 자르기를 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →

자르기 경계 결정

자르기 도구를 지원하는 PDF 뷰어에서 첫 번째 스캔 페이지를 엽니다. 책등 가장자리를 확대하고 그림자가 페이지 배경을 눈에 띄게 어두워지기 시작하는 위치를 식별합니다. 자르기 경계는 이 점 바로 안쪽에 배치되어 전체 그림자 영역을 제거해야 합니다. 어두운 픽셀이 남지 않도록 그림자 옆에 일반 페이지 배경의 작은 여백을 포함합니다. 그림자에 잘린 자르기 경계선은 잘린 페이지의 가장자리를 따라 어두운 띠를 남깁니다.

페이지 가장자리에서 자르기 경계까지의 거리를 측정합니다. 이 거리는 스캔의 모든 페이지에 대한 자르기 값이 됩니다. 그러나 최적의 자르기 거리는 책의 왼쪽 페이지와 오른쪽 페이지에 따라 다를 수 있으며 페이지 곡률이 변경되는 책의 앞면과 뒷면에 따라 달라질 수 있습니다. 책의 여러 섹션에 있는 샘플 페이지를 스캔하고 책등 그림자 너비가 일정한지 확인하세요. 다양한 경우 페이지를 동일한 자르기 거리를 공유하는 섹션으로 그룹화하세요. 각 그룹에 적절한 자르기 거리를 적용합니다.

모든 페이지에 자르기 적용

자르기 경계를 결정한 후 PDF의 모든 페이지에 적용합니다. 자르기를 지원하는 대부분의 PDF 편집기는 동일한 자르기 직사각형을 다양한 페이지에 적용할 수 있습니다. 동일한 자르기 거리를 공유하는 모든 페이지를 선택하고 자르기 도구를 열고 자르기 값을 입력하고 적용합니다. 왼쪽 및 오른쪽 페이지에 서로 다른 자르기 값이 필요한 도서 스캔의 경우 왼쪽 및 오른쪽 페이지를 별도의 페이지 그룹으로 처리합니다. 선택한 모든 페이지에 동일한 자르기를 적용하는 Crop PDF 일괄 작업에는 몇 초가 걸립니다.

각 PDF 페이지에 펼쳐진 책의 왼쪽 및 오른쪽 페이지가 모두 표시되는 두 페이지 펼침으로 PDF를 스캔한 경우 자르기가 더 복잡합니다. 척추 그림자는 페이지 중앙을 따라 이어집니다. 척추 그림자의 왼쪽을 제거하려면 페이지의 왼쪽 절반을 자르고, 오른쪽을 제거하려면 오른쪽 절반을 자릅니다. 일부 PDF 도구는 각 페이지를 중앙으로 분할하고 각 절반을 독립적으로 잘라 스프레드에서 개별 페이지를 생성할 수 있습니다. WukongPDF 및 유사한 플랫폼은 단일 페이지 및 펼친 페이지 책 스캔 자르기를 모두 처리하는 자르기 도구를 제공합니다.

척추 근처에 페이지 콘텐츠 보존

척추 그림자 영역에는 단순히 삭제할 수 없는 콘텐츠가 포함될 수 있습니다. 전체 페이지 너비에 걸쳐 있는 테이블에는 그림자 영역까지 확장되는 열이 있을 수 있습니다. 다이어그램이나 사진은 제본 가까이에 위치할 수 있습니다. 각주나 여백주는 그림자로 인해 부분적으로 가려질 수 있습니다. 이러한 페이지의 경우 전체 그림자 영역을 자르면 독자에게 필요한 콘텐츠가 제거됩니다.

이러한 예외 페이지를 개별적으로 처리하세요. 어두워졌음에도 불구하고 그림자 영역의 내용을 읽을 수 있는 경우 해당 특정 페이지에서 덜 공격적으로 자르고 그림자의 가장 어두운 부분만 제거하고 어두워졌지만 여전히 읽을 수 있는 텍스트는 남겨둡니다. 내용을 읽을 수 없는 경우 페이지를 더욱 평평하게 만들기 위해 보다 주의 깊게 취급하여 실제 책을 다시 스캔할 수 있는지 고려하십시오. 책을 스캐너 유리에 더 단단히 누르거나, 제본용으로 설계된 V자형 압반이 있는 책 스캐너를 사용하거나, 평판이 아닌 오버헤드 카메라로 책을 스캔하면 소스에서 책등 그림자가 줄어듭니다.

수확 후 품질 검증

자른 후 PDF의 모든 페이지를 스크롤하여 남은 그림자가 없는지, 실수로 잘린 내용이 없는지 확인하세요. 페이지 곡률과 그림자 너비가 중간 페이지와 다를 수 있는 책의 시작과 끝 부분에 있는 페이지에 특히 주의하세요. 100페이지에 딱 맞는 자르기가 5페이지에는 너무 공격적일 수 있습니다. 제본 한쪽의 얇은 페이지 묶음이 다른 곡률을 생성합니다.

잘린 PDF에서 OCR을 실행하고 그림자 영역에서 잘리지 않은 원본 스캔과 텍스트 인식 정확도를 비교합니다. 잘린 버전이 이전에 그림자로 가려진 영역의 텍스트를 더 정확하게 인식하면 잘린 것이 성공한 것입니다. 잘린 버전에서 이전에 인식된 텍스트가 손실된 경우 자르기가 너무 공격적이었을 수 있습니다. PDF 품질 목표는 모든 필수 콘텐츠가 보존되고 방해가 되는 모든 아티팩트가 제거된 깨끗한 페이지를 만드는 것입니다.

척추 그림자 제거를 위한 자르기 대안

자르기는 척추 그림자 제거에 대한 가장 간단한 접근 방식이지만 이것이 유일한 접근 방식은 아닙니다. 이미지 편집 소프트웨어는 그림자 영역에 국부적인 밝기 및 대비 조정을 적용하여 내용을 제거하지 않고도 배경을 밝게 하고 텍스트 대비를 높일 수 있습니다. 이 접근 방식은 페이지의 모든 단어를 보존하지만 페이지별 이미지 편집이 필요하므로 짧은 문서나 중요도가 높은 개별 페이지에만 실용적입니다.

ScanTailor와 같은 전용 책 스캔 소프트웨어에는 각 페이지의 텍스트 영역을 자동으로 감지하고 해당 영역을 자르는 콘텐츠 선택 기능이 포함되어 자르기 경계를 수동으로 측정하지 않고도 책등 그림자를 처리합니다. ScanTailor은 스캔한 이미지를 PDF로 조합하기 전에 처리합니다. 책을 정기적으로 PDF로 스캔하는 경우 자동 콘텐츠 감지 및 자르기를 포함하는 스캔 작업 흐름에 투자하면 수동으로 PDF 자르기 조정 시간을 절약할 수 있습니다.

스캐너에 눌려 눌려질 수 없는 희귀하거나 깨지기 쉬운 책의 경우 펼쳐진 책 바로 위에 카메라를 놓고 페이지 사진을 찍는 것을 고려해 보세요. 카메라 접근 방식은 유리 플래튼을 완전히 피하고 양쪽에서 조심스럽게 조명을 사용하여 이를 수정하기 위한 후처리에 의존하는 대신 캡처 단계에서 척추 그림자를 최소화할 수 있습니다.

PDF를 자르고 마무리한 후, 책이 공개 도메인에 있는 경우 정리된 디지털 버전을 온라인 아카이브나 디지털 도서관에 기증하는 것을 고려해보세요. 스캔을 정리하는 데 소요되는 시간은 자신의 프로젝트뿐만 아니라 읽을 수 있는 디지털 형식의 해당 텍스트에 액세스해야 하는 다른 모든 사람에게 도움이 될 수 있습니다.

마주보는 페이지 사이의 여백을 가로지르는 그림, 사진 또는 지도가 있는 책의 경우 책등 그림자를 자르면 이미지의 중앙 부분이 희생됩니다. 이러한 경우에는 그림 페이지의 두 페이지 펼쳐진 부분을 그대로 유지하고 텍스트만 있는 페이지만 자르는 것이 좋습니다. 문서 메타데이터의 메모는 교차 여백 콘텐츠를 보존하기 위해 특정 페이지가 잘리지 않은 상태로 남아 있음을 설명할 수 있습니다.

도서 디지털화 프로젝트를 위한 스캔된 PDF 정리 프로세스는 스캐닝, 자르기, OCR 및 품질 확인 단계를 분리하는 구조화된 작업 흐름의 이점을 얻습니다. 스캔할 때 각 페이지를 자르고 마무리하려고 하면 일관성 없는 결과가 발생합니다. 먼저 전체 책을 스캔한 후 자르기 단계를 통해 전체 페이지 이미지 세트를 일괄 처리합니다.

도서 스캔을 위한 Crop PDF 워크플로는 대략적인 스캔을 읽기, 인쇄 및 디지털 도서관 컬렉션의 장기 보존에 적합한 깨끗한 디지털 사본으로 변환합니다.

척추 그림자가 제거된 정리된 스캔된 PDF는 OCR 처리 준비가 되어 있어 향상된 이미지 품질의 이점을 누릴 수 있습니다.

잘 자른 책 스캔은 저자의 단어를 보존하는 동시에 스캔 프로세스의 기계적 인공물을 제거합니다.

도서 스캔은 보존 행위입니다. 스캐너 그림자가 제거된 모든 페이지는 미래의 독자들이 방해 없이 읽을 수 있는 페이지입니다. 자르기 단계에 투자한 관심은 실제 책의 콘텐츠를 디지털 미래로 옮기려는 더 큰 노력의 일부입니다.

WukongPDF

PDF 자르기를 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →