
OCR이 스캔한 PDF에 수행하는 작업
광학 문자 인식은 페이지 이미지 모음인 스캔 PDF을 검색 가능한 문서로 변환합니다.
OCR PDF 프로세스는 각 페이지 이미지를 분석하고 문자의 모양을 식별하며 페이지 이미지 뒤에 보이지 않는 텍스트 레이어를 만듭니다. OCR 후에는 문서 속 단어를 검색하고, 텍스트를 선택 및 복사하고, 화면 리더를 사용하여 문서를 소리내어 읽을 수 있습니다.
OCR은 텍스트의 수동적 이미지를 텍스트 선택 및 화면 판독기를 지원하는 검색 가능한 활성 문서로 변환합니다.
OCR의 정확성은 원본 스캔의 품질에 직접적으로 좌우되며 깨끗한 300 DPI 스캔이 최상의 결과를 생성합니다.
OCR 없이 스캔한 PDF는 텍스트의 사진 앨범과 같습니다. 단어를 볼 수는 있지만 단어와 상호 작용할 수는 없습니다. 특정 용어를 검색할 수 없습니다. 단락을 복사하여 인용할 수는 없습니다. 화면 판독기를 사용할 수 없습니다. OCR은 단순한 보기 이상으로 디지털 문서를 유용하게 만드는 대화형 기능을 추가합니다.
OCR의 정확도는 원본 스캔의 품질에 따라 달라집니다. 균일한 조명과 선명한 초점을 갖춘 300DPI의 깨끗한 고해상도 스캔은 표준 인쇄 텍스트에 대해 99% 이상의 OCR 정확도를 제공합니다. 저해상도 스캔, 비스듬히 찍은 문서 사진, 주름지거나 얼룩진 원본을 스캔하면 정확도가 낮아집니다. 스캔 품질은 OCR 출력 품질을 직접적으로 결정합니다.
OCR에 의해 추가된 PDF 검색 가능 텍스트 레이어는 페이지 이미지와 별개입니다. PDF의 시각적 모양은 OCR 후에도 변경되지 않습니다. 페이지가 여전히 스캔한 이미지처럼 보입니다. 해당 이미지 뒤에는 인식된 텍스트가 검색 엔진, 화면 판독기 및 텍스트 선택 도구에 액세스할 수 있는 보이지 않는 문자 데이터로 존재합니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
다른 장치에서 스캔한 PDF에 대해 OCR을 실행하는 방법
Windows에서 Adobe Acrobat Pro는 스캔한 PDF에 대해 OCR을 실행할 수 있습니다. PDF를 열고 스캔 및 OCR 도구를 선택한 다음 텍스트 인식을 선택합니다. Acrobat은 각 페이지를 처리하고 텍스트를 인식하며 검색 가능한 텍스트 레이어를 추가합니다. 파일을 저장합니다. 이제 PDF에서 검색 및 텍스트 선택을 지원합니다. Acrobat Pro는 Windows에서 가장 정확한 OCR을 제공합니다.
Mac의 내장 미리보기 애플리케이션에는 OCR이 포함되어 있지 않습니다. 여러 타사 Mac PDF 도구가 OCR 기능을 제공합니다. PDF Expert와 PDFpen에는 모두 스캔한 PDF를 처리하고 검색 가능한 텍스트 레이어를 추가하는 OCR 엔진이 포함되어 있습니다. OCR 품질은 표준 문서용 Windows 도구와 비슷합니다.
WukongPDF의 브라우저 기반 OCR 도구는 모든 운영 체제에서 작동합니다. 스캔한 PDF를 업로드하고 OCR 엔진의 문서 언어를 선택한 후 인식을 실행하세요. 처리가 완료되면 검색 가능한 PDF를 다운로드하세요. 브라우저 기반 접근 방식을 사용하면 소프트웨어를 설치하지 않고도 OCR에 액세스할 수 있습니다.
iPhone 및 Android의 경우 OCR을 포함하는 스캐너 앱이 캡처 중에 스캔을 처리합니다. Adobe Scan, Microsoft Lens 및 iPhone Notes 앱에 내장된 스캐너는 모두 문서를 스캔할 때 자동으로 OCR을 수행합니다. 별도의 OCR 처리 단계 없이 스캔 후 즉시 결과 PDF를 검색할 수 있습니다.
까다로운 문서의 OCR 정확도 향상
OCR을 실행하기 전에 올바른 문서 언어를 선택하십시오. OCR 엔진은 언어별 사전과 문자 빈도 데이터를 사용하여 모호한 문자를 해결합니다. 프랑스어 설정을 사용하여 프랑스어 문서에서 OCR을 실행하면 영어 설정을 사용하는 것보다 더 나은 결과를 얻을 수 있습니다. 다국어 문서의 경우 기본 언어를 선택하고 보조 언어 구문의 오류를 수동으로 수정합니다.
OCR 전에 스캔한 페이지의 기울기를 조정합니다. 1~2도라도 약간 회전된 스캔 페이지는 OCR 엔진이 텍스트 줄을 수평으로 예상하기 때문에 OCR 정확도를 떨어뜨립니다. 대부분의 스캐닝 소프트웨어에는 자동 기울기 조정 기능이 포함되어 있습니다. 캡처 중에 스캔의 기울기가 조정되지 않은 경우 OCR을 실행하기 전에 PDF 페이지의 기울기를 조정하십시오.
작은 텍스트나 복잡한 레이아웃이 포함된 문서의 스캔 해상도를 높이세요. 10포인트 미만의 텍스트는 정확한 OCR을 위해 더 높은 스캔 해상도가 필요합니다. 대부분의 문서는 300DPI로 스캔하면 충분합니다. 8포인트 이하의 텍스트가 포함된 문서의 경우 400 또는 600DPI로 스캔하면 OCR 엔진에 개별 문자를 구별할 수 있는 충분한 픽셀 데이터가 제공됩니다.
텍스트와 사진 또는 그림이 결합된 페이지와 같이 콘텐츠 유형이 혼합된 문서의 경우 OCR 엔진은 텍스트 영역만 인식하도록 구성해야 합니다. 이미지 영역에서 텍스트를 인식하려고 하면 쓰레기 문자가 생성됩니다. 대부분의 OCR 도구에는 텍스트가 포함된 페이지 영역을 지정할 수 있는 영역 선택 기능이 포함되어 있습니다.
OCR 출력 확인 및 수정
OCR이 완료된 후 페이지에 표시되는 몇 가지 단어를 검색하여 출력을 확인합니다. 검색 결과가 발견되면 OCR이 성공한 것입니다. 검색에서 명확한 단어가 누락된 경우 해당 페이지의 특정 글꼴, 레이아웃 또는 이미지 품질에 대한 OCR 정확도가 충분하지 않을 수 있습니다.
완전히 검색 가능해야 하는 법률 또는 의료 기록과 같이 OCR 정확성이 중요한 문서의 경우 인식된 텍스트를 수동으로 검토하세요. 일부 PDF 도구를 사용하면 숨겨진 텍스트 레이어를 보고 편집할 수 있습니다. 특히 OCR 엔진이 잘못 인식할 가능성이 높은 고유명사, 숫자 및 기술 용어의 인식 오류를 수정합니다.
가장 일반적인 OCR 오류에는 문자 혼동이 포함됩니다. 문자 l과 숫자 1은 많은 글꼴에서 비슷하게 보입니다. 문자 rn을 합치면 문자 m처럼 보일 수 있습니다.
문자 cl은 문자 d처럼 보일 수 있습니다. 이러한 문자 혼동으로 인해 원본과 시각적으로 유사하지만 텍스트가 잘못된 단어가 생성됩니다. 중요한 섹션을 수동으로 검토하면 이러한 오류가 발견됩니다.
OCR 출력을 확인한 후 OCR로 처리되었음을 나타내는 파일 이름으로 문서를 저장합니다. Report-OCR.pdf 또는 Report-Searchable.pdf와 같은 파일 이름은 검색 가능한 버전을 원본 이미지 전용 스캔과 구별합니다.
검색 가능한 스캔 PDF의 실질적인 이점은 대용량 문서에서 특정 정보를 처음 찾아야 할 때 분명해집니다. OCR이 없는 200페이지 스캔 계약서는 특정 조항을 찾기 위해 모든 페이지를 수동으로 읽어야 합니다. 검색 가능한 버전은 몇 초 안에 해당 조항을 찾습니다. 두 번 이상 참조할 것으로 예상되는 문서의 경우 OCR 투자는 그 자체로 가치가 있습니다.
OCR 처리된 PDF는 화면 판독기에서도 액세스할 수 있으므로 보조 기술을 사용하여 문서를 읽는 시각 장애인도 사용할 수 있습니다. OCR 없이 스캔한 PDF는 소리내어 읽을 텍스트가 없기 때문에 화면 판독기에서 전혀 액세스할 수 없습니다. OCR을 추가하면 섹션 508 및 WCAG를 포함한 접근성 표준에서 요구하는 문서에 액세스할 수 있게 됩니다.
영어 이외의 언어로 된 문서의 경우 처리하기 전에 올바른 OCR 언어를 선택하십시오. OCR 엔진은 언어별 문자 인식 모델을 사용합니다. 일본어 모델로 인식된 일본어 문서는 영어 모델로 인식된 동일한 문서보다 훨씬 더 나은 결과를 생성합니다.
OCR을 사용하면 다른 문서에서 재사용할 수 있도록 텍스트 추출도 가능합니다. 자신의 보고서에 스캔한 문서의 한 구절을 인용해야 할 경우 OCR은 해당 텍스트를 복사 가능하게 만듭니다. OCR이 없으면 구절을 수동으로 다시 입력해야 합니다. OCR 처리된 문서에서 복사하여 붙여넣을 수 있어 절약된 시간은 상당히 늘어납니다.
보관할 스캔 문서의 경우 OCR은 필수 보존 단계입니다. 현재 보관된 이미지 전용 스캔 PDF는 미래의 연구자에게 검색 기능을 제공하지 않습니다. 검색 가능한 PDF는 텍스트 검색을 통해 문서 내용에 대한 액세스를 제공하므로 향후 사용자의 문서 유용성이 크게 향상됩니다.
PDF의 파일 크기는 OCR 후에도 크게 변하지 않습니다. OCR 데이터는 각 페이지에 일반적으로 페이지당 몇 킬로바이트에 해당하는 소량의 텍스트 데이터를 추가합니다. 원본 페이지 이미지는 변경되지 않습니다. 검색 가능한 텍스트 레이어가 제공하는 기능적 개선을 고려하면 파일 크기 증가는 무시할 수 있습니다.
OCR에 의해 추가된 검색 가능한 텍스트 레이어는 시각적 페이지 이미지와 별개입니다. OCR 처리된 PDF에서 단어를 검색하면 검색은 이미지가 아닌 텍스트 레이어와 일치합니다. 검색 결과는 페이지 이미지에서 텍스트가 발견된 영역을 강조 표시합니다.
OCR 처리된 PDF는 텍스트 음성 변환 기능을 지원하므로 시각 장애가 있는 사람과 문서를 읽는 것보다 듣는 것을 선호하는 모든 사람이 액세스할 수 있습니다. 이 접근성 기능은 단순한 검색 기능을 뛰어넘는 OCR의 중요한 이점입니다.
수백 또는 수천 개의 스캔 페이지가 포함된 대규모 OCR 프로젝트의 경우 일괄 OCR 처리를 통해 상당한 시간을 절약할 수 있습니다. OCR 설정을 한 번 구성하면 전체 문서 배치에 적용됩니다. 모든 페이지를 검토하기보다는 정확성을 위해 페이지 샘플을 검토하세요.
OCR 텍스트 레이어를 일반 텍스트 파일로 내보낼 수 있으므로 문서 내용을 다른 응용 프로그램에서 사용할 수 있습니다. 인식된 텍스트를 내보내고 텍스트 편집기나 워드 프로세서에서 열어 새 문서의 기초로 사용하세요.
OCR 처리된 PDF의 장기적인 가치는 문서에서 정보를 찾아야 할 때마다 실현됩니다. 계약서, 매뉴얼 또는 참조 문서의 검색 가능한 PDF는 수동으로 읽어야 하는 정적 파일이 아니라 쿼리할 수 있는 리소스가 됩니다.
문서 스캐닝 작업 과정의 표준 단계로 OCR을 구현하면 디지털화한 모든 문서가 디지털 라이브러리에 들어가는 순간부터 검색 가능해집니다. 스캔하는 동안 OCR 처리에 몇 초의 추가 시간이 걸리므로 스캔한 문서에서 정보를 찾아야 할 때마다 이점을 얻을 수 있습니다.
디지털 문서 라이브러리를 관리하는 모든 사람에게 OCR은 스캔한 PDF에 적용할 수 있는 가장 영향력 있는 단일 처리 단계입니다. 수동적 이미지 파일을 검색 가능하고 액세스 가능한 활성 문서로 변환합니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
