노트에 손으로 쓰고, 휴대폰으로 사진을 찍고, 스캔한 PDF로 저장된 회의록 한 페이지에는 검색, 복사 붙여넣기, 스크린 리더로는 전혀 접근할 수 없는 귀중한 정보가 담겨 있습니다. 단어는 사람의 눈에는 보이지만 컴퓨터에는 이미지의 형태일 뿐입니다. 손으로 쓴 메모를 편집 가능한 텍스트로 변환하면 모든 문서나 애플리케이션에서 검색, 복사 및 사용할 수 있습니다.
필기 인식은 모든 사람의 필기가 고유하기 때문에 인쇄된 텍스트 인식보다 어렵습니다. 글자의 모양은 인쇄된 서체보다 개인마다 훨씬 더 다양하며 인식 엔진은 이러한 가변성을 처리해야 합니다.
스캔한 OCR PDF 문서의 필기 메모를 편집 가능한 입력 텍스트로 변환하려면 필기체 및 인쇄된 필기체를 인식할 수 있는 필기 가능 OCR 엔진과 인쇄된 텍스트 OCR에 비해 더 높은 필기 인식 오류율을 처리하는 워크플로가 필요합니다. WukongPDF의 스캔 PDF 및 OCR 도구는 텍스트 인식을 지원하며 아래 지침에서는 필기 인식 정확도를 최대화하는 방법을 다룹니다.

필기 인식이 인쇄된 텍스트 OCR보다 훨씬 어려운 이유
인쇄된 텍스트 OCR은 문자 모양을 알려진 서체 패턴과 일치시키는 방식으로 작동합니다. Times New Roman의 문자 A는 내가 입력하든, 사용자가 입력하든, 기계가 인쇄하든 똑같이 보입니다. 인식 엔진에는 모든 공통 글꼴의 모든 문자에 대해 명확하고 일관된 템플릿이 있습니다. 모든 사람의 문자 A가 다르게 보이기 때문에 필기 인식에는 그러한 템플릿이 없습니다. 엔진은 모양, 크기, 기울기, 문자 간 연결의 엄청난 변화에 걸쳐 손으로 쓴 문자의 통계적 패턴을 인식해야 합니다.
단어 안의 문자가 연결된 필기체 필기는 복잡성을 한층 더 가중시킵니다. 인식 엔진은 각 문자를 인식하기 전에 연결된 문자를 개별 문자로 분할해야 합니다. 문자 m을 r과 n으로 분할하거나 두 문자를 하나로 병합하는 잘못된 분할은 필기 인식 오류의 주요 원인입니다. 각 글자를 별도로 쓰는 인쇄 필기체는 인식 엔진이 처리하기가 훨씬 더 쉽고 더 높은 정확도의 결과를 생성합니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
필기 인식을 위한 스캔 이미지 준비
원본 이미지의 품질은 필기 인식 정확도에 있어 가장 큰 단일 요소이며 인식 엔진 선택보다 더 중요합니다. 필기 페이지를 최소 300DPI로 스캔하거나 사진을 찍으세요. 작거나 조밀한 필기에는 600DPI가 권장됩니다. 전체 페이지에 걸쳐 균일하고 그림자 없는 조명을 보장합니다. 원근 왜곡을 최소화하려면 카메라나 휴대폰을 페이지와 평행하게 잡으세요. 원본 이미지가 좋을수록 인식이 더 정확해집니다.
인식을 실행하기 전에 스캔한 이미지를 향상시키십시오. 대비를 높여 잉크를 어둡게 하고 용지 배경을 밝게 합니다. 선명하게 하기 필터를 적용하여 손으로 쓴 획의 가장자리를 더욱 선명하게 만듭니다. 전역 임계값보다 고르지 않은 조명을 더 잘 처리하는 적응형 임계값을 사용하여 이미지를 회색조 또는 순수 흑백으로 변환합니다. 향상된 이미지는 인식 엔진에 더 깨끗하고 뚜렷한 문자 모양을 제공합니다.
필기 가능 OCR 엔진 사용
Tesseract와 같은 범용 OCR 엔진에는 구성 설정을 통해 활성화할 수 있는 필기 인식 모드가 포함되어 있습니다. Tesseract에서 필기 지원을 포함하는 언어 모델을 지정하고 이미지를 단일 텍스트 블록으로 처리하도록 페이지 분할 모드를 설정합니다. Google Cloud Vision API 및 Microsoft Azure Computer Vision에는 클라우드 기반 OCR 서비스에 필기 인식 기능이 포함되어 있습니다.
Nebo, GoodNotes 또는 Microsoft OneNote의 잉크-텍스트 기능과 같은 전용 필기 인식 응용 프로그램은 필기용으로 특별히 최적화되어 있으며 필기 서비스에 적용된 일반 OCR 엔진보다 더 나은 결과를 생성하는 경우가 많습니다. 필기 앱에서 인식된 텍스트를 내보내고 필요한 경우 원본 스캔 PDF와 다시 통합하세요.
| 요소 | 정확도에 미치는 영향 | 권장사항 |
|---|---|---|
| 스캔 해상도 | 해상도가 높을수록 문자당 더 자세한 내용이 제공됩니다. | 최소 300DPI, 작은 필기의 경우 600DPI |
| 조명 | 그림자와 고르지 못한 조명으로 인해 문자 가장자리가 모호해집니다. | 확산되고 균일한 조명; 카메라 플래시를 피하세요 |
| 필기 스타일 | 필기체보다 인쇄체 필기가 더 쉽습니다. | 출처를 통제하는 경우 더 나은 결과를 위해 인쇄물로 작성하세요. |
| 이미지 향상 | 더 깔끔한 입력으로 더 깔끔한 인식이 가능합니다. | 대비 증가, 선명화, 적응형 임계값 적용 |
인식된 텍스트 검토 및 수정
필기 인식은 항상 오류를 발생시킵니다. 일반적으로 필기 품질과 이미지 조건에 따라 문자 오류율은 5~20%입니다. 손으로 쓴 원본 페이지와 인식된 텍스트를 검토하고 잘못 인식된 단어를 수정합니다. 수정 단계는 시간이 걸리지만 출력을 검색, 복사하여 붙여넣기 또는 추가 편집에 사용할 수 있도록 하는 데 필수적입니다.
법적 기록이나 의료 기록과 같이 완벽한 정확성이 요구되는 문서의 경우 인식된 텍스트를 원본 손글씨를 대체하는 것이 아니라 검색 색인으로 처리합니다. 원본 스캔 이미지를 신뢰할 수 있는 기록으로 보관하세요. 인식된 텍스트를 사용하여 원본 스캔에서 관련 페이지를 찾는 키워드 검색을 활성화합니다. 검색 가능한 인식된 텍스트와 원본 이미지의 조합은 텍스트의 검색 가능성과 이미지의 충실도라는 두 가지 장점을 모두 제공합니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
