휴대폰으로 인쇄된 문서의 사진을 찍습니다. 어쩌면 도서관에 있던 책의 한 페이지일 수도 있고, 회의에서 나눠준 유인물일 수도 있고, 지출 보고서에 필요한 영수증일 수도 있고, 중요한 정보가 적힌 표지판일 수도 있습니다. 사진은 읽을 수 있을 정도로 선명하지만, 사진일 뿐입니다. 그 안에 있는 단어는 검색할 수 없습니다. 텍스트를 복사하여 붙여넣을 수 없습니다. 편집할 수 없습니다. 텍스트 자체가 아닌 텍스트의 사진입니다.
광학 문자 인식은 해당 사진을 편집 및 검색 가능한 텍스트로 변환할 수 있으며 이를 수행하는 도구는 휴대폰과 브라우저에서 사용할 수 있습니다. 이 과정에서는 인쇄된 페이지의 사진을 찍어 모든 단어를 마치 직접 입력한 것처럼 검색, 선택, 복사 및 편집할 수 있는 문서를 생성합니다.

OCR에 가장 적합한 사진 얻기
OCR 정확도는 입력 이미지의 품질에 따라 크게 달라집니다. 조명이 밝고 선명하게 초점이 맞춰진 평평한 페이지의 사진은 95%~99%의 정확도로 OCR됩니다. 휘어진 페이지의 조명이 어둡고 흐릿하며 기울어진 사진은 70% 정확도로 OCR될 수 있습니다. 이는 대략 3~4 단어 중 하나에 오류가 있음을 의미합니다. 좋은 사진을 찍는 데 소요된 시간은 수정 노력이 줄어들어 여러 번 반환됩니다.
문서를 평평하고 조명이 밝은 표면에 놓습니다. 자연광은 확산되고 그림자가 없기 때문에 이상적입니다. 그림자가 페이지에 떨어지지 않도록 위치를 지정하면 머리 위 사무실 조명이 작동합니다. 페이지 바로 위에 휴대전화를 비스듬히 놓지 말고 페이지와 평행하게 잡으세요. 양손을 사용하거나 팔꿈치를 표면에 올려 전화기를 안정되게 유지하세요. 가장자리 주위에 작은 여백을 남겨두고 프레임을 페이지로 채웁니다. 텍스트에 초점을 맞추려면 화면을 탭하세요. 휴대폰에 문서 스캔 모드가 있으면 이를 사용하세요. iPhone의 Notes 앱에는 페이지 가장자리를 자동으로 감지하고 원근을 수정하며 대비를 향상시키는 문서 스캔 기능이 포함되어 있습니다. Android에서는 Google 드라이브의 스캔 기능도 동일합니다.
페이지가 제본된 책이고 편평하게 놓을 수 없는 경우 척추를 가볍게 눌러 곡선을 줄이고 페이지가 카메라에서 구부러지는 홈통 근처에서 OCR 정확도가 낮아진다는 점을 인정하세요. 책등 근처에 있는 중요한 텍스트의 경우 구부러진 텍스트의 해상도를 최대화하기 위해 휴대폰을 페이지에 더 가깝게 두고 특히 해당 영역에 초점을 맞춘 두 번째 사진을 찍습니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
휴대폰에 내장된 도구를 사용하여 사진에서 OCR 실행
iPhone에는 카메라 앱, 사진 앱 및 Safari에서 직접 작동하는 내장 OCR 기능인 라이브 텍스트가 포함되어 있습니다. 카메라를 텍스트로 향하면 라이브 텍스트 아이콘이 뷰파인더 모서리에 나타납니다. 탭하면 휴대폰이 실시간으로 문자를 인식합니다. 즉시 선택, 복사, 붙여넣기가 가능합니다. 이미 라이브러리에 있는 사진의 경우 사진 앱에서 해당 사진을 열고 라이브 텍스트 아이콘을 찾으세요. 인식된 모든 텍스트를 강조 표시하려면 탭하세요. 선택한 부분 또는 전체를 복사할 수 있습니다. 라이브 텍스트는 인터넷 연결 없이도 장치에서 완전히 작동합니다.
Android 휴대전화에는 Google 포토와 Google 앱에 Google 렌즈가 내장되어 있습니다. Google 포토에서 사진을 열고 렌즈 아이콘을 탭하세요. Google 렌즈는 이미지 속 텍스트를 식별하여 이를 선택, 복사, 번역 또는 검색할 수 있도록 해줍니다. Apple의 라이브 텍스트와 마찬가지로 Google Lens는 최신 장치에서 텍스트 인식을 위해 오프라인으로 작동합니다. 두 플랫폼 모두 내장 OCR은 여러 페이지로 구성된 문서가 아닌 짧은 구절, 몇 문장 또는 단락용으로 설계되었습니다. 텍스트를 추출하지만 서식이 지정된 문서를 생성하지는 않습니다.
OCR PDF 도구를 사용하여 사진을 검색 가능한 PDF로 변환
적절한 문서가 되어야 하는 사진, 검색 가능한 텍스트 레이어가 있는 PDF의 경우 브라우저 기반 OCR 도구가 전체 파이프라인을 처리합니다. WukongPDF에서는 JPEG, PNG, HEIC 및 기타 일반적인 형식의 사진 업로드를 허용합니다. 사진을 업로드하세요. 도구는 이를 처리하고 텍스트를 인식한 후 원본 사진이 보이는 페이지로, 인식된 텍스트가 그 뒤에 보이지 않는 검색 가능한 레이어로 포함된 PDF를 출력합니다. 출력은 사진과 똑같아 보이지만 이제 단어를 검색하고 텍스트를 선택 및 복사할 수 있으며 파일은 다른 PDF처럼 작동합니다.
연속된 페이지의 사진이 여러 장인 경우 함께 업로드하세요. 이 도구는 각 항목을 처리하고 이를 여러 페이지로 구성된 검색 가능한 단일 PDF로 결합할 수 있습니다. 이것은 휴대폰으로 짧은 문서를 디지털화하는 작업 흐름입니다. 각 페이지의 사진을 찍고, 배치를 업로드하고, OCR을 실행하고, 전체 문서의 검색 가능한 단일 PDF를 다운로드합니다. 이 프로세스는 10페이지 문서의 경우 몇 분 정도 걸리며 평판 스캐너에서 스캔한 PDF와 기능적으로 동일한 결과를 생성합니다.
사진에서 OCR 출력 정리
휴대폰으로 찍은 사진은 좋은 사진이라 할지라도 300DPI의 평판 스캔보다 OCR 정확도가 낮습니다. 인쇄된 페이지의 전화 사진은 일반적으로 90%~95%의 정확도로 OCR됩니다. 이는 대략 20개 단어 중 1개 단어에 오류가 있음을 의미합니다. 오류는 예측 가능한 위치, 즉 카메라 렌즈로 인해 왜곡이 발생하는 페이지 가장자리 근처, 10포인트 미만의 작은 글꼴, 그림자나 조명이 고르지 않은 영역에 클러스터됩니다.
사진에서 스캔 PDF을 변환한 후 PDF를 열고 일반적인 OCR 오류를 검색하세요. "cl"을 검색하세요. 이는 종종 "d"로 인식됩니다. "rn" 종종 "m"으로 인식됩니다. 그리고 "1" 이는 종종 "l"로 인식됩니다. 텍스트를 읽고 발견한 오류를 수정하세요. 정리에 필요한 시간은 문서 길이와 사진 품질에 따라 다릅니다. 단일 페이지 문서를 교정하는 데 5~10분 정도 걸립니다. 20페이지짜리 문서는 한 시간 이상이 걸립니다. 정리 단계는 엉성한 OCR 결과와 세련된 전문 문서를 구분하는 단계입니다.
사진이 스캐너보다 나은 경우
품질이 최우선인 경우 휴대폰 사진은 평판 스캐너를 대체할 수 없습니다. 하지만 필요할 때 휴대하지 않는 스캐너보다 휴대폰 사진이 훨씬 더 좋습니다. 최고의 카메라는 당신이 가지고 있는 카메라입니다. 도서관 서적, 컨퍼런스 유인물, 화이트보드 메모, 영수증, 표지판, 메뉴 및 책상 밖에서 마주치는 모든 인쇄물에서 텍스트를 캡처하기 위해 OCR이 적용된 전화 사진은 순간적인 시각적 만남을 영구적이고 검색 가능하며 편집 가능한 텍스트로 바꿉니다. WukongPDF의 이미지를 PDF로 파이프라인은 휴대폰 사진을 완성된 PDF에 1분 안에 연결하여 세상의 텍스트를 보는 것과 이를 사용할 수 있는 문서로 제공하는 것 사이의 격차를 줄입니다.
이해해야 할 한 가지 제한 사항: 휴대폰 카메라는 흑백 문서의 경우에도 색상 정보를 캡처하기 때문에 텍스트 문서의 휴대폰 사진은 일반적으로 동등한 평판 스캔보다 파일 크기가 더 큽니다. 단일 텍스트 페이지의 전화 사진은 JPEG로 3~5MB일 수 있지만, 흑백 모드에서 동일한 페이지의 평판 스캔은 200KB일 수 있습니다. 휴대폰으로 많은 페이지를 디지털화하는 경우 OCR을 실행하기 전에 사진을 회색조로 변환하세요. 이렇게 하면 파일 크기가 60~80% 줄어들고 회색조 변환을 통해 인식 엔진을 혼란스럽게 하는 색상 노이즈와 그림자가 제거되므로 OCR 정확도가 향상되는 경우가 많습니다. iPhone 및 Android에 내장된 사진 앱을 포함한 대부분의 사진 편집 앱에는 사진당 한 번의 탭으로 이 작업을 수행하는 회색조 또는 모노 필터가 포함되어 있습니다.
PDF OCR을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
