Others

내 PDF의 텍스트를 편집할 수 없는 이유

Why Cannot I Edit Text in My PDF

텍스트처럼 보이는 PDF를 편집할 수 없는 이유

PDF를 열고 화면에 나오는 단어를 보고 편집할 수 있다고 가정합니다. 텍스트를 클릭했는데 아무 일도 일어나지 않거나, 입력을 하려고 하는데 커서가 나타나지 않을 때, 텍스트 문서처럼 보이는 PDF가 실제로는 전혀 편집 가능한 문서가 아니라는 것을 발견하게 됩니다. PDF에는 근본적으로 다른 형식의 텍스트가 포함될 수 있고 그 중 일부만 편집할 수 있기 때문에 이러한 경험은 실망스러울 정도로 일반적입니다.

스캔한 PDF에서 OCR을 실행하면 문서의 모든 페이지 이미지 뒤에 검색 및 편집 가능한 텍스트 레이어가 추가됩니다.

PDF에서 편집 가능한 형식으로 변환한 후 다시 PDF로 변환하는 것은 직접 편집이 불가능할 때 신뢰할 수 있는 대체 방법입니다.

PDF 편집기는 선택 가능하고 수정 가능한 문자 코드로 표시되는 각 문자를 사용하여 PDF에 실제 텍스트 개체로 존재하는 텍스트를 수정할 수 있습니다. 이를 네이티브 또는 라이브 텍스트라고 합니다. PDF 형식에는 텍스트가 페이지 사진의 일부인 스캔 문서와 같이 이미지로만 존재하는 텍스트가 포함될 수도 있습니다. PDF에는 문자 데이터가 없고 문자 모양을 형성하는 픽셀만 포함되어 있으므로 이미지 기반 텍스트는 선택, 검색 또는 편집할 수 없습니다. PDF가 편집 가능한지 여부를 알기 전에 어떤 유형의 텍스트가 포함되어 있는지 알아야 합니다.

가장 빠른 테스트는 PDF에서 텍스트를 선택해 보는 것입니다. 단어를 클릭하고 드래그하세요. 드래그할 때 텍스트가 강조 표시되면 이는 기본 텍스트이며 잠재적으로 편집될 수 있습니다. 아무 것도 강조 표시되지 않고 커서가 변경되지 않으면 텍스트는 이미지 기반이므로 직접 편집할 수 없습니다. 텍스트가 강조 표시되지만 강조 표시가 불분명하여 일부 단어를 선택하고 다른 단어를 건너뛰는 경우 PDF에는 기본 텍스트와 시각적 요소로만 존재하는 텍스트가 혼합되어 있는 것입니다. 이는 이전 소프트웨어로 생성되거나 여러 소스 문서를 결합하여 생성된 PDF에서 흔히 발생하는 현상입니다.

WukongPDF

PDF 편집을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →

PDF 텍스트를 편집할 수 없는 일반적인 이유

가장 일반적인 이유는 PDF가 스캔된 문서이기 때문입니다. 평판 스캐너나 휴대폰 카메라 앱으로 종이 페이지를 스캔하여 생성된 PDF에는 실제 텍스트 문자가 아닌 텍스트 이미지가 포함되어 있습니다. 화면의 단어를 읽을 수는 있지만 PDF 파일에는 편집 가능한 텍스트 데이터가 포함되어 있지 않습니다. 스캔한 PDF를 편집 가능하게 만들려면 먼저 OCR을 실행하여 이미지의 텍스트를 인식하고 각 페이지 이미지 뒤에 보이지 않는 텍스트 레이어를 만들어야 합니다. OCR 후에는 텍스트를 검색할 수 있으며, 많은 PDF 편집기에서 마치 기본 텍스트인 것처럼 편집할 수 있습니다.

비밀번호 또는 권한 제한은 편집에 대한 또 다른 일반적인 장벽입니다. 권한 암호로 보호된 PDF는 열고 볼 수 있지만 권한으로 인해 편집, 복사 또는 인쇄가 차단될 수 있습니다. PDF를 열고 텍스트를 볼 수 있지만 편집 도구가 회색으로 표시되거나 오류 메시지가 표시되는 경우 문서의 보안 설정을 확인하세요. 대부분의 PDF 뷰어에서는 문서 속성 또는 보안 패널에 어떤 권한이 제한되어 있는지 표시됩니다. 편집이 제한되어 있고 권한 비밀번호가 있는 경우 제한을 제거하고 편집을 활성화할 수 있습니다.

PDF에는 작성 중에 윤곽선이나 곡선으로 변환된 텍스트가 포함될 수 있습니다. 그래픽 디자이너는 수신자가 해당 글꼴을 설치했는지 여부에 관계없이 글꼴이 올바르게 표시되도록 하기 위해 PDF를 만들기 전에 Adobe Illustrator와 같은 응용 프로그램에서 텍스트를 윤곽선으로 변환하는 경우가 있습니다. 윤곽선으로 변환된 텍스트는 시각적으로 기본 텍스트와 동일하게 보이지만 문자 데이터가 아닌 벡터 모양으로 구성됩니다. PDF 편집 없음] 도구는 윤곽선으로 변환하는 동안 문자 정보가 삭제되었기 때문에 윤곽선이 있는 텍스트를 텍스트로 편집할 수 있습니다.

글꼴 인코딩 문제로 인해 PDF에 기본 텍스트 문자가 포함된 경우에도 텍스트를 편집할 수 없게 될 수 있습니다. 일부 PDF는 비표준 방식으로 문자 코드를 글리프에 매핑하는 사용자 정의 글꼴 인코딩을 사용합니다. 편집 도구는 문자 코드를 볼 수 있지만 어떤 문자를 나타내는지 확인할 수 없으므로 텍스트 손상을 방지하기 위해 편집을 거부합니다. 이 문제는 전문 소프트웨어, 레거시 시스템 또는 사용자 정의 글꼴 처리와 함께 비라틴어 스크립트를 사용하는 문서에서 생성된 PDF에서 가장 일반적입니다. 글꼴 포함이 활성화된 원본 응용 프로그램에서 PDF를 다시 내보내면 인코딩 문제가 해결되는 경우가 많습니다.

OCR을 사용하여 스캔한 PDF를 편집 가능하게 만드는 방법

광학 문자 인식은 텍스트 이미지를 실제 편집 가능한 텍스트로 변환하는 프로세스입니다. 최신 OCR 기술은 일반 크기의 일반 글꼴로 인쇄된 텍스트를 깨끗하고 조명이 밝은 상태에서 스캔할 때 매우 정확합니다. 스캔한 PDF에서 OCR을 실행하면 인식된 문자가 포함된 각 페이지 이미지 뒤에 숨겨진 텍스트 레이어가 추가됩니다. OCR이 완료되면 문서에서 텍스트를 검색할 수 있으며 대부분의 PDF 편집기에서 인식된 텍스트를 원래 원본인 것처럼 편집할 수 있습니다.

OCR 출력 품질은 스캔한 이미지의 품질에 따라 달라집니다. 균일한 조명, 평평한 페이지 및 선명한 초점을 갖춘 300DPI의 고해상도 스캔은 표준 인쇄 텍스트에 대해 99% 이상의 OCR 정확도를 생성합니다. 그림자, 제본된 책의 구부러진 페이지 또는 초점이 맞지 않는 영역이 있는 150DPI의 저해상도 스캔은 정확도가 낮고 OCR 후 더 많은 수동 수정이 필요합니다. 평평한 페이지, 좋은 조명 및 적절한 해상도를 의미하는 OCR을 염두에 두고 문서를 스캔하면 편집 프로세스가 훨씬 더 원활해집니다.

OCR을 지원하는 대부분의 PDF 편집기에는 인식 설정의 일부로 언어 선택이 포함되어 있습니다. 올바른 언어를 선택하면 OCR 엔진이 언어별 사전과 문자 빈도 데이터를 사용하여 모호한 문자를 해결하므로 정확성이 향상됩니다. 프랑스어 설정으로 인식된 프랑스어 문서는 영어 설정으로 인식된 동일한 문서보다 더 나은 결과를 생성합니다. 다국어 문서의 경우 기본 언어를 선택하고 보조 언어 구문의 오류를 수동으로 수정합니다.

WukongPDF의 OCR PDF 도구는 브라우저에서 스캔한 문서를 처리하고 검색 및 편집 가능한 텍스트 레이어가 포함된 PDF를 반환합니다. OCR 엔진은 여러 언어를 지원하고 편지, 양식, 영수증 및 기사를 포함한 일반적인 문서 유형을 처리합니다. OCR 후에는 이전에 편집할 수 없었던 스캔 PDF가 편집 가능하게 되며 인식된 텍스트를 선택, 검색 및 수정할 수 있습니다.

직접 PDF 편집이 불가능할 때의 대체 접근 방식

PDF가 OCR에 액세스할 수 없는 스캔된 문서이거나 제거할 수 없는 보안 제한이 있기 때문에 PDF를 직접 편집할 수 없는 경우 대체 작업 흐름을 사용하면 다른 경로를 통해 동일한 결과를 얻을 수 있습니다. PDF를 Word 또는 Google Docs와 같은 편집 가능한 형식으로 변환하고 해당 형식으로 변경한 다음 편집된 문서를 다시 PDF로 변환합니다. 편집 가능한 형식을 통한 왕복은 직접 편집보다 시간이 오래 걸리지만 열고 볼 수 있는 모든 PDF에서 작동합니다.

단일 단락의 오타 수정과 같은 사소한 수정만 필요한 문서의 경우 PDF의 주석 도구를 사용하여 잘못된 텍스트를 흰색 직사각형으로 덮고 수정된 텍스트를 맨 위에 입력하는 것이 실용적인 해결 방법입니다. 이 방법은 기본 텍스트와 문서 구조를 실제로 편집하지 않으므로 주석 기반 수정은 검색 및 접근성 도구에 표시되지 않지만 이미지로 인쇄되거나 표시될 문서에 대한 빠른 시각적 수정의 경우 허용 가능한 결과를 생성합니다.

광범위한 편집이 필요하고 직접 편집할 수 없는 문서의 경우 가장 신뢰할 수 있는 접근 방식은 가능한 경우 원본 소스 문서로 돌아가는 것입니다.

PDF를 만드는 데 사용된 Word 문서, Google Doc 또는 InDesign 파일에는 수정하고 새 PDF로 다시 내보낼 수 있는 편집 가능한 텍스트가 포함되어 있습니다. 소스 파일에 대해 문서 작성자에게 연락하거나 자신의 기록에서 소스 파일을 찾는 것이 비협조적인 PDF를 편집하는 데 어려움을 겪는 것보다 빠른 경우가 많습니다.

기본 텍스트가 포함된 것으로 보이는 일부 PDF에는 텍스트를 검색하고 선택할 수 있음에도 불구하고 실제로 편집 도구로 수정할 수 없는 방식으로 텍스트가 저장되어 있습니다. 이러한 상황은 PDF에 검색 및 선택이 가능한 올바른 텍스트 레이어가 있지만 기본 글꼴 인코딩으로 인해 편집 도구가 편집된 문자를 올바른 시각적 문자 모양으로 다시 매핑하지 못하는 경우 발생합니다. 편집 도구는 텍스트를 읽을 수 있지만 잠재적으로 문자 매핑을 손상시키지 않고는 변경 사항을 문서에 다시 쓸 수 없습니다. 편집에 대한 이러한 방어는 문서 작성자 측에서 의도적으로 수행되는 경우도 있습니다.

PDF 편집 도구의 확산으로 인해 PDF 편집이 그 어느 때보다 쉬워졌지만 편집이 무엇인지에 대한 혼란도 야기되었습니다. PDF 페이지 위에 텍스트 주석을 추가하는 것은 기본 텍스트를 편집하는 것과 다릅니다. PDF 페이지에서 이미지를 바꾸는 것은 이미지를 설명하는 텍스트를 편집하는 것과 다릅니다. 기존 페이지 위에 새 콘텐츠를 오버레이하는 주석 기반 변경 사항과 PDF 구조 내의 실제 텍스트 콘텐츠를 수정하는 실제 텍스트 편집 간의 차이점을 이해하면 각 편집 작업에 적합한 도구와 올바른 접근 방식을 선택하는 데 도움이 됩니다.

모든 편집 시도를 거부하고 업데이트에 중요한 정보가 포함된 문서의 경우 핵 옵션은 문서를 처음부터 다시 만드는 것입니다. PDF를 시각적 참조로 사용하고 콘텐츠를 워드 프로세서나 디자인 응용 프로그램에 다시 입력하여 재작성 과정에서 편집합니다. 이 접근 방식은 노동 집약적이지만 잔여 서식 문제, 글꼴 문제 또는 변환 아티팩트 없이 깨끗하고 완전히 편집 가능한 문서를 생성합니다. PDF에서 문서를 다시 만드는 데는 문서의 길이와 복잡성에 비례하여 시간이 걸리며, 상당한 편집이 필요한 짧은 문서의 경우 비협조적인 PDF 편집 도구로 어려움을 겪는 것보다 실제로 더 빠를 수 있습니다.

WukongPDF

PDF 편집을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →