PDF를 열고 텍스트 단락을 선택한 다음 삭제를 누르고 그 자리에 새 텍스트를 입력한 다음 파일을 저장합니다. 새 텍스트가 화면에 나타납니다. 문서를 보내드립니다. 수신자는 이전 텍스트에만 나타난 용어를 PDF에서 검색하고 검색을 통해 해당 용어를 찾습니다. 삭제했다고 생각했던 이전 텍스트는 여전히 파일에 있고 새 텍스트 뒤에 숨겨져 있으며 화면에서는 보이지 않지만 문서 데이터에는 완전히 존재합니다. 이 불안한 경험은 PDF 편집에 대한 근본적인 진실을 드러냅니다. 즉, 보이는 것이 전부가 아니라는 것입니다.
브라우저 및 기본 데스크톱 응용 프로그램에서 사용할 수 있는 PDF 편집기 도구는 일반적으로 PDF를 완전히 대체하는 것이 아니라 PDF에 콘텐츠를 추가합니다. 단락을 삭제하고 새 텍스트를 입력하면 편집기는 이전 텍스트 위에 흰색 직사각형을 그리고 새 텍스트를 맨 위에 배치합니다. 이전 텍스트는 파일 데이터 레이어에 남아 있습니다. 텍스트를 추출하거나, 문서를 검색하거나, 다른 형식으로 변환하는 사람이라면 삭제된 줄 알았던 내용을 복구할 수 있습니다.

PDF 편집의 실제 작동 방식: 교체가 아닌 오버레이
PDF 파일은 편집용으로 설계되지 않았습니다. 이 형식은 인쇄된 페이지와 동등한 디지털 출력 형식인 최종 출력 형식으로 만들어졌습니다. PDF 편집기가 문서를 수정할 때 원본 텍스트 개체를 다시 작성하지 않습니다. 이전 개체 위에 그려지는 새 개체를 추가합니다. 원본 텍스트 개체를 제거하려면 페이지 콘텐츠 스트림을 다시 작성해야 하기 때문에 파일에 남아 있습니다. 이는 오버레이를 추가하는 것보다 훨씬 더 복잡한 작업입니다.
이 오버레이 접근 방식은 문서 보안 및 PDF 형식 무결성에 중요한 결과를 가져옵니다. 오래된 콘텐츠는 절대 제거되지 않고 덮어지기만 하기 때문에 편집할 때마다 문서 크기가 늘어납니다. 10번 편집된 PDF에는 원본 내용과 9개의 편집 레이어가 포함되어 있습니다. 표시되는 페이지 수와 겉보기 내용은 동일하게 유지되더라도 개정될 때마다 파일 크기가 늘어납니다.
오버레이 접근 방식은 편집 속도를 위해 편집 품질을 교환하며, 숨겨진 콘텐츠가 다시 나타날 때까지 상충 관계는 보이지 않습니다.
오버레이 문제는 텍스트 편집에서 가장 심각합니다. 편집자는 이전 텍스트를 숨기고 새 텍스트를 별도의 텍스트 개체에 배치하기 위해 흰색 직사각형을 그릴 수 있습니다. 흰색 직사각형은 이전 텍스트를 시각적으로 덮지만 이전 텍스트는 여전히 텍스트 레이어에 있습니다. 화면 판독기는 이전 텍스트와 새 텍스트를 모두 읽습니다. 검색하면 둘 다 발견됩니다. 텍스트 추출 도구는 두 가지를 모두 얻습니다. 편집은 화장품이었습니다.
적절하게 구현된 PDF Editor 수정 도구는 텍스트 레이어에서 콘텐츠를 제거합니다. 동일한 애플리케이션의 범용 텍스트 편집 도구는 그렇지 않을 수도 있습니다. 사용자는 삭제가 제거를 의미한다고 합리적으로 기대하지만 PDF 형식에서는 추가보다 제거가 더 어렵고 많은 편집자가 더 쉬운 경로를 택합니다.
PDF 편집을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
이전 텍스트가 다시 나타날 수 있는 경우
오버레이로 숨겨진 이전 텍스트는 여러 가지 일반적인 시나리오에서 다시 나타날 수 있습니다. PDF를 Word 또는 일반 텍스트와 같은 다른 형식으로 변환하면 숨겨진 이전 텍스트를 포함하여 문서에서 모든 텍스트가 추출됩니다. 변환 도구는 PDF 텍스트 레이어를 직접 읽고 흰색 오버레이 직사각형을 표시하지 않습니다. 이는 텍스트 콘텐츠가 아닌 시각적 요소이기 때문입니다.
다른 뷰어에서 PDF를 열면 숨겨진 텍스트가 나타날 수 있습니다. 페이지를 다르게 렌더링하는 뷰어는 흰색 오버레이 직사각형을 잘못된 위치에 배치하거나 전혀 렌더링하지 않아 이전 텍스트를 노출할 수 있습니다. 브라우저 기반 뷰어, 모바일 PDF 앱 및 이전 데스크톱 뷰어에는 각각 오버레이 위치에 영향을 줄 수 있는 고유한 렌더링 문제가 있습니다.
문서 검색 시 찾기 기능을 이용하면 시각적 레이어가 아닌 텍스트 레이어를 검색합니다. 삭제된 텍스트에 나타나는 단어를 검색하면 해당 단어가 화면에 표시되지 않더라도 해당 단어를 찾을 수 있습니다. 이는 수신자가 삭제된 것으로 추정되는 콘텐츠가 파일에 여전히 존재한다는 것을 발견하는 방법입니다.
화면 판독기와 접근성 도구는 텍스트 레이어를 읽습니다. 화면 판독기에 의존하는 시각 장애가 있는 사용자는 현재 텍스트와 삭제된 텍스트를 모두 듣게 되는데, 자신이 듣고 있는 내용 중 일부가 숨겨져 있어야 한다는 표시가 없는 경우가 많습니다. PDF 메타데이터 및 구조는 문서 수정 내역에서 이전 편집 내용의 흔적을 유지할 수도 있습니다.
삭제된 텍스트가 실제로 사라졌는지 확인하는 방법
PDF를 편집한 후 편집된 파일에서 텍스트 추출을 실행하여 삭제된 텍스트가 실제로 제거되었는지 확인하십시오. Ctrl+A를 사용하여 PDF의 모든 텍스트를 복사하고 텍스트 편집기에 붙여넣습니다. 붙여넣은 텍스트에서 삭제한 문구를 검색하세요. 문구가 나타나면 삭제는 외관상 삭제된 것입니다. 또는 편집된 PDF를 일반 텍스트 파일로 변환하고 삭제된 콘텐츠를 검색하세요.
두 번째 확인 방법은 PDF 찾기 기능을 사용합니다. 삭제된 텍스트에서 구별되는 단어나 문구를 검색하세요. 찾기 도구가 해당 텍스트를 찾으면 해당 텍스트는 여전히 문서 데이터 레이어에 있는 것입니다. 대부분의 PDF 리더에 있는 찾기 도구는 텍스트 콘텐츠 스트림을 직접 검색하며 시각적 오버레이의 영향을 받지 않습니다.
민감한 문서의 경우 일반 편집 도구가 아닌 전용 교정 도구를 사용하여 내용을 제거하세요. 교정 도구는 데이터 영역에서 텍스트를 시각적으로 덮는 것이 아니라 데이터 영역에서 텍스트를 제거하도록 설계되었습니다. 편집과 수정의 차이는 콘텐츠를 숨기는 것과 제거하는 것의 차이입니다.
PDF에서 텍스트를 올바르게 제거하는 방법
WukongPDF는 일반 편집 도구뿐만 아니라 교정 도구도 제공합니다. PDF에서 내용을 영구적으로 제거해야 하는 경우 텍스트 편집 기능이 아닌 교정 기능을 사용하십시오. 교정은 데이터 레이어에서 텍스트를 제거하고 그 자리에 검은색 표시나 공백을 배치합니다. 이후의 텍스트 추출, 검색 및 변환에서는 수정된 콘텐츠가 더 이상 파일에 존재하지 않기 때문에 수정된 콘텐츠를 찾을 수 없습니다.
이미 PDF를 편집했고 이전 텍스트를 복구할 수 없도록 해야 하는 경우 가장 안전한 방법은 PDF를 새 PDF로 인쇄하는 것입니다. 인쇄 프로세스에서는 각 페이지를 이미지와 같은 표현으로 렌더링하고 숨겨진 텍스트 레이어와 오버레이를 모두 삭제합니다. 출력 PDF에는 페이지에 표시되는 내용만 포함됩니다. 단점은 새 PDF에서 텍스트 검색 가능성, 링크 및 기타 대화형 기능이 손실된다는 것입니다.
또 다른 접근 방식은 보이는 텍스트 레이어만 추출하여 숨겨진 콘텐츠를 버리고 새 PDF를 만드는 것입니다. 이를 위해서는 보이는 텍스트 개체와 숨겨진 텍스트 개체를 구별하고 보이는 개체만 선택적으로 내보낼 수 있는 도구가 필요합니다. 결과 PDF는 깨끗하고 의도한 내용만 포함합니다.
실수로 인한 콘텐츠 보존 방지
외부에 공유할 PDF를 편집할 때 내용 확인 단계를 포함하는 작업 흐름을 설정하세요. 편집 후 텍스트 추출을 실행하고 제거되어야 하는 콘텐츠를 검색하세요. 법률, 금융 또는 개인 데이터가 포함된 문서의 경우 파일이 사용자의 통제를 벗어나기 전에 이 확인 단계를 필수로 수행해야 합니다.
광범위한 편집이 필요한 문서에는 PDF 이외의 형식을 사용하는 것이 좋습니다. 문서를 원래 형식인 Word, Google Docs, InDesign으로 편집하고 콘텐츠가 최종 완성되면 새로운 PDF를 내보냅니다. 원본 문서에서 새로 내보낸 파일에는 편집 기록이나 숨겨진 콘텐츠가 없습니다. PDF는 편집 캔버스가 아닌 최종 출력 형식으로 의도된 목적을 수행합니다.
문제는 텍스트에만 국한되지 않습니다. 기본 편집기를 사용하여 PDF에서 삭제한 이미지도 파일 데이터에 남아 있을 수 있습니다. 편집기는 이전 이미지 위에 흰색 직사각형을 그리고 새 이미지를 맨 위에 배치합니다. 원본 이미지 데이터는 여전히 PDF에 포함되어 있어 파일 크기가 늘어나고 포함된 모든 개체를 열거할 수 있는 도구를 사용하여 파일을 여는 사람은 누구나 추출할 수 있습니다.
PDF에 민감한 정보를 보존하는 것은 문서화된 보안 위험입니다. 2023년에 호주 신호국(Australian Signals Directorate)은 비전문 도구를 사용하여 PDF 교정을 수행하면 교정된 콘텐츠를 복구 가능한 상태로 남길 수 있다는 경고 지침을 발표했습니다. 지침에는 텍스트나 이미지 위에 검은색 상자를 그려도 기본 데이터가 제거되지 않으며 변환된 문서에서 제거된 것으로 추정되는 콘텐츠가 노출될 수 있다는 점을 구체적으로 명시했습니다.
이전 콘텐츠의 흔적을 포함해서는 안 되는 편집된 PDF를 공유하는 가장 안전한 방법은 보이는 콘텐츠로만 PDF를 다시 작성하는 것입니다. PDF 프린터 드라이버를 사용하여 편집된 문서를 새 PDF로 인쇄합니다. 이 프로세스는 각 페이지를 화면에 나타나는 대로 렌더링하고 표시되는 콘텐츠만 새 파일에 씁니다. 숨겨진 텍스트, 삭제된 이미지 및 편집 기록은 렌더링된 페이지 모양의 일부가 아니기 때문에 모두 삭제됩니다.
법적 공개 또는 정보 요청의 자유가 적용되는 문서를 처리하는 조직의 경우 편집과 수정의 차이점을 이해하는 것이 필수적입니다. 숨겨져 있지만 복구 가능한 텍스트가 포함된 공개 요청에 대한 응답으로 생성된 문서는 심각한 법적 결과를 초래할 수 있습니다. 법원과 규제 기관에서는 숨겨진 콘텐츠가 페이지에 표시되었는지 여부에 관계없이 공개된 콘텐츠로 취급합니다.
민감한 정보나 기밀 정보가 포함된 PDF의 가장 안전한 편집 작업 과정은 PDF가 아닌 소스 문서를 편집하는 것입니다. 원본 Word 파일, Google Docs 또는 디자인 파일을 변경하고 편집된 소스에서 새로운 PDF를 내보냅니다. 새로 내보내기에는 숨겨진 콘텐츠, 편집 기록 및 지정된 수신자가 복구할 수 있는 이전 버전의 잔여 데이터가 포함되지 않습니다.
| 시나리오 | 숨겨진 텍스트가 노출되는 방식 | 위험 수준 |
|---|---|---|
| PDF를 Word로 변환 | 변환기는 데이터 영역에서 모든 텍스트를 추출합니다. | 높음: 숨겨진 텍스트가 모두 표시됩니다. |
| PDF 내에서 검색 | 찾기 기능은 시각적 레이어가 아닌 텍스트 스트림을 검색합니다. | 매체: 숨겨진 텍스트의 존재를 드러냅니다. |
| 스크린 리더 액세스 | 오버레이를 무시하고 텍스트 레이어를 직접 읽습니다. | 높음: 이전 텍스트와 새 텍스트를 함께 읽습니다. |
| 다양한 PDF 뷰어 | 대체 뷰어가 오버레이를 올바르게 렌더링하지 못할 수 있음 | 중간: 시청자 간에 일관성이 없음 |
| 텍스트 추출/복사-붙여넣기 | 모두 선택은 데이터 영역의 모든 텍스트를 캡처합니다. | 높음: 숨겨진 텍스트가 붙여넣기 버퍼에 나타납니다. |
PDF 편집을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
