검색 가능한 PDF가 있습니다. 편집하려면 Word로 변환하세요. 편집한 문서를 다시 PDF로 저장합니다. 새 PDF는 원본과 동일해 보이지만 문서에 있는 것으로 알고 있는 단어를 검색하면 검색 결과가 반환되지 않습니다. 원본 PDF에서 검색 가능한 텍스트는 새 PDF의 검색 기능에서 보이지 않습니다. Word를 통한 왕복으로 인해 텍스트에서 검색 가능성이 제거되었습니다.
PDF를 Word로 변환한 후 Word를 PDF로 다시 변환하는 것은 PDF 편집을 위한 일반적인 작업 흐름이지만 각 변환 단계에서는 텍스트 레이어가 손상될 가능성이 있습니다. PDF 형식으로 다시 도착하는 텍스트는 원본과 다르게 저장되거나, 문자 코드 대신 벡터 윤곽선으로 저장되거나, 이미지로 래스터화될 수 있습니다. 이러한 각 결과는 텍스트가 표시되지만 검색할 수는 없는 PDF를 생성합니다.

형식 변환 중에 텍스트가 유지되거나 손실되는 방법
검색 가능한 원본 PDF에서 텍스트는 글꼴 상형 문자에 매핑된 문자 코드로 저장됩니다. 문자 H는 ASCII 코드 72로 저장되며, 이는 PDF 판독기에 포함된 글꼴에서 H의 문자 모양을 표시하도록 지시합니다. 검색 기능은 검색어에 대한 문자 코드를 스캔하고 페이지에서 해당 위치를 강조 표시합니다. 이 문자 코드 기반 저장소를 통해 텍스트를 검색할 수 있습니다.
PDF가 Word로 변환되면 변환기는 문자 코드를 추출하여 Word 문서에 편집 가능한 텍스트로 씁니다. Word의 텍스트는 Word에서 유니코드 문자 코드로 저장되기 때문에 검색 가능합니다. PDF에서 Word로 변환하면 변환기가 문자 코드를 올바르게 추출하는 한 검색 가능성이 유지됩니다.
편집된 Word 문서가 PDF로 다시 저장되면 Word PDF 엔진은 텍스트 저장 방법을 결정해야 합니다. 기본 설정은 텍스트를 글꼴이 포함된 문자 코드로 저장하여 검색 가능성을 유지합니다. 그러나 특정 Word 기능 및 PDF 설정으로 인해 텍스트가 벡터 윤곽선으로 저장되거나 이미지로 래스터화됩니다.
텍스트 그림자, 반사, 광선 및 3D 회전과 같은 Word의 텍스트 효과로 인해 Word PDF 엔진은 영향을 받은 텍스트를 이미지로 변환합니다. 텍스트가 시각적으로는 정확해 보이지만 검색 기능에서 찾을 수 있는 문자 코드가 없습니다. 시각 효과가 적용된 텍스트의 경우 PDF Searchable 속성이 손실됩니다.
PDF를 Word로 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
왕복 동안 텍스트 검색 가능성을 유지하는 방법
편집된 Word 문서를 PDF로 저장하기 전에 저장 설정을 확인하세요. Word에서 파일, 옵션, 저장을 열고 파일에 글꼴 포함이 선택되어 있는지 확인하세요. 이 설정을 사용하면 글꼴이 윤곽선이나 이미지로 변환되지 않고 문자 기반 텍스트로 포함됩니다.
검색 가능한 상태를 유지해야 하는 콘텐츠에는 텍스트 효과를 적용하지 마세요. 그림자, 반사, 네온 효과 대신 굵게, 기울임꼴, 색상 서식을 사용하세요. 검색 가능성을 희생하지 않고도 시각적인 구별이 가능합니다.
WukongPDF는 PDF를 처리하여 텍스트 저장을 최적화할 수 있는 PDF 변환기 도구를 제공합니다. 검색할 수 없는 텍스트가 포함된 PDF를 만든 경우 OCR은 기존 시각적 콘텐츠 뒤에 검색 가능한 텍스트 레이어를 추가할 수 있습니다.
재변환 후 검색 가능성 확인
Word 문서를 PDF로 저장한 후 PDF를 열고 검색 기능을 테스트합니다. 각 페이지에 나타나는 단어를 검색하세요. 페이지에서 눈에 띄게 존재하는 단어에 대한 결과를 반환하지 않으면 해당 페이지에는 검색할 수 없는 텍스트가 있는 것입니다. 검색 테스트는 몇 초가 걸리며 문서가 배포되기 전에 검색 가능성 손실을 포착합니다.
검색 가능성이 손실된 경우 다시 변환된 PDF에서 OCR을 실행하여 검색 가능한 텍스트 레이어를 추가하세요. OCR은 보이는 텍스트를 인식하고 그 뒤에 문자 코드를 생성합니다. 그런 다음 검색 기능은 OCR 생성 문자 코드를 통해 텍스트를 찾을 수 있습니다. 이는 예방이 아닌 사후 수정이지만 검색할 수 없는 PDF에 대한 검색 가능성을 복원합니다.
검색 가능성이 보장되어야 하는 문서의 경우 PDF에서 Word로의 PDF 왕복을 완전히 피하세요. 원본 소스 문서, Word 파일, InDesign 파일, Google Docs를 편집하고 새로운 PDF를 내보냅니다. 소스에서 PDF로 한 번만 내보내면 중간 변환 단계 없이 검색 가능성이 유지됩니다.
Word 호환 모드는 PDF 출력에 영향을 미칩니다. DOCX가 아닌 이전 DOC 형식으로 저장된 문서는 PDF 검색 가능성에 영향을 미치는 다른 텍스트 저장 방법을 사용할 수 있습니다. PDF로 내보내기 전에 문서를 현재 DOCX 형식으로 저장하세요.
텍스트 상자 형식에 따라 PDF를 내보내는 동안 Word 텍스트 상자의 텍스트가 래스터화될 수 있습니다. 채우기 효과, 회전 또는 텍스트 방향 변경이 있는 텍스트 상자는 일반 텍스트 상자보다 래스터화될 가능성이 높습니다.
PDF를 내보내는 동안 텍스트가 래스터화되면 인코딩된 텍스트가 아닌 텍스트 이미지가 됩니다. 이미지는 올바르게 표시되지만 문자는 코드가 아닌 픽셀입니다. OCR은 텍스트를 복구할 수 있지만 OCR 텍스트에는 인식 오류가 포함될 수 있습니다.
Word의 PDF 내보내기 옵션에는 글꼴이 포함되지 않을 수 있는 경우 비트맵 텍스트 설정이 포함되어 있습니다. 이 설정은 포함 제한이 있는 글꼴을 사용하는 텍스트를 래스터화합니다. 모든 글꼴이 포함을 허용하도록 하면 이러한 강제 래스터화를 방지할 수 있습니다.
왕복 변환 후 원본 PDF와 다시 변환된 PDF의 파일 크기를 비교하세요. 다시 변환된 PDF의 크기가 상당히 크다면 텍스트가 이미지로 래스터화되어 인코딩된 텍스트보다 더 많은 저장 공간을 소비한다는 의미일 수 있습니다.
일부 PDF-Word 변환기는 스캔한 PDF에 대한 OCR 기반 변환 모드와 디지털 PDF에 대한 텍스트 추출 모드를 제공합니다. 잘못된 모드를 사용하면 예상치 못한 결과가 발생합니다. 디지털 PDF는 원래 문자 인코딩을 보존하기 위해 OCR이 아닌 텍스트 추출을 사용해야 합니다.
텍스트 검색 기능이 손실되면 PDF 뷰어의 찾기 기능은 눈에 보이는 단어에 대한 결과를 반환하지 않습니다. 각 페이지에서 또는 및 같은 일반적인 단어를 검색하면 전체 문서에 검색 가능한 텍스트가 있는지 빠르게 확인할 수 있습니다.
여러 편집 주기를 통해 검색 가능성을 유지해야 하는 문서의 경우 편집 가능한 형식(Word, Google Docs 또는 InDesign)으로 마스터 문서를 설정하고 PDF를 읽기 전용 배포 형식으로 처리합니다. 모든 편집은 마스터에서 이루어지며 PDF는 각 편집 주기 후에 마스터에서 다시 생성됩니다.
접근성 검사기는 텍스트 검색 가능성을 확인하고 검색할 수 없는 텍스트가 있는 페이지를 식별할 수 있습니다. 다시 변환된 PDF에서 접근성 검사를 실행하여 모든 텍스트가 인코딩되고 액세스 가능한지 확인합니다.
PDF/UA 표준에서는 검색 가능성과 화면 판독기 액세스를 보장하기 위해 모든 텍스트를 유니코드 문자로 인코딩해야 합니다. Word에서 PDF/UA로 내보내면 검색 가능성을 유지하는 텍스트 인코딩 요구 사항이 적용됩니다.
PDF-Word 변환기 선택은 텍스트 보존에 영향을 미칩니다. 텍스트 편집 가능성보다 시각적 충실도를 우선시하는 변환기는 특이한 글꼴이나 위치 지정을 사용하는 텍스트를 래스터화할 수 있습니다. 텍스트 편집 가능성을 우선시하는 변환기는 더 검색 가능한 출력을 생성할 수 있습니다.
텍스트가 PDF에서 합자(fi, fl, ffi)로 저장되면 변환기는 합자를 별도의 문자로 분할하거나 단일 문자로 보존할 수 있습니다. 검색 기능 동작은 변환 중에 합자가 처리된 방식에 따라 달라집니다.
향후 변환 시 검색 가능성 손실 방지
원본 PDF에서 원래 벡터 기반이었던 텍스트는 Word 문서에서 WordArt, SmartArt 또는 포함된 Excel 차트와 같은 기능을 사용하는 경우 Word를 PDF로 내보내는 동안 래스터 이미지로 변환될 수 있습니다. 이러한 기능은 PDF 출력에서 이미지로 렌더링됩니다.
Word의 PDF 생성 설정에는 제목에서 책갈피를 만드는 옵션이 포함되어 있습니다. 이 옵션은 문서 구조를 유지하지만 텍스트 검색 가능성에는 영향을 주지 않습니다. 북마크와 검색 가능성은 독립적인 기능입니다.
문서 언어의 일반적인 단어와 같이 모든 페이지에 나타나는 단어를 검색하여 검색 가능성을 테스트하면 검색할 수 없는 텍스트가 있는 페이지를 빠르게 식별할 수 있습니다. 페이지에서 일반적인 단어에 대한 결과가 반환되지 않으면 해당 페이지에 텍스트 인코딩 문제가 있는 것입니다.
PDF에서 Word로, PDF로 왕복하는 동안 텍스트 검색 가능성이 손실되는 조건을 이해하면 문서 작성자는 편집 작업 흐름에 대해 정보에 입각한 선택을 하고 콘텐츠의 접근성과 검색 가능성을 유지할 수 있습니다.
PDF-Word-PDF 왕복을 통해 텍스트 검색 기능을 유지하려면 각 단계의 변환 설정에 주의를 기울여야 하며 어떤 Word 기능으로 인해 텍스트가 문자로 인코딩되지 않고 래스터화되는지 이해해야 합니다.
텍스트 검색 가능성이 요구되는 문서의 경우 모든 형식 변환을 통해 원본 인코딩된 텍스트를 보존하는 작업 흐름을 설정하는 것이 손실된 후 검색 가능성을 복원하려고 시도하는 것보다 더 효율적입니다.
텍스트 검색 가능성은 없어질 때까지 사용자가 당연하게 여기는 기능이며, 검색할 수 없는 PDF에 대한 검색 가능성을 복원하려면 원본 소스에서 다시 처리하거나 영향을 받은 페이지에서 OCR을 실행하여 텍스트 레이어를 다시 생성해야 합니다.
PDF-Word-PDF 왕복은 텍스트 인코딩이 저하되거나 손실될 수 있는 여러 기회를 제공하는 일반적인 편집 작업 흐름이며, 각 위험 지점을 이해하면 사용자가 프로세스를 통해 검색 가능성을 유지하는 데 도움이 됩니다.
텍스트 검색 기능은 외관상의 기능이 아니라 접근성, 검색 가능성, 콘텐츠를 추출하고 다른 용도로 재활용하는 기능에 영향을 미치는 기본적인 문서 기능입니다.
PDF-Word 변환기의 선택은 왕복 결과에 큰 영향을 미치며, 텍스트 편집 가능성에 최적화된 변환기는 시각적 충실도에 최적화된 변환기보다 더 검색 가능한 출력을 생성합니다.
왕복 중에 검색 가능성이 손실되면 OCR은 검색 가능한 텍스트 레이어를 복원할 수 있지만 OCR 텍스트에는 문서를 완전히 신뢰할 수 있도록 수정해야 하는 인식 오류가 포함됩니다.
검색 가능성이 요구되는 문서의 경우 원본 소스 파일을 유지하고 각 편집 주기 후에 새로운 PDF를 내보내는 것이 Word를 통해 왕복하는 것보다 더 안정적입니다.
PDF 형식은 워드 프로세싱 형식과 근본적으로 다른 방식으로 텍스트를 보존하며 이러한 표현 간의 각 번역으로 인해 텍스트 인코딩 시 정보가 손실될 위험이 있습니다.
| 왕복 단계 | 검색 가능성 위험 | 완화 |
|---|---|---|
| PDF를 Word로(추출) | 텍스트 추출 변환기를 사용하는 경우 낮음 | 텍스트 추출 모드로 변환기 사용 |
| Word에서 편집 | 없음; 단어 텍스트는 항상 검색 가능합니다. | 텍스트 효과(그림자, 광선, 3D) 피하기 |
| Word를 PDF로(내보내기) | 중간; 효과로 인해 래스터화 발생 | 글꼴 삽입; 검색 가능한 텍스트에 대한 영향 방지 |
| 수출 후 검증 | 해당 없음 | 모든 페이지에서 일반적인 단어 검색 |
PDF를 Word로 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
