대부분의 사람들은 PDF를 압축하면 일정 수준의 품질 손실이 허용된다고 가정합니다. 그 가정은 절반만 사실이다. PDF 내의 텍스트와 벡터 그래픽은 고정된 픽셀 격자가 아닌 모양, 곡선 및 문자 모양에 대한 수학적 설명으로 저장됩니다. 압축 도구가 이러한 차이점을 이해하면 포함된 래스터 이미지를 적극적으로 최적화하여 모든 문자, 선 및 다각형을 원본과 똑같이 선명하게 유지하여 파일을 축소할 수 있습니다. 결과는 동일해 보이지만 크기가 아주 작은 파일입니다.
문제는 압축 도구가 압축을 적용하기 전에 벡터 콘텐츠를 포함한 모든 것을 단일 이미지 레이어로 병합할 때 발생합니다. 이 시점에서 텍스트는 압축된 이미지에 영향을 미치는 동일한 흐림 및 JPEG 아티팩트가 발생하기 쉬운 텍스트 사진이 됩니다. 이런 일이 언제, 왜 발생하는지 이해하는 것이 이를 방지하는 열쇠입니다. 이 가이드에서는 PDF의 벡터 콘텐츠와 래스터 콘텐츠의 차이점, 파일에 포함된 유형을 식별하는 방법, 선명한 텍스트를 픽셀화된 엉망으로 만들지 않고 파일 크기를 줄이는 압축 설정을 선택하는 방법에 대해 설명합니다.

일부 PDF 압축기가 텍스트를 흐릿한 이미지로 바꾸는 이유는 무엇입니까?
PDF Association의 2025년 조사에 따르면 압축 후 시각적 품질 손실을 보고한 사용자 중 47%가 JPEG 또는 JPEG 2000 압축을 적용하기 전에 텍스트를 포함한 전체 페이지를 래스터화하는 도구를 사용한 것으로 나타났습니다(PDF Association, "PDF Compression Practices Survey", 2025). PDF 페이지가 래스터화되면 페이지의 모든 요소가 고정된 해상도의 단일 평면 이미지로 변환됩니다. 한때 선택 가능하고 검색 가능했으며 무한히 선명했던 텍스트는 텍스트 그림이 되며 그 선명도는 래스터화 단계에서 사용된 해상도에 따라 제한됩니다.
이는 단순화된 처리 파이프라인을 사용하는 브라우저 기반 도구 및 경량 모바일 앱에서 가장 자주 발생합니다. 내부 PDF 구조를 구문 분석하고 개별 이미지 개체를 선택적으로 다시 압축하는 대신 페이지를 캔버스 요소나 오프스크린 비트맵으로 렌더링한 다음 해당 비트맵을 새 이미지로 인코딩합니다. 내부 복잡성에 관계없이 빠르고 모든 PDF에서 작동하지만 외과 의사의 작업을 큰 망치로 처리합니다.
PDF 파일 형식은 시각적 콘텐츠를 표현하기 위해 근본적으로 다른 두 가지 방법을 사용합니다. 벡터 그래픽은 그리기를 위한 지침을 저장합니다: A 지점에서 B 지점까지의 선, 주어진 반경을 가진 원, 지정된 크기의 지정된 글꼴의 문자. 이 지침은 전화기 화면부터 광고판까지 디스플레이가 요구하는 모든 해상도를 선명도 손실 없이 렌더링합니다. 래스터 이미지는 고정 해상도(일반적으로 72~300dpi)로 컬러 픽셀 그리드를 저장하며 눈에 띄는 저하 없이 기본 해상도 이상으로 확대할 수 없습니다.
워드 프로세서나 전자 출판 응용 프로그램에서 작성된 PDF는 일반적으로 벡터 중심이기 때문에 이러한 구별이 중요합니다. 해당 텍스트는 글꼴 참조와 함께 문자 코드로 저장된 실제 텍스트입니다. 로고와 차트는 벡터 경로입니다. 포함된 사진만 래스터 이미지입니다. 적절하게 설계된 압축 도구는 이를 알고 벡터 부분을 그대로 둡니다.
PDF 압축을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
PDF에 벡터 텍스트가 포함되어 있는지 래스터 텍스트가 포함되어 있는지 확인하는 방법
압축을 적용하기 전에 PDF에 실제로 어떤 내용이 포함되어 있는지 아는 것이 좋습니다. 가장 간단한 테스트는 표준 PDF 뷰어에서 파일을 열고 400% 이상으로 확대하는 것입니다. 텍스트가 가장자리가 매끄럽고 선명하게 유지되면 벡터 텍스트입니다. 가장자리가 들쭉날쭉하거나 고르지 않은 경우 텍스트가 이미 일부 초기 단계에서 래스터화된 것이므로 추가 압축에 각별히 주의해야 합니다.
두 번째 테스트는 텍스트 문장을 선택하고 복사하는 것입니다. 개별 문자를 강조 표시하고 클립보드에 복사할 수 있으면 해당 텍스트가 실제 텍스트 데이터로 저장됩니다. 클릭하고 끌면 텍스트 흐름을 따르지 않고 직사각형 영역이 선택되거나 아무 것도 선택할 수 없는 경우 페이지가 스캔된 이미지이거나 래스터화된 것입니다. 스캔한 PDF는 텍스트 레이어를 복구하기 위해 OCR 처리가 필요하며, 이를 압축하려면 기본 디지털 문서를 압축하는 것과는 다른 고려 사항이 필요합니다.
pdfinfo 또는 메타데이터 뷰어와 같은 도구를 사용하여 파일의 개체 구조를 확인할 수도 있습니다. 실제 텍스트의 존재를 확인하는 글꼴 개체와 JPEG 또는 JPEG 2000 압축 래스터 이미지를 나타내는 DCTDecode 또는 JPXDecode 필터가 있는 이미지 개체를 찾습니다. 글꼴 개체와 이미지 개체가 모두 포함된 문서는 혼합 콘텐츠 PDF이며 선택적 압축에 이상적인 문서입니다. 이 내부 구조를 이해하면 품질을 유지하는 압축과 품질을 저하시키는 압축을 구분할 수 있습니다.
벡터 콘텐츠를 보호하는 압축 설정 선택
모든 벡터 세부 사항을 유지하면서 PDF를 압축해야 하는 경우 WukongPDF의 PDF 압축 도구를 사용하여 각 페이지 요소를 개별적으로 분석할 수 있습니다. 이미지 데이터만 최적화되는 동안 텍스트 및 벡터 경로는 그대로 유지되므로 눈에 띄는 텍스트 품질 변화 없이 대부분의 파일이 50~70% 축소됩니다.
대부분의 데스크탑 및 온라인 압축 도구는 최대 압축에서 최대 품질까지의 품질 설정을 제공하지만 슬라이더의 레이블은 도구가 실제로 수행하는 작업을 거의 알려주지 않습니다. '고압축'이라는 설정이 있습니다. 벡터 콘텐츠가 보존된 공격적인 이미지 다운샘플링을 의미할 수도 있고, 150DPI에서 전체 페이지 래스터화 후 과도한 JPEG 압축을 의미할 수도 있습니다. 차이점은 외관상의 차이가 아니라 동일해 보이는 작은 파일과 눈에 띄게 성능이 저하된 작은 파일의 차이입니다.
찾아야 할 가장 중요한 설정은 이미지 다운샘플링 해상도입니다. 일반적인 사전 설정에는 화면 전용 보기용 72DPI, 인쇄 가능한 표준 사무용 문서용 150DPI, 전문 인쇄용 문서용 300DPI가 포함됩니다. 벡터 텍스트 및 그래픽의 경우 DPI 설정은 다운샘플링할 픽셀이 없기 때문에 관련이 없습니다. PDF 내부의 래스터 이미지만 영향을 받으며 150DPI에서도 화면 읽기에 완벽하게 허용됩니다.
컬러 및 회색조 이미지에 적용되는 압축 알고리즘은 두 번째 중요한 설정을 구성합니다. 60~80% 품질 수준의 JPEG 압축은 일반적으로 사진 콘텐츠의 가시적 차이를 최소화하면서 압축되지 않은 원본보다 50~70% 더 작은 파일을 생성합니다. 흑백 스캔의 경우 JBIG2 또는 CCITT 그룹 4 압축은 텍스트 가독성을 유지하면서 흑백 페이지에서 탁월한 크기 감소를 달성합니다. 올바른 PDF 크기 줄이기 접근 방식은 이러한 결정을 분리하여 동일한 페이지 내의 다양한 콘텐츠 유형에 다양한 알고리즘을 적용합니다.
래스터-벡터 구별을 유지하는 도구
압축 도구 환경은 두 가지 범주, 즉 내부 PDF 개체 구조를 구문 분석하고 존중하는 범주와 PDF를 다시 인코딩할 일반 이미지로 처리하는 범주로 깔끔하게 나뉩니다. 첫 번째 범주의 도구는 PDF의 상호 참조 테이블을 읽고, 각 콘텐츠 스트림, 글꼴 및 이미지 개체를 개별적으로 식별하고, 적합한 경우에만 압축을 적용합니다. 두 번째 범주의 도구는 페이지를 비트맵으로 렌더링한 다음 해당 비트맵을 압축하여 처음에 PDF를 PDF로 만든 구조적 정보를 삭제합니다.
Adobe Acrobat Pro, Ghostscript 및 여러 오픈 소스 PDF 프로세서와 같은 데스크탑 애플리케이션이 첫 번째 범주에 속합니다. 텍스트 및 벡터 컨텐츠 스트림을 건드리지 않으면서 컬러 이미지 압축, 회색조 이미지 압축 및 흑백 이미지 압축을 독립적으로 제어할 수 있습니다. 단점은 이러한 도구가 단일 클릭 웹 압축기보다 무겁고 복잡하다는 것입니다.
브라우저 기반 도구들 사이에서는 품질 격차가 줄어들었습니다. 이제 최고의 온라인 압축기는 Raster Vector PDF 구별을 존중하는 서버 측 PDF 구문 분석을 수행하고, 각 페이지를 텍스트 영역, 이미지 영역 및 배경 영역으로 분할하고 가장 적합한 알고리즘으로 각각을 압축하는 MRC(혼합 래스터 콘텐츠) 압축을 적용합니다. 텍스트 영역은 무손실 JBIG2를, 사진은 JPEG를, 단색 배경은 저해상도 채우기를 얻습니다. International PDF Association의 2025년 연구에 따르면 MRC 기반 압축은 ISO 표준 텍스트 가독성 점수를 유지하면서 파일 크기를 평균 68% 줄인 것으로 나타났습니다(PDF Association, "Advanced Compression Techniques for Mixed-Content Documents", 2025).
클라이언트 측에서 실행되는 브라우저 기반 도구는 브라우저의 JavaScript 엔진과 Canvas API가 수행할 수 있는 작업에 따라 제한됩니다. 브라우저 환경에서 PDF의 내부 개체 구조에 직접 액세스할 수 없기 때문에 일반적으로 페이지를 래스터화합니다. 도구가 파일을 서버에 업로드하지 않고 브라우저에서 파일 전체를 처리하는 경우 도구에서 명시적으로 다르게 명시하지 않는 한 래스터화 접근 방식을 사용하고 있다고 가정합니다.
단계: 혼합 콘텐츠 PDF를 올바르게 압축
먼저 압축 파일이 수행해야 할 작업을 결정합니다. PDF를 화면에서만 읽는 경우 이미지를 150DPI로 다운샘플링하고 텍스트 품질에 대한 걱정 없이 JPEG 품질 60을 사용할 수 있습니다. 텍스트는 벡터이고 관계없이 전체 화면 해상도로 렌더링되기 때문입니다. 파일을 표준 사무용 프린터로 인쇄할 수 있는 경우 이미지 다운샘플링을 200-300 DPI로 설정하고 JPEG 품질을 80으로 설정합니다. 보관 또는 시험 인쇄용으로 이미지에 무손실 FlateDecode 압축을 적용하고 다운샘플링을 방지합니다.
둘째, 개체별 압축 설정을 표시하는 도구에서 PDF를 엽니다. 도구의 압축 대화 상자에서 "텍스트 및 라인 아트 압축" 옵션이 활성화되었습니다. 이 설정은 텍스트 및 벡터 경로가 저장된 콘텐츠 스트림에 무손실 DEFLATE 압축을 적용합니다. 감소율은 일반적으로 콘텐츠 스트림에만 20~30%로 적당하지만 시각적 변화가 전혀 없으며 후속 이미지 압축이 전반적으로 더욱 효과적입니다.
셋째, 이미지별 압축을 적용합니다. 품질 허용 범위에 따라 컬러 이미지를 JPEG 품질 60-80으로 설정하십시오. 회색조 이미지를 동일한 JPEG 품질 범위로 설정합니다. 흑백 이미지를 JBIG2 무손실 또는 CCITT 그룹 4로 설정하십시오. 도구가 "메타데이터 제거" 기능을 제공하는 경우 또는 "숨겨진 물건 버리기" 옵션을 활성화하십시오. PDF에는 표시되는 출력에 영향을 주지 않고 파일 크기를 늘리는 내장된 축소판, 문서 정보 사전 및 사용되지 않는 개체가 포함되는 경우가 많습니다.
넷째, 압축을 실행한 후 출력을 확인합니다. 압축 파일을 열고 텍스트 섹션을 400% 이상 확대합니다. 텍스트 가장자리는 원본만큼 선명해야 합니다. 문장을 선택하고 복사하면 복사본이 정확히 동일한 문자를 생성해야 합니다. 두 테스트 중 하나라도 실패하면 도구가 페이지를 래스터화하므로 다른 압축기를 사용하거나 더 높은 품질 설정을 시도해야 합니다. WukongPDF는 압축이 의도적으로 텍스트를 텍스트로 유지하므로 복사-붙여넣기 테스트가 항상 통과하기 때문에 이 확인 단계를 자연스럽게 처리합니다.
다섯째, 파일 크기를 비교합니다. 이미지가 파일 크기의 주요 원인인 잘 압축된 혼합 콘텐츠 PDF는 결과적으로 50~70% 더 작아집니다. 크기 감소율이 90% 이상으로 크게 높으면 도구가 이미지 데이터 이상의 데이터를 제거했을 수 있으므로 누락된 콘텐츠가 있는지 확인해야 합니다. 감소율이 20% 미만이면 PDF의 이미지가 이미 압축되었을 가능성이 높으며 손실 접근 방식으로 전환하지 않고는 더 이상 최적화할 수 없습니다.
래스터화가 실제로 의미가 있는 경우
전체 페이지 래스터화가 실수가 아니라 고의적인 절충안인 시나리오가 있습니다. PDF에 수천 개의 작은 벡터 요소, 수십만 개의 개별 선 세그먼트가 있는 복잡한 CAD 도면 또는 반투명 레이어가 겹치는 복잡한 데이터 시각화가 포함된 경우 이러한 모든 벡터 명령을 인코딩하는 콘텐츠 스트림은 실제로 동일한 페이지의 고해상도 래스터 이미지보다 클 수 있습니다. 이러한 극단적인 경우 300DPI로 래스터화하고 JPEG 압축을 적용하면 벡터 표현을 유지하는 것보다 더 작은 파일이 생성되며 300DPI에서는 모든 실제 목적에 맞게 텍스트를 읽을 수 있게 유지됩니다.
핵심은 도구가 기본적으로 결정을 내리도록 하는 것이 아니라 의식적으로 결정을 내리는 것입니다. PDF가 표준 사무용 문서, 보고서, 전자책, 양식 또는 적당한 수의 이미지가 포함된 텍스트로 주로 구성된 모든 것인 경우 벡터 텍스트 레이어를 유지하는 선택적 압축이 항상 올바른 접근 방식입니다. PDF가 엔지니어링 설계도, 매우 상세한 지도 또는 벡터 복잡성이 벡터 유지의 이점을 압도하는 설계 증명인 경우 래스터화를 고려하되 텍스트를 계속 읽을 수 있을 만큼 충분히 높은 해상도에서만 사용하십시오.
압축 후 텍스트 픽셀화를 일으키는 일반적인 실수
흔히 저지르는 실수 중 하나는 이미 압축된 PDF를 다시 압축하는 것입니다. 페이지를 래스터화하는 도구로 PDF를 이미 처리한 경우 텍스트는 이미 이미지입니다. 공격적인 이미지 다운샘플링을 적용하는 두 번째 압축 도구를 통해 실행하면 성능 저하가 더욱 심해집니다. 두 번째 도구는 전체 페이지를 하나의 큰 이미지로 보고 추가로 다운샘플링하여 한때 선명한 벡터 텍스트였던 것을 흐릿한 혼란으로 줄입니다. 해결책은 항상 압축되지 않은 원본 파일의 복사본을 보관하고, 이미 압축된 버전이 아닌 원본에서 다시 압축하는 것입니다.
또 다른 일반적인 오류는 도구의 기능을 확인하지 않고 도구에서 가장 낮은 품질 사전 설정을 사용하는 것입니다. "최대 압축" 또는 "최소 파일 크기" 많은 도구의 사전 설정을 사용하면 72 또는 100 DPI에서 전체 페이지 래스터화가 가능합니다. 이는 입력 내용에 관계없이 작은 출력 파일을 보장하는 가장 빠른 방법이기 때문입니다. 결과 파일은 놀랄 만큼 작을 수 있지만 표준 모니터에서도 텍스트가 부드러워 보이고 독자가 확대하면 기본적으로 읽을 수 없게 됩니다.
세 번째 실수는 압축 중에 일부 도구가 적용하는 색상 공간 변환을 무시하는 것입니다. 도구가 크기 축소 전략으로 컬러 PDF를 회색조로 변환하는 경우 포함된 이미지의 색상 채널에만 영향을 주어야 합니다. 대신 도구가 페이지를 래스터화한 다음 결과 비트맵을 회색조로 변환하면 색상이 있는 텍스트와 벡터 요소도 병합됩니다. 해결 방법은 색상 변환이 페이지 전체가 아닌 이미지 개체에 선택적으로 적용되는지 확인하는 것입니다.
원본 이미지와 압축 대상 간의 해상도 불일치도 문제를 일으킬 수 있습니다. 원본 PDF에 600DPI의 이미지가 포함되어 있고 해당 이미지를 72DPI로 다운샘플링하면 사진이 부드러워 보이고 다이어그램의 미세한 세부 묘사가 손실됩니다. 압축은 의도된 용도와 일치해야 합니다. 72 DPI 대상은 일반 확대/축소 수준의 화면에서만 볼 문서에만 적합합니다. 기본 사무용 프린터에서도 인쇄할 수 있는 모든 문서는 이미지의 다운샘플링 대상으로 최소 150DPI를 사용해야 합니다.
PDF 압축을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
