ほとんどの PDF 圧縮 ツールは、単一の設定セットをドキュメント内のすべてのページに適用します。すべての画像は同じ解像度にダウンサンプリングされ、すべてのテキスト要素は同じ圧縮アルゴリズムを使用します。この統一的なアプローチは、テキストのみのレポートや写真のみのポートフォリオなど、すべてのページが類似しているドキュメントには適切に機能します。テキストの多いページと画像の多いページが混在するドキュメントの場合、単一の圧縮設定ではテキスト ページが不必要に過剰に圧縮されるか、画像ページの圧縮が不十分になります。
同じ PDF 内のテキスト領域と画像領域に異なる圧縮を適用すると、均一な圧縮よりも良い結果が得られます。テキストはベクトル コンテンツ用に設計されたロスレス アルゴリズムで圧縮されているため、鮮明で読みやすい状態が保たれます。画像はテキストよりも解像度の低下に耐えられるため、積極的にダウンサンプリングされます。合計のファイル サイズの削減は、テキストの可読性を保つために保守的に適用される均一圧縮よりも大きく、両方のコンテンツ タイプの視覚的な品質は、それぞれが必要とするレベルで維持されます。
WukongPDF の PDF 品質 および圧縮ツールは、同じドキュメント内でテキストと画像を異なる方法で処理するインテリジェントな要素ごとの圧縮を適用します。要素ごとの設定を手動で制御するには、Adobe Acrobat Pro の PDF オプティマイザーが最も詳細な制御を提供します。

なぜ均一圧縮が混合コンテンツ PDF にダメージを与えるのか
テキストは圧縮アーティファクトを許しません。低解像度でレンダリングされた単一の文字は、すぐに判読できなくなります。 72 DPI の文字「e」の高さはわずか 4 ~ 6 ピクセルであり、さらにダウンサンプリングすると認識できない汚れになってしまいます。対照的に、画像には、画面表示に必要なピクセルよりもはるかに多くのピクセルが含まれています。 300 DPI の写真には、75 DPI の同じ画像の約 16 倍のピクセルが含まれます。画像を画面解像度にダウンサンプリングすると、ほとんどの表示シナリオで目に見える品質の低下を引き起こすことなく、冗長なピクセルが削除されます。
すべてを 150 DPI にダウンサンプリングする均一な圧縮パスにより、大幅な画像圧縮を残しつつ、テキストがわずかにぼやけます。 72 DPI にダウンサンプリングする均一パスにより、画像は十分に小さくなりますが、テキストはほとんど判読できなくなります。正しいアプローチは、Flate や ZIP などの可逆圧縮アルゴリズムを使用してテキスト領域を処理し、解像度を元の値のままにし、画像領域を低い DPI で非可逆 JPEG 圧縮で処理することです。 2 つのコンテンツ タイプは、同じ圧縮操作内で異なる最適化パスを通過します。
PDFを圧縮してみる
インストールは必要ありません。ブラウザで直接動作します。
Adobe Acrobat Pro での要素ごとの圧縮の設定
Acrobat Pro で PDF を開き、「ファイル」、「別名で保存」、「最適化 PDF」の順に選択します。 [PDF オプティマイザー] ダイアログが開き、左側のパネルに圧縮カテゴリがリストされます。画像をクリックして画像圧縮を設定します。バイキュービック ダウンサンプリングを使用して、カラー イメージのダウンサンプリング ターゲットを 150 DPI に設定すると、写真のきれいな結果が得られます。 JBIG2 可逆圧縮を使用してモノクロ画像を 300 DPI に設定し、スキャンした文書のテキストの鮮明さを維持します。 [圧縮] で、中品質のカラー画像の場合は JPEG を選択し、モノクロ画像の場合は ZIP を選択します。
テキスト保護の重要な設定は、[画像] セクションではなく、[透明性] セクションと [クリーンアップ] セクションにあります。 [クリーンアップ] で、[ドキュメント構造の圧縮] と [未使用のオブジェクトの削除] をオンにします。どちらも、表示されるコンテンツに影響を与えることなくファイル サイズを削減します。テキスト関連オブジェクトの場合は、「オブジェクトを破棄」のチェックを外したままにしておきます。オプティマイザーの [フォント] セクションでは、フォントの埋め込みとサブセットを制御します。 [すべてのフォントを埋め込む] が必要な場合を除きチェックされていないこと、および [サブセットの埋め込みフォント] がチェックされていることを確認します。フォントのサブセット化には、フォント ファイル全体ではなく、ドキュメント内で実際に使用されている文字のみが含まれます。これにより、大きなフォントの文字セットの小さなサブセットのみを使用するドキュメントでは、フォント データを 70 ~ 90% 削減できます。
設定を行った後、「OK」をクリックし、最適化されたファイルを新しい名前で保存します。元の PDF と最適化された PDF を 100% ズームで並べて比較します。テキストは 2 つのバージョン間で区別できない必要があります。選択したダウンサンプリング解像度では画像がわずかに柔らかくなる場合がありますが、ブロック状のエッジやカラーバンディングなどの目に見える圧縮アーチファクトはありません。
コマンドライン制御に Ghostscript を使用する
Ghostscript は、デバイス パラメータを通じて要素ごとの圧縮設定にコマンドライン アクセスを提供します。 ColorImageResolution、GrayImageResolution、および MonoImageResolution パラメータは、各画像タイプのダウンサンプリング ターゲットを個別に設定します。 ColorImageFilter パラメーターは、カラー画像の圧縮アルゴリズムを設定します。混合コンテンツ圧縮用の一般的な Ghostscript コマンドは次のとおりです。 gs -sDEVICE=pdfwrite -dCompatibilityLevel=1.7 -dPDFSETTINGS=/printer -dColorImageResolution=150 -dMonoImageResolution=300 -dColorImageFilter=/DCTEncode -dGrayImageFilter=/DCTEncode -dMonoImageFilter=/CCITTFaxEncode -sOutputFile=output.pdf 入力.pdf。
実際には、/printer PDFSETTINGS プリセットはすべての画像タイプに 300 DPI を適用しますが、これは必要以上に高くなります。モノクロ解像度を高く保ちながら、カラー画像の解像度を下げるには、プリセットの後に特定のパラメータをオーバーライドします。 Ghostscript は、事前設定されたデフォルトをオーバーライドする明示的なパラメータを使用して、パラメータ階層に従って PDF を処理します。コマンドライン アプローチはスクリプト化可能で無料であるため、サーバー上での混合コンテンツ PDF のバッチ処理や自動公開パイプラインの一部として適しています。
| コンテンツタイプ | 圧縮戦略 | 一般的な削減 |
|---|---|---|
| 高解像度の写真 | 100 ~ 150 DPI、JPEG 中品質へのダウンサンプル | 写真ページの場合は 50 ~ 80% |
| テキストとベクターグラフィックス | Flate/ZIP ロスレス圧縮、元の解像度を維持 | テキスト ページの場合は 10 ~ 30% |
| 混合ページ | 画像ごとの設定を適用し、テキスト ベクトルを保持 | 全体の 30 ~ 60% |
コンテンツ タイプごとの圧縮結果の検証
圧縮後、テキストと PDF 画像 が意図した処理を受けているかどうかを確認します。 Acrobat Pro では、「印刷制作」メニューの「出力プレビュー」ツールを使用して、個々の画像解像度を検査します。オブジェクト インスペクターには、現在のページ上のすべての画像が、圧縮後の有効解像度とともにリストされます。カラー写真が 150 DPI などの目標解像度を示し、テキストを含むスクリーンショットが 200 ~ 300 DPI などのより高い解像度を示すことを確認します。ページ コンテンツ監査により、要素ごとの設定が正しく適用されたことが確認されます。
簡単に視覚的に確認するには、テキスト領域を 200% にズームします。文字はエッジが柔らかくならずに鮮明なままである必要があります。次に、写真画像を 200% にズームします。画像は通常の視聴距離でダウンサンプリングされているため、極端なズーム時に多少のピクセル化が発生することは予想され、許容されます。 Acrobat Pro のファイル比較ツールを使用して、オリジナルの PDF と最適化された PDF を切り替えて、ピクセルレベルの違いを強調表示する視覚的な差分を生成します。差分では、画像領域の変更が示され、純粋なテキスト領域の変更は示されません。
同じ PDF 内でテキストと画像を異なる方法で圧縮することは、配布しやすい大きさと、快適に読める鮮明な文書を作成するためのプロフェッショナルなアプローチです。 Acrobat Pro の PDF オプティマイザーで要素ごとの圧縮設定を構成するのに 5 分を費やすと、万能の圧縮プリセットよりも明らかに優れた結果が得られます。主に画面上で配布されるドキュメントの場合、要素ごとのアプローチにより、モバイル閲覧者が高く評価する高速読み込みと同時に、読者が期待する鮮明なテキストが提供されます。
混合コンテンツ PDF 用の再利用可能な圧縮プリセットの作成
グラフやコメントを含む月次レポートなど、同じソースから混合コンテンツの PDF を定期的に作成する場合は、要素ごとの圧縮設定を再利用可能なプリセットとして Acrobat Pro に保存します。 [PDF オプティマイザー] ダイアログで、一般的なドキュメント タイプに合わせてすべての設定を構成し、ダイアログの上部にある [保存] ボタンをクリックして、プリセットに「Monthly Report Optimized」などの名前を付けます。次回同様のドキュメントを圧縮する必要がある場合は、PDF オプティマイザーを開き、[設定] ドロップダウンから保存したプリセットを選択し、[OK] をクリックします。個々の設定を再構成することなく、ワンクリックで全体の最適化が適用されます。
圧縮標準を共有するチームの場合は、プリセットをファイルとしてエクスポートし、チーム メンバー全員に配布します。各コンピューターの Acrobat Pro 設定フォルダーにプリセット ファイルを配置します。その後、チーム メンバー全員が同一の圧縮設定を適用し、異なる人が作成したドキュメント全体で一貫した出力を生成します。一貫した圧縮により、一部のチームメンバーが鮮明だが大きい PDF を送信し、他のチームメンバーが小さくても曖昧な PDF を送信し、それぞれが自分たちのアプローチが正しいと信じているというシナリオを防ぎます。
ページ タイプが混在したスキャンされた PDF の処理
一部のページが鮮明なテキストであり、他のページが粒子の粗い写真であるスキャンされた PDF では、圧縮シナリオが困難になります。テキストページは鮮明にするために高いモノクロ解像度を必要とします。写真ページでは、ファイル サイズを制御するために適度なカラー ダウンサンプリングが必要です。単一の圧縮設定を文書全体に適用すると、テキストの鮮明さまたは写真の品質が犠牲になります。
解決策は、圧縮する前にドキュメントをページの種類ごとに分離することです。 PDF を 2 つの一時ファイル (テキストのみのページと写真のみのページ) に分割します。コンテンツに最適化された設定でそれぞれを圧縮します。次に、最適化されたファイルを単一の PDF に結合します。この 3 ステップのワークフローにはさらに 2 分かかりますが、各ページ タイプに最適な結果が得られます。繰り返し行われる混合コンテンツ ドキュメントのスクリプトを使用して、分割、圧縮、結合のプロセスを自動化します。分割、圧縮、マージのワークフローは、Acrobat Pro が内部で実行する要素ごとの圧縮に手動で相当し、少し長くなりますが、完全に制御可能なプロセスを通じて同じ結果が得られます。
ほとんどのツールでは、同じドキュメント内でテキストと画像をさまざまな設定で圧縮できるかどうかが、許容できる PDF 出力と優れた PDF 出力を分けるものとなります。印刷ではなく画面上で読む文書の場合、鮮明なテキストは交渉の余地がありません。読者はテキストがぼやけていることにすぐに気づきます。 150 DPI のわずかに柔らかい写真では、ほとんど知覚できません。テキストと画像のさまざまな品質要件を尊重することで、ファイル サイズに関係なく、専門的に作成されたと思われるドキュメントが作成されます。同じ PDF 内のテキストと画像に異なる圧縮を適用すると、その努力が報われ、ドキュメントが迅速に読み込まれ、快適に読みやすく、各コンテンツ タイプが要求する品質レベルでコンテンツが表示されます。
PDFを圧縮してみる
インストールは必要ありません。ブラウザで直接動作します。
