50 ページ、10 MB の PDF を開きます。 10 ページの古いコンテンツを削除し、ドキュメントを 40 ページに減らします。ファイルが約 8 MB に縮小されることを期待して、ファイルを保存します。その代わりに、ファイル サイズは 20 メガバイトに跳ね上がります。ページを削除するとファイルが大きくなりました。 PDF からページを削除しても、それらのページに関連付けられたデータは削除されないため、この直観に反する結果が発生します。文書構造からページ参照のみが削除されます。
ページ削除後のファイルサイズのPDF圧縮は自動であるべきように思えますが、PDFエディターはファイルサイズの最適化よりも編集速度とデータの保存を優先します。ページを削除すると、エディターはページ エントリをページ ツリーから削除しますが、ページ コンテンツ オブジェクト、画像、フォント、およびその他のリソースはファイル内に残ります。これらの孤立したオブジェクトは、どのページからも参照されず、依然としてスペースを占有しています。それらが占めるスペースは、編集自体のオーバーヘッドに追加されます。

PDF ページの削除の実際の仕組み
PDF ファイルは、相互参照テーブルによって接続された番号付きオブジェクトのコレクションとして構造化されています。ページ ツリー オブジェクトには、どのページがどのような順序で存在するかがリストされます。各ページ オブジェクトは、コンテンツ ストリーム、画像、フォント、その他のリソースを参照します。 PDF エディターでページを削除すると、エディターはページ ツリーからページ エントリを削除します。そのページのコンテンツ ストリームとそのページが参照するすべてのリソースは、孤立したオブジェクトとしてファイル内に残ります。
ほとんどの PDF エディターは、孤立したオブジェクトをすぐには削除しません。削除すると計算コストがかかるためです。エディターは、削除されたページによってのみ参照されていたすべてのオブジェクトを識別する必要があり、ファイル全体にわたる参照チェーンをトレースする必要があります。この分析には時間がかかるため、ユーザーはページが即座に削除されることを期待しています。エディターはファイル サイズと引き換えに速度を確保し、クリーンアップは後の「名前を付けて保存」または最適化操作に任せます。
一部の編集者は、PDF 内に編集履歴を保存します。編集するたびに、古いオブジェクトを維持しながら新しいオブジェクトが追加されます。 PDF ファイル サイズ は、ファイルには現在のドキュメントの状態だけでなく、その状態に到達するまでの完全な履歴が含まれるため、編集セッションのたびに大きくなります。 10 回編集された文書には、10 層の増分変更が含まれています。
フォント データは、削除後のファイル サイズの肥大化に大きく寄与します。削除されたページでは、特定のフォント サブセットが使用されている可能性があります。他のページでもそのフォント サブセットが使用される可能性があるため、そのフォント サブセットはファイルに残ります。残りのページでそのフォントが使用されていない場合でも、その事実を特定するには、編集者が 1 つおきのページをチェックする必要がありますが、クイック削除操作ではスキップされます。
PDFを圧縮してみる
インストールは必要ありません。ブラウザで直接動作します。
実際にファイルサイズが増加する理由
ファイル サイズの増加は、編集者が変更されたファイルを書き込む方法によって発生します。ページを削除した後に保存すると、エディターは現在のドキュメントの状態、孤立したオブジェクト、および新しい相互参照テーブルを書き込みます。新しい相互参照テーブルには、現在のオブジェクトと孤立したオブジェクトの両方のエントリが含まれるため、元の相互参照テーブルよりも大きくなる可能性があります。保存操作により、編集自体に関するメタデータが追加される場合もあります。
エディターがファイルを書き直すのではなく変更を追加する場合、各保存操作では何も削除せずにコンテンツが追加されます。変更を元に戻したい場合に備えて、元のファイルの内容が保存されます。削除されたページは表示されないだけでまだ残っています。このファイルには、元の 50 ページの文書に加えて、それらのページのうち 10 ページを非表示にするための指示と、新しい相互参照表が含まれています。もっと大きくても不思議ではありません。
PDF ページ の削除とそれに続く保存操作では、名前を付けて保存操作ではなく、孤立したオブジェクトが保持される可能性が高くなります。保存すると、既存のファイルが段階的に更新されます。 「名前を付けて保存」は、新しいファイルを最初から書き込むため、エディターは孤立したオブジェクトを省略できます。
ページを削除した後に実際にファイルサイズを減らす方法
最も効果的な方法は、「保存」ではなく「名前を付けて保存」です。 [名前を付けて保存] を使用すると、エディターは現在のドキュメントの状態によって参照されるオブジェクトのみを含む新しいファイルを書き込みます。以前の編集で孤立したオブジェクトは含まれません。新しいファイルはクリーンで、現在のコンテンツのみが含まれています。ファイル サイズは、削除されたページに比例して減少します。
[名前を付けて保存] でファイル サイズが十分に削減されない場合は、ページを削除し、[名前を付けて保存] を使用した後で PDF の最適化または圧縮パスを実行します。最適化パスでは、冗長なオブジェクトが削除され、使用されている文字のみが含まれるようにフォントがサブセット化され、画像が適切な解像度にダウンサンプリングされます。 [名前を付けて保存] とその後の最適化を組み合わせると、現在のコンテンツに対して可能な最小のファイルが生成されます。
WukongPDF は、ページ削除後にファイルを圧縮および最適化できるブラウザベースのツールを通じて PDF を処理します。圧縮ツールは、孤立したオブジェクトと冗長なデータを削除し、現在のドキュメントの内容を正確に反映したファイル サイズを生成します。
文書編集時のファイルサイズの肥大化を防ぐ
ページの削除、追加、並べ替えなど、PDF を広範囲に編集する予定がある場合は、最初にすべての構造編集を実行してから、[名前を付けて保存] を使用し、最後に最適化を実行します。このシーケンスにより、蓄積された孤立したオブジェクトが最小限に抑えられ、最もクリーンな出力ファイルが生成されます。
長期間にわたって繰り返し編集されるドキュメントの場合は、クリーンアップ スケジュールを確立します。 5 回の編集セッションごと、または毎月ごとに、「名前を付けて保存」を使用してクリーン コピーを作成し、作業ファイルに蓄積された編集履歴を破棄します。これにより、ファイル サイズが管理しやすくなり、構造上の問題が蓄積されてレンダリングの問題が発生するリスクが軽減されます。
編集した PDF を外部に共有する場合は、配布する前に必ず「保存」ではなく「名前を付けて保存」を使用してください。 [名前を付けて保存] を選択すると、以前のバージョンの機密情報が含まれる可能性のある編集履歴が削除されます。外部受信者は、現在のドキュメントのコンテンツのみを含むクリーンなファイルを受け取ります。
PDF 編集における増分保存と完全保存の違いは、テキスト ファイルへの追加と書き換えの違いに似ています。増分保存では、既存のファイルの末尾に変更が追加されます。完全保存では、ドキュメントの状態全体を読み取り、最初から書き込みます。増分保存は変更を書き込むだけなので高速です。完全保存では、蓄積された不要なファイルが破棄されるため、より小さくクリーンなファイルが生成されます。
Adobe Acrobat には、動作が異なる 2 つの保存オプションがあります。保存すると、変更が段階的に追加されます。 [名前を付けて保存] を選択すると、完全な新しいファイルが書き込まれます。編集セッションを複数回行うと、2 つのファイル サイズの差が大幅に大きくなる場合があります。 「保存」を使用して 10 回編集されたドキュメントは、同じように編集され、各セッション後に「名前を付けて保存」を使用して保存された同じドキュメントよりも 3 倍大きくなる可能性があります。
画像が多い PDF では、画像が PDF 内で最大のオブジェクトであるため、ページ削除による肥大化が特に発生しやすくなります。 5 MB の写真を含むページを削除すると、写真データは孤立したオブジェクトとしてファイルに残ります。ファイル内の最大のオブジェクトがまだ存在しているため、ファイル サイズはまったく減少しません。孤立したイメージを特定して削除するには、名前を付けて保存または最適化プロセスが必要です。
一部の PDF エディターには、特に孤立したオブジェクトを削除対象とする「ファイル サイズの削減」または「PDF の最適化」コマンドが含まれています。このコマンドは、ページのクイック削除ではスキップされる参照分析を実行します。ページの削除後にこのコマンドを実行すると、削除されたページのコンテンツが占めていたスペースが実際に復元されます。
帯域幅が制限された Web サイトで提供される PDF や、添付ファイルのサイズ制限がある受信者に電子メールで送信される PDF など、ファイル サイズが重要なドキュメントの場合は、削除後の最適化手順が必須です。 20 MB の 40 ページの文書は、50 ページの元の文書よりも大きくなる可能性があります。受信者には短いドキュメントが表示されますが、ファイルは大きくなります。これは受信者の期待とは逆であり、正常に配信できない可能性があります。
PDF 線形化機能は Fast Web View とも呼ばれ、ファイル全体がダウンロードされる前に最初のページが表示できるようにファイルを再編成します。線形化 PDF には特定の内部構造があり、ページを削除すると破壊される可能性があります。ページが削除された線形化された PDF は線形化を失う可能性があり、エディターは迅速なアクセスを維持するために一部のリソースの 2 番目のコピーを追加する場合があります。この重複により、削除後のファイル サイズはさらに増加します。
ページ削除のサイズ動作を理解すると、PDF をクリーンアップするときに現実的な期待を設定するのに役立ちます。ページの削除は、ページ数を減らす簡単な操作です。ファイル サイズの削減は別の最適化手順であり、名前を付けて保存または明示的な圧縮コマンドが必要です。これらをクリーンアップ ワークフローの 2 つのステップとして扱うと、より短いドキュメントとより小さいファイルの両方を確実に取得できます。
ページ削除後の PDF ファイル サイズの直観に反する動作は、保存効率よりも編集速度とデータ保存を優先した形式の結果です。このトレードオフを理解することで、ユーザーはワークフローに最適化ステップを組み込むことができ、高速な編集とファイルのコンパクト化の両方を実現できます。
構造編集後のデフォルトの保存操作を「保存」ではなく「名前を付けて保存」にすることは、PDF ファイル サイズの肥大化を防ぎ、現在のドキュメントの内容を正確に反映するクリーンでコンパクトなファイルを維持するための最も効果的な習慣です。
ページを削除した後に「保存」ではなく「名前を付けて保存」を使用することは、PDF ファイルのサイズを実際のコンテンツに比例させておくための最も重要な習慣です。
| 保存メソッド | 何が起こるか | 削除後のファイルサイズ | 次の場合に使用 |
|---|---|---|---|
| 保存 | 変更を追加します。孤児を引き留める | 増加する可能性があります | 素早い編集。作業書類 |
| 名前を付けて保存 | ファイル全体を書き換えます。孤児を捨てる | 比例して減少します | 共有前の最終バージョン |
| 名前を付けて保存 + 最適化 | 書き換え + 冗長性の削除 | 可能な限り最小 | 外部配布。アーカイブ |
PDFを圧縮してみる
インストールは必要ありません。ブラウザで直接動作します。
