Tips & Tricks

PDF から元の解像度で画像を抽出する方法

PDF から画像を抽出するのは簡単そうに思えます。 [エクスポート] をクリックし、画像形式を選択すると、画像が表示されます。しかし、表示される画像は、多くの場合、文書に配置された元の画像よりも小さく、柔らかく、圧縮されています。これは、多くの PDF ツールが抽出中に画像をダウンサンプリングして再圧縮し、画像が最初に埋め込まれたときに適用された圧縮に加えて、2 回目の品質損失を適用するために発生します。元の解像度で画像を抽出すると、元々 PDF に配置されていたすべてのピクセルが保持され、ソース画像と同一の出力ファイルが生成されます。元の解像度でPDF から Image に抽出するには、固定 DPI でページを再レンダリングするのではなく、埋め込まれた画像データを尊重するツールが必要です。

How to Extract Images From a PDF at Their Original Resolution

標準的な画像抽出では品質が低下する理由

ほとんどの PDF ビューアと基本的な抽出ツールは、実際には PDF から元の画像ファイルを抽出しません。各ページを指定された解像度 (通常は 150 または 300 DPI) でレンダリングし、ツールが画像コンテンツを検出した場所に基づいて、レンダリングされたページを画像の四角形にスライスします。この再レンダリング プロセスでは、埋め込み時にすでに圧縮されていた画像に 2 回目の JPEG 圧縮を適用します。その結果、JPEG ファイルを保存して再度開き、再度保存する場合と同様に世代が失われます。各サイクルでは、さらに多くの視覚データが破棄されます。

元の解像度の抽出では、再レンダリングの手順が完全にバイパスされます。ページをレンダリングしてレンダリングから画像をスライスする代わりに、ツールは埋め込まれた画像ストリームを PDF ファイル構造から直接読み取ります。各イメージ ストリームには、ドキュメントの作成時に PDF に挿入された正確なバイトが含まれています。これらのストリームを抽出すると、元のイメージとビットごとに同一のファイルが生成されます。 PDF に埋め込まれた 3000 × 2000 ピクセルの写真は、3000 × 2000 ピクセルのファイルとして表示されます。 PDF 画像 抽出プロセスでは、すべてのピクセルが保存されます。

WukongPDF

PDFから画像への変換を試してください

インストールは必要ありません。ブラウザで直接動作します。

始める →

オリジナル解像度の抽出をサポートするツール

Adobe Acrobat Pro には、元の解像度でエクスポートできるすべての画像のエクスポート機能が含まれています。 PDF を開き、[ツール] パネルに移動して、[PDF をエクスポート] を選択します。出力形式として [画像] を選択し、設定で JPEG または PNG 形式を選択し、[すべての画像を元の解像度でエクスポートする] または同様の文言というラベルの付いたオプションを探します。抽出された画像は、元のピクセルサイズで出力フォルダーに表示されます。

コマンドライン ツールは、埋め込み画像ストリームへの最も直接的なアクセスを提供します。オープンソースの Poppler-utils パッケージの一部である pdfimages ツールは、再圧縮せずに PDF から画像を抽出します。 pdfimages -j input.pdf Outputprefix を実行すると、すべての JPEG 画像が元の圧縮で抽出されます。 pdfimages -png input.pdf Outputprefix を実行すると、元のピクセル寸法を維持しながら、抽出中にすべての画像がロスレス PNG 形式に変換されます。 WukongPDF およびブラウザベースの PDF から画像 プラットフォームは、サーバー側で元の解像度の抽出を処理し、ダウンロード可能なアーカイブで画像を返します。

複数の形式で埋め込まれた画像の処理

1 つの PDF に複数の異なる形式の画像を含めることができます。写真では JPEG 画像が一般的です。 JPEG 2000 画像は、一部のアーカイブ PDF およびエンジニアリング PDF に含まれています。 PNG 画像は、スクリーンショットや透明度のあるグラフィックに使用されます。 TIFF イメージはスキャンされたドキュメントに表示されます。生のビットマップ データは圧縮せずに保存できます。抽出ツールは各形式を正しく処理する必要があります。すべての画像が JPEG であると想定しているツールでは、PNG または TIFF に遭遇すると破損した出力が生成されます。

以下の表は、抽出中にさまざまな埋め込み画像形式をどのように処理する必要があるかをまとめたものです。

埋め込みフォーマット最適なエクスポート形式注記
JPEG (DCTデコード)JPEG(オリジナル)すでに圧縮されています。さらに JPEG を 2 回圧縮します
JPEG 2000 (JPXデコード)PNG または JPEG 2000すべてのビューアが JPEG 2000 をサポートしているわけではありません
PNG または生のビットマップPNG (ロスレス)すべてのピクセルデータを正確に保存します
TIFFまたはスキャンしたデータTIFF または PNGTIFF は複数ページのスキャン データを保存します

埋め込み画像の元の解像度の特定

抽出する前に、埋め込まれた画像の実際の解像度を知ることができます。画像のプロパティを表示できるビューアで PDF を開きます。画像をクリックして、ピクセル寸法を表示するプロパティ パネルを探します。ピクセル寸法をページ上の画像の物理寸法で割って、有効 DPI を計算します。ページ上の 5 × 4 インチの領域に表示される 1500 × 1200 ピクセルの画像の有効解像度は 300 DPI です。ページの表示サイズに関係なく、元の解像度は 1500 x 1200 ピクセルです。

実効 DPI が低い場合、画像は低解像度で埋め込まれており、どの抽出方法も埋め込まれたデータにない詳細を復元できません。元の解像度で抽出すると、そこにあるものが保存されます。埋め込まれなかった詳細は作成されません。元の解像度で抽出された 72 DPI 画像は、依然として 72 DPI 画像です。元の解像度で抽出する利点は、魔法のように解像度を高めることではなく、さらなる品質の低下を回避することです。

抽出した画像の整理と名前付け

数十の画像を含む PDF を抽出すると、img-001.jpg、img-002.jpg などの一般的な名前を持つファイルの山が生成されます。ファイルを使用する前に、わかりやすい名前に変更します。画像が製品カタログから取得された場合は、製品の SKU または名前を使用して名前を付けます。レポートから取得したものである場合は、図番号を付けて名前を付けます。名前変更の手順は、イメージのバッチでは数分かかりますが、数日または数週間後に特定のイメージを検索する必要がある場合には、はるかに時間を節約できます。

抽出した画像はソース PDF にちなんだ名前のフォルダーに保存して、出所が明確になるようにします。画像を新しいドキュメントで使用するか、Web サイトにアップロードする場合は、画像のメタデータまたは付随するテキスト ファイルにソース PDF 名を含めます。画像の出所がわかれば、後で必要になった場合にソースに戻って高解像度のバージョンを取得することができます。 WukongPDF は、オリジナル解像度の画像抽出による PDF Export をサポートし、ソース ドキュメントと抽出されたアセット間の接続を保持する整理された出力を生成します。

抽出品質の検証

元の解像度で画像を抽出した後、抽出されたファイルのサンプルを開いて、高ズーム レベルで PDF に表示される同じ画像と並べて比較することで、出力品質を検証します。抽出された画像は、ズームされた PDF ビューと同じレベルの詳細を表示する必要があります。抽出された画像に、PDF では表示されない JPEG ブロッキング アーティファクトが示されている場合は、抽出により追加の圧縮が適用されている可能性があります。抽出された画像のピクセル寸法が予想よりも小さい場合、ツールは元の解像度で抽出するのではなく、抽出中にダウンサンプリングした可能性があります。

抽出した画像を印刷物で使用する場合は、最終決定する前にプリンタに解像度要件を確認してください。元のピクセル寸法の 300 DPI 画像は、半ページの印刷配置には十分ですが、フルブリードのカバー画像には不十分です。元の解像度の抽出では、そこにあるものが保持されます。元の埋め込みにはない解像度は作成されません。

元の画像が他のソースから入手できなくなったアーカイブ PDF の場合、元の解像度で抽出された画像が入手可能な最良のコピーになります。それらをアーカイブマスターとして扱います。 PNG や TIFF などのロスレス形式で保存し、毎回 PDF から再抽出するのではなく、これらのマスターから作業コピーまたは Web バージョンを作成します。

異常に高い解像度で埋め込まれたPDF 画像の場合、抽出されたファイルが予想よりも大きくなる可能性があります。元の解像度で抽出された 600 DPI 写真は、高品質の印刷に適したファイルを生成しますが、Web での使用や電子メールの添付には不必要に大きくなります。抽出後、配布用にサイズ変更したバージョンを作成し、元の解像度で抽出されたファイルをアーカイブ マスターとして保存します。

自分で作成したものではない PDF から画像を抽出する場合は、埋め込まれた画像の著作権ステータスに注意してください。元の解像度で抽出すると、再利用に適したコピーが生成されます。つまり、再利用には著作権上の影響が適用されます。 PDF が公的に入手可能なドキュメントの場合、画像はフェアユースまたはドキュメントの出版条件に基づいて使用できる可能性があります。 PDF がプロプライエタリなドキュメントまたはライセンスされたドキュメントである場合、埋め込まれた画像にはドキュメント自体と同じ使用制限が適用されます。

元の解像度でのPDF から Image への抽出は、自分の作品を PDF 形式で受け取り、レイアウト中にドキュメントに配置された元の画像ファイルを復元する必要がある写真家やグラフィック デザイナーにとって特に価値があります。

自分の作品の PDF プルーフを受け取るデザイナーやコンテンツ作成者にとって、元の解像度の抽出により、作業ファイルから失われた可能性のある画像を復元する方法が提供されます。

PDF に埋め込まれた PDF 画像 は、多くの場合、これらの画像の現存する最高品質のバージョンです。

画像を元の解像度で抽出することは、PDF から出力されるすべての画像に影響する 1 回限りのセットアップの決定です。バッチを実行する前に時間をかけて抽出ツールを正しく構成することで、すべての画像が最高の品質で表示され、次にどのような用途にも使用できるようになります。

元の解像度の抽出により、埋め込まれた画像データの整合性が維持されます。抽出された画像がそれらの写真、ロゴ、またはグラフィックのコピーとして唯一残っている場合、その完全性が重要になります。

デフォルトの DPI ではなく元の解像度で画像を抽出するという決定は、利便性よりも品質を優先するための選択です。ファイルは大きくなります。このプロセスには少し時間がかかる場合があります。ただし、画像は PDF に配置されたときとまったく同じになります。

WukongPDF

PDFから画像への変換を試してください

インストールは必要ありません。ブラウザで直接動作します。

始める →