Das Extrahieren von Bildern aus einem PDF klingt einfach. Klicken Sie auf „Exportieren“, wählen Sie ein Bildformat und die Bilder werden angezeigt. Doch die dabei entstehenden Bilder sind oft kleiner, weicher oder stärker komprimiert als die Originale, die in das Dokument eingefügt wurden. Dies liegt daran, dass viele PDF-Tools Bilder beim Extrahieren verkleinern und erneut komprimieren, wodurch zusätzlich zu der Komprimierung, die beim ersten Einbetten der Bilder angewendet wurde, ein zweiter Qualitätsverlust entsteht. Durch das Extrahieren von Bildern in ihrer ursprünglichen Auflösung bleibt jedes Pixel erhalten, das ursprünglich in der PDF-Datei platziert wurde, sodass Ausgabedateien erstellt werden, die mit den Quellbildern identisch sind. Die PDF-zu-Bild-Extrahierung mit Originalauflösung erfordert ein Tool, das die eingebetteten Bilddaten berücksichtigt, anstatt die Seite mit einer festen DPI neu zu rendern.

Warum die Standard-Bildextraktion an Qualität verliert
Die meisten PDF-Viewer und einfachen Extraktionstools extrahieren die Originalbilddateien nicht wirklich aus der PDF-Datei. Sie rendern jede Seite mit einer bestimmten Auflösung, normalerweise 150 oder 300 DPI, und teilen die gerenderte Seite dann in Bildrechtecke auf, je nachdem, wo das Tool den Bildinhalt erkennt. Bei diesem erneuten Rendering-Prozess wird eine zweite Runde der JPEG-Komprimierung auf Bilder angewendet, die bereits beim Einbetten komprimiert waren. Das Ergebnis ist ein Generierungsverlust, ähnlich dem Speichern, erneuten Öffnen und erneuten Speichern einer JPEG-Datei. Jeder Zyklus verwirft mehr visuelle Daten.
Durch die Extraktion der Originalauflösung wird der Schritt des erneuten Renderns vollständig umgangen. Anstatt die Seite zu rendern und Bilder aus dem Rendering herauszuschneiden, liest das Tool die eingebetteten Bildströme direkt aus der PDF-Dateistruktur. Jeder Bildstream enthält genau die Bytes, die beim Erstellen des Dokuments in das PDF eingefügt wurden. Durch das Extrahieren dieser Streams entstehen Dateien, die Bit für Bit mit den Originalbildern identisch sind. Ein in das PDF eingebettetes 3000 x 2000 Pixel großes Foto entsteht als 3000 x 2000 Pixel große Datei. Beim PDF-Bilder-Extraktionsprozess bleibt jedes Pixel erhalten.
Probieren Sie PDF to Image aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
Tools, die die Extraktion in Originalauflösung unterstützen
Adobe Acrobat Pro verfügt über eine Funktion zum Exportieren aller Bilder, die den Export in Originalauflösung ermöglicht. Öffnen Sie die PDF-Datei, gehen Sie zum Bedienfeld „Werkzeuge“ und wählen Sie „PDF exportieren“. Wählen Sie „Bild“ als Ausgabeformat, wählen Sie in den Einstellungen das JPEG- oder PNG-Format und suchen Sie nach einer Option mit der Bezeichnung „Alle Bilder in Originalauflösung exportieren“ oder einem ähnlichen Wortlaut. Die extrahierten Bilder werden im Ausgabeordner mit ihren ursprünglichen Pixelabmessungen angezeigt.
Befehlszeilentools bieten den direktesten Zugriff auf eingebettete Bildstreams. Das Tool pdfimages, Teil des Open-Source-Pakets popppler-utils, extrahiert Bilder aus PDFs, ohne sie erneut zu komprimieren. Durch Ausführen von pdfimages -j input.pdf Outputprefix werden alle JPEG-Bilder mit ihrer ursprünglichen Komprimierung extrahiert. Wenn Sie pdfimages -png input.pdf Outputprefix ausführen, werden beim Extrahieren alle Bilder in das verlustfreie PNG-Format konvertiert, wobei die ursprünglichen Pixelabmessungen erhalten bleiben. WukongPDF und browserbasierte PDF to Image-Plattformen übernehmen die serverseitige Extraktion der Originalauflösung und geben die Bilder in einem herunterladbaren Archiv zurück.
Umgang mit Bildern, die in mehreren Formaten eingebettet sind
Ein einzelnes PDF kann Bilder in mehreren verschiedenen Formaten enthalten. JPEG-Bilder sind für Fotos üblich. JPEG 2000-Bilder erscheinen in einigen Archivierungs- und Konstruktions-PDFs. PNG-Bilder werden für Screenshots und Grafiken mit Transparenz verwendet. TIFF-Bilder erscheinen in gescannten Dokumenten. Rohe Bitmap-Daten können ohne Komprimierung gespeichert werden. Das Extraktionstool muss jedes Format korrekt verarbeiten. Ein Tool, das davon ausgeht, dass alle Bilder im JPEG-Format vorliegen, erzeugt eine beschädigte Ausgabe, wenn es auf ein PNG- oder TIFF-Format trifft.
Die folgende Tabelle fasst zusammen, wie verschiedene eingebettete Bildformate während der Extraktion behandelt werden sollten:
| Eingebettetes Format | Bestes Exportformat | Hinweise |
|---|---|---|
| JPEG (DCTDecode) | JPEG (Original) | Bereits komprimiert; weiteres JPEG wird zweimal komprimiert |
| JPEG 2000 (JPXDecode) | PNG oder JPEG 2000 | Nicht alle Viewer unterstützen JPEG 2000 |
| PNG oder Rohbitmap | PNG (verlustfrei) | Behält alle Pixeldaten exakt bei |
| TIFF oder gescannte Daten | TIFF oder PNG | TIFF bewahrt mehrseitige Scandaten auf |
Identifizieren der Originalauflösung eines eingebetteten Bildes
Vor dem Extrahieren ist es hilfreich zu wissen, welche Auflösung die eingebetteten Bilder tatsächlich haben. Öffnen Sie die PDF-Datei in einem Viewer, der Bildeigenschaften anzeigen kann. Klicken Sie auf ein Bild und suchen Sie nach einem Eigenschaftenfenster, das die Pixelabmessungen anzeigt. Teilen Sie die Pixelabmessungen durch die physischen Abmessungen des Bildes auf der Seite, um den effektiven DPI-Wert zu berechnen. Ein 1500 x 1200 Pixel großes Bild, das in einem 5 x 4 Zoll großen Bereich auf der Seite angezeigt wird, hat eine effektive Auflösung von 300 DPI. Die Originalauflösung beträgt 1500 x 1200 Pixel, unabhängig von der Darstellungsgröße auf der Seite.
Wenn der effektive DPI-Wert niedrig ist, wurde das Bild mit einer niedrigen Auflösung eingebettet und keine Extraktionsmethode kann Details wiederherstellen, die nicht in den eingebetteten Daten enthalten sind. Bei der Extraktion in Originalauflösung bleibt das Vorhandene erhalten. Es werden keine Details erstellt, die nie eingebettet wurden. Ein mit der Originalauflösung extrahiertes 72-DPI-Bild ist immer noch ein 72-DPI-Bild. Der Vorteil der Originalauflösungsextraktion besteht darin, dass weitere Qualitätsverluste vermieden werden und nicht die Auflösung auf magische Weise erhöht wird.
Extrahierte Bilder organisieren und benennen
Eine PDF-Datei mit Dutzenden Bildern erzeugt beim Extrahieren einen Stapel Dateien mit generischen Namen wie img-001.jpg, img-002.jpg. Benennen Sie die Dateien aussagekräftig um, bevor Sie sie verwenden. Wenn die Bilder aus einem Produktkatalog stammen, benennen Sie sie mit der Produkt-SKU oder dem Namen. Wenn sie aus einem Bericht stammen, benennen Sie sie mit der Abbildungsnummer. Der Umbenennungsschritt dauert bei einem Stapel von Bildern einige Minuten, spart jedoch viel mehr Zeit, wenn Sie Tage oder Wochen später ein bestimmtes Bild suchen müssen.
Bewahren Sie die extrahierten Bilder in einem Ordner auf, der nach dem Quell-PDF benannt ist, damit die Herkunft klar ist. Wenn die Bilder in einem neuen Dokument verwendet oder auf eine Website hochgeladen werden sollen, fügen Sie den Namen der Quell-PDF in die Bildmetadaten oder in eine begleitende Textdatei ein. Wenn Sie wissen, woher ein Bild stammt, können Sie bei Bedarf später zur Quelle zurückkehren, um eine Version mit höherer Auflösung zu erhalten. WukongPDF unterstützt PDF-Export mit Bildextraktion in Originalauflösung und erzeugt eine organisierte Ausgabe, die die Verbindung zwischen dem Quelldokument und den extrahierten Assets beibehält.
Überprüfung der Extraktionsqualität
Überprüfen Sie nach dem Extrahieren der Bilder in Originalauflösung die Ausgabequalität, indem Sie ein Beispiel der extrahierten Dateien öffnen und diese nebeneinander mit denselben Bildern vergleichen, die in der PDF-Datei bei hoher Zoomstufe angezeigt werden. Das extrahierte Bild sollte den gleichen Detaillierungsgrad aufweisen wie die vergrößerte PDF-Ansicht. Wenn das extrahierte Bild JPEG-blockierende Artefakte aufweist, die im PDF nicht sichtbar sind, wurde bei der Extraktion möglicherweise eine zusätzliche Komprimierung angewendet. Wenn die Pixelabmessungen des extrahierten Bildes kleiner als erwartet sind, hat das Tool beim Extrahieren möglicherweise ein Downsampling durchgeführt, anstatt mit der ursprünglichen Auflösung zu extrahieren.
Wenn die extrahierten Bilder in einer Druckpublikation verwendet werden sollen, bestätigen Sie die Auflösungsanforderungen vor der Fertigstellung mit dem Drucker. Ein 300-DPI-Bild mit seinen ursprünglichen Pixelabmessungen reicht möglicherweise für eine halbseitige Druckplatzierung aus, reicht jedoch nicht für ein randloses Titelbild aus. Bei der Extraktion der ursprünglichen Auflösung bleibt das Vorhandene erhalten. Es wird keine Auflösung erstellt, die nicht in der ursprünglichen Einbettung enthalten war.
Bei archivierten PDFs, bei denen die Originalbilder aus keiner anderen Quelle mehr verfügbar sind, werden die extrahierten Bilder in Originalauflösung zu den besten verfügbaren Kopien. Behandeln Sie sie wie Archivmeister. Speichern Sie sie in einem verlustfreien Format wie PNG oder TIFF und erstellen Sie beliebige Arbeitskopien oder Webversionen von diesen Mastern, anstatt sie jedes Mal erneut aus der PDF-Datei zu extrahieren.
Bei PDF-Bildern, die mit ungewöhnlich hohen Auflösungen eingebettet wurden, sind die extrahierten Dateien möglicherweise größer als erwartet. Ein mit Originalauflösung extrahiertes 600-DPI-Foto erzeugt eine Datei, die sich für den Druck in hoher Qualität eignet, aber für die Verwendung im Internet oder als E-Mail-Anhang unnötig groß ist. Erstellen Sie nach der Extraktion verkleinerte Versionen zur Verteilung und behalten Sie die extrahierte Datei mit der ursprünglichen Auflösung als Archivmaster bei.
Beachten Sie beim Extrahieren von Bildern aus einer PDF-Datei, die Sie nicht erstellt haben, den Urheberrechtsstatus der eingebetteten Bilder. Bei der Extraktion in Originalauflösung entstehen Kopien, die für die Wiederverwendung geeignet sind, was bedeutet, dass die urheberrechtlichen Auswirkungen dieser Wiederverwendung gelten. Wenn es sich bei der PDF-Datei um ein öffentlich zugängliches Dokument handelt, können die Bilder möglicherweise im Rahmen der fairen Nutzung oder der Bedingungen der Dokumentveröffentlichung verwendet werden. Wenn es sich bei der PDF-Datei um ein proprietäres oder lizenziertes Dokument handelt, unterliegen die eingebetteten Bilder denselben Nutzungsbeschränkungen wie das Dokument selbst.
Die PDF to Image-Extrahierung in Originalauflösung ist besonders wertvoll für Fotografen und Grafikdesigner, die ihre eigene Arbeit im PDF-Format zurückerhalten und die Originalbilddateien wiederherstellen müssen, die während des Layouts in das Dokument eingefügt wurden.
Für Designer und Inhaltsersteller, die PDF-Beweise ihrer Arbeit erhalten, bietet die Extraktion in Originalauflösung eine Möglichkeit, Bilder wiederherzustellen, die möglicherweise aus den Arbeitsdateien verloren gegangen sind
Die in ein PDF eingebetteten PDF-Bilder sind oft die hochwertigsten erhaltenen Versionen dieser Bilder
Das Extrahieren von Bildern in ihrer ursprünglichen Auflösung ist eine einmalige Einrichtungsentscheidung, die sich auf jedes Bild aus der PDF-Datei auswirkt. Wenn Sie sich die Zeit nehmen, das Extraktionstool richtig zu konfigurieren, bevor Sie den Stapel ausführen, stellen Sie sicher, dass jedes Bild in seiner vollen Qualität entsteht und für die nächste Verwendung bereit ist.
Durch die Extraktion der Originalauflösung bleibt die Integrität der eingebetteten Bilddaten erhalten. Wenn die extrahierten Bilder die einzigen erhaltenen Kopien dieser Fotos, Logos oder Grafiken sind, ist diese Integrität wichtig.
Die Entscheidung, Bilder mit Originalauflösung statt mit einer Standard-DPI zu extrahieren, ist eine Entscheidung, bei der Qualität Vorrang vor Komfort hat. Die Dateien werden größer. Der Vorgang kann etwas länger dauern. Die Bilder sind jedoch genau so, wie sie waren, als sie in das PDF eingefügt wurden.
Probieren Sie PDF to Image aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
