Wenn Sie ein Buch Seite für Seite scannen, entsteht ein PDF, bei dem jede Seite einen dunklen, geschwungenen Schatten aufweist, der in der Mitte verläuft. Der Schatten wirft den Buchrücken dort, wo sich die Seiten in den Einband hinein krümmen. Der Text in der Nähe des Buchrückens ist durch die Seitenkrümmung abgedunkelt und manchmal verzerrt. Der Schatten verbraucht beim Drucken Tinte oder Toner, lässt die Seite unprofessionell aussehen und beeinträchtigt die OCR-Genauigkeit des betroffenen Textes. Durch das Ausschneiden des Buchrückenschattens aus jeder gescannten Seite werden visuelle Artefakte entfernt und die Aufmerksamkeit des Lesers auf den Inhalt gelenkt. Der Crop PDF-Ansatz zur Entfernung von Rückenschatten muss Seite für Seite angewendet werden, da sich die Schattenposition von Seite zu Seite leicht verschiebt, wenn sich die Buchdicke von vorne nach hinten ändert.

Warum Rückenschatten in Buchscans erscheinen
Flachbettscanner drücken das Buch gegen eine Glasplatte. Die Seite in der Nähe des Rückens kann nicht vollständig flach liegen, da die Bindung dies verhindert. Durch diesen Spalt zwischen der Seite und dem Glas entsteht ein Bereich, in dem das Scannerlicht unterschiedlich reflektiert wird und ein Schatten entsteht, der an der Buchrückenkante beginnt und mit zunehmender Entfernung von der Bindung verblasst. Auf der linken Seite eines aufgeschlagenen Buches ist der Schatten am linken Rand am dunkelsten und erstreckt sich zur Mitte hin. Auf der rechten Seite ist der Schatten am rechten Rand am dunkelsten.
Auch die Krümmung der Seite in der Nähe der Bindung verzerrt den Text. Je nach Winkel der Seite relativ zum Scannersensor erscheinen Zeichen in der Nähe des Buchrückens gestaucht oder gestreckt. Durch das Zuschneiden werden der Schatten und der verzerrte Text entfernt. Die Alternative, Bildbearbeitung zu verwenden, um den Schatten aufzuhellen und den verzerrten Text zu entzerren, ist komplexer und führt selten zu einem so sauberen Ergebnis wie das einfache Wegschneiden des betroffenen Bereichs. Das Gescannte PDF aus einem Buchscan profitiert mehr vom Zuschneiden als von der versuchten Korrektur des Schattenbereichs.
Versuchen Sie es mit „PDF zuschneiden“.
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
Bestimmen der Erntegrenzen
Öffnen Sie die erste gescannte Seite in einem PDF-Viewer, der Zuschneidewerkzeuge unterstützt. Vergrößern Sie den Rand des Buchrückens und stellen Sie fest, wo der Schatten beginnt, den Seitenhintergrund merklich abzudunkeln. Die Beschneidungsgrenze sollte direkt innerhalb dieses Punktes platziert werden, sodass die gesamte Schattenzone entfernt wird. Fügen Sie neben dem Schatten einen kleinen Rand des normalen Seitenhintergrunds ein, um sicherzustellen, dass keine abgedunkelten Pixel übrig bleiben. Eine Beschnittgrenze, die in den Schatten ragt, hinterlässt einen dunklen Streifen am Rand der beschnittenen Seite.
Messen Sie den Abstand vom Seitenrand bis zur Beschnittgrenze. Dieser Abstand wird zum Beschnittwert für alle Seiten im Scan. Allerdings kann der optimale Zuschnittabstand zwischen der linken und rechten Seite des Buches variieren, und er kann zwischen der Vorder- und Rückseite des Buches variieren, wo sich die Seitenkrümmung ändert. Scannen Sie eine Auswahl von Seiten aus verschiedenen Abschnitten des Buches und prüfen Sie, ob die Rückenschattenbreite konsistent ist. Wenn es unterschiedlich ist, gruppieren Sie die Seiten in Abschnitte, die den gleichen Zuschnittsabstand haben. Wenden Sie für jede Gruppe den entsprechenden Schnittabstand an.
Anwenden des Zuschnitts auf alle Seiten
Nachdem Sie die Zuschneidegrenze bestimmt haben, wenden Sie sie auf jede Seite im PDF an. Die meisten PDF-Editoren, die das Zuschneiden unterstützen, können dasselbe Zuschneiderechteck auf mehrere Seiten anwenden. Wählen Sie alle Seiten aus, die denselben Zuschneideabstand haben, öffnen Sie das Zuschneidewerkzeug, geben Sie die Zuschneidewerte ein und wenden Sie sie an. Für einen Buchscan, bei dem die linke und rechte Seite unterschiedliche Zuschnittwerte benötigen, verarbeiten Sie die linke und rechte Seite als separate Seitengruppen. Ein PDF zuschneiden Stapelvorgang, der den gleichen Zuschnitt auf alle ausgewählten Seiten anwendet, dauert Sekunden.
Wenn das PDF als Doppelseite gescannt wurde, wobei jede PDF-Seite sowohl die linke als auch die rechte Seite des aufgeschlagenen Buches zeigt, ist das Zuschneiden komplexer. Der Rückenschatten verläuft in der Mitte der Seite. Schneiden Sie die linke Hälfte der Seite zu, um die linke Seite des Rückenschattens zu entfernen, und schneiden Sie die rechte Hälfte zu, um die rechte Seite zu entfernen. Einige PDF-Tools können jede Seite in der Mitte teilen und jede Hälfte unabhängig zuschneiden, sodass aus der Doppelseite einzelne Seiten entstehen. WukongPDF und ähnliche Plattformen bieten Zuschneidewerkzeuge, die sowohl das Zuschneiden von Einzelseiten- als auch Doppelseiten-Buchscans ermöglichen.
Bewahren des Seiteninhalts in der Nähe des Buchrückens
Der Schattenbereich des Rückens kann Inhalte enthalten, die nicht einfach verworfen werden können. Eine Tabelle, die sich über die gesamte Seitenbreite erstreckt, kann Spalten haben, die bis in die Schattenzone reichen. Ein Diagramm oder Foto kann in der Nähe des Einbands platziert werden. Eine Fußnote oder eine Randnotiz kann durch den Schatten teilweise verdeckt werden. Bei diesen Seiten werden durch das Zuschneiden der gesamten Schattenzone Inhalte entfernt, die der Leser benötigt.
Behandeln Sie diese außergewöhnlichen Seiten individuell. Wenn der Inhalt in der Schattenzone trotz der Verdunkelung lesbar ist, beschneiden Sie diese bestimmte Seite weniger aggressiv, indem Sie nur den dunkelsten Teil des Schattens entfernen und den Text verdunkeln, aber immer noch lesbar lassen. Wenn der Inhalt unleserlich ist, überlegen Sie, ob das physische Buch erneut gescannt werden kann, wobei die Seite vorsichtiger behandelt werden kann, um die Seite noch weiter zu glätten. Wenn Sie das Buch fester gegen das Scannerglas drücken, einen Buchscanner mit V-förmiger Auflagefläche für gebundene Bände verwenden oder das Buch mit einer Overhead-Kamera anstelle eines Flachbettscanners scannen, wird der Buchrückenschatten an der Quelle reduziert.
Qualitätsüberprüfung nach der Ernte
Scrollen Sie nach dem Zuschneiden durch jede Seite der PDF-Datei, um sicherzustellen, dass keine Schattenreste zurückbleiben und dass kein Inhalt versehentlich zugeschnitten wurde. Achten Sie besonders auf Seiten am Anfang und Ende des Buches, wo die Seitenkrümmung und die Schattenbreite von den mittleren Seiten abweichen können. Ein perfekter Zuschnitt für Seite 100 kann für Seite 5 zu aggressiv sein, da der dünnere Seitenstapel auf einer Seite der Bindung eine andere Krümmung erzeugt.
Führen Sie OCR für das zugeschnittene PDF aus und vergleichen Sie die Texterkennungsgenauigkeit mit dem ursprünglichen, nicht zugeschnittenen Scan in der Schattenzone. Wenn die zugeschnittene Version Text im zuvor schattierten Bereich genauer erkennt, war der Zuschnitt erfolgreich. Wenn in der zugeschnittenen Version Text verloren geht, der zuvor erkannt wurde, war der Zuschnitt möglicherweise zu aggressiv. Das PDF-Qualität-Ziel ist eine saubere Seite, auf der alle wesentlichen Inhalte erhalten bleiben und alle störenden Artefakte entfernt werden.
Alternativen zum Zuschneiden für die Entfernung von Wirbelsäulenschatten
Das Zuschneiden ist der einfachste Ansatz zur Entfernung von Wirbelsäulenschatten, aber es ist nicht der einzige Ansatz. Bildbearbeitungssoftware kann lokale Helligkeits- und Kontrastanpassungen an der Schattenzone vornehmen, den Hintergrund aufhellen und den Textkontrast erhöhen, ohne den Inhalt zu entfernen. Bei diesem Ansatz bleibt jedes Wort auf der Seite erhalten, erfordert jedoch eine Bildbearbeitung pro Seite, was nur für kurze Dokumente oder einzelne Seiten von großer Bedeutung praktisch ist.
Spezielle Software zum Scannen von Büchern wie ScanTailor verfügt über eine Inhaltsauswahlfunktion, die den Textbereich auf jeder Seite automatisch erkennt und auf diesen Bereich zuschneidet, wobei der Buchrückenschatten ohne manuelle Messung der Beschnittgrenzen verarbeitet wird. ScanTailor verarbeitet gescannte Bilder, bevor sie zu einem PDF zusammengesetzt werden. Wenn Sie regelmäßig Bücher in PDF scannen, erspart die Investition in einen Scan-Workflow mit automatischer Inhaltserkennung und Zuschnitt stundenlange manuelle PDF beschneiden Anpassungen.
Bei seltenen oder empfindlichen Büchern, die nicht flach gegen einen Scanner gedrückt werden können, sollten Sie erwägen, die Seiten mit einer Kamera direkt über dem aufgeschlagenen Buch zu fotografieren. Der Kameraansatz vermeidet die Glasplatte vollständig und kann bei sorgfältiger Beleuchtung von beiden Seiten den Rückenschatten in der Aufnahmephase minimieren, anstatt sich auf die Nachbearbeitung zu verlassen, um ihn zu korrigieren.
Nach dem Zuschneiden und Finalisieren der PDF-Datei sollten Sie erwägen, die bereinigte digitale Version einem Online-Archiv oder einer digitalen Bibliothek zu spenden, wenn das Buch gemeinfrei ist. Die Stunden, die Sie mit der Bereinigung des Scans verbringen, können nicht nur Ihrem eigenen Projekt zugute kommen, sondern auch allen anderen, die Zugriff auf diesen Text in einem lesbaren digitalen Format benötigen.
Bei Büchern mit Illustrationen, Fotos oder Karten, die sich über den Zwischensteg zwischen gegenüberliegenden Seiten erstrecken, geht durch das Beschneiden des Buchrückenschattens der Mittelteil des Bildes verloren. In diesen Fällen sollten Sie erwägen, die Doppelseite für die Illustrationsseiten beizubehalten und nur die reinen Textseiten zuzuschneiden. Ein Hinweis in den Metadaten des Dokuments kann erklären, dass bestimmte Seiten nicht zugeschnitten wurden, um den Inhalt über den Steg hinweg beizubehalten.
Der Gescannte PDF-Bereinigungsprozess für Buchdigitalisierungsprojekte profitiert von einem strukturierten Arbeitsablauf, der die Schritte Scannen, Zuschneiden, OCR und Qualitätsprüfung trennt. Der Versuch, jede Seite beim Scannen zuzuschneiden und zu finalisieren, führt zu inkonsistenten Ergebnissen. Scannen Sie zuerst das gesamte Buch und verarbeiten Sie dann den gesamten Satz an Seitenbildern im Stapel durch den Zuschneideschritt.
Der Crop PDF-Workflow für Buchscans wandelt einen groben Scan in eine saubere digitale Kopie um, die zum Lesen, Drucken und zur langfristigen Aufbewahrung in digitalen Bibliotheksbeständen geeignet ist.
Das bereinigte gescannte PDF mit entfernten Rückenschatten ist bereit für die OCR-Verarbeitung, die von der verbesserten Bildqualität profitiert
Bei einem gut zugeschnittenen Buchscan bleiben die Worte des Autors erhalten und gleichzeitig werden die mechanischen Artefakte des Scanvorgangs entfernt
Das Scannen von Büchern ist ein Akt der Konservierung. Jede von Scannerschatten befreite Seite ist eine Seite, die zukünftige Leser ohne Ablenkung lesen können. Die Sorgfalt, die beim Zuschneiden aufgewendet wird, ist Teil der größeren Anstrengung, den Inhalt physischer Bücher in die digitale Zukunft zu übertragen.
Versuchen Sie es mit „PDF zuschneiden“.
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
