Eine handschriftlich in ein Notizbuch geschriebene, mit einem Telefon fotografierte und als gescannte PDF-Datei gespeicherte Seite mit Besprechungsnotizen enthält wertvolle Informationen, die für Such-, Kopier- und Einfügeprogramme und Screenreader völlig unzugänglich sind. Die Wörter sind für das menschliche Auge sichtbar, für den Computer sind sie jedoch nur Formen in einem Bild. Durch das Konvertieren dieser handschriftlichen Notizen in bearbeitbaren getippten Text werden sie durchsuchbar, kopierbar und in jedem Dokument oder jeder Anwendung verwendbar.
Die Handschrifterkennung ist schwieriger als die Erkennung gedruckter Texte, da die Handschrift jeder Person einzigartig ist. Die Formen von Buchstaben variieren zwischen einzelnen Personen weitaus stärker als bei gedruckten Schriftarten, und die Erkennungsmaschine muss mit dieser Variabilität umgehen.
Das Konvertieren handschriftlicher Notizen in einem gescannten OCR PDF-Dokument in bearbeitbaren getippten Text erfordert eine handschriftfähige OCR-Engine, die kursive und gedruckte Handschrift erkennen kann, sowie einen Workflow, der die höhere Fehlerrate der Handschrifterkennung im Vergleich zur gedruckten Text-OCR bewältigt. WukongPDFs Gescannte PDF und OCR-Tools unterstützen die Texterkennung, und die folgenden Anleitungen behandeln die Maximierung der Genauigkeit der Handschrifterkennung.

Warum die Handschrifterkennung wesentlich schwieriger ist als OCR für gedruckten Text
OCR für gedruckten Text funktioniert durch den Abgleich von Zeichenformen mit bekannten Schriftmustern. Der Buchstabe A in Times New Roman sieht gleich aus, egal ob ich ihn tippe oder Sie ihn tippen oder ob eine Maschine ihn ausdruckt. Die Erkennungs-Engine verfügt über eine klare, konsistente Vorlage für jedes Zeichen in jeder gängigen Schriftart. Für die Handschrifterkennung gibt es keine derartigen Vorlagen, da der Buchstabe A bei jeder Person anders aussieht. Die Engine muss die statistischen Muster handgeschriebener Zeichen über enorme Unterschiede in Form, Größe, Neigung und Verbindung zwischen Buchstaben hinweg erkennen.
Die kursive Handschrift, bei der Buchstaben innerhalb eines Wortes verbunden werden, erhöht die Komplexität zusätzlich. Die Erkennungsmaschine muss verbundene Buchstaben in einzelne Zeichen zerlegen, bevor sie jedes einzelne erkennt. Falsche Segmentierung, das Aufteilen eines Buchstabens m in r und n oder das Zusammenführen zweier Buchstaben zu einem, ist eine der Hauptursachen für Fehler bei der Handschrifterkennung. Handschriftliche Schrift, bei der jeder Buchstabe einzeln geschrieben wird, ist für Erkennungsmaschinen deutlich einfacher zu verarbeiten und führt zu präziseren Ergebnissen.
Probieren Sie PDF-OCR aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
Vorbereiten des gescannten Bildes für die Handschrifterkennung
Die Qualität des Quellbildes ist der größte Einzelfaktor für die Genauigkeit der Handschrifterkennung und wichtiger als die Wahl der Erkennungs-Engine. Scannen oder fotografieren Sie die handgeschriebene Seite mit mindestens 300 DPI, wobei 600 DPI für kleine oder dichte Handschriften empfohlen wird. Sorgen Sie für eine gleichmäßige, schattenfreie Ausleuchtung der gesamten Seite. Halten Sie die Kamera oder das Telefon parallel zur Seite, um perspektivische Verzerrungen zu minimieren. Je besser das Quellbild ist, desto genauer ist die Erkennung.
Verbessern Sie das gescannte Bild, bevor Sie die Erkennung ausführen. Erhöhen Sie den Kontrast, um die Tinte dunkler und den Papierhintergrund aufzuhellen. Wenden Sie einen Schärfungsfilter an, um die Kanten handgeschriebener Striche schärfer zu machen. Konvertieren Sie das Bild in Graustufen oder reines Schwarzweiß mithilfe des adaptiven Schwellenwerts, der ungleichmäßige Beleuchtung besser verarbeitet als ein globaler Schwellenwert. Das verbesserte Bild präsentiert der Erkennungsmaschine klarere, deutlichere Zeichenformen.
Verwendung handschriftfähiger OCR-Engines
Allzweck-OCR-Engines wie Tesseract verfügen über Handschrifterkennungsmodi, die über Konfigurationseinstellungen aktiviert werden können. Geben Sie in Tesseract das Sprachmodell an, das Handschriftunterstützung umfasst, und legen Sie den Seitensegmentierungsmodus fest, um das Bild als einen einzelnen Textblock zu behandeln. Google Cloud Vision API und Microsoft Azure Computer Vision integrieren Handschrifterkennungsfunktionen in ihre cloudbasierten OCR-Dienste.
Spezielle Handschrifterkennungsanwendungen wie Nebo, GoodNotes oder die Ink-to-Text-Funktion von Microsoft OneNote sind speziell für die Handschrift optimiert und liefern häufig bessere Ergebnisse als allgemeine OCR-Engines, die in den Handschriftdienst integriert sind. Exportieren Sie den erkannten Text aus der Handschrift-App und integrieren Sie ihn bei Bedarf erneut in das ursprünglich gescannte PDF.
| Faktor | Auswirkung auf die Genauigkeit | Empfehlung |
|---|---|---|
| Scanauflösung | Eine höhere Auflösung bietet mehr Details pro Zeichen | Mindestens 300 DPI, 600 DPI für kleine Handschriften |
| Beleuchtung | Schatten und ungleichmäßige Beleuchtung verdecken die Zeichenkanten | Diffuse, gleichmäßige Beleuchtung; Vermeiden Sie Kamerablitze |
| Handschriftstil | Handschrift in Schriftform ist einfacher als Schreibschrift | Wenn Sie die Quelle kontrollieren, schreiben Sie in gedruckter Form, um bessere Ergebnisse zu erzielen |
| Bildverbesserung | Eine sauberere Eingabe führt zu einer saubereren Erkennung | Erhöhen Sie den Kontrast, schärfen Sie die Schärfe und wenden Sie adaptives Schwellenwertverfahren an |
Überprüfung und Korrektur des erkannten Textes
Bei der Handschrifterkennung entstehen immer Fehler, typischerweise liegt die Zeichenfehlerrate bei 5–20 %, abhängig von der Qualität der Handschrift und den Bildbedingungen. Vergleichen Sie den erkannten Text mit der handgeschriebenen Originalseite und korrigieren Sie falsch erkannte Wörter. Der Korrekturschritt nimmt Zeit in Anspruch, ist jedoch wichtig, damit die Ausgabe zum Suchen, Kopieren und Einfügen oder zur weiteren Bearbeitung verwendet werden kann.
Behandeln Sie den erkannten Text bei Dokumenten, bei denen absolute Genauigkeit erforderlich ist, wie z. B. Rechtsakten oder medizinische Notizen, als Suchindex und nicht als Ersatz für die Originalhandschrift. Bewahren Sie das gescannte Originalbild als maßgebliche Aufzeichnung auf. Verwenden Sie den erkannten Text, um eine Stichwortsuche zu aktivieren, die die relevante Seite im Originalscan findet. Die Kombination aus durchsuchbarem erkanntem Text und dem Originalbild bietet das Beste aus beidem: Auffindbarkeit anhand des Textes und Wiedergabetreue anhand des Bildes.
Probieren Sie PDF-OCR aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
