Tips & Tricks

So erstellen Sie eine OCR-Erkennung für ein Dokument, das sowohl handschriftliche Notizen als auch getippten Text enthält

Sie scannen ein Papierformular, das jemand handschriftlich ausgefüllt hat. Der gedruckte Text auf dem Formular ist klar. Die handgeschriebenen Antworten in den Kästchen sind unordentlich, aber für einen Menschen lesbar. Sie führen OCR für den Scan aus, in der Hoffnung, das Formular durchsuchbar zu machen und die handschriftlichen Antworten als Text extrahieren zu können. Das OCR-Ergebnis für den gedruckten Text ist nahezu perfekt. Das OCR-Ergebnis für die Handschrift ist Kauderwelsch. Die auf gedruckte Schriftarten trainierte Erkennungsmaschine kann die variablen, unregelmäßigen Formen menschlicher Handschrift nicht verstehen.

Dokumente, die sowohl getippten als auch handschriftlichen Text enthalten, stellen eine doppelte Herausforderung für OCR PDF-Engines dar. Der gedruckte Text benötigt Standard-OCR, was gut funktioniert. Die Handschrift erfordert eine spezielle Handschrifterkennung, die weniger genau ist und andere Einstellungen erfordert. Um beides in einem einzigen Dokument zu handhaben, ist eine Strategie erforderlich, die jeden Inhaltstyp angemessen behandelt.

How to OCR a Document That Contains Both Handwritten Notes and Typed Text Together

Warum Handschrift für OCR-Engines so viel schwieriger ist

OCR für gedruckten Text funktioniert durch den Abgleich von Zeichenformen mit bekannten Schriftmustern. Der Buchstabe „a“ Im 12-Punkte-Times New Roman sieht jedes Mal, wenn es erscheint, nahezu identisch aus. Die OCR-Engine speichert ein Modell, wie Times New Roman-Buchstaben aussehen, und gleicht es mit diesem Modell ab. Für die Handschrift gibt es kein solches Modell. Das „A“ eines jeden Menschen ist sieht anders aus. Sogar das „a“ derselben Person variiert von einem Vorfall zum nächsten, abhängig von den umgebenden Buchstaben, der Schreibgeschwindigkeit, dem Stiftwinkel und der Ermüdung. Es gibt kein festes Muster, mit dem abgeglichen werden kann.

Die Handschrifterkennung nutzt Modelle des maschinellen Lernens, die auf Tausenden oder Millionen von Handschriftproben trainiert wurden. Diese Modelle lernen die statistischen Muster der Variation handgeschriebener Buchstaben kennen und können Zeichen erkennen, selbst wenn sie erheblich von einer einzelnen Vorlage abweichen. Die Genauigkeit der Handschrifterkennung hat sich durch Deep Learning dramatisch verbessert, bleibt aber immer noch deutlich hinter der Erkennung gedruckter Texte zurück. Ein Benchmark der PDF Association aus dem Jahr 2025 ergab eine OCR-Genauigkeit von gedrucktem Text bei sauberen Scans von über 97 %. Die Genauigkeit der Handschrifterkennung lag bei demselben Benchmark bei etwa 80 % bis 85 %, was bedeutet, dass etwa jedes fünfte bis sechste handgeschriebene Wort einen Fehler enthält (PDF Association, „OCR Accuracy Benchmark Report“, 2025).

WukongPDF

Probieren Sie PDF-OCR aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →

Strategien für OCR bei gemischt getippten und handschriftlichen Dokumenten

Die effektivste Strategie besteht darin, das Dokument in getippte und handgeschriebene Bereiche zu unterteilen und jeden mit der entsprechenden Erkennungs-Engine zu verarbeiten. Diese Trennung kann manuell durch Zuschneiden oder Maskieren des Dokuments in Abschnitte oder automatisch durch eine Erkennungsmaschine erfolgen, die den Inhaltstyp pro Bereich erkennt.

Das OCR-Tool von WukongPDF erkennt, ob jeder Textbereich auf der Seite gedruckt oder handschriftlich ist, und wendet das entsprechende Erkennungsmodell an. Auf einem Formular mit gedruckten Etiketten und handgeschriebenen Antworten werden die Etiketten mit dem gedruckten Textmodell mit hoher Genauigkeit erkannt. Die handschriftlichen Antworten werden mit dem Handschriftmodell mit der Genauigkeit verarbeitet, die die Qualität der Handschrift zulässt. Die Ausgabe ist eine einzelne Textebene, die beide Erkennungsergebnisse kombiniert.

Verbesserung der OCR-Genauigkeit von Handschriften durch besseres Scannen

Die Scanqualität hat einen größeren Einfluss auf die Handschrifterkennung als auf die Erkennung gedruckter Texte. Scannen Sie mit mindestens 300 DPI. Durch eine höhere Auflösung kann die Erkennungs-Engine mehr Pixel pro Zeichen analysieren. Verwenden Sie den Graustufen- oder Farbmodus anstelle von reinem Schwarzweiß. Die subtilen Grauvariationen in einem handgeschriebenen Strich enthalten Informationen über Buchstabenformen, die bei der reinen Schwarz-Weiß-Schwellenwertermittlung verworfen werden. Ein handgeschriebenes „e“ Wo die Schleife teilweise ausgefüllt ist, ist möglicherweise in Graustufen erkennbar, wird jedoch zu einem nicht unterscheidbaren Fleck, wenn der Schwellenwert auf Schwarz und Weiß gesetzt wird.

Stellen Sie sicher, dass die Handschrift so dunkel und gleichmäßig wie möglich ist. Bleistifthandschrift ist schwerer zu erkennen als Federschrift, da der Graphit eine schwächere, variablere Linie erzeugt. Blaue oder schwarze Tinte auf weißem Papier ergibt den besten Kontrast. Rote Tinte, grüne Tinte oder farbiges Papier verringern Kontrast und Genauigkeit. Wenn Sie den Prozess zum Ausfüllen von Formularen steuern, geben Sie an, dass Formulare für optimale OCR-Ergebnisse mit schwarzer Tinte ausgefüllt werden sollen. Diese kleine Anweisung auf dem Formular selbst kann die Genauigkeit der nachgelagerten Datenextraktion um 10 bis 15 Prozentpunkte verbessern.

Überprüfen und Korrigieren handschriftlicher OCR-Ausgabe

Nach der OCR weist die Textebene Gescanntes PDF Fehler auf, die sich auf die handschriftlichen Bereiche konzentrieren. Der gedruckte Text wird nahezu perfekt sein. Konzentrieren Sie sich bei Ihrer Rezension auf die handschriftlichen Antworten. Öffnen Sie das PDF und suchen Sie nach häufigen handschriftlichen OCR-Fehlern. Die Zahl 1 wird oft als Buchstabe l erkannt. Die Zahl 0 wird oft als Buchstabe O erkannt. Die Buchstabenkombination „th“ wird oft als „+h“ erkannt weil der Querbalken des t in das h übergeht.

Für Formulardaten, die in eine Datenbank oder Tabellenkalkulation extrahiert werden müssen, ist eine manuelle Überprüfung der handschriftlichen Felder unerlässlich. Die Erkennungsmaschine liefert eine beste Schätzung. Ein Mensch muss diese Vermutung anhand der Originalhandschrift überprüfen. In diesem Überprüfungsschritt wird die Zeitersparnis durch OCR teilweise durch die Notwendigkeit einer menschlichen Qualitätskontrolle ausgeglichen. Die Nettoersparnis hängt vom Volumen ab. Bei 10 Formularen ist die manuelle Dateneingabe möglicherweise schneller als OCR plus Überprüfung. Bei 500 Formularen ist die OCR-Plus-Überprüfung erheblich schneller, da der Überprüfungsschritt auf die Felder beschränkt ist, in denen die OCR-Konfidenz niedrig ist. Die OCR-Ausgabe von WukongPDF enthält einen Konfidenzwert für jeden erkannten Textblock, sodass Sie nach Konfidenz sortieren und nur die Ergebnisse mit geringer Konfidenz überprüfen können.

Bei Formularen, die in großen Mengen verarbeitet werden, wie z. B. medizinische Aufnahmeformulare, Versicherungsansprüche oder behördliche Anträge, kann das Formulardesign selbst die Genauigkeit der handschriftlichen OCR verbessern. Entwerfen Sie das Formular mit separaten Zeichenfeldern, einem Feld pro Buchstabe, und nicht mit einer einzigen langen Zeile für einen Namen oder eine Adresse. Einzelne Zeichenfelder zwingen den Autor dazu, ihre Buchstaben zu trennen, was die Erkennungsgenauigkeit erheblich verbessert, da die OCR-Engine jedes Zeichen isolieren kann, bevor es eine Erkennung versucht. Dies ist das gleiche Prinzip, das weltweit bei Steuerformularen und Einwanderungsdokumenten angewendet wird. Die Kästchen sind für die Person, die das Formular ausfüllt, etwas unpraktisch, ermöglichen aber eine automatisierte Datenextraktion in großem Maßstab, was den Kompromiss darstellt, der bei der Verarbeitung großer Formularmengen erforderlich ist.

Ein praktischer Qualitätskontrollpunkt nach der OCR bei gemischten Dokumenten: Führen Sie eine Suche nach häufigen OCR-Fehlermustern durch, die darauf hinweisen, dass die Engine Handschrift mit gedrucktem Text verwechselt hat. Suchen Sie nach „cl“ und stellen Sie sicher, dass es nicht „d“ sein sollte. Suchen Sie nach „0“ und stellen Sie sicher, dass jede Instanz tatsächlich eine Null und kein großes O ist. Suchen Sie nach „1“ und vergewissern Sie sich, dass es sich um eine Eins und nicht um ein kleines L oder ein großes I handelt. Diese drei Suchvorgänge decken die meisten OCR-Fehler auf Zeichenebene sowohl bei der gedruckten als auch bei der handschriftlichen Erkennung ab. Beheben Sie die gefundenen Fehler und führen Sie dann eine weitere Suche nach den spezifischen Namen, Nummern oder Daten durch, die für den Zweck des Dokuments von entscheidender Bedeutung sind. Ein Formular, bei dem die gedruckten Anweisungen einen Tippfehler enthalten, ist ärgerlich. Ein Formular, bei dem die handschriftliche Medikamentendosierung falsch ist, ist gefährlich.

WukongPDF

Probieren Sie PDF-OCR aus

Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.

Jetzt starten →