Ein Schuhkarton voller Quittungen. Ein Ordner mit Rechnungs-PDFs. Ein Jahr mit Geschäftsausgaben, die zur Steuervorbereitung, Spesenabrechnung oder Budgetanalyse in eine Tabelle eingegeben werden müssen. Die manuelle Eingabe jeder Einzelposition aus jedem Beleg in Excel ist langsam, fehleranfällig und nervtötend. Ein besserer Arbeitsablauf nutzt OCR, um den Belegtext zu lesen und die erkannten Einzelposten direkt in eine strukturierte Tabelle zu exportieren.
Die OCR PDF-to-Spreadsheet-Pipeline ist deutlich ausgereifter geworden. Moderne OCR-Engines können Beleglayouts erkennen, Einzelposten anhand ihrer Position und Formatierungsmuster identifizieren und strukturierte Daten exportieren, die nur minimale Bereinigung erfordern. Was früher Stunden der manuellen Dateneingabe erforderte, erfordert heute Minuten automatisierter Verarbeitung mit einem kurzen Überprüfungsschritt.

Vorbereiten von Quittungen und Rechnungen für OCR
Die Bildqualität des Quellbilds bestimmt die Genauigkeit der OCR-Ausgabe, die wiederum den Umfang der Bereinigung bestimmt, die Sie durchführen müssen. Scannen oder fotografieren Sie Belege auf einer ebenen, dunklen Oberfläche mit gleichmäßiger Beleuchtung. Stellen Sie sicher, dass die Quittung flach und nicht zerknittert oder gefaltet ist. Erfassen Sie den gesamten Beleg, einschließlich des Filialnamens oben und des Gesamtbetrags unten. Fehlt der Geschäftsname, bedeutet dies, dass die OCR-Ausgabe keine Anbieteridentifikation enthält.
Erhöhen Sie bei verblassten Thermopapierbelegen den Kontrast, bevor Sie OCR ausführen. Ein verblasster Beleg, dessen Text für das menschliche Auge kaum sichtbar ist, ist für OCR praktisch unsichtbar. Verwenden Sie einen Bildeditor oder eine Scan-App mit Kontrastverstärkung, um den Text abzudunkeln und den Hintergrund aufzuhellen. Das verbesserte Bild sieht für das menschliche Auge möglicherweise unnatürlich aus, führt jedoch zu wesentlich besseren OCR-Ergebnissen.
Gruppieren Sie Belege vor der Verarbeitung nach Typ. Quittungen aus derselben Filiale weisen häufig ähnliche Layouts auf. Durch die gemeinsame Verarbeitung kann die OCR-Engine das Layoutmuster erlernen und die Genauigkeit im gesamten Stapel verbessern. Das Mischen von Belegen aus verschiedenen Filialen zwingt die OCR-Engine dazu, jeden Beleg als einzigartiges Layout zu behandeln.
Probieren Sie PDF-OCR aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
OCR für die Quittungsdatenextraktion konfigurieren
Wählen Sie für Belege optimierte OCR-Einstellungen. Bei Quittungen werden in der Regel kleine Schriftarten, schmales Papier und Thermodruck verwendet, wodurch Zeichen mit inkonsistenter Tintendichte entstehen. Zu den für den Beleg optimierten OCR-Einstellungen gehören Scannen mit höherer Auflösung, mindestens 300 DPI und Graustufen- statt Schwarzweißausgabe, um die subtilen Unterschiede in der Zeichendichte beizubehalten.
WukongPDF ermöglicht die OCR-Verarbeitung über den Browser, sodass Sie Belege scannen oder hochladen und Text extrahieren können. Die browserbasierte OCR verarbeitet Dateien lokal und speichert Ihre Finanzdokumente auf Ihrem Gerät.
Für PDF-Daten extrahieren aus Belegen muss die OCR-Engine zwischen Artikelbeschreibungen, Mengen, Einzelpreisen und Zeilensummen unterscheiden. Die Engine verwendet Positionshinweise, um diese Unterscheidung vorzunehmen. Normalerweise stehen die Artikel links, die Mengen und Preise rechts und die Zeilensummen in der Spalte ganz rechts. Je konsistenter das Beleglayout ist, desto genauer ist die Feldidentifizierung.
Exportieren von OCR-Daten in das Tabellenformat
Nachdem die OCR abgeschlossen ist, exportieren Sie die erkannten Daten in das CSV- oder Excel-Format. Der Export sollte die bei der OCR identifizierte Feldtrennung beibehalten: Lieferantenname in einer Spalte, Datum in einer anderen, Beschreibung jeder Einzelposition, Menge, Einzelpreis und Gesamtsumme in ihren eigenen Spalten. Die meisten OCR-Tools verfügen über eine Option zum Exportieren von Belegen in Tabellenkalkulationen.
Die Konvertierung von Gescannten PDF in eine Tabellenkalkulation ist nicht perfekt. Rechnen Sie damit, dass pro Beleg fünf bis zehn Minuten für die Überprüfung und Bereinigung aufgewendet werden müssen. Vergleichen Sie die Tabellenausgabe mit dem Originalbild der Quittung. Überprüfen Sie, ob die Einzelposten zur Belegsumme addiert werden. Stellen Sie sicher, dass die Steuer korrekt identifiziert und von den Artikelpreisen getrennt wurde. Der Überprüfungsschritt erkennt OCR-Fehler, bevor sie sich in Ihren Spesenabrechnungen verbreiten.
Speichern Sie für die Verarbeitung wiederkehrender Belege die OCR-Einstellungen und die Exportkonfiguration als Voreinstellung. Jeder nachfolgende Belegstapel wird mit denselben Einstellungen verarbeitet, wodurch eine konsistente Ausgabe entsteht. Der voreingestellte Ansatz ist besonders wertvoll für Geschäftsinhaber, die monatliche Spesenabrechnungen von denselben Anbietern verarbeiten.
Umgang mit mehrseitigen Rechnungen und komplexen Belegen
Mehrseitige Rechnungen erfordern eine besondere Behandlung, da Einzelposten über Seitengrenzen hinweg fortgeführt werden können. Die OCR-Engine muss erkennen, dass es sich bei den Elementen auf Seite zwei um eine Fortsetzung der Elemente auf Seite eins und nicht um einen neuen Satz von Elementen handelt. Die meisten OCR-Tools handhaben dies korrekt, wenn die Rechnungsseiten als ein einziges Dokument verarbeitet werden.
Restaurantbelege mit handgeschriebenen Trinkgeldbeträgen fügen einen manuellen Überprüfungsschritt hinzu. Die OCR kann die gedruckten Beträge lesen, hat jedoch Probleme mit der Handschrift, insbesondere mit der Handschrift, die nach dem Drucken des Belegs hinzugefügt wurde, wenn der Stift möglicherweise den gedruckten Text überquert hat. Der Trinkgeldbetrag und die angepasste Gesamtsumme müssen überprüft und manuell eingegeben werden, wenn das OCR sie nicht lesen kann.
Nach dem Export in eine Tabellenkalkulation können Sie die Ausgaben mithilfe der Tabellenkalkulationstools kategorisieren. Fügen Sie eine Kategoriespalte hinzu und weisen Sie jeden Einzelposten basierend auf dem Lieferanten oder der Artikelbeschreibung einer Ausgabenkategorie zu. Die Kategorisierung während des OCR-Überprüfungsprozesses ist effizienter als die Kategorisierung, nachdem alle Belege verarbeitet wurden.
Bei beidseitig bedruckten Belegen, die aus Umweltgründen immer häufiger vorkommen, scannen Sie beide Seiten und verarbeiten Sie sie als ein einziges Dokument. Die OCR-Engine liest die Vorder- und Rückseite als aufeinanderfolgende Seiten. Posten, die sich von der Vorder- bis zur Rückseite des Belegs fortsetzen, sollten als eine einzelne Transaktion behandelt werden, wenn das Geschäft auf der Vorderseite einen Fortsetzungshinweis druckt.
Währungssymbole und Dezimaltrennzeichen variieren je nach Region. Eine Quittung aus einem europäischen Geschäft verwendet das Euro-Symbol und ein Komma als Dezimaltrennzeichen. Konfigurieren Sie die OCR-Engine vor der Verarbeitung für das richtige Gebietsschema. Durch die Nachbearbeitung der Tabelle zur Standardisierung der Währungsformate für Belege aus verschiedenen Ländern wird eine konsistente Finanzberichterstattung gewährleistet.
Das Datumsformat auf Quittungen variiert stark. MM/TT/JJJJ in den Vereinigten Staaten, TT/MM/JJJJ in Europa, JJJJ/MM/TT in Teilen Asiens. Die OCR exportiert das Datum als erkannten Text. Die Tabelle muss das Datum anhand der Herkunft des Belegs korrekt interpretieren. Das Hinzufügen einer Spalte „Belegland“ hilft bei der Datumsinterpretation während der Bereinigungsphase.
Für die Spesenabrechnung kann die OCR-Tabellenausgabe direkt in Buchhaltungssoftware oder Spesenverwaltungsplattformen importiert werden. Die meisten Plattformen akzeptieren CSV-Importe mit Standardspalten: Datum, Anbieter, Beschreibung, Betrag, Kategorie und Zahlungsmethode. Die Zuordnung der OCR-Ausgabespalten zu den von der Plattform erwarteten Spalten ist der letzte Schritt in der Empfangs-zu-Bericht-Pipeline.
Speichern Sie die PDF-Originalquittung zusammen mit der OCR-Tabellenausgabe. Als maßgebliche Aufzeichnung dient das PDF. Als Arbeitsdaten dient die Tabellenkalkulation. Wenn Fragen zu einer bestimmten Transaktion auftreten, kann das Original-Quittungs-PDF zur Überprüfung der OCR-Interpretation herangezogen werden.
Bei wiederkehrenden Lieferanten mit konsistenten Belegformaten verbessert sich die OCR-Genauigkeit mit der Zeit, da die Engine das Layout lernt. Der erste Beleg eines neuen Lieferanten erfordert möglicherweise mehr manuelle Bereinigung als der zehnte. Das Speichern der korrigierten Ausgabe als Trainingsbeispiel für die OCR-Engine beschleunigt diesen Lernprozess.
Die Steuersätze für Quittungen variieren je nach Standort und Produkttyp. Das OCR erkennt möglicherweise den Steuerbetrag, nicht jedoch den Steuersatz. Die Berechnung des Steuersatzes aus dem Steuerbetrag und der Zwischensumme hilft bei der Überprüfung der OCR-Genauigkeit. Wenn der berechnete Satz mit keinem bekannten Steuersatz für den Kaufort übereinstimmt, wurden die Beträge entweder vom OCR falsch gelesen oder die Quittung enthält sowohl steuerpflichtige als auch nicht steuerpflichtige Posten.
Bei Geschäftsausgaben, die mit einer Kombination aus persönlichen und geschäftlichen Mitteln bezahlt werden, wie etwa bei einem Geschäftsessen, bei dem eine Person den gesamten Tisch bezahlt, muss auf der Quittung der geschäftliche Teil vermerkt werden. Die Anmerkung sollte nach der OCR zur Tabelle hinzugefügt werden und nicht zum Beleg-PDF, um den Originalbeleg für Prüfzwecke aufzubewahren.
Der Return on Investment für Beleg-OCR wird im Vergleich zur manuellen Dateneingabe nach etwa fünfzig Belegen positiv. Für Unternehmen, die monatlich Hunderte von Belegen verarbeiten, führt die Zeitersparnis zu einer messbaren Senkung der Arbeitskosten und schnelleren Spesenabrechnungszyklen.
Cloudbasierte Belegverwaltungsplattformen kombinieren OCR mit mobilen Apps, die Belegfotos am Empfangsort erfassen. Die Belegdaten fließen direkt in die Spesenabrechnungen ein, ohne den Zwischenschritt des Speicherns und späteren Verarbeitens von PDF-Dateien, was den Arbeitsablauf weiter rationalisiert.
Das IRS und andere Steuerbehörden akzeptieren digitale Kopien von Quittungen, sofern das digitale Bild lesbar ist und das Original genau wiedergibt. Die OCR-Tabellenausgabe in Kombination mit der Original-PDF-Quittung erfüllt die Aufzeichnungsanforderungen und macht die Daten gleichzeitig für die Steuervorbereitung wesentlich nützlicher.
Für Unternehmen, die Belege aus mehreren Ländern verarbeiten, muss das OCR-System unterschiedliche Sprachen, Währungen, Datumsformate und Steuerstrukturen verarbeiten. Eine Quittung aus Frankreich sieht anders aus als eine aus Japan und das OCR-System muss für jedes regionale Format konfiguriert werden.
Der langfristige Wert digitalisierter Belege geht über die unmittelbare Notwendigkeit der Spesenabrechnung hinaus. Historische Belegdaten können im Hinblick auf Ausgabenmuster, Lieferantenverhandlungen und Budgetprognosen analysiert werden – Erkenntnisse, die nicht zugänglich sind, wenn Belege in Papierform oder als nicht durchsuchbare PDFs vorliegen.
Die Kombination aus OCR-Technologie und Tabellenkalkulationsexport wandelt Belege aus statischen Datensätzen in analysierbare Daten um, die das Finanzmanagement, die Einhaltung von Steuervorschriften und Business Intelligence unterstützen.
Der Übergang von Papierbelegen zu OCR-verarbeiteten digitalen Daten stellt eine der praktischsten Anwendungen der Dokumentenautomatisierung für kleine Unternehmen und Einzelpersonen dar, die ihre Finanzen verwalten.
Die OCR-Belegverarbeitung wandelt die mühsame und fehleranfällige Aufgabe der manuellen Dateneingabe in einen schnellen, automatisierten Workflow um, der sich bereits nach den ersten paar Dutzend Belegen durch Zeitersparnis bezahlt macht.
| Quittungsfeld | OCR-Erkennungstipp | Spalte exportieren |
|---|---|---|
| Shopname | Normalerweise oben; größte Schriftart | Verkäufer |
| Datum | Suchen Sie nach Datumsmustern oben | Datum |
| Werbebuchungen | Linksbündige Textblöcke | Beschreibung, Menge, Stückpreis |
| Zwischensumme | Vor Steuern; oft beschriftet | Zwischensumme |
| Steuer | Nach Zwischensumme; prozentual oder fest | Steuer |
| Gesamt | Größte Menge; oft mutig | Gesamt |
Probieren Sie PDF-OCR aus
Keine Installation erforderlich. Funktioniert direkt in Ihrem Browser.
