レシートが入った靴箱。請求書 PDF のフォルダー。税金の準備、経費報告、または予算分析のためにスプレッドシートに入力する必要がある 1 年間の事業経費。各レシートの各項目を Excel に手動で入力するのは時間がかかり、エラーが発生しやすく、気が遠くなります。より良いワークフローでは、OCR を使用して領収書のテキストを読み取り、認識された明細を構造化スプレッドシートに直接エクスポートします。
OCR PDFからスプレッドシートへのパイプラインは大幅に成熟しました。最新の OCR エンジンは、レシートのレイアウトを認識し、位置と書式パターンによって品目を識別し、最小限のクリーンアップで構造化データをエクスポートできます。かつては手動でデータを入力するのに何時間もかかっていましたが、今では簡単な検証ステップを伴う自動処理で数分で済みます。

OCR 用の領収書と請求書の準備
ソース イメージの画質によって OCR 出力の精度が決まり、必要なクリーンアップの量が決まります。均一な照明の下、平らで暗い表面でレシートをスキャンまたは写真撮影します。レシートが平らで、しわになったり折れたりしていないことを確認してください。上部に店舗名、下部に合計金額を含むレシート全体をキャプチャします。店舗名が欠落している場合は、OCR 出力にベンダー ID がないことを意味します。
色あせた感熱紙のレシートの場合は、OCR を実行する前にコントラストを高めます。人間の目にはテキストがほとんど見えない色あせたレシートは、基本的に OCR では認識できません。コントラスト強調機能のある画像エディターまたはスキャン アプリを使用して、テキストを暗くし、背景を明るくします。強化された画像は人間の目には不自然に見えるかもしれませんが、劇的に優れた OCR 結果が得られます。
処理する前に、領収書を種類ごとにグループ化します。同じ店舗からのレシートはレイアウトが似ていることが多く、これらを一緒に処理することで OCR エンジンがレイアウト パターンを学習し、バッチ全体の精度を向上させることができます。異なる店舗からのレシートを混在させると、OCR エンジンは各レシートを一意のレイアウトとして処理するようになります。
PDF OCRを試してみる
インストールは必要ありません。ブラウザで直接動作します。
領収書データ抽出のための OCR の構成
レシート用に最適化された OCR 設定を選択します。通常、領収書には小さなフォント、幅の狭い紙、インク濃度が一定でないサーマル印刷が使用されます。受信に最適化された OCR 設定には、高解像度のスキャン、少なくとも 300 DPI、文字密度の微妙な変化を維持するための白黒出力ではなくグレースケールが含まれます。
WukongPDF はブラウザを介した OCR 処理を提供し、領収書をスキャンまたはアップロードしてテキストを抽出できます。ブラウザベースの OCR はファイルをローカルで処理し、財務書類をデバイス上に保存します。
領収書から PDF データを抽出 の場合、OCR エンジンは品目の説明、数量、単価、明細合計を区別する必要があります。エンジンは位置キューを使用してこの区別を行います。通常、品目は左側、数量と価格は右側、行合計は右端の列に表示されます。レシートのレイアウトの一貫性が高まるほど、フィールドの識別がより正確になります。
OCR データをスプレッドシート形式にエクスポートする
OCRが完了したら、認識されたデータをCSVまたはExcel形式にエクスポートします。エクスポートでは、OCR 中に特定されたフィールド分離を保持する必要があります。つまり、ある列にはベンダー名、別の列には日付、各品目説明、数量、単価、行合計はそれぞれの列にあります。ほとんどの OCR ツールには、レシートをスプレッドシートにエクスポートするオプションが含まれています。
スキャン PDF からスプレッドシートへの変換は完全ではありません。検証とクリーンアップには、レシートごとに 5 ~ 10 分かかることが予想されます。スプレッドシート出力を元のレシート画像と比較します。項目の合計が領収書の合計に達していることを確認します。税金が正しく識別され、商品価格から分離されていることを確認します。検証ステップでは、経費レポートに伝播される前に OCR エラーを検出します。
定期的なレシート処理の場合、OCR 設定を保存し、設定をプリセットとしてエクスポートします。後続の領収書の各バッチは同じ設定で処理され、一貫した出力が生成されます。事前設定されたアプローチは、同じベンダーからの毎月の経費報告書を処理するビジネス オーナーにとって特に価値があります。
複数ページの請求書と複雑な領収書の処理
明細項目がページ境界を越えて続く可能性があるため、複数ページの請求書には特別な処理が必要です。 OCR エンジンは、2 ページ目のアイテムが新しいアイテムのセットではなく、1 ページ目のアイテムの継続であることを認識する必要があります。ほとんどの OCR ツールは、請求書のページが単一の文書として処理される場合、これを正しく処理します。
レストランの領収書に手書きのチップ金額が記載されている場合は、手動による確認手順が追加されます。 OCR は印刷された金額を読み取ることができますが、手書き、特にレシートの印刷後にペンが印刷されたテキストを横切った場合に追加された手書きには苦労します。チップの金額と調整された合計を確認し、OCR で読み取れない場合は手動で入力する必要があります。
スプレッドシートにエクスポートした後、スプレッドシート ツールを使用して経費を分類します。カテゴリ列を追加し、ベンダーまたは品目の説明に基づいて各明細を経費カテゴリに割り当てます。 OCR レビュー プロセス中の分類は、すべてのレシートが処理された後に分類するよりも効率的です。
環境上の理由から両面に印刷されたレシートの場合は、両面をスキャンして 1 つの文書として処理することが一般的になっています。 OCR エンジンは、表と裏を連続したページとして読み取ります。ストアがレシートの表面に継続通知を印刷する場合、レシートの表面から裏面まで続く品目は単一のトランザクションとして扱う必要があります。
通貨記号と小数点区切り文字は地域によって異なります。ヨーロッパの店舗からのレシートでは、ユーロ記号とカンマが小数点区切り文字として使用されます。処理する前に、正しいロケールに合わせて OCR エンジンを構成します。スプレッドシートを後処理して、さまざまな国の領収書の通貨形式を標準化することで、一貫した財務報告が保証されます。
領収書の日付形式はさまざまです。米国では MM/DD/YYYY、ヨーロッパでは DD/MM/YYYY、アジアの一部では YYYY/MM/DD。 OCR は日付を認識されたテキストとしてエクスポートします。スプレッドシートは、領収書の発行元に基づいて日付を正しく解釈する必要があります。受取国列を追加すると、クリーンアップ段階での日付の解釈が容易になります。
経費報告の場合、OCR スプレッドシート出力を会計ソフトウェアまたは経費管理プラットフォームに直接インポートできます。ほとんどのプラットフォームは、日付、ベンダー、説明、金額、カテゴリ、支払い方法などの標準列を使用した CSV インポートを受け入れます。 OCR 出力列をプラットフォームで予期される列にマッピングすることは、受信からレポートまでのパイプラインの最後のステップです。
オリジナルの領収書 PDF を OCR スプレッドシート出力と一緒に保存します。 PDF は信頼できる記録として機能します。スプレッドシートは作業データとして機能します。特定の取引に関して疑問が生じた場合は、元の領収書 PDF を参照して OCR 解釈を確認できます。
一貫したレシート形式を使用する定期仕入先の場合、エンジンがレイアウトを学習するにつれて OCR の精度が時間の経過とともに向上します。新しいベンダーからの最初の受領書は、10 番目の受領書よりも手動によるクリーンアップが必要になる場合があります。修正された出力を OCR エンジンのトレーニング サンプルとして保存すると、この学習プロセスが加速されます。
領収書の税率は地域と商品の種類によって異なります。 OCR は税額を認識する場合がありますが、税率は認識しない場合があります。税額と小計から税率を計算すると、OCR の精度を検証できます。計算された税率が購入場所の既知の税率と一致しない場合は、OCR が金額を誤って読み取ったか、領収書に課税品目と非課税品目の両方が含まれているかのいずれかです。
1 人がテーブル全体の費用を支払ったビジネスランチなど、個人資金と事業資金を組み合わせて支払われた事業経費の場合は、領収書に事業部分の注釈を付ける必要があります。監査目的で元の領収書を保存するには、OCR 後に注釈を領収書の PDF ではなくスプレッドシートに追加する必要があります。
レシート OCR の投資収益率は、手動でデータを入力した場合と比較して、約 50 枚のレシートを受け取るとプラスになります。毎月数百件の領収書を処理する企業にとって、時間の節約は目に見える人件費の削減と経費報告サイクルの短縮につながります。
クラウドベースの領収書管理プラットフォームは、OCR と、受領時に領収書の写真をキャプチャするモバイル アプリを組み合わせています。領収書データは、PDF ファイルを保存して後で処理するという中間ステップなしで経費報告書に直接入力されるため、ワークフローがさらに合理化されます。
IRS およびその他の税務当局は、デジタル画像が判読でき、オリジナルを正確に表現している場合に限り、領収書のデジタル コピーを受け入れます。 OCR スプレッドシート出力と元の領収書 PDF を組み合わせることで、記録管理の要件を満たしながら、データを税務準備にさらに活用できるようになります。
複数の国からの領収書を処理する企業の場合、OCR システムはさまざまな言語、通貨、日付形式、税金構造を処理する必要があります。フランスからの領収書は日本からの領収書と見た目が異なるため、地域の形式ごとに OCR システムを設定する必要があります。
デジタル化された領収書の長期的な価値は、当面の経費報告のニーズを超えています。過去の領収書データを分析して、支出パターン、ベンダーとの交渉、予算予測など、領収書が紙の形式または検索できない PDF のままではアクセスできない洞察を得ることができます。
OCR テクノロジーとスプレッドシートのエクスポートを組み合わせることで、領収書が静的な記録から財務管理、税務コンプライアンス、ビジネス インテリジェンスをサポートする分析可能なデータに変換されます。
紙の領収書から OCR 処理されたデジタル データへの移行は、中小企業や財務を管理する個人にとって、ドキュメント自動化の最も実用的なアプリケーションの 1 つです。
OCR 領収書処理は、手動データ入力という退屈でエラーが発生しやすいタスクを高速で自動化されたワークフローに変換し、最初の数十枚の領収書を受け取った後には時間の節約という効果が得られます。
| 受信フィールド | OCR 認識のヒント | エクスポート列 |
|---|---|---|
| 店名 | 通常は一番上にあります。最大のフォント | ベンダー |
| 日付 | 上部付近の日付パターンを探します | 日付 |
| 品目 | 左揃えのテキストブロック | 説明、数量、単価 |
| 小計 | 税引き前;ラベルが貼られることが多い | 小計 |
| 税 | 小計の後;割合または固定 | 税 |
| 合計 | 最大額;しばしば大胆な | 合計 |
PDF OCRを試してみる
インストールは必要ありません。ブラウザで直接動作します。
