Tips & Tricks

スキャンした紙フォームを入力可能なデジタル PDF に変換する方法

紙のフォームは企業や政府機関のいたるところにあります。医療摂取シート、求職申込書、登録フォーム、アンケート調査票、納税申告書などはすべて紙の文書として始まり、誰かが手書きで記入する必要があります。これらのスキャンされた紙のフォームを記入可能な記入可能な PDF デジタル バージョンに変換すると、手動でのデータ入力が不要になり、転記エラーが減り、自動データ収集による電子提出が可能になります。変換プロセスには、紙のフォームを適切な解像度でスキャンし、スキャンした画像の上に透明な入力可能なフィールドを配置し、正しい種類の入力を受け入れるようにそれらのフィールドを構成することが含まれます。

その結果、ハイブリッドドキュメントが作成されます。スキャンされた紙のフォームは、フォームのタイトル、質問テキスト、ロゴ、説明テキスト、装飾要素などの視覚的な背景を提供します。透明な入力可能なフィールドが回答領域に重なって表示され、回答者が紙のバージョンに手書きで書き込んだ位置に正確に配置されたインタラクティブな長方形として表示されます。デジタル回答者は書き込みの代わりに入力し、フォーム データはスプレッドシートやデータベースにエクスポートできる構造化フォーマットで電子的に取得されます。

WukongPDF の Image to PDF およびフォーム構築ツールは、ブラウザで直接機能するフィールド配置と構成オプションを備え、スキャンした紙文書から入力可能なデジタル フォームを作成します。

How to Convert Scanned Paper Forms Into Fillable Digital PDFs

ステップ 1: 紙フォームを正しくスキャンする

スキャンの品質は、結果として得られる入力可能なデジタル フォームの使いやすさに直接影響します。画面上で入力するフォームを 300 DPI でスキャンします。この解像度では、不必要に大きなファイルを生成することなく、標準ズーム レベルで読むのに十分な鮮明なテキストがキャプチャされます。法的開示事項などのセクションに非常に小さなテキストが含まれるフォーム、細かい活字で印刷された用語、または密集した指示が含まれるフォームの場合は、可読性を向上させるためにスキャン解像度を 400 DPI に上げます。

純粋な白黒ではなくグレースケールでスキャンします。グレースケールでは、フォームのセクションを相互に区別するのに役立つ微妙な陰影と背景の色合いが保持されます。必須フィールドを示す薄い陰影の領域、表セクションの 1 行おきの陰影、および灰色の説明テキストはすべて、グレースケール キャプチャの恩恵を受けます。白黒スキャンではファイルは小さくなりますが、ユーザーがナビゲーションに利用する視覚的な手がかりは失われます。カラー スキャンでは、元のフォームが必須フィールドの赤色の強調表示などの機能的な目的で色を使用していない限り、機能的な価値は追加されずにファイル サイズが大幅に増加します。

スキャナーが結合 PDF ではなく、TIFF や JPEG などの個別の画像ファイルを生成する場合は、Acrobat Pro のファイル結合機能、無料のオンライン画像から PDF へのコンバーター、または Windows および macOS に組み込まれた画像から PDF へのツールを使用して、スキャンしたページを 1 つの PDF 文書に結合します。フィールド配置に進む前に、ページが正しい順序であること、スキャン中にページがスキップされたり複製されたりしていないこと、およびすべてのページが正しい向きであることを確認してください。

WukongPDF

画像をPDFに変換してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

ステップ 2: フィールド配置用にスキャンした PDF を準備する

スキャンした PDF を Acrobat Pro で開き、すべてのページの向きが正しいかどうかを検査します。紙がスキャナに物理的にどのように供給されたかに応じて、スキャンされたページは 90 度または 180 度回転される場合があります。ページ整理ツールを使用して、方向が間違っているページを個別にまたはバッチで回転します。フォームフィールドはページの方向に合わせて配置されるため、この段階で回転を修正すると、後で再配置が必要になるフィールドの位置ずれを防ぐことができます。

スキャンしたページに、スキャナー ベッドの端から用紙の周囲に余分な黒い境界線がある場合は、トリミング ツールを使用してそれらの境界線を切り取ります。ページの端をきれいにすると、入力可能なフォームがよりプロフェッショナルに見え、視覚的な邪魔がなくなります。スキャン処理中に紙がわずかにずれたため、スキャンしたテキストが不均一または歪んで見える場合は、「スキャンされた文書の補正」ツールを使用して各ページの傾きを補正してまっすぐにし、視覚的な品質と OCR の精度の両方を向上させます。

スキャンした PDF で OCR を実行し、スキャンした画像の背後に非表示のテキスト レイヤーを追加します。このテキスト レイヤーはフォーム フィールドの配置には直接使用されませんが、スキャンされたコンテンツが検索可能になり、フィールドの配置場所を特定するのに役立つテキスト ラベルをフォーム準備ツールで検出できるようになります。 OCR ステップでは、スクリーン リーダーが使用できるテキスト レイヤーも作成され、最終的な入力可能なフォームのアクセシビリティが向上します。

ステップ 3: スキャンされた画像上に入力可能なフォーム フィールドを追加する

スキャンした PDF を準備して OCR 処理したら、[ツール]、[フォームの準備] に移動します。 Acrobat は各ページをスキャンし、空白行、チェックボックスの四角形、署名ブロックなどの視覚的なパターンに基づいてフォームフィールドの位置を検出しようとします。スキャンされたフォームには、デジタルフォームに含まれる内部構造タグが欠落しているため、Acrobat の自動検出が不完全であるか、フィールド全体が欠落している可能性があります。 [フォームの準備] ツールバーの手動フィールド配置ツールを使用して、検出されなかったフィールドを追加します。

各フィールドを、スキャンしたフォーム上の対応する回答領域上に正確に配置します。フィールドの境界をドラッグして、フォーム上の印刷された行、ボックス、または空白スペースに合わせます。予想される入力に基づいて、適切なフィールド タイプを選択します。名前、住所、日付、および回答が予測できない自由形式の回答には、テキスト フィールドを使用します。 「はい」または「いいえ」で答える質問や、各選択肢が独立している多肢選択式の質問には、チェック ボックスを使用します。回答が 1 つだけ許可される多肢選択式の質問には、ラジオ ボタンを使用します。 5 つを超えるオプションが存在する事前定義された選択肢のリストには、ドロップダウンを使用します。

各フィールドに、Field1 や Text2 のような一般的なラベルではなく、回答する質問に基づいて一意でわかりやすい名前を割り当てます。 PatientFirstName、EmploymentStartDate、InsuranceProviderName などの名前を使用すると、手動で列の名前を変更しなくても、エクスポートされたフォーム データをスプレッドシートやデータベースですぐに使用できるようになります。フィールド名は、フォームの回答が収集およびエクスポートされるときに列ヘッダーになります。

スキャンされた背景のフィールドの外観の調整

スキャンされた背景に配置されたフォーム フィールドには、きれいな白いデジタル ページ上のフィールドとは異なる視覚設定が必要です。スキャンされたフォームのテキストとその下の線がフィールドを通して完全に見えるように、フィールドの塗りつぶしの色を透明または白に設定します。フォーム ユーザーが使用するターゲット PDF リーダーで透明度がサポートされていない場合は、塗りつぶしを白に設定し、その下にあるスキャンされたコンテンツが判読できるかどうかをテストします。

テキスト フィールドのフォント サイズは、元の紙フォームが収容できるように設計された手書きテキストのサイズと一致するように設定します。通常、本文テキストの場合は 10 ~ 12 ポイント、セクション ヘッダーの場合は入力可能な場合はそれより少し大きくなります。すべての PDF リーダーおよびオペレーティング システムで一貫してレンダリングされる、Arial や Helvetica などのクリーンで普遍的に利用可能なフォントを選択してください。ユーザーのシステムで利用できない装飾的なフォントや珍しいフォントは避けてください。

すべてのフィールドに説明的なツールチップを追加します。ツールヒントのテキストは、ユーザーがフィールド上にカーソルを移動するとホバー ポップアップとして表示され、スクリーン リーダーによって読み上げられます。スキャンしたフォーム上の「名前」という視覚的にラベル付けされたフィールドには、「政府発行の身分証明書に記載されている正式な正式名を入力してください」などのツールチップが表示されます。ツールチップは、特に予期される形式やコンテンツがフォーム ラベルだけでは明らかではないフィールドに対して、静的にスキャンされた背景では伝えられないガイダンスとコンテキストを提供します。

完成した入力可能なスキャンされたフォームのテスト

フォームをユーザーに配布する前に、テスト回答者と同じように自分でフォームを完成させてください。すべてのテキスト フィールドにテキストを入力し、内容がフィールド境界内に収まり、隣接するフォーム要素やその下のスキャンされたテキストにはみ出さないことを確認します。すべてのチェックボックスをオンにして、正しく切り替わることを確認します。すべてのラジオ ボタンを選択し、各グループで一度に 1 つのオプションのみを選択できることを確認します。すべてのドロップダウンを開いて、意図したオプションがすべて存在し、正しく順序付けされていることを確認します。

フォーム内のすべてのフィールドを Tab キーで移動して、タブの順序がフォームの論理的な読み取り順序 (上から下、左から右、セクションごと) に従っていることを確認します。 Tab キーを押すと予期しない位置にジャンプしたり、フィールドがスキップされたりする場合は、Acrobat Pro でフィールドパネルを開き、フィールド名を正しい順序にドラッグします。論理的なタブ シーケンスは、効率的なキーボード ベースのデータ入力とアクセシビリティへの準拠に不可欠です。

テストおよび検証されたフォームをテンプレート ファイルとして保存します。テンプレートには、入力可能なすべてのフィールドが正しい位置に含まれており、設定されたプロパティとツールチップも含まれています。フォームを配布する必要がある場合は、テンプレートのコピーを受信者に送信します。元のテンプレートを、すべての配布コピーの派生元となるマスターとして変更せずに保持します。フォームを更新する必要がある場合は、テンプレートを変更し、新しいコピーを配布します。

スキャンした紙フォームを記入可能な 記入可能な PDF デジタル バージョンに変換すると、既存の紙フォーム ライブラリの耐用年数が延びると同時に、電子データ キャプチャによる効率のメリットが加わります。スキャンされた背景には、フォーム ユーザーが紙のバージョンから認識する使い慣れた視覚レイアウトが保存されます。デジタル フィールドにより、フォーム プロセッサが必要とする高速で正確なデータ収集が可能になります。紙フォームのバックカタログを大量に保有している組織は、フォームの量に基づいて変換の優先順位を付け、最もトラフィックの多いフォームから順に変換を行うことで、変換投資の収益を最大化できます。

最初の変換後、フォーム ユーザーと送信されたフォームを処理するスタッフの両方から構造化されたフィードバックを収集します。ユーザーは、入力するのが難しいフィールド、不明瞭なツールチップ、および予期せずジャンプするタブ オーダーを報告します。プロセッサは、一貫性のない形式で到着したデータやフィールドが頻繁に空白のままであることを報告します。このフィードバックを使用して、フィールド サイズ、タイプ、ツールチップ テキスト、タブの順序を調整しながら、デジタル バージョンが紙のオリジナルと同じくらいスムーズかつ確実に動作し、さらに構造化された電子データの利点が得られるまで、繰り返しフォームを改良します。

WukongPDF

画像をPDFに変換してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →