Tips & Tricks

PDF を Word に変換するときに言語設定を保持する方法

PDF を Word に変換する場合、通常は視覚的なレイアウトを維持することに重点が置かれますが、ドキュメントの言語設定は、アクセシビリティ、スペル チェック、スクリーン リーダーの互換性にとっても同様に重要です。 PDF から Word への変換中に言語メタデータが失われると、結果の文書ではすべての単語にスペル エラーのフラグが立てられ、スクリーン リーダーの使用時にテキストが間違った音声で読み上げられ、言語固有のハイフネーションと文法の規則が適用されない可能性があります。 WebAIM による 2025 年の調査では、PDF から Word への変換の 18% で、出力から言語メタデータが取り除かれ、支援技術に依存するユーザーが文書にアクセスしにくくなっていることが判明しました (WebAIM、「変換された文書のスクリーン リーダー アクセシビリティ」、2025 年)。

重要なポイント

PDF の言語設定は、ドキュメントの構造ツリーと個々のテキスト オブジェクトのプロパティに保存されます。ほとんどのエクスポート ツールは、テキストの視覚的なレイアウトを保持しますが、変換設定で文書構造を明示的に保持しない限り、言語メタデータを破棄します。作成された Word ファイルの言語設定は、スペル チェック辞書、シソーラス検索、ハイフネーション ルール、およびスクリーン リーダーに通知されるデフォルト言語を制御します。変換後に失われた言語設定を修正するには、ドキュメントごとにわずか数秒しかかかりません。

How to Preserve Language Settings When Converting PDF to Word

PDF 内の言語設定の場所

OCR 処理されたスキャンされた文書から作成された PDF には、元の文書から継承されたのではなく、OCR エンジンによって追加された言語メタデータが含まれる場合があります。 OCR エンジンのデフォルトが英語で、スキャンされたドキュメントがフランス語だった場合、変換が開始される前に PDF 内の言語メタデータが間違ったものになります。変換する前に PDF のドキュメント プロパティの言語フィールドを確認し、OCR エンジンが正しく設定していない場合は PDF メタデータ エディタを使用して修正します。

PDF には言語情報が 2 つの場所に保存されます。ドキュメントレベルの言語はドキュメントカタログで設定され、オーバーライドされない限りすべてのテキストに適用されます。個々のテキスト オブジェクトは、Lang 属性を使用して独自の言語プロパティを保持できます。これにより、テキストの特定の範囲の言語が指定されます。英語の本文とフランス語の引用を含む製品マニュアルなどの多言語 PDF では、文書レベルで英語を使用し、引用部分にフランス語の言語属性を含めることができます。この 2 レベルのシステムは、PDF/UA アクセシビリティ標準に従って、スクリーン リーダーが言語を正しく切り替えられるようにします。

PDF コンバータ は PDF からテキストを抽出するときに、文字コードを読み取り、Unicode 値にマップします。言語メタデータはテキストとともに移動しますが、表示される文字の一部ではありません。文字ストリームのみを読み取り、メタデータを無視するコンバーターは、言語情報のない Word 文書を生成するため、Word はデフォルトのインストール言語になりますが、元の文書の言語と一致する場合と一致しない場合があります。

WukongPDF

PDF を Word に変換してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

出力 Word 文書の言語の確認と設定

言語の教科書や言語学の論文など、同じ段落に複数の言語が含まれる文書の場合、Word の単語ごとの言語マーキングは段落レベルの設定よりも正確です。文書の言語を設定した後、個々の外国語の単語またはフレーズを選択し、[レビュー] タブで言語を設定します。これにより、Word のスペル チェッカーに、それらの単語をスキップするか、正しい辞書と照合してチェックするように指示されます。また、スクリーン リーダーに特定の単語の発音を切り替えるように指示するため、支援技術のユーザーのリスニング エクスペリエンスが大幅に向上します。

変換後、Word 文書を開き、Ctrl+A を押してすべてのテキストを選択します。 Word ウィンドウの下部にあるステータス バーを見てください。現在の言語が単語数の横に表示されます。間違った言語が表示される場合、または「言語: (複数)」が表示される場合は、または空白の場合、言語メタデータは変換中に保存されませんでした。言語を設定するには、[校閲] タブに移動し、[言語]、[校正言語の設定] の順にクリックし、リストから正しい言語を選択します。 [言語を自動的に検出する] チェックボックスをオンにします。文書に複数の言語が含まれている場合はチェックを外し、文書全体が 1 つの言語で書かれている場合はチェックを外したままにします。

異なるパッセージに異なる言語設定が必要な多言語ドキュメントの場合、プロセスはより複雑になります。各パッセージを個別に選択し、同じ [レビュー] タブ メニューから言語を設定します。言語設定は、選択したテキストにのみ適用されます。この手動プロセスは、言語切り替えがいくつかある短いドキュメントに機能します。長い多言語ドキュメントの場合は、後で手動で修正するのではなく、最初の変換中に言語メタデータを保存することを検討してください。

言語メタデータを保存する変換ツール

PDF 内のアクセシビリティ タグ構造 (存在する場合) には、各テキスト要素の言語属性が含まれます。 PDF/UA 準拠に必要なアクセシビリティ用に PDF に適切なタグが付けられている場合、言語メタデータは Word にきれいに変換される、構造化された機械可読形式で保存されます。ワークフローで許可されている場合は、後で Word に変換されるドキュメントのアクセシビリティ タグ付き PDF を要求または作成します。タグ付けへの先行投資は、より高速かつ正確な変換という形で報われます。

Adobe Acrobat に組み込まれている PDF から Word へのエクスポート機能は、「フロー テキストを保持」がオンになっている場合でもドキュメントの言語設定を保持します。オプションが選択され、「コメントと画像を含める」が選択されています。にチェックが入っています。 Microsoft Word 自体は、[ファイル]、[開く] を使用して PDF を直接開くと、PDF 言語メタデータを Word の言語設定にマップしようとします。マッピングの品質は、PDF が標準 ISO 言語コードを使用しているかどうかによって異なります。 「en-US」を指定する PDFまたは「fr-FR」標準の言語コードを使用すると、きれいに変換されます。標準以外の言語コードまたは欠落している言語コードを使用する PDF では、言語設定のない Word 文書が生成されます。

オンラインの PDF から Word へのコンバーターは、言語メタデータのサポートが異なります。 PDF/UA 準拠をターゲットとするツールなど、アクセシビリティを考慮して設計されたツールは、汎用コンバータよりも言語設定を保持する可能性が高くなります。 WukongPDF の PDF から Word への変換ツールは、ドキュメント レベルの言語メタデータを保存し、対応する Word 校正言語にマッピングするため、追加の言語設定を行わなくても、出力ドキュメントのスペル チェックやスクリーン リーダーでの使用が可能になります。

言語の保存がスペル チェックを超えて重要である理由

言語設定は、単純なスペル チェックを超えた文章の提案を提供する Word のエディター機能のパフォーマンスにも影響します。エディターは言語固有のモデルを使用して、明瞭さの問題、包括的な言語の問題、およびスタイルの問題を検出します。ドキュメントの言語が正しく設定されていない場合、エディターは間違った言語モデルを適用し、ユーザーの時間を無駄にする偽の提案を生成します。エディタを実行する前に言語を正しく設定すると、このイライラを回避できます。

Word 文書の言語設定は、スペルミスのある単語の下にある赤い波線以外にも影響します。これらにより、Shift+F7 キーを押したときに Word でどのシソーラスが使用されるか、文法チェック中にどの文法規則が適用されるか、改行時の自動ハイフネーションのためにどのハイフネーション辞書が参照されるか、文書を読み上げるときにスクリーン リーダーがどの音声と発音の規則を使用するかが決まります。視覚障害のあるユーザーにとって、間違った言語の音声や間違った発音ルールで文書が読み上げられるのを聞くと、内容を理解することがはるかに困難になります。

規制された業界では、言語設定もコンプライアンスにとって重要です。二か国語を使用する地域の政府機関、医療提供者、教育機関は、多くの場合、特定の言語で文書を作成する必要があります。言語メタデータを失った変換された PDF には、技術的には正しいテキストが含まれている可能性がありますが、ドキュメントのプロパティで必要な言語が宣言されていないため、自動化されたコンプライアンス チェックに失敗します。変換後の言語の確認と設定は、大きなコンプライアンス問題の発生を防ぐ小さなステップです。

よくある質問

編集のために Word に変換するだけで、後で PDF にエクスポートする場合、PDF の言語設定は重要ですか?はい、中間 Word 文書の言語設定は、スペル チェック、文法チェック、および最終的な PDF に書き込まれる言語メタデータに影響を与えるためです。 Word で言語の設定をスキップすると、最終的な PDF には言語メタデータが含まれないため、アクセシビリティが低下し、自動化されたコンプライアンス チェックに失敗する可能性があります。

結果を改善するために、変換前に元の PDF に言語メタデータを設定できますか?

はい。 PDF 作成プロセスを制御する場合は、ドキュメント言語が PDF プロパティで設定されていること、および別の言語のテキストに正しい Lang 属性が設定されていることを確認してください。 「アクセシビリティのための文書構造タグ」を使用して Word から作成された PDFエクスポート中にオプションを有効にすると、このメタデータが自動的に組み込まれます。アクセシビリティタグ付き PDF から変換すると、タグなし PDF から変換するよりも言語の保持が大幅に向上します。

変換中に右から左へ記述する言語設定はどうなりますか?

アラビア語やヘブライ語などの右から左に記述する言語では、言語コードと段落の方向設定の両方が必要です。標準の PDF から Word へのコンバーターでは、多くの場合、言語コードは保持されますが、方向設定が削除されるため、変換されたテキストは左から右に表示されます。変換後、影響を受けるテキストを選択し、Word の段落設定ダイアログを使用して段落の方向を右から左に設定します。

DOCX ではなく DOC などの古い Word 形式に変換すると、言語の保存に影響しますか?

はい。 DOCX は、PDF メタデータからより確実にマッピングされる構造化 XML 形式で言語設定を保存します。古い DOC バイナリ形式では、テキストごとの言語属性のサポートが制限されています。言語メタデータを最適に保存するには、常に DOCX に変換してください。

PDF を変換する前に、どの言語が設定されているかを確認するにはどうすればよいですか? PDF を開き、通常は [ファイル]、[プロパティ] の下にあるドキュメントのプロパティを表示するか、Ctrl+D を押します。 [詳細設定] タブまたは [説明] タブには、[言語] フィールドが含まれています。このフィールドが空白の場合、PDF にはドキュメントレベルの言語設定がないため、変換後に Word で言語を手動で設定する必要があります。

WukongPDF

PDF を Word に変換してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →