Others

PDFを翻訳するときに元のテキストレイヤーを保持できますか

PDF を翻訳すると、通常、元のテキストが翻訳されたバージョンに置き換えられます。ソース言語のテキストが出力から消えます。一部のユースケースでは、元のテキストを翻訳と一緒に非表示レイヤーとして保存することが重要です。バイリンガルの読者は、翻訳をオリジナルと照合して検証できます。将来の翻訳者は、元の文書を見つけなくても、原文が何であったかを確認できます。また、検索エンジンは両方の言語のインデックスを作成できるため、どちらの言語でもドキュメントを検索できるようになります。問題は、Translate PDF ツールが翻訳中に元のテキスト レイヤーを保存できるかどうか、またどのような条件下でそれが可能であるかということです。

重要なポイント

ほとんどの PDF 翻訳ツールは、元のテキストを翻訳されたバージョンに置き換えます。元のテキストを非表示レイヤーとして保存するには、バイリンガルまたは並列出力をサポートするツールが必要です。このツールでは、元のテキストは翻訳されたテキストの下に非表示のレイヤーとして保存されます。この機能は一部のプロフェッショナルな翻訳ツールで利用できますが、一般向けの PDF 翻訳ツールでは標準ではありません。別の方法としては、PDF のコピーを翻訳し、オリジナルを別の参照ドキュメントとして保存することです。

Can You Keep the Original Text Layer When Translating a PDF

翻訳中の PDF テキスト レイヤーの仕組み

テキスト抽出ステップは、最も複雑な部分です。翻訳ツールは、表示されているテキストを抽出するだけでなく、その正確な位置、フォント プロパティ、各文字のエンコーディングも記録する必要があります。翻訳されたテキストを元に戻すとき、ツールは新しいテキストを正しく配置するために元のテキストの位置データを必要とします。元のテキストを非表示レイヤーとして保存するツールは、2 つの完全なテキスト データ セットを保存し、それらのレイヤーを管理する必要があります。これにより、テキスト処理のワークロードがおよそ 2 倍になるため、多くのツールがこの機能を提供していないのです。技術的能力は PDF 仕様に存在します。制限は形式ではなくツールの実装にあります。

PDF は、テキストを文字コードとしてコンテンツ ストリームに保存します。翻訳ツールは PDF を処理するときに、これらの文字コードを抽出し、読み取り可能なテキストにマッピングして、テキストを翻訳エンジンに送信し、翻訳されたテキストを文書に戻します。標準のワークフローでは、元の文字コードが翻訳された文字コードに置き換えられます。元のテキストがファイルから消えています。元に戻すことはできません。元のテキストを保存するには、翻訳ツールでソース言語を含む 2 番目のテキスト レイヤーを作成し、それを非表示または非印刷としてマークし、翻訳されたテキストを表示レイヤーに配置する必要があります。これは技術的には可能ですが、プロセス全体を通じて翻訳ツールがデュアル テキスト レイヤーを管理する必要があります。

PDF 仕様では、一般に PDF Layers と呼ばれるオプションのコンテンツ グループがサポートされており、個別に表示または非表示にすることができます。翻訳ツールは、元のテキストを 1 つのレイヤーに配置し、翻訳されたテキストを別のレイヤーに配置し、元のレイヤーをデフォルトで非表示に設定できます。オリジナルのテキストを見たい読者は、PDF ビューアでレイヤーの表示を切り替えることができます。このアプローチでは、両方の言語を 1 つのファイルに保存し、どの言語を表示するかを読者が制御できるようにします。技術的能力は PDF 形式で存在します。問題は、特定の翻訳ツールがそれを実装しているかどうかです。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

原文保存をサポートする翻訳ツール

ローカリゼーションエージェンシーが使用する専門的な翻訳プラットフォームは、多くの場合、バイリンガル PDF 出力をサポートしています。これらのツールは、レビュー担当者が翻訳を原文と比較する必要があるワークフロー向けに設計されています。出力 PDF には両方の言語レイヤーが含まれており、レビュー担当者はそれらを切り替えたり、専用のレビュー インターフェイスで並べて表示したりできます。これらのツールは通常、サブスクリプションベースであり、不定期の文書翻訳ではなく、大量の商用翻訳作業向けに設計されています。

消費者および中小企業ユーザーの場合、選択肢はさらに限られています。一部のオンライン PDF 翻訳サービスでは、元のテキストと翻訳されたテキストが交互の段落または 2 列のレイアウトで表示される並列出力形式を提供しています。これにより、どちらかの言語がレイヤーとして非表示になるのではなく、両方の言語が表示された状態で保存されます。ドキュメントは長くなりますが、レイヤーを切り替えることなく両方の言語にアクセスできます。 WukongPDF の翻訳ツールは、元の段落と翻訳された段落を並べて配置する並列出力モードをサポートしており、両方の言語を 1 つの読み取り可能な文書内に保持します。

代替案: 元の PDF を参照として保存

複数の改訂サイクルにわたってドキュメントのバイリンガル バージョンを維持する必要があるチームの場合、単一ファイル アプローチよりもドキュメント管理アプローチの方が効果的です。オリジナルの PDF と翻訳された PDF を、それらをリンクする命名規則を使用してバージョン管理されたリポジトリに保存します。元の文書が更新されると、命名規則により、一致させるためにどの翻訳を更新する必要があるかが明確になります。このワークフローは、時間の経過とともに変更されるドキュメントに対して、単一のバイリンガル PDF よりも信頼性が高くなります。

翻訳ツールが二言語出力をサポートしていない場合、最も簡単なワークフローは、PDF のコピーを翻訳し、オリジナルを別の参照ファイルとして保持することです。ファイル間の関係が明確になるように、ファイルには一貫した名前を付けます。英語翻訳の report-2025-en.pdf、フランス語の原文の report-2025-fr-original.pdf のような命名規則により、フォルダーを閲覧する誰にとってもその関係が明確になります。両方のファイルを同じ場所に保存し、翻訳されたドキュメントのメタデータまたは表紙のメモで元のファイル名を参照します。

アーカイブ目的の場合、多くの場合、オリジナルと翻訳のペアが最も信頼性の高いアプローチとなります。各ファイルは標準の PDF であり、誰でも開くことができます。レイヤーの表示設定や特殊な表示ツールには依存しません。この 2 つのファイルには、原文と翻訳の両方が、数十年にわたってアクセス可能な形式で文書化されています。このアプローチは、単一のバイリンガル PDF ほど洗練されていないかもしれませんが、長期的にはより信頼性が高くなります。

元のテキストレイヤーが損なわれていないことの確認

バイリンガル PDF でテキスト抽出テストを実行します。文書からすべてのテキストを抽出し、元の言語から特徴的な単語またはフレーズを検索します。抽出されたテキストにそれが表示される場合、元のレイヤーは存在し、正しくエンコードされています。抽出されたテキストに翻訳された言語のみが含まれている場合は、元のレイヤーが欠落しているか、抽出可能なテキストとしてエンコードされていません。このテストは、レイヤー パネルの目視検査では見逃されるエンコードの失敗を検出します。

翻訳ツールが元のテキストを非表示レイヤーとして保存すると主張している場合は、それに依存する前にそれを確認してください。翻訳された PDF を、Adobe Acrobat Pro などのレイヤー表示の切り替えをサポートするビューアで開きます。ナビゲーション ウィンドウでレイヤー パネルを探します。ツールが元のテキスト レイヤーを正しく作成した場合は、表示/非表示を切り替える名前付きレイヤーとして表示されます。レイヤーのオンとオフを切り替えて、元のテキストが期待どおりに表示または非表示になることを確認します。原文に登場するが翻訳で変更されたことがわかっている単語のテキスト検索を実行します。検索で元の単語が見つかった場合、レイヤーは存在し、検索可能です。

また、バイリンガル PDF のファイル サイズを、標準の翻訳版のサイズと比較して確認してください。デュアル テキスト レイヤーを含む PDF は、テキストの量に応じて、単一言語バージョンよりも約 10 ~ 30% 大きくなります。標準翻訳と同じサイズのバイリンガル PDF には、ツールのドキュメントの内容に関係なく、元のテキスト レイヤーが含まれていない可能性があります。ファイル サイズの違いは、迅速かつ確実にチェックできます。

よくある質問

オリジナルのテキストレイヤーを非表示にすると、ファイルサイズが大幅に増加しますか?この増加はテキストの量に比例し、テキストの多いドキュメントの場合は通常 15 ~ 30% になります。テキストがファイル サイズ全体に占める割合が小さい、画像の多いドキュメントの場合、増加は無視できます。デュアルレイヤーのアプローチでは、テキスト データとレイヤー管理メタデータの 2 番目のコピーが追加されますが、画像、フォント、ページ構造は複製されません。アーカイブ用途の場合、ファイル サイズが適度に増加することは、バイリンガル アクセシビリティとの合理的なトレードオフです。

元のテキスト レイヤーを保持すると PDF の検索可能性に影響しますか?

はい、積極的に。両方の言語レイヤーが存在するため、PDF は両方の言語で検索できます。元の言語で用語を検索するユーザーは非表示レイヤーで検索し、翻訳言語で検索するユーザーは表示レイヤーで検索します。この二重の検索可能性は、元のテキストを保存することの主な利点の 1 つです。

バイリンガル PDF から元のテキストを抽出してソース文書を復元できますか?

元のテキスト レイヤが存在し、正しくエンコードされている場合は、それを抽出するとソース テキストが高い忠実度で復元されます。抽出品質は、翻訳ツールが元のテキストをどのように保存したかによって異なります。これを完全で破損していないテキスト ストリームとして保存するツールは、抽出可能な出力を生成します。断片化されたテキスト オブジェクトとして保存するツールでは、手動でのクリーンアップが必要な壊れた文を含む抽出可能な出力が生成される場合があります。

バイリンガル PDF は 2 つの別々のファイルを保持するよりも大きくなりますか?

通常はいいえ。両方の言語レイヤーを含むバイリンガル PDF は、画像、フォント、ページ構造がレイヤー間で共有されるため、通常、2 つの個別の単一言語 PDF を合わせたサイズよりも小さくなります。テキスト レイヤーは少量のデータのみを追加します。ストレージに制約のある環境では、2 つの個別のファイルを管理するよりも、バイリンガル PDF の方が効率的です。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →