Tips & Tricks

PDF ドキュメントを別の言語に翻訳する方法

How to Translate a PDF Document to Another Language

翻訳ツールにテキストをコピーする代わりに PDF を翻訳する理由

PDF からテキストをコピーしてオンライン翻訳ツールに貼り付けるのは本能的なアプローチですが、2 つの理由から悪い結果が生じます。

まず、PDF からテキストをコピーすると、多くの場合、不要な改行、段落の断片化、書式の喪失が発生し、翻訳されたテキストを一貫した文書に再組み立てすることが困難になります。次に、貼り付けられたテキストを処理する翻訳ツールは単語を翻訳しますが、文書の構造、見出し、リスト、表、ページ レイアウトは失われます。

自動翻訳によって作成される強力な初稿は、人間の査読者が精度と自然な表現を求めて改良することができます。

翻訳された PDF では元のページ構造が保持されるため、言語バージョン間でコンテンツを簡単に参照できます。

文書全体を処理するTranslate PDF ツールは、テキスト コンテンツを翻訳しながら文書構造を保持します。見出しは見出しのままです。リストはリストのままです。段落は段落のままです。翻訳されたドキュメントは、言語が異なるだけで、元のドキュメントと似ています。この構造の保存は、フォーム、マニュアル、証明書、法的文書など、レイアウトが意味に寄与する文書には不可欠です。

PDF 翻訳に対する PDF Converter のアプローチは、翻訳が単なる単語に関するものではないことを認識しています。それは、ターゲット言語で使用可能な文書を作成することです。翻訳されたフォームは入力可能な状態にしておく必要があります。翻訳されたマニュアルは引き続き参照できるようにする必要があります。翻訳された証明書は表示可能なままでなければなりません。 PDF 翻訳とテキスト翻訳の違いは、文書の機能的プロパティをそのテキスト コンテンツとともに保持することです。

翻訳されたドキュメントの PDF Export は、オリジナルと同じ用途に使用できる状態になっている必要があります。翻訳されたパンフレットは印刷できる状態になっている必要があります。翻訳された契約書に署名できる状態になっている必要があります。翻訳されたレポートは配布できる状態になっている必要があります。翻訳プロセスでは、翻訳されたドキュメントを使用可能にするために追加の作業が発生してはなりません。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

PDF ドキュメントを段階的に翻訳する方法

言語ペアをサポートする PDF 翻訳ツールを選択してください。

Google 翻訳や DeepL などの主要な翻訳プラットフォームは、ドキュメント全体を処理して翻訳された PDF 出力を生成する直接 PDF 翻訳をサポートするようになりました。 Web インターフェイスまたはモバイル アプリを通じて PDF を翻訳ツールにアップロードします。

ソース言語を選択するか、ツールに自動検出させてターゲット言語を選択します。ほとんどのツールは、数十の言語ペアをサポートしています。 Google 翻訳は 100 以上の言語をサポートしています。 DeepL は、小規模ではありますが拡張中の言語セットをサポートしており、特にヨーロッパの言語ペアでは、より自然な響きの翻訳で定評があります。

翻訳ツールは PDF の各ページを処理し、テキストを抽出して翻訳し、翻訳されたテキストをページ レイアウトに戻します。処理時間は文書の長さと翻訳サービスの負荷によって異なります。通常、10 ページの文書は 1 分以内に翻訳されます。 100 ページの文書には数分かかる場合があります。

翻訳が完了したら、翻訳された PDF をダウンロードして、すぐに確認してください。翻訳されたドキュメントの最初と最後のページを元のページと比較して、翻訳が正常に完了し、ページ レイアウトが損なわれていないことを確認します。ヘッダー、フッター、ページ番号、画像キャプションなどの特別な要素に特に注意してください。これらの要素は、翻訳エンジンが翻訳可能なテキストとして認識しない可能性があるため、正しく翻訳されない場合があります。

WukongPDF の Translate PDF ツールは、ドキュメントを直接処理し、テキスト コンテンツの翻訳中に元の書式を保持します。 PDF をアップロードし、ターゲット言語を選択し、元のレイアウトをそのままに翻訳されたドキュメントをダウンロードします。

自動 PDF 翻訳の品質に期待できること

自動化された PDF 翻訳は、直接的で事実に基づいたテキストに対して良好な結果をもたらします。ビジネス通信、技術文書、ニュース記事、情報コンテンツは、言語が直接的で文構造が従来型であるため、適切に翻訳されます。文学的なテキスト、マーケティングコピー、法律用語、および文化的参照や言葉遊びを含むコンテンツは、自動翻訳では捉えられないニュアンスに依存するため、翻訳の精度が低くなります。

法的契約書、医療記録、出版品質のコンテンツなど、翻訳の正確さが重要な文書の場合は、自動翻訳を初稿として扱う必要があります。理想的には両方の言語に堪能な人間の翻訳者と一緒に、翻訳を注意深く確認してください。自動翻訳は、人間のレビュー担当者が正確さと自然な表現を追求できる強力な出発点となります。

複数列のテキスト、画像上のテキスト、密集した表など、複雑なレイアウトを持つ PDF は、自動翻訳にさらなる課題をもたらします。翻訳エンジンは、翻訳する前にテキストの読み順を正確に識別する必要があり、複雑なレイアウトでは読み順の検出が混乱する可能性があります。翻訳されたドキュメントのこれらのセクションを特に注意深く確認すると、レイアウトに起因する翻訳エラーが見つかります。

PDF 自動翻訳の品質は急速に向上し続けています。膨大な多言語データセットでトレーニングされたニューラル機械翻訳モデルは、ますます自然で文脈に適した翻訳を生成します。今日翻訳されたドキュメントは、2 年前に同じサービスを通じて翻訳された同じドキュメントよりも明らかに優れています。

言語または非ラテン文字が混在する PDF の処理

一部の PDF には、同じ文書内に複数の言語のテキストが含まれています。製品マニュアルには、英語、フランス語、スペイン語で交互のページに説明が記載されている場合があります。学術論文では、英語訳とともに原語の一節を引用する場合があります。ほとんどの翻訳ツールは、文書全体を単一の言語として処理します。混合言語の PDF の場合は、各言語のページまたはセクションを抽出し、正しいソース言語設定を使用して個別に翻訳します。

アラビア語、ヘブライ語、ペルシア語などの右から左へ記述するスクリプトを含む PDF には、双方向テキスト処理をサポートする翻訳ツールが必要です。翻訳されたテキストは、右から左へのページ レイアウト内に正しく配置される必要があります。すべての PDF 翻訳ツールが右から左へのテキストの配置を正しくサポートしているわけではありません。翻訳されたテキストが正しい方向に流れ、テキストの配置がターゲット言語の規則に従っていることを確認します。

ネイティブ テキストではなくテキストのスキャン画像を含む PDF の場合、翻訳前に OCR を実行する必要があります。 OCR ステップでは、スキャンされた画像内のテキストを認識し、編集可能なテキスト レイヤーを作成します。次に、翻訳ツールが認識されたテキストを翻訳します。最終的な翻訳の精度は、OCR ステップの精度によって決まります。クリーンで高解像度のスキャンにより、より優れた OCR 結果が生成され、より優れた翻訳が可能になります。

一部の翻訳ツールは、複数の PDF のバッチ処理をサポートしています。同じターゲット言語に翻訳する必要があるドキュメントのコレクションがある場合、バッチ処理では、各ドキュメントを個別に処理するのではなく、それらすべてを 1 回の操作で翻訳します。このバッチ機能は、外国語の文書を定期的に受け取り、内部レビューのために翻訳する必要がある組織にとって特に価値があります。

翻訳中の文書コンテンツのプライバシーは重要な考慮事項です。 PDF をオンライン翻訳サービスにアップロードすると、ドキュメントのコンテンツがサービス サーバーに送信され、処理されます。機密文書または機密文書の場合は、翻訳サービスのプライバシー ポリシーを確認して、文書データがどのように扱われるかを理解してください。一部のサービスでは、品質向上のためにアップロードされたドキュメントを保持します。翻訳後すぐに削除する人もいます。

法的または公的目的で認証翻訳が必要な文書の場合、自動翻訳は認証要件を満たしません。認定翻訳は、翻訳の正確さを証明する資格のある人間の翻訳者によって作成またはレビューされる必要があります。自動翻訳は作業草案を提供し、認定翻訳者がそれをレビューして認定します。

複雑な書式設定、表、画像を含むドキュメントの場合、翻訳された PDF でテキストの位置を手動で調整する必要がある場合があります。翻訳されたテキストは、多くの場合、元のテキストとは長さが異なります。ドイツ語のテキストは通常、英語より 20 ~ 30% 長くなります。通常、中国語のテキストは短いです。これらの長さの違いにより、固定レイアウト PDF でテキストのオーバーフローや過剰な空白が発生する可能性があります。翻訳されたドキュメントでレイアウトの問題がないか確認してください。

翻訳ツールの選択では、必要な言語ペアを考慮する必要があります。一部のツールはヨーロッパ言語のペアに優れています。他の言語では、アジア言語の方が良い結果が得られます。 DeepL は、ヨーロッパ言語の最も自然な翻訳を生成すると広く認められています。 Google 翻訳は最も幅広い言語をサポートしています。重要な文書の場合は、複数の翻訳ツールを試して結果を比較してください。

同じ言語ペアと文書タイプで繰り返し翻訳が必要な場合は、プロセスを合理化する翻訳ワークフローを作成します。翻訳ツール、設定、および通常必要となる翻訳後の調整を文書化します。この文書化されたワークフローにより、一貫した結果が保証され、各翻訳に必要な時間が短縮されます。

翻訳された PDF は、ターゲット言語を読む人、理想的には文書の主題に精通している人によってレビューされる必要があります。自動翻訳では、翻訳エンジンが原文内の専門用語や曖昧な語句を誤解したために、文法的には正しい文が生成されても、間違った意味を伝える可能性があります。流暢な話者による短いレビューでは、これらの意味の間違いがわかります。

PDF マニュアルまたはガイドを翻訳する場合は、翻訳された指示が引き続き実行可能であることを確認してください。翻訳者が技術的な背景を理解していないと、元の言語では明確に読めるステップでも、翻訳では曖昧になったり混乱したりする可能性があります。翻訳されたドキュメントを使用して、翻訳された手順を自分で確認してください。手順を正しく完了できない場合は、翻訳を修正する必要があります。

学術または研究用の PDF の場合は、参照および引用の目的で、元の文書を翻訳とともに保存してください。学術論文で翻訳文書を引用する場合は、原文と翻訳文の両方を引用してください。オリジナルは信頼できるテキストを提供します。翻訳は、原文を読まない読者にもアクセスを提供します。

翻訳された PDF では、元の文書のページ数とレイアウト構造が保持されます。英語の 20 ページのレポートは、同じ見出し、同じ段落区切り、同じ画像の配置を備えた 20 ページのスペイン語のレポートになります。この構造的忠実度は、スペイン語圏の読者と英語圏の読者が、同じページ番号の同じ内容を参照しながら、文書についてページごとに議論できることを意味します。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →