スペイン語で書かれた 40 ページの PDF があります。理解する必要があるのは、3 ページと 4 ページの概要と 38 ページの結論だけです。文書全体を翻訳するには数分の処理時間がかかり、決して読むことのできない 38 ページの翻訳が作成されます。実際に必要なのは、必要なセクションだけを抽出して翻訳することです。
特定の部分のみが必要な場合は、文書全体の翻訳よりも選択的な Translate PDF の方が効率的です。このアプローチは、PDF がテキストを選択してコピーできるテキストベースのドキュメントであるか、または翻訳前に OCR が必要なスキャン画像であるかによって異なります。

方法 1: テキストをコピーして外部に翻訳する
テキストベースの PDF の場合、最も簡単な方法は、必要な特定のセクションを選択してコピーし、翻訳ツールに貼り付けることです。 PDF を開いてセクションに移動し、カーソルでテキストを選択してコピーします。コピーしたテキストを Google 翻訳、DeepL、またはお好みの翻訳サービスに貼り付けます。翻訳は数秒で表示されます。翻訳されたテキストをコピーし、メモ、電子メール、または文書に貼り付けます。
この方法では、どのテキストを翻訳するかを正確に制御できます。ソーステキストを見て、それが必要なセクションであることを確認すると、そのテキストのみの翻訳が得られます。制限事項は、元の書式が失われることです。翻訳されたテキストは、フォント、レイアウト、画像のないプレーン テキストとして届きます。内容を理解するにはこれで十分です。書式設定されたドキュメントを作成するには、PDF 構造を保持する方法が必要です。
PDFを翻訳してみる
インストールは必要ありません。ブラウザで直接動作します。
方法 2: PDF を分割し、関連するページのみを翻訳する
翻訳された出力をフォーマットされた PDF として必要な場合は、ドキュメントを分割して必要なページのみを抽出し、そのサブセットを翻訳します。分割ツールを使用してページ 3、4、および 38 を抽出します。抽出したページを翻訳ツールにアップロードします。このツールはそれらのページのみを翻訳し、翻訳されたテキストを元のレイアウトで含む PDF を出力します。このアプローチは、処理されるコンテンツが少なく、フォーマットされた出力が生成されるため、文書全体の翻訳よりも高速です。
スキャンされた PDF の場合は、翻訳する前に抽出されたページで OCR を実行します。 WukongPDF の OCR ツールはテキストを認識し、翻訳ツールは OCR 出力を処理します。ワークフローは、分割してページを選択し、OCR でテキストを認識し、ターゲット言語に翻訳し、翻訳されたページをダウンロードするというものです。各ステップでは必要なコンテンツのみが処理されるため、合計処理時間は実際に翻訳するテキストの量に比例します。
方法 3: 部分翻訳をサポートするツールを使用する
一部の翻訳ツールでは、単一ドキュメント内の翻訳のページ範囲を指定できます。完全な PDF をアップロードし、指定したページにのみ翻訳が適用されるように設定します。 WukongPDF の翻訳ツールはページ範囲パラメータを受け入れます。翻訳したいページを入力すると、ツールはそれらのページのみを処理します。未翻訳のページは元の言語のままです。 The output is a single PDF where some pages are translated and some are not, which is exactly what you want for a document where you only need to understand specific sections.
このページ範囲のアプローチは、言語が混在するニーズに最も便利です。多国籍チームでは、エグゼクティブサマリーは 3 か国語で、財務表は 1 か国語で、付録はまったく翻訳されていない必要がある場合があります。 1 つのドキュメント、複数の翻訳ターゲットが選択的に適用されます。分割、OCR、および選択的翻訳を組み合わせたPDF Editor ワークフローは、これらの複雑なシナリオを効率的に処理します。
レイアウトを崩さずにテーブルとデータを変換する
表は、翻訳されたテキストが拡大または縮小して列の配置が崩れることが多いため、選択的翻訳にとって最も困難なコンテンツ タイプです。 5 単語の英語ヘッダーが 8 単語のスペイン語ヘッダーになり、列の幅が隣のヘッダーよりも広くなる場合があります。表を含む特定のセクションのみを翻訳する場合は、翻訳後に表の形式を確認してください。列がずれている場合は、翻訳された出力で列の幅を手動で調整します。
表の多いセクションのための実用的なテクニック: 翻訳する前に表からテキストを抽出し、各セルを個別に翻訳し、ターゲット言語で表を手動で再構築します。これは自動翻訳よりも手間がかかりますが、正しくフォーマットされた表が生成されます。財務諸表、法的表、および表の構造に意味がある文書の場合、手動によるアプローチにより、翻訳された文書がオリジナルと同じように使用できることが保証されます。
選択的な翻訳精度の検証
特定のセクションを翻訳した後、結果を元のセクションと比較して検証します。両方の言語を理解できる場合は、原文と並行して翻訳されたテキストを読んでください。ソース言語を読まない場合は、2 番目の翻訳ツールを使用して出力を元の言語に逆翻訳し、比較します。この逆翻訳チェックにより、段落の脱落、重要な用語の誤訳、意味が変わった文などの明らかなエラーが明らかになります。このチェックは人間が翻訳全体をレビューするよりも速く、最も重大なエラーを検出します。
翻訳がビジネス、法律、または医療目的で使用される文書の場合は、両方の言語を読める人に翻訳されたセクションをレビューしてもらいます。機械翻訳は共通言語のペアを適切に処理しますが、専門用語、イディオム、および文脈依存の意味を誤解する可能性があります。翻訳されたエグゼクティブサマリーを人間が 5 分間レビューすることで、誤解や誤った決定につながる可能性のあるエラーを発見します。選択的に翻訳された文書の PDF エクスポート には、どのセクションが機械翻訳されたか、また人間によるレビューを受けたかどうかを示す注記を含める必要があります。そうすることで、読者は翻訳の信頼性を理解できます。
選択的翻訳が特に価値のある特定のシナリオは、国際契約レビューです。法務チームはドイツ語で書かれた 60 ページの契約書を受け取ります。ドイツ語を話さない関係者向けに翻訳が必要なのは、支払条件、契約解除条項、および責任に関するセクションのみです。契約書の残りの部分、定型文、定義、準拠法は、オリジナルのままにすることができます。選択した翻訳では 3 つの重要なセクションを 1 分以内に翻訳できますが、文書全体を翻訳すると数分かかり、57 ページもの不要な出力が生成されます。翻訳されたセクションは、正確な法的意味を確認するために原文を参照できるバイリンガルの弁護士によってレビューされます。この対象を絞ったワークフローは、国際法律事務所や企業法務部門における標準的な慣行です。
PDF のセクションを頻繁に翻訳するユーザーの場合は、文書内に出現する重要な用語の翻訳用語集を作成します。機械翻訳は、同じドイツ語を「契約」と翻訳するため、業界用語と一致しない可能性があります。 1 ページに「同意」が記載されています。別の。 PDF と一緒にアップロードされた用語集ファイルは、翻訳エンジンに一貫した用語を使用するよう指示します。翻訳ツールはカスタム用語集ファイルを受け入れ、法律、医学、工学、財務文書の専門用語が、同じ用語が出現するたびに一貫して翻訳されるようにします。用語集は 1 回限りの投資であり、その後のすべての翻訳が改善されます。
PDFを翻訳してみる
インストールは必要ありません。ブラウザで直接動作します。
