Tips & Tricks

携帯電話のカメラを使用して PDF 写真またはスクリーンショット内のテキストを翻訳する方法

あなたは旅行中に、読めない言語で書かれた標識、メニュー、文書、またはラベルに遭遇しました。携帯電話を取り出し、カメラを開き、テキストに向けます。画面上では、外国の文字がリアルタイムであなたの言語に変換され、あたかも標識自体が母国語で書かれているかのようにカメラのビューに重ねられます。これはSFではありません。それは今あなたの携帯電話に組み込まれています。これは携帯電話に組み込まれているカメラベースの翻訳で、PDF でも機能します。

携帯電話のカメラを使用して PDF からテキストを翻訳すると、画像内のテキストを認識する OCR と、それをターゲット言語に変換する機械翻訳が組み合わされます。このプロセスは 2 つのモードで機能します。印刷ドキュメントのライブカメラ翻訳と、PDF スクリーンショットと写真の静的画像翻訳です。どちらも、携帯電話にすでに搭載されている無料ツールを通じて利用できます。

How to Translate Text Inside a PDF Photo or Screenshot Using Your Phone Camera

方法 1: 印刷された PDF および物理ドキュメントのライブ カメラ翻訳

Google 翻訳のカメラ モードは iPhone と Android の両方で動作します。 Google 翻訳アプリを開きます。ソース言語を選択するか、ドキュメントの言語がわからない場合は言語を検出するように設定します。ターゲット言語を選択します。カメラアイコンをタップします。携帯電話のカメラを印刷されたドキュメント、または別の画面で開いている PDF に向けます。アプリは、翻訳されたテキストをリアルタイムでカメラビューに直接オーバーレイします。元のテキストが翻訳によって置き換えられ、同じ位置と視点に揃えられて表示されます。この拡張現実ビューを使用すると、自分の言語で印刷されているかのようにドキュメントを読むことができます。

ライブ翻訳は高速に実行され、テキスト 1 画面あたりの処理時間は約 1 秒ですが、完璧ではありません。翻訳は Google の機械翻訳エンジンによって実行されます。このエンジンは一般的な言語ペアを適切に処理しますが、慣用的な表現、専門用語、トレーニング データが限られている言語については扱いにくい、または不正確な翻訳を生成します。理解のためにライブ翻訳を使用し、文書の内容を理解します。他の人と共有するために洗練された翻訳を作成するためにこれに依存しないでください。そのためには、レビューおよび編集できる静的な翻訳が必要です。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →

方法 2: 携帯電話の写真アプリを使用して PDF スクリーンショットまたは写真を翻訳する

携帯電話で PDF を開いていて、特定のセクションを翻訳したい場合は、スクリーンショットを撮ります。 iPhone では、サイドボタンと音量を同時に押します。 Android では、電源ボタンと音量ダウン ボタンを押します。スクリーンショットは写真ライブラリに保存されます。 Google フォトまたは Apple フォトで写真を開き、組み込みの Translate PDF テキスト認識を使用してテキストを抽出して翻訳します。

Google フォトでスクリーンショットを開き、Google レンズ アイコンをタップします。 Lens はテキストを検出し、翻訳オプションを提供します。ターゲット言語を選択すると、翻訳されたテキストが画像に重ねて表示されます。個々の単語をタップして元のテキストを表示したり、翻訳されたテキストをコピーして別の場所に貼り付けることができます。 iPhone の Apple Photos では、Live Text 機能がテキストを検出し、テキストを選択すると翻訳オプションを提供します。翻訳がポップアップ オーバーレイに表示されます。どちらの方法も、最近のデバイスではテキスト認識のためにオフラインで機能しますが、翻訳ステップではインターネット接続が必要です。

方法 3: ブラウザベースのツールを使用した完全なドキュメント翻訳

スクリーンショットだけでなく PDF ドキュメント全体を翻訳する場合、ブラウザベースの翻訳ツールがファイル全体を処理します。携帯電話のブラウザを開き、翻訳ツールに移動して、PDF をアップロードします。このツールは、PDF がスキャンされた場合に OCR を実行し、テキストを抽出して翻訳し、翻訳された PDF を生成します。出力では元のレイアウトが保持され、翻訳されたテキストが元のテキストと同じ位置に配置されます。これは、全文を読んだり、他の人と共有したり、翻訳してアーカイブしたりする必要がある文書に対するアプローチです。

ブラウザベースのアプローチは、複数ページのドキュメントを効率的に処理します。一度アップロードし、処理を待って、完全な翻訳済みファイルをダウンロードします。 WukongPDF は同じ基盤テクノロジーを使用しているため、翻訳品質は主要な機械翻訳エンジンと同じです。スクリーンショットベースの翻訳よりも優れているのは完全性です。すべてのページのすべての単語が翻訳され、出力は携帯電話のスクリーンショットのコレクションではなく、適切な PDF になります。

電話翻訳でうまくできることとできないことを理解する

電話ベースのPDF 読み取り 翻訳は、一般的なフォントで読みやすいサイズで印刷されたテキストに最適に機能します。手書き、高度に様式化されたフォント、曲面または反射面に印刷されたテキスト、ラベルの細かい文字のような非常に小さいサイズのテキストには問題があります。また、二か国語の契約書や、ある言語で料理名と別の言語で説明が記載されたメニューなど、同じページに複数の言語が混在する文書にも問題があります。翻訳エンジンは各セグメントがどの言語で書かれているかを推測する必要がありますが、推測が間違っていることが多く、混乱を招く結果が生じます。

技術文書、法律文書、または医療文書の翻訳には特に注意が必要です。機械翻訳は、人間の翻訳者のように文脈を理解することはできません。ソース言語で複数の意味を持つ単語が、ターゲット言語では間違った意味に翻訳される場合があります。特定の法的定義を持つ法律用語は、同じ法的重みを持たない口語的な同等の用語に翻訳される場合があります。正確な意味が重要な文書の場合は、最初の理解のために電話翻訳を使用し、文書が意思決定に依存する場合は、両方の言語を読める人間に翻訳をレビューしてもらいます。

電話翻訳の保存と共有

PDF スクリーンショットまたは写真を翻訳した後、結果を保存したいことがよくあります。 Google レンズを使用すると、翻訳されたテキストをコピーして、メモ、メール、または文書に貼り付けることができます。 Apple の Live Text も同様に、認識され翻訳されたテキストをコピーできます。より永続的な記録を得るために、文書全体の翻訳では、保存、共有、アーカイブできる PDF が生成されます。翻訳された PDF は、どのデバイスでも開いて、他のドキュメントと同様に読むことができます。

携帯電話のカメラは、密かに消費者が利用できる最も有能な翻訳ツールの 1 つになりました。高解像度カメラとオンデバイス OCR、クラウドベースの機械翻訳を組み合わせており、ポケットに収まります。旅行者、国際的なビジネスマン、外国語ソースを扱う研究者、そして読めないテキストに遭遇した人にとって、携帯電話で PDF をかざして母国語で表示できる機能は、10 年前には存在しなかった真のスーパーパワーです。 WukongPDF では、その機能がスナップショットから完全なドキュメントまで拡張され、電話ベースの翻訳があらゆる PDF コンテンツに役立ちます。

非ラテン文字を使用する言語、中国語、日本語、韓国語、アラビア語、ロシア語で PDF を翻訳する必要があるユーザーにとって、携帯電話のカメラによるアプローチにはさらなる利点があります。従来のテキスト抽出ベースの翻訳は、OCR エンジンが数十の文字ではなく数千の一意の文字を認識する必要があるため、これらのスクリプトでは失敗することがよくあります。カメラベースの翻訳は、文字レベルの認識をバイパスし、視覚パターン レベルで機能し、個々の文字を認識するのではなく、文字全体の形状を翻訳モデルと照合します。この視覚的なアプローチは、中国語と日本語で特に効果的です。この場合、Google 翻訳のカメラ モードは、テキストベースの OCR 翻訳パイプラインを完全に打ち破る、読みやすい文書の翻訳を生成できます。視覚的なパスは、技術的な意味では正確ではありませんが、失敗の仕方が異なり、特定の言語と文書の組み合わせでは、テキストベースの翻訳が完全に失敗する場合でも成功します。

WukongPDF

PDFを翻訳してみる

インストールは必要ありません。ブラウザで直接動作します。

始める →