Tips & Tricks

PDF에서 그림 캡션만 번역하는 방법

과학 논문, 기술 보고서 및 그림 문서에는 각 이미지, 차트 또는 다이어그램이 표시하는 내용을 설명하는 그림 캡션이 포함되어 있습니다. 그러한 문서의 본문 텍스트가 이미 독자가 이해할 수 있는 언어로 되어 있지만 그림 캡션은 그렇지 않은 경우 캡션만 번역하면 독자가 이미 따라갈 수 있는 내용을 번역하는 불필요한 작업을 피할 수 있습니다. 문제는 캡션만 번역 엔진을 통과하도록 주변 본문 텍스트에서 캡션 텍스트를 분리하는 것입니다.

PDF의 캡션은 일반적으로 본문 텍스트와 약간 다른 글꼴 크기나 스타일로 설정됩니다. 이미지 아래나 옆에 위치하며, 종종 그림이나 표로 시작하고 뒤에 숫자가 표시됩니다. 이러한 시각적 및 위치적 단서는 독자가 캡션을 한눈에 식별하는 데 도움이 됩니다. PDF 번역 캡션만 대상으로 하는 워크플로는 수동 선택, 스타일 기반 필터링 또는 내보내기 및 추출 접근 방식을 통해 이러한 신호를 사용하여 올바른 텍스트를 선택합니다.

WukongPDF의 PDF 내보내기 및 번역 도구는 문서 전체의 언어 변환을 처리합니다. 선택적 캡션 전용 번역의 경우 다음 수동 및 반자동 워크플로는 캡션 텍스트를 주변 콘텐츠에서 분리합니다.

How to Translate Only Figure Captions in a PDF

방법 1: 캡션 수동 복사-번역-붙여넣기

관리 가능한 캡션 수가 일반적으로 20개 미만인 문서의 경우 가장 신뢰할 수 있는 방법은 수동입니다. 텍스트 선택을 지원하는 편집기에서 PDF를 엽니다. 각 캡션에 대해 텍스트를 선택하고 복사한 다음 Google 번역 또는 DeepL과 같은 번역 도구에 붙여넣고 번역된 출력을 복사한 다음 PDF의 동일한 위치에 다시 붙여넣어 원래 캡션 텍스트를 바꿉니다.

수동 방법이 정확합니다. 번역할 텍스트와 번역 위치를 정확하게 제어할 수 있습니다. 실수로 본문 텍스트를 번역하거나 자동 감지가 건너뛸 수 있는 캡션이 누락되는 위험을 방지합니다. 정확성은 시간의 대가로 이루어집니다. 각 캡션을 선택하고 번역하고 교체하는 데 약 30~60초가 소요됩니다. 15개의 캡션이 있는 문서는 대략 10~15분 정도 걸립니다. 단일 문서의 일회성 번역의 경우 수동 방법이 적합합니다. 수백 개의 캡션이 포함된 반복 번역이나 문서의 경우 아래의 자동화된 방법이 더 실용적입니다.

WukongPDF

PDF 번역을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →

방법 2: PDF 편집기에서 스타일 기반 선택

Adobe Acrobat Pro의 PDF 편집 도구에는 특정 글꼴, 크기 또는 색상과 일치하는 모든 텍스트를 선택하는 기능이 포함되어 있습니다. PDF의 캡션이 9포인트 기울임꼴과 같은 일관된 스타일을 사용하는 경우 한 번의 작업으로 모든 캡션 텍스트를 선택할 수 있습니다. Acrobat Pro에서 PDF를 열고 PDF 편집으로 이동하여 캡션 텍스트 영역을 클릭한 다음 마우스 오른쪽 버튼을 클릭하고 이 글꼴로 모두 선택을 선택합니다. Acrobat은 동일한 글꼴과 크기를 사용하는 페이지의 모든 텍스트 블록을 선택합니다. 선택한 텍스트를 복사하여 텍스트 문서에 붙여넣습니다.

붙여넣은 텍스트를 검토하세요. 실수로 캡션과 동일한 글꼴을 사용한 본문 텍스트는 실제 캡션과 함께 선택됩니다. 캡션이 아닌 텍스트를 수동으로 제거합니다. 이제 텍스트 문서에는 캡션 콘텐츠만 포함됩니다. 번역 도구에 붙여넣고 번역한 다음 번역된 각 캡션을 PDF의 원래 위치에 다시 붙여넣습니다. 스타일 기반 선택은 각 캡션을 개별적으로 선택하는 것에 비해 추출 단계의 속도를 크게 향상시킵니다.

방법 3: Word로 내보내기 및 스타일별 필터링

Acrobat Pro의 Word로 내보내기 기능이나 온라인 PDF-Word 변환기를 사용하여 PDF를 Word 형식으로 변환합니다. Microsoft Word에서 결과 DOCX를 엽니다. Word에서는 PDF의 글꼴 스타일을 유지하므로 캡션이 원본과 동일한 글꼴 및 크기로 표시됩니다. Word의 유사한 서식이 있는 모든 텍스트 선택 기능을 사용하여 문서 전체에서 모든 캡션 텍스트를 선택하십시오. 캡션 단락을 마우스 오른쪽 버튼으로 클릭하고 스타일로 이동한 다음 모두 선택으로 이동합니다. Word에서는 서식이 일치하는 모든 단락을 선택합니다.

선택한 텍스트를 새 문서의 표에 복사합니다. 각 캡션은 한 행을 차지합니다. 번역된 텍스트에 대한 두 번째 열을 추가합니다. 번역 도구를 사용하여 각 캡션을 번역하고 번역 내용을 인접한 열에 붙여넣습니다. 모든 캡션이 번역된 후 PDF의 각 캡션을 해당 번역으로 바꾸려면 2열 표를 참조로 사용하세요. Word 기반 접근 방식은 번역 진행 상황이 테이블에 표시되므로 PDF 기반 방법보다 추적하기 쉬운 구조화된 작업 흐름을 제공합니다.

방법작동 방식에 가장 적합
선택적 복사-붙여넣기PDF에서 캡션 텍스트만 복사, 번역, 다시 붙여넣기5~10개의 캡션이 포함된 짧은 문서
PDF 편집기 스타일로 찾기-바꾸기캡션 글꼴과 일치하는 모든 텍스트를 선택하고 번역기에 복사하세요.스타일 캡션이 있는 문서
캡션을 텍스트 파일로 내보내기PDF를 Word로 내보내고 서식을 지정하여 캡션을 분리합니다.캡션이 많은 문서, 반복되는 작업 흐름

여러 줄에 걸쳐 있는 캡션 처리

PDF의 여러 줄 캡션은 한 줄에 하나씩 별도의 텍스트 블록으로 분할될 수 있습니다. 캡션을 선택하고 복사하면 하나의 연속된 단락이 아닌 세 개의 별도 텍스트 선택이 표시됩니다. 세 개를 모두 공백으로 결합하여 번역 도구에 단일 블록으로 붙여넣습니다. 번역은 한 문단으로 하겠습니다. 번역물을 PDF에 다시 붙여넣을 때 레이아웃을 유지하기 위해 원본과 동일한 수의 텍스트 블록으로 분할하세요.

문서 워크플로우의 경우 기술 용어, 약어 또는 측정 단위가 포함된 캡션의 경우 도구가 지원하는 경우 번역 도구에서 번역 안 함으로 플래그를 지정하거나 자리 표시자 토큰으로 대체하고 번역을 실행하고 원본을 복원하여 해당 용어가 번역되지 않도록 보호합니다. 그림 3: 50kx 배율의 TiO2 나노입자 SEM 이미지를 읽는 캡션은 TiO2 및 50kx를 기록된 대로 정확하게 보존해야 합니다.

그림 캡션만 번역하면 본문 텍스트는 원래 언어로 유지되고 시각적 콘텐츠는 대상 언어 독자가 이해할 수 있게 됩니다. 선택적 접근 방식은 전체 문서 번역에 비해 시간을 절약하고 부분 번역된 기술 콘텐츠의 가장 일반적인 독자인 이중 언어 독자가 효율적으로 탐색할 수 있는 문서를 생성합니다.

여러 PDF의 캡션 일괄 번역

외국어로 된 캡션이 포함된 문서 라이브러리를 관리하는 연구원 또는 기술 작가의 경우 여러 PDF에 대한 일괄 번역은 확장된 동일한 작업 흐름을 따릅니다. 일괄 변환기를 사용하여 모든 PDF를 Word 형식으로 내보냅니다. 서식 필터와 함께 Word의 찾기 및 바꾸기를 사용하여 특정 글꼴 및 크기와 일치하는 모든 텍스트를 찾으십시오. 그러면 내보낸 모든 문서에서 캡션이 캡처됩니다. 발견된 모든 텍스트를 단일 번역 배치로 복사합니다.

DeepL 또는 Google 번역을 통해 한 번의 작업으로 전체 배치를 번역하세요. 두 서비스 모두 큰 텍스트 블록을 허용하고 개별 캡션 경계에 해당하는 단락 구분을 유지합니다. 번역 후 번역된 텍스트를 단락 구분별로 개별 캡션으로 다시 분할하고 각 캡션을 해당 PDF에 붙여넣습니다. 일괄 접근 방식은 캡션당 번역 오버헤드를 30초에서 약 5초로 줄여 수백 개의 캡션이 있는 문서 컬렉션에 실용적입니다.

번역된 캡션 교체 시 레이아웃 보존

번역된 캡션은 원본보다 길거나 짧은 경우가 많습니다. 독일어 번역은 영어보다 20~30% 더 깁니다. 중국어 번역은 종종 더 짧습니다. 텍스트 상자 크기를 변경하지 않고 길이 변화를 흡수하려면 번역된 캡션의 글꼴 크기를 0.5포인트 조정합니다. 작은 글꼴 조정은 번역 길이 차이를 수용하면서 레이아웃을 유지합니다.

문서 작업 흐름 전체에서 길이가 크게 변경된 경우 번역된 캡션을 여러 줄에 수동으로 분할합니다. 매치 라인은 원래 캡션의 시각적 너비와 거의 비슷합니다. 목표는 번역된 캡션이 원본과 거의 동일한 시각적 공간을 차지하면서 캡션과 캡션이 설명하는 그림 간의 관계를 유지하는 것입니다.

그림 캡션을 선택적으로 번역하는 것은 독자의 기존 언어 능력을 존중하는 정밀한 작업입니다. 번역이 필요한 부분만 번역하면 시간이 절약되고 이중 언어 사용자가 편안하게 탐색할 수 있는 문서가 생성됩니다. 수동, 스타일 기반 및 내보내기 기반 방법은 5개의 캡션이 있는 단일 문서에서 수백 개의 캡션이 있는 문서 라이브러리로 확장됩니다.

캡션의 선택적 번역은 본문 텍스트를 따라갈 수 있지만 선호하는 언어로 캡션이 필요한 이중 언어 독자가 사용할 수 있는 문서를 생성하는 정밀 작업입니다. 워크플로우는 5개의 캡션이 있는 단일 문서에서 수백 개의 캡션이 있는 라이브러리까지 확장되며 수동, 스타일 기반 및 내보내기 방법은 각각 서로 다른 규모를 제공합니다.

선택적 캡션 번역은 독자의 기존 언어 능력을 존중하는 동시에 시각적 콘텐츠에 접근할 수 있도록 합니다. 전체 문서가 아닌 번역이 필요한 부분만 번역하는 정밀도는 시간을 절약하고 이중 언어 사용자가 편안하게 탐색할 수 있는 결과를 낳습니다. 수동, 스타일 기반 및 내보내기 기반 방법은 단일 문서에서 전체 라이브러리로 확장됩니다.

WukongPDF

PDF 번역을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →