온라인 번역 도구를 통해 PDF를 제공하고 결과를 다운로드합니다. 이제 텍스트가 대상 언어로 되어 있지만 문서가 잘못된 것 같습니다. 제목이 바뀌었습니다. 글머리 기호가 잘못 정렬되었습니다. 이미지가 원래 위치에서 이동되었습니다. 가장 나쁜 것은 문서의 모든 하이퍼링크가 작동하지 않는다는 것입니다. 번역 도구는 표시되는 링크 텍스트를 대체했지만 기본 URL은 제거했습니다. 문서가 번역되었으나 손상되었습니다.
서식과 대화형 요소를 유지하면서 PDF를 번역하려면 페이지 구조에서 텍스트 레이어를 분리하는 번역 접근 방식이 필요합니다. 문제는 PDF 텍스트와 PDF 레이아웃이 밀접하게 결합되어 있다는 것입니다. 번역된 문장의 길이를 변경하면(영어에서 독일어, 프랑스어 또는 스페인어로 번역할 때 20%~30%까지 늘어날 수 있음) 주변 텍스트와 요소가 제자리에서 벗어나게 됩니다. 그 결과 텍스트가 원래 경계를 벗어나거나 인접한 내용과 겹치게 됩니다.

PDF 번역이 종종 서식을 깨뜨리는 이유
대부분의 PDF 번역 도구는 각 페이지에서 텍스트를 추출하여 기계 번역 엔진으로 보낸 다음 번역된 텍스트를 원래 페이지 레이아웃에 다시 배치하는 방식으로 작동합니다. 핵심 문제는 텍스트 리플로우입니다. 독일어로 번역된 영어 텍스트의 문자 수는 평균 20~30% 늘어납니다. 영어용으로 디자인된 텍스트 상자에 깔끔하게 들어맞는 동일한 문장이 이제 상자를 넘칩니다. 번역 도구가 텍스트 상자 크기나 글꼴 크기를 조정하지 않으면 번역된 텍스트가 잘리거나 인접한 요소와 겹치거나 페이지 레이아웃이 깨집니다.
PDF 링크는 표시되는 텍스트와 별도로 페이지에 중첩된 클릭 가능한 직사각형 영역으로 저장되므로 하이퍼링크가 손실됩니다. 번역 도구가 텍스트를 교체했지만 새 텍스트 위치 및 길이와 일치하도록 링크 주석을 업데이트하지 않으면 링크가 잘못된 위치를 가리키거나 완전히 제거됩니다. 눈에 보이는 밑줄 그어진 파란색 텍스트는 그대로 유지되지만 그 뒤에 있는 클릭 가능한 영역은 사라졌습니다.
PDF 번역을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
레이어 기반 접근 방식: OCR, 텍스트 번역, 원본 오버레이
번역 중에 서식을 유지하는 가장 안정적인 방법은 원본 페이지 이미지를 그대로 유지하고 번역된 텍스트 레이어를 맨 위에 추가하는 것입니다. 이 접근 방식은 원본 PDF를 시각적 배경으로 처리하고 원본 텍스트 위에 있는 투명한 텍스트 상자에 번역된 텍스트를 배치합니다. 원본 형식, 이미지 및 링크는 제거되지 않았으므로 그대로 유지됩니다. 텍스트만 번역되고 위치가 변경됩니다.
이 접근 방식은 시각적 레이아웃이 주요 관심사이고 번역된 텍스트가 추가 편집용이 아닌 읽기용인 정적 문서에 적합합니다. 번역된 텍스트는 배경에 영향을 주지 않고 사용 가능한 공간에 맞게 글꼴 크기와 상자 크기를 조정할 수 있습니다. WukongPDF는 필요한 경우 OCR을 수행하고, 텍스트를 추출하고, 텍스트 블록 간의 공간적 관계를 유지하면서 번역하고, 원본 페이지 이미지 위에 새 레이어에 번역을 배치함으로써 이러한 레이어 기반 접근 방식을 지원합니다.
번역 중 하이퍼링크 보존
하이퍼링크는 텍스트와 별도로 주석으로 저장되기 때문에 번역 중에 가장 취약한 요소입니다. 링크를 보존하려면 번역 도구는 각 링크 주석을 읽고, 대상 URL을 기록하고, 연결된 텍스트를 기록하고, 해당 텍스트를 번역하고, 링크 주석을 새 텍스트 위치에 다시 첨부해야 합니다. 링크 보존을 명시적으로 지원하지 않는 도구는 링크를 제거합니다.
브라우저 기반 번역 도구에는 번역 프로세스의 일부로 PDF 링크 보존 기능이 포함되어 있습니다. 번역하기 전에 도구는 문서에서 하이퍼링크 주석을 검색하고 각 링크의 URL, 표시되는 텍스트 및 위치를 기록합니다. 번역 후 링크는 해당 번역된 텍스트 블록에 다시 첨부됩니다. 웹사이트를 가리키는 외부 하이퍼링크는 원래 URL이 변경되지 않은 채로 유지됩니다. 동일한 PDF 내의 다른 페이지를 가리키는 내부 링크는 텍스트 확장으로 인한 페이지 번호 변경을 고려하여 다시 매핑됩니다. 그 결과 텍스트와 탐색 기능이 모두 그대로 유지되는 번역된 PDF가 생성됩니다.
언어 간 텍스트 확장 및 축소 처리
언어 쌍마다 확장 특성이 다릅니다. 영어에서 독일어로의 변환은 일반적으로 20%에서 30%까지 확장됩니다. 영어-프랑스어는 15%에서 25%로 확장됩니다. 영어-스페인어는 10%에서 20%로 확장됩니다. 이와 대조적으로 영어에서 중국어 또는 일본어로의 변환은 로고 그래픽 문자가 더 적은 수평 공간에 더 많은 의미를 담기 때문에 20%에서 40%까지 줄어듭니다. 이러한 차이를 고려하지 않는 번역 도구는 번역된 텍스트가 넘치거나 어색한 공백을 남기는 문서를 생성합니다.
확장이 많은 언어 쌍의 경우 실제 조정은 번역된 텍스트의 글꼴 크기를 1~2포인트 줄이거나 텍스트 상자의 가로 너비를 원래 열 너비로 제한하면서 세로로 확장하도록 허용하는 것입니다. 수직 확장은 후속 콘텐츠를 페이지 아래로 밀어냅니다. 이는 일반적으로 텍스트가 페이지 여백 너머로 사라지게 하는 수평 오버플로보다 더 좋습니다. 수축이 많은 쌍의 경우 공간을 채우기 위해 글꼴 크기를 약간 늘릴 수 있지만 이렇게 하면 번역된 텍스트와 원본 문서의 타이포그래피 간에 시각적 불일치가 발생할 위험이 있습니다.
번역된 PDF 품질 확인
기계 번역은 완벽하지 않으며 번역 오류로 인해 때로는 미묘하고 결과적인 방식으로 문장의 의미가 바뀔 수 있습니다. 번역 후에는 대상 언어를 읽는 사람이 문서를 검토하게 합니다. 검토자가 없는 경우 최소한 다른 번역 엔진을 사용하여 원본 언어로 다시 번역하고 원본과 비교하여 번역된 문장의 샘플링을 무작위로 확인합니다. 이 역번역 검사는 명백한 오류를 포착하지만 사람의 검토를 대체할 수는 없습니다.
형식을 체계적으로 확인하세요. 모든 페이지를 스크롤합니다. 텍스트가 잘리거나 겹치거나 위치에서 벗어나지 않았는지 확인하세요. 모든 하이퍼링크를 클릭하고 올바른 대상으로 이동하는지 확인하세요. 이미지, 표, 기타 텍스트가 아닌 요소가 원래 위치에 남아 있는지 확인하세요. 번역 도구가 오버레이 접근 방식을 사용하는 경우 번역된 텍스트가 원본 텍스트를 적절하게 덮고 있는지 확인합니다. 특히 원본 텍스트가 번역보다 더 큰 글꼴이나 어두운 색상인 경우 더욱 그렇습니다. 번역 뒤에서 원본 텍스트가 엿보이는 것은 전문적이지 않은 결과를 낳습니다.
정기적으로 업데이트되고 재번역될 문서의 경우 번역 메모리를 구축하세요. 번역 메모리는 이전에 번역된 세그먼트를 저장하고 새 버전에 동일하거나 유사한 텍스트가 나타날 때 이를 재사용합니다. 이를 통해 번역 비용이 절감되고 일관성이 향상되며 동일한 형식 오류가 반복되는 것을 방지할 수 있습니다. WukongPDF의 PDF 내보내기 파이프라인은 번역 메모리 데이터를 통합하여 업데이트된 문서의 재번역을 가속화할 수 있습니다.
PDF 번역을 사용해 보세요
설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.
