Tips & Tricks

기존 접근성 메타데이터를 제거하지 않고 태그가 지정된 PDF의 구조적 읽기 순서를 편집하는 방법

How to Edit the Structural Reading Order of a Tagged PDF Without Stripping Existing Accessibility Metadata

PDF 태그가 읽기 순서를 제어하는 방법 및 중단되는 이유

적절하게 구조화된 PDF는 PDF 태그에 의해 관리되는 논리적 콘텐츠 트리의 위치에 콘텐츠, 제목, 단락, 이미지 및 표의 각 부분을 할당합니다. 읽기 순서는 페이지의 시각적 위치가 아니라 이 트리 내의 노드 순서에 따라 결정됩니다. PDF 편집기가 태그 트리를 업데이트하지 않고 콘텐츠를 추가, 제거 또는 재배열하면 시각적 순서와 태그 지정 순서가 달라집니다.

이러한 차이는 페이지가 각각 고유한 태그 구성표를 사용하는 다양한 소스 문서에서 병합될 때 가장 자주 발생합니다. 세 개의 태그가 지정된 PDF로 구성된 보고서에는 올바른 순서로 서로 연결되지 않은 세 개의 별도 태그 트리가 있을 수 있습니다. 화면 판독기는 첫 번째 문서의 태그 트리 끝에서 두 번째 문서의 시작 부분으로 이동하며 그 사이에 있는 콘텐츠는 시각적으로 건너뜁니다. 그 결과 화면에서는 올바르게 보이지만 보조 기술에 대해서는 연결되지 않은 일련의 조각으로 읽히는 문서가 생성됩니다.

또 다른 일반적인 원인은 초기 태그 프로세스 이후에 추가된 콘텐츠입니다. 누군가 표준 편집 도구를 사용하여 태그가 지정된 PDF에 단락이나 이미지를 삽입하는 경우 편집자는 새 개체를 페이지에 배치하지만 기존 태그 트리에는 등록하지 않습니다. 새 콘텐츠는 화면 판독기에서 보이지 않게 됩니다. 한편, 태그 트리는 여전히 편집 전 문서 상태를 반영합니다. 여러 편집 주기에 걸쳐 시각적 문서와 해당 태그 구조 사이의 간격이 넓어지고 각 후속 편집으로 인해 접근성 준수 실패 위험이 높아집니다.

태그 순서 문제의 실질적인 결과는 화면 판독기 사용자의 범위를 넘어서는 것입니다. 모바일 화면에 맞게 PDF 레이아웃을 조정하는 컨텐츠 리플로우 엔진도 순서 지정을 위해 태그 트리에 의존합니다. 시각적 순서는 정확하지만 태그 순서가 뒤섞인 문서는 전화기 화면에서 읽을 수 없는 혼란으로 리플로우되며 문단은 임의의 위치에 나타납니다. PDF 콘텐츠를 색인화하는 검색 엔진은 마찬가지로 태그 구조를 사용하여 문서 계층 구조를 이해하므로 태그 순서 문제는 공개적으로 게시된 PDF의 SEO에 영향을 미칠 수 있습니다.

WukongPDF

PDF 편집을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →

태그 재정렬과 PDF 태그 다시 지정의 차이점

기존 태그를 재정렬하는 것은 목표 수정 사항입니다. 태그 재지정은 전체 재구축입니다. 차이점을 이해하면 문서에 이미 입력된 PDF 접근성 작업을 유지할지 아니면 잃을지 결정됩니다.

측면태그 재정렬전체 태그 재지정
범위기존 태그 트리 노드 순서를 조정합니다.전체 태그 트리를 처음부터 다시 작성합니다.
기존 메타데이터보존됨; 모든 대체 텍스트, 제목 수준, 테이블 헤더가 유지됨잃어버린; 모두 수동으로 다시 입력해야 합니다.
소요시간일반적인 문서의 경우 분복잡한 다중 섹션 문서의 시간
규정 준수에 대한 위험태그 트리 패널을 사용하면 낮음높은; 하나의 누락된 요소로 인해 PDF/UA 규정 준수가 중단됩니다.
최고의 대상태그는 있지만 순서가 잘못된 문서태그가 지정되지 않은 스캔 또는 완전히 손상된 태그 구조
편집 후 검증빠른 확인; 재정렬된 섹션만 검토가 필요함전체 문서 감사가 필요합니다. 모든 태그를 확인해야 합니다.

태그 재정렬은 이미 기능적 태그 구조를 갖고 있는 문서에 선호되는 접근 방식입니다. 전체 태그 재지정은 태그 트리가 너무 손상되어 개별 노드를 재정렬하는 것이 다시 시작하는 것보다 오래 걸리는 태그가 지정되지 않은 스캔 및 문서에 대해 예약되어야 합니다. 주요 차이점은 순서를 바꾸면 이미지의 사용자 정의 대체 텍스트, 제목 수준 할당, 테이블 머리글 범위 정의 및 언어 속성 표시가 유지되는 반면, 태그를 다시 지정하면 모든 항목이 지워지고 수동으로 다시 입력해야 한다는 것입니다.

메타데이터 손실 없이 태그 재정렬을 지원하는 도구

모든 PDF 편집기가 태그 트리를 안전하게 처리하는 것은 아닙니다. 아래 표는 태그 보존 동작을 기준으로 일반적인 도구 유형을 분류합니다.

도구 유형태그 트리 액세스재주문에도 안전위험 수준
전용 접근성 검사기전체 읽기/쓰기낮은
전문 PDF 모음(Acrobat Pro)전체 읽기/쓰기예, 태그 패널 포함낮은
브라우저 기반 편집기없음아니요; 저장 시 모든 태그를 제거합니다.높은
Office 제품군 수출업체내보낼 때 새 태그를 생성합니다.해당 사항 없음; 태그를 대체합니다중간
오픈 소스 명령줄 도구부분 읽기; 제한된 쓰기가정 어구중간

브라우저 기반 PDF 편집기는 태그가 지정된 문서에 대해 가장 위험한 범주입니다. 렌더링 엔진은 태그 트리 구조를 구문 분석하지 않으므로 브라우저 기반 도구의 저장 작업은 경고 없이 전체 태그 트리를 삭제합니다. 조직에서 빠른 편집을 위해 브라우저 기반 도구를 사용하는 경우 태그가 지정된 문서는 논리적 구조를 유지하는 데스크톱 응용 프로그램을 통해서만 처리되어야 한다는 정책을 설정하십시오.

단계: 접근성을 유지하면서 태그 재정렬

태그 재정렬에 대한 체계적인 접근 방식은 보조 기술 사용자가 문서를 사용할 수 없게 만드는 메타데이터 손실을 방지합니다. 다음 단계에서는 읽기 순서가 잘못된 태그가 지정된 PDF가 있고 기존의 모든 접근성 메타데이터를 그대로 유지하면서 순서를 수정해야 한다고 가정합니다.

1단계: PDF 편집기에서 태그 탐색 패널을 열고 전체 태그 트리를 확장합니다. 변경하기 전에 현재 나무를 참조로 내보내거나 스크린샷을 찍으십시오. 재정렬이 잘못될 경우 변경 사항을 취소하려면 원래 상태를 알아야 하기 때문에 이 백업은 필수적입니다. 참조 사본 없이 작업하는 것은 되돌릴 수 없는 태그 손상의 가장 일반적인 원인입니다.

2단계: 순서가 잘못된 노드를 정확히 식별합니다. 태그는 페이지 수준에서 순서가 잘못되어 전체 페이지가 잘못된 위치에 표시되거나 콘텐츠 수준에서 페이지 내의 개별 단락과 이미지가 잘못된 순서로 표시될 수 있습니다. 단일 페이지 내에서 콘텐츠 수준의 잘못된 순서는 페이지 수준의 잘못된 순서보다 더 일반적이고 수정하기 쉽습니다. 이는 종종 문서 조립 프로세스의 더 깊은 구조적 문제를 나타냅니다.

3단계: 위치를 벗어난 태그를 트리 내의 올바른 순서로 끌어서 놓습니다. 대부분의 전문 도구는 태그 패널에서 직접 재배열을 지원합니다. 이동할 때마다 빠른 접근성 검사를 실행하여 변경 사항이 적용되었고 새로운 문제가 발생하지 않았는지 확인하세요. 전체 문서를 한 번에 재배열하지 말고 한 번에 한 섹션씩 완료하세요. 이 점진적인 접근 방식은 실수의 범위를 단일 섹션으로 제한합니다.

4단계: 모든 섹션을 재정렬한 후 전체 접근성 유효성 검사 단계를 실행합니다. 검사기는 편집 전 상태와 비교하여 새로운 오류가 전혀 보고되지 않아야 합니다. 대체 텍스트가 누락되거나 테이블 헤더 연결이 끊어지는 등 새로운 오류가 나타나면 가장 최근 재정렬 단계를 실행 취소하고 영향을 받은 태그를 수동으로 검사한 후 다시 시도하세요. 새로운 오류를 발생시키는 검증 패스는 태그가 필수 상위 컨테이너 외부로 이동되었음을 나타냅니다.

5단계: 자동화된 유효성 검사 외에도 실제 화면 판독기를 사용하여 재정렬된 문서를 테스트합니다. 자동화된 도구는 구조적 정확성을 검증합니다. 라이브 스크린 리더 테스트를 통해서만 읽기 순서가 사람의 청취자에게 자연스럽게 들리는 것을 확인할 수 있습니다. 전체 문서를 일반 속도로 재생하고 내레이션이 예기치 않게 내용을 건너뛰거나 반복하거나 건너뛰는 섹션을 기록해 둡니다.

메타데이터를 손상시키는 일반적인 태그 재정렬 실수

태그 재정렬 중 몇 가지 실수로 인해 오류 메시지가 표시되지 않고 접근성 메타데이터가 자동으로 제거될 수 있습니다. 이러한 함정을 인식하면 감지되지 않은 규정 준수 실패가 발생할 위험이 줄어듭니다.

상위 컨테이너 노드 외부로 콘텐츠 요소를 드래그하면 계층 관계가 끊어집니다. 단락 태그는 상위 섹션이나 기사 태그 안에 남아 있어야 합니다. 실수로 루트 수준으로 드래그하면 문서 구조가 평면화되고 화면 판독기에서 섹션별로 탐색하는 기능이 손실됩니다. 순서를 바꾼 후에는 모든 콘텐츠 태그가 올바른 상위 항목 내에 중첩되어 있는지 항상 확인하세요.

전체 표 행을 이동하는 대신 표 셀을 개별적으로 재배열하는 것은 또 다른 빈번한 실수입니다. PDF 테이블 태그는 엄격한 계층 구조를 사용합니다. 테이블에는 TableRow가 포함되고 TableDataCell이 포함됩니다. 이 구조에서 단일 셀을 이동하면 화면 판독기의 테이블 연결이 끊어집니다. 테이블 내용을 재정렬할 때 항상 전체 행 또는 전체 테이블 구조를 하나의 단위로 이동하십시오.

재정렬 중에 아티팩트 태그를 무시하면 접근성 검사 시 잘못된 통과가 발생합니다. 아티팩트 태그는 화면 판독기에서 숨겨야 하는 장식 콘텐츠, 실행 헤더 및 페이지 번호를 표시합니다. 순서를 바꾸면 아티팩트가 콘텐츠 태그로 승격되는 경우 화면 판독기가 단락 중간에 있는 페이지 번호와 장식 요소를 큰 소리로 읽어 청취 환경을 크게 저하시킵니다.

태그 재정렬 후 읽기 순서 확인

재주문 후 확인은 자동 방법과 수동 방법을 모두 사용해야 합니다. 자동 검사기는 구조적 타당성을 확인하지만 읽기 순서가 자연스러운지 여부를 평가할 수는 없습니다. PDF 뷰어에 내장된 소리내어 읽기 기능을 사용하거나 테스트 모드에서 전용 화면 판독기를 사용하여 전체 문서를 처음부터 끝까지 들어보세요.

가능하다면 두 개의 서로 다른 화면 판독기 응용 프로그램을 사용하여 테스트하십시오. Windows의 JAWS 및 NVDA 또는 Mac의 VoiceOver는 모호한 태그 구조를 처리하는 방법에 약간의 차이가 있지만 태그 트리를 구문 분석합니다. 한 화면 판독기에서는 문서가 올바르게 읽히더라도 다른 화면 판독기에서는 여전히 주문 문제가 표시될 수 있습니다. 크로스리더 테스트는 문서가 최종 사용자에게 도달하기 전에 극단적인 사례를 파악하는 가장 좋은 방법입니다.

태그가 지정된 PDF를 정기적으로 작업하는 대규모 조직의 경우 WukongPDF의 편집 도구는 접근성 구조를 건드리지 않고도 콘텐츠를 수정하고 페이지 순서를 변경할 수 있는 태그 보존 작업 흐름을 지원합니다. 이 접근 방식은 새 문서의 수동 재정렬 단계를 완전히 방지하여 문서 수명 주기 동안 메타데이터 손실 위험을 줄이고 편집된 모든 파일이 생성부터 최종 배포까지 접근성 표준을 준수하도록 보장합니다. 처음부터 태그 보존 편집을 채택한 팀은 사후에 편집된 문서에 태그를 수정하는 팀보다 접근성 수정에 훨씬 적은 시간을 소비합니다.

WukongPDF

PDF 편집을 사용해 보세요

설치가 필요하지 않습니다. 브라우저에서 직접 작동합니다.

시작하기 →