Oznaczony plik PDF zawiera ukryte metadane dotyczące dostępności, których czytniki ekranu używają do opisywania obrazów, tabel i struktury dokumentów użytkownikom niedowidzącym. Widoczny tekst na stronie może być w języku angielskim, natomiast opisy w tekście alternatywnym, podsumowania tabel i etykiety strukturalne muszą być dostępne w wielu językach dla międzynarodowej publiczności. Tłumaczenie tylko tej ukrytej warstwy bez dotykania widocznej zawartości dokumentu wymaga bezpośredniej pracy ze strukturą znaczników pliku PDF, a jest to funkcja, której brakuje większości narzędzi do tłumaczenia ogólnego przeznaczenia.
Standard PDF/UA (uniwersalna dostępność, ISO 14289) wymaga, aby oznaczone pliki PDF zapewniały tekst alternatywny dla wszystkich elementów treści nietekstowych. W organizacji wielojęzycznej umowa napisana w języku francuskim może wymagać udostępnienia tekstu alternatywnego w języku angielskim, niemieckim i holenderskim, aby recenzenci dostępności w każdym kraju mogli sprawdzić zgodność. Tłumaczenie całego dokumentu byłoby niepotrzebne i kosztowne. Tylko kilkaset słów tekstu alternatywnego i etykiet strukturalnych wymaga uwagi. To zadanie należy do wąskiej kategorii, która mieści się pomiędzy pełnym dokumentem Tłumacz PDF a ręczną edycją ułatwień dostępu i niewiele organizacji opracowało dla niego standardowy przepływ pracy.
Konsekwencje nieprzetłumaczonych metadanych dotyczących dostępności są bardziej znaczące, niż mogłoby się wydawać. Użytkownik czytnika ekranu uzyskujący dostęp do umowy w języku francuskim zawierającej wyłącznie angielski tekst alternatywny, usłyszy angielskie opisy przerywające treść w języku francuskim, tworząc mylące i dezorientujące doświadczenie. W przypadku agencji rządowych i organizacji finansowanych ze środków publicznych podlegających przepisom dotyczącym dostępności stanowi to lukę w zgodności, która może mieć konsekwencje prawne. Tłumaczenie warstwy dostępności nie jest rozwiązaniem przyjemnym dla organizacji wielojęzycznych. Jest to część spełnienia obowiązków w zakresie dostępności w każdym języku obsługiwanym przez organizację.

Zrozumienie struktury znaczników PDF i miejsca przechowywania tekstu alternatywnego
Oznaczony plik PDF organizuje swoją zawartość w logiczne drzewo struktury zawierające elementy takie jak Dokument, Część, Sekta, P, Tabela, Rysunek i Formuła. Każdy element może mieć atrybuty, a krytycznym dla tłumaczenia jest wpis /Alt, który przechowuje alternatywny opis tekstowy. Element Rysunek reprezentujący wykres może mieć wpis /Alt zawierający „wykres słupkowy przedstawiający kwartalny wzrost przychodów od pierwszego kwartału 2022 r. do czwartego kwartału 2024 r., przy wzroście o 12% rok do roku”. Ten tekst nigdy nie jest wyświetlany na widocznej stronie. Istnieje wyłącznie w strukturze tagów do wykorzystania przez czytnik ekranu.
Wpis /Alt to ciąg tekstowy przechowywany jako obiekt ciągu PDF lub ciąg znaków XML w zaznaczonej treści dokumentu. Wyodrębnianie, tłumaczenie i ponowne zapisywanie bez zakłócania otaczającej struktury znaczników wymaga narzędzia, które może analizować oznakowaną zawartość pliku PDF na poziomie obiektu. Większość edytorów PDF, które wyświetlają drzewo znaczników w panelu dostępności, może edytować pojedyncze wpisy /Alt, ale ręczne tłumaczenie dziesiątek lub setek z nich jest powolne i podatne na błędy, a każdy wpis wymaga osobnego cyklu otwarcia, edycji i zapisywania.
Poza wpisami /Alt istnieją inne elementy ułatwień dostępu, które można przetłumaczyć. Atrybut /Summary elementów tabeli zapewnia tekstowy przegląd struktury i przeznaczenia tabeli. Wpis /ActualText w elementach Span może zastąpić tekst wizualny dla czytników ekranu, co jest przydatne, gdy tekst wizualny jest skrótem, który należy rozwinąć. Opisy pól formularza przechowywane we wpisie /TU (podpowiedź) również wymagają tłumaczenia. Kompletne tłumaczenie dostępności obejmuje wszystkie te elementy. W przypadku 50-stronicowej umowy zawierającej 30 rycin, 15 tabel i 40 pól formularzy całkowity tekst dotyczący dostępności do przetłumaczenia może wynosić od 2000 do 3000 słów, co wystarczy tłumaczowi na spędzenie części dnia, ale znacznie mniej niż na tłumaczenie pełnego tekstu dokumentu.
Wypróbuj Tłumacz PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Wyodrębnianie tekstu ułatwień dostępu do tłumaczenia
Pierwszym krokiem jest inwentaryzacja tego, co wymaga tłumaczenia. Użyj narzędzia do sprawdzania dostępności plików PDF lub przeglądarki znaczników, aby wyeksportować listę wszystkich wpisów /Alt, /Summary, /ActualText i /TU w dokumencie. Większość narzędzi do sprawdzania dostępności, w tym wbudowany moduł sprawdzania dostępności w programie Adobe Acrobat Pro, może wygenerować raport pokazujący każdy element znacznika z tymi atrybutami i ich bieżącymi wartościami tekstowymi. Wyeksportuj tę listę do ustrukturyzowanego formatu, np. CSV, z kolumnami zawierającymi typ tagu, identyfikator elementu, tekst oryginalny i pustą kolumnę z tłumaczeniem.
Wyślij oryginalne ciągi tekstowe do tłumacza lub usługi tłumaczenia maszynowego. Ustrukturyzowany format zapewnia, że każdy przetłumaczony ciąg znaków pozostaje powiązany ze swoim elementem źródłowym, co jest niezbędne do zapisywania tłumaczeń z powrotem we właściwych lokalizacjach. Aby zachować zgodność z Dostępność PDF, tłumaczenia powinny spełniać te same standardy jakości, co oryginalny tekst alternatywny. Dobry opis tekstu alternatywnego jest zwięzły, zwykle ma mniej niż 150 znaków i opisuje zawartość i funkcję elementu, a nie jego wygląd. Tłumaczenie powinno zachować tę zwięzłość i skupienie na funkcjonalności.
WukongPDF obsługuje edycję Tagi PDF i atrybuty dostępności na poziomie pojedynczego elementu, dzięki czemu praktyczna jest aktualizacja tłumaczeń tekstu alternatywnego bez wpływu na widoczną zawartość strony. Ustrukturyzowany edytor tagów wyświetla pełną hierarchię elementów ze wszystkimi możliwymi do przetłumaczenia atrybutami, a funkcja aktualizacji zbiorczej pozwala importować tłumaczenia z pliku CSV i stosować je do właściwych elementów w jednej operacji.
Zapisywanie tłumaczeń z powrotem do struktury tagu
Po otrzymaniu tłumaczeń etap zapisywania zwrotnego wymaga narzędzia umożliwiającego nawigację po drzewie tagów PDF i aktualizację poszczególnych wartości atrybutów. Otwórz plik PDF w edytorze tagów, który pokazuje pełne drzewo struktury. Znajdź każdy przetłumaczony element w drzewie, wybierz jego atrybut /Alt lub inny i wklej przetłumaczony tekst. Zapisz plik po zaktualizowaniu wszystkich wpisów. Sprawdź wynik za pomocą czytnika ekranu lub narzędzia do sprawdzania dostępności. Poruszaj się po dokumencie z aktywnym czytnikiem ekranu i upewnij się, że każdy przetłumaczony opis jest czytany w oczekiwanym języku.
W przypadku dokumentów, które będą rozpowszechniane w wielu językach, należy rozważyć, czy plik PDF powinien zawierać wszystkie wersje językowe tekstu alternatywnego w jednym pliku, czy też należy utworzyć osobne pliki PDF dla poszczególnych języków. Specyfikacja PDF obsługuje tagowanie języków na poziomie elementu, więc teoretycznie pojedynczy plik może zawierać angielski tekst alternatywny na rysunku 1 i francuski tekst alternatywny na rysunku 2. Jednak obsługa czytnika ekranu w zakresie przełączania języka dla poszczególnych elementów jest niespójna w różnych aplikacjach czytników ekranu. Jeśli wymagana jest zgodność z dostępnością, bezpieczniejszym i bardziej niezawodnym wyborem są osobne pliki PDF dla poszczególnych języków.
Automatyzacja przepływu pracy dla dużych zestawów dokumentów
W przypadku organizacji, które muszą zlokalizować metadane dotyczące dostępności w setkach lub tysiącach plików PDF, metoda ręcznego zapisywania zwrotnego nie jest skalowalna. W takich przypadkach wyodrębnianie, tłumaczenie i zapisywanie zwrotne powinno odbywać się za pomocą skryptu. Użyj biblioteki PDF obsługującej dostęp do struktury znaczników, takiej jak Apache PDFBox dla Java lub pikepdf dla Pythona, aby programowo wyodrębnić wszystkie możliwe do przetłumaczenia atrybuty, wysłać je do interfejsu API tłumaczenia i zapisać wyniki.
Skrypt powinien rejestrować każdy modyfikowany przez siebie atrybut i generować raport porównawczy przed i po, aby weryfikator mógł na miejscu sprawdzić tłumaczenia. Automatyzacja przepływu pracy zmniejsza koszt dokumentu, ale wprowadza ryzyko błędów systemowych, takich jak błędnie przetłumaczony termin, który pojawia się w dziesiątkach opisów tekstu alternatywnego i jest wykrywany dopiero po dystrybucji. Przegląd zbiorczy losowej próbki oraz ukierunkowany przegląd wszelkich tłumaczeń oznaczonych przez interfejs API tłumaczeń jako mało pewne, równoważy wydajność z jakością i zapewnia uzasadniony zapis zapewnienia jakości.
Wypróbuj Tłumacz PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
