Tips & Tricks

Jak przetłumaczyć dokument PDF, zachowując całe formatowanie i wewnętrzne hiperłącza

Podajesz plik PDF za pośrednictwem narzędzia do tłumaczenia online i pobierasz wynik. Tekst jest teraz w języku docelowym, ale dokument wygląda nieprawidłowo. Nagłówki uległy zmianie. Punktory są źle ustawione. Obrazy zostały przesunięte z pierwotnych pozycji. Co najgorsze, każde hiperłącze w dokumencie jest martwe. Narzędzie do tłumaczenia zastąpiło widoczny tekst linku, ale usunęło podstawowy adres URL. Dokument jest przetłumaczony, ale uszkodzony.

Tłumaczenie pliku PDF z zachowaniem jego formatowania i elementów interaktywnych wymaga podejścia polegającego na tłumaczeniu, które oddziela warstwę tekstową od struktury strony. Wyzwanie polega na tym, że tekst PDF i układ PDF są ściśle powiązane. Zmiana długości przetłumaczonego zdania, która może wzrosnąć od 20% do 30% podczas tłumaczenia z angielskiego na niemiecki, francuski lub hiszpański, powoduje wysunięcie otaczającego tekstu i elementów z miejsca. Rezultatem jest tekst, który przekracza swoje pierwotne granice lub nakłada się na sąsiadującą treść.

How to Translate a PDF Document While Keeping All Formatting and Internal Hyperlinks

Dlaczego tłumaczenie PDF często psuje formatowanie

Większość narzędzi Translate PDF działa w ten sposób, że wyodrębnia tekst z każdej strony, wysyła go do mechanizmu tłumaczenia maszynowego, a następnie próbuje umieścić przetłumaczony tekst z powrotem w oryginalnym układzie strony. Podstawowym problemem jest ponowne wlanie tekstu. Tekst angielski przetłumaczony na niemiecki zwiększa liczbę znaków średnio o 20% do 30%. To samo zdanie, które idealnie mieści się w polu tekstowym przeznaczonym dla języka angielskiego, teraz je przepełnia. Jeśli narzędzie do tłumaczenia nie dostosuje rozmiaru pola tekstowego lub rozmiaru czcionki, aby to zrekompensować, przetłumaczony tekst zostanie obcięty, nałoży się na sąsiednie elementy lub zepsuje układ strony.

Hiperłącza są tracone, ponieważ łącza PDF są przechowywane w postaci klikalnych prostokątnych obszarów nałożonych na stronę, oddzielonych od widocznego tekstu. Kiedy narzędzie do tłumaczenia zastępuje tekst, ale nie aktualizuje adnotacji linków, aby dopasować je do nowych pozycji i długości tekstu, linki albo wskazują niewłaściwe lokalizacje, albo są całkowicie usuwane. Widoczny, podkreślony niebieski tekst pozostaje, ale klikalny obszar za nim zniknął.

WukongPDF

Wypróbuj Tłumacz PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →

Podejście warstwowe: OCR, tłumaczenie tekstu, nakładanie na oryginał

Najbardziej niezawodnym sposobem zachowania formatowania podczas tłumaczenia jest zachowanie oryginalnych obrazów stron w nienaruszonym stanie i dodanie na wierzch przetłumaczonej warstwy tekstowej. Podejście to traktuje oryginalny plik PDF jako tło wizualne i umieszcza przetłumaczony tekst w przezroczystych polach tekstowych umieszczonych nad tekstem oryginalnym. Oryginalne formatowanie, obrazy i linki pozostają niezmienione, ponieważ nigdy nie zostały usunięte. Tylko tekst jest tłumaczony i zmieniany.

To podejście sprawdza się dobrze w przypadku dokumentów statycznych, w których najważniejszy jest układ wizualny, a przetłumaczony tekst służy do czytania, a nie do dalszej edycji. Przetłumaczony tekst można dostosować pod względem rozmiaru czcionki i wymiarów ramki, aby dopasować go do dostępnej przestrzeni bez wpływu na tło. WukongPDF wspiera to podejście oparte na warstwach, wykonując w razie potrzeby OCR, wyodrębniając tekst, tłumacząc go przy zachowaniu relacji przestrzennej pomiędzy blokami tekstu i umieszczając tłumaczenie w nowej warstwie na oryginalnych obrazach stron.

Zachowywanie hiperłączy podczas tłumaczenia

Hiperłącza są najbardziej wrażliwym elementem podczas tłumaczenia, ponieważ są przechowywane jako adnotacje oddzielone od tekstu. Aby zachować linki, narzędzie do tłumaczenia musi przeczytać adnotację każdego linku, zapisać jego docelowy adres URL, zanotować, z jakim tekstem jest powiązany, przetłumaczyć ten tekst i ponownie dołączyć adnotację linku do nowej pozycji tekstowej. Narzędzia, które nie obsługują jawnie zachowywania linków, usuną linki.

Narzędzie do tłumaczenia oparte na przeglądarce umożliwia zachowanie PDF Links w ramach procesu tłumaczenia. Przed tłumaczeniem narzędzie skanuje dokument pod kątem adnotacji hiperłączy i rejestruje adres URL każdego łącza, widoczny tekst i położenie. Po tłumaczeniu linki są ponownie dołączane do odpowiednich przetłumaczonych bloków tekstu. Hiperłącza zewnętrzne, prowadzące do stron internetowych, zostają zachowane z niezmienionymi oryginalnymi adresami URL. Linki wewnętrzne, które prowadzą do innych stron w tym samym pliku PDF, są ponownie mapowane w celu uwzględnienia wszelkich zmian numeracji stron spowodowanych rozszerzeniem tekstu. Rezultatem jest przetłumaczony plik PDF, w którym zarówno tekst, jak i nawigacja pozostają funkcjonalne.

Obsługa rozszerzania i kurczenia tekstu w różnych językach

Różne pary językowe mają różną charakterystykę ekspansji. Z języka angielskiego na niemiecki wzrasta zazwyczaj o 20% do 30%. Z angielskiego na francuski wzrósł o 15% do 25%. Angielski na hiszpański wzrósł o 10% do 20%. Natomiast z języka angielskiego na chiński lub japoński zmniejsza się o 20% do 40%, ponieważ znaki logograficzne mieszczą więcej znaczenia w mniejszej poziomej przestrzeni. Narzędzie do tłumaczenia, które nie uwzględnia tych różnic, stworzy dokumenty, w których przetłumaczony tekst będzie przepełniony lub pozostawi niewygodne luki.

W przypadku par językowych wymagających dużej ekspansji praktyczną regulacją jest zmniejszenie rozmiaru czcionki przetłumaczonego tekstu o jeden lub dwa punkty lub zezwolenie na rozszerzanie się pól tekstowych w pionie, przy jednoczesnym zachowaniu ich szerokości w poziomie ograniczonej do oryginalnej szerokości kolumny. Rozszerzanie pionowe powoduje wypychanie kolejnych treści w dół strony, co jest zwykle lepsze niż przepełnienie poziome, które powoduje znikanie tekstu poza marginesem strony. W przypadku par o dużym skurczu rozmiar czcionki można nieznacznie zwiększyć, aby wypełnić przestrzeń, chociaż może to spowodować wizualne niedopasowanie między przetłumaczonym tekstem a typografią oryginalnego dokumentu.

Sprawdzanie jakości przetłumaczonego pliku PDF

Tłumaczenie maszynowe nie jest doskonałe, a błędy w tłumaczeniu mogą zmieniać znaczenie zdań, czasami w subtelny i znaczący sposób. Po tłumaczeniu poproś osobę czytającą w języku docelowym o przejrzenie dokumentu. Jeśli nie jest dostępny żaden weryfikator, przeprowadź przynajmniej wyrywkową próbę przetłumaczonych zdań, tłumacząc je z powrotem na język źródłowy przy użyciu innego silnika tłumaczeniowego i porównując z oryginałem. Ta kontrola tłumaczenia wstecznego wychwytuje oczywiste błędy, ale nie zastępuje weryfikacji ręcznej.

Sprawdź metodycznie formatowanie. Przewiń każdą stronę. Sprawdź, czy żaden tekst nie jest obcięty, nałożony lub przesunięty z innej pozycji. Kliknij każde hiperłącze i potwierdź, że prowadzi ono do właściwego miejsca docelowego. Sprawdź, czy obrazy, tabele i inne elementy nietekstowe pozostały w swoich oryginalnych pozycjach. Jeśli narzędzie do tłumaczenia korzysta z metody nakładania, upewnij się, że przetłumaczony tekst odpowiednio pokrywa tekst oryginalny, szczególnie jeśli tekst oryginalny jest napisany większą czcionką lub ma ciemniejszy kolor niż tłumaczenie. Oryginalny tekst wystający zza tłumaczenia daje nieprofesjonalny efekt.

W przypadku dokumentów, które będą regularnie aktualizowane i ponownie tłumaczone, utwórz bazę tłumaczeń. Pamięć tłumaczeniowa przechowuje wcześniej przetłumaczone segmenty i wykorzystuje je ponownie, gdy ten sam lub podobny tekst pojawia się w nowej wersji. Zmniejsza to koszty tłumaczenia, poprawia spójność i zapobiega powtarzaniu się tych samych błędów formatowania. Potok PDF Export WukongPDF może zawierać dane z pamięci tłumaczeń, aby przyspieszyć ponowne tłumaczenie zaktualizowanych dokumentów.

WukongPDF

Wypróbuj Tłumacz PDF

Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.

Zacznij teraz →