Artykuł badawczy napisany w języku francuskim zawiera ryciny z podpisami i tabele z nagłówkami, które anglojęzyczny recenzent powinien zrozumieć. Tekst podstawowy może pozostać w języku francuskim, ponieważ recenzent współpracuje z dwujęzycznym kolegą. Tłumaczenie całego dokumentu jest niepotrzebne i stwarza ryzyko wprowadzenia błędów w treści technicznej. Tłumaczenie jedynie podpisów rycin i nagłówków tabel zapewnia recenzentowi informacje potrzebne do interpretacji elementów wizualnych bez dotykania tekstu podstawowego.
Selektywne Tłumacz PDF podpisów i nagłówków to precyzyjne zadanie, które wymaga narzędzia zdolnego do identyfikowania określonych elementów tekstu na podstawie ich położenia, formatowania lub wzorców treści. Podpisy zazwyczaj pojawiają się pod rysunkami mniejszą czcionką. Nagłówki tabeli są wyświetlane w pierwszym wierszu tabeli pogrubioną czcionką. Te wskazówki formatujące umożliwiają selektywne wyodrębnianie i tłumaczenie.

Identyfikacja podpisów i nagłówków do tłumaczenia selektywnego
Podpisy rysunków w akademickich i technicznych plikach PDF mają przewidywalne wzorce formatowania. Pojawiają się bezpośrednio pod lub obok figury. Używają mniejszego rozmiaru czcionki niż tekst główny, zwykle od 8 do 10 punktów. Często zaczynają się od cyfry, po której następuje liczba. Wzorce te umożliwiają ręczną lub automatyczną identyfikację tekstu podpisu.
Nagłówki tabel pojawiają się w pierwszym wierszu tabeli, często pogrubionym tekstem i zacienionym tłem. Wiersz nagłówka różni się strukturalnie od wierszy danych. Narzędzie do wyodrębniania tabeli PDF może zidentyfikować wiersz nagłówka na podstawie jego położenia i formatowania, wyodrębnić tekst nagłówka i pozostawić wiersze danych nietknięte.
W Format PDF podpisy i nagłówki są przechowywane jako umieszczone obiekty tekstowe, a nie jako elementy oznaczone semantycznie. Wyodrębnianie ich wymaga analizy położenia tekstu, właściwości czcionki i bliskości obrazów lub struktur tabel. Narzędzie do wyodrębniania tekstu ogólnego przeznaczenia nie odróżnia podpisów od tekstu podstawowego. Specjalistyczne narzędzie, które rozumie układ dokumentu, może.
Wypróbuj Tłumacz PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Selektywny proces tłumaczenia
Najpierw wyodrębnij podpis i tekst nagłówka z pliku PDF. Zidentyfikuj każdy podpis na podstawie jego położenia względem obrazów i charakterystyki czcionki. Zidentyfikuj każdy nagłówek tabeli według jego pozycji w strukturach tabeli. Skompiluj wyodrębniony tekst w listę tłumaczeń z odniesieniami do pozycji.
Po drugie, przetłumacz wyodrębniony tekst. Tłumaczenie maszynowe sprawdza się dobrze w przypadku prostego języka używanego w podpisach i nagłówkach. Weryfikacja tłumaczeń przez człowieka zapewnia prawidłowe przetłumaczenie terminów technicznych i zachowanie terminologii specyficznej dla domeny.
WukongPDF udostępnia możliwości ekstrakcji PDF do tekstu, które umożliwiają wyodrębnienie określonych elementów tekstu. Ekstrakcja w połączeniu z tłumaczeniem tworzy przetłumaczone podpisy i nagłówki, zachowując jednocześnie oryginalny tekst podstawowy.
Ponowne wstawianie przetłumaczonych podpisów i nagłówków
Po przetłumaczeniu umieść przetłumaczony tekst z powrotem w pliku PDF w oryginalnych miejscach. Przetłumaczone podpisy zastępują oryginalne podpisy pod każdym rysunkiem. Przetłumaczone nagłówki zastępują oryginalne nagłówki w każdej tabeli. Tekst podstawowy pozostaje niezmieniony.
Należy zwrócić uwagę na różnice w długości tłumaczeń pomiędzy językami. Podpis w języku francuskim, który można przełożyć na dłuższy tekst w języku angielskim, może wymagać nieco mniejszego rozmiaru czcionki lub mniejszych odstępów między wierszami, aby zmieścić się na tym samym obszarze. Dostosuj formatowanie tekstu, aby uwzględnić tłumaczenie bez zakłócania układu strony.
Kiedy tłumaczenie selektywne jest właściwym podejściem
Tłumaczenie selektywne jest odpowiednie, gdy czytelnik musi zrozumieć elementy wizualne, ale nie musi szczegółowo czytać tekstu podstawowego. Współpraca naukowa ponad barierami językowymi, przegląd techniczny zgłoszeń międzynarodowych i wielojęzyczne procesy publikacji czerpią korzyści z tego ukierunkowanego podejścia.
Oszczędność kosztów i czasu w przypadku tłumaczenia selektywnego w porównaniu z tłumaczeniem pełnego dokumentu jest proporcjonalna do stosunku podpisów i nagłówków do tekstu podstawowego. Dokument składający się w 80% z tekstu podstawowego i 20% z podpisów pozwala zaoszczędzić 80% kosztów tłumaczenia, jeśli tłumaczone są tylko podpisy.
Identyfikację podpisów i nagłówków do tłumaczenia selektywnego można częściowo zautomatyzować, ucząc model analizy układu dokumentu w konkretnym formacie dokumentu lub publikacji. Model wyszkolony na szablonie czasopisma może z dużą dokładnością identyfikować podpisy i nagłówki we wszystkich artykułach korzystających z tego szablonu.
Narzędzia pamięci tłumaczeniowej mogą przechowywać tłumaczenia powtarzających się fraz podpisów w wielu dokumentach z tego samego pola. Wyrażenie takie jak rysunek X pokazuje związek pomiędzy, pojawia się w dziesiątkach artykułów i korzysta z spójnego tłumaczenia we wszystkich z nich.
Proces zapewniania jakości tłumaczenia selektywnego powinien weryfikować zarówno, czy przetłumaczony został prawidłowy tekst, jak i czy nie został przetłumaczony nieprawidłowy tekst, czyli tekst podstawowy. Recenzent porównuje próbkę przetłumaczonych podpisów z oryginałami, a także sprawdza, czy treść tych stron pozostaje w języku oryginalnym.
Dokumenty, w których podpisy zawierają numeryczne odniesienia do tekstu podstawowego, patrz sekcja 3.2, aby uzyskać szczegółowe informacje. Tłumaczenie musi dokładnie zachowywać te odniesienia. Błędnie przetłumaczone odsyłacze wskazujące na nieistniejącą sekcję powodują zamieszanie.
Kiedy przetłumaczone podpisy zostaną ponownie wstawione do pliku PDF, nowy tekst powinien wizualnie odróżniać się od oryginalnego tekstu podstawowego, na przykład subtelną różnicą kolorów lub notatką na marginesie, aby czytelnicy zrozumieli, że oglądają dokument przetłumaczony selektywnie.
Podejście do tłumaczenia selektywnego można rozszerzyć na inne elementy dokumentu, które skorzystają z tłumaczenia ukierunkowanego: tłumaczenie abstrakcyjne, tłumaczenie słów kluczowych dla międzynarodowych baz danych i tłumaczenie etykiet rycinowych dla publikacji wielojęzycznych.
Dla wydawców akademickich wydających czasopisma w wielu językach selektywne tłumaczenie podpisów i nagłówków stanowi opłacalny środek pomiędzy kosztownym pełnym tłumaczeniem a całkowitym brakiem tłumaczenia.
Selektywne tłumaczenie podpisów i nagłówków jest precyzyjnym narzędziem dostosowanym do konkretnych potrzeb i nie zastępuje tłumaczenia pełnego dokumentu, gdy odbiorca musi zrozumieć całą treść.
Opłacalność tłumaczenia selektywnego sprawia, że jest to atrakcyjna opcja w przypadku współpracy międzynarodowej, w przypadku której pełne tłumaczenie byłoby zbyt drogie.
Tłumaczenie selektywne zapewnia ukierunkowane rozwiązanie do współpracy przy wielojęzycznych dokumentach.
Podpisy pod rysunkami w artykułach naukowych są zgodne z przewidywalnymi wzorami, które mogą zidentyfikować narzędzia do automatycznego wyodrębniania: pojawiają się pod rysunkami, używają mniejszej czcionki i zaczynają się od Rycina, po której następuje liczba.
Nagłówki tabel różnią się strukturalnie od wierszy danych, ponieważ pojawiają się na górze tabeli, często zawierają pogrubiony tekst i mogą mieć zacienione tło, czyli cechy, których używają narzędzia do wyodrębniania do identyfikacji.
Proces wyodrębniania powinien zachować oryginalne informacje o formatowaniu, aby przetłumaczony tekst mógł zostać umieszczony z powrotem we właściwych miejscach, z zachowaniem odpowiednich właściwości czcionki i odstępów.
W przypadku publikacji wielojęzycznych można systematycznie stosować tłumaczenie selektywne: wyodrębnij podpisy i nagłówki, przetłumacz na wszystkie języki docelowe i wstaw każdą wersję jako osobną warstwę PDF.
Jakość tłumaczenia maszynowego podpisów naukowych poprawiła się do tego stopnia, że ręczna edycja końcowa jest szybsza i tańsza niż tłumaczenie od zera tych elementów tekstu strukturalnego.
Różnica w rozmiarze czcionki między tekstem podstawowym a podpisami jest głównym sygnałem używanym przez narzędzia do automatycznego wyodrębniania do identyfikowania tekstu podpisów, przy czym podpisy są zwykle od 2 do 4 punktów mniejsze niż otaczający tekst główny.
Wiersze nagłówka tabeli można rozpoznać po ich pozycji jako pierwszego wiersza każdej tabeli, pogrubionym formacie tekstu i często zacienionym tle odróżniającym je od wierszy danych.
Wyodrębnione podpisy i nagłówki należy skompilować w uporządkowaną listę, która zachowuje numer strony i współrzędne pozycji, umożliwiając dokładne ponowne wstawienie po tłumaczeniu.
Narzędzia pamięci tłumaczeniowej mogą przechowywać przetłumaczone podpisy z poprzednich dokumentów w tym samym polu, poprawiając spójność i zmniejszając koszty tłumaczenia powtarzającej się terminologii.
Ponowne wstawienie przetłumaczonych napisów musi uwzględniać różnice w długości tekstu między językami, dostosowując rozmiar czcionki lub odstępy między wierszami w razie potrzeby, aby zmieścić przetłumaczony tekst w oryginalnym obszarze podpisu.
Zapewnienie jakości tłumaczenia selektywnego obejmuje sprawdzenie, czy wyodrębniono właściwe elementy tekstu, czy tłumaczenia są dokładne i czy żaden tekst podstawowy nie został przypadkowo zmodyfikowany.
W przypadku czasopism akademickich publikujących artykuły w wielu językach wybiórcze tłumaczenie podpisów i nagłówków można włączyć do procesu produkcyjnego w ramach standardowego kroku.
Oszczędności wynikające z tłumaczenia selektywnego w porównaniu z tłumaczeniem pełnym sprawiają, że współpraca międzynarodowa jest dostępna dla projektów i publikacji o ograniczonych budżetach na tłumaczenia.
Jakość tłumaczenia maszynowego ustrukturyzowanego, formalnego języka używanego w podpisach naukowych jest generalnie wyższa niż w przypadku tekstu narracyjnego, co zmniejsza obciążenie poedytacyjne.
Możliwość tłumaczenia tylko określonych elementów dokumentu przy jednoczesnym zachowaniu oryginalnego języka tekstu podstawowego zapewnia elastyczność w międzynarodowym obiegu dokumentów.
W przypadku współpracy badawczej obejmującej wiele społeczności językowych tłumaczenie selektywne umożliwia każdemu współpracownikowi dostęp do dowodów wizualnych w preferowanym przez niego języku.
To selektywne podejście sprawia, że wielojęzyczna współpraca nad dokumentami jest dostępna dla zespołów i projektów z ograniczonymi zasobami tłumaczeniowymi.
Ukierunkowane tłumaczenie podpisów rysunków i nagłówków tabel zapewnia niezbędny kontekst, którego czytelnicy potrzebują do interpretacji elementów wizualnych.
Selektywne tłumaczenie podpisów i nagłówków umożliwia czytelnikom z zagranicy zrozumienie dowodów wizualnych w dokumencie bez konieczności pełnego tłumaczenia tekstu podstawowego.
To ukierunkowane podejście do tłumaczenia dokumentów zmniejsza koszty, jednocześnie zwiększając dostępność informacji wizualnych pomimo barier językowych.
Wyodrębnianie podpisów opiera się na różnicach w rozmiarze czcionki i położeniu w stosunku do otaczającego tekstu.
Tekst podpisu w plikach PDF jest zwykle umieszczany bezpośrednio pod lub obok odpowiedniej ilustracji, przy użyciu czcionki o rozmiarze od 2 do 4 punktów mniejszym niż tekst główny, dzięki czemu można go zidentyfikować za pomocą automatycznych narzędzi do wyodrębniania, które analizują położenie tekstu i cechy formatowania.
Selektywne tłumaczenie podpisów i nagłówków zapewnia międzynarodowym czytelnikom dostęp do informacji wizualnych.
Dzięki tej możliwości międzynarodowa współpraca badawcza jest bardziej dostępna i opłacalna.
Selektywne podejście do tłumaczenia dokumentów odpowiada konkretnej potrzebie bez konieczności ponoszenia kosztów pełnego tłumaczenia.
| Element | Wskazówka identyfikacyjna | Priorytet tłumaczenia | Notatka o ponownym wstawieniu |
|---|---|---|---|
| Podpis rysunku | Poniżej rysunek; mniejsza czcionka; Przedrostek cyfry N | Wysoki | Ta sama pozycja; może być konieczna zmiana rozmiaru czcionki |
| Nagłówek tabeli | Pierwszy rząd; pogrubiony; zacieniony bł | Wysoki | Te same komórki; zachować wyrównanie |
| Etykieta osi | Sąsiadujące z osiami wykresu | Średni | Może wymagać regulacji obrotu |
| Wpis legendy | Próbka koloru + tekst | Niski | Często nie ekstrahowane oddzielnie |
Wypróbuj Tłumacz PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
