Otwierasz plik PDF i zamiast słów każda strona jest wypełniona pustymi prostokątami, małymi kwadratami lub rzędami identycznych symboli zastępczych w miejscach, w których powinien znajdować się tekst. Struktura dokumentu jest nienaruszona. Układ wygląda poprawnie. Ale każdą literę, cyfrę i znak interpunkcyjny zastąpiono pustym pudełkiem. Jest to błąd zastępowania czcionek i oznacza, że plik PDF próbuje wyświetlić tekst przy użyciu czcionki, która nie jest dostępna dla czytnika plików PDF. Dane tekstowe nadal znajdują się w pliku. Nie został usunięty ani uszkodzony. Problem leży wyłącznie w warstwie renderującej i dzięki temu można go naprawić.

Co powoduje, że podstawienie czcionki powoduje utworzenie pustych prostokątów
Przyczyna jest prostsza, niż sugerują objawy.
Każdy plik PDF zawiera instrukcje dotyczące wyświetlania tekstu. Każdy fragment tekstu odnosi się do określonej czcionki, która została osadzona w pliku PDF podczas jego tworzenia lub która ma być dostępna w systemie, w którym będzie przeglądana. Gdy czcionka jest osadzona, plik PDF zawiera kopię danych czcionki, a każdy czytnik plików PDF może poprawnie wyświetlić tekst, niezależnie od czcionek zainstalowanych na urządzeniu przeglądającym. Jeśli czcionka nie jest osadzona, czytnik plików PDF musi znaleźć pasującą czcionkę w systemie lokalnym. Jeśli dopasowanie nie istnieje, czytnik zastępuje czcionkę zastępczą. W większości przypadków działa to odpowiednio: tekst jest wyświetlany nieco inną, ale czytelną czcionką.
Awaria pustego prostokąta ma miejsce, gdy zawodzi sam mechanizm substytucji. Może się to zdarzyć z kilku powodów. Plik PDF może odwoływać się do czcionki przy użyciu nazwy wewnętrznej, która nie pasuje do żadnej standardowej nazwy czcionki rozpoznawanej przez system operacyjny. Czcionka może być niestandardowym lub zastrzeżonym krojem pisma z kodowaniem znaków, którego nie można odwzorować w przypadku standardowych czcionek zastępczych. Plik PDF może zawierać uszkodzone lub niekompletne osadzone czcionki, w których dane czcionki zostały uwzględnione, ale uległy uszkodzeniu podczas przesyłania pliku, uniemożliwiając czytelnikowi ich odkodowanie. W każdym przypadku czytelnik wie, że tekst powinien pojawić się w określonym miejscu, ale nie ma danych glifów do wyrenderowania, więc rysuje uniwersalny symbol brakujących znaków: pusty prostokąt (ISO, „ISO 32000-2:2020, Font Handling in PDF”, 2020).
Spróbuj naprawić plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Sprawdzanie, czy czcionka jest osadzona czy jej brakuje
Pierwszym krokiem diagnostycznym jest sprawdzenie, czy plik PDF zawiera osadzone czcionki, a jeśli tak, to czy są nienaruszone. Otwórz plik PDF w przeglądarce, która może wyświetlać właściwości dokumentu, takiej jak Adobe Acrobat. Przejdź do Plik, Właściwości, Czcionki. Lista czcionek pokazuje każdą czcionkę, do której odwołuje się dokument, oraz to, czy każda z nich jest osadzona, czy osadzona jako podzbiór. Czcionka osadzona wyświetla swoją pełną nazwę z dodatkiem (Osadzony) lub (Osadzony podzbiór) po niej. W przypadku czcionki nieosadzonej wyświetlana jest tylko nazwa czcionki, bez wskaźnika osadzenia. Jeśli czcionki użyte w brakującym tekście są wymienione jako nieosadzone, problem polega na tym, że na urządzeniu wyświetlającym nie są zainstalowane te czcionki.
Jeśli czcionki są wymienione jako osadzone, ale tekst nadal jest wyświetlany jako prostokąty, dane osadzonej czcionki są prawdopodobnie uszkodzone. Może się to zdarzyć, gdy plik PDF jest przesyłany przez zawodne połączenie sieciowe, przechowywany na uszkodzonym urządzeniu pamięci masowej lub przetwarzany przez oprogramowanie, które nie obsługuje w pełni używanego formatu osadzania czcionek. Dane czcionek znajdują się w pliku, ale nie można ich zdekodować. Panel właściwości dokumentu może nadal pokazywać czcionkę jako osadzoną, ponieważ deklaracja osadzania pozostaje nienaruszona, mimo że dane binarne czcionki są uszkodzone.
Naprawa problemów z niezamontowanymi czcionkami
W przypadku plików PDF, w których czcionki nigdy nie były osadzone, ścieżka naprawy polega na zainstalowaniu brakujących czcionek na urządzeniu przeglądającym lub na ponownym utworzeniu pliku PDF z osadzonymi czcionkami. Instalowanie czcionek działa, gdy wiesz, których czcionek brakuje i możesz je legalnie uzyskać. Jest to praktyczne, gdy brakująca czcionka jest popularnym komercyjnym krojem pisma, takim jak Helvetica lub Times New Roman, który już posiadasz, ale nie jest zainstalowany na bieżącym urządzeniu. Jest to mniej praktyczne, gdy brakująca czcionka jest niestandardowym krojem pisma korporacyjnego lub kosztowną czcionką licencjonowaną.
Narzędzie Napraw PDF WukongPDF może ponownie przetworzyć plik PDF, w którym występują problemy z wyświetlaniem czcionek, analizując kodowanie tekstu i odniesienia do czcionek w pliku. W przypadku powszechnie dostępnych czcionek nieosadzonych narzędzie może zastąpić czcionki ścisłe, które zachowują zawartość tekstu i przybliżony wygląd. W przypadku dokumentów, w których musi zostać dokładnie zachowany oryginalny tekst, odtworzenie pliku PDF z dokumentu źródłowego z włączoną funkcją osadzania czcionek jest najbardziej niezawodnym i długoterminowym rozwiązaniem. Większość edytorów tekstu i aplikacji do projektowania ma ustawienie Osadź czcionki lub Osadź wszystkie znaki w oknie dialogowym eksportu do pliku PDF. Włączenie tego ustawienia zapobiega pojawianiu się problemów z zastępowaniem czcionek.
Odzyskiwanie tekstu z plików PDF z uszkodzonymi osadzonymi czcionkami
W przypadku uszkodzenia osadzonych czcionek dane tekstowe zwykle pozostają nienaruszone, nawet jeśli nie można ich wyświetlić. Kody znaków określające, gdzie pojawiają się litery, są przechowywane oddzielnie od danych glifów czcionki, które mówią modułowi renderującemu, jak narysować te litery. Możesz wyodrębnić treść tekstową z pliku PDF, nawet jeśli renderowanie wizualne nie powiedzie się. Skopiuj pozornie pusty obszar tekstowy, klikając i przeciągając po nim. Nawet jeśli nic nie jest widoczne, tekst może zostać zaznaczony. Wklej go do edytora tekstu. Jeśli pojawi się czytelny tekst, dane tekstowe pozostaną nienaruszone, a jedynie renderowanie czcionki zostanie uszkodzone.
Jeśli kopiowanie i wklejanie daje zniekształcone znaki, kodowanie czcionek może być niestandardowe. W takim przypadku użyj funkcji wyodrębniania tekstu PDF w dedykowanym narzędziu PDF, które próbuje dekodować tekst przy użyciu wielu schematów kodowania. Wyodrębniony tekst można następnie umieścić w nowym dokumencie z odpowiednio osadzonymi czcionkami. Oryginalny plik PDF służy jako wizualny punkt odniesienia dla układu, natomiast wyodrębniony tekst zawiera treść naprawionej wersji. To dwuetapowe odzyskiwanie pozwala zachować zarówno informacje, jak i ich prezentację.
Zapobieganie problemom z czcionkami w tworzonych plikach PDF
Najskuteczniejszą metodą zapobiegania jest zawsze osadzanie czcionek podczas tworzenia plików PDF. W programie Microsoft Word opcja ta znajduje się w Plik, Opcje, Zapisz, w obszarze Zachowaj wierność podczas udostępniania tego dokumentu. Zaznacz opcję Osadź czcionki w pliku. W programie Adobe InDesign i podobnych aplikacjach do tworzenia układu okno dialogowe eksportu do pliku PDF zawiera sekcję osadzania czcionek, w której można określić, które czcionki mają zostać osadzone. Osadzanie pełnego zestawu znaków zamiast podzbioru gwarantuje, że nawet jeśli dokument będzie później edytowany i zostaną użyte znaki spoza oryginalnego podzbioru, będą one wyświetlane poprawnie.
W przypadku plików PDF otrzymanych od innych problemy z renderowaniem czcionek należy traktować jako problem możliwy do naprawienia, a nie trwałe uszkodzenie. Tekst prawie na pewno nadal znajduje się w pliku. Podejście Fix PDF polega na zdiagnozowaniu, czy brakuje czcionek lub czy są one uszkodzone, wyodrębnieniu tekstu, który można odzyskać, i zainstalowaniu brakujących czcionek lub odbudowaniu dokumentu przy użyciu osadzonych czcionek. Plik PDF pełen pustych prostokątów wygląda niepokojąco, ale zawartość tych prostokątów jest zwykle nienaruszona i można ją odzyskać, wykonując odpowiednie czynności.
Zastępowanie czcionek w pismach innych niż łacińskie i specjalistycznych
Błędy podczas zastępowania czcionek są szczególnie częste w przypadku pism innych niż łacińskie, takich jak chiński, japoński, koreański, arabski i cyrylica. Te systemy pisma używają zestawów znaków znacznie większych niż alfabet łaciński, a obsługujące je czcionki są odpowiednio większe, co zwiększa prawdopodobieństwo ich podzbioru lub pominięcia podczas tworzenia pliku PDF. Plik PDF utworzony w systemie z pełną obsługą czcionek CJK może być wyświetlany jako puste prostokąty w systemie bez tych czcionek. To samo dotyczy wyspecjalizowanych zestawów znaków używanych w matematyce, notacji muzycznej i językoznawstwie. Dokumenty korzystające z tych skryptów powinny zawsze mieć całkowicie osadzone czcionki, a nie ich podzbiór, aby zapewnić zgodność między platformami.
W przypadku otrzymania pliku PDF z brakującymi czcionkami innymi niż łacińskie zainstalowanie określonej czcionki jest często jedynym niezawodnym rozwiązaniem. Algorytmy podstawiania czcionek zaprojektowane dla alfabetu łacińskiego słabo sprawdzają się w przypadku zestawów znaków innych niż łacińskie, ponieważ kształty glifów są zbyt różne, aby można je było sensownie zastąpić. Identyfikacja dokładnej czcionki użytej w oryginalnym dokumencie, uzyskanie jej z legalnego źródła i zainstalowanie jej w systemie przeglądania przywraca dokumentowi jego zamierzony wygląd. Ekosystem Czcionki PDF w pełni obsługuje Unicode, ale obsługa ta zależy od czcionek dostępnych dla modułu renderującego. Brakująca czcionka to luka, której żadna sprytna substytucja nie jest w stanie w pełni wypełnić w przypadku złożonych systemów pisma.
Problem z pustym prostokątem jest jednym z najbardziej niepokojących wizualnie problemów z plikami PDF, jakie może napotkać użytkownik, ale jest też jednym z najłatwiejszych do naprawienia. W przeciwieństwie do uszkodzeń strukturalnych, w których w ogóle nie można otworzyć pliku, błąd renderowania czcionki oznacza, że struktura pliku jest nienaruszona i zawartość jest obecna. Moduł renderujący po prostu nie może narysować tego, o czym wie, że powinno się tam znajdować. Metodyczne podejście do problemu, sprawdzenie stanu osadzania, identyfikacja brakujących czcionek i odzyskanie zawartości tekstowej sprawia, że plik PDF, który wygląda na zniszczony, staje się w pełni użyteczny i czytelny. Wygląd zniszczenia jest iluzją stworzoną przez warstwę renderującą. Dane znajdujące się pod spodem prawie zawsze można odzyskać, wykonując odpowiednie czynności diagnostyczne i narzędzia naprawcze.
Puste prostokąty, w których powinien znajdować się tekst, są niepokojące już przy pierwszym spotkaniu z nimi. Po zrozumieniu stojącego za nimi mechanizmu zastępowania czcionek stają się one możliwym do rozwiązania problemem technicznym z jasną ścieżką diagnostyczną i niezawodnymi poprawkami. Panika znika i zaczyna się rozwiązywanie problemów.
Spróbuj naprawić plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
