Otwierasz plik PDF na swoim laptopie z systemem Windows i wszystko wygląda idealnie. Wysyłasz go do kolegi korzystającego z komputera Mac i widzi on losowe symbole, kwadratowe pola lub znaki zapytania rozsiane po całym dokumencie. Na komputerze z systemem Linux w tym samym pliku mogą być wyświetlane spacje w miejscu, w którym powinien znajdować się tekst. To frustrujące doświadczenie zdarza się częściej, niż większość ludzi zdaje sobie sprawę, i prawie zawsze sprowadza się do tego, jak różne systemy operacyjne radzą sobie z czcionkami osadzonymi w plikach PDF.
Zasadnicza kwestia jest prosta: plik PDF został zaprojektowany tak, aby wszędzie wyglądał tak samo, ale spełnienie tej obietnicy zależy od tego, czy czcionki są osadzone w pliku, czy są dostępne w systemie, który go otwiera. Gdy plik PDF opiera się na czcionkach zainstalowanych na komputerze twórcy, ale nie zawiera tych czcionek w samym pliku, każde urządzenie pozbawione tych samych czcionek zastąpi je czymś innym. W innym systemie operacyjnym, gdzie nawet popularne czcionki mają różne nazwy lub wersje, takie podstawienie może spowodować zniekształcenie i nieczytelność danych wyjściowych.

Najczęstszy winowajca: brakujące lub niezagnieżdżone czcionki
Kiedy ktoś tworzy plik PDF z dokumentu Word, Dokumentu Google lub aplikacji do projektowania, takiej jak InDesign, oprogramowanie decyduje, czy osadzić czcionki bezpośrednio w pliku PDF, czy po prostu odwoływać się do nich. Osadzanie czcionek oznacza, że rzeczywiste dane czcionki zostaną spakowane w pliku PDF. Odniesienie do czcionki rejestruje jedynie, która czcionka została użyta i oczekuje, że urządzenie odczytujące ją zainstaluje.
Program Microsoft Word w systemie Windows zazwyczaj używa czcionek takich jak Calibri, Cambria lub Times New Roman. Jeśli twórca pliku PDF zdecyduje się nie osadzać czcionek, często w celu zmniejszenia rozmiaru pliku, plik PDF przechowuje tylko nazwę czcionki, a nie rzeczywiste kształty znaków. Komputer Mac otwierający ten plik szuka Calibri, ale znajduje inną wersję Calibri lub nie znajduje żadnego dopasowania. Przeglądarka plików PDF na komputerze Mac powraca następnie do czcionki zastępczej, a odwzorowanie znaków pomiędzy czcionką oryginalną a czcionką zastępczą rzadko jest idealnie dopasowane.
Analiza przeprowadzona w 2024 r. przez stowarzyszenie PDF Association wykazała, że problemy związane z czcionkami odpowiadają za około 40% wszystkich problemów z renderowaniem plików PDF na różnych platformach (PDF Association, „Badanie błędów renderowania plików PDF”, 2024). Błędy podczas zastępowania czcionek są szczególnie częste w przypadku pism innych niż łacińskie, takich jak cyrylica, CJK (chiński, japoński, koreański), arabski i hebrajski, gdzie czcionka zastępcza może całkowicie nie zawierać wymaganych zestawów znaków.
Z tego też powodu mogą wystąpić problemy z Czcionki PDF w przypadku dokumentów korzystających z czcionek niestandardowych lub licencjonowanych. Aplikacje projektowe często korzystają z czcionek premium, które nie są swobodnie dystrybuowane. Jeśli projektant zapomni je osadzić lub licencja na czcionkę zabrania osadzania, każda osoba otwierająca plik PDF bez zainstalowanej określonej czcionki zobaczy zniekształcony tekst.
Ten sam dokument oglądany w innym systemie operacyjnym może wyglądać zupełnie inaczej. Plik PDF renderowany poprawnie na komputerze z systemem Windows, na którym został utworzony, może zawierać tofu (pseudonim pustych prostokątnych pól pojawiających się, gdy czcionka nie ma określonego znaku) w systemie Mac lub Linux. Tej niespójności można całkowicie zapobiec na etapie tworzenia pliku PDF.
Spróbuj naprawić plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
Konflikty kodowania znaków między systemami Windows, macOS i Linux
Korzystanie z narzędzia PDF opartego na przeglądarce oznacza również, że nigdy nie musisz instalować ani aktualizować oprogramowania. Narzędzie działa na zdalnych serwerach i dostarcza wyniki za pośrednictwem przeglądarki, dzięki czemu zawsze masz dostęp do najnowszej wersji bez konieczności pobierania. Jest to szczególnie wygodne, gdy musisz szybko przetworzyć plik na urządzeniu, na którym nie masz uprawnień administratora do instalowania programów.
Oprócz brakujących czcionek, kodowanie znaków jest drugim głównym powodem, dla którego pliki PDF wyświetlają się inaczej na różnych platformach. Kodowanie znaków to system, który odwzorowuje kody numeryczne na określone kształty znaków. Podczas tworzenia pliku PDF każdemu znakowi w dokumencie przypisywany jest kod oparty na kodowaniu używanym przez aplikację źródłową. PDF Przeglądanie w innym systemie operacyjnym może błędnie zinterpretować te kody.
Aplikacje systemu Windows historycznie korzystają ze starszych stron kodowych, takich jak Windows-1252 dla języków zachodnioeuropejskich lub Shift-JIS dla języka japońskiego. Aplikacje na komputery Mac zwykle korzystają z kodowania opartego na Unicode. Systemy Linux domyślnie korzystają z UTF-8. Gdy plik PDF utworzony w systemie Windows z kodowaniem specyficznym dla systemu Windows zostanie otwarty w systemie, który inaczej interpretuje te same kody numeryczne, w rezultacie powstaje mojibake, czyli zniekształcony tekst spowodowany nieprawidłowym kodowaniem znaków.
Problem pojawia się najczęściej w przypadku znaków specjalnych: cudzysłowów, znaków akcentu, symboli walut i notacji matematycznej. Plik PDF utworzony w języku europejskim, w którym używane są znaki akcentowane, takie jak é, ö lub ń, może wyświetlać te znaki jako symbole zaszyfrowane po otwarciu w systemie z innym domyślnym kodowaniem. Specyfikacja PDF zawiera mechanizmy umożliwiające wyraźne definiowanie kodowania znaków w pliku, ale nie wszystkie programy do tworzenia plików PDF implementują je poprawnie i spójnie.
Szczególnie podatne są pliki PDF w języku azjatyckim. Dokumenty zawierające tekst w języku chińskim, japońskim lub koreańskim, utworzone w systemie przy użyciu starszego kodowania, mogą nie mieć osadzonych niezbędnych map znaków. Otwarcie takiego pliku w innym systemie operacyjnym może spowodować kompletny bełkot, a nie tylko kilka zniekształconych znaków. W przypadku organizacji obsługujących dokumenty wielojęzyczne problemy z kodowaniem stanowią rzeczywiste ryzyko biznesowe, które może mieć wpływ na umowy, zgłoszenia prawne i komunikację z klientami.
Uszkodzone tabele czcionek i uszkodzona struktura pliku PDF
Problemy z czcionkami nie zawsze są spowodowane brakującymi plikami. Czasami dane czcionek znajdują się w pliku PDF, ale zostały uszkodzone. Plik PDF przechowuje informacje o czcionkach w strukturach zwanych tabelami czcionek, które odwzorowują kody znaków na opisy glifów. Jeśli tabele te ulegną uszkodzeniu podczas przesyłania plików, niekompletnego pobierania lub błędów dysku, aplikacja czytnika nie będzie w stanie poprawnie zinterpretować danych czcionek, mimo że są one technicznie osadzone.
Częściowe uszkodzenie może dawać najbardziej mylące rezultaty. Możesz widzieć poprawny tekst na większości stron, ale zniekształcone znaki na niektórych stronach lub litery, które są poprawnie wyświetlane w nagłówkach, ale nie pojawiają się w tekście głównym. Te wzorce powstają, ponieważ różne części pliku PDF odwołują się do różnych podzbiorów czcionek i tylko niektóre z tych podzbiorów są uszkodzone.
Podejście Napraw PDF jest często potrzebne, gdy zauważysz, że ten sam plik był wyświetlany poprawnie w zeszłym tygodniu, ale dzisiaj wyświetla zniekształcony tekst. Ten wzorzec zmian w czasie prawie zawsze wskazuje na uszkodzenie danych, a nie na problem z zamianą czcionek. Uszkodzenie plików może nastąpić podczas transmisji e-maili, synchronizacji w chmurze, a nawet wtedy, gdy urządzenie magazynujące zaczyna ulegać awarii.
Pliki PDF przechodzące przez wiele systemów są obarczone większym ryzykiem. Za każdym razem, gdy plik jest przetwarzany przez serwer poczty, usługę przechowywania w chmurze lub narzędzie do kompresji plików, istnieje niewielkie ryzyko uszkodzenia danych. W przypadku kilku transferów ryzyko to się zwiększa. Plik PDF przesyłany z pulpitu systemu Windows przez serwer poczty e-mail, filtr spamu i w końcu do klienta poczty Mac może wykryć uszkodzenie na każdym z tych etapów, a tabele czcionek, będące jedną z najbardziej złożonych części pliku PDF, są często pierwszymi strukturami, które wykazują uszkodzenia.
Niestandardowe formaty czcionek i starsze wersje plików PDF
Format PDF znacznie ewoluował od czasu jego wprowadzenia w 1993 r. Starsze pliki PDF mogą wykorzystywać formaty czcionek, których współczesne przeglądarki nie są już w pełni obsługiwane. Czcionki Type 1 (PostScript) były standardem we wczesnych plikach PDF, ale firma Adobe zaczęła je wycofywać w 2021 r. i zakończyła wycofywanie w 2023 r. (Adobe, „PostScript Type 1 Font End of Support”, 2023). Otwarcie pliku PDF zawierającego czcionki Type 1 w aktualnej wersji programu Adobe Acrobat lub nowoczesnej przeglądarce internetowej może spowodować powrót czcionki, co skutkuje zniekształceniem wydruku.
Podobnie niektórzy twórcy plików PDF osadzają czcionki w zastrzeżonych lub skompresowanych formatach, które tylko ich własne oprogramowanie może w pełni odszyfrować. Plik PDF wygenerowany przez starszą wersję programu AutoCAD może używać czcionek SHX, które są zasadniczo plikami kształtów, a nie standardowymi formatami czcionek. Większość przeglądarek plików PDF ogólnego przeznaczenia nie jest w stanie poprawnie ich renderować, a wynik w innym systemie operacyjnym jest przewidywalny: losowe symbole, źle wyrównane znaki lub spacje.
Niestandardowo zakodowane czcionki stanowią kolejne wyzwanie. Niektóre narzędzia do tworzenia plików PDF tworzą na bieżąco niestandardowe kodowanie znaków, odwzorowując glify użyte w dokumencie na dowolne pozycje w tabeli czcionek. Jeśli czytnik plików PDF nie przeanalizuje poprawnie tego niestandardowego kodowania, wyświetli nieprawidłowe glify. Tekst może nadal wyglądać jak prawdziwe słowa, ale z zamienionymi lub zastąpionymi literami, co czasami jest gorsze niż oczywiste śmieci, ponieważ czytelnik może nie od razu zorientować się, że treść jest błędna.
Jak naprawić plik PDF z zniekształconymi znakami
W przypadku napotkania zniekształconego pliku PDF istnieje kilka sposobów odzyskania czytelnego tekstu. Najszybszym rozwiązaniem jest często odtworzenie pliku PDF z oryginalnego dokumentu źródłowego. Otwórz oryginalny plik programu Word, dokument Google lub plik projektu i wyeksportuj go ponownie jako plik PDF z wyraźnie włączoną funkcją osadzania czcionek. W programie Microsoft Word to ustawienie znajduje się w obszarze Plik, Opcje, Zapisz, a następnie zaznacz opcję „Osadź czcionki w pliku”. W Dokumentach Google opcja pobierania w formacie PDF zawsze powoduje osadzenie czcionek. W programie Adobe InDesign lub Illustrator osadzaniem czcionek steruje się w ustawieniach eksportu w panelu Zaawansowane.
Jeśli oryginalny dokument źródłowy nie jest dostępny, WukongPDF może ponownie przetworzyć plik za pomocą silnika opartego na przeglądarce, który normalizuje dane czcionek i rozwiązuje konflikty kodowania niezależnie od systemu operacyjnego użytego do przeglądania danych wyjściowych. Pomocne może być także dedykowane narzędzie Napraw PDF, analizując wewnętrzne tabele czcionek PDF i próbując je zrekonstruować lub zmapować istniejące kody znaków na standardowe wartości Unicode.
Drukowanie pliku PDF do nowego pliku PDF to kolejne praktyczne obejście. Większość systemów operacyjnych zawiera opcję „Drukuj do pliku PDF”. lub „Zapisz jako PDF” opcję w oknie dialogowym drukowania. Kiedy drukujesz zniekształcony plik PDF do nowego pliku PDF, systemowy potok drukowania renderuje każdą stronę jako reprezentację przypominającą obraz, a następnie zapisuje ją w nowym, czystym pliku PDF. Proces ten całkowicie usuwa problematyczne odniesienia do czcionek i osadza jedynie ich reprezentację wizualną. Kompromis polega na tym, że nowy plik PDF nie będzie zawierał tekstu, który można wybierać ani przeszukiwać, ponieważ znaki są renderowane jako elementy graficzne.
W przypadku plików PDF z problemami z kodowaniem, a nie z brakującymi czcionkami, konwersja pliku do formatu pośredniego może zresetować mapowanie znaków. Niektóre narzędzia mogą wyodrębnić nieprzetworzony tekst z pliku PDF i zapisać go w nowym pliku z odpowiednim kodowaniem Unicode. To podejście sprawdza się dobrze w przypadku dokumentów, w których wyświetlany jest zniekształcony tekst alfabetu łacińskiego spowodowany niezgodnością kodowania, ale może nie pomóc w przypadku niestandardowego lub zastrzeżonego kodowania czcionek. W takich przypadkach metoda drukowania do pliku PDF jest bardziej niezawodna.
Zapobieganie problemom z czcionkami podczas tworzenia plików PDF do użytku na wielu platformach
Zapobieganie jest znacznie łatwiejsze niż naprawa. Jeśli regularnie tworzysz pliki PDF, które będą udostępniane w różnych systemach operacyjnych, kilka nawyków może wyeliminować prawie wszystkie problemy z wyświetlaniem związane z czcionkami.
Po pierwsze, podczas eksportowania do pliku PDF zawsze osadzaj czcionki. Każda większa aplikacja do tworzenia dokumentów i projektowania oferuje tę opcję, chociaż można ją nazwać inaczej: „Osadzanie czcionek”; „Dołącz czcionki”; lub „Podzestaw czcionek”. Podzbiór czcionek osadza tylko znaki faktycznie używane w dokumencie, a nie cały plik czcionki, co pozwala na zarządzanie rozmiarem pliku PDF, a jednocześnie zapewnia wszystkie potrzebne dane znakowe. Niewielki wzrost rozmiaru pliku to niewielka cena za gwarantowaną czytelność na wielu platformach.
Po drugie, jeśli ze względów licencyjnych nie jest możliwe osadzanie, trzymaj się standardowych lub powszechnie dostępnych czcionek. Gwarantujemy, że 14 standardowych czcionek Type 1 zdefiniowanych w oryginalnej specyfikacji pliku PDF, w tym Times, Helvetica, Courier i Symbol, będzie dostępnych w każdym czytniku plików PDF, niezależnie od systemu operacyjnego. Nowoczesne odpowiedniki, które są bezpieczne na różnych platformach, obejmują Arial, Times New Roman i rodzinę czcionek Google Noto, która obejmuje ponad 1000 języków i jest swobodnie rozpowszechniana.
Po trzecie, przed szeroką dystrybucją przetestuj plik PDF na co najmniej jednym innym systemie operacyjnym. Otwórz plik na urządzeniu z innym systemem operacyjnym niż ten, którego użyłeś do jego utworzenia. Sprawdź nie tylko pierwszą stronę, ale kilka stron w całym dokumencie i zwróć szczególną uwagę na znaki specjalne, litery akcentowane lub tekst w języku innym niż łaciński. Pięć minut testowania może zapobiec godzinom zamieszania wśród odbiorców.
Po czwarte, sprawdź właściwości pliku PDF po utworzeniu. Większość przeglądarek plików PDF może wyświetlić listę czcionek używanych w dokumencie i wskazać, czy każda czcionka jest osadzona, czy nie. W programie Adobe Acrobat jest to opcja Plik, Właściwości, Czcionki. W przeglądarkach przeglądarkowych lista czcionek jest zazwyczaj dostępna poprzez właściwości dokumentu lub narzędzia inspektora. Jeśli widzisz czcionki na liście „(Osadzone)” obok nich plik powinien wyświetlać się poprawnie na różnych platformach.
Na koniec rozważ użycie formatu PDF/A w przypadku dokumentów, które wymagają długoterminowej niezawodności na wielu platformach. PDF/A to wersja pliku PDF zgodna ze standardem ISO, która wymaga osadzania czcionek i zabrania funkcji mogących powodować niespójności renderowania. Został zaprojektowany specjalnie do archiwizacji przypadków użycia, w których dokumenty muszą pozostać czytelne przez dziesięciolecia w przyszłości, niezależnie od ewolucji systemów operacyjnych i technologii czcionek.
Spróbuj naprawić plik PDF
Nie wymaga instalacji. Działa bezpośrednio w Twojej przeglądarce.
